腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
使用
flume
-
advice
获取
流
数据
flume
、
hortonworks-data-platform
我需要从网站()实时
获取
数据
,并将
数据
存储到HDFS (我
使用
hortonworks)。我阅读了不同的技术来做到这一点,我找到了一个名为
Flume
的工具(包含在hortonworks中)。
Flume
对我的情况有帮助吗?或者你有其他的技术?西蒙!
浏览 30
提问于2018-01-30
得票数 0
3
回答
使用
SQOOP和
FLUME
将
数据
从RDBMS移动到Hadoop
hadoop
、
sqoop
、
flume
我正在学习Hadoop,在将
数据
从关系
数据
库移动到Hadoop以及从关系
数据
库移动到Hadoop的过程中,我只掌握了几个概念。我已经
使用
SQOOP import查询将文件从MySQL传输到HDFS。我传输的文件是结构化
数据
集,而不是任何服务器日志
数据
。我最近读到我们通常
使用
flume
将日志文件移动到Hadoop中,我的问题是: 1.我们是否也可以
使用
SQOOP来移动日志文件?2.如果可以,对于日志文件,SQOOP和
FLUME<
浏览 1
提问于2014-03-18
得票数 2
1
回答
Flume
-twitter
流
API
hadoop-streaming
、
flume
、
flume-ng
、
flume-twitter
我是新的水槽,我已经
使用
水槽从twitter的
数据
流
使用
搜索API。但是twitter json将"geo“键设置为null。那么,是否有一种方法可以
使用
Flume
中的
流
API
获取
twitter
数据
呢?
浏览 1
提问于2015-04-14
得票数 0
2
回答
使用
flume
将
数据
存储在linux本地目录中
hadoop
、
hdfs
、
flume
是否可以
使用
flume
从oracle
获取
数据
,并将其存储在Linux本地文件夹中,而不是hdfs中?
浏览 0
提问于2013-07-18
得票数 0
回答已采纳
1
回答
通知bean中的Spring集成"onSuccessExpression“语法
java
、
spring
、
spring-integration
我有一个Spring Integration
流
的配置类,它在
流
的末尾有一个文件输出通道适配器。我
使用
ConsumerEndpointSpec.
advice
()在文件复制完成后发出通知。
advice
= new ExpressionEvaluatingRequestHandlerAdvice();
advice
.setFailureChannel(fileCopy
浏览 9
提问于2017-01-14
得票数 1
回答已采纳
3
回答
火花
流
无法读取从hdfs中的水槽中创建的文件
hadoop
、
apache-spark
、
hdfs
、
spark-streaming
、
flume-ng
我创建了一个实时应用程序,在这个应用程序中,我
使用
flume
从weblog中将
数据
流
写入hdfs,然后
使用
火花
流
处理该
数据
。但是,尽管
flume
正在hdfs中编写和创建新文件,但spark
流
无法处理这些文件。如果我
使用
put命令将这些文件放到hdfs目录中,火花
流
就能够读取和处理这些文件。
浏览 9
提问于2015-06-09
得票数 2
回答已采纳
2
回答
Sqoop和水槽的澄清
hadoop
、
sqoop
、
flume
、
bigdata
我对大
数据
非常陌生,我对Sqoop和
Flume
几乎没有什么混淆。 我的困惑是因为我所看到的大
数据
体系结构(我没有虚拟副本),分组结构化
数据
,它由Sqoop传输,非结构化
流
由
Flume
传输。高频
数据
呢?
Flume
是否支持非结构化<em
浏览 4
提问于2016-05-31
得票数 0
回答已采纳
1
回答
如何过滤并将
流
数据
从apache转换为rdd/data,
使用
spark将其写入表
apache-spark
、
apache-spark-sql
、
spark-streaming
、
flume
嗨,我是水槽/火花/火花
流
的新手。我已经配置了水槽和netcat,并成功地将
数据
流到Spark。我的要求是从日志文件中检查
流
数据
(流流)中的错误,并
获取
错误行(
流
中的单词" Error“),并将其作为DF写入oracle。import org.apache.spark.streaming.
flume
.FlumeUtils import org.slf4j.LoggerFacto
浏览 0
提问于2018-10-19
得票数 0
回答已采纳
2
回答
有没有办法在没有
Flume
的情况下
使用
Spark将Kafka中的
流
数据
加载到HDFS中?
apache-spark
、
apache-kafka
、
hdfs
、
flume
我在寻找是否有一种方法可以
使用
spark streaming而不
使用
Flume
将
流
数据
从Kafka直接加载到HDFS中。我已经用
Flume
(Kafka源和HDFS接收器)试过了。 提前感谢!
浏览 0
提问于2017-10-19
得票数 0
1
回答
Flume
代理:
flume
代理如何从位于不同物理服务器的gets服务器
获取
数据
flume
、
flume-ng
我正在尝试理解
Flume
,并参考
flume
在
flume
.apache.org的官方页面 特别是,在提到时,我对此感到有点困惑。我们是否需要在实际的we服务器上运行
flume
代理,或者我们是否可以在不同的物理服务器上运行
flume
代理并从we服务器
获取
数据
?如果上面是正确的,那么
flume
agent是如何从then服务器日志中
获取
数据
的?webserver如何使其
数据
可供
flume
浏览 1
提问于2018-04-09
得票数 0
1
回答
Flume
+Spark -在HDFS中存储DStream
apache-spark
、
spark-streaming
、
flume
我有水槽
流
,我想把它存储在HDFS通过火花。)}[root@sandbox ~]# hadoop fs -cat /user/root/spark/
flume
_Maporg.apache.spark.streaming.
flume
.SparkFlumeEvent@f9ed85f!!!!org.apache.spark.streaming.
flume
.SparkFlumeEve
浏览 3
提问于2016-04-01
得票数 2
回答已采纳
1
回答
Apache和
Flume
可以互换
使用
吗?
hadoop
、
bigdata
、
sqoop
、
flume
我对大
数据
很陌生。从的一些答案中,
Flume
和Sqoop都可以从源中提取
数据
并推送到Hadoop。有谁能说明一下在哪里
使用
水槽和sqoop在哪里?两者都可以用于相同的任务吗?
浏览 6
提问于2014-11-27
得票数 3
回答已采纳
1
回答
如何
使用
HTTP源设置Apache
Flume
并
使用
File_Roll接收器将
数据
保存在本地
flume
、
flume-ng
这个问题的目标是如何创建一个Apache
Flume
设置,在其中我们将从HTTP
Flume
Source
获取
数据
,并
使用
File-Roll
Flume
Sink保存该
数据
。在这里,我们从用户那里
获取
了输入
数据
。收到用户的
数据
后,我们将该
数据
保存到一个文本文件中。
浏览 50
提问于2021-06-25
得票数 0
1
回答
水槽推特
流
java
、
hadoop
、
twitter4j
、
flume
、
flume-twitter
我正在尝试执行
flume
来从twitter
流
中
获取
数据
,但是在执行
flume
时收到了此错误。错误- org.apache.
flume
.lifecycle.LifecycleSupervisor$MonitorRunnable.run(LifecycleSupervisor.java:253)无法启动EventDrivenSourceRunner:{ source:com.cloudera.
flume
.source.TwitterSource{name:Twitter,状
浏览 2
提问于2018-10-31
得票数 0
回答已采纳
1
回答
如何将
流
日志
数据
追加到
Flume
中的hdfs文件中?有没有人有将
数据
追加到hdfs文件中的MR源代码
streaming
、
hdfs
、
flume
我需要
使用
Flume
将
流
数据
附加到hdfs中。在不覆盖现有日志文件的情况下,我需要将
流
数据
附加到hdfs中的现有文件中。您可以提供相同的MR代码的链接。
浏览 3
提问于2016-11-21
得票数 0
3
回答
向hawq插入流
数据
hadoop
、
hdfs
、
hawq
、
nosql
如何将
流
数据
插入hawq并对在线
数据
执行查询。 我测试了jdbc插入,性能非常差。之后,我用
flume
测试了向hdfs写入
数据
,并在hawq中创建了外部表,但是hawq在
flume
关闭文件之前无法读取
数据
。第三种解决方案是hbase,但是由于我的大多数查询都是聚集在许多
数据
上的,所以hbase不是一个很好的解决方案(hbase很适合
获取
单个
数据
)。那么,有了这些约束,用hawq在线查询流式
数据
的
浏览 8
提问于2016-08-17
得票数 0
回答已采纳
1
回答
Apache
Flume
与Apache Flink差异
flume
、
apache-flink
、
flume-ng
、
flink-streaming
我需要从某个源读取
数据
流
(在我的例子中它是UDP
流
,但这并不重要),转换每个记录并将其写入HDFS。但是我是新来的弗林克,所以对我来说,弗林克也会这么做。求你了救命!
浏览 0
提问于2016-10-04
得票数 11
1
回答
Cloudera的
Flume
vs Facebook的Scribe
logging
、
flume
、
scribe-server
我需要设置一个框架来移动
数据
。基本上,我们有以文本文件形式传入的点击
流
数据
。这些
数据
需要在归档后从应用程序服务器移动到HDFS,然后再移动到S3。 我需要帮助在
Flume
和Scribe之间做出选择。
浏览 0
提问于2011-09-25
得票数 2
回答已采纳
3
回答
使用
apache spark流进行实时日志处理
apache-spark
、
apache-kafka
、
flume
、
spark-streaming
我想创建一个可以实时读取日志的系统,并
使用
apache spark对其进行处理。我很困惑是应该
使用
kafka或
flume
之类的东西来传递日志到spark stream,还是应该
使用
套接字来传递日志。
浏览 2
提问于2015-02-22
得票数 9
回答已采纳
1
回答
将
数据
从hdfs写入运动
流
amazon-web-services
、
hadoop
、
apache-spark
、
amazon-kinesis
我需要将hdfs中的
数据
写入到kinesis
流
中,以便进一步计算。有人可以指导我如何将
数据
从hdfs放到kinesis
流
中吗?例如,我在hdfs上有拼图格式的
数据
。我现在想把
数据
放到动态
流
中。
浏览 2
提问于2017-09-23
得票数 0
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
实时音视频
云点播
活动推荐
运营活动
广告
关闭
领券