腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
配置Spark
写入
HDFS
的
Avro
文件大小
scala
、
apache-spark
、
hdfs
、
avro
我正在
将
Avro
格式的Spark
数据
帧
写入
HDFS
。我想拆分较大的
Avro
文件,以便它们适合
Hadoop
块大小,同时又不会太小。有没有什么dataframe或
Hadoop
选项?如何将要
写入
的文件拆分成更小的文件?下面是我
将
数据
写入
HDFS
的方法: dataDF.write .option
浏览 24
提问于2019-04-10
得票数 2
回答已采纳
1
回答
生成
Avro
架构文件并存储在
HDFS
中
centos
、
hdfs
、
avro
我正在使用
avro
工具从
HDFS
中的
avro
文件生成模式文件,并使用以下命令将其转储到Linux文件系统:这样做效果很好,可
浏览 17
提问于2016-09-24
得票数 1
1
回答
可以
将
WebHDFS与Flume一起使用吗?
hadoop
、
flume
、
flume-ng
、
webhdfs
我想让flume代理位于
hadoop
集群之外,并想知道是否可以使用flume
将
消息发送到使用WebHDFS的
hadoop
集群中。 如果没有,有没有使用WebHDFS的替代方案?使用多层flume仍然需要在
hadoop
集群中运行flume代理。
浏览 0
提问于2017-01-06
得票数 1
3
回答
无法从
avro
文件创建配置单元表
hive
、
create-table
、
avro
.
avro
.AvroSerDe''org.apache.
hadoop
.hive.ql.io.
avro
.AvroContainerInputFormat'TABLEPROPERTIES ('
avro
.schema.url'=
浏览 4
提问于2014-10-09
得票数 2
4
回答
将
数据
从.
avro
文件导入到单元表
apache
、
hadoop
、
hive
、
avro
我按照命令和
avro
模式创建了一个hive表。.
avro
.AvroSerDe'OUTPUTFORMAT'org.apache.
hadoop
.hive.ql.io.
avro
.AvroContainerOutputFormat''<e
浏览 9
提问于2017-01-25
得票数 4
回答已采纳
1
回答
Hadoop
文件格式
apache-spark
、
hadoop
、
hive
、
avro
、
parquet
我需要考虑如何
将
数据
写入
Hadoop
。我每天有大约200 B的记录。
数据
字段可能会改变(不是很多,但将来可能会改变),我该选什么?阿夫罗还是帕奎特?但还是不知道该选什么, 有什么建议吗?
浏览 1
提问于2018-07-01
得票数 1
回答已采纳
1
回答
使用进化的
avro
模式存储黑斑羚/蜂箱
mapreduce
、
hive
、
hadoop2
、
avro
、
impala
由于JSON结构正在发展,我们认为我们可以使用
Avro
。
avro
格式的
数据
可以直接由黑斑羚使用。假设我们将其存储在
HDFS
目录/user/
hdfs
/person_data/中。 ROW FORMAT SERDE 'org.ap
浏览 4
提问于2016-04-01
得票数 1
1
回答
在
HDFS
上仍打开编写器时获取文件大小
java
、
hdfs
、
avro
、
apache-kafka-connect
、
confluent-platform
从Kafka主题在
HDFS
上
写入
的
avro
文件,但org.apache.
hadoop
.fs.FileStatus一直返回0字节(
Avro
),而
写入
器仍处于打开和
写入
状态。我可以在
写入
器端保留一个长度的计数器,但在深层,
数据
被转换成长度与原始记录不同的二进制格式(
avro
)。它可以是近似的,但我正在寻找一个更精确的解决方案。有没有办法从
hdfs
(io.confluent.connect.
hd
浏览 5
提问于2018-08-22
得票数 0
回答已采纳
1
回答
将
AVRO
数据
写入
Hadoop
hdfs
hadoop
、
apache-kafka
、
avro
我有一个java Kafka用户,它正在使用来自kafka的
avro
数据
,比如主题x,它应该在没有代码生成的情况下
将
这些
数据
推送到
HDFS
。在
avro
中,他们使用了类似如下的东西:e1.put("key", "value")dataFileWriter = new DataFileWriter<GenericRecord>
浏览 2
提问于2016-08-12
得票数 0
回答已采纳
1
回答
Spark
avro
insertInto文件扩展名
hadoop
、
apache-spark
、
hive
.
avro
.AvroSerDe' || 'org.apache.
hadoop
.hive.ql.io.
avro
.AvroContainerInputFormat' || 'org.apache.
hadoop
.hive.ql.io.
avro</e
浏览 3
提问于2017-08-29
得票数 0
1
回答
执行错误,从org.apache.
hadoop
.hive.ql.exec.DDLTask返回代码1。无法验证serde: org.apache.
hadoop
.hive.serde2.
avro
.AvroSerde
hive
、
avro
、
flume-twitter
、
hive-serde
、
avro-tools
我正在创建一个使用
avro
serde存储twitter
数据
的hive表。这是密码- row format serde tblproperties('
avro<
浏览 3
提问于2017-01-14
得票数 0
2
回答
当我创建一个带有“存储为
Avro
”子句的hive表时,
AVRO
模式存储在哪里?
hive
、
schema
、
avro
、
metastore
至少有两种不同的方法可以创建一个以
Avro
数据
为后盾的蜂窝表: 创建表'org.apache.
hadoop
.hive.serde2.
avro
.AvroSerDe‘行格式SERDE ('
avro
.schema.url'='
hdfs
:///user/root/
avro
/schema
浏览 0
提问于2017-05-30
得票数 14
回答已采纳
1
回答
从流文件内容中提取多行内容
apache-nifi
、
hortonworks-data-platform
、
hortonworks-dataflow
我从MySQL表中导入
数据
(仅针对选定的列),并将其放入
HDFS
中。一旦完成,我想要在Hive中创建一个表。如果我
将
整个模式放入属性中,那么如何使用NiFi处理器甚至表达式语言来实现这一点呢? 还是有更好的方法在导入的
数据
上创建表?
浏览 0
提问于2018-09-23
得票数 2
回答已采纳
1
回答
没有从avsc架构创建的配置单元表的
数据
hive
、
sqoop
我
将
mysql中的
数据
以avroformat格式导入
hdfs
。我
将
.avsc文件移动到
hdfs
,并使用.avsc文件创建配置单元表。请参考下表: >
浏览 2
提问于2017-09-13
得票数 0
2
回答
使用嵌套子目录的输入创建表。
hadoop
、
hive
、
avro
、
create-table
、
hive-configuration
我在诸如:/data/logs/[foldername]/[filename].
avro
这样的文件路径中有
HDFS
格式的
Avro
格式的
数据
。.
avro
.AvroSerDe' 'org.apache.
hadoop
.hive.ql.io.
avro
.AvroContainerInputFormat' 'org.a
浏览 7
提问于2014-06-26
得票数 11
3
回答
如何让spark为空拼图输出写一个_SUCCESS文件?
apache-spark
目前,如果有输入,它不会向输出的目录
写入
任何内容,所以我无法确定是否出现了故障(这是一个更大的自动化管道的一部分,因此它会一直重新调度作业,因为没有迹象表明它已经运行了)。
浏览 30
提问于2016-02-24
得票数 5
2
回答
IOException:不是
数据
文件
hive
、
sqoop
在使用
Avro
数据
/模式创建Hive外部表时,我遇到了问题: Hive命令行声明创建的OK表。ShotTables显示表
浏览 0
提问于2016-09-11
得票数 1
1
回答
Kafka-连接
HDFS
- Protobuf到Parquet
hadoop
、
apache-kafka
、
hdfs
、
protocol-buffers
、
parquet
hadoop
.conf.dir=/etc/
hadoop
hadoop
.home=/etc/
hadoop
/client:701) at org.apache.
avro
.Schema.toString(Schema.java:324) at org.apache.<em
浏览 0
提问于2019-02-17
得票数 0
1
回答
把
avro
转换成拼花(也许用蜂巢?)
mapreduce
、
hive
、
apache-pig
、
avro
、
parquet
我正在尝试
将
一堆存储在
HDFS
(100秒的GBs)上的多部分
avro
文件转换为parquet文件(保存所有
数据
)。Hive可以使用以下方法
将
avro
文件读入外部表:ROW FORMAT SERDE 'org.apache.
hadoop
.hive.serde2.
avro
.AvroSerDe' STORED as INPUTFORMAT 'o
浏览 2
提问于2016-12-02
得票数 0
1
回答
在
HDFS
中存储
Avro
文件
python
、
hdfs
、
avro
、
bigdata
我正在尝试在
HDFS
上存储大量
数据
。我已经能够使用Python生成
Avro
文件。
Avro
是否提供
将
输出直接存储到
HDFS
的功能?
浏览 11
提问于2017-03-04
得票数 0
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
实时音视频
云点播
活动推荐
运营活动
广告
关闭
领券