腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
AVRO
文件
上的Hive外部表只为所有列生成空数据
hadoop
、
hive
、
avro
、
spark-avro
、
hive-table
我试图
在
一些使用Hive external table生成的
avro
文件
的基础上创建一个spark-scala。我使用的是CDH 5.16,它有hive 1.1,spark 1.6。但是我在这个位置找不到这些
avro
文件
的架构
文件
。 我对
avro
文件
类型非常陌生。有人能帮我一下吗。("
hdfs
:path/user/hive/warehouse/transform.db/pro
浏览 1
提问于2019-07-17
得票数 2
回答已采纳
1
回答
在
HDFS
中
存储
Avro
文件
python
、
hdfs
、
avro
、
bigdata
我正在尝试
在
HDFS
上
存储
大量数据。我已经能够使用Python生成
Avro
文件
。
Avro
是否提供将输出直接
存储
到
HDFS
的功能?
浏览 11
提问于2017-03-04
得票数 0
回答已采纳
1
回答
具有多个
Avro
模式的flume
schema
、
flume
、
avro
、
serialization
我使用Flume将较小的
Avro
文件
(每个
文件
包含两个
Avro
事件)组合成较大的
文件
,以
存储
在
HDFS
中
。我正在使用缓冲源和
HDFS
接收器,与
Avro
序列化程序。我的Spool目录包含具有3种不同模式的
文件
。是否可以将Flume配置为将具有每个不同模式的
Avro
文件
组合到不同的接收器
文件
中
? 提前感谢
浏览 2
提问于2015-01-22
得票数 1
1
回答
允许
在
配置单元表的字段中使用空值
hive
、
avro
我正在从
存储
在
hdfs
中
的
avro
文件
创建一个配置单元表。而且,这个
avro
文件
是从mongodb集合生成的。问题是有些字段有空值,我希望hive表
中
的字段除了应该
存储
的内容(如int、string、array等)之外,还可以接受null值。我使用以下命令创建了配置单元表ROW FORMAT SERDE 'org.apache
浏览 1
提问于2018-07-25
得票数 0
1
回答
使用水槽的日志数据未正确
存储
在
蜂巢
中
logging
、
hadoop
、
hive
、
flume
、
avro
现在,flume代理正在所有3 App服务器上运行,并将日志消息从app服务器传递到
Hdfs
服务器,
在
Hdfs
服务器上运行另一个flume代理,并最终将日志
存储
在
hadoop
文件
系统
中
。但是一切都很顺利,除了hive无法正确解析日志数据并
存储
在
表
中
这一事实之外。这里是我的水槽和蜂巢配置:应用服务器上的Flume conf: app-agent.sour
浏览 2
提问于2014-07-17
得票数 0
回答已采纳
1
回答
使用进化的
avro
模式
存储
黑斑羚/蜂箱
mapreduce
、
hive
、
hadoop2
、
avro
、
impala
假设我们将其
存储
在
HDFS
目录/user/
hdfs
/person_data/
中
。 我们将继续将
avro
序列化数据放在该
文件
夹
中
,并将一个接一个地解析输入json。比方说,我们有一个针对person的
avro
模式
文件
(
hdfs
://user/
hdfs
/
avro
/scheams&
浏览 4
提问于2016-04-01
得票数 1
1
回答
蜂巢导入与导入
AVRO
格式不兼容。
import
、
sqoop
蜂巢导入与导入到
AVRO
格式不兼容。
浏览 0
提问于2018-02-23
得票数 1
1
回答
无法验证serde: org.apache.hadoop.hive.serde2.
avro
.AvroSerde
hive
、
avro
、
flume-twitter
、
hive-serde
、
avro-tools
我正在创建一个使用
avro
serde
存储
twitter数据的hive表。
hdfs
://user/itelligence/ee/TwitterDataAvroSchema.avsc');FAILED: Execution Error, return code 1Cannot validate serde: org.apache.hadoop.hive.serde2.
avro
.AvroSerdet
浏览 3
提问于2017-01-14
得票数 0
1
回答
从流
文件
内容中提取多行内容
apache-nifi
、
hortonworks-data-platform
、
hortonworks-dataflow
我从MySQL表中导入数据(仅针对选定的列),并将其放入
HDFS
中
。一旦完成,我想要在Hive
中
创建一个表。为此,我有一个schema.sql
文件
,其中包含整个表的CREATE语句,我只想为导入的列生成新的CREATE语句。 还是有更好的方法
在
导入的数据上创建表?
浏览 0
提问于2018-09-23
得票数 2
回答已采纳
2
回答
当我创建一个带有“
存储
为
Avro
”子句的hive表时,
AVRO
模式
存储
在哪里?
hive
、
schema
、
avro
、
metastore
至少有两种不同的方法可以创建一个以
Avro
数据为后盾的蜂窝表: 创建表'org.apache.hadoop.hive.serde2.
avro
.AvroSerDe‘=’
hdfs
:///user/root/
avro
/schema/user.avsc‘);
浏览 0
提问于2017-05-30
得票数 14
回答已采纳
1
回答
从
HDFS
读取简单的
Avro
文件
java
、
io
、
avro
我正在尝试对
存储
在
HDFS
中
的
Avro
文件
进行简单读取。String value = datum.get(1).toString();} 然而,我的
文件
在
HDFS
中
。如何在
HDFS
中
简单地读取
Avro
文件
? 编
浏览 0
提问于2012-07-24
得票数 6
回答已采纳
2
回答
从
hdfs
将
avro
文件
加载到pyspark数据格式
中
python
、
apache-spark
、
pyspark
、
apache-spark-sql
、
avro
现在让我解释一下我是如何做到的,这样您就可以看到我可能失败的地方了:我的目标是将json数据从本地目录推送到
HDFS
,这样我就可以使用pySpark=
avro
_event这是没有任何错误的运行,所以我假设flume将每个
文件
作为正确的
avro
文件
移动到2)通过
浏览 1
提问于2018-09-03
得票数 1
1
回答
如何利用水槽将数据从一个系统传输到另一个系统的
HDFS
(通过局域网连接)?
hdfs
、
lan
、
transfer
、
hadoop-streaming
、
flume
我需要通过水槽将数据从系统传输到另一个系统的
HDFS
位置。致以敬意, 阿蒂拉姆
浏览 2
提问于2014-03-10
得票数 0
回答已采纳
1
回答
flume根据
文件
大小进行滚动时,将数据拷贝到
hdfs
所需的时间
hadoop
、
flume
我有一个用例,我想使用flume将远程
文件
复制到
hdfs
中
。我还希望复制的
文件
应该与
HDFS
块大小(128MB/256MB)对齐,远程数据的.Total大小为33 is。我使用
avro
源和接收器将远程数据复制到
hdfs
中
。类似地,
在
接收器端,我正在做
文件
大小滚动(128,256).but,用于从远程机器复制
文件
并将其
存储
到
hdfs
(
文件
浏览 2
提问于2016-11-10
得票数 0
1
回答
基于
文件
结构的蜂箱表创建
hadoop
、
hive
我有一个疑问,
在
蜂箱
中
是否有任何方法在装载期间创建表到蜂窝仓库或外部表。而不是如何将这些
文件
加载到hive表
中
。因此,简而言之,如何在不知道
HDFS
的架构结构的情况下将
文件
从
HDFS
加载到HIVE Table。谢谢
浏览 1
提问于2018-07-07
得票数 2
回答已采纳
1
回答
Flume:目录到
Avro
->
Avro
到
HDFS
-传输后无效
hadoop
、
hdfs
、
flume
、
avro
我有用户编写
AVRO
文件
,我想使用Flume使用Flume将所有这些
文件
移动到
HDFS
中
。因此,以后我可以使用Hive或Pig来查询/分析数据。.port = 41414a1.sources =
avro
1a1.channels = c1 a1每当
文件
是有效的
AVRO
<
浏览 2
提问于2014-02-07
得票数 5
回答已采纳
1
回答
包含选定列的
HDFS
群集内拷贝
hadoop
、
hive
、
hdfs
、
avro
、
distcp
我正在使用
Avro
文件
在
HDFS
中
存储
数据。我需要从一个
avro
文件
中
复制选定的列数据,并将其发送到具有其自己的架构
文件
(包含选定列信息)的同一群集中的另一个位置。我该怎么做呢?或者,
HDFS
中有没有什么实用程序可以帮助我做到这一点? 这是必需的,因为一个组必须能够访问整个表,而另一个组应该只能访问几列。因此,我需要将它们放在
HDFS
中
的单独位置,其中只包含所需的
浏览 10
提问于2017-08-10
得票数 0
回答已采纳
2
回答
Spark SQL看不到
hdfs
文件
java
、
hadoop
、
apache-spark
、
hdfs
我已经将
文件
添加到
hdfs
:
文件
存在于
hdfs
上(可用的日志:
文件
可读/可执行/可写),但我无法使用sparkSQL API从该
文件
读取信息: File file = new File(path + "/test.
avro</
浏览 0
提问于2017-08-08
得票数 0
1
回答
HDFS
中
Avro
模式的生成
hadoop
、
apache-spark
、
avro
、
spark-avro
我有一个场景,我
在
HDFS
.And中有一些
avro
文件
集,我需要在
HDFS
.I
中
为这些
Avro
数据
文件
生成
AVRO
模式
文件
。我尝试使用Spark ()进行研究。除了将
AVRO
数据
文件
带到本地并执行
HDFS
PUT之外,还有其他方法吗? 任何建议都是welcomed.Thanks!
浏览 0
提问于2016-10-14
得票数 0
1
回答
图像的
Avro
文件
类型?
hadoop
、
avro
、
sequencefile
我试着
在
Hadoop中使用to...figure这个例子。 什么是最好的
文件
格式
Avro
或SequenceFile,以防将图像
存储
在
HDFS
中
,然后用Python处理它们?SequenceFile是面向关键值的,所以我认为
Avro
文件
会工作得更好吗?
浏览 2
提问于2014-06-07
得票数 1
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
即时通信 IM
云直播
活动推荐
运营活动
广告
关闭
领券