腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
2
回答
如何
解除
Hive
中
每个
节点
的
分区
限制
?
hadoop
、
hive
、
partitioning
我在
Hive
中有一个
分区
表。对于
每个
节点
,我将
分区
限制
设置为2000。set
hive
.exec.max.dynamic.partitions.pernode=2000有没有人能帮我一
浏览 16
提问于2016-09-26
得票数 1
1
回答
蜂巢
中
的
分区
performance
、
hadoop
、
hive
、
partitioning
、
sqoop
我使用
hive
中
的
静态
分区
来根据date字段将数据重新划分到子目录
中
,我需要为
每个
表(总共14个表)每年需要365个
分区
,因为我每天都要将数据加载到
hive
中
。是否对可以在单元格
中
创建
的
静态
分区
的
数量有任何
限制
?在sqoop导入
中
,如果"
hive
.exec.max.dynamic.partitions
浏览 0
提问于2015-03-17
得票数 4
1
回答
限制
对配置单元
分区
的
访问
hive
、
partition
我有一个具有50个
分区
的
Hive
表Person (
每个
州一个
分区
)。有什么方法可以
限制
访问
Hive
中
的
分区
吗?例如:我希望用户只能访问
分区
CA和IL,任何方式都可以在
Hive
中
实现这一点。
浏览 2
提问于2014-11-04
得票数 0
1
回答
`
hive
.exec.max.dynamic.partitions`和`
hive
.exec.max.dynamic.partitions.pernode`之间
的
区别
hadoop
、
hive
我正在寻找一些文档来理解
hive
.exec.max.dynamic.partitions和
hive
.exec.max.dynamic.partitions.pernode之间
的
区别。我们什么时候需要设置这些参数,这些参数
的
用途是什么?
hive
.exec.max.dynamic.partitions=500
hive
.exec.max.dynamic.partitions.pernode=500
浏览 56
提问于2020-04-14
得票数 3
回答已采纳
1
回答
蜂箱装载时间
hadoop
、
hive
、
hiveql
如何
提高5GB数据组
的
加载时间?通常,使用多
节点
集群处理5GB
的
数据需要多长时间?我使用
的
是单个
节点
集群。请帮帮忙
浏览 5
提问于2015-11-12
得票数 0
回答已采纳
1
回答
火花数据
的
极限函数
apache-spark
当我有一个
限制
语句在我
的
火花数据框架,它仍然读取整个表/
分区
之前,它
限制
在
限制
中
的
行数。spark.table("table_name").limit(1).show() 这最终启动了30个任务(表
中
的
每个
文件都有一个),而在我
的
记忆
中
,它只需读取第一个文件就可以返回。无论
如何
,我是否可以通过打开一些优化设置来避免这种情况,比如
浏览 0
提问于2019-02-07
得票数 0
1
回答
单元格:在查询
中
强制执行where子句
hive
、
hiveql
我们有一个按日期划分
的
单元表,我们希望最终用户总是在查询中使用where子句,如果他们不使用它,它应该抛出异常。 蜂巢里有什么设置,可以强制执行吗?
浏览 1
提问于2017-03-16
得票数 0
1
回答
Spark HiveContext: HDFS上包含多个文件
的
表
python
、
apache-spark
、
dataframe
、
hdfs
我有一个
Hive
表X,它在HDFS上有多个文件。表X在HDFS上
的
位置是/data/
hive
/X。文件:/data/
hive
/X/f2 /data/
hive
/X/f3 ...是否将
每个
文件视为单独
的
分区
,并由单独
的
节点
浏览 8
提问于2016-09-14
得票数 0
回答已采纳
2
回答
如何
提高蜂箱
中
从非
分区
表加载数据到ORC
分区
表
的
性能
hadoop
、
hive
、
hadoop-yarn
、
azure-hdinsight
我对
Hive
查询很陌生,我正在寻找从
Hive
表
中
检索数据
的
最佳实践。我们已经启用了TeZ具有执行引擎和启用了矢量化。 我们希望从
Hive
表中进行报告,我从TEZ文档中看到,它可以用于实时报告。场景来自我
的
WEB应用程序,我希望在UI上显示来自
Hive
query * from
Hive
表
的
结果,但是对于任何查询,即使
hive
表有60 GB
的
数据,在单元格命令提示符
中
至少需要20-6
浏览 2
提问于2015-03-07
得票数 1
回答已采纳
2
回答
HDFS与单元
分区
hadoop
、
hive
、
hdfs
、
cloudera
、
partitioning
当数据被加载到HDFS时,它
的
分布并加载到多个
节点
中。对数据进行
分区
和分布。 对于单元,有一个单独
的
选项来划分数据。我非常肯定,即使您没有提到
分区
选项,在加载一个
hive
表时,数据也会被拆分并分发到集群
中
的
不同
节点
。在这种情况下,这个命令会带来什么额外
的
好处。
浏览 3
提问于2017-07-18
得票数 5
回答已采纳
1
回答
带Galera簇
的
MariaDB
分区
旋转
mysql
、
mariadb
、
partitioning
、
galera
如何
在Galera集群上实时管理
分区
旋转?CREATE DEFINER=`root`@`localhost` PROCEDURE `manage_partitions`() if @@GLOBAL.wsrep_onpartitions
浏览 1
提问于2016-12-03
得票数 1
3
回答
Hive
中
的
多个
分区
hadoop
、
hive
、
partitioning
对于列"id“,我有大约200,000个不同
的
值,并且我已经将它用作一个动态
分区
的
Hive
表
中
的
分区
键。现在
分区
已经创建,当我尝试查询(我已经使用了简单
的
Select *查询)时,它总是返回以下错误: FAILED: SemanticException org.apache.hadoop.
hive
.ql.metadata.HiveException
浏览 0
提问于2015-11-20
得票数 2
1
回答
星火
如何
对蜂巢执行写操作
apache-spark
、
hive
我正在做一项工作,从某个源读取数据,进行一些转换,并将其写入
Hive
。为了给蜂巢写信,我正在做dataframe.write.insertInto(
hive
_table) 我
的
问题是,星火
如何
将整个dataframe写到
Hive
?它是并行写入,就像不同执行程序上
的
不同
分区
将被并行写入,还是会将来自不同
分区
的
所有数据收集到驱动程序,然后尝试一次插入?
浏览 1
提问于2021-03-25
得票数 0
回答已采纳
2
回答
Apache
hive
-
如何
在show命令
中
限制
分区
hive
在show命令
中
列出
分区
时,有没有办法
限制
配置单元
分区
的
数量?我尝试设置
hive
.limit.query.max.table.partition=1,但这
浏览 33
提问于2018-01-22
得票数 1
1
回答
如何
有效地处理易失性记录
hadoop
、
hive
、
hdfs
我有这个问题,我想和其他人一起运行,看看我是否能以更好
的
方式处理这个问题。业务是这样
的
,我们可能会得到几个月或几年前创建
的
事务
的
更
浏览 1
提问于2014-03-30
得票数 0
1
回答
如何
使用Apache Nifi在多个
节点
上运行Kafka消费者处理器实例
apache-kafka
、
apache-nifi
kafka客户端
的
输出连接到
hive
处理器。有没有我
浏览 3
提问于2019-08-04
得票数 0
1
回答
由于配置单元元存储
中
的
许多
分区
而导致
的
错误
apache-spark
、
hive
、
apache-spark-sql
、
metastore
我使用Apache spark-sql从数据库
中
查询数据。我知道Spark在默认情况下共享同一转移
的
hive
。我已经根据列id对输入数据进行了
分区
,这些列有超过300k个不同
的
值。到目前为止,该表有超过300k
的
分区
,而且还会定期增加。 有没有因此而产生
的
问题?
浏览 0
提问于2015-11-23
得票数 0
3
回答
生成多个小文件
的
单元查询
hadoop
、
hive
说 上面的问题是,
每个
分区
生成400个文件,
每个
文件
的
大小在200 K左右。我尝试过多个参数组合:set
hive
.exec.reducers.bytes.per.reducer=256000000; 结果1减速器数量减少到100个,因此
每个
分区</e
浏览 4
提问于2016-02-10
得票数 0
1
回答
如何
设置动态
分区
,其中列键将是
分区
hadoop
、
apache-spark
、
dynamic
、
hive
、
partition
所以我有一个表A和表B,其中表A数据是从表B
中
插入
的
。本质上,表A和表B是相同
的
,唯一
的
区别是表A有一个date_partition列,而表B没有。表B模式是: ID int school_bg_dt bigint log_on_count int active_count int date_partition字符串set
hive
.exec.dynamic.partition=true; set
hive</em
浏览 3
提问于2016-10-28
得票数 0
回答已采纳
1
回答
关于配置单元表存储
hive
我已经创建了一个不是
分区
表
的
HIVE
表,但我在一个10
节点
集群
中
工作,那么在这种情况下,该表(表是一个大表)
的
数据是否会分布在不同
的
数据
节点
上?或者它将只存在于一个
节点
中??如果它分布在不同
的
数据
节点
上,那么我们
如何
才能看到\
hive
\warehouse文件夹下
的
一个文件呢? 另外,请不要说明这个存储是
如何
分配给一个
分区
浏览 2
提问于2015-02-26
得票数 0
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
云点播
实时音视频
活动推荐
运营活动
广告
关闭
领券