腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
Delta Lake
表
元
数据
delta-lake
Delta Lake在
哪里
存储
表
元
数据
信息。我
在
我的独立机器上使用的是
spark
2.6(不是Databricks)。我的假设是,如果我重启
spark
,
在
delta
中
创建的
表
将被删除(尝试使用Jupyter notebook)。但事实并非如此。
浏览 31
提问于2020-07-21
得票数 1
回答已采纳
1
回答
关于
Spark
sql
表
和
数据
库的问题
apache-spark
、
pyspark
、
apache-spark-sql
我是
Spark
的新手,对以下几点感到困惑: 当我们为自己的分析创建新的
数据
库和全局
表
(使用dataframe API或
spark
sql)时,这些是在
哪里
创建/
存储
的?这些
数据
是
存储
在
Spark
memory
中
,还是
存储
在
Spark
读取
数据
的外部
存储
中
(可以是Hive/HD
浏览 2
提问于2021-04-19
得票数 0
1
回答
表
数据
在
Spark
中
存储
在
哪里
?
apache-spark
、
apache-spark-sql
、
apache-spark-2.0
嗨,我想找出SparkSQL
在
Spark
中
存储
表
元
数据
的位置?如果默认情况下它不在配置单元元
存储
中
,那么它
存储
在
哪里
?
浏览 113
提问于2019-03-10
得票数 2
回答已采纳
1
回答
星星之火上的星星之火
apache-spark
、
hive
、
apache-spark-sql
、
spark-dataframe
我正在浏览星火和sql的文档,并试图理解
Spark
和星火上的蜂巢之间的区别。考虑一种情况,当我
在
没有的情况下启动星火会话--任何明显的单元支持,比如复制hive-site.xml,然后将
表
持久化到我的
spark
程序
中
,
数据
和元
数据
将
存储
在
哪里
。考虑一种情况,当我启动一个星星之交时,它支持单元,比如复制hive-ste.xml并使
spark
意识到现有的蜂巢。然后,如果我持久化,
表
将
数据</em
浏览 3
提问于2016-08-08
得票数 1
1
回答
Spark
_SQL模式和
表
数据
将
存储
在
哪里
?
hadoop
、
apache-spark
、
hive
、
apache-spark-sql
我对火花(
spark
_sql )很陌生,我已经将
数据
加载到
spark
_sql
中
,我还创建了
表
并将一些
数据
加载到其中。 我的问题是:模式和
表
数据
将
存储
在
哪里
?
浏览 3
提问于2017-02-14
得票数 0
3
回答
无法从配置单元查询`saveAsTable`之后的
Spark
DF -
Spark
SQL特定格式,与配置单元不兼容
scala
、
apache-spark
、
hadoop
、
hive
、
apache-spark-sql
我正在尝试将
数据
帧保存为外部
表
,该
表
将同时使用
spark
和可能的hive进行查询,但不知何故,我无法使用hive查询或查看任何
数据
。它在
spark
中
工作。以下是如何重现该问题的方法:hivesc
浏览 3
提问于2019-08-02
得票数 0
1
回答
星星之火创建的
数据
库到
哪里
去了?
azure-ml
我正在学习本教程:https://docs.microsoft.com/en-us/learn/modules/intro-to-azure-databricks/4-using-notebooks%sql USE Databricks; CREATE TABLE IF NOT/mnt/training/asa&
浏览 0
提问于2019-12-29
得票数 2
2
回答
通过sparkSQL创建蜂窝
apache-spark
、
hive
、
apache-spark-sql
、
data-processing
我对蜂巢
中
的扣环有一个疑问。我已经创建了一个临时
表
,该
表
在
列关键字上
存储
桶。当我检查这个
表
的基目录时,它显示了前缀为part_*的文件名。但是,当我通过另一个
表
手动将
数据
插入到这个
表
浏览 1
提问于2018-08-02
得票数 5
2
回答
HiveContext没有读取Orcfile的架构
scala
、
apache-spark
、
hive
、
orc
、
hortonworks-sandbox
当我
在
Hive
中
“描述mytable”时,它会正确地打印列名,但当我运行'orcfiledump‘时,它也会显示_col0、_col1、_col2。我是否必须指定“读取上的模式”或其他什么?如果是,我如何在
Spark
/Scala
中
做到这一点?warehouse/mydb.db/mytable1fieldNames: "_col0"fieldNames: "_col2"
浏览 5
提问于2016-08-02
得票数 3
回答已采纳
1
回答
如果没有启用Hive支持,那么在
哪里
创建火花
表
?
apache-spark
当我
在
Spark
2
中
使用SQL语法创建
表
时,创建的
表
在
哪里
?星火是否会在内部
存储
,必须始终支持Impala或Hive支持星火
表
才能工作?
浏览 0
提问于2018-12-04
得票数 1
回答已采纳
1
回答
WSO2DAS
中
的分析
wso2
、
wso2-das
在
wso2das的
spark
console上运行select查询时,我得到一个找不到
表
的错误。安装完成后,我保留了所有的默认配置。我无法从事件流
中
获取
数据
,即使它显示在
数据
资源管理器的
表
下拉列表
中
。
浏览 0
提问于2016-02-03
得票数 0
2
回答
Spark
SQL扮演什么角色?内存DB?
apache-spark
、
apache-spark-sql
最近我开始使用
Spark
SQL。我读了
数据
源Api,仍然不明白
Spark
SQL的作用是什么。真的愿意接受任何答案。 诚挚的问候。
浏览 0
提问于2018-01-16
得票数 1
1
回答
如何在Databricks
Spark
中
存储
旧的流
数据
?
scala
、
databricks
我是
Spark
Streaming和Azure Databricks的新手。我读了很多关于
spark
如何工作和处理
数据
等的文章,但是旧
数据
呢?如果
spark
在
交互式
数据
上工作,那么我的2周或2个月前的
数据
Spark
可以保存吗?或者假设我必须在转换后移动
数据
,我应该移动到
哪里
并清除
spark
内存?它将只
存储
在
SSD
中
吗?
浏览 2
提问于2018-03-30
得票数 0
2
回答
如何将temptable保存到Hive metastore (并在Hive中进行分析)?
apache-spark
、
hive
、
apache-spark-sql
、
spark-dataframe
、
apache-spark-1.3
我使用的是
Spark
1.3.1。
在
配置单元
中
,如果我运行show tables,DataFrame
在
配置单元
数据
库
中
不会以
表
的形式出现。我已经将hive-site.xml复制到$
SPARK
_HOME/conf,但它没有帮助(
数据
帧也不会出现在配置单元元
存储
中
)。
浏览 0
提问于2015-11-18
得票数 0
1
回答
Spark
和Metastore关系
apache-spark
、
apache-spark-sql
、
metastore
我知道Hive Metastore用于
存储
我们
在
HIVE
中
创建的
表
的元
数据
,但是为什么
spark
需要Metastore,Metastore和
Spark
之间的默认关系是什么为什么即使iam没有使用任何sql库,
spark
by defaults也会检查元
存储
区连接?
浏览 8
提问于2017-09-21
得票数 4
2
回答
外部配置单元
表
刷新
表
与MSCK修复
apache-spark
、
hive
、
hivecontext
、
hive-partitions
我有一个外部蜂窝
表
,
存储
为Parquet,分区
在
一个列上,比如as_of_dt,
数据
通过
spark
streaming插入。现在,每天都会添加新的分区。我正在执行msck repair table,以便配置单元元
存储
获得新添加的分区信息。这是唯一的办法,还是有更好的办法?我担心如果下游用户查询
表
,msck repair是否会导致
数据
不可用或
数据
陈旧的问题?我正在浏览HiveContext应用程序接口并查看refreshTable选项。
浏览 8
提问于2018-08-07
得票数 13
2
回答
Spark
bucketing读取性能
apache-spark
、
spark-dataframe
、
apache-spark-dataset
、
apache-spark-2.2
Spark
版本- 2.2.1。我已经创建了一个包含64个
存储
桶的
存储
器
表
,我正在执行一个聚合函数select t1.ifa,count(*) from $tblName t1 where t1.date_ = '2018-01-01我可以看到
Spark
UI中有64个任务,它们只使用了20个
中
的4个executor (每个executor有16个核心)。有没有一种方法可以扩展任务的数量,或者这就是
存储
桶查询应该如何运行(正在运行的核心数量相当于
存储</
浏览 24
提问于2018-01-19
得票数 2
2
回答
Azure
存储
帐户中储存的蜂箱
表
在
哪里
?
database
、
azure
、
apache-spark
、
hive
如果我使用Hive创建一个
表
,那么
表
本身
存储
在
Azure
存储
帐户
中
的位置呢? 我的意图是,我想复制表和亚稳态,以复制它。
浏览 2
提问于2020-05-08
得票数 1
回答已采纳
1
回答
当
表
很大时,可以
在
关系
数据
库中使用
Spark
吗?
sql
、
apache-spark
、
apache-spark-sql
、
bigdata
我想知道如何使用
spark
来处理
存储
在
关系
数据
库
中
的结构化大
数据
?我有包含超过40亿行(GPS坐标)的表格。
在
使用合并操作时,
Spark
试图处理内存
中
的所有
表
,这是不可能的。我知道
Spark
是“内存
中
的”处理,但在我的例子
中
,内存不能适用于整个
表
。那么,当
表
很大时,是否可以
在
关系
数据
库中使用<
浏览 3
提问于2017-02-01
得票数 1
2
回答
Apache不使用来自Hive分区外部
表
的分区信息
apache-spark
、
hive
、
apache-spark-sql
我有一个简单的Hive外部
表
,它是
在
S3之上创建的(文件是CSV格式的)。当我运行hive查询时,它会显示所有记录和分区。但是,当我
在
Spark
中使用相同的
表
时(
Spark
在
分区列上有一个where条件),它不会显示应用了分区筛选器。然而,对于Hive托管
表
,
Spark
可以使用分区信息并应用分区筛选器。是否有任何标志或设置可以帮助我使用星火中的Hive外部
表
的分区?谢谢。 更新: 由于某些原因
浏览 0
提问于2019-08-24
得票数 3
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
即时通信 IM
云直播
活动推荐
运营活动
广告
关闭
领券