腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
使用
JDBC
驱动程序
将
Spark
数据
集
写入
Oracle
数据库
的过程非常耗时
scala
、
apache-spark
、
pyspark
、
apache-spark-sql
、
pyspark-sql
我正在
使用
Apache
Spark
加载、处理
数据
集
,并
使用
JDBC
驱动程序
将
数据
集
输出到Oracle DB中。 我
使用
spark
jdbc
write方法
将
数据
集
写入
数据库
。但是,同时
将
数据
集
写入
数据库
,
浏览 0
提问于2018-08-21
得票数 0
1
回答
无法
使用
jdbc
将
spark
数据
集
写入
数据库
java
、
python
、
scala
、
apache-spark-sql
我需要将我的
spark
数据
集
写入
oracle
数据库
表。我正在
使用
带有追加模式的
数据
集
写入
方法。但是当
使用
spark
2-submit命令在集群上触发
spark
作业时,会出现分析异常。我已经读取了json文件,将其扁平化,并将其设置为abcDataset
数据
集
。
Spark
版本-2 Oracle
数据库
JDBC
浏览 51
提问于2019-05-15
得票数 0
1
回答
使用
DataBricks
将
SQL查询发送到Server
sql-server
、
azure
、
jdbc
、
pyspark
、
databricks
将自定义SQL查询发送到Python上的SQL
数据库
是非常直接的。值得一提的是,我可以
使用
JDBC
读取和
写入
Server
数据库
,但我希望发送一个自定义SQL语句,例如,希望在Server
数据库
中执行的"bulk insert“语句。下面是我如何
使用
JDBC
从Server读取
数据
。table_name="dbo.myTable"
spark
.read.
jdbc
(url=j
浏览 3
提问于2020-09-20
得票数 0
2
回答
使用
Apache
Spark
进行快速计算,但
写入
数据库
会消耗大量时间
scala
、
apache-spark
、
pyspark
我正在
使用
Apache
spark
从Oracle
数据库
中加载
数据
集
,
使用
jdbc
格式在
Spark
-Java.I中。我正在加载一个大小为10M和1M的
数据
集
,并在dataset.After上执行各种操作。所有处理都完成了,我正在
将
多个
数据
集
写入
数据库
,这几乎消耗了90%的时间。那么,如何降低这种
写入
Oracle<
浏览 0
提问于2018-08-23
得票数 0
1
回答
spark
.sql()和
spark
.read.format("
jdbc
").option("query“、"")之间有什么区别?
python
、
apache-spark
、
pyspark
、
apache-spark-sql
我假设
spark
.sql(查询)是在
使用
spark
.sql时
使用
的,而
spark
.read.format("
jdbc
").option("query“、"")则是在
使用
oracle语法时
使用
的。
浏览 3
提问于2021-08-16
得票数 3
回答已采纳
1
回答
设置
spark
连接超时的最简单方法
java
、
apache-spark
、
apache-spark-sql
为
spark
的连接方法设置超时的最简单方法是什么,比如读和写?所以我
将
heartbeatInterval设置为"1s“。","2s").config("
spark
.executor.heartbeatInterval", "1s").getOrCreate();Dataset<Row> dataset =sparkSession.read().
jdbc
(url, fromStatement, prop
浏览 156
提问于2018-09-26
得票数 1
2
回答
将
具有字符串列的
数据
集
写入
teradata时获取SQLException
apache-spark
、
spark-dataframe
、
teradata
当我试图
将
数据
集
从
spark
写到teradata时,同时在
数据
集中有一些字符串
数据
时,我得到了下面的错误: at org.apache.
spark
.sql.execution.QueryExecution.toRdd(QueryExecution.scala:92) 如何确保
数据
被正确地
写入</
浏览 25
提问于2018-01-02
得票数 0
回答已采纳
2
回答
火花-雪花连接器是否只适用于
数据库
火花?
apache-spark
、
databricks
、
snowflake-cloud-data-platform
使用
databricks
spark
,能够
使用
connector(
spark
-snowflake_2.11-2.3.0.jar,
spark
雪花-
JDBC
2.8.1.jar
将
数据
写入
雪花中,而不是
使用
JDBC
但是如果没有databricks,当我试图在安装了火花的本地机器上应用相同的代码时,我
无法
使用
火花-雪花连接器
写入
雪花。但是能够
使用<
浏览 1
提问于2018-10-13
得票数 1
2
回答
使用
Apache编写错误
java
、
mysql
、
apache-spark
我是一个
使用
Spark
的新手。我遵循了DataBricks:的在线指南import org.apache.
spark
.SparkConf; import org.apache.
spark
.api.java.JavaSparkContext;import org.apache.
spark
.sql.Dataset;
浏览 4
提问于2017-05-01
得票数 0
回答已采纳
1
回答
无法
将
星火
数据
集
持久化为orientdb
apache-spark
、
orientdb-2.1
、
orientdb2.2
我正在尝试从sql服务器
数据库
中获取
数据
,并创建一个
spark
数据
集
。当我
将
数据
集
持久化到orientdb时,
无法
做到这一点。下降到误差以下这是我的代码"); options.p
浏览 2
提问于2017-02-28
得票数 0
1
回答
在mongoDB中为大
数据
集
1.8TB保存
数据
时触发内存错误
mongodb
、
apache-spark
、
pyspark
、
amazon-emr
我试图
使用
下面提到的用于MongoDB的代码在MongoDB中保存
数据
,并在AWS s3中保存与JSON相同的
数据
。虽然s3
写入
工作正常,但MongoDB给了我java.lang.OutOfMemoryError,但不确定在MongoDB
写入
和s3中以JSON形式
写入
文件时,相同的
数据
是如何处理的。MongoDB写db_url
浏览 3
提问于2022-10-09
得票数 2
1
回答
DataFrame numPartitions默认值
scala
、
apache-spark
、
apache-spark-sql
我正在尝试
使用
JDBC
从
数据库
表中读取一些内容:然后将其
写入
另一个
数据库
: df.write.mode(SaveMode.Append).
jdbc
("<other database url&g
浏览 0
提问于2020-07-09
得票数 1
1
回答
使用
覆盖模式向Teradata表
写入
DF的星星之火--尽管截断为真
apache-spark-sql
、
teradata
、
pyspark-sql
我正在尝试
使用
Spark
将
DF记录
写入
Teradata表。示例代码: .option("url", jdbcUrl)\根据
Spark
文档,当我
将
浏览 1
提问于2018-09-18
得票数 0
1
回答
激发
JDBC
来读取和
写入
Hive
apache-spark
、
hadoop
、
jdbc
、
hive
我正在尝试开发一个通用的实现来
使用
Spark
来支持从各种符合
JDBC
的
数据库
(如PostgreSQL、MySQL、Hive等)读取/
写入
数据
。 我的代码如下所示。,但是一旦我
使用
与Hive相关的
JDBC
,它就会引发问题。首先,我的read
无法
读取任何
数据
并返回空的结果。经过一些搜索,我可以通过添加自定义的HiveDialect来使读取工作,但我仍然面临着
将
数据
写入
浏览 6
提问于2019-11-12
得票数 0
1
回答
为什么来自Oracle的
Spark
查询(加载)比SQOOP慢?
oracle
、
apache-spark
、
apache-spark-sql
、
spark-dataframe
我们发现,从
Spark
1.3到当前的
Spark
2.0.1,
使用
Spark
的API从Oracle
数据库
加载
数据
总是很慢。"); .format("
jdbc
但是
Spark
核心代码的某些部分变成了
Spark
的内部代码,所以这个版本之后就不能
浏览 1
提问于2016-10-13
得票数 9
1
回答
使用
JDBC
连接
将
数据
写入
Azure SQL DB with Scala代码Databricks notebook
scala
、
apache-spark
、
hive
、
azure-sql-database
、
azure-databricks
我正在尝试
将
数据
从配置单元表插入Azure SQL DB表。SQL DB表已经存在,我只想用下面的Scala
JDBC
编写代码覆盖其中的
数据
。此代码
将
数据
写入
SQL DB表,但它正在更改其DDL (
数据
类型/列名)。我怎么才能避免它。我想要简单的插入表。 ?
浏览 18
提问于2019-04-29
得票数 0
2
回答
在Azure
数据库
中
使用
Python
将
DF
写入
Server
sql-server
、
python-3.x
、
scala
、
dataframe
、
databricks
我有一个
数据
文件,需要插入到Server中。我以前多次这样做,
使用
下面的Scala代码。
浏览 3
提问于2019-11-22
得票数 5
回答已采纳
3
回答
如何
使用
JDBC
源在(Py)星火库中读写
数据
?
python
、
scala
、
apache-spark
、
apache-spark-sql
、
pyspark
这个问题的目的是记录: 这些方法只要做一些小的改动,就可以与其他受支持的语言一起工作,包括Scala
浏览 0
提问于2015-06-22
得票数 81
回答已采纳
1
回答
我可以
使用
Pyspark更新远程Mysql DB中的表中的值吗?
python
、
mysql
、
pyspark
、
apache-kafka
、
pyspark-sql
我正在
使用
kafka从远程mysql
数据库
读取
数据
,并将其传递到Pyspark streaming以应用情感分析,然后用该值更新mysql
数据库
中的列。这是最好的情况,还是有比这更有效的架构?
浏览 1
提问于2019-11-20
得票数 0
1
回答
如何
使用
中的hadoop office库
将
数据
集
写入
excel文件
java
、
apache-spark
、
apache-spark-sql
、
spark-excel
目前,我
使用
com.crealytics.
spark
.excel读取Excel文件,但
使用
此库,
无法
将
数据
集
写入
Excel文件。这个说,
使用
hadoop库(org.zuinnote.
spark
.office.excel),我们可以读写Excel文件 请帮助我在
spark
.中将
数据
集
对象
写入
excel文件。
浏览 5
提问于2017-06-28
得票数 4
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
实时音视频
云点播
活动推荐
运营活动
广告
关闭
领券