腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
使用
Spark
structured
streaming
仅
保留
最新
数据
apache-spark
、
pyspark
、
spark-streaming
、
databricks
我像这样流式传输
数据
:time,id,value我只想用
最新
的value为每个id
保留
一条记录。解决这个问题的最好方法是什么?更喜欢
使用
Pyspark
浏览 23
提问于2021-09-22
得票数 1
2
回答
Apache Ignite到亚马逊S3的连接
ignite
我想知道如何将
数据
从亚马逊S3加载到Apache Ignite集群?是否需要单节点或多节点群集?
浏览 5
提问于2017-05-02
得票数 1
1
回答
使用
spark
和
spark
streaming
构建服务
apache-spark
、
pyspark
、
rabbitmq
、
spark-streaming
我读过一些关于
spark
streaming
的文章,我想知道是否有可能
使用
rabbitmq作为代理从自定义来源流式传输
数据
,并通过
spark
流提供这些
数据
,
Spark
的机器学习和图形处理算法将在这些
数据
上执行,并将其发送到其他文件系统/
数据
库/仪表板或客户接收器。附注:我用python编写代码,我没有任何
使用
spark
的经验,我可以称之为我试图实现的微服务吗? 谢谢。
浏览 5
提问于2020-09-02
得票数 0
2
回答
如何对
Spark
结构化流媒体进行单元测试?
apache-spark
、
spark-structured-streaming
、
spark-streaming-kafka
我想了解一下
Spark
Structured
Streaming
的单元测试方面。我的场景是,我从Kafka获取
数据
,并
使用
Spark
Structured
Streaming
使用
它,并在
数据
上应用一些转换。 我不确定如何
使用
Scala和
Spark
来测试它。有人能告诉我如何
使用
Scala在结构化流媒体中进行单元测试吗?我还是个流媒体新手。
浏览 3
提问于2019-07-05
得票数 2
1
回答
Spark
Structured
Streaming
source
保留
策略
apache-spark
、
spark-structured-streaming
考虑一个关于Kafka主题的连续的JSON
数据
流,我们希望通过结构化的流来处理它,如下所示: .readStream .那么,有没有什么配置可以消除df中较早的
数据
或简单地将最早的行出队呢?
浏览 0
提问于2018-02-19
得票数 1
2
回答
如何在
Spark
Structured
Streaming
中读取Kafka和查询外部存储,如Cassandra?
apache-spark
、
apache-spark-sql
如何在
Spark
Structured
Streaming
中读取Kafka和查询外部存储,如Cassandra?我从Kafka获得消息流,我想对它应用Map操作,对于每个键,我想查询像Cassandra这样的
数据
存储,并获得该键的更多信息,并在流上应用进一步的操作。我如何
使用
Spark
Structured
Streaming
2.2.0来做到这一点?
浏览 2
提问于2017-09-07
得票数 1
2
回答
电火花外壳中的外部包(jars) --如何
apache-spark
、
pyspark
到目前为止,我读到的资料: - [
Spark
configuration](https://
spark
.ap
浏览 0
提问于2019-12-11
得票数 0
1
回答
删除
spark
-
structured
-
streaming
写入的损坏拼接文件时会丢失
数据
吗?
scala
、
apache-kafka
、
parquet
、
spark-structured-streaming
我
使用
spark
-
structured
-
streaming
作为消费者从kafka获取
数据
,按照指南参考https://
spark
.apache.org/docs/latest/
structured
-
streaming
-kafka-integration.html然后将
数据
保存到hdfs作为拼图文件。但我不确定是否会因为移动而导致
数据
丢失。 我知道
spark</
浏览 20
提问于2019-05-25
得票数 0
1
回答
连接
spark
structured
streaming
+ kafka出错
scala
、
apache-spark
、
apache-kafka
、
spark-streaming
、
spark-structured-streaming
我正在尝试连接我的结构化流式
spark
2.4.5与kafka,但所有的时间,我尝试这个
数据
源提供程序出现错误。._ def main(args: Array[String]): Unit = { println("
Spark
Structured
Streaming
with K
浏览 86
提问于2020-05-04
得票数 0
回答已采纳
1
回答
如何查看
Spark
Streaming
应用的逻辑和物理规划?
scala
、
apache-spark
、
spark-streaming
我正在寻找一种在
Spark
中打印流媒体应用程序的执行计划的方法。我知道这是可能的print the plan of a SQL
Spark
application。下面是我的应用程序: package org.sense.
spark
.app import org.apache.
spark
.
浏览 11
提问于2019-09-30
得票数 0
回答已采纳
1
回答
使用
Spark
Structured
Streaming
读取目录时,如何实现只读一次处理?
apache-spark
、
apache-kafka
、
spark-structured-streaming
我想
使用
流处理的概念从本地目录读取文件,然后发布到Apache Kafka。我考虑过
使用
Spark
Structured
Streaming
。 当读取50行文件后流式传输失败时,如何实现检查点。此外,如果我们在结构化流媒体中
使用
检查点,当代码有任何升级或任何更改时,我们是否会有任何问题。
浏览 0
提问于2019-02-25
得票数 2
1
回答
与RabbitMQ的
Spark
结构化流媒体集成
apache-spark
、
rabbitmq
、
spark-streaming
我想
使用
Spark
structured
来聚合从RabbitMQ消费的
数据
。我知道与apache kafka有官方的
spark
结构化流媒体集成,我想知道是否也存在与RabbitMQ的集成?由于我不能切换现有的消息传递系统(RabbitMQ),我想
使用
kafka-connect在消息传递系统(Rabbit to kafka)之间移动
数据
,然后
使用
Spark
structured
streaming
浏览 0
提问于2018-04-16
得票数 0
1
回答
Nifi和
Spark
集成
scala
、
apache-spark
、
apache-nifi
我想在用Scala编写的Nifi自定义处理器中创建
Spark
会话,到目前为止,我可以在scala项目上创建
spark
会话,但是当我在nifi自定义处理器的OnTrigger方法中添加这个
spark
会话时,
spark
会话永远不会创建,有什么方法可以实现这一点吗?到目前为止,我已经导入了
spark
-core和
spark
-sql库,欢迎任何反馈。
浏览 4
提问于2021-03-10
得票数 0
1
回答
齐柏林飞艇:可以用齐柏林飞艇发送卡夫卡信息吗?
apache-kafka
、
apache-zeppelin
._2)) 对我来说,Zeppelin相当于一个
spark
-shell,但我不确定我们是否可以用
Spark
-shell发送kafka消息。
浏览 4
提问于2021-09-06
得票数 0
1
回答
Apache
Spark
与Kafka的集成
apache-spark
、
apache-kafka
、
spark-structured-streaming
、
spark-kafka-integration
我正在学习Udemy上关于Kafka和
Spark
的课程,我正在学习apache
spark
与Kafka的集成 下面是apache
spark
的代码 SparkSession session = SparkSession.builder-- https://mvnrepository.com/artifact/org.apache.
spark
/
spark
-
streaming
--> <!-- <dependency&
浏览 26
提问于2020-09-25
得票数 4
回答已采纳
1
回答
在达到
最新
偏移量之前,不会将Kafka消息写入拼图文件
apache-spark
、
apache-kafka
、
spark-streaming
我让它工作了,但后来我做了更改,现在我必须等到所有消息都被
使用
完后,拼图文件中才会有任何东西。我的代码如下。import org.apache.
spark
.sql.SparkSession def main(args: Array[String]): Unit= { .builder .getOrCreate()= "loc
浏览 4
提问于2020-10-10
得票数 0
回答已采纳
1
回答
可以在没有HDFS的情况下
使用
Spark
Structured
吗?
spark-structured-streaming
我经常
使用
HDFS和Kafka,我注意到Kafka比HDFS更可靠。所以现在
使用
Spark
-
structured
-
streaming
,我很惊讶检查点只有HDFS。用Kafka来勾点会更快更可靠。那么,有没有可能在没有HDFS的情况下
使用
spark
structured
?奇怪的是,我们只能在Kafka中将HDFS用于流
数据
。
Spark
2.4.7 谢谢
浏览 39
提问于2021-05-07
得票数 2
1
回答
如何
使用
MongoDB Sink集成Kafka和
Spark
Structured
mongodb
、
scala
、
apache-spark
、
apache-spark-sql
、
spark-structured-streaming
我正在尝试将Kafka与
Spark
-
Structured
Streaming
集成到MongoDB Sink。如果我出错了,我需要帮助来纠正我的代码。集成了Kafka-
Spark
和
Spark
-Mongo。现在尝试集成来自Kafka-
Spark
-Mongo的管道 import org.apache.
spark
.sql.
streaming
.Triggerimport org.a
浏览 48
提问于2019-04-15
得票数 1
回答已采纳
1
回答
如何找到
spark
结构的流媒体应用的消费者组id?
apache-spark
、
spark-structured-streaming
在
spark
streaming
编程中,我们可以通过设置以下配置来显式分配kafka消费者组id: val kafkaParams = Map[String, Object]( ...= KafkaUtils.createRDD[String, String](sparkContext, kafkaParams, offsetRanges, PreferConsistent) 在
spark
structured
streaming
中,禁止设置自己的消费者组id。在我的程序中,我不会更改消费者组id,而是
浏览 11
提问于2020-03-31
得票数 1
回答已采纳
3
回答
如何在
spark
数据
流结构中
使用
非基于时间的窗口?
pyspark
、
apache-spark-sql
、
spark-streaming
我正在尝试
使用
window on
structured
与
spark
和kafka。我在非基于时间的
数据
上
使用
window,所以我得到了这个错误: .filter(col("rank")
浏览 0
提问于2019-04-09
得票数 5
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
实时音视频
云点播
活动推荐
运营活动
广告
关闭
领券