腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
2
回答
PySpark
-
获取
组
中
每行
的
行号
apache-spark
、
pyspark
、
apache-spark-sql
、
spark-dataframe
、
pyspark-sql
使用
pyspark
,我希望能够对spark数据帧进行分组,对
组
进行排序,然后提供
行号
。
浏览 13
提问于2017-08-05
得票数 19
回答已采纳
2
回答
获取
星火中RDD
中
每个键
的
前3位值
python-2.7
、
apache-spark
、
lambda
、
pyspark
、
rdd
我是Spark
的
初学者,我正在尝试创建一个RDD,它包含每个键
的
前3个值(而不仅仅是前3个值)。我当前
的
RDD包含数千个条目,格式如下:因此,想象一下,我有一个内容如下
的
RDD:("B1", "qwe", 4),
浏览 1
提问于2018-04-08
得票数 3
回答已采纳
1
回答
根据文本文件
每行
中
的
列号从文本文件
中
读取数据
c#
、
xml
、
file
、
filestream
、
streamreader
我正在从客户端
获取
一个文本文件,该文件有多行,
每行
可以属于一个
组
。每组都有特定
的
数据格式。每种数据格式定义将在行
中
的
特定位置出现
的
字段。我需要重新格式化数据并向
每行
添加详细信息。例如,有3个
组
GroupA、GroupB、GroupC,每个
组
的
格式由
行号
指定。-12.90Adj 1274G 20122013 C FEECredit 12.34INR -12.90
浏览 1
提问于2014-02-12
得票数 0
1
回答
将MySQL SELECT all划分为包含7个结果
的
部分,并对每个部分运行新查询
php
、
mysql
、
sql
我想通过将结果
的
数量除以7来将MySQL查询
的
结果分组,这样我就可以在每个
组
上运行查询。每次
的
时间段都是不同
的
。
浏览 1
提问于2013-08-25
得票数 0
1
回答
将列添加到
Pyspark
,该列将多个组分配给相应
的
行
group-by
、
pyspark
、
apache-spark-sql
我有一个数据框架: from
pyspark
.sql import SparkSession| d| 66 || b| 3 |+-------+-----+ 我想把每4行作为一个
组
。然后,关于该
组
,创建新列,在该列
中
,我可以将
组
数分配给相应
的
行。因此,
浏览 27
提问于2019-04-12
得票数 0
回答已采纳
1
回答
如何在
PySpark
的
Pandas中使用iloc获得相同
的
结果?
apache-spark
、
pyspark
、
apache-spark-sql
在Pandas dataframe
中
,我可以使用data.iloc[1:1000,:]
获取
前1000行。如何在
PySpark
中
做到这一点?
浏览 24
提问于2021-01-11
得票数 1
回答已采纳
1
回答
使用分组和标头对SSRS表进行序列号
sql
、
ssrs-2008
以下是我正在编写
的
一份报告
的
示例。它是通过"CostCenter“字段分组
的
,并且在每个
组
的
上方有一个具有"Betrag”字段总和
的
标题。我还想用标题对表
中
的
每一列进行编号。我认为应该有一种方法或公式来连接Colmun
行号
或"Zeilennr“
中
的
两个字段,从而为
每行
生成正确
的
行号
浏览 54
提问于2021-04-26
得票数 0
回答已采纳
1
回答
按行索引拆分Spark数据帧
python
、
apache-spark
、
pyspark
、
apache-spark-sql
如果有100行,则期望分割成4个相等
的
数据帧应分别具有索引0-24、25-49、50-74和75-99。 唯一可用
的
预定义函数是randomSplit。我想到
的
另一种方法是使用count归约操作找到数据计数,然后使用take继续提取数据,但这非常昂贵。有没有其他方法可以在保持相同顺序
的
情况下实现上述目标?
浏览 8
提问于2018-02-21
得票数 2
回答已采纳
5
回答
SQL -如何更新每个行值递增1
的
列?
sql
、
sql-server
、
loops
、
auto-increment
、
row-number
对于一列
中
的
选定行,如何从头到尾依次更新
每行
,
每行
的
值递增1(或某个数字)。我知道这可以在excel
中
在几秒钟内完成,但我可以弄清楚如何在SQL server
中
实现。例如:ship-to party customer id 0002018092 NULL,如何使用
行号
更新
每行
?我知道有一个row_nu
浏览 1
提问于2017-12-08
得票数 1
1
回答
用C# Api查询日志采集
c#
、
.net
、
mongodb
、
mongodb-query
要进行上下文设置,请执行以下操作: 批处理文件有BachItems,每个BatchItem都是一行,并且有一个
行号
。
每行
都是按顺序处理
的
。我是NoSQL和mongo
的
新手,我想知道如何查询每个BatchItem (
行号
)上执行
的
最后一个处理步骤(最近
的
EventType列),按BatchId过滤?我相信我可以使用聚合和
组
函数来实现这一点,但不知道如何实现。谢谢。
浏览 34
提问于2019-02-18
得票数 0
2
回答
在引导
中
获得显示
行号
的
最干净
的
方法是什么?
javascript
、
jquery
、
css
、
twitter-bootstrap
假设我在一系列引导行
中
显示了一
组
图像,每个行看起来如下 <div class="col-md-3 col-sm-6">im1</div> <div class当呈现这组行时,
每行
的
列数将取决于浏览器
的
像素宽度。现在,假设我想为用户提供
行号
,但我希望
行号
与用户看到
的
行相关联,而不是类指定
的
行。获得和显示
浏览 5
提问于2015-10-10
得票数 0
回答已采纳
2
回答
在火花中放置行
pyspark
如何根据
行号
/行索引值
的
值删除
Pyspark
中
的
行值? 我对
Pyspark
(和编码)很陌生--我尝试过编码一些东西,但是它不起作用。
浏览 1
提问于2019-04-08
得票数 3
回答已采纳
1
回答
PySpark
中
的
群累积计数
python
、
pyspark
df.groupby(['id']).cumcount()df['id'] += count_num 1 | joe | 2 | jane |--------------- 如何在
PySpark
中
实
浏览 0
提问于2019-04-10
得票数 0
回答已采纳
1
回答
如何
获取
row_number is
pyspark
数据帧
python
、
apache-spark
、
dataframe
、
pyspark
为了排名,我需要让row_number是一个
pyspark
数据帧。我看到在
pyspark
的
窗口函数中有row_number函数,但这是使用HiveContext所必需
的
。我尝试用HiveContext替换sqlContext self.sc =
pyspark
.SparkContext()
浏览 0
提问于2016-10-30
得票数 2
1
回答
基于关键字
的
R子集文本行
r
、
string
我有一个linux文本文件(日志文件),我从windows
的
R工作室读取。到目前一切尚好。读取R
中
的
文件后,我得到以下结构# 'utf8' chr [1:1321] 现在,我想找到一种方法来选择包含任意一
组
特定关键字
的
行号
在选择
浏览 0
提问于2018-11-07
得票数 1
回答已采纳
1
回答
在
pyspark
dataframe
中
检索最大值时遇到问题
python
、
apache-spark
、
pyspark
、
apache-spark-sql
、
aws-glue
在我通过使用窗口和对一
组
列进行分区来计算
pyspark
dataframe
中
每行
5行内
的
平均数量之后 from
pyspark
.sql import functions as Fconsecutive_df = prep_df.withColumn('aveg', F.avg(prep_df['quantity']).over(window)) 我尝试使用相同
的
<e
浏览 14
提问于2020-06-19
得票数 0
回答已采纳
2
回答
如何只保留每个用户(另一列)具有最高列值
的
行?
python
、
apache-spark
、
pyspark
、
apache-spark-sql
我有一个
PySpark
数据格式- ("u1", "india", 10),| u4| japan| 15|我只想为每个user_id保留具有最高价格列
的
行想要
的
输出应该是- +-------+---------+---
浏览 2
提问于2020-12-15
得票数 0
回答已采纳
1
回答
在从网格
中
获取
每条记录后,我正在尝试创建一个json数组。我想添加网格
的
行号
作为json数组
中
每一行
的
键
extjs
在从ExtJS 3.4.0
的
网格
中
获取
每条记录后,我正在尝试创建一个json数组。我想添加网格
的
行号
作为JSON数组
中
每行
的
键。
浏览 4
提问于2017-07-29
得票数 2
0
回答
行号
的
配置单元查询
apache-spark
、
hive
、
pyspark
、
spark-dataframe
我在
pyspark
上工作,需要编写一个从hive表
中
读取数据并返回包含所有列和
行号
的
pyspark
数据帧
的
查询。这是我尝试过
的
:这个查询在hive
中
运行得很好,但是当我从
pyspark
注意:我不希望以任何特定
的
顺序对行进行排序,我只需要表中所有行
的
行号
浏览 2
提问于2017-12-06
得票数 0
2
回答
如何将多个文件
中
的
行号
提取到单个文件
python
每个文件包含以下格式
的
多个
行号
(
每行
一个
行号
):15我想从15个文件
中
的
每个文件中提取10个随机
行号
到单个输出文件(OutputLinesFile)
中
棘手
的
部分是,其中一些文件可能包含少于10个
行号
,在这种情况下,我希望将尽可能多
的
行号
提取到输出文件
中
。输出文件
的
格式应与输入文件相同(
每行
一行)。提前感谢您<em
浏览 0
提问于2013-06-18
得票数 1
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
即时通信 IM
云直播
活动推荐
运营活动
广告
关闭
领券