腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
3
回答
PySpark
每一天
出现
的
次数
python
、
apache-spark
、
pyspark
、
apache-spark-sql
我有一个
PySpark
数据帧,它看起来像这样: +------+-------------------++------+----------|2020-06-20 01:11:12|+------+-------------------+ 我正在尝试找出每天使用不同端口
的
次数
例如,生成
的
数据帧应如下所示: +------------+----------------+ |window | p
浏览 44
提问于2020-12-15
得票数 0
回答已采纳
1
回答
将每个二元语法从列表格式移动到Pandas或
Pyspark
数据帧中
的
新行
python
、
pandas
、
apache-spark
、
text
、
pyspark
我有pandas和
pyspark
数据帧,每天每行都有二元组
的
列表。我想打破列表,并将每个二元组合移动到一行,计数按降序排列。 如下所示是我拥有的数据帧。我已经按event_dt进行了排序。在“merged”列中,显示了二元语法
的
列表。例如,“漂亮
的
相遇”和“相遇后付费”是两个二元语法。双连词
的
列表每天都在继续... ? 现在,我想要将每个biagram移动到同一日期
的
新行。例如,“nice meet”将在一行中,而“meet postpaid”将在另一行中,而event_dt列则
浏览 40
提问于2020-10-23
得票数 0
回答已采纳
1
回答
Apache特征提取Word2Vec示例和异常
python
、
scala
、
exception
、
apache-spark
、
word2vec
A.以下是我
的
配置:火花版本: 1.4.1 (版本也在1.4.0中)B.示例源代码:inp = sc.textFile(1.4.1-bin-hadoop2.6\python\lib\
pyspark
.zip
浏览 1
提问于2015-08-15
得票数 1
1
回答
大熊猫在火花源中计数
pandas
、
apache-spark
、
hadoop
、
pyspark
目前正在尝试将我从pandas创建
的
脚本转换为
pyspark
,我有一个数据帧,其中包含以下形式
的
数据: index | letter0 | a2 | b4 | a6 | b 我想创建以下数据帧,其中存储了字母
的
每个实例
的
出现
次数
,例如,第一次看到"a“时,它
的
出现
次数
为0| 3 6
浏览 4
提问于2019-06-20
得票数 0
回答已采纳
3
回答
如何使用
pyspark
计算
出现
的
次数
python
、
apache-spark
、
pyspark
我正在尝试使用
pyspark
来计算
出现
的
次数
。假设我有这样
的
数据: (2,[u'a',u'c',u'd']),(3,[u'a']) ]) count = sc.parallelize([(u'a',0),(u
浏览 0
提问于2016-04-12
得票数 6
3
回答
绘制Pandas DataFrame中
的
引用数
python
、
matplotlib
、
pandas
我有一个有两列
的
DataFrame。其中一个包含时间戳,另一个包含某个操作
的
id。大概是这样
的
:2000-12-29 00:20:00 action22000-12-31 00:20:00 action2我想知道在某一天内执行了多少个特定类型
的
操作也就是说,对于
每一天</
浏览 1
提问于2014-01-24
得票数 13
回答已采纳
1
回答
如何使用
pySpark
将items行中
的
数组列单元格转换为计数?
arrays
、
pyspark
、
dataset
、
transformation
我有一个在一列中有多个值
的
数据集,并且我想计算每个值在数据集
的
所有行中
出现
的
次数
。+ 1 ++ val3 + 2 ++---------+-------+ 代码在
pySpark
我有一个包含数组列
的
数据集,但我不知道如何正确使用它。 我寻找了许多可以帮助我
的
示例和函数,但我没有找到,而且由于
pySpark
数据集是不可变<em
浏览 15
提问于2019-10-06
得票数 0
回答已采纳
1
回答
计数与
pyspark
dataframe中
的
某个值匹配
的
键值
python
、
json
、
apache-spark
、
pyspark
、
apache-spark-sql
我有一个
pyspark
dataframe,它有一个值为string json
的
列。如何计算与字典内列表中
的
某个值匹配
的
值,并以列
的
形式返回报告?]}} +--------------------------------------------------------------------------+ 我想计算一下列表中有多少“升级”键是假
的
。因此,理想
的
数据帧将如下所示: +---------------------------------------------
浏览 18
提问于2020-12-11
得票数 0
回答已采纳
2
回答
按不同
的
星期统计日期名称
的
出现
次数
mysql
、
count
我有一个包含datetime字段
的
MySQL表。对于不同
的
星期,如何计算
每一天
名称
的
出现
次数
?任何指导都非常感谢,谢谢!
浏览 2
提问于2012-03-06
得票数 1
回答已采纳
1
回答
使用UDF从Apache中
的
其他列创建新列
python
、
apache-spark
、
pyspark
、
apache-spark-sql
我正在尝试从Apache中
的
另一列中创建一个新列。2018-05-26T00:00:00.000+0000 5 Thursday我尝试过 & & 手册中
的
建议/worker.py", line 262, in main File "/databricks/spark/python/
pyspark
/worker.p
浏览 0
提问于2018-10-26
得票数 0
回答已采纳
1
回答
如何在List<DateTime>中获取特定日期
的
日期个数?
c#
、
lambda
Good day,我有一个列表,有一些日期,我需要获取一周中一天
的
天数,例如,在一个int变量中获取周日
的
天数,另一个int变量表示周一……List<int> SundayDates= DateList.FindAll(x => x.DayOfWeek = DayOfWeek.Sunday) 但它说它是只读
的
( DateList是我存储日期和想要获取日期
的
列表)。
浏览 18
提问于2018-07-07
得票数 2
回答已采纳
1
回答
统计
pyspark
数据帧中
的
出现
次数
python
、
amazon-web-services
、
pyspark
、
apache-spark-sql
、
aws-glue
我需要计算
pyspark
数据帧中重复值
的
出现
次数
,如下所示。简而言之,当值相同时,它会累加,直到值不同为止。当该值不同时,将重置计数。我需要它
出现
在一个专栏里。0 || 1 || 2 || 3 || 3 |+------+ 我需要
的
是
浏览 43
提问于2020-09-09
得票数 0
2
回答
pyspark
:计算每个不同值
的
出现
次数
pyspark
我认为这个问题与:有关因此,我想计算每个不同
的
值(在本例中为1和2)在A列中
出现
的
次数
,并输出类似如下
的
内容 distinct_values
浏览 6
提问于2018-12-06
得票数 0
回答已采纳
1
回答
取数查询,按天求和,按小时/分钟计数
sql
、
subquery
、
ms-access-2010
、
nested-query
我
的
挑战是
每一天
,我需要计算"105“在A列中
出现
的
次数
和"100”在B列中
出现
的
次数
。我不需要计算每个实例"105“
出现
的
次数
,而是每一分钟"105”
出现
的
次数
。A B2:28 1 15:12 1 0Date A B
浏览 4
提问于2021-03-04
得票数 0
回答已采纳
3
回答
Excel计算列范围内
的
指定值,但每列只计算一次。
excel
、
excel-formula
我一直在试图计算一个值在一个范围内
出现
的
次数
,但每列只显示一次。 我如何使它每列计算一次,但跨多个列(在实际数据中,一年中
的
每一天
都有一列) 谢谢
浏览 5
提问于2020-09-07
得票数 1
回答已采纳
1
回答
Pyspaprk计算符合条件
的
出现
次数
pyspark
、
group-by
、
count
、
conditional-statements
在
pyspark
中,我有每个国家
的
df格式
的
数据,我想要计算当值小于100时
出现
的
次数
。以及当值小于1000时
出现
的
次数
。低于1000
的
3。Ru有1低于100,3低于1000等等。 如何获取此信息?有没有一种方法可以按国家分组并统计满足某个条件
的
事件?如果是这样的话,就有可能使每个条件不同。
浏览 8
提问于2020-09-06
得票数 1
回答已采纳
2
回答
如何为dataframe中
的
每个单独类别绘制一周中
的
每一天
python
、
pandas
、
matplotlib
我正在尝试为每个“cat”列绘制一周中
每一天
发生
的
事件
的
图表。因此,绘制一周中
每一天
出现
的
次数
的
计数,将它们绘制在子图上。 因此,例如,在上面的数据框中,将有4个子图。对于每个子图,我们将有7个条形图代表各自日期
的
计数。 如果任何人有任何建议,那将是非常棒
的
,谢谢。
浏览 29
提问于2019-02-25
得票数 0
回答已采纳
1
回答
Google Sheets:如何计算2列中
的
匹配值
google-sheets
、
countif
在D列中,我列出了一年中
每一天
的人员1
的
3个字母
的
城市代码(共366行) 在G列中,我列出了人员2
的
3个字母
的
城市代码,也是一年中
的
每一天
。 我想知道如何计算代码匹配
的
次数
的
公式?换句话说,Person 1和Person 2在同一城市
的
次数
是多少? 此外,计算每个城市有多少匹配天数
的
公式,例如,它们都在“LDN”、“BCN”等中
的
天数。
浏览 28
提问于2020-02-02
得票数 4
回答已采纳
1
回答
在满足条件时使用列表值修改列值-
PySpark
python
、
pyspark
我想在一个条件下从一个列表中为dataframe列赋值,但是我
的
代码只适用于硬编码
的
替换,而不是像list这样
的
动态版本。而且我不能将列表直接转换为dataframe列‘s,因为它
的
长度比列
的
长度短得多 .otherwise(network_data1.NoUserConnections)) 我还可
浏览 3
提问于2021-12-14
得票数 -1
回答已采纳
2
回答
如何在AWS Glue / Py Spark脚本中将UnPivot列分成行
pyspark
、
pivot
、
unpivot
、
amazon-athena
、
aws-glue
我每年都有一个大型嵌套json文档(比如2018年、2017年),它每个月(1月至12月)和
每一天
(1-31天)都有汇总数据。"4": { "n": 5 }} 我使用了AWS Relationalize.apply函数将上述层
次数
据转换为平面结构每个月和
每一天
,表中都会有很多列。,我无法得到正确
的
答案。是否有一种解决方案,AWS Glue/
PySp
浏览 0
提问于2019-01-03
得票数 0
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
云点播
即时通信 IM
活动推荐
运营活动
广告
关闭
领券