腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
如何
根据
dataframe
中
的
列
动态
生成
for
循环
?
python
、
python-3.x
、
pandas
我尝试
根据
数据帧
中
的
列
数
动态
生成
一个for
循环
。 例如,如果我在
dataframe
中
的
列
是5,那么我
生成
For
循环
并相应地分配变量。], df_cols[4]: row['ENDED_DATE'], }) df_cols和行值应
浏览 28
提问于2019-09-27
得票数 1
回答已采纳
1
回答
Pyspark:为具有可变
列
数
的
when()子句
动态
生成
条件
pyspark
我有一个函数,我向它传递了一个
dataframe
和listofcolumns,它们不应该包含空值。如果“listofcolumn”
中
的
任何
列
都有空值,我就需要采取一个操作。现在,我必须在这里使用when子句,但是传递给when子句
的
列
将
根据
传递
的
dataframe
和passed
列
而有所不同。因此,我希望能够使用传递
的
列
动态
生成
when子句。whe
浏览 8
提问于2020-05-17
得票数 0
回答已采纳
1
回答
Scala火花:
动态
拆分
dataframe
列
scala
、
apache-spark
我已经将一个文本文件读取到一个
dataframe
中
,并成功地将单个
列
拆分为
列
(实质上该文件是以空格分隔
的
csv)。val irisDF:
DataFrame
= spark.read.csv("src/test/resources/iris-in.txt") val dfnew:
DataFrame
= irisDF.withColumn("_tmp", split
浏览 8
提问于2017-08-30
得票数 1
回答已采纳
2
回答
如何
根据
列名提取
列
?
r
、
dataframe
、
parsing
、
select
我有一个数据帧dfa 1 1 2 5c 3 3 3 3df[,"m"][1] m
如何
根据
geni,1提取
列</e
浏览 1
提问于2020-06-10
得票数 1
回答已采纳
2
回答
为熊猫添加新行
python
、
pandas
、
dataframe
在psuedo代码
中
,我做了这样
的
事情:for headers in df.columns.values.tolist() #generate field with name header当我
循环
遍历这些值时,我会将它们
浏览 8
提问于2021-07-15
得票数 0
回答已采纳
1
回答
将
DataFrame
转换为RDD,并将RDD
动态
拆分为与
DataFrame
相同
的
列
数。
scala
、
dataframe
、
apache-spark
、
rdd
我试图将
DataFrame
转换为RDD,并
根据
DataFrame
中
的
列
数
动态
而优雅地将它们拆分为特定
的
列
数。也就是说,这是hive employee中表
中
的
一个示例数据123 Bob 34 Texas Dallas 456 Stan 26= spark.sql("Select * from employee"
浏览 1
提问于2021-07-31
得票数 2
2
回答
具有
动态
列名
的
pd.eval
python
、
python-3.x
、
pandas
、
dataframe
、
eval
我在一个
循环
中
的
数据帧中
生成
新
列
,其中列名是在每个
循环
中
动态
设置
的
,如果可能的话,我想使用
DataFrame
.eval()。readFromColName.mean() - @readFromColName') 但是这给了我这个错误: AttributeError: 'Load' object has no attribute '__name__' 有人知道
如何
在
Datafra
浏览 35
提问于2020-07-02
得票数 1
3
回答
如何
基于模式
动态
生成
数据集?
scala
、
apache-spark
、
apache-spark-sql
我有多个模式,如下所示,具有不同
的
列名和数据类型。我希望为每个模式使用
DataFrame
和Scala
生成
测试/模拟数据,并将其保存到parquet文件
中
。下面是示例模式(来自示例json),用于
动态
生成
包含虚拟值
的
数据。StringType, true) StructField("pp", StringType, true))
浏览 0
提问于2018-11-30
得票数 13
回答已采纳
2
回答
从一个创建多个数据文件
python
、
python-3.x
、
pandas
、
dataframe
我有这样
的
数据:Alex 135 10 3 5Lee 136 2 6 4 我希望
根据
每个会话
生成
多个数据格式。例如,我想使
dataframe
具有name、time和session1。
dataframe
2有name、time和session2。
dataframe
3有nam
浏览 0
提问于2018-09-20
得票数 1
回答已采纳
1
回答
在熊猫中使用函数时按其位置选择
列
python-3.x
、
pandas
我
的
数据看起来像这样 'week1_values':[0,0,13,39,64],我试图应用一个函数来计算每周两
列
(“week1_values”和“week2_values”)之间
的
周差,
的
名称是<
浏览 1
提问于2022-01-25
得票数 1
回答已采纳
3
回答
在for
循环
中追加数组
python
、
pandas
、
numpy
我有一个1000行1000
列
的
dataframe
。我试图使用for
循环
从该数据帧
生成
一个numpy数组,我使用for
循环
随机选择每个周期
的
5
列
。我需要追加或连接我
生成
的
每个数组(1000行和5
列
)。我尝试了以下代码:import pandas as pd df = pd.
DataFrame
(np.random.choice([0.0, 0
浏览 1
提问于2019-04-07
得票数 3
回答已采纳
1
回答
按分类
列
展开pandas数据帧
python
、
pandas
、
dataframe
、
expansion
我试图通过在一个分类
列
中
创建更多特定于某个值
的
列
来扩展
dataframe
。我
的
数据帧如下所示: ? 基于
列
cluster
的
值,我想创建一个新
的
数据帧,它应该如下所示: var1_clus0 , var1_clus1, ... var3_clus2 我有一个巨大
的
数据集,所以我试图在一个嵌套
的
for
循环
中做到这一点,这个
循环
可以很好地处理聚集
列</em
浏览 14
提问于2019-02-20
得票数 0
2
回答
根据
条件火花选择
列
pyspark
我
的
dataframe
df1
中
有这样
的
列
,其中以20开头
的
列
是
动态
生成
的
。df.select(*[col(c).alias(f"${c}_p") if c.startswith("20") elsecol(c) for c in df.column
浏览 7
提问于2022-10-31
得票数 0
回答已采纳
1
回答
Spark :基于s3文件
中
的
字段
动态
生成
查询
scala
、
apache-spark
、
apache-spark-sql
基于s3
中
的
这些数据,我们将数据加载到一个表
中
,并且我们手动地(在每次运行
中
字段
的
数目可能会随着添加或删除几个
列
而改变)运行一个metrics.There,因为很少
的
metrics.There会对这些数据进行更多
的
计算
中
读取数据,并
根据
字段
动态
生成
SQL。查询:
如何
在scala/spark/
dataframe
中</em
浏览 7
提问于2020-03-19
得票数 1
1
回答
动态
添加不同长度
的
列
,同时
循环
遍历空熊猫
的
ncols =len(
列
)
的
数据
python
、
pandas
使用for
循环
,我尝试将不同长度
的
列
附加到预初始化
的
空数据empty
中
。在每次迭代
中
,我必须对数据进行斗争才能返回我想要
的
输出,但是我想要
的
输出
的
长度都是不同
的
。我希望保存所有存在
的
数据(这意味着,长度较短
的
列
将被填充nan值,以匹配长度最长
的
列
)。 但是,我意识到,由第一个迭代器返回
的
第一
列
浏览 0
提问于2019-08-19
得票数 0
回答已采纳
1
回答
对
动态
生成
的
DataFrames
列
进行排序
python
、
python-3.x
、
pandas
我有一个与此类似的数据 'age':[15,34,22],w-1(6)':[96,66,74], 'w-3(4)':[11,66,44]}) 注意,在我最初
的
DataFrame</
浏览 4
提问于2022-02-17
得票数 1
2
回答
从PySpark
DataFrame
列
中
删除元素
pyspark
我知道PySpark DataFrames是不可变
的
,所以我想创建一个新
列
,该
列
是
根据
应用到PySpark
DataFrame
的
现有
列
的
转换
生成
的
。我
的
数据太大了,无法使用collect()。该
列
是唯一int列表(在给定列表
中
不重复int),例如:[1,2][2,3] 上面是一个玩具例子,因为我
的
实际
DataF
浏览 9
提问于2017-01-12
得票数 1
回答已采纳
3
回答
在python pandas
中
,
如何
在一个csv文件
中
并排堆叠(每次迭代)
列
中
的
数据帧?
python
、
pandas
如果我可以在for
循环
中每次迭代
生成
两
列
数据,并且我想将其保存在csv文件
中
,那么如果在下一次迭代
中
我将
生成
两
列
数据将并排堆叠在同一个csv文件
中
(没有覆盖),该
如何
做?下一次迭代也是如此。我已经搜索了pandas.
DataFrame
(mode='a'),但它只垂直地(按行)追加
列
。我研究过连接pd.concat,然而,我不知道
如何
在超过两个dataframes
浏览 50
提问于2016-07-20
得票数 1
1
回答
基于准则
的
单列数据分析
python
、
pandas
、
dataframe
我有一个有十
列
和一千多行数据
的
Dataframe
。我正在
循环
遍历每一个标题,并计算两个标题之间
的
差异。这将产生一个数据帧,即一个
列
和N行。然后,我想
根据
某些标准进行统计。比如给我一组大于零
的
数据
的
统计数据。所以样本就像这样。df[SecondHeader] print (df(TempDF[]>0).describe()) 这会
浏览 1
提问于2015-08-04
得票数 2
回答已采纳
2
回答
从值列表
中
向
Dataframe
添加
列
r
从一个空
的
dataframe
开始,我需要按如下方式填充该
dataframe
:一个for
循环
在每次迭代中
生成
固定数量
的
值,我需要使用该列表
中
的
值添加一个新
列
,并为该
列
提供一个唯一
的
名称col_i (其中i是
循环
的
第i次迭代)。
如何
完成这项(看似简单
的
任务)?
浏览 2
提问于2012-06-21
得票数 1
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
即时通信 IM
云直播
活动推荐
运营活动
广告
关闭
领券