腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
使
列
全部
为
空
Pyspark
DataFrame
apache-spark
、
pyspark
我正在寻找一个
列
的列表
全部
为
空
。这些
列
中可能有值,也可能没有值。理想情况下,我会尝试清除
列
中的数据。
浏览 5
提问于2021-06-08
得票数 0
回答已采纳
1
回答
电火花函数理解-转换因子
apache-spark
、
pyspark
、
azure-databricks
我在Apache,Databricks上用
PySpark
编写代码。 very_large_
dataframe
250 GB来自客户端的CSV文件,其中必须只有10
列
A、B、C、D、E、F、G、H、I、A、B包含字符串数据C、D、E、F、G、H、I、J,包含精度
为
5的小数,标度2(即125.75) A、B、C、D、E,不应为
空
F、
浏览 6
提问于2022-01-14
得票数 0
回答已采纳
1
回答
如何将所有的日期格式转换为日期
列
的时间戳?
apache-spark
、
datetime
、
pyspark
、
apache-spark-sql
我使用的是
PySpark
版本3.0.1。我正在将csv文件读取
为
具有2个日期
列
的
PySpark
数据帧。但是,当我尝试打印模式时,两
列
都被填充
为
字符串类型。 ? ? 上面附加的屏幕截图是
Dataframe
和
Dataframe
模式。 如何使用
pyspark
将date
列
中的行值转换为时间戳格式?我也尝试过下面的代码,但这是在创建一个
空
值的新
列
df1 = df.withCo
浏览 16
提问于2020-12-30
得票数 2
2
回答
如何创建
空
的考拉df
python
、
spark-koalas
我正在尝试使用以下命令创建
空
的考拉
DataFrame
但是我得到了以下错误我也尝试了执行命令,但发现了类似的错误 df = ks.
DataFrame
(columns=['col1
浏览 3
提问于2020-08-24
得票数 0
2
回答
列
的值
为
null,并在中进行交换。
python
、
pandas
、
dataframe
、
apache-spark
、
pyspark
我正在使用
pyspark
==2.3.1。我用熊猫对数据进行了数据预处理,现在我想把我的预处理功能转换成熊猫的火花放电。但是,当使用
pyspark
读取数据CSV文件时,许多值将变为
空
列
,而该
列
实际上有一些值。如果我试图对这个
dataframe
执行任何操作,那么它将与其他
列
交换
列
的值。我也尝试过不同版本的火花放电。谢谢
列
"property_type“的值
为
null,但实际的
浏览 5
提问于2022-02-16
得票数 0
回答已采纳
2
回答
在
Pyspark
中将任意数量的
列
合并为Array类型的新
列
python
、
pyspark
我有一个
pyspark
dataframe
,它包含N个包含整数的
列
。某些字段也可能为
空
。+---+-----+-----+| 2|123 | null|+---+-----+-----+ 我想要的是将所有以f
为
前缀的
列
组合成一个新
列
中的
pyspark
数组。features_filtered = features.select(F.concat(* features.colu
浏览 67
提问于2020-06-18
得票数 1
回答已采纳
2
回答
用不同的
列
合并两个星火数据格式,以获得所有
列
python
、
apache-spark
、
pyspark
450 230因此,我想要的df应该包含来自这两个数据的所有
列
,这些值正在交换,第二个数据帧中的一个
列
丢失了。
浏览 3
提问于2021-08-19
得票数 0
回答已采纳
1
回答
pyspark
.sql.utils.AnalysisException: Parquet数据源不支持
空
数据类型
apache-spark
、
pyspark
、
types
、
parquet
、
void
我试图在
PySpark
中的
dataframe
PySpark
中添加一个
列
。我试过的密码:df1 = df1.withColumn("empty_column", F.lit(None)) 但我知道这个错误:
pyspark
.sql.utils.AnalysisException: Parquet数据源不支持
空
数据类型。
浏览 23
提问于2022-10-18
得票数 3
回答已采纳
1
回答
Pyspark
:如果其他列为
空
,则在
pyspark
列
中填充固定值
python
、
pyspark
我有一个有两
列
的
pyspark
dataframe
。如果另一
列
中的行值
为
空
,我想用固定值填充一
列
。因此,在customer_df中,如果customer_address
为
null,则将城市
列
填充
为
“unknown” 我在试这个 customer_df = customer_df.withColumn
浏览 172
提问于2020-09-26
得票数 0
回答已采纳
1
回答
pyspark
中的to_json包含
空
值,但我需要
空
值作为
空
python
、
struct
、
pyspark
、
azure-databricks
、
to-json
我正在使用
pyspark
中的to_json将
dataframe
中的结构
列
转换为json
列
,但是在json中忽略了少数结构字段中的
空
值,我不希望这些
空
值被忽略。
浏览 6
提问于2020-10-14
得票数 0
1
回答
PySpark
:如何根据
列
的数据类型替换
空
值?
python
、
pyspark
我有一张表格,里面有257
列
。我试图找出如何根据数据类型更改表中的
空
值。我正试图在
PySpark
中做到这一点。而
dataframe
的名字叫做df。因此,例如,如果
列
包含日期,则为时间戳数据类型,且该
列
中的
空
值必须
为
1900-01-01如果是字符串类型,则应该是n/a 谢谢
浏览 5
提问于2022-04-15
得票数 0
回答已采纳
2
回答
如何在
PySpark
中获得数据类型为时间戳的
列
的null/nan计数?
python
、
apache-spark
、
pyspark
、
apache-spark-sql
我有一个名为 createdtime 的
列
,其数据类型为时间戳,我希望找到创建时间
为
空
或
空
或nan的行数。from
pyspark
.sql.functions import col,isnan,when,count df_Columns=["
浏览 5
提问于2022-06-26
得票数 0
1
回答
是否在不使用UDF的情况下向
pyspark
dataframe
添加新
列
?
apache-spark
、
pyspark
、
spark-dataframe
我目前有一个
pyspark
dataframe
,其中一
列
包含我想要使用我编写的返回信息字符串的函数查找的数字行。我知道最简单的方法是使用withCoulmn并定义一个UDF来从旧的
列
创建一个新
列
,但是我的函数不能将它注册
为
UDF.Is的方式
使
我可以基于旧
列
的值创建一个新的
dataframe
而不需要创建一个UDF?
浏览 5
提问于2017-08-01
得票数 1
回答已采纳
1
回答
PYSPARK
:-在不丢失null值的情况下分解
dataframe
中的数组:“
DataFrame
”对象没有属性“_get_object_id”
python
、
python-3.x
、
pyspark
、
pyspark-sql
调用下面的对象时出错是在不丢失
空
值的情况下分解
dataframe
中的数组,但在调用
列
时我得到错误,说对象没有属性‘_ code.This _ object _id’。需要帮助,在其他方式调用
列
,可以工作。from
pyspark
.sql import SparkSessionfrom
pyspark
.sql import Row from
pyspark
.sql.ty
浏览 2
提问于2018-07-05
得票数 2
2
回答
Dataframe
空
检查
pyspark
pyspark
我正在尝试使用下面的代码检查
Pyspark
中的
dataframe
是否
为
空
。我检查了我的对象是否真的是使用类型(Df)的dd,以及它是否是类'
pyspark
.sql.
dataframe
.
Dataframe
‘
浏览 207
提问于2021-09-17
得票数 0
回答已采纳
2
回答
如何删除星火表列中的空白
python
、
apache-spark
、
pyspark
、
databricks
、
sparktable
我想从特定
列
(Purch_location)中的所有值中删除空格。我使用的是spark表,而不是
dataframe
或SQL表(但如果需要,我可以使用
dataframe
或SQL表)。TORONTO | 4| 0|我尝试了以下函数
pyspark
.sql.functions导入regexp_replace from
pyspark
.sql.funct
浏览 6
提问于2017-12-03
得票数 2
1
回答
如何将电火花
列
(
pyspark
.sql.column.Column)转换为火花放电数据?
apache-spark
、
pyspark
、
apache-spark-sql
我有一个用例来映射基于条件的
pyspark
列
的元素。通过这个文档,我找不到一个函数来执行映射函数。因此,尝试使用
pyspark
映射函数,但无法将
pyspark
列
转换为
dataFrame
# like column.map(lambda x: __valid_date(x))我所拥有的,
浏览 4
提问于2021-11-19
得票数 0
回答已采纳
2
回答
在
pySpark
中按条件分割数据
python
、
pyspark
、
boolean
、
pyspark-dataframes
我有一个
dataframe
值
为
false、true或null。我想创建两个dataframes,1)只使用True列名,2)只使用假列名。我是
pySpark
新手,我想知道如何在不硬编码任何列名(我有几百
列
)的情况下做到这一点,我知道我不能遍历行,因为这样做会违背
pySpark
的目的。每一
列
将只有一个boolen -一个T或F,因此每
列
多个
空
。我尝试使用.filter,但它只过滤了一
列
,它实际上打印了其他所有
列
,而不是
浏览 3
提问于2020-05-07
得票数 1
回答已采纳
2
回答
如何在
pyspark
dataframe
中返回空值的行?
python
、
pyspark
、
apache-spark-sql
我正在尝试从
pyspark
dataframe
中获取
空
值的行。在pandas中,我可以在数据帧上使用isnull()来实现这一点:但在
PySpark
的情况下,当我运行以下命令时,它显示Attributeerror:AttributeError:'
DataFrame
‘对象没有属性'isNull’。如何在不对每一
列
进行检查的情况下获取具有空值的行?
浏览 25
提问于2018-11-27
得票数 5
点击加载更多
相关
资讯
PySaprk之DataFrame
Python开源数据分析工具TOP 3!
一个Python大数据处理利器:PySpark入门指南
一文读懂PySpark数据框
一文读懂 PySpark 数据框
热门
标签
更多标签
云服务器
ICP备案
对象存储
实时音视频
云点播
活动推荐
运营活动
广告
关闭
领券