腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
3
回答
处理
Dataframe
中
的
空
值
scala
、
apache-spark
、
dataframe
我有一个
DataFrame
,如下所示。input.withColumn("checkNull", testUDF(col("value1"),col("value2"),col("value3"))).showValue1Value2 Value3 checkNullnull 20000 10000 null 这里,列"checkNUll“
的
第二行显示
的</e
浏览 1
提问于2017-08-04
得票数 1
1
回答
处理
pyspark
dataframe
中
的
空
值
python-3.x
、
dataframe
、
pyspark
、
azure-databricks
我有一些数据
的
pyspark
dataframe
,我想要substring列
的
一些数据,该列也包含一些null
值
。|| something|+--------------+ 我只想从Name列
中
删除Asia, US, Europ 下面是我已经尝试过
的
代码Name.like("Europ%"),fun_europ(col('Name')))
浏览 68
提问于2019-10-17
得票数 2
回答已采纳
1
回答
Mongo写.options(replaceDocument,false)例外
mongodb
、
apache-spark
当我试图使用选项 replace document false从spark到mongo编写大量文档时。我在写作时得到以下例外:- org.apache.spark.SparkException: Job aborted due to stage failure: Task 28 in stage 18.0 failed 4 times, most recent failure: Lost task 28.3 in stage 18.0 (TID 275, 10.80.102.83, executor 2): com.mongodb.MongoBulkWriteException: Bulk w
浏览 0
提问于2018-10-30
得票数 0
回答已采纳
1
回答
Scala和Spark - Logistic回归- NullPointerException
scala
、
apache-spark
、
nullpointerexception
、
user-defined-functions
、
logistic-regression
我
的
scala和星火代码有问题。我正在尝试实施一种物流回归模式。为此,我必须实现两个UDF函数来收集我
的
特性。问题是,每当我试图调用
dataframe
.show()函数时,都会得到一个错误:我想可能我
的
数据中有空
值
,为了消除可能
的
空
值
,我尝试调用
dataframe
.na.drop()。poblem stil存在一个它说
的
失败执行用户定义
的
函数(anonfun$3:(数组,数组) =>
浏览 0
提问于2018-12-17
得票数 1
回答已采纳
1
回答
如何在R
中
处理
数据帧
中
字符型
的
空
记录?
r
、
dataframe
、
na
我在R
中
读取一个JSON txt文件作为数据帧,其中有很多
空
记录。现在,当我检查is.na(df)时,我对空记录不是真的。我该怎么
处理
呢?我尝试通过打印来检查
空
记录,它显示为
空
引号"",我相信它被
dataframe
算作字符。我尝试用NA替换它们,但不确定这是否是正确
的
处理
方法。最终,我需要
处理
这些缺失
的
值
。is.na(df) dfdf==""<-NA 将
浏览 14
提问于2019-04-14
得票数 1
回答已采纳
1
回答
发生异常: TypeError 'NaTType‘对象不可调用
python
、
greenplum
、
data-lake
warehouse') password = pwd,curr=conn.cursor() for i in
dataFrame
.index''&
浏览 21
提问于2022-07-04
得票数 0
1
回答
PySpark:获取数据
中
每个列
的
第一个非
空
值
。
python
、
apache-spark
、
dataframe
、
pyspark
、
apache-spark-sql
我正在
处理
不同
的
星火DataFrames,它们在许多列中都有大量
的
空
值
。我希望从每个列
中
获取任何一个非
空
值
,以查看该
值
是否可以转换为datetime。我尝试执行df.na.drop().first(),希望它将删除所有带有空
值
的
行,而在剩余
的
DataFrame
中
,我将只获得第一行
的
所有非
空
值
。
浏览 5
提问于2017-05-09
得票数 6
回答已采纳
2
回答
Spark
DataFrame
对数据集为
空
scala
、
apache-spark
从MS SQL数据库导入数据时,可能会出现
空
值
。在Spark
中
,DataFrames能够
处理
空
值
。但是,当我尝试将
DataFrame
转换为强类型Dataset时,收到编码器错误。下面是一个简单
的
例子: def))) .toDF("a"
浏览 2
提问于2017-03-31
得票数 0
2
回答
多类分类
的
RandomForestClassifier SPACK2.x
scala
、
apache-spark
、
apache-spark-mllib
、
random-forest
、
multiclass-classification
我试图使用随机森林进行多类分类,使用spark 2.1.1我有一个包含多个字符串类型列
的
dataframe
。我是通过将StringIndexers与VectorAssembler链接起来来创建管道
的
,最后是用标签转换器连接RandomForestClassifier。我已经用distinct().count()检查了我
的
所有列,以确保我没有太多
的
类别,等等。label: $label.")} Error eval
浏览 1
提问于2018-02-12
得票数 1
回答已采纳
1
回答
使用带有空列表属性
的
pandas.io.json.json_normalize()
python
、
json
、
pandas
,我想是因为我
的
一个json字段是一个
空
数组。据我所知,我可以向json_normalize传递额外
的
path参数,让它提取数组
值
,并使用父数据增加行:但是,我不能将它用于这个实例,因为数组是
空
的
,因此它不返回
值
。是否有方法将
空
列表
值
设置为None,或者通过json_serialize函数序列
浏览 5
提问于2018-04-25
得票数 3
回答已采纳
1
回答
如何在spark
dataframe
中
获取记录
的
输入文件名?
spark-dataframe
我通过从s3加载制表符分隔
的
文件,在spark
中
创建了一个数据帧。我需要获取
dataframe
中
每条记录
的
输入文件名信息,以便进一步
处理
。我试过了但是我得到了input_file_name
的
空
值
。谁来帮我解决这个问题。
浏览 0
提问于2016-10-11
得票数 5
回答已采纳
2
回答
如何
处理
dataframe
Spark/Scala上
的
空
/
空
值
scala
、
apache-spark
我有一个CSV文件,我正在
处理
它
的
数据。我不想用其他
值
替换null/
空
<
浏览 9
提问于2016-05-12
得票数 3
2
回答
从视觉上观察熊猫数据
中
的
NaNs
python
、
matplotlib
、
pandas
我正在
处理
一个包含数百列,有时甚至数千列
的
复杂数据集。它们
中
的
许多都是NaN,并且系统地如此(它们往往在
空
的
分布方式上高度相关)。这使我相信,对NaNs
的
视觉检查是一个良好
的
第一步。我能做到得到每一列
中
的
值
的
数目,但我不知道它们
的
分布。因此,我想要创建一个散点图,它直观地反映了
dataframe</e
浏览 0
提问于2014-06-22
得票数 0
回答已采纳
1
回答
时间戳StructField
中
的
空
值
scala
、
apache-spark
如何
处理
时间戳列
中
的
空
值
?我将源数据保存在列表
中
(sql
的
结果) [220,1,220,220,2012-04-24 23在最后一列
中
,
空
值
与时间戳混合。: scala.runtime.BoxedUnit不是时间戳模式
的
有效外部类型 因此,Null
值
被包装为BoxedUn
浏览 0
提问于2018-06-21
得票数 0
回答已采纳
2
回答
访问
空
数组或
空
数组时引发错误
java
、
json
、
scala
、
apache-spark
我有一个带有这种模式
的
JSON文件: "name" : "john doe", "home": ["1111", "222"], }家庭电话号码数组有时可能是
空
的
。我
的
spark应用程序收到这些JSONS
的
列表,并执行以下操作: va
浏览 2
提问于2017-05-21
得票数 3
回答已采纳
1
回答
使用条件和变量将熊猫
值
映射到另一个数据格式(Python )
python
、
pandas
、
dataframe
在我
的
示例
中
,我正在
处理
两个数据文件。一个
dataframe
是
空
的
,12列编号为1-12。另一种是我希望映射
的
数据,以及指向映射数据应该转到哪一列
的
列(图像附加)。我需要使用位置矩阵将
dataframe
值
转换为结果
dataframe
的
正确列。下面的图片显示了我解释
的
内容。
浏览 12
提问于2022-08-26
得票数 0
1
回答
如何将一个数据框
的
列
值
追加到另一个数据框
的
列
python
、
pandas
、
dataframe
我正在
处理
两个数据帧,A和B。数据帧A是用
值
填充
的
,而数据帧B是
空
的
,除了报头结构。我想取数据帧A
中
的
列
的
值
,并将它们附加到数据帧B
的
相应列
中
。我已经将
dataframe
A列
的
值
放到了一个列表
中
。我尝试将目标列
值
设置为与起始列
值
列表相等,但出现了以下错误: dataframeB[x] = l
浏览 5
提问于2019-06-11
得票数 0
5
回答
根据某些列
中
的
空
值
删除行(pandas)
python
、
pandas
我知道如何从包含所有空
值
或单个
空
值
的
DataFrame
中
删除一行,但是您能根据指定
的
一组列
的
空
值
删除一行吗? 例如,假设我正在
处理
包含地理信息(城市、纬度和经度)以及许多其他字段
的
数据。我希望保留至少包含城市值或LAT
值
和long
值
的
行,但删除所有这三个
值
都为NULL
值
的
行。
浏览 2
提问于2017-02-09
得票数 6
1
回答
如何为给定列添加行和
值
?
java
、
apache-spark
、
apache-spark-sql
因此,我现在有以下
DataFrame
,其
值
如下:+-------+--------++-------+--------++-------+--------+ 其中时间没有
值
(或为
空
)。稍后,我将在我
的
程序
中
添加更多
的
行,并且需要为
值
和时间列添加/
浏览 5
提问于2017-06-26
得票数 0
回答已采纳
2
回答
星星之火sql query,java.lang.NullPointerException
scala
、
apache-spark
、
user-defined-functions
| 然后我定义了一个udf:现在,我尝试用定义
的
udf
浏览 0
提问于2018-04-01
得票数 0
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
即时通信 IM
云直播
活动推荐
运营活动
广告
关闭
领券