开发者社区

文档建议反馈控制台

最新优惠活动

文章/答案/技术大牛

发布

在Dplyr中使用case_when创建新列时遇到问题

，可能是由于以下原因导致的：

语法错误：在使用case_when函数时，需要注意语法的正确性。确保每个条件都有对应的结果，并使用逗号将它们分隔开。另外，确保在case_when函数的末尾使用了默认的else语句，以处理未匹配到任何条件的情况。
数据类型不匹配：在使用case_when函数时，需要确保每个条件的结果与要创建的新列的数据类型相匹配。如果条件的结果是字符型，而新列的数据类型是数值型，可能会导致错误。
数据缺失：在使用case_when函数时，需要确保所有参与条件判断的列都没有缺失值。如果某个参与条件判断的列存在缺失值，可能会导致结果不准确或出现错误。

解决这些问题的方法如下：

检查语法：仔细检查case_when函数的语法，确保每个条件都有对应的结果，并使用逗号将它们分隔开。确保在case_when函数的末尾使用了默认的else语句。
检查数据类型：确保每个条件的结果与要创建的新列的数据类型相匹配。如果需要将字符型结果转换为数值型，可以使用as.numeric函数进行转换。
处理缺失值：在使用case_when函数之前，可以使用其他函数（如na.omit或complete.cases）来处理缺失值。这些函数可以帮助删除或填充缺失值，以确保参与条件判断的列没有缺失值。

总结起来，使用Dplyr中的case_when函数创建新列时，需要注意语法的正确性、数据类型的匹配以及处理缺失值的问题。通过仔细检查语法、确保数据类型匹配和处理缺失值，可以解决在使用case_when函数时遇到的问题。

腾讯云相关产品和产品介绍链接地址：

Dplyr是一个R语言中用于数据处理的包，它提供了一套简洁、一致的语法，可以方便地对数据进行筛选、排序、汇总等操作。腾讯云没有直接相关的产品和介绍链接，但可以在腾讯云的云计算平台上使用R语言进行数据处理和分析。

相关搜索:Case_when和/或if_else dplyr -当NA使用另一列中的值时 dplyr:使用矩阵中的值子集通过case_when创建新列 dplyr:：使用另一列的订单号创建新列 dplyr，purr，在R中动态生成/计算新列使用dplyr mutate根据列名的向量创建新列使用dplyr中的组长度创建新列使用dplyr创建新列，并使用阈值计算重复项使用dplyr在列中创建新组使用dplyr根据另一列的值之和创建新列使用for循环在pandas中创建新列？

相关搜索:

页面内容是否对你有帮助？

有帮助

没帮助

相关·内容

R&Python Data Science 系列：数据处理（2）

1 衍生字段函数主要有两个函数，mutate()和transmute(）,两个函数在Python和R上使用方法相同，这两个函数本身有点区别：mutate()函数保留原来所有列，然后新增一列；transmute...2 条件函数这里介绍3个条件函数，if_else()、case_when()、between()函数，Python包dfply和R包dplyr中都是这3个函数，在用法上有点细微差别，日常中使用最多...注意：python在jupyter中使用管道函数换行书写代码的时候需要用()把代码括起来。 2.2 case_when函数用于多条件赋值，评分卡Woe赋值的时候使用起来很方便。...注意：case_when函数在Python和R语言中使用的时候有点区别，请留意。...注意：R语言中可以使用XXX_join(a，b，by)，Python中不可以使用。

7541 0

Day07 生信马拉松-数据整理中的R

包 2.1 arrange，数据框按照某一列排序,实际参数不能加" " library(dplyr) arrange(test, Sepal.Length) #从小到大排序 arrange(test,...= T"为必须要写的参数 2.3 mutate，数据框新增一列 test <- mutate(test, new = Sepal.Length * Sepal.Width) #R中的修改必须要赋值，...### library(dplyr) i = rnorm(10) case_when(i>0 ~ "+", i<0 ~ "-", T ~ "0") ★★★★★长脚本的管理方式...test1,test2,by="name") #反连接基本不用 6.表达矩阵画箱线图 6.1操作过程图示 step1 对matrix进行转置：使gene名变为列名，将样本名转化为data.frame中的第一列...ggplot2对行名并不友好，通常要使样本名转化为data.frame中的第一列，防止在后续代码运行过程中行名丢失图片图片 step2 把原来的行名转变为第一列图片 step3 宽变长：test

2170 0

数据处理第2节：将列转换为正确的形状

转换列：基础部分您可以使用mutate（）函数创建新列。 mutate中的选项几乎是无穷无尽的：你可以对普通向量做任何事情，可以在mutate（）函数内完成。...在动态创建函数时，通常需要一种方法来引用要替换的值：这是.符号。...通过使用mutate_at（），我们在管道中需要两个参数：首先，它需要有关列的信息。...如果我想在几分钟内完成，我可以使用mutate_at（）并将包含列的所有'sleep'包装在vars（）中。其次，我在飞行中创建一个函数，将每个值乘以60。...如果要添加另一个数据框的信息，可以使用dplyr中的连接函数。

8.1K3 0

生信马拉松 Day7

50行 pheatmap::pheatmap(x3) #画热图 #使用管道符%>%的代码 iris %>% select(-5) %>% as.matrix() %>% head(50)...require(g,character.only = T)) install.packages(g,ask = F,update = F) } 一个类似的函数case_when() library...(dplyr) i = 0 ifelse(i>0,"+",ifelse(i<0,"-","0")) case_when(i>0 ~ "+", i<0 ~ "-",...4.9500000 3.3833333 1.4500000 0.2333333 apply(test, 1, sum) ### 2.lapply(list, FUN, …) # 对列表/向量中的每个元素实施相同的操作...“ ”转换为NA iris$Species[iris$Species=='']=NA 3.如何删除多余的信息 #这里示例数据中，a$tumor_stage.diagnoses内的数据可能的值有stage

2330 0

R语言基础5（绘图基础）

geom_bar(mapping = aes(x = cut)) ggplot(data = diamonds) + stat_count(mapping = aes(x = cut)) #统计变换使用场景...o替换为a，只替换出现的第一个o； str_replace(x,"o|s","a")#将x中的o或者s替换为a，只替换出现的第一个o； str_replace_all(x,"o","a")#将x中的o替换为...a，替换所有的o； str_remove(x," ")##将x中的第一个空格删除； str_remove_all(x," ")##将x中的全部空格删除；图片 library(stringr) str_split...library(dplyr) arrange(test, Sepal.Length) #将Sepal.LengthSepal.Length这一列从小到大排序 arrange(test, desc(Sepal.Length...一些搞文件的函数---- dir() # 列出工作目录下的文件 dir(pattern = ".R$") #列出工作目录下以.R结尾的文件 file.create("douhua.txt") #用代码创建文件

3237 1

R tips：使用TCGAbiolinks包下载TCGA数据

这个过程中，GDCprepare还会将生存数据自动合并到summarizedExperiment对象的colData中。...summarizedExperiment对象和ExpressionSet等对象类型类似，核心组件就是三大件：表达量、列注释和行注释。...表达量：一个表达量矩阵，行是基因或者相关特征，列是样本或相关特征; 列注释：样本相关的注释，比如病人信息、生存数据等等；行注释：基因相关的注释，比如基因名称、长度、位置、ID等等。...Normalization需要控制的三个不均衡因素是文库大小、基因长度及文库组成：文库大小：比如样本A是样本B的测序量的两倍，那么在同等表达水平下，样本A的基因的Counts值就是B的两倍；基因长度...生存分析时根据基因的中位数将其分为High和Low，使用log-rank检验显著性，也可以使用cox回归。

3K3 1

roughnet绘制带有纹理填充的网络图

欢迎关注R语言数据分析指南 ❝本节来介绍一款R包「roughnet」其最主要用来绘制网络图时添加纹理填充，小编测试后发现挺有趣的有多了一种图形展示方式。...igraph) install.packages(c("signnet","graphlayouts")) library(signnet) library(graphlayouts) library(dplyr...) 绘制纹理填充网络图 g <- make_graph("Zachary") # 创建一个名为 "Zachary" 的图形对象 V(g)$shape <- "circle" # 将图形中的节点形状设置为圆形...ifelse(E(main)$sign == 1, 3, 1) # 根据边的符号（sign）确定边的宽度 xy <- layout_with_stress(main, weights = 1/w) # 使用...600，高度为 600 的 roughnet 图形，使用 Herculanum 字体 roughnet(main, width = 600, height = 600, font = "30px Herculanum

1332 0

70-R茶话会15-你的编程菜鸟路上缺失的一课

1-switch和case_when 在做数据分析时，常常遇到的一个场景是，1,2,3 需要转换成其对应的"a","b","c"。比如在对结果进行分类统计的时候。...) c b c c b c c c c a a a b b b b c b a a 3 2 3 3 2 3 3 3 3 1 1 1 2 2 2 2 3 2 1 1 但这样的循环编程语法是低效的，dplyr...提供了向量化的操作[[37-R茶话会07-高效的处理数据框的列]]： > dplyr::case_when( + tmp %in% "a" ~ 1, + tmp %in% "b" ~ 2, +...如果你的脚本中需要你的某些签名或密码，最好不要把他们放在脚本里，因为你的脚本可能会分享给其他人。...可以使用系统变量： Sys.setenv( DSN = "database_name", UID = "User ID", PASS = "Password" ) 接着在脚本中使用这些键即可

3K4 0

使用 R 语言从 PDF 文档中提取表格

由于一个知识星球的小伙伴急需学习如何从 PDF 文档中提取表格，所以先插这个课，「使用 R 语言处理 netCDF 数据」系列的课程下次再发新的哈。...本课程介绍了如何使用 R 语言从 WHO（世界卫生组织）的官网上下载新冠疫情的每日报告以及如何从这些报告中的表格里面提取数据。... 标签的 href 属性，然后过滤出链接中含 .pdf 的，最后再用一个循环下载所有的 PDF 文件即可。...read_html('https://www.who.int/emergencies/diseases/novel-coronavirus-2019/situation-reports/') -> html # 创建...包，因此在使用这个包之前你需要在电脑上安装 Java 和在 R 里面安装 rJava 包。

3.5K1 0

gt包绘制表格详细介绍！

分组操作隐藏、移动某些列列分组操作合并列 & 添加标签使用格式化功能对齐方式及风格主体的字体美化标题和副标题添加脚注 library(gt) library(dplyr) glimpse...包中的union()函数功能差不多。...一次合并2列，第一列的列名会被保留，第2列的列名会被丢弃，默认使用{1} & {2}代替第一列、第二列，支持HTML语法 tab % cols_merge(columns = c...fn = function(x) { # transmission这一列中每行的第一个字符表示speed speed <- substr(x, 1, 1)...# 第2-3个字符表示type,共分成4中type type <- dplyr::case_when( substr(x, 2,

6842 0

生信技能树- R语言-day7

sort是给向量排序的library(dplyr)arrange(test, Sepal.Length) #默认根据这一列从小到大给整个数据框排序arrange(test, desc(Sepal.Length...duplicated(mm)] 提取没有重复的第一次出现的mutate，数据框新增一列mutate(test, new = Sepal.Length * Sepal.Width) new是新产生的列名新加之后...，如果没有赋值，那么这个数据框还是没有新加，没有赋值，就没有产生补充select（）filter（）如何简化连续的步骤1....else2， ifelse（，，ifelse）在ifelse里加一个ifelse补充 case_when练习题1.加载deg.Rdata,根据a、b两列的值，按照以下条件生成向量x：load("deg.Rdata...ID2.一些搞文件的函数----dir() # 列出工作目录下的文件dir(pattern = ".R$") #列出工作目录下以.R结尾的文件file.create("douhua.txt") #用代码创建文件

740 0

EF Core使用CodeFirst在MySql中创建新数据库以及已有的Mysql数据库如何使用DB First生成域模型

view=aspnetcore-2.1 使用EF CodeFirst在MySql中创建新的数据库，我们首先在appsettings.json文件夹中，使用json对来给出mysql数据库连接语句，其次在...Startup.cs中使用MySql的中间价来注入MySql服务，在这里，我使用的MySql驱动是Pomelo.EntityFramoworkCore.MySql。...这个新的数据库上下文一定要有构造函数。...做好之后，使用如下命令创建新的数据库：首先打开Nuget管理控制台： Add-Migration xxxx Update-Database 如果我们就生成了数据库了，还会给我们生成一个Migration...那么如果有了数据库怎么使用DbContext呢？从现有的MySql数据库中使用DB First来创建数据表模型在这种方案下，我们只需要引入第三方的mysql数据库驱动就可以。

3172 0

生信入门马拉松之R语言基础-脚本项目管理、条件循环、表达矩阵和一丢丢数据挖掘(Day 7)

save(pd,exp,gpl,file = "steploutput,Rdata")，这句代码将几个第一个脚本有用的变量保存到Rdata文件中，下次使用这些变量时直接加载load这个Rdata文件即可...undefined表格文件需要赋值，读取参数不同导致读取结果不同，不能在后续代码中同等处理。Rdata可以保存多个变量，下次使用只需要一次load可以的到多个数据。...代码2实现结果和代码1相同2.6 练习library(dplyr)x = c(-1,-1,4,5,2,0)case_when(x>0 ~ "A", x==0 ~ "0",...加载test1.Rdata，将两个数据框按照probe_id列连接在一起，按共同列取交集load("test1.Rdata")library(dplyr)merge1 <- merge(dat,ids,...表达矩阵：一行是一个基因在所有样品里的表达，一列是一个样本里所有基因的表达。在表达矩阵中，寻找在不同组有表达差异的基因。

1400 0

大更新，pandas终于有case_when方法了！

数分小伙伴们都知道，SQL中的case when语句非常好用，尤其在加工变量的时候，可以按照指定的条件的进行赋值，并且结合其他嵌套用法还可以实现非常强大的功能。...二、case_when用法东哥了解了一下case_when用法，总结了以下几点要点。对象：case_when属于series对象的方法，dataframe对象无法使用。...对于condition和replacement的要求可以看出，case_when的用法非常的灵活。举例下面创建一组数据说明，是不同学生的三科考试成绩。...[90, 84, 69, 73, 98, 83], physic = [84, 58, 74, 93, 87, 86] )) df 首先，对三科考试求和生成总分数新列...df['score_all'] = df.sum(axis=1) 对加工的总成绩列使用case_when方法，生成1-5的排序等级。

2291 0

答读者问：R语言ggplot2画气泡图展示相关性分析的结果~文末留言送书

有读者在公众号后台留言问下图应该如何实现 image.png image.png 实现这个图的办法很多，今天的推文介绍使用R语言ggplot2包实现这个图的方法。...第一步是准备数据部分数据集如下 image.png image.png 总共4列前两列是变量第三列是相关系数第四列是显著性P值前面的变量需要注意的是，因为只画上三角，所以准备数据的时候是...：总共的变量是10个第一列10个x1，接下来是紧接着9个x2,然后是8个x3 第一步树读入数据 df<-read.csv("20210320.csv",header=T) head(df) 增加一列显著性的星号...library(dplyr) df%>% mutate(label=case_when( signi<0.001 ~ "***", signi>0.001&signi<0.01 ~...1,1,0.2))+ scale_size_continuous(range = c(5,15))+ guides(size=F) 这样就对了 image.png 接下来是添加文字，首先把对角线那一列去掉

2.2K2 0

ggpol包优雅的绘制蝴蝶图

ungroup() %>% # 解除分组 unite(col = "status_gender", gender, status, sep = "_") %>% # 将性别和选举状态合并成一个新的列...构建数据用于在图形中添加空白区域 dummy_constituency = tibble(y = c(-max(results$y), 0, 0, max(results$y)), # y值为最大最小值及其负值...gender = c("female", "female", "male", "male")) %>% # 性别列 mutate(gender_label = case_when...映射选区、y值和主导性别 shape = 19,size = 4) + geom_blank(data = dummy_constituency, # 添加空白图层，使用虚拟选区数据..., dir = "h", scales = "free", reverse_num = TRUE) + # 分面显示，根据性别标签分面 coord_flip() + # 翻转坐标轴，使选区显示在y

2521 0

GEO表达芯片平台 — GPL14951，注释文件探索过程

最近jimmy老师在学徒群了扔了一个数据挖掘文献图表复现任务，作为老师的新晋小透明学徒，希望可以表现一下，在分析数据集GSE62133时，并没有其平台GPL14951相应的注释包，把这个探索过程分享一下吧...首先是在jimmy老师4年前博客整理的芯片平台对应R包找：(16)芯片探针与基因的对应关系-生信菜鸟团博客2周年精选文章集的确这个平台无法找到！...空白列这样，时间过了两三天，重新鼓起勇气继续探索下查平台的title：Illumina HumanHT-12 WG-DASL V4.0 R2 expression beadchip 搜索这个title...[grep("GSM", names(.))])) %>% #去除symbol中的NA filter(SYMBOL_ID !...上述问题的突破点就是寻找平台的title 这是一个通过【检索+意外发现】而解决问题的过程，遇到问题多探索、多思考、多检索，会柳暗花明收获填补了对芯片种类的认知空白，以前可能都是用affymetrix

9.4K8 6

RNA-seq 保姆教程：差异表达分析（二）

差异分析将基因计数导入 R/RStudio 工作流程完成后，您现在可以使用基因计数表作为 DESeq2 的输入，使用 R 语言进行统计分析。 7.1....导入表达矩阵开始导入文件夹中的 featureCounts 表。本教程将使用 DESeq2 对样本组之间进行归一化和执行统计分析。...使行名成为基因标识符 countdata <- read.table("example/final_counts.txt", header = TRUE, skip = 1, row.names = 1) # 从列标识符中删除...SampleID 必须是第一列。...统计获取基因数量的基本统计数据 # 使用 FDR 调整 p-values 从检测中获取结果 results <- results(ddsMat, pAdjustMethod = "fdr", alpha

7833 0

玩转数据处理120题｜R语言版本

how：any-只要有空值就删除（默认），all-全部为空值才删除 inplace：False-返回新的数据集（默认），True-在原数据集上操作 57 数据可视化题目：绘制收盘价的折线图难度：⭐...") # [1] ‘0.8.99.9002’ 82 数据创建题目：从NumPy数组创建DataFrame 难度：⭐ 备注使用numpy生成20个0-100随机数 R语言解法 df1 <- sapply...V1) 83 数据创建题目：从NumPy数组创建DataFrame 难度：⭐ 备注使用numpy生成20个0-100固定步长的数 R语言解法 df2 % dplyr::rename(`0` = "seq(0, 99, 5)") 84 数据创建题目：从NumPy数组创建DataFrame 难度：⭐ 备注使用numpy生成20个指定分布...数据创建题目：将df1，df2，df3按照行合并为新DataFrame 难度：⭐⭐ R语言解法 df <- rbind(df1,df2,df3) 86 数据创建题目：将df1，df2，df3按照列合并为新

8.7K1 0

r语言学习day6

")library(dplyr)示例数据直接使用内置数据集iris的简化版:test <- iris[c(1:2,51:52,101:102),] #dplyr五个基础函数library(dplyr)创建一个示例数据框...data <- data.frame( x = 1:5, y = 6:10)使用mutate()函数创建新的变量data <- mutate(data, z = x + y)输出结果print(data...包依赖：inner_join()函数属于dplyr包，因此需要先加载dplyr包才能使用。merge()函数是基础R的一部分，无需额外加载包即可使用。...例如，当两个数据框中存在重复的列名时，inner_join()会自动为其中一个数据框的重复列名添加后缀以区分，而merge()函数则不会自动处理，需要手动指定后缀。...合并行与合并列在相当于base包里的cbind()函数和rbind()函数;注意，bind_rows()函数需要两个表格列数相同，而bind_cols()函数则需要两个数据框有相同的行数

1321 0

点击加载更多

扫码

添加站长进交流群

领取专属 10元无门槛券

手把手带您无忧上云

扫码加入开发者社群

相关资讯

热门标签

活动推荐

运营活动

活动名称

广告关闭