腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
1
回答
groupby
的
代码
优化
python
、
python-3.x
、
pandas
我有下面的
代码
,它基本上执行一个group by操作,然后是一个sum。grouped = df.
groupby
(by=['Cabin'], as_index=False)['Fare'].sum()grouped.columns = ['Cabin', 'testCol'] 然后我将“分组
的
”数据帧与我
的
原始数据帧合并,以计算聚合。df2 = df.merge(grouped, on='Cabin'
浏览 8
提问于2018-02-23
得票数 1
回答已采纳
1
回答
python中
groupby
的
代码
优化
python
、
pandas
、
performance
我希望
优化
一些python
代码
,但我不确定如何处理这个问题,因为我使用python主要是为了分析数据,而且硬编码技能有限,所以欢迎任何意见。我
的
数据如下所示: X Y Stock NumberA 30-40 id2'] = df.
groupby
('y')['total_stocks'].transform('sum') <em
浏览 17
提问于2021-10-22
得票数 1
回答已采纳
1
回答
删除
groupby
并
优化
pandas
代码
python
、
pandas
我正在尝试替换for循环,以便在pandas中获得更好
的
性能。在pandas中使用for循环是性能杀手,请在许多博客中阅读它。现在,我必须应用一些逻辑来设置项目和按emp_id分组。
代码
块如下所示。现在,下面的
代码
可以工作,但是抱怨与性能有关。我不能确定删除
groupby
,有没有其他技术可以让我获得更高
的
性能?emp_groups = self.df.
groupby
("emp_id")
浏览 4
提问于2020-11-16
得票数 0
1
回答
熊猫:
优化
我
的
代码
(
groupby
() / apply())
pandas
我有一个形状
的
数据(RxC) 1.5米x128。我所做
的
工作如下: <df = Read dataframe from file> g = df.
groupby
(grp_cols) g[nongrp_cols].apply(lambda d: d.apply
浏览 1
提问于2015-06-17
得票数 11
回答已采纳
1
回答
避免重复C#中
的
Linq组
c#
、
asp.net-mvc
、
linq
、
optimization
我需要
优化
我
的
代码
。我有些重复
的
密码。但我想
优化
它。谁能帮我
优化
我
的
代码
。我如何才能实现这一通用功能?foreach (var item in hotellocation.
GroupBy
(x => x).ToDictionary(g => g.Key, g => g.Count()))}
浏览 3
提问于2014-09-19
得票数 0
回答已采纳
1
回答
通过bucketBy实现Spark DataFrame / Dataset
groupBy
优化
apache-spark
、
group-by
、
query-optimization
、
parquet
、
bucket
我正在研究一个用例
的
选项,在这种用例中,我们将数据集存储为拼图文件,并希望稍后在读取数据时对特定键运行有效
的
groupBy
查询。我读过一些关于
groupBy
优化
的
文章,但是没有找到太多关于它
的
信息(除了RDD级别的reduceByKey)。我所考虑
的
是,如果数据集是由键写成桶
的
,那么它也将在
groupBy
中使用。从理论上讲,
groupBy
是可以
优化
的
,因为包含该键
浏览 61
提问于2019-05-18
得票数 3
2
回答
优化
groupBy
查询
sql
、
group-by
、
mariadb
、
aggregate-functions
1,2016-01-01,1),(1,2016-01-02,4),(1,2016-01-03,3),(1,2016-01-04,2)id, startDate, endDate上有表A
的
索引,表B有id, date
的
索引。A中
的
行计数约为10K,而B中
的
行计数为200万。上面的查询大约需要5-6秒才能完成。有人能告诉我一些我可以尝试
的
东西吗?
浏览 0
提问于2018-05-12
得票数 0
1
回答
Pandas /
Groupby
/应用
优化
python
、
pandas
、
pandas-groupby
、
pandas-apply
我有一段
代码
试图合并cols。在pandas结构中使用重复
的
cols名称,基本上我正在尝试做与这篇文章相同
的
事情: 在2600列中,只需要将大约30个cols合并成4个cols,比如从第13到第42列。 有没有办法
优化
链接帖子中提到
的
代码
?也许可以找到一种方法来告诉
浏览 18
提问于2020-07-30
得票数 0
2
回答
Laravel
代码
优化
:在Laravel 8中计算特定项目中
的
任务数
laravel
、
collections
、
count
、
statistics
如何
优化
我
的
Laravel
代码
?例如,根据任务
的
状态(已完成、待办、执行)计算特定项目中
的
任务数。)->get(); $totaltask_doing = $tasks->where('status', "TODo")->
groupBy
return $row->count(); $totaltask_todo =
浏览 1
提问于2022-03-24
得票数 -1
2
回答
优化
pandas
groupby
python
python
、
pandas
、
optimization
、
group-by
、
bigdata
有多个客户端拥有由ID引用
的
契约。这些客户在特定
的
时间点填写调查,该时间点由日期(Key_Date)表示。我们有一个dataframe df_result,它包含客户
的
ID和他们填写调查
的
日期。我也希望能够在填写日期之前给出一个范围,所以所有独特
的
产品在过去
的
一年中一直活跃。因此,即使是11个月前
的</em
浏览 8
提问于2017-07-25
得票数 1
回答已采纳
2
回答
EF
GroupBy
查询
优化
c#
、
entity-framework
我有这样
的
方法: { }SELECT
浏览 0
提问于2014-12-21
得票数 5
回答已采纳
2
回答
优化
Python
代码
python
、
datetime
、
pandas
、
optimization
、
dataframe
我已经编写了以下
代码
来预处理这样
的
数据集:school Mon Jul 25 19:04:30 GMT+01:它包含用户参与
的
位置列表以及开始和结束时间。每个位置可能会出现多次,并且没有全面的位置列表。由此,我希望聚合每个位置
的
数据(频率、总时间、平均时间)。如何
优化
代码
? 编辑:基于有帮助
的
评论,我不再重复。然而,我仍然希望在可能
的
情况下进一步
优化</
浏览 1
提问于2017-01-23
得票数 1
1
回答
python:熊猫群&应用
优化
python
、
pandas
、
optimization
我有以下
代码
:我
的
df位于较大
的
一边(大约300000行),而
groupby
生成2300个组。对如何
优化
它有什么想法吗?Python版本: 3.6
浏览 2
提问于2017-06-14
得票数 1
回答已采纳
2
回答
pyspark中
的
优化
pyspark
、
aggregate
我正在用pyspark写
代码
,在那里我正在做过滤,连接,联合,分组操作。但我注意到,在
groupby
操作之前,count()函数需要9分钟,而在
groupby
操作之后,count()函数需要35分钟。我需要一些关于如何
优化
groupby
子句以减少处理时间
的
建议。配置参数: executor内存12g个executors 50个executor核心5个驱动内存40g数据大小约1TBdataframeA = hc.sql("select * f
浏览 3
提问于2016-11-28
得票数 0
1
回答
查看Dataflow如何进行融合
优化
的
最佳方法是什么?
google-cloud-platform
、
google-cloud-dataflow
我正在尝试
优化
一个管道,它从PubSubIO中提取消息并将这些消息发送给第三方API。我有一个有趣
的
观察,如果我在
GroupBy
之后放置一个PubSubIO.read和一个"Degroup“转换,管道
的
吞吐量就会显著增加。我添加
GroupBy
只是为了防止融合
优化
,现在我想知道如何将转换合并到给定
的
管道中。 在融合之后,找出管道是什么样
的
最好
的
方法是什么?
浏览 0
提问于2018-08-29
得票数 1
回答已采纳
2
回答
不包含
GroupBy
的
定义。
c#
、
visual-studio
、
func
Func<Areas.RetailShop.Models.FPSinformation, string>> groupingFunction) return queryable.
GroupBy
,但却出了差错 IQueryable<FPSinformation>不包含“
GroupBy
”
的
定义,最好
的
扩展方法重载ParallelEnumerable.
GroupBy
<string, int>(ParallelQuery<string&
浏览 3
提问于2015-12-16
得票数 0
回答已采纳
2
回答
C#码
优化
GroupBy
c#
、
linq
、
optimization
、
foreach
、
linq-group
下面的
代码
有几个问题。var groupedItems = inputFiles.
GroupBy
(q => q.Name.ToLower().Split('_').ElementAt(2)); ErrorFile(groupedItem); }
浏览 1
提问于2017-01-17
得票数 1
回答已采纳
1
回答
熊猫通过尝试
优化
几个步骤
pandas-groupby
我一直在尝试
优化
一个bokeh服务器,以便在Covid19上计算选定国家
的
实时统计数据。我发现自己重复了一个
groupby
函数来计算新列,并且想知道,在选择了
groupby
之后,我是否可以以类似的方式将它应用到多列上
的
.agg()?目前我做这件事
的
路很长dfall['dpc_cases'] =
浏览 3
提问于2020-05-16
得票数 0
回答已采纳
2
回答
如何
优化
Spark
的
groupBy
()操作
java
、
scala
、
apache-spark
我
的
问题是关于RDD上
的
groupBy
()操作
的
选择/
优化
。我有数以百万计
的
Message实例,需要基于某些ID进行分组。我使用
groupBy
()来实现这个目标,但我知道这是一个昂贵
的
事实,需要大量
的
处理时间。因此,我尝试了reduceByKey(func)和combineByKey()作为一种替代方案,这是在我所使用
的
一些资源中提出
的
,但是它不适合于我
的
场景,在这种情况
浏览 4
提问于2016-11-23
得票数 1
回答已采纳
1
回答
hive.
groupby
.skewindata是否依赖于hive.optimize.skewjoin?
hadoop
、
hive
、
bigdata
、
hiveql
根据蜂巢模板:但我不明白hive.
gr
浏览 0
提问于2018-02-12
得票数 2
回答已采纳
点击加载更多
热门
标签
更多标签
云服务器
ICP备案
对象存储
即时通信 IM
云直播
活动推荐
运营活动
广告
关闭
领券