作者lance5487 ( )
看板Python
标题Re: [问题] pandas 问题
时间Mon Feb 5 22:31:58 2018
不好意思,想再问另外一个问题
df= UserID time
A 16:01
A 16:03
A 16:04
A 16:07
A 16:08
B 17:10
B 17:11
想计算每个USER最近值相剪的数列
也就是
A 2=16:03-16:01
A 1=16:04-16:03
A 3=16:07-16:04
B 1=17:11-17:10
※ 引述《lance5487 ( )》之铭言:
: 不好意思,小弟是pandas新手,想请问pandas的问题,请各位大大帮帮小弟忙QQ
: 假设今天有一个df
: df= UserID time
: A 16:01
: A 16:03
: A 16:04
: A 16:07
: A 16:08
: B 17:10
: B 17:11
: 想统计根据groupby UserID後 以 X 分钟时间内统计的平均,众数,最大值
: 假设以五分钟为例
: A
: 16:01 5分钟後为 16:06 => 共 3 笔 (16:01,16:03,16:04)
: 16:03 5分钟後为 16:08 => 共 4 笔 (16:03,16:04,16:07,16:08)
: 16:04 5分钟後为 16:09 => 共 3 笔 (16:04,16:07,16:08)
: 16:07 5分钟後为 16:12 => 共 2 笔 (16:07,16:08)
: 16:08 5分钟後为 16:13 => 共 1 笔 (16:08)
: 平均:(1+2+3+3+4)/5=3.6
: 最大值:4笔
: 众数:3笔
: 最後整理成
: USERID 平均 众数 最大值
: A 3.6 3 4
: B 1.5 1或2(1.5是最好) 2
--
※ 发信站: 批踢踢实业坊(ptt.cc), 来自: 36.228.126.136
※ 文章网址: https://webptt.com/cn.aspx?n=bbs/Python/M.1517841120.A.7D5.html
好像不行 因为这样好像会计算到不同user,想求的只有同一个user底下的差值
,因为user蛮多的QQ
※ 编辑: lance5487 (220.129.59.40), 02/06/2018 06:07:47
2F:→ lance5487: 查到了 好像用groupby跟diff就可以了 02/06 06:43
3F:→ lance5487: 原本想说关键字不好下 囧 02/06 06:45
4F:推 goldflower: 喔喔没看到要用user分 02/06 10:11