问在Python中将每月数据转换为每日数据
EN

Stack Overflow用户

提问于 2019-06-24 15:41:57

回答 1查看 1.2K关注 0票数 3

我正在尝试将月度数据点转换为每周数据点，但为了实现这一目标，我将数据集分解为每日数据集，然后将其聚合到周级别。当聚合发生时(通过groupby)，我无法将数据分解到每日级别。

Month_End_Date  A   B   C   D
2/28/2019   Pikachu Starter 100000  5302
2/28/2019   Jolteon Evolution   250000  7935
3/31/2019   Charmander  Starter 62810   5103
3/31/2019   Bulbasaur   Starter 16868   6035
4/30/2019   Flareon Evolution   62810   5103
4/30/2019   Eevee   Starter 16868   6035
5/31/2019   Glaceon Evolution   62810   5103
5/31/2019   Leafeon Evolution   16868   6035
6/30/2019   Umbreon Evolution   62810   5103
6/30/2019   Espeon  Evolution   16868   6035

我正在尝试将第一行转换为

Month_End_Date  A   B   C   D
2/1/2019    Pikachu Starter 3571.428571 189.3571429
2/2/2019    Pikachu Starter 3571.428571 189.3571429
2/3/2019    Pikachu Starter 3571.428571 189.3571429
2/4/2019    Pikachu Starter 3571.428571 189.3571429
2/5/2019    Pikachu Starter 3571.428571 189.3571429

其中，日值除以28 (因为2月份有28天)

我已经搜索了ffill和其他东西，但无法完全解决这个问题

pandas

python

回答 1

Stack Overflow用户

发布于 2019-06-24 16:15:10

首先通过DataFrame.drop_duplicates删除每列的重复项Month_End_Date，然后通过向前填充缺少的值来删除DataFrame.resample，最后只过滤每个月和年的28行：

#convert column to datetimes and then to first day of month
df['Month_End_Date'] = (pd.to_datetime(df['Month_End_Date'], format='%m/%d/%Y')
                         .dt.to_period('m').dt.to_timestamp())
df = df.drop_duplicates('Month_End_Date').set_index('Month_End_Date')
#for duplicated last row of data
df.loc[df.index[-1] + pd.offsets.MonthEnd(1)] = df.iloc[-1]
df = df.resample('d').ffill()

df1 = df[df.groupby(df.index.to_period('m')).cumcount() < 28]
print (df1.tail())
                      A          B      C     D
Month_End_Date                                 
2019-06-24      Umbreon  Evolution  62810  5103
2019-06-25      Umbreon  Evolution  62810  5103
2019-06-26      Umbreon  Evolution  62810  5103
2019-06-27      Umbreon  Evolution  62810  5103
2019-06-28      Umbreon  Evolution  62810  5103

如果需要所有值，不仅first per groups使用GroupBy.cumcount创建helper column by counter，还使用groupby创建resample chain

df['Month_End_Date'] = (pd.to_datetime(df['Month_End_Date'], format='%m/%d/%Y')
                         .dt.to_period('m').dt.to_timestamp())
df['g'] = df.groupby('Month_End_Date').cumcount()
df = df.set_index('Month_End_Date')
df.loc[df.index[-1] + pd.offsets.MonthEnd(1)] = df.iloc[-1]

df = df.groupby('g').resample('d').ffill().reset_index(level=0, drop=True)
df2 = df[df.groupby(['g', df.index.to_period('m')]).cumcount() < 28]
print (df2.tail())
                     A          B      C     D  g
Month_End_Date                                   
2019-06-24      Espeon  Evolution  16868  6035  1
2019-06-25      Espeon  Evolution  16868  6035  1
2019-06-26      Espeon  Evolution  16868  6035  1
2019-06-27      Espeon  Evolution  16868  6035  1
2019-06-28      Espeon  Evolution  16868  6035  1

票数 2

页面原文内容由Stack Overflow提供。腾讯云小微IT领域专用引擎提供翻译支持

原文链接：

https://stackoverflow.com/questions/56731914

复制

相似问题

问在Python中将每月数据转换为每日数据
EN

回答 1

Stack Overflow用户

社区

活动

圈层

关于

腾讯云开发者

热门产品

热门推荐

更多推荐

问在Python中将每月数据转换为每日数据EN

回答 1

Stack Overflow用户

社区

活动

圈层

关于

腾讯云开发者

热门产品

热门推荐

更多推荐

问在Python中将每月数据转换为每日数据
EN