首页
学习
活动
专区
圈层
工具
发布
社区首页 >问答首页 >多索引Pandas Dataframe中2列的差异

多索引Pandas Dataframe中2列的差异
EN

Stack Overflow用户
提问于 2018-08-17 02:34:54
回答 1查看 2K关注 0票数 2

我有一个Pandas DataFrame,它的列是具有2个级别的MultiIndex,如下所示:

代码语言:javascript
复制
index = ['monday','tuesday','wednesday']
tuples = [('yesterday','travel'),('yesterday','food'),('today','travel'),('today','food')]
columns = pd.MultiIndex.from_tuples(tuples,names=[None,'category'])
df = pd.DataFrame(np.random.randint(low=0, high=10, size=(3, 4)), index=index, columns=columns)

我只是想将“旅行”和“食物”列的差异存储到一个新的顶级列中-例如,“diff”-紧挨着“昨天”和“旅行”。

代码语言:javascript
复制
diff = t['today'] - t['yesterday']

我将返回我感兴趣的底层DataFrame,但是我不知道如何在整个DataFrame中正确地放置它。

类似于:

代码语言:javascript
复制
pd.concat([df,diff],axis=1)

产生一个有趣的(但不正确的)结果

EN

回答 1

Stack Overflow用户

回答已采纳

发布于 2018-08-17 02:42:04

一种方法是将diff的列作为MultiIndex,如下所示:

代码语言:javascript
复制
diff = df['today'] - df['yesterday']
diff.columns = pd.MultiIndex.from_tuples([('diff',col) for col in diff.columns])

然后当你使用concat时,它提供了:

代码语言:javascript
复制
print (pd.concat([df,diff],axis=1))
          yesterday       today        diff     
category     travel food travel food travel food
monday            8    7      7    1     -1   -6
tuesday           1    3      0    8     -1    5
wednesday         6    4      5    6     -1    2

编辑:另一种不使用MultiIndex的方法是直接执行创建列的操作:

代码语言:javascript
复制
df[[('diff','travel'),('diff','food')]] = df['today'] - df['yesterday']

更通用的方法是,您可以使用get_level_values

代码语言:javascript
复制
df[[('diff',col) for col in df.columns.get_level_values(1).unique()]] = df['today'] - df['yesterday']
票数 2
EN
页面原文内容由Stack Overflow提供。腾讯云小微IT领域专用引擎提供翻译支持
原文链接:

https://stackoverflow.com/questions/51883381

复制
相关文章

相似问题

领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档