本文介绍了 pandas 以复制品为枢轴的处理方法,对大家解决问题具有一定的参考价值,需要的朋友们下面随着小编来一起学习吧!

问题描述

示例数据如下:

d = pd.DataFrame({'name': ['Adam', 'Adam', 'Bob', 'Bob', 'Craig'],
              'number': [111, 222, 333, 444, 555],
              'type': ['phone', 'fax', 'phone', 'phone', 'fax']})

name    number  type
------   ------  -----
Adam    111     phone
Adam    222     fax
Bob     333     phone
Bob     444     phone
Craig   555     fax

我正在尝试将号码(电话和传真)转换为宽格式,理想输出:

name    fax     phone
----    -----   -----
Adam    222.0   111.0
Bob     NaN     333.0
Bob     NaN     444.0
Craig   555.0   NaN

当我尝试使用pivot方法并运行以下代码时:

p = d.pivot(index='name', columns = 'type', values='number').reset_index()

我收到错误ValueError: Index contains duplicate entries, cannot reshape,因为Bob有两个电话号码。

是否有解决此问题的方法?

推荐答案

这里,您可以使用cumcount创建附加密钥

d['key']=d.groupby(['name','type']).cumcount()
p = d.pivot_table(index=['key','name'], columns = 'type', values='number',aggfunc='sum').reset_index()
p
Out[71]:
type  key   name    fax  phone
0       0   Adam  222.0  111.0
1       0    Bob    NaN  333.0
2       0  Craig  555.0    NaN
3       1    Bob    NaN  444.0

这篇关于 pandas 以复制品为枢轴的文章就介绍到这了,希望我们推荐的答案对大家有所帮助,也希望大家多多支持!

05-21 09:11