GroupBy 结果到列表字典中
- 2025-01-15 08:45:00
- admin 原创
- 82
问题描述:
我有一张如下所示的 Excel 表:
Column1 Column2 Column3
0 23 1
1 5 2
1 2 3
1 19 5
2 56 1
2 22 2
3 2 4
3 14 5
4 59 1
5 44 1
5 1 2
5 87 3
我希望提取该数据,按第 1 列对其进行分组,然后将其添加到字典中,使其显示如下:
{0: [1],
1: [2,3,5],
2: [1,2],
3: [4,5],
4: [1],
5: [1,2,3]}
这是我目前的代码
excel = pandas.read_excel(r"e: est_data.xlsx", sheetname='mySheet', parse_cols'A,C')
myTable = excel.groupby("Column1").groups
print myTable
但是,我的输出如下所示:
{0: [0L], 1: [1L, 2L, 3L], 2: [4L, 5L], 3: [6L, 7L], 4: [8L], 5: [9L, 10L, 11L]}
谢谢!
解决方案 1:
您可以groupby
继续Column1
然后拨打Column3
电话apply(list)
吗to_dict
?
In [81]: df.groupby('Column1')['Column3'].apply(list).to_dict()
Out[81]: {0: [1], 1: [2, 3, 5], 2: [1, 2], 3: [4, 5], 4: [1], 5: [1, 2, 3]}
或者
In [433]: {k: list(v) for k, v in df.groupby('Column1')['Column3']}
Out[433]: {0: [1], 1: [2, 3, 5], 2: [1, 2], 3: [4, 5], 4: [1], 5: [1, 2, 3]}
解决方案 2:
根据文档,GroupBy.groups
:
是一个字典,其键是计算的唯一组,相应的值是属于每个组的轴标签。
如果您想要这些值本身,您可以使用groupby
“Column1”,然后调用apply
并传递list
方法应用于每个组。
然后您可以根据需要将其转换为字典:
In [5]:
dict(df.groupby('Column1')['Column3'].apply(list))
Out[5]:
{0: [1], 1: [2, 3, 5], 2: [1, 2], 3: [4, 5], 4: [1], 5: [1, 2, 3]}
(注:看一下这个 SO 问题以了解为什么数字后面跟着L
)
相关推荐
热门文章
项目管理软件有哪些?
热门标签
云禅道AD