pandas计数value_counts() (简)

在pandas里面常用value_counts确认数据出现的频率。

import pandas as pd
df = pd.DataFrame({'区域' : ['西安', '太原', '西安', '太原', '郑州', '太原'], 
         '10月份销售' : ['0.477468', '0.195046', '0.015964', '0.259654', '0.856412', '0.259644'],
         '9月份销售' : ['0.347705', '0.151220', '0.895599', '0236547', '0.569841', '0.254784']})
print(df)

 

 统计每个区域出现多少次:

print(df['区域'].value_counts()) #每个区域都被计数,并且默认从高到低排序。如果想升序排列,设置参数 ascending = True:

 

 如果想得出计数占比,可以加参数 normalize=True

print(df['区域'].value_counts(normalize=True))

 

 注:空值默认剔除掉的。value_counts()返回的结果是一个Series数组,可以跟别的数组进行计算。

posted @ 2021-05-08 15:42  LLLxling  阅读(180)  评论(0编辑  收藏  举报