首頁手記 dataframe進行常用統計、分組統計平均絕對偏差等...

dataframe進行常用統計、分組統計平均絕對偏差等操作函數。

標簽：

深度學習

pandas在dataframe中提供了丰富的统计、合并、分组、缺失值等操作函数。

1.统计函数

df.count() #非空元素计算
df.min() #最小值
df.max() #最大值
df.idxmin() #最小值的位置，类似于R中的which.min函数
df.idxmax() #最大值的位置，类似于R中的which.max函数
df.quantile(0.1) #10%分位数
df.sum() #求和
df.mean() #均值
df.median() #中位数
df.mode() #众数
df.var() #方差
df.std() #标准差
df.mad() #平均绝对偏差
df.skew() #偏度
df.kurt() #峰度
df.describe() #一次性输出多个描述性统计指标

2.分组统计
依托group by
单列如：df.groupby(‘sex’).sum()
通过多个列进行分组形成一个层次索引，然后执行函数：df.groupby([‘sex’,’B’]).sum()

案例：

#!usr/bin/env python#_*_ coding:utf-8 _*_import pandas as pdimport pymysqldef get_data():
    conn=pymysql.connect(
                 host='192.168.1.xxx',
                 port=3306,
                 user='root',
                 passwd='xxx',
                 db='kmind',
                 charset='utf8'
             )
    sqldb="SELECT socre,review_star,review_author_id,review_author_level as count2 FROM source_mg_mfw_socre_ljon_01 WHERE\
            review_author_id IN (select review_author_id from (SELECT review_author_id,COUNT(*) AS count1 FROM\
            source_mg_mfw_socre_ljon_01 GROUP BY review_author_id HAVING count1>3)A)and socre!=' '"
    pd_data=pd.read_sql(sqldb,conn)
    pd_data["subtract"]=(pd_data["socre"]-pd_data["review_star"]*2)**2
    print(pd_data.head(5))    #获取对应统计效果描述
    print(pd_data.groupby("review_author_id").mean().describe())
    print(pd_data.groupby("review_author_id").mad().describe())
    print(len(pd_data.loc[pd_data["subtract"]<0.983275]))
    print(pd_data.loc[pd_data["subtract"]<0.983275])if __name__=="__main__":
    get_data()

对应的原始数据结构

对应的部分数据描述

點擊查看更多內容

為 TA 點贊

若覺得本文不錯，就分享一下吧！

評論

評論

共同學習，寫下你的評論

評論加載中...

展開查看更多評論

作者其他優質文章

正在加載中

慕斯卡3302699

算法工程師

手記
篇

粉絲

58

獲贊與收藏

314

關注作者，訂閱最新文章

閱讀免費教程

后端通用面試教程

41個小節 32486 366

網絡編程入門教程

20個小節 13447 254

Pandas 入門教程

25個小節 20073 381

推薦

評論

收藏

共同學習，寫下你的評論



感謝您的支持，我會繼續努力的～

掃碼打賞，你說多少就多少

贊賞金額會直接到老師賬戶

支付方式

打開微信掃一掃，即可進行掃碼打賞哦

今天注冊有機會得

100積分直接送

付費專欄免費學

大額優惠券免費領

立即參與放棄機會

點擊
抽獎

慕課手記新用戶專享福利

恭喜你，你的運氣太好了，居然抽中了 100個積分！

恭喜你，抽中了價值元的專欄！

太棒了，直接落到你賬戶里！

積分商城里的羅技鼠標、機械鍵盤、
Kindle 閱讀器、小米平衡車
Apple iPad （10.2英寸）、大額優惠券
在等著你去兌換了噢

作者：

免費贈送

兌換碼：1111222211 復制

優惠券可用于購買實戰課、體系課
無門檻使用

先去看看，有什么好東西馬上兌換我愛學習，選課去


亚洲在线久爱草,狠狠天天香蕉网,天天搞日日干久草,伊人亚洲日本欧美

熱搜

最近搜索清空

dataframe進行常用統計、分組統計平均絕對偏差等操作函數。

閱讀免費教程

dataframe進行常用統計、分組統計平均絕對偏差等操作函數。