首頁手記機器學習算法應用中常用技巧-2

機器學習算法應用中常用技巧-2

標簽：

機器學習算法

7. 降维－PCA

n_components为降到多少维，用原数据fit后，再用transform转换成降维后的数据。

from sklearn.decomposition import PCA
pca = PCA(n_components = 6)
pca.fit(good_data)
reduced_data = pca.transform(good_data)
reduced_data = pd.DataFrame(reduced_data, columns = ['Dimension 1', 'Dimension 2'])

8. 聚类－选择类别数

用 silhouette coefficient 计算每个数据到中心点的距离，-1 (dissimilar) to 1 (similar) 根据这个系数来评价聚类算法的优劣。

from sklearn.cluster import KMeansfrom sklearn.metrics import silhouette_score
cluster = KMeans(n_clusters=2, random_state=0).fit(reduced_data)
preds = cluster.predict(reduced_data)
score = silhouette_score(reduced_data, preds)

选择分数最大的个数作为聚类的类别数。

9. 恢复维度

例如数据，先经过 log，又经过 PCA降维，要恢复回去，先用 pca.inverse_transform，再用 np.exp

log_centers = pca.inverse_transform(centers)
true_centers = np.exp(log_centers)
true_centers = pd.DataFrame(np.round(true_centers), columns = data.keys())

数据变化：

10. 自定义accuracy

分类问题可以自己写accuracy的函数

def accuracy_score(truth, pred):
    """ Return accuracy score for input truth and prediction"""
    
    if len(truth)==len(pred):        return "Accuracy for prediction: {:.2f}%.".format((truth==pred).mean()*100)    else:        return "Numbers do not match!"

點擊查看更多內容

為 TA 點贊

若覺得本文不錯，就分享一下吧！

評論

評論

共同學習，寫下你的評論

評論加載中...

展開查看更多評論

作者其他優質文章

正在加載中

Alice嘟嘟

手記
篇

粉絲

75

獲贊與收藏

280

關注作者，訂閱最新文章

閱讀免費教程

Python 算法入門教程

15個小節 29202 1121

算法入門教程

15個小節 33171 694

后端通用面試教程

41個小節 32087 358

推薦

評論

收藏

共同學習，寫下你的評論



感謝您的支持，我會繼續努力的～

掃碼打賞，你說多少就多少

贊賞金額會直接到老師賬戶

支付方式

打開微信掃一掃，即可進行掃碼打賞哦

今天注冊有機會得

100積分直接送

付費專欄免費學

大額優惠券免費領

立即參與放棄機會

點擊
抽獎

慕課手記新用戶專享福利

恭喜你，你的運氣太好了，居然抽中了 100個積分！

恭喜你，抽中了價值元的專欄！

太棒了，直接落到你賬戶里！

積分商城里的羅技鼠標、機械鍵盤、
Kindle 閱讀器、小米平衡車
Apple iPad （10.2英寸）、大額優惠券
在等著你去兌換了噢

作者：

免費贈送

兌換碼：1111222211 復制

優惠券可用于購買實戰課、體系課
無門檻使用

先去看看，有什么好東西馬上兌換我愛學習，選課去


亚洲在线久爱草,狠狠天天香蕉网,天天搞日日干久草,伊人亚洲日本欧美

熱搜

最近搜索清空

機器學習算法應用中常用技巧-2

7. 降维－PCA

8. 聚类－选择类别数

9. 恢复维度

10. 自定义accuracy

閱讀免費教程