for splitValue in set(dataset[:, featureIndex].tolist()):
首先set是一個無序,無重復的數據結構,所以很多時候使用它來進行去重;但是set接收的函數是原生array,這個怎么辦?我現在有的numpy里面的matrix;于是我查了一下,直接使用matrix.tolist(),但是發現返回值有問題:
import os os.chdir("D:\\galaxy\\aliyunsvn\\code\\MLInAction\\dataset") dataArr = loadDataSet("ex00.txt") dataMat = mat(dataArr) dataMat[:, 0].tolist()
輸出為:
[[0.036098], [0.727098],..
并不是我想要的,因為如果此時將其放于set中將會報錯:
set(dataMat[:, 0].tolist()) >>TypeError: unhashable type: 'list'
于是查了一下,做了調整:
import os os.chdir("D:\\galaxy\\aliyunsvn\\code\\MLInAction\\dataset") dataArr = loadDataSet("ex00.txt") dataMat = mat(dataArr) dataMat[:, 0].A.flatten().tolist() >> [0.036098, 0.712386, ....
很好就是要這種一維的數組,然后再使用數組作為參數放入set中,完美。
set(dataMat[:, 0].A.flatten().tolist())
以上就是本文的全部內容,希望對大家的學習有所幫助,也希望大家多多支持腳本之家。
更多文章、技術交流、商務合作、聯系博主
微信掃碼或搜索:z360901061

微信掃一掃加我為好友
QQ號聯系: 360901061
您的支持是博主寫作最大的動力,如果您喜歡我的文章,感覺我的文章對您有幫助,請用微信掃描下面二維碼支持博主2元、5元、10元、20元等您想捐的金額吧,狠狠點擊下面給點支持吧,站長非常感激您!手機微信長按不能支付解決辦法:請將微信支付二維碼保存到相冊,切換到微信,然后點擊微信右上角掃一掃功能,選擇支付二維碼完成支付。
【本文對您有幫助就好】元
