第七色在线视频,2021少妇久久久久久久久久,亚洲欧洲精品成人久久av18,亚洲国产精品特色大片观看完整版,孙宇晨将参加特朗普的晚宴

為了賬號(hào)安全,請(qǐng)及時(shí)綁定郵箱和手機(jī)立即綁定

機(jī)器學(xué)習(xí) -- 特征二值化

所涉及到的几种 sklearn 的二值化编码函数:OneHotEncoder(), LabelEncoder(), LabelBinarizer(), 及pandas.get_dummies()

一、构造数据集:

import pandas as pd

from sklearn.preprocessing import OneHotEncoder

from sklearn.preprocessing import LabelEncoder

from sklearn.preprocessing import LabelBinarizer

pd.set_option('display.width',300)

pd.set_option('display.max_columns',300)

testdata = pd.DataFrame({'pet': ['cat', 'dog', 'dog', 'fish'],'age': [4 , 6, 3, 3],'salary':[4, 5, 1, 1]})

二、观察数据:

        这里我们把 pet、age、salary 都看做类别特征,所不同的是 age 和 salary 都是数值型,而 pet 是字符串型。我们的目的很简单: 把他们全都二值化,进行 one-hot 编码。

三、代码实现

        1、对字符串类型特征 pet 做二值化处理:

                方法总共是有两种:

                    第一种:LabelEncoder() + OneHotEncoder()

pet = OneHotEncoder(sparse=False).fit_transform(LabelEncoder().fit_transform(testdata['pet']).reshape(-1,1))

pet = pd.DataFrame(pet,columns=['pet_cat','pet_dog','pet_fish'])

                    第二:直接调用 LabelBinarizer(),用于数字和字符串都是可以的

pet_binarlizer = LabelBinarizer().fit_transform(testdata.pet)

pet = pd.DataFrame(pet_binarlizer,columns=['pet_cat','pet_dog','pet_fish'])

                    输出结果为:

webp

        2、对数字类型特征 age,salary 做二值化处理:

                直接用 OneHotEncoder() 函数

age_and_salary = OneHotEncoder(sparse= False).fit_transform(testdata[['age',"salary"]])

age_and_salary = pd.DataFrame(age_and_salary,columns=['age_3','age_4','age_6','salary_1','salary_4','salary_5'])

                 结果为:

webp

            3、 pandas 的concat() 连接所有数据

print(pd.concat((testdata,pet,age_and_salary),axis=1))

                结果为:

webp

            4、总上,调用 pandas 库 中 get_dummies() 方法

            print(pd.get_dummies(testdata,columns=testdata.columns))

            结果为:

webp



作者:MLGirl
链接:https://www.jianshu.com/p/d95a78e380e4


點(diǎn)擊查看更多內(nèi)容
TA 點(diǎn)贊

若覺得本文不錯(cuò),就分享一下吧!

評(píng)論

作者其他優(yōu)質(zhì)文章

正在加載中
  • 推薦
  • 評(píng)論
  • 收藏
  • 共同學(xué)習(xí),寫下你的評(píng)論
感謝您的支持,我會(huì)繼續(xù)努力的~
掃碼打賞,你說多少就多少
贊賞金額會(huì)直接到老師賬戶
支付方式
打開微信掃一掃,即可進(jìn)行掃碼打賞哦
今天注冊(cè)有機(jī)會(huì)得

100積分直接送

付費(fèi)專欄免費(fèi)學(xué)

大額優(yōu)惠券免費(fèi)領(lǐng)

立即參與 放棄機(jī)會(huì)
微信客服

購課補(bǔ)貼
聯(lián)系客服咨詢優(yōu)惠詳情

幫助反饋 APP下載

慕課網(wǎng)APP
您的移動(dòng)學(xué)習(xí)伙伴

公眾號(hào)

掃描二維碼
關(guān)注慕課網(wǎng)微信公眾號(hào)

舉報(bào)

0/150
提交
取消