佳木斯湛栽影视文化发展公司

主頁(yè) > 知識(shí)庫(kù) > 詳細(xì)介紹在pandas中創(chuàng)建category類型數(shù)據(jù)的幾種方法

詳細(xì)介紹在pandas中創(chuàng)建category類型數(shù)據(jù)的幾種方法

熱門標(biāo)簽:電話運(yùn)營(yíng)中心 呼叫中心市場(chǎng)需求 客戶服務(wù) 企業(yè)做大做強(qiáng) 百度AI接口 語(yǔ)音系統(tǒng) Win7旗艦版 硅谷的囚徒呼叫中心

在pandas中創(chuàng)建category類型數(shù)據(jù)的幾種方法之詳細(xì)攻略

 T1、直接創(chuàng)建 category類型數(shù)據(jù)
可知,在category類型數(shù)據(jù)中,每一個(gè)元素的值要么是預(yù)設(shè)好的類型中的某一個(gè),要么是空值(np.nan)。 

T2、利用分箱機(jī)制(結(jié)合max、mean、min實(shí)現(xiàn)二分類)動(dòng)態(tài)添加 category類型數(shù)據(jù)

輸出結(jié)果
[NaN, 'medium', 'medium', 'fat']
Categories (2, object): ['medium', 'fat']
   name    ID  age  age02  ... weight    test01    test02  age02_mark
0   Bob     1  NaN     14  ...  140.5  1.000000  1.000000      Minors
1  LiSa     2   28     26  ...  120.8  2.123457  2.123457      Adults
2  Mary         38     24  ...  169.4  3.123457  3.123457      Adults
3  Alan  None           6  ...  155.6  4.123457  4.123457      Minors
 
[4 rows x 12 columns]

實(shí)習(xí)代碼

import pandas as pd
import numpy as np
 
contents={"name": ['Bob',    'LiSa',           'Mary',            'Alan'],
     "ID":  [1,       2,             ' ',             None],  # 輸出 NaN
     "age": [np.nan,    28,              38 ,             '' ],  # 輸出 
     "age02": [14,      26,              24 ,             6], 
    "born": [pd.NaT,   pd.Timestamp("1990-01-01"), pd.Timestamp("1980-01-01"),    ''],   # 輸出 NaT
     "sex": ['男',     '女',            '女',            None,],  # 輸出 None
     "hobbey":['打籃球',   '打羽毛球',          '打乒乓球',          '',],  # 輸出 
     "money":[200.0,        240.0,          290.0,           300.0], # 輸出
     "weight":[140.5,        120.8,         169.4,           155.6], # 輸出
     "test01":[1,  2.123456789,    3.123456781011126,  4.123456789109999],  # 輸出
     "test02":[1,  2.123456789,    3.123456781011126,  4.123456789109999],  # 輸出
     }
data_frame = pd.DataFrame(contents)
 
 
 
# T1、直接創(chuàng)建 category類型數(shù)據(jù)
weight_mark=pd.Categorical(['thin','medium','medium','fat'],categories=['medium','fat'])
print(weight_mark)
 
 
 
# T2、利用分箱機(jī)制(結(jié)合max、mean、min實(shí)現(xiàn)二分類)動(dòng)態(tài)添加 category類型數(shù)據(jù)
col_age_des=pd.Series(data_frame['age02']).describe()
age_ranges=[col_age_des['min']-1,col_age_des['mean'],col_age_des['max']+1]
age_labels=['Minors','Adults']        # 高于平均值的為胖
data_frame['age02_mark']=pd.cut(data_frame['age02'],age_ranges,labels=age_labels)
print(data_frame)

到此這篇關(guān)于詳細(xì)介紹在pandas中創(chuàng)建category類型數(shù)據(jù)的幾種方法的文章就介紹到這了,更多相關(guān)pandas創(chuàng)建category內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

您可能感興趣的文章:
  • python-pandas創(chuàng)建Series數(shù)據(jù)類型的操作
  • 對(duì)pandas中兩種數(shù)據(jù)類型Series和DataFrame的區(qū)別詳解
  • Pandas實(shí)現(xiàn)數(shù)據(jù)類型轉(zhuǎn)換的一些小技巧匯總
  • Pandas數(shù)據(jù)類型之category的用法

標(biāo)簽:山西 海南 喀什 山西 長(zhǎng)沙 崇左 安康 濟(jì)南

巨人網(wǎng)絡(luò)通訊聲明:本文標(biāo)題《詳細(xì)介紹在pandas中創(chuàng)建category類型數(shù)據(jù)的幾種方法》,本文關(guān)鍵詞  ;如發(fā)現(xiàn)本文內(nèi)容存在版權(quán)問(wèn)題,煩請(qǐng)?zhí)峁┫嚓P(guān)信息告之我們,我們將及時(shí)溝通與處理。本站內(nèi)容系統(tǒng)采集于網(wǎng)絡(luò),涉及言論、版權(quán)與本站無(wú)關(guān)。
  • 相關(guān)文章
  • 收縮
    • 微信客服
    • 微信二維碼
    • 電話咨詢

    • 400-1100-266
    胶南市| 正阳县| 海城市| 天柱县| 和政县| 达日县| 云安县| 光泽县| 红桥区| 老河口市| 金寨县| 凌源市| 扶绥县| 海原县| 贵德县| 巍山| 兴隆县| 孟州市| 吉木乃县| 曲阳县| 友谊县| 越西县| 洮南市| 东阳市| 六安市| 望江县| 平和县| 双鸭山市| 周口市| 黔西| 龙州县| 昌乐县| 福建省| 阳高县| 兴仁县| 溧阳市| 泾川县| 融水| 克拉玛依市| 广丰县| 乌鲁木齐市|