伴隨著大數(shù)據(jù)時代的到來,Python的熱度居高不下,已成為職場人士必備的技能,它不僅可以從事網(wǎng)絡(luò)爬蟲、人工智能、Web開發(fā)、游戲開發(fā)等工作,還是數(shù)據(jù)分析的首選語言。那么,學習Python數(shù)據(jù)分析可以做什么?
第一、檢查數(shù)據(jù)表
Python中使用shape函數(shù)來查看數(shù)據(jù)表的維度,也就是行數(shù)和列數(shù)。你可以使用info函數(shù)查看數(shù)據(jù)表的整體信息,使用dtypes函數(shù)來返回數(shù)據(jù)格式。Lsnull是Python中檢查空置的函數(shù),你可以對整個數(shù)據(jù)進行檢查,也可以單獨對某一列進行空置檢查,返回的結(jié)果是邏輯值,包括空置返回True,不包含則返回False。使用unique函數(shù)查看唯一值,使用Values函數(shù)用來查看數(shù)據(jù)表中的數(shù)值。
第二,數(shù)據(jù)表清洗
Python中處理空值的方法比較靈活,可以使用Dropna函數(shù)用來刪除數(shù)據(jù)表中包括空值的數(shù)據(jù),也可以使用fillna函數(shù)對空值進行填充。Python中dtype是查看數(shù)據(jù)格式的函數(shù),與之對應(yīng)的是asstype函數(shù),用來更改數(shù)據(jù)格式,Rename是更改名稱的函數(shù),drop_duplicate函數(shù)函數(shù)重復值,replace函數(shù)實現(xiàn)數(shù)據(jù)轉(zhuǎn)換。
第三,數(shù)據(jù)預(yù)處理
數(shù)據(jù)預(yù)處理是對清洗完的數(shù)據(jù)進行整理以便后期統(tǒng)計和分析工作,主要包括數(shù)據(jù)表的合并、排序、數(shù)值分列、數(shù)據(jù)分組以及標記等工作。在Python中可以使用merge函數(shù)對兩個數(shù)據(jù)表進行合并,合并的方式為inner,此外還有l(wèi)eft、right和outer方式。使用ort_values函數(shù)和sort_index函數(shù)完成排序,使用where函數(shù)完成數(shù)據(jù)分組,使用split函數(shù)實現(xiàn)分列。
第四,數(shù)據(jù)提取
主要是使用三個函數(shù):loc、iloc和ix,其中l(wèi)oc函數(shù)按標準值進行提取,iloc按位置進行提取,ix可以同時按標簽和位置進行提取。除了按標簽和位置提取數(shù)據(jù)意外,還可以按照具體的條件進行提取。
第五,數(shù)據(jù)篩選匯總
Python中使用loc函數(shù)配合篩選條件來完成篩選功能,配合sum和count函數(shù)還能實現(xiàn)Excel中sumif和countif函數(shù)的功能。Python中使用的主要函數(shù)是groupby和pivot_table。
以上文章由北京達內(nèi)教育課程顧問整理編輯發(fā)布,部分文章來自網(wǎng)絡(luò)內(nèi)容真實性請自行核實或聯(lián)系我們,了解相關(guān)專業(yè)課程信息您可在線咨詢也可免費申請試課。關(guān)注官方微信了解更多:150 3333 6050
免 費 申 請 試 課