婷婷综合国产,91蜜桃婷婷狠狠久久综合9色 ,九九九九九精品,国产综合av

主頁 > 知識庫 > 利用python進行數據加載

利用python進行數據加載

熱門標簽:地圖標注視頻廣告 高德地圖標注是免費的嗎 老人電話機器人 梅州外呼業務系統 北京電信外呼系統靠譜嗎 洪澤縣地圖標注 大連crm外呼系統 百度地圖標注位置怎么修改 無錫客服外呼系統一般多少錢

前言

最近參加了datawhale的組隊學習活動,在組隊學習動員下,開始通過強迫自己輸出來實現更好的輸入與處理,6-15開始自己的第一次文章發布,我會把自己這個真的很小白遇到的問題寫出來,希望能給屏幕前小白的你帶來幫助。

工作中大量繁瑣的自動化,把以前在學校摸過的python重新撿起來,不成體系的、拼圖一樣把需要的工作搭建起來,工作暫時是可用上了,每天節省了至少3個小時的數據處理工作,手里拿著python這個錘子,看什么都像釘子。

首先,你要先學會安裝軟件,anaconda軟件,安裝成功后,你點擊jupyter notebook打開代碼框。

現在可以開始嘗試做數據分析了。

一、數據加載

1.1 載入數據

數據集下載 https://www.kaggle.com/c/titanic/overview

1.1.1 導入包

導入numpy和pandas

import pandas as pd
import numpy as np

如果出錯了,需要注意大小寫、有沒有單詞寫錯了

1.1.2 載入數據

(1) 使用相對路徑載入數據
(2) 使用絕對路徑載入數據  

df = pd.read_csv('train.csv')
df.head(3)
df = pd.read_csv('/Users/Documents/train.csv')
df.head(3)

注意絕對路徑的 “  /  ” 方向不要錯。

1.1.3 大文件時要分塊讀取

每1000行為一個數據模塊,逐塊讀取

chunker = pd.read_csv('train.csv', chunksize=1000)

1.1.4

對著整個表修改列名:將表頭改成中文,索引改為乘客ID ,要注意的是,要記得把名字跟列一一對上,數量對上、順序對上

PassengerId => 乘客ID
Survived => 是否幸存
Pclass => 乘客等級(1/2/3等艙位)
Name => 乘客姓名
Sex => 性別
Age => 年齡
SibSp => 堂兄弟/妹個數
Parch => 父母與小孩個數
Ticket => 船票信息
Fare => 票價
Cabin => 客艙
Embarked => 登船港口

df = pd.read_csv('train.csv', names=['乘客ID','是否幸存','倉位等級','姓名','性別','年齡','兄弟姐妹個數','父母子女個數','船票信息','票價','客艙','登船港口'],index_col='乘客ID',header=0)
df.head()

1.2 初步觀察

導入數據后,我們可以對數據的整體結構和樣例進行概覽,比如說,數據大小、有多少列,各列都是什么格式的,是否包含null等。info 后面加()跟不加()會 有不同的內容。

print(df.info())

如想在python的查看數據,可以用head

df.head(10)
df.tail(15)

判斷數據是否為空,為空的地方返回True,其余地方返回False

df.isnull().head()

1.3 保存數據

在工作目錄下保存為一個新文件train_chinese.csv,如不希望表格自帶index,可以加入index=false

df.to_csv('train_chinese.csv',index=flase)

到此這篇關于利用python進行數據加載的文章就介紹到這了,更多相關python數據加載內容請搜索腳本之家以前的文章或繼續瀏覽下面的相關文章希望大家以后多多支持腳本之家!

您可能感興趣的文章:
  • Python加載數據的5種不同方式(收藏)
  • Python實現爬取網頁中動態加載的數據
  • Python使用Selenium爬取淘寶異步加載的數據方法
  • python用pandas數據加載、存儲與文件格式的實例

標簽:洛陽 安慶 泉州 長春 吉林 清遠 岳陽 怒江

巨人網絡通訊聲明:本文標題《利用python進行數據加載》,本文關鍵詞  利用,python,進行,數據,加載,;如發現本文內容存在版權問題,煩請提供相關信息告之我們,我們將及時溝通與處理。本站內容系統采集于網絡,涉及言論、版權與本站無關。
  • 相關文章
  • 下面列出與本文章《利用python進行數據加載》相關的同類信息!
  • 本頁收集關于利用python進行數據加載的相關信息資訊供網民參考!
  • 推薦文章
    主站蜘蛛池模板: 谷城县| 甘南县| 连南| 郁南县| 右玉县| 保靖县| 建瓯市| 疏附县| 大石桥市| 岫岩| 班戈县| 上饶县| 随州市| 嵊州市| 盐源县| 福鼎市| 东安县| 托里县| 万源市| 夹江县| 孟州市| 达日县| 轮台县| 通化市| 元江| 苗栗市| 南宁市| 康平县| 南投县| 凤山市| 禄丰县| 嫩江县| 洛川县| 高尔夫| 马山县| 栾川县| 陆良县| 宁陵县| 彭阳县| 甘孜县| 沾益县|