Excel数据处理 #Python
涉及单词
1.head 显示数据行数
2.header(header=None 取消表头) 表头
3.sep 分割 (后面加=)
4.数据类型: {a1:[b1,b2,b3],……} 注意,数据要加引号
5.column(s) 列 重点注意拼写!!!
6.index 行
7.object 对象
语法
(1)下载、导入
注:本文所使用的所有技术均依赖于pandas,并结合.ipynb
pip install pandas
下载pandas
import pandas as pd
导入pandas并将其缩写为pd(pandas后可不写,但改为pd更省力)
(2)语法
data = {'state' : ['Ohio','Ohio','Ohio','Nevada',],
'year' : ['2000','2001','2002','2003'],
'pop' : ['1.5','1.7','3.6','2.4']}
frame = pd.DataFrame(data)
新建一个数据集名为“data”,并将其保存到frame变量,作为Excel显示 注意:data的每个元素中必须有空格
完成后输出:

pd1 = pd.DataFrame(frame,columns=['year','state','pop'])#columns 列
pd1
将Frame的头调换顺序,原来的"state,year,pop",改为"year,state,pop",另存为pd1变量
完成后输出:

pd2 = pd.DataFrame(data,columns=['year','state','pop'],index=['one','two','three','four'])#columns 列 index 行
pd2 #object 对象
这个代码将data中的头数据改为"year,state,pop",行改为"one,two,three,four"
运行结果:

(3)数据分割处理
#sep 分割
import pandas as pd
MD=pd.read_csv("movieusers.csv",sep="|")
导入movieusers,分割设为"|",并存为MD变量
MU=pd.read_csv("movieusers.csv",sep="|",header=None)
导入movieusers,分割设为"|",并存为MU变量,并将表头删除,变成"0,1,2,......"
注意:pandas中NaN表示没有数据
感谢您的阅读!
更多推荐



所有评论(0)