涉及单词

1.head                                                                                                                          显示数据行数

2.header(header=None 取消表头)                                                                                        表头 

3.sep                                                                                                                      分割 (后面加=)

4.数据类型: {a1:[b1,b2,b3],……} 注意,数据要加引号

5.column(s) 列     重点注意拼写!!!

6.index 行

7.object 对象 

语法

(1)下载、导入

注:本文所使用的所有技术均依赖于pandas,并结合.ipynb

pip install pandas

下载pandas

import pandas as pd

导入pandas并将其缩写为pd(pandas后可不写,但改为pd更省力)

(2)语法

data = {'state' : ['Ohio','Ohio','Ohio','Nevada',],
       'year' : ['2000','2001','2002','2003'],
       'pop' : ['1.5','1.7','3.6','2.4']}
frame = pd.DataFrame(data)

新建一个数据集名为“data”,并将其保存到frame变量,作为Excel显示 注意:data的每个元素中必须有空格

完成后输出:

pd1 = pd.DataFrame(frame,columns=['year','state','pop'])#columns 列
pd1

将Frame的头调换顺序,原来的"state,year,pop",改为"year,state,pop",另存为pd1变量

完成后输出:

pd2 = pd.DataFrame(data,columns=['year','state','pop'],index=['one','two','three','four'])#columns 列 index 行
pd2 #object 对象

这个代码将data中的头数据改为"year,state,pop",行改为"one,two,three,four"

运行结果:

(3)数据分割处理

#sep 分割
import pandas as pd
MD=pd.read_csv("movieusers.csv",sep="|")

导入movieusers,分割设为"|",并存为MD变量

MU=pd.read_csv("movieusers.csv",sep="|",header=None)

导入movieusers,分割设为"|",并存为MU变量,并将表头删除,变成"0,1,2,......"

注意:pandas中NaN表示没有数据

感谢您的阅读!

Logo

Agent 垂直技术社区,欢迎活跃、内容共建。

更多推荐