数据读取与保存

Pandas 教程 · 第 3 章 · 8 次浏览

选数据是 Pandas 最常用操作:选列、选行、按条件筛选。区分清楚 loc 和 iloc 是关键。

选择方法

  • df["列名"]:选一列(Series)
  • df[["a", "b"]]:选多列
  • df.loc[行标签, 列标签]:按标签选
  • df.iloc[行位置, 列位置]:按位置选
  • df[条件]:布尔筛选

代码示例

import pandas as pd

df = pd.DataFrame({
    "name": ["张三", "李四", "王五", "赵六"],
    "age": [25, 30, 22, 35],
    "city": ["烟台", "青岛", "济南", "烟台"],
    "salary": [8000, 12000, 6000, 15000],
})

# 选列
print(df["name"])
print(df[["name", "age"]])

# 按行(iloc 位置)
print(df.iloc[0])          # 第一行
print(df.iloc[1:3])        # 第 2-3 行

# 按标签(loc)
print(df.loc[df.index[0], "name"])   # 第一个名字

# 条件筛选
young = df[df["age"] < 30]
print(young)

# 多条件
print(df[(df["age"] >= 25) & (df["city"] == "烟台")])
📚 Python 语法速查
常用条目速查,完整版见对应教程章节。可复制代码到在线运行中测试。
写法 / 语法作用
print("hello")输出到控制台
name = "张三"变量赋值(无需声明类型)
if x > 0: ...条件判断(注意冒号和缩进)
for i in range(10): ...循环(缩进是语法的一部分)
while x < 10: ...条件循环
def fn(a, b): return a + b定义函数
class Person: ...定义类
list = [1, 2, 3]列表(可改)
tuple = (1, 2)元组(不可改)
dict = {"key": "value"}字典(键值对)
set = {1, 2, 3}集合(去重)
len(obj)取长度
str(x) / int(x) / float(x)类型转换
s.split(",")字符串按分隔符拆分
" ".join(list)列表拼接成字符串
import os导入模块
from math import sqrt从模块导入指定函数
try: ... except Exception as e: ...异常捕获
with open("a.txt", "r") as f: ...文件读取(自动关闭)
f"你好 {name}"f-string 格式化
lambda x: x * 2匿名函数
list(map(fn, arr))函数式处理列表
range(start, stop, step)生成数字序列
if __name__ == "__main__":主入口判断
pip install 包名安装第三方包(命令行)