百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术文章 > 正文

Python CSV 模块通关秘籍:数据表格处理不求人

cac55 2025-06-13 11:34 24 浏览 0 评论

对话实录

小白:(苦恼)我导出的CSV用Excel打开全是乱码!
专家:(递上秘籍)(掏出魔法书)**编码问题!用utf-8-sigma保存!

CSV格式初体验

CSV后缀的文件是标准文件格式,可以通过文本编辑器或者excel表格打开,

使用非常广泛;使用文本编辑器打开后,每一行都以英文逗号隔开。

基础操作,初窥门径

1. 模块导入

Python 内置了csv模块,无需额外安装,直接导入即可:

import csv

2.常用函数速查表

函数 / 类名

作用

示例场景

csv.reader

按行读取 CSV 文件

逐行解析日志文件

csv.writer

按行写入 CSV 文件

批量写入用户数据

csv.DictReader

以字典形式读取 CSV 文件

按字段名提取学生成绩

csv.DictWriter

以字典形式写入 CSV 文件

生成结构化报表

3.使用csv.reader逐行读取CSV文件

with open('data.csv', 'r', encoding='utf-8') as f:
    reader = csv.reader(f)
    for row in reader:
        print(row)  # 输出 ['name', 'age'], ['Alice', '25'], ['Bob', '30']

4. 使用csv.writer写入CSV文件

data = [
    ['Charlie', 35],
    ['David', 40]
]
with open('new_data.csv', 'w', encoding='utf-8-sig', newline='') as f:
    writer = csv.writer(f)
    writer.writerows(data)

专家提醒:使用utf-8-sig编码解决Excel的乱码问题!

5. 使用csv.DictReader以字典形式读取 CSV 文件

with open('data.csv', 'r', encoding='utf-8') as f:
    reader = csv.DictReader(f)
    reader.fieldnames = ['a','b']
    for row in reader:
        print(row['a'])  # 输出 'Alice', 'Bob'

专家提醒:csv_read.fieldnames = ['a','b'] 表示设置每一行数据对应的字典的key值,如果不设置,会使用csv第一行的内容作为字典的key

6. 使用csv.DictWriter以字典形式写入 CSV 文件

fieldnames = ['name', 'age']
with open('new_dict_data.csv', 'w', encoding='utf-8', newline='') as f:
    writer = csv.DictWriter(f, fieldnames=fieldnames)
    writer.writeheader()
    writer.writerow({'name': 'Eve', 'age': 28})
    writer.writerows([{'name': 'Eve', 'age': 28}])

专家提醒:使用csv.DictWriter()函数,参数fieldnames定义字典的key,通过writeheader函数写入csv文件的第一行,通过writerows函数写入列表中的所有字典对象的value值或者writerow函数写入单个字典对象。

实际案例

案例 1:按列提取数据

从scores.csv中提取数学成绩:

math_scores = []
with open('scores.csv', 'r', encoding='utf-8') as f:
    reader = csv.DictReader(f)
    for row in reader:
        math_scores.append(int(row['math']))
print(math_scores)  # 输出 [85, 78]

案例 2:数据清洗与转换

将日期格式dd/mm/yyyy转为yyyy-mm-dd:

new_data = []
with open('dates.csv', 'r', encoding='utf-8') as f:
    reader = csv.reader(f)
    for row in reader:
        date_parts = row[0].split('/')
        new_date = f"{date_parts[2]}-{date_parts[1]}-{date_parts[0]}"
        new_data.append([new_date])

with open('new_dates.csv', 'w', encoding='utf-8', newline='') as f:
    writer = csv.writer(f)
    writer.writerows(new_data)

案例 3:合并多个 CSV 文件

合并file1.csv和file2.csv:

merged_data = []
for filename in ['file1.csv', 'file2.csv']:
    with open(filename, 'r', encoding='utf-8') as f:
        reader = csv.reader(f)
        merged_data.extend([row for row in reader])

with open('merged.csv', 'w', encoding='utf-8', newline='') as f:
    writer = csv.writer(f)
    writer.writerows(merged_data)

闭坑指南

换行符问题

错误示范(Windows 下多出空行):

with open('test.csv', 'w', encoding='utf-8') as f:
    writer = csv.writer(f)
    writer.writerow(['test'])

正确做法(添加newline=''):

with open('test.csv', 'w', encoding='utf-8', newline='') as f:
    writer = csv.writer(f)
    writer.writerow(['test'])

数据类型转换

错误示范(直接比较字符串):

with open('scores.csv', 'r', encoding='utf-8') as f:
    reader = csv.DictReader(f)
    for row in reader:
        if row['math'] > 80:  #  字符串比较错误
            print(row)

正确做法(转换为数值):

with open('scores.csv', 'r', encoding='utf-8') as f:
    reader = csv.DictReader(f)
    for row in reader:
        if int(row['math']) > 80:
            print(row)

专家工具箱

1. 处理复杂分隔符

读取制表符分隔的文件:

with open('tab_separated.csv', 'r', encoding='utf-8') as f:
    reader = csv.reader(f, delimiter='\t')
    for row in reader:
        print(row)

2 自定义CSV格式

csv.register_dialect('my_dialect',
                    delimiter='|',
                    quoting=csv.QUOTE_MINIMAL)

with open('data.csv', 'w') as f:
    writer = csv.writer(f, dialect='my_dialect')

3. 处理百万级大文件

def process_large_file(file_path):
    with open(file_path) as f:
        reader = csv.reader(f)
        for row in reader:
            process(row)  # 逐行处理,避免内存爆炸

4. 与Pandas配合使用

import pandas as pd

# 读取CSV
df = pd.read_csv('big_data.csv')

# 写入CSV
df.to_csv('output.csv', index=False)

小白:(豁然开朗)原来 CSV 模块能这么高效处理数据!
专家:(微笑)记住:掌握 CSV 模块,数据表格处理就能得心应手!

相关推荐

Mac电脑强制删除任何软件方法-含自启动应用

对于打工者来说,进入企业上班使用的电脑大概率是会被监控起来,比如各种流行的数据防泄漏DLP,奇安信天擎,甚至360安全卫士,这些安全软件你想卸载是非常困难的,甚至卸载后它自己又安装回来了,并且还在你不...

Linux基础知识 | 文件与目录大全讲解

1.linux文件权限与目录配置1.文件属性Linux一般将文件可存取的身份分为三个类别,分别是owner/group/others,且三种身份各read/write/execute等权限文...

文件保护不妥协:2025 年 10 款顶级加密工具推荐

数据安全无小事,2025年这10款加密工具凭借独特功能脱颖而出,从个人到企业场景全覆盖,第一款为Ping32,其余为国外英文软件。1.Ping32企业级加密核心工具,支持200+文件格...

省心省力 一个软件搞定系统维护_省心安装在哪里能找到

◆系统类似于我们居住的房间,需要经常打理才能保持清洁、高效。虽然它本身也自带一些清理和优化的工具,但借助于好用的第三方工具来执行这方面的任务,会更让人省心省力。下面笔者就为大家介绍一款集多项功能于一身...

JAVA程序员常用的几个工具类_java程序员一般用什么软件写程序

好的工具做起事来常常事半功倍,下面介绍几个开发中常用到的工具类,收藏一下,也许后面真的会用到。字符串处理:org.apache.commons.lang.StringUtilsisBlank(Char...

手工解决Windows10的若干难题_windows10系统卡顿怎么解决

【电脑报在线】很多朋友已经开始使用Win10,估计还只是测试版本的原因,使用过程中难免会出现一些问题,这里介绍解决一些解决难题的技巧。技巧1:让ProjectSpartan“重归正途”从10074...

System32文件夹千万不能删除,看完这篇你就知道为什么了

C:\Windows\System32目录是Windows操作系统的关键部分,重要的系统文件存储在该目录中。网上的一些恶作剧者可能会告诉你删除它,但你不应该尝试去操作,如果你尝试的话,我们会告诉你会发...

Windows.old 文件夹:系统备份的解析与安全删除指南

Windows.old是Windows系统升级(如Win10升Win11)或重装时,系统自动在C盘创建的备份文件夹,其核心作用是保留旧系统的文件、程序与配置,为“回退旧系统”提供保...

遇到疑难杂症?Windows 10回收站问题巧解决

回收站是Windows10的一个重要组件。然而,我们在使用过程中,可能会遇到一些问题。例如,不论回收站里有没有文件,都显示同一个图标,让人无法判别回收站的空和满的真实情况;没有了像Windows7...

卸载软件怎么彻底删掉?简单几个步骤彻底卸载,电脑小白看过来

日常工作学习生活中,我们需要在安装一些软件程序,但随着软件的更新迭代速度,很多时候我们需要重新下载安装新的程序,这时就需要将旧的一些软件程序进行卸载。但是卸载软件虽然很简单,但是很多小伙伴们表示卸载不...

用不上就删!如何完全卸载OneDrive?

作为Windows10自带的云盘,OneDrive为资料的自动备份和同步提供了方便。然而,从隐私或其他方面考虑,有些人不愿意使用OneDrive。但Windows10本身不提供直接卸载OneDri...

【Linux知识】Linux下快速删除大量文件/文件夹方法

在Linux下,如果需要快速删除大量文件或文件夹,可以使用如下方法:使用rm命令删除文件:可以使用rm命令删除文件,例如:rm-rf/path/to/directory/*这个命令会递...

清理系统不用第三方工具_清理系统垃圾用什么软件

清理优化系统一定要借助于优化工具吗?其实,手动优化系统也没有那么神秘,掌握了方法和技巧,系统清理也是一件简单和随心的事。一方面要为每一个可能产生累赘的文件找到清理的方法,另一方面要寻找能够提高工作效率...

系统小技巧:软件卸载不了?这里办法多

在正常情况下,我们都是通过软件程序组中的卸载图标,或利用控制面板中的“程序和功能”模块来卸载软件的。但有时,我们也会发现利用卸载图标无法卸载软件或者卸载图标干脆丢失找不到了,甚至控制面板中卸载软件的功...

麒麟系统无法删除文件夹_麒麟系统删除文件权限不够

删除文件夹方法例:sudorm-rf文件夹名称。删除文件方法例:sudorm-r文件名包括扩展名。如果没有权限,给文件夹加一下权限再删。加最高权限chmod775文件名加可执行权限...

取消回复欢迎 发表评论: