热门标签 | HotTags
当前位置:  开发笔记 > 编程语言 > 正文

Python基础教程:Pythoncsv模块:处理csv文件

csv文件本质上是文本文件,用来保存表格数据,它使用逗号来分隔行内的单元,使用换行符来分隔不同的行。下面是一个普通的csv文件,包含两行和两列,内容如下:第一行第一列,第一行第二列

csv 文件本质上是文本文件,用来保存表格数据,它使用逗号来分隔行内的单元,使用换行符来分隔不同的行。下面是一个普通的 csv 文件,包含两行和两列,内容如下:

第一行第一列,第一行第二列
第二行第一列,第二行第二列

在 Excel 中的显示效果如图 1 所示。

Python csv模块:处理csv文件
图 1 普通的csv文件

如果某个单元格中包含“,”分隔符,那么它将使用双引号将单元格的内容包裹起来。如下面的 csv 文件内容就是包裹有“,”分隔符的情形。

"包括,的单元",第一行第二列
第二行第一列,第二行第二列

注意,第一行第一列是用双引号包裹的,显示效果如图 2 所示。

Python csv模块:处理csv文件
图 2 带有“,”分隔符的单元

如果某个单元格包含多行,也是将该单元格的内容包裹在双引号内。例如,下面的 csv 文件的第一行第一列就包含多行。

"包含换行符的单元
第2行
第三行",第一行第二列
第二行第一列,第二行第二列

在 Excel 中的显示效果如图 3 所示。

Python csv模块:处理csv文件
图 3 包含多行内容的单元格

如果单元格的内容包含双引号呢?其还是用双引号来包裹,内容中的双引号用两个连续的双引号来表示。例如下面的csv文件的第一行第一列就包含“””字符:

Python csv模块:处理csv文件
图 4 带有双引号的单元格

可以看出 csv 文件的格式还是比较简单的,通过“,”和“””就能完整表示一个仅包含文本内容的表格数据。在 Python 中,可以不通过操作文本文件的方式来对 csv 文件进行处理,因为其可以通过很多库来直接操作单元格内容,而不用关心 csv 文件格式的细节。本节将介绍一个比较常见的处理 csv 文件的模块——csv。

csv 模块是 Python 的一个内置模块,不需要安装只需要在使用之前将其引入即可,方式如下:

import csv

对 csv 文件的操作主要有两个,一个是读入,一个是写出。首先来介绍读入,在 csv 模块中有一个类 reader,该类实例对象是可迭代的,就是可以用 for…in… 语句来变量所有的 csv 的行。同时其还有一个属性 line_num,表示当前读入的行号。

下面以图 1 所示的 csv 文件为例来演示相关操作:

  >>> import csv                                  # 引入csv模块  >>> reader_obj = csv.reader(open('demo1.csv', 'r', encoding="utf-8"))  >>> for line in reader_obj:                             # 对每行进行操作  ...   print("line number: %d" % reader_obj.line_num)    # 显示当前行号  ...   print("content: %s" % str(line))          # 显示当前行的内容  ...   print("")                                 # 输出换行  ...                                             # 结束for循环  line number: 1                                  # 行号为1  content: ['第一行第一列', '第一行第二列']         # 内容为列表                                                  # 第6行的输出  line number: 2                                  # 行号为2  content: ['第二行第一列', '第二行第二列']         # 第二行的内容

下面是一个查找诈骗电话的例子。诈骗电话有这样一个特点,就是这些电话仅往外拨,从来不接听别人的电话。现在我们拿到一个完整的通话记录,内容显示如图 5 所示。

Python csv模块:处理csv文件
图 5 通话记录

其中第一列是呼叫方的号码,第二列是被叫方的电话号码,第三列是呼叫开始的时间,第四列是通话时长。我们希望通过这些数据来找到其中的诈骗电话号码。我们依次读出所有的行,然后在呼叫方号码列表中查找没有出现在被叫方号码列表的号码,它们就可能是诈骗电话号码。

实现代码如下:

  import sys, csv  # 打开通话记录文件  if sys.version_info.major == 3: # python3      f = open("telephone.csv", "r",encoding="utf-8", newline="n")  else:                                          # Python 2      f = open("telephone.csv", "r")  reader = csv.reader(f)  caller_list = []                               # 呼叫方号码列表  callee_list = []                               # 被叫方号码列表,最开始都为空  for record in reader:                          # 对每个记录进行处理      # 第一行是表头,不进行处理      if reader.line_num == 1:          continue      caller_list.append(record[0])       # 记录下所有的呼叫号码      # 记录下所有的被呼叫号码      callee_list.append(record[1])  caller_list = set(caller_list)          # 去掉重复的呼叫号码  f.close()                               # 关闭文件  # 对于每个呼叫号码  for caller in caller_list:              # 如果它没有被呼叫过,那么标定为骗子号码      if caller not in callee_list:          print(caller, "is Cheat Telephone Number")

运行后的输出如下:

$ python cheatTel1.py
13243767000 is Cheat Telephone Number

下面我们来介绍将数据输出到 csv 文件中的方法。在 csv 模块中有一个 writer 类,其提供 writerow() 和 writerows() 两个接口函数。使用这两个接口函数便可以将列表数据输出到 csv 文件中。

下面是一个简单的例子,其使用 writerow() 来产生一个 csv 文件:

  import csv  csv_writer_obj = csv.writer(open("writeDemo1.csv", "w"))  csv_writer_obj.writerow(("a", "b", 12, 24.6))

输出文件 writeDemo1.csv 的内容在 Excel 中的显示如图 6 所示。

Python csv模块:处理csv文件
图 6 writeDemo1.csv文件的内容

在输出时并不要求每行的列数相同,例如下面的代码,其输出了三行,这三行的列数分别为 4、2、3。

  import csv  csv_writer_obj = csv.writer(open("writeDemo2.csv", "w"))  csv_writer_obj.writerow(("a", "b", 12, 24.6))  csv_writer_obj.writerow(("c", "d"))  csv_writer_obj.writerow(("e", "", "1"))

输出 csv 文件,内容如图 7 所示。

Python csv模块:处理csv文件
图 7 writeDemo2.csv文件的内容

另外一个接口函数是 writerows(),顾名思义,该接口函数可以一次写入多行。下面的例子便是将一个列表写入到 csv 文件中。

  import csv  data = [                          # 列表,每个元素代表一行      ["a", "b", "c"],      ["d", "e", "f"],  ]  csv_writer_obj = csv.writer(open("writeDemo3.csv", "w"))  csv_writer_obj.writerows(data)

输出 csv 文件,内容如图 8 所示。

Python csv模块:处理csv文件
图 8 writeDemo3.csv的内容

以上就是Python基础教程:Python csv模块:处理csv文件相关内容,想了解更多python基础教程关注(编程笔记)。


推荐阅读
  • 用pandas库修改excel文件里的内容,并把excel文件格式存为csv格式,再将csv格式改为html格式
    假设有Excel文件data.xlsx,其中内容为:     ID age height    sex weight张三  1  39    181 female     85李四  2  40    180   male     80王五  3  38    178 female     78赵六  4  59    1 ... [详细]
  • 本文介绍了在Python3中如何使用选择文件对话框的格式打开和保存图片的方法。通过使用tkinter库中的filedialog模块的asksaveasfilename和askopenfilename函数,可以方便地选择要打开或保存的图片文件,并进行相关操作。具体的代码示例和操作步骤也被提供。 ... [详细]
  • 本文介绍了如何使用python从列表中删除所有的零,并将结果以列表形式输出,同时提供了示例格式。 ... [详细]
  • pythonMatplotlib(二)
    Matplotlib+pandas作图一、对csv文件进行提取ruixi.csv对上述表格进行提取并做图画出图像二、对.xlsx进行提取:rui ... [详细]
  • python机器学习之数据探索
    🐱今天我们来讲解数据建模之前需要处理的工作,也就是数据探索的过程,很多同学会说,不就是处理缺失值,异常值&# ... [详细]
  • python教程分享Python获取时光网电影数据的实例代码
    一、前言有时候觉得电影真是人类有史以来最伟大的发明,我喜欢看电影,看电影可以让我们增长见闻,学习知识。从某种角度上而言,电影凭借自身独有的魅力大大延长了人类的”寿命&r ... [详细]
  • 本文介绍了Python对Excel文件的读取方法,包括模块的安装和使用。通过安装xlrd、xlwt、xlutils、pyExcelerator等模块,可以实现对Excel文件的读取和处理。具体的读取方法包括打开excel文件、抓取所有sheet的名称、定位到指定的表单等。本文提供了两种定位表单的方式,并给出了相应的代码示例。 ... [详细]
  • 开发笔记:加密&json&StringIO模块&BytesIO模块
    篇首语:本文由编程笔记#小编为大家整理,主要介绍了加密&json&StringIO模块&BytesIO模块相关的知识,希望对你有一定的参考价值。一、加密加密 ... [详细]
  • 基于dlib的人脸68特征点提取(眨眼张嘴检测)python版本
    文章目录引言开发环境和库流程设计张嘴和闭眼的检测引言(1)利用Dlib官方训练好的模型“shape_predictor_68_face_landmarks.dat”进行68个点标定 ... [详细]
  • Python爬虫中使用正则表达式的方法和注意事项
    本文介绍了在Python爬虫中使用正则表达式的方法和注意事项。首先解释了爬虫的四个主要步骤,并强调了正则表达式在数据处理中的重要性。然后详细介绍了正则表达式的概念和用法,包括检索、替换和过滤文本的功能。同时提到了re模块是Python内置的用于处理正则表达式的模块,并给出了使用正则表达式时需要注意的特殊字符转义和原始字符串的用法。通过本文的学习,读者可以掌握在Python爬虫中使用正则表达式的技巧和方法。 ... [详细]
  • 本文介绍了使用Python解析C语言结构体的方法,包括定义基本类型和结构体类型的字典,并提供了一个示例代码,展示了如何解析C语言结构体。 ... [详细]
  • 本文总结了使用不同方式生成 Dataframe 的方法,包括通过CSV文件、Excel文件、python dictionary、List of tuples和List of dictionary。同时介绍了一些注意事项,如使用绝对路径引入文件和安装xlrd包来读取Excel文件。 ... [详细]
  • 基于词向量计算文本相似度1.测试数据:链接:https:pan.baidu.coms1fXJjcujAmAwTfsuTg2CbWA提取码:f4vx2.实验代码:imp ... [详细]
  • csv转为矩阵 python_Python可视化 | Seaborn5分钟入门(六)——heatmap热力图
    Seaborn是基于matplotlib的Python可视化库。它提供了一个高级界面来绘制有吸引力的统计图形。Seaborn其实是在matplotlib的基础上进行了更高级的API ... [详细]
  • 代码如下:#coding:utf-8importstring,os,sysimportnumpyasnpimportmatplotlib.py ... [详细]
author-avatar
妈妈说称号长的人很牛也
这个家伙很懒,什么也没留下!
PHP1.CN | 中国最专业的PHP中文社区 | DevBox开发工具箱 | json解析格式化 |PHP资讯 | PHP教程 | 数据库技术 | 服务器技术 | 前端开发技术 | PHP框架 | 开发工具 | 在线工具
Copyright © 1998 - 2020 PHP1.CN. All Rights Reserved | 京公网安备 11010802041100号 | 京ICP备19059560号-4 | PHP1.CN 第一PHP社区 版权所有