热门标签 | HotTags
当前位置:  开发笔记 > 编程语言 > 正文

python操作excel_详解Python操作Excel文件

点击上方“后端技术精选”,选择“置顶公众号”技术文章第一时间送达!前言本篇文章主要总结了一下利用python操作Excel文件的第三方库和方法。常见库简

点击上方“后端技术精选”,选择“置顶公众号”

技术文章第一时间送达!

前言

本篇文章主要总结了一下利用python操作Excel文件的第三方库和方法。

常见库简介

1.xlrd

xlrd是一个从Excel文件读取数据和格式化信息的库,支持.xls以及.xlsx文件。

地址:http://xlrd.readthedocs.io/en/latest/

  • xlrd支持.xls,.xlsx文件的读

  • 通过设置on_demand变量使open_workbook()函数只加载那些需要的sheet,从而节省时间和内存(该方法对.xlsx文件无效)。

  • xlrd.Book对象有一个unload_sheet方法,它将从内存中卸载工作表,由工作表索引或工作表名称指定(该方法对.xlsx文件无效)

2.xlwt

xlwt是一个用于将数据和格式化信息写入旧Excel文件的库(如.xls)。

地址:https://xlwt.readthedocs.io/en/latest/

  • xlwt支持.xls文件写。

3.xlutils

xlutils是一个处理Excel文件的库,依赖于xlrd和xlwt。

地址:http://xlutils.readthedocs.io/en/latest/

  • xlutils支持.xls文件。

  • 支持Excel操作。

4.xlwings

xlwings是一个可以实现从Excel调用Python,也可在python中调用Excel的库。

地址:http://docs.xlwings.org/en/stable/index.html

  • xlwings支持.xls读,支持.xlsx文件读写。

  • 支持Excel操作。

  • 支持VBA。

4、强大的转换器可以处理大部分数据类型,包括在两个方向上的numpy array和pandas DataFrame。

5.openpyxl

openpyxl是一个用于读取和编写Excel 2010 xlsx/xlsm/xltx/xltm文件的库。

地址:https://openpyxl.readthedocs.io/en/stable/

  • openpyxl支持.xlsx文件的读写。

  • 支持Excel操作。

  • 加载大.xlsx文件可以使用read_only模式。

  • 写入大.xlsx文件可以使用write_only模式。

6.xlsxwriter

xlsxwriter是一个用于创建Excel .xlsx文件的库。

地址:https://xlsxwriter.readthedocs.io/

  • xlswriter支持.xlsx文件的写。

  • 支持VBA。

  • 写入大.xlsx文件时使用内存优化模式。

7.win32com

win32com库存在于pywin32中,是一个读写和处理Excel文件的库。

地址:http://pythonexcels.com/python-excel-mini-cookbook/

  • win32com支持.xls,.xlsx文件的读写,支持.xlsx文件的写。

  • 支持Excel操作。

8.DataNitro

DataNitro是一个内嵌在Excel中的插件。

地址:https://datanitro.com/docs/

  • DataNitro支持.xls,.xlsx文件的读写。

  • 支持Excel操作。

  • 支持VBA。

  • 收费

9.pandas

pandas通过对Excel文件的读写实现数据输入输出

地址:http://pandas.pydata.org/

  • pandas支持.xls,.xlsx文件的读写。

  • 支持只加载每个表的单一工作页。

78bc5f864b350282cc066c7eb96d8449.png

提醒及注意:

  • xlutils 仅支持 xls 文件,即2003以下版本;

  • win32com 与 DataNitro 仅支持 windows 系统;

  • xlwings 安装成功后,如果运行提示报错“ImportError: no module named win32api”,请再安装 pypiwin32 或者 pywin32 包;

  • win32com 不是独立的扩展库,而是集成在其他库中,安装 pypiwin32 或者 pywin32 包即可使用;

  • DataNitro 是 Excel 的插件,安装需到官网下载。

基本功能:

由于设计目的不同,每个模块通常着重于某一方面功能,各有所长。

1.xlwings

可结合 VBA 实现对 Excel 编程,强大的数据输入分析能力,同时拥有丰富的接口,结合 pandas/numpy/matplotlib 轻松应对 Excel 数据处理工作。

2.openpyxl

简单易用,功能广泛,单元格格式/图片/表格/公式/筛选/批注/文件保护等等功能应有尽有,图表功能是其一大亮点,缺点是对 VBA 支持的不够好。

3.pandas

数据处理是 pandas 的立身之本,Excel 作为 pandas 输入/输出数据的容器。

4.win32com

从命名上就可以看出,这是一个处理 windows 应用的扩展,Excel 只是该库能实现的一小部分功能。该库还支持 office 的众多操作。需要注意的是,该库不单独存在,可通过安装 pypiwin32 或者 pywin32 获取。

5.xlsxwriter

拥有丰富的特性,支持图片/表格/图表/筛选/格式/公式等,功能与openpyxl相似,优点是相比 openpyxl 还支持 VBA 文件导入,迷你图等功能,缺点是不能打开/修改已有文件,意味着使用 xlsxwriter 需要从零开始。

6.DataNitro

作为插件内嵌到 Excel 中,可完全替代 VBA,在 Excel 中使用 python 脚本。既然被称为 Excel 中的 python,协同其他 python 库亦是小事一桩。然而,这是付费插件…

7.xlutils

基于 xlrd/xlwt,老牌 python 包,算是该领域的先驱,功能特点中规中矩,比较大的缺点是仅支持 xls 文件。

读写测试

测试用例

  • 用例1. 读.xls文件的整个表(表有5个分页,每个分页有2000行1200列的整数)。

  • 用例2. 读.xlsx文件的整个表(表有5个分页,每个分页有2000行1200列的整数)。

  • 用例3. 读.xls文件的整个表(表有1个分页,页有2000行1200列的整数)。

  • 用例4. 读.xlsx文件的整个表(表有1个分页,页有2000行1200列的整数)。

  • 用例5. 写.xls文件的整个表(表有5个分页,每个分页有2000行1200列的整数)。

  • 用例6. 写.xlsx文件的整个表(表有5个分页,每个分页有2000行1200列的整数)。

  • 用例7. 写.xls文件的整个表(表有1个分页,页有2000行1200列的整数)。

  • 用例8. 写.xlsx文件的整个表(表有1个分页,页有2000行1200列的整数)。

测试结果

c9030da8fe9fa197447eb42ebbadc679.png

注:

  1. xlwt和pandas每个工作页最多写入256列,因此测试用例修改为每页有2000行256列的整数.

  2. xlutils读写依赖于xlrd和xlwt,不单独测试。

  3. openpyxl测试两种模式,一是普通加载写入,二是read_only/write_only模式下的加载写入。

  4. DataNitro要收费,且需依托Excel使用,本次不测试。

性能比较

单从读写的性能上考虑,win32com的性能是最好的,xlwings其次。

openpyxl虽然操作Excel的功能强大,但读写性能过于糟糕,尤其是写大表时,会占用大量内存(把我的4G内存用完了),开启read_only和write_only模式后对其性能有大幅提升,尤其是对读的性能提升很大,使其几乎不耗时(0.01秒有点夸张,不过确实是加载上了)。

pandas把Excel当作数据读写的容器,为其强大的数据分析服务,因此读写性能表现中规中矩,但其对Excel文件兼容性是最好的,支持读写.xls,.xlsx文件,且支持只读表中单一工作页。同样支持此功能的库还有xlrd,但xlrd只支持读,并不支持写,且性能不突出,需要配合xlutils进行Excel操作,并使用xlwt保存数据,而xlwt只能写入.xls文件(另一个可以写入.xls文件的库是pandas,且这两个写入的Excel文件最多只能有256列,其余库就我目前的了解均只能写入.xlsx文件),性能一般。

xlsxwriter功能单一,一般用来创建.xlsx文件,写入性能中庸。win32com拥有最棒的读写性能,但该库存在于pywin32的库中,自身没有完善的文档,使用略吃力。xlwings拥有和win32com不相伯仲的读写性能,强大的转换器可以处理大部分数据类型,包括二维的numpy array和pandas DataFrame,可以轻松搞定数据分析的工作。

综合考虑,xlwings的表现最佳,正如其名,xlwings——Make Excel Fly!

便捷性比较

本测试目前只是针对Excel文件的读写,并未涉及Excel操作,单从读写的便捷性来讲,各库的表现难分上下,但是win32com和xlwings这两个库可以在程序运行时实时在打开的Excel文件中进行操作,实现过程的可视化,其次xlwings的数据结构转换器使其可以快速的为Excel文件添加二维数据结构而不需要在Excel文件中重定位数据的行和列,因此从读写的便捷性来比较,仍是xlwings胜出。

代码示例

最后,附上一些演示代码,大家可自行体会下不同模块的使用。

6.1 xlwings基本代码

import xlwings 

6.2 xlsxwriter基本代码

import xlsxwriter 

6.3 xlutils基本代码import xlrd #读取数据

import xlwt 

6.4 win32com基本代码

import win32com.client 

6.5 openpyxl基本代码

import openpyxl

6.6 DataNitro基本代码

#单一单元格赋值

openpyxl具体使用

1、 创建一个excel 文件,并写入不同类的内容

# -*- coding: utf-8 -*-

2、创建sheet

from openpyxl 

3、操作单元格

# -*- coding: utf-8 -*-

4、操作已存在的文件

# -*- coding: utf-8 -*-

5、操作批量的单元格

# -*- coding: utf-8 -*-

6、获取所有的行(列)对象:

# coding=utf-8

推荐阅读(点击即可跳转阅读)

1. SpringBoot内容聚合

2. 面试题内容聚合

3. 设计模式内容聚合

4. Mybatis内容聚合

5. 多线程内容聚合

cfbfca7b796a92471a1fffb9185eedec.png




推荐阅读
  • 本文将介绍如何编写一些有趣的VBScript脚本,这些脚本可以在朋友之间进行无害的恶作剧。通过简单的代码示例,帮助您了解VBScript的基本语法和功能。 ... [详细]
  • PHP 5.2.5 安装与配置指南
    本文详细介绍了 PHP 5.2.5 的安装和配置步骤,帮助开发者解决常见的环境配置问题,特别是上传图片时遇到的错误。通过本教程,您可以顺利搭建并优化 PHP 运行环境。 ... [详细]
  • Python自动化处理:从Word文档提取内容并生成带水印的PDF
    本文介绍如何利用Python实现从特定网站下载Word文档,去除水印并添加自定义水印,最终将文档转换为PDF格式。该方法适用于批量处理和自动化需求。 ... [详细]
  • 优化ListView性能
    本文深入探讨了如何通过多种技术手段优化ListView的性能,包括视图复用、ViewHolder模式、分批加载数据、图片优化及内存管理等。这些方法能够显著提升应用的响应速度和用户体验。 ... [详细]
  • PyCharm下载与安装指南
    本文详细介绍如何从官方渠道下载并安装PyCharm集成开发环境(IDE),涵盖Windows、macOS和Linux系统,同时提供详细的安装步骤及配置建议。 ... [详细]
  • Explore a common issue encountered when implementing an OAuth 1.0a API, specifically the inability to encode null objects and how to resolve it. ... [详细]
  • 本文详细介绍如何使用Python进行配置文件的读写操作,涵盖常见的配置文件格式(如INI、JSON、TOML和YAML),并提供具体的代码示例。 ... [详细]
  • 技术分享:从动态网站提取站点密钥的解决方案
    本文探讨了如何从动态网站中提取站点密钥,特别是针对验证码(reCAPTCHA)的处理方法。通过结合Selenium和requests库,提供了详细的代码示例和优化建议。 ... [详细]
  • 本文介绍了Java并发库中的阻塞队列(BlockingQueue)及其典型应用场景。通过具体实例,展示了如何利用LinkedBlockingQueue实现线程间高效、安全的数据传递,并结合线程池和原子类优化性能。 ... [详细]
  • 1.如何在运行状态查看源代码?查看函数的源代码,我们通常会使用IDE来完成。比如在PyCharm中,你可以Ctrl+鼠标点击进入函数的源代码。那如果没有IDE呢?当我们想使用一个函 ... [详细]
  • 本文详细介绍了Java中org.eclipse.ui.forms.widgets.ExpandableComposite类的addExpansionListener()方法,并提供了多个实际代码示例,帮助开发者更好地理解和使用该方法。这些示例来源于多个知名开源项目,具有很高的参考价值。 ... [详细]
  • 使用 Azure Service Principal 和 Microsoft Graph API 获取 AAD 用户列表
    本文介绍了一段通用代码示例,该代码不仅能够操作 Azure Active Directory (AAD),还可以通过 Azure Service Principal 的授权访问和管理 Azure 订阅资源。Azure 的架构可以分为两个层级:AAD 和 Subscription。 ... [详细]
  • 解决PHP与MySQL连接时出现500错误的方法
    本文详细探讨了当使用PHP连接MySQL数据库时遇到500内部服务器错误的多种解决方案,提供了详尽的操作步骤和专业建议。无论是初学者还是有经验的开发者,都能从中受益。 ... [详细]
  • 本文详细介绍了Java编程语言中的核心概念和常见面试问题,包括集合类、数据结构、线程处理、Java虚拟机(JVM)、HTTP协议以及Git操作等方面的内容。通过深入分析每个主题,帮助读者更好地理解Java的关键特性和最佳实践。 ... [详细]
  • 在当前众多持久层框架中,MyBatis(前身为iBatis)凭借其轻量级、易用性和对SQL的直接支持,成为许多开发者的首选。本文将详细探讨MyBatis的核心概念、设计理念及其优势。 ... [详细]
author-avatar
手机用户2502922477
这个家伙很懒,什么也没留下!
PHP1.CN | 中国最专业的PHP中文社区 | DevBox开发工具箱 | json解析格式化 |PHP资讯 | PHP教程 | 数据库技术 | 服务器技术 | 前端开发技术 | PHP框架 | 开发工具 | 在线工具
Copyright © 1998 - 2020 PHP1.CN. All Rights Reserved | 京公网安备 11010802041100号 | 京ICP备19059560号-4 | PHP1.CN 第一PHP社区 版权所有