百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术资源 > 正文

使用Python自动化Microsoft Excel和Word

off999 2024-11-03 14:17 17 浏览 0 评论


将Excel与Word集成,无缝生成自动报告

毫无疑问,微软的Excel和Word是公司和非公司领域使用最广泛的两款软件。它们实际上是“工作”的同义词。通常情况下,每一周我们都会将两者结合起来,并以某种方式发挥它们的优点。虽然一般的日常用途不会要求自动化,但有时自动化可能是必需的。也就是说,当您有大量的图表、图形、表格和报告要生成时,如果您选择手动方式,它可能会成为一项极其繁琐的工作。其实没必要这样。实际上,有一种方法可以在Python中创建一个管道,您可以将两者无缝集成,在Excel中生成电子表格,然后将结果传输到Word中,几乎即时生成报告。

Openpyxl

Openpyxl它可以说是Python中最通用的包之一,它可以非常容易使用Excel接口。有了它,你可以读和写所有当前和最早的excel格式,即xlsx和xls。Openpyxl允许您填充行和列、执行公式、创建2D和3D图表、标记轴和标题,以及其他许多非常有用的功能。然而,最重要的是,这个包允许您在Excel中遍历无穷多的行和列,从而避免了之前必须做的所有烦人的数字处理和绘图。

Python-docx

然后是Python-docx,这个包之于Word就像Openpyxl之于Excel。如果您还没有学习他们的文档,那么您可能应该看一看。毫不夸张地说,Python-docx是我开始使用Python以来使用过的最简单、最不言自明的工具包之一。它允许您通过插入文本、填充表格和在报表中自动渲染图像来自动生成文档。

言归正传,让我们创建我们自己的自动化流水线。继续使用Anaconda(或者你选择的任何其他IDE)并安装以下软件包:

pip install openpyxl 
pip install python-docx

Microsoft Excel自动化

首先,我们将加载一个已经创建好的Excel工作簿(如下所示):

workbook = xl.load_workbook('Book1.xlsx') 
sheet_1 = workbook['Sheet1']

随后,我们将遍历电子表格中的所有行,通过电流乘以电压来计算和插入功率值:

for row in range(2, sheet_1.max_row + 1): 
current = sheet_1.cell(row, 2) 
voltage = sheet_1.cell(row, 3) 
power = float(current.value) * float(voltage.value) 
power_cell = sheet_1.cell(row, 1) 
power_cell.value = power

一旦完成,我们将使用计算的功率值生成折线图,将插入指定的单元格,如下图所示:

values = Reference(sheet_1, min_row = 2, max_row = sheet_1.max_row, min_col = 1, max_col = 1) 
chart = LineChart() 
chart.y_axis.title = 'Power' 
chart.x_axis.title = 'Index' 
chart.add_data(values) 
sheet_1.add_chart(chart, 'e2') 
workbook.save('Book1.xlsx')

现在我们已经生成了图表,我们需要将其提取为图像,以便在Word报告中使用它。首先,我们将确定Excel文件的确切位置,以及输出的图表图像应该保存的位置:

input_file = "C:/Users/.../Book1.xlsx" 
output_image = "C:/Users/.../chart.png"

然后使用以下方法访问电子表格:

operation = win32com.client.Dispatch("Excel.Application") 
operation.Visible = 0 
operation.DisplayAlerts = 0 
workbook_2 = operation.Workbooks.Open(input_file) 
sheet_2 = operation.Sheets(1)

你可以迭代电子表格中的所有图表对象(如果有一个以上),并将它们保存在指定的位置如下:

for x, chart in enumerate(sheet_2.Shapes): 
chart.Copy() 
image = ImageGrab.grabclipboard() 
image.save(output_image, 'png') 
passworkbook_2.Close(True) 
operation.Quit()

Microsoft Word自动化

现在我们已经生成了图表图像,我们必须创建一个模板文档,它基本上是一个普通的Microsoft Word文档(.docx),它完全按照我们希望的报告外观来制定,包括字体、字体大小、格式和页面结构。然后,我们需要做的就是为我们的自动内容创建占位符,即表值和图像,并使用变量名声明它们,如下所示。

任何自动的内容都可以在双花括号{{variable_name}}中声明,包括文本和图像。对于表,你需要创建一个包含所有列的模板行表,然后你需要在上面加上一行,下面加上一行,符号如下:

第一行:

{%tr for item in variable_name %}

最后一行:

{%tr endfor %}

在上图中,变量名是:

  1. table_contents用于存储表格数据的Python字典
  2. 字典键的索引(第一列)
  3. 字典值的功率、电流和电压(第二、第三和第四列)

然后我们将模板文档导入Python,并创建一个字典来存储表中的值:

template = DocxTemplate('template.docx') 
table_contents = []for i in range(2, sheet_1.max_row + 1): 
table_contents.append({ 
'Index': i-1, 
'Power': sheet_1.cell(i, 1).value, 
'Current': sheet_1.cell(i, 2).value, 
'Voltage': sheet_1.cell(i, 3).value 
})

接下来,我们将导入之前由Excel生成的图表图像,并创建另一个字典来实例化模板文档中声明的所有占位符变量:

image = InlineImage(template,'chart.png',Cm(10))context = { 
'title': 'Automated Report', 
'day': datetime.datetime.now().strftime('%d'), 
'month': datetime.datetime.now().strftime('%b'), 
'year': datetime.datetime.now().strftime('%Y'), 
'table_contents': table_contents, 
'image': image 
}

最后,我们将用我们的值表和图表图像渲染报告:

template.render(context) 
template.save('Automated_report.docx')

结果

好了,这就是一个自动生成的Microsoft Word报告,包含数字和在Microsoft Excel中创建的图表。这样你就有了一个完全自动化的管道,可以用来创建尽可能多的表格、图表和文档。

最后,完整的代码在这里:github/mkhorasani/excelwordautomation 有兴趣的可以下载修改和执行

作者:M Khorasani

deephub翻译组

相关推荐

一文搞清 Python 中方法和函数之间的区别

在我们使用Python的过程中,经常涉及到方法和函数,那他们有什么不同吗?在本文中,让我们通过示例了解Python中方法和函数之间的区别。Python函数Python函数是一系列以特定顺序...

Python 数据分析 + 可视化实战:5 分钟出图表,老板看了直点赞

还在用Excel做数据分析?效率太低了!同样一份销售数据,同事用Python半小时出报告,图表炫酷还能自动更新;你用Excel捣鼓大半天,稍微改点数据就得重新做图。今天教你用Python...

Python每日一库之Pendulum(python penup)

关于日期处理,Python提供了许多库,例如标准库datetime、第三方库dateutil、Arrow等。在这篇文章中,我想介绍我个人最喜欢的库pendulum,它使用非常方便,它可以满足...

Python计算两个日期相差天数 M + ACT/360模式,银行计算利息用

一般银行在计算计息的时候,都会用到M+ACT/360模式,也就是满1个月按30天计算,不足一个月按实际天数计算。一年算360天。例如:计算20151018到20190817相差的天数,201...

Python 之 MySql 每日一练 32——查询每门课程的平均成绩

一、表名和字段–1.学生表student(s_id,s_name,s_birth,s_sex)–学生编号,学生姓名,出生年月,学生性别–2.课程表course(c_id,c_name,t...

用Python制作数据报告:如何自动生成PDF格式的报告?

最近在琢磨数据分析工作的自动化,手动做报告真是太费劲啦!试过用Python整了个自动生成PDF报告的小工具,效果还不错。今天就聊聊怎么用Python把数据处理、可视化和PDF生成一条龙搞定。repor...

Github 1.2k star,一个好用的 Python 库-pyexcel!

大家好,今天为大家分享一个好用的Python库-pyexcel。Github地址:https://github.com/pyexcel/pyexcelpyexcel是一个功能强大的Python...

使用python写一个简单的到期事件钉钉提醒功能

前言:学习python第3天需求:简单的事件提醒功能版本:python3.9、mysql5.71、现在mysql建一个表event_remindCREATETABLE`event_remind`...

python定时任务最强框架APScheduler详细教程

APScheduler定时任务上次测试女神听了我的建议,已经做好了要给项目添加定时任务的决定了。但是之前提供的四种方式中,她不知道具体选择哪一个。为了和女神更近一步,我把我入行近10年收藏的干货免费拿...

解放双手,一键运行!Python每日自动生成数据日报

对于一个企业来说,高层看意义,中层看结论,基层看落地,数据日报、周报、月报可以监控销售个人在实际执行过程中的销售动态,而数据季度报、年报可以反映一个销售策略是否与实际的业务场景切合。可见数据日报在我们...

Python模块datetime、calendar、logging、argparse、re用法

datetime模块:提供日期和时间相关的功能。importdatetime#获取当前日期和时间current_time=datetime.datetime.now()#格式化日期...

python入门到脱坑正则表达式—re.search()函数

re.search()是Python正则表达式模块re中的核心函数之一,用于在字符串中搜索匹配指定模式的第一个位置。与re.match()不同,它不限制匹配必须从字符串开头开始。基本语法...

python3从零学习-5.2.1、日历相关模块calendar

源代码:Lib/calendar.py这个模块让你可以输出像Unixcal那样的日历,它还提供了其它与日历相关的实用函数。默认情况下,这些日历把星期一当作一周的第一天,星期天为一周的最后一...

DAY6-step7 Python 示例说明CALENDAR

Python中的Calendar模块具有Calendar类,该类允许基于日期,月份和年份来计算各种任务。最重要的是,Python中的TextCalendar和HTMLCalendar类允许您编辑日历...

Python 数据分析——Pandas 时间序列

Pandas提供了表示时间点、时间段和时间间隔等三种与时间有关的类型,以及元素为这些类型的索引对象,并提供了许多时间序列相关的函数。一、时间点、时间段、时间间隔Timestamp对象从Python标准...

取消回复欢迎 发表评论: