惊!Python大神几秒提取上百个PPT所有文字,老板直呼“太神奇”
off999 2024-10-10 07:53 18 浏览 0 评论
上周末,我的好友小张遇到了一个大问题。他的老板为了学习最新的行业知识,搜集了上百个PPT文件,但老板却没时间逐个翻阅,他更倾向于直接阅读文字资料。于是,这项“艰巨”的任务就落在了小张的肩上——手动从每个PPT中复制粘贴文字。可以想象,这将是一个多么耗时且枯燥的工作。
就在小张准备牺牲整个周末的时间来完成这项任务时,我得知了这个情况。作为一名资深的Python技术爱好者,我当即表示:“这个忙,我帮定了!”
问题展示
在日常生活中,我们经常会遇到需要提取PPT中文字的情况。无论是为了整理资料、学习新知识,还是为了其他目的,手动复制粘贴无疑是一项低效且繁琐的工作。尤其是在面对大量PPT文件时,这种方法更是显得力不从心。
解决方案揭晓
幸运的是,Python自动化办公技术为我们提供了高效的解决方案。利用Python的相关库,我们可以轻松地从PPT中提取所有文字,而且只需几秒钟!
我迅速编写了一个简单的Python脚本,利用python-pptx库(一个用于读取和写入PowerPoint文件的Python库)来遍历所有PPT文件,并提取其中的文字。整个过程既快速又准确,让小张和他的老板都大为惊喜。
效果对比
- 传统方法:小张原本计划花费整个周末的时间手动复制粘贴PPT中的文字,不仅效率低下,而且容易出错。
- Python自动化方法:使用Python脚本,我仅用了几秒钟就完成了所有PPT中的文字提取工作,大大提高了效率,且准确率达到了100%。
操作流程
- 安装必要的Python库:首先,需要安装python-pptx库。你可以使用pip命令进行安装:pip install python-pptx。
- 编写Python脚本:接下来,编写一个简单的Python脚本来遍历指定文件夹中的所有PPT文件,并使用python-pptx库提取每个文件中的文字。
- 运行脚本并导出结果:运行编写好的Python脚本,稍等片刻,所有PPT中的文字就会被提取并保存到指定的文本文件中。
from pptx import Presentation
data = []
prs = Presentation('data\制造业必修课.pptx')
for slide in prs.slides: #遍历每页PPT
for shape in slide.shapes: #遍历PPT中的每个形状
if shape.has_text_frame:
for paragraph in shape.text_frame.paragraphs:
data.append(paragraph.text)
#写入word文件
import docx
doc=docx.Document()#创建一个Document对象
for i in data:
doc.add_paragraph(i) #增加一个段落,并写入内容
doc.save('data\制造业必修课.docx')#保存文档
就这样通过遍历所有的100多个PPT文件,将所有的PPT中的文字汇总到了一个Word里,几秒钟就完成了小张计划用两天来做的工作
想要获取详细的Python脚本代码和教程吗?赶快关注我们的公众号并留言“PPT文字提取”,我们会第一时间将相关资料发送给你哦!
相关推荐
- 每天一个 Python 库:datetime 模块全攻略,时间操作太丝滑!
-
在日常开发中,时间处理是绕不开的一块,比如:生成时间戳比较两个时间差转换为可读格式接口传参/前端展示/日志记录今天我们就用一个案例+代码+思维导图,带你完全搞定datetime模块的用法!...
- 字节跳动!2023全套Python入门笔记合集
-
学完python出来,已经工作3年啦,最近有很多小伙伴问我,学习python有什么用其实能做的有很多可以提高工作效率增强逻辑思维还能做爬虫网站数据分析等等!!最近也是整理了很多适合零基...
- 为什么你觉得Matplotlib用起来困难?因为你还没看过这个思维导图
-
前言Matplotlib是一个流行的Python库,可以很容易地用于创建数据可视化。然而,设置数据、参数、图形和绘图在每次执行新项目时都可能变得非常混乱和繁琐。而且由于应用不同,我们不知道选择哪一个图...
- Python新手必看!30分钟搞懂break/continue(附5个实战案例)
-
一、跳转语句的使命当程序需要提前结束循环或跳过特定迭代时,break和continue就是你的代码急刹按钮和跳步指令。就像在迷宫探险中:break=发现出口立即离开continue=跳过陷阱继续前进二...
- 刘心向学(24)Python中的数据类(python中5种简单的数据类型)
-
分享兴趣,传播快乐,增长见闻,留下美好!亲爱的您,这里是LearningYard新学苑。今天小编为大家带来文章“刘心向学(24)Python中的数据类”欢迎您的访问。Shareinterest,...
- 刘心向学(25)Python中的虚拟环境(python虚拟环境安装和配置)
-
分享兴趣,传播快乐,增长见闻,留下美好!亲爱的您,这里是LearningYard新学苑。今天小编为大家带来文章“刘心向学(25)Python中的虚拟环境”欢迎您的访问。Shareinte...
- 栋察宇宙(八):Python 中的 wordcloud 库学习介绍
-
分享乐趣,传播快乐,增长见识,留下美好。亲爱的您,这里是LearingYard学苑!今天小编为大家带来“Python中的wordcloud库学习介绍”欢迎您的访问!Sharethefun,...
- AI在用|ChatGPT、Claude 3助攻,1分钟GET高颜值思维导图
-
机器之能报道编辑:Cardinal以大模型、AIGC为代表的人工智能浪潮已经在悄然改变着我们生活及工作方式,但绝大部分人依然不知道该如何使用。因此,我们推出了「AI在用」专栏,通过直观、有趣且简洁的人...
- 使用DeepSeek + Python开发AI思维导图应用,非常强!
-
最近基于Deepseek+PythonWeb技术开发了一个AI对话自动生成思维导图的应用,用来展示下如何基于低门槛的Python相关技术栈,高效结合deepseek实现从应用场景到实际应用的快速落地...
- 10幅思维导图告诉你 - Python 核心知识体系
-
首先,按顺序依次展示了以下内容的一系列思维导图:基础知识,数据类型(数字,字符串,列表,元组,字典,集合),条件&循环,文件对象,错误&异常,函数,模块,面向对象编程;接着,结合这些思维导图主要参考的...
- Python基础核心思维导图,让你轻松入门
-
Python基础核心思维导图【高清图文末获取】学习路线图就给大家看到这里了,需要的小伙伴下方获取获取方式看下方图片...
- Python基础核心思维导图,学会事半功倍
-
Python基础核心思维导图【高清图文末获取】学习路线图就给大家看到这里了,需要的小伙伴下方获取获取方式看下方图片...
- 硬核!288页Python核心知识笔记(附思维导图,建议收藏)
-
今天就给大家分享一份288页Python核心知识笔记,相较于部分朋友乱糟糟的笔记,这份笔记更够系统地总结相关知识,巩固Python知识体系。文末获取完整版PDF该笔记学习思维导图:目录内容展示【领取方...
- Python学习知识思维导图(高效学习)
-
Python学习知识思维导图python基础知识python数据类型条件循环列表元组字典集合字符串序列函数面向对象编程模块错误异常文件对象#python##python自学##编程#...
- 别找了!288页Python核心知识笔记(附思维导图,建议收藏)
-
今天就给大家分享一份288页Python核心知识笔记,相较于部分朋友乱糟糟的笔记,这份笔记更够系统地总结相关知识,巩固Python知识体系。文末获取完整版PDF该笔记学习思维导图:目录内容展示【领取方...
你 发表评论:
欢迎- 一周热门
- 最近发表
-
- 每天一个 Python 库:datetime 模块全攻略,时间操作太丝滑!
- 字节跳动!2023全套Python入门笔记合集
- 为什么你觉得Matplotlib用起来困难?因为你还没看过这个思维导图
- Python新手必看!30分钟搞懂break/continue(附5个实战案例)
- 刘心向学(24)Python中的数据类(python中5种简单的数据类型)
- 刘心向学(25)Python中的虚拟环境(python虚拟环境安装和配置)
- 栋察宇宙(八):Python 中的 wordcloud 库学习介绍
- AI在用|ChatGPT、Claude 3助攻,1分钟GET高颜值思维导图
- 使用DeepSeek + Python开发AI思维导图应用,非常强!
- 10幅思维导图告诉你 - Python 核心知识体系
- 标签列表
-
- python计时 (54)
- python安装路径 (54)
- python类型转换 (75)
- python进度条 (54)
- python的for循环 (56)
- python串口编程 (60)
- python写入txt (51)
- python读取文件夹下所有文件 (59)
- java调用python脚本 (56)
- python操作mysql数据库 (66)
- python字典增加键值对 (53)
- python获取列表的长度 (64)
- python接口 (63)
- python调用函数 (57)
- python qt (52)
- python人脸识别 (54)
- python斐波那契数列 (51)
- python多态 (60)
- python命令行参数 (53)
- python匿名函数 (59)
- python打印九九乘法表 (65)
- centos7安装python (53)
- python赋值 (62)
- python异常 (69)
- python元祖 (57)