python处理Excel实战进阶篇day08(把30MB文本数据写入excel文件)
off999 2024-10-04 00:20 45 浏览 0 评论
实例08—把规整的文本大数据写入excel表格
模拟场景需求:
年末岁尾,单位考勤机故障,通过某种方法,有幸获得了考勤记录的原始文本数据,足足近30MB的大文档,用系统自带的文本文件,打开都很困难,打开之后,是一行行规律的数据,先截图如下:
半天拉到结尾,一共9万多行,突发奇想,能不能把他们逐行导入excel表格,分段插入每一列,也好做好分析,手动去粘贴,你要累死呀,还不如累死计算机呢^_^干再多的重复循环也是分分秒秒的事,用Python处理Excel文件的模块openpyxl,看我怎么样用它搞定我们的“文本大数据写入表格”。
1、用到的知识点:
Python的循环读取,IO操作,file的读写方法,wb对象基本操作包括创建和保存,ws的操作遍历,cell单元格的读取和写入等。
2、用到的文件:
一个导出的考勤log日志数据,非隐私数据(已经脱敏处理,人名已经更改)如需要请下载,通过阿里云盘分享,链接如下:
https://www.aliyundrive.com/s/cjiSN9ZrGz7
3、操作步骤思维导图:
4、代码操作编写截图:
a、初级代码如下:
from openpyxl import Workbook
# 建立excel操作对象
wb = Workbook()
ws = wb.active
# 最python_man的文件读取方法,迭代遍历,不用担心读取文件过大问题
# 初级代码
with open('kaoqin.txt','r',encoding='utf-8') as f:
for line in f:
tmp = line.split() # 读取的行按空格分割
ws.append(tmp) # 按行写入excel表格
wb.save('result.xlsx')
成功了,虽然有点丑:
循环读文本写表格,python无惧大数据
b、改进代码如下:
改进稍微难一点,用到了正则表达式模块和列表生成式,列表的切片合并等。
from openpyxl import Workbook
import re
# 建立excel操作对象
wb = Workbook()
ws = wb.active
title = ['date','time','id','name','workcode','status','authority','card_src','photo']
# 插入标题
ws.append(title)
#最python_man的读取方法
with open('kaoqin.txt','r',encoding='utf-8') as f:
for line in f:
tmp = re.split(r'[\s\=\"]+',line) # 分割字符通过空白和特殊符号="
ret = tmp[1:2]+tmp[2::2] # 调节列表选项,选取需求的
ws.append(ret)
wb.save('result2.xlsx')今天的例子要活学活用,关键练基础,熟悉python的openpyxl处理表格的思路,愿一路有你,好好学习,openpyxl操作有疑难请参阅<python办公自动化openpyxl处理excel(基础篇)>,python基础不好的,请参阅其它,或者关注作者即将退出的python基础内容哦。
相关推荐
- win7系统进入桌面黑屏(win7进去界面后黑屏)
-
win7黑屏无法进入桌面的解决方法:1、按【ctrl+alt+del】组合键,打开任务管理器;2、依次点击文件、创建新任务,输入regedit;3、在打开的注册表编辑器中,找到shell选项,更改数值...
- 文件隐藏专家(文件隐藏专家怎么设置)
-
是隐藏的软件恢复到桌面吗?在手机桌面中间向上滑→桌面设置→应用隐藏/私密应用→输入密码→编辑→选择应用点击即可取消。 默认F2可以开始,停止的。亦可以自己设置。 屏幕录像专家设置步骤: 1、在电...
- 电脑蓝屏无法重启怎么办(电脑蓝屏重启不行)
-
插上U盘并重启电脑。大多数电脑都可以通过按下F11或F12来选择U盘启动。·在启动时选择U盘启动,然后按回车键。接着选择“第二项”,开始启动PE系统。·现在已经进入PE系统了,找到引导修复工具并双击。...
- tplink路由器重设密码步骤(tplink路由器重置密码设置步骤图解)
-
重设TP-LINK无线路由器密码方法如下1、打开浏览器,在地址栏输入192.168.1.1(一般路由器地址是这个或者查看路由器背面的登录信息)进路由-输入用户名,密码,(默认一般是admin)。2、...
-
- 查看电脑ip地址的命令(查看电脑ip地址用什么命令)
-
1、在“本地连接”的状态中查看。2、使用“ipconfig/all”命令查看。3、打开电脑网页,输入IP地址,点击确定,就能看到本机IP。扩展资料IP地址(InternetProtocolAddress),全称为网际协议地址,是一种在...
-
2025-12-30 10:03 off999
- ie浏览器9(IE浏览器9.0如何升级)
-
1、首先,我们点击开始菜单,找到控制面板,点击一下。2、之后,找到程序和功能选项,点击一下。3、点击进入后,我们找到左边的打开或关闭windows功能,点击一下。4、点击进入后,找到Internet...
- hp1020打印机驱动怎么下载(hp1020打印机驱动怎么下载)
-
惠普1020打印机驱动怎么安装: 1.首先到下载软件名称:惠普1020打印机驱动程序官方版(支持win7/8)32位/64位软件大小:5.09MB更新时间:2014-09-05立即下载 2.然后...
- win2003是windows7系统(win2003哪个版本好)
-
win2003是专门用于服务器的操作系统,现在最主流的windows服务器系统主要是win2003server和win2008server,winXP是个人电脑专用的操作系统,现在微软已经不再提供XP...
- 路由器账号和密码忘了怎么办
-
你好,如果你忘记了路由器的用户名和密码,你可以尝试重置一下路由器,大多数路由器都配备了一个复位按键。在重置路由器之后,用户名和密码将被还原为默认值,你可以在路由器的用户手册或厂家网站上找到默认的用户名...
- win10永久禁止自动更新(win10禁止自动更新彻底)
-
阻止Windows10自动更新的方法如下:使用“本地组策略编辑器”:按下“Win+R”键,输入“gpedit.msc”打开本地组策略编辑器,找到“计算机配置”>“管理模板”>“W...
- 联想笔记本怎么看配置和型号
-
联想笔记本看配置的方法如下1、打开电脑,点击桌面的计算机,右键菜单里选择【属性】;打开后,即可看到电脑系统的大概信息;2、如果要看比较详细的设备相关信息,点击桌面的计算机,点击右键,在菜单里选择【系统...
- win10下载应用商店(win10应用商店打不开)
-
1、点击Win10系统的开始菜单,然后在点击应用商店;2、打开Win10应用商店后,在搜索框里输入想要搜索的应用软件,然后点击检索;3、点击搜索到的应用,点击安装;4、点击安装后,系统会提示要切换到这...
- dell电脑重装系统win10(dell 重装win10系统)
-
戴尔笔记本重装系统win10的步骤如下:制作好wepe启动盘之后,将win10系统iso镜像直接复制到U盘。在需要重装系统的戴尔电脑上插入pe启动盘,重启后不停按F12启动快捷键,调出启动菜单对话框,...
欢迎 你 发表评论:
- 一周热门
-
-
抖音上好看的小姐姐,Python给你都下载了
-
全网最简单易懂!495页Python漫画教程,高清PDF版免费下载
-
Python 3.14 的 UUIDv6/v7/v8 上新,别再用 uuid4 () 啦!
-
飞牛NAS部署TVGate Docker项目,实现内网一键转发、代理、jx
-
python入门到脱坑 输入与输出—str()函数
-
宝塔面板如何添加免费waf防火墙?(宝塔面板开启https)
-
Python三目运算基础与进阶_python三目运算符判断三个变量
-
(新版)Python 分布式爬虫与 JS 逆向进阶实战吾爱分享
-
失业程序员复习python笔记——条件与循环
-
系统u盘安装(win11系统u盘安装)
-
- 最近发表
- 标签列表
-
- python计时 (73)
- python安装路径 (56)
- python类型转换 (93)
- python进度条 (67)
- python吧 (67)
- python的for循环 (65)
- python格式化字符串 (61)
- python静态方法 (57)
- python列表切片 (59)
- python面向对象编程 (60)
- python 代码加密 (65)
- python串口编程 (77)
- python封装 (57)
- python写入txt (66)
- python读取文件夹下所有文件 (59)
- python操作mysql数据库 (66)
- python获取列表的长度 (64)
- python接口 (63)
- python调用函数 (57)
- python多态 (60)
- python匿名函数 (59)
- python打印九九乘法表 (65)
- python赋值 (62)
- python异常 (69)
- python元祖 (57)
