百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术资源 > 正文

带你使用Python在两类场景下自动采集日志数据(附程序)

off999 2025-05-23 19:19 4 浏览 0 评论


各位同学,大家好。采集日志数据是重要的数据来源。本次课程教大家使用Python技术从Windows和Linux两个环境去自动采集日志数据,轻松应对各类日志采集需求。

01 Python实时采集本地文件数据。

如果日志文件在本地,本地的操作系统是windows,可以这样来读取日志文件。

1. Subprocess

我们会使用Subprocess模块,Subprocess是Python内置的模块,这个模块中的Popen方法可以运行用户输入的命令行。如果运行正常,会把内容写入stdout管道。如果命令不正常,则把信息写入stderr管道。

Popen命令的基本格式是这样的:

shell=True 表示在终端中运行的命令,stdout=subprocess.PIPE 表示当命令运行正常的时候把结果写入stdout管道,stderr=subprocess.PIPE 表示的是当命令运行不正常的时候把结果写入stderr管道。

2.读取日志内容

我们使用以下的程序来实时读取日志内容:

其中的命令是powershell Get-Content –wait。

这是调用了Windows的powershell的Get-Content命令,来实时读取日志内容。

如果我们的操作系统是Linux,可以使用下面的程序来读取日志内容:

3.打印内容

读取到的结果通过以下程序来打印出来:

其中的readline是按照每行来读取内容,然后使用decode()将字节流转换成字符串,再使用strip方法,将内容中出现的/r和/n等字符删除。

最后使用communicate方法,将输出结果保存在内存中,而不是默认的保存到管道,这样存储能力更强,不容易卡死。这个进程将会一直执行直到外部程序来将它结束。

02 Python实时远程采集文件数据。

如果我们想远程采集linux服务器上面的日志信息,可以这样来操作。

1.创建ssh连接

Paramiko 是 Python 语言的一个 SSH 客户端。可以远程连接Linux服务器,通过 Python实现进行对远程服务器的操作。

创建SSH连接,我们使用以下程序来实现。

首先进行对paramiko下的SSHClient完成实例化。

然后使用
set_missing_host_key_policy() 方法,连接到没有已知主机秘钥的服务器。最后使用connect()方法,输入远程连接的地址、端口号,用户名,密码等信息。

2.通过ssh获取日志信息

接下来,我们使用以下程序来读取服务器日志。

我们使用exec_command()方法来执行tail –f命令,获取服务器日志信息。

其中ssh_stdin为标准输入流,通常用于向进程发送输入。

ssh_stdout为标准输出流,通常用于输出进程的结果。

ssh_stderr为标准错误流,通常用于输出进程的错误信息。

然后使用readline方法按照每行来读取内容,再使用strip方法,将内容中出现的/r和/n等字符删除。

最后结束ssh连接。

03 实例讲解。

接下来,我们给大家进行实例的讲解。

未完待续。

我是源动君,带领大家一起进步,谢谢观看。

相关推荐

python3多进程的大数据处理应用场景示例

多进程的大数据处理可以应用于以下场景:大规模数据的分块处理:importmultiprocessingdefprocess_chunk(chunk):#对数据块进行处理操作...

值得学习练手的100个Python项目(附代码),真的太实用了

Python丰富的开发生态是它的一大优势,各种第三方库、框架和代码,都是前人造好的“轮子”,能够完成很多操作,让你的开发事半功倍。在科技飞速发展的当今时代,Python以其简洁、高效和强大的功能,成...

python匿名函数lambda的语法特点和应用场景

在Python的编程过程中,有时我们会碰到一些很简单的计算,但是感觉专门为这个计算创建个函数又觉得太小题大做,这时就可以用到lambda表达式。lambda是用于创建匿名函数,也就是没有具体名称的函...

Waitress,一个神奇的python库!

基本介绍WaitressWaitress是一个纯Python写的WSGI服务器,适用于开发与部署。它简单易用,能够满足基本的Web服务需求,并且具有较好的性能。特性简单性:易于配置和使用。可靠性:稳定...

Python 中的三个不寻常的事情 柯里化、海象和 Interning

柯里化柯里化是指不是一次性给函数所有参数,而是逐个给出。因此,每次都会创建一个新的函数。让我们看看Python中的快速手动实现defadd_curried(x):definner(y)...

带你使用Python在两类场景下自动采集日志数据(附程序)

各位同学,大家好。采集日志数据是重要的数据来源。本次课程教大家使用Python技术从Windows和Linux两个环境去自动采集日志数据,轻松应对各类日志采集需求。01Python实时采集本地文件数...

python多进程的分布式任务调度应用场景及示例

多进程的分布式任务调度可以应用于以下场景:分布式爬虫:importmultiprocessingimportrequestsdefcrawl(url):response=re...

Python自动化操控术:PyAutoGUI全场景实战指南

一、PyAutoGUI核心武器库解析1.1鼠标操控三剑客importpyautogui#绝对坐标移动(闪电速度)pyautogui.moveTo(100,200,duration=0....

python学习——031编程中需要定义函数的几种场景

在编程里,当出现下面几种情形时,定义函数是非常有必要的:代码复用当某段代码在程序里要多次使用时,把它定义成函数,能避免代码重复。这样既让代码更加简洁,也方便维护。比如在一个计算多个数字的平方和的程序中...

如何在python中开发桌面应用程序?请看文章

常用的工具和框架1.TkinterTkinter是Python的标准GUI库,适合简单的桌面应用。importtkinterastkdefon_button_click():label.co...

Python多进程与多线程应用场景对比

在Python中,多进程(Multiprocessing)和多线程(Multithreading)的选择取决于任务类型(I/O密集型vsCPU密集型)、Python的GIL限制以及并...

Python 集合的应用场景

Python集合的应用场景包括:去重:集合中的元素都是唯一的,可以用于去除列表或其他可迭代对象中的重复项。成员检查:可以快速地判断一个元素是否在集合中,这比在列表或其他可迭代对象中搜索要高效。数学操作...

Python缓存应用场景与实现分析

在Python开发中,缓存是优化性能的重要手段。以下是对缓存应用场景、实现方式及常见问题的系统分析:一、缓存应用场景计算密集型函数结果缓存O示例:递归计算斐波那契数列、复杂数学运算。O优势:避免重...

Python 从入门到精通:一个月就够了

要知道,一个月是一段很长的时间。如果每天坚持用6-7小时来做一件事,你会有意想不到的收获。作为初学者,第一个月的月目标应该是这样的:熟悉基本概念(变量,条件,列表,循环,函数)练习超过30个编...

Python 编程算法级优化

大家好,我是ICodeWR。今天要记录的是Python编程算法级优化相关知识。1空间换时间经典案例1.1预计算加速三角函数importmathimportnumpyasnp#传...

取消回复欢迎 发表评论: