Python 中常见下载文件方法九个方面知识
off999 2024-09-16 00:43 43 浏览 0 评论
在 Python 中,我们常常需要下载文件,例如爬虫下载页面中的图片、下载页面的链接pdf文件或者word文档、音频和视频;下载远程服务器上的资源,如压缩文件、视频、grib2等等。那么我们可以通过哪些方法来实现文件的下载呢?
需要说明的是:本例子使用下载网址为:http://cv.sycdn.kuwo.cn/99d1a17cc43457c58cd0049db033c348/650e4bbc/resource/n1/17/37/233599851.mp3,是一首MP3的歌曲,4M的大小。粉丝可以在评论区讨论。
第一、使用requests
Requests 是 Python 中非常常用的第三方库,是一个非常强大、简单易用的 HTTP 请求库。
我们直接采用requests.get 获得文件的内容,然后二进制的方法保存文件内容。url:下载的文件名;localfile:保存的本地文件名。timeout:单位秒,如果文件比较大,可以适当的延长时间。如果文件比较大,需要下载比较长的时间,这个方法就不太适合了。示例代码如下:
import requests
url = 'http://cv.sycdn.kuwo.cn/99d1a17cc43457c58cd0049db033c348/650e4bbc/resource/n1/17/37/233599851.mp3'
localfile = './233599851.mp3'
#url:下载的文件名;localfile:保存的本地文件名。timeout:单位秒
r = requests.get(url,timeout=300)
with open(localfile, "wb") as fp:
fp.write(r.content)第二、使用urllib
urllib库是Python的标准库,因此不需要安装它。 urllib 库是一个非常方便的下载工具,提供了简单易用的下载接口。调用 urllib 库的 urlretrieve() 方法下载文件。示例代码如下:
import urllib.request
url = 'http://cv.sycdn.kuwo.cn/99d1a17cc43457c58cd0049db033c348/650e4bbc/resource/n1/17/37/233599851.mp3'
localfile = './233599851.mp3'
urllib.request.urlretrieve(url, localfile) 第三、使用urllib2
urllib2库是urllib库的增强版,提供了更多的功能和更好的错误处理。需要说明的是:urllib2 是 Python2.7 自带的模块(不需要下载,导入即可使用),在 python3 中,urllib2 被改为urllib.request。为了教程的完整性,还是在这里介绍一下。示例代码如下:
import urllib2
url = 'http://cv.sycdn.kuwo.cn/99d1a17cc43457c58cd0049db033c348/650e4bbc/resource/n1/17/37/233599851.mp3'
localfile = './233599851.mp3'
data = urllib2.urlopen(url).read()
with open(localfile, 'wb') as video:
video.write(data)第四、使用urllib3
urllib3是urllib模块的改进版本,是一个轻量级的python库,提供了线程安全,HTTP连接池和重用,文件发送等。我们将通过使用urllib3来获取一个链接并将它存储在一个文件中。示例代码如下:
import urllib3
url = 'http://cv.sycdn.kuwo.cn/99d1a17cc43457c58cd0049db033c348/650e4bbc/resource/n1/17/37/233599851.mp3'
localfile = './233599851.mp3'
#创建一个HTTP连接池
http = urllib3.PoolManager()
r = http.request('GET',url)
print(r.data)
with open(localfile, 'wb') as mp3:
mp3.write(r.data)
r.release_conn() #最后释放这个HTTP连接第五、使用wget
wget是一个从网络上自动下载文件的自由工具,跨平台软件。它支持HTTP,HTTPS和FTP协议,可以使用HTTP代理。这里使用Python的wget模块从一个URL下载文件。wget.download直接从地址url下载到本地localfile。需要使用pip命令安装后才能使用。
pip install wget示例代码如下:
import wget
url = 'http://cv.sycdn.kuwo.cn/99d1a17cc43457c58cd0049db033c348/650e4bbc/resource/n1/17/37/233599851.mp3'
localfile = './233599851.mp3'
wget.download(url,localfile)除了使用 Python 编程语言,我们还可以使用命令行工具 wget 来下载文件。
下面是一个示例代码:
import os
url = 'http://cv.sycdn.kuwo.cn/99d1a17cc43457c58cd0049db033c348/650e4bbc/resource/n1/17/37/233599851.mp3'
localfile = './233599851.mp3'
os.system(f'wget -O {localfile} {url}')第六、下载重定向的文件
有时我们下载一个链接文件,但是远端的服务器将URL会被重定向到另一个的源URL。遇到这种情况,使用requests.get可以轻松解决。get方法中,我们将allow_redirects设置为True,这将允许URL中的重定向,获得重定向后的内容后,然后二进制的方法保存文件内容。示例代码如下:
url = 'http://cv.sycdn.kuwo.cn/99d1a17cc43457c58cd0049db033c348/650e4bbc/resource/n1/17/37/233599851.mp3'
localfile = './233599851.mp3'
r = requests.get(url,timeout=300, allow_redirects=True)
with open(localfile, "wb") as fp:
fp.write(r.content)下面介绍大文件的下载方法。
大文件的下载,需要使用文件流进行下载,它是一种更高效、更安全的方式。使用文件流进行下载的原理,就是将文件一块一块地按顺序从网络上读取,每读取一块就立即写入本地文件。这样的方法既可以保证安全可靠地下载大文件,又可以避免因内存不足而导致的程序崩溃。
第七、使用requests库中的get方法,下载大文件
使用requests库中的get方法,并将stream参数设置为True即可。
示例代码如下:
url = 'http://cv.sycdn.kuwo.cn/99d1a17cc43457c58cd0049db033c348/650e4bbc/resource/n1/17/37/233599851.mp3'
localfile = './233599851.mp3'
r = requests.get(url, stream=True)
fp = open(localfile, "wb")
for chunk in r.iter_content(chunk_size=1024):
if chunk:
fp.write(chunk)
fp.flush()第八、使用urllib2,下载大文件
需要说明的是,urllib2是Python2.7 自带的模块,示例代码只能在Python2.7运行。作为知识了解一下。示例代码如下:
url = 'http://cv.sycdn.kuwo.cn/99d1a17cc43457c58cd0049db033c348/650e4bbc/resource/n1/17/37/233599851.mp3'
localfile = './233599851.mp3'
r = urllib2.Request(url)
u = urllib2.urlopen(r)
with open('localfile, 'wb') as f:
while True:
tmp = u.read(1024)
if not tmp:
break
f.write(tmp)第九、使用urllib3,下载大文件
既然使用urllib2库可以下载文件,当然使用urllib3库也能办到。利用http连接池的request方法,并将preload_content参数设置为False即可。示例代码如下:
import urllib3
url = 'http://cv.sycdn.kuwo.cn/99d1a17cc43457c58cd0049db033c348/650e4bbc/resource/n1/17/37/233599851.mp3'
localfile = './233599851.mp3'
#创建一个HTTP连接池
http = urllib3.PoolManager()
r = http.request('GET', url, preload_content=False)
chunk_size = 1024
with open(localfile, 'wb') as out:
while True:
data = r.read(chunk_size)
if not data:
break
out.write(data)
r.release_conn() #最后释放这个HTTP连接总结
通过介绍常见下载文件方法九个方面知识,我们可以轻松地实现 Python 下载文件的功能,同时也阐述了大文件下载的处理方法。当然,下载文件应该还有其他的方法,这里就不一一介绍。其中,使用 Requests 库是最为常用的方法,因为它提供了很多强大而灵活的功能,非常方便编写复杂的下载程序,这个也是我在项目中常用的方法。wget库下载功能强大,也是一个非常好的方法。
相关推荐
- 阿里云国际站ECS:阿里云ECS如何提高网站的访问速度?
-
TG:@yunlaoda360引言:速度即体验,速度即业务在当今数字化的世界中,网站的访问速度已成为决定用户体验、用户留存乃至业务转化率的关键因素。页面加载每延迟一秒,都可能导致用户流失和收入损失。对...
- 高流量大并发Linux TCP性能调优_linux 高并发网络编程
-
其实主要是手里面的跑openvpn服务器。因为并没有明文禁p2p(哎……想想那么多流量好像不跑点p2p也跑不完),所以造成有的时候如果有比较多人跑BT的话,会造成VPN速度急剧下降。本文所面对的情况为...
- 性能测试100集(12)性能指标资源使用率
-
在性能测试中,资源使用率是评估系统硬件效率的关键指标,主要包括以下四类:#性能测试##性能压测策略##软件测试#1.CPU使用率定义:CPU处理任务的时间占比,计算公式为1-空闲时间/总...
- Linux 服务器常见的性能调优_linux高性能服务端编程
-
一、Linux服务器性能调优第一步——先搞懂“看什么”很多人刚接触Linux性能调优时,总想着直接改配置,其实第一步该是“看清楚问题”。就像医生看病要先听诊,调优前得先知道服务器“哪里...
- Nginx性能优化实战:手把手教你提升10倍性能!
-
关注△mikechen△,十余年BAT架构经验倾囊相授!Nginx是大型架构而核心,下面我重点详解Nginx性能@mikechen文章来源:mikechen.cc1.worker_processe...
- 高并发场景下,Spring Cloud Gateway如何抗住百万QPS?
-
关注△mikechen△,十余年BAT架构经验倾囊相授!大家好,我是mikechen。高并发场景下网关作为流量的入口非常重要,下面我重点详解SpringCloudGateway如何抗住百万性能@m...
- Kubernetes 高并发处理实战(可落地案例 + 源码)
-
目标场景:对外提供HTTPAPI的微服务在短时间内收到大量请求(例如每秒数千至数万RPS),要求系统可弹性扩容、限流降级、缓存减压、稳定运行并能自动恢复。总体思路(多层防护):边缘层:云LB...
- 高并发场景下,Nginx如何扛住千万级请求?
-
Nginx是大型架构的必备中间件,下面我重点详解Nginx如何实现高并发@mikechen文章来源:mikechen.cc事件驱动模型Nginx采用事件驱动模型,这是Nginx高并发性能的基石。传统...
- Spring Boot+Vue全栈开发实战,中文版高清PDF资源
-
SpringBoot+Vue全栈开发实战,中文高清PDF资源,需要的可以私我:)SpringBoot致力于简化开发配置并为企业级开发提供一系列非业务性功能,而Vue则采用数据驱动视图的方式将程序...
- Docker-基础操作_docker基础实战教程二
-
一、镜像1、从仓库获取镜像搜索镜像:dockersearchimage_name搜索结果过滤:是否官方:dockersearch--filter="is-offical=true...
- 你有空吗?跟我一起搭个服务器好不好?
-
来人人都是产品经理【起点学院】,BAT实战派产品总监手把手系统带你学产品、学运营。昨天闲的没事的时候,随手翻了翻写过的文章,发现一个很严重的问题。就是大多数时间我都在滔滔不绝的讲理论,却很少有涉及动手...
- 部署你自己的 SaaS_saas如何部署
-
部署你自己的VPNOpenVPN——功能齐全的开源VPN解决方案。(DigitalOcean教程)dockovpn.io—无状态OpenVPNdockerized服务器,不需要持久存储。...
- Docker Compose_dockercompose安装
-
DockerCompose概述DockerCompose是一个用来定义和管理多容器应用的工具,通过一个docker-compose.yml文件,用YAML格式描述服务、网络、卷等内容,...
- 京东T7架构师推出的电子版SpringBoot,从构建小系统到架构大系统
-
前言:Java的各种开发框架发展了很多年,影响了一代又一代的程序员,现在无论是程序员,还是架构师,使用这些开发框架都面临着两方面的挑战。一方面是要快速开发出系统,这就要求使用的开发框架尽量简单,无论...
- Kubernetes (k8s) 入门学习指南_k8s kubeproxy
-
Kubernetes(k8s)入门学习指南一、什么是Kubernetes?为什么需要它?Kubernetes(k8s)是一个开源的容器编排系统,用于自动化部署、扩展和管理容器化应用程序。它...
欢迎 你 发表评论:
- 一周热门
- 最近发表
- 标签列表
-
- python计时 (73)
- python安装路径 (56)
- python类型转换 (93)
- python进度条 (67)
- python吧 (67)
- python的for循环 (65)
- python格式化字符串 (61)
- python静态方法 (57)
- python列表切片 (59)
- python面向对象编程 (60)
- python 代码加密 (65)
- python串口编程 (77)
- python封装 (57)
- python写入txt (66)
- python读取文件夹下所有文件 (59)
- python操作mysql数据库 (66)
- python获取列表的长度 (64)
- python接口 (63)
- python调用函数 (57)
- python多态 (60)
- python匿名函数 (59)
- python打印九九乘法表 (65)
- python赋值 (62)
- python异常 (69)
- python元祖 (57)
