百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术资源 > 正文

2021年,你应该知道的Python打包指南

off999 2024-09-16 00:52 47 浏览 0 评论

△点击上方Python猫”关注 ,回复“1”领取电子书

花下猫语:好久没在开头写推荐语了。今天分享一篇文章,作者应该是国内唯一一位PyPA成员。如他所言,中文世界关于 Python 最新包管理发展的内容确实很少,因此他的这篇文章有很好的指导价值。恰好我之前曾翻译过PyPA维护者的三篇文章(这里),算是有一定的相关性,推荐大家作关联阅读。

作者:frostming

原题:Python打包指南2021

来源:https://frostming.com/2020/12-25/python-packaging

大家好,雕虫小技栏目又和大家见面了,谁让咱不会那些个屠龙之技,只好捉几个虫子玩玩了。写这篇文章是因为过去的两年关于pip和 Python 包管理有几个重要的 PEP 发布,然而网上(中文世界)的打包发布教程很少有针对此的更新。再加上我成为 PyPA 的成员已经尸位素餐快一年了,还是应该来做点贡献。

setup.py 真难写

似乎从有 Python 打包以来就有了setuptools这个库,你能搜到的教程,涉及打包发布的,都会让你编写那个可怕的setup.py。不知道谁能完全掌握那个东西的写法,我到现在都还不太会。说几个常用的配置:

  1. 指定依赖和可选依赖setup(
    install_requires=[
    "flask", "flask-migrate", "sqlalchemy"],
    extras_require={
    "mysql": ["mysqlclient"], "pgsql": ["psycopg2"]}
    )
    注意那两个 key 分别是install_requiresextras_require,别写错了。此外,如果你需要根据条件增减依赖的话,不要用INSTALL_REQUIRES = ["flask"]
    if sys.platform ==
    "win32":
    INSTALL_REQUIRES.append(
    "pywin32")
    setup(install_requires=INSTALL_REQUIRES)
    而应该使用Environment MarkersINSTALL_REQUIRES = [
    "flask",
    "pywin32; sys_platform == 'win32'"
    ]
    setup(install_requires=INSTALL_REQUIRES)
  2. 发布可执行程序到/binsetup(
    entry_points={
    "console_scripts": ["mybin=mypackage.main:cli"]
    }
    )
    或者 ini 写法setup(
    entry_points=
    """[console_scripts]
    mybin = mypackage.main:cli
    """

    )
    任选其一。
  3. 包含 data 文件setup(
    include_package_data=
    True # 从MANIFEST.in中读取配置
    )
    或者setup(
    package_data={
    "": ["*.json"]} # 包含所有json文件
    )
  4. 指定源代码结构,如果你使用的是src/存放包的源码这种项目结构,可以:setup(
    package_dir={
    "": "src"}
    )

打包上传和安装

打包

好了,这个万恶的setup.py我已经写好了,咱要发布 PyPI 了。第一步,打包成可分发的文件:

nbsp;python setup.py sdist bdist_wheel --universal

这条命令会同时生成源代码包(Source Distribution),和二进制包(Binary Distribution)。当然,大部分的 Python 发布包中并不真的包含二进制, 只是沿用了软件工程中的一般叫法。

其中bdist_wheel生成的二进制包是 wheel 格式(需要安装wheel才能打包),--universal的意思是这个二进制包对所有 支持的 Python 版本和 ABI 都适用,「 一处打包,到处使用」,生成的文件名类似:my_package-0.1.0-py3-none-any.whl

如果你包中有 C 扩展, 也就是打包出来的 wheel 会真的有二进制文件时就不能加这个 flag 了,这时生成的文件名类似:my_package-0.1.0-cp38-cp38-win_amd64.whl

这个文件名不是乱来的,是要遵循一定规则,下载器能直接从这个文件名获得这个包的基本信息:

上传

可能有老的教程,让你直接用python setup.py sdist bdist_wheel register upload打包上传一步到位,这个方式已经过时了不推荐使用。正确的方法应该用twine工具:

nbsp;twine upload dist/*

如果你要把上传放到 CI 里自动执行,最好生成一个 token 来使用,访问 https://pypi.org/manage/account/token/ 按提示生成一个 token,使用的时候只要用命令指定下用户名和密码:

twine upload --username __token__ --password ${{ secrets.PYPI_TOKEN }} dist/*

安装

把包上传到 PyPI 以后,pip install my-package的时候是怎么安装的呢?

  1. 访问https://pypi.org/simple/my-package,解析所有链接
  2. 若是 whl 文件,判断是否与当前 Python 版本、ABI、平台适配,加入到候选列表
  3. 从<a>标签中读取data-requires-python属性,判断是否与当前 Python 版本兼容,加入候选列表
  4. 若是源代码包,直接加入候选列表

最终在候选列表中优先选择 whl 文件为待安装的包,将包下载到本地,候选包的选择可以由pip install--only-binary--no-binary选项控制。

现在准备安装了,如果待安装的是 whl,那就非常简单,直接解压(whl 文件是一种 zip 格式),放到目标目录即可,解压后产生的文件除了代码或二进制以外,还会包含一个my_package-0.1.0.dist-info/目录,包含这个包的元数据信息,比如有哪些文件、文件 hash 值、entry_points 等等。

如果待安装的文件是源代码包,那么需要把这个压缩包解压到一个临时目录,根据包指定的方式编译构建,生成 whl 文件,再用 whl 安装同样的方法放到目标目录中。而这个指定的编译方式,在 PEP 517 提案之前,是调用python setup.py install命令。在 PEP 517 发布之后,则由 PEP 517 的 build backend 控制。

setuptools 不再是唯一的选择

PEP 517 的内容简单来说,就是在项目根目录下的pyproject.toml定义了两个特殊属性(注:其实还有第三个属性backend-path,当你的 backend 是在本地时使用。):

[build-system]
requires = ["setuptools >= 40.8.0", "wheel"]
build-backend = "setuptools.build_meta:__legacy__"

上面这个就是setuptools的 PEP 517 的配置,这样可以让老的项目,能直接用 PEP 517 的方式构建。如果你的项目中并没有pyproject.toml文件,pip能自动填充为此缺省配置。其中requires意为这个 backend 依赖的包列表,build-backend则为 backend 的具体位置。这个 backend 需要实现几个约定的接口:

  1. get_requires_for_build_wheel,构建 wheel 需要的依赖列表,这个一般没有特殊要求都是空
  2. get_requires_for_build_sdist,构建 sdist 需要的依赖列表,同上
  3. prepare_metadata_for_build_wheel,生成一个 wheel 要用的dist-info/文件夹
  4. build_wheel,生成 wheel 文件
  5. build_sdist,生成 sdist 文件

有了这些接口,pip以及其他可能的 frontend 就能从源代码构建一个 wheel 出来。因此,pyproject.toml必须被包含在源代码包中。

有了 PEP 517 的协议规范以后,backend 和 frontend 就能自由组合,不再是非setuptools不可了,实现了 PEP 517 的 backend 有:

  • Poetry-core
  • Flit-core
  • pdm-pep517
  • 所以我可以不用写 setup.py 了

    setup.py作为一个元数据的定义格式是有问题的:

    1. 必须由 Python 运行,无法静态解析
    2. 由于第 1 点,有注入恶意代码的操作可行性

    所以需要指定一个元数据的配置格式,这个格式规范最近也定下来了,它就是 PEP 621,也是使用pyproject.toml来定义的。而且,PDM已经支持这个配置格式了,仅此一家。


    阅读链接

  • Python Packaging User Guide (https://packaging.python.org/)
  • setuptools 文档 (https://setuptools.readthedocs.io/en/latest/)
  • Python 包构建接口 - PEP 517
  • Wheel 包格式 - PEP 427
  • Python 包元数据格式 - PEP 621
  • Snake bites: Beware malicious Python libraries (https://www.infoworld.com/article/3487701/snake-bites-beware-malicious-python-libraries.html)
  • 相关推荐

    阿里云国际站ECS:阿里云ECS如何提高网站的访问速度?

    TG:@yunlaoda360引言:速度即体验,速度即业务在当今数字化的世界中,网站的访问速度已成为决定用户体验、用户留存乃至业务转化率的关键因素。页面加载每延迟一秒,都可能导致用户流失和收入损失。对...

    高流量大并发Linux TCP性能调优_linux 高并发网络编程

    其实主要是手里面的跑openvpn服务器。因为并没有明文禁p2p(哎……想想那么多流量好像不跑点p2p也跑不完),所以造成有的时候如果有比较多人跑BT的话,会造成VPN速度急剧下降。本文所面对的情况为...

    性能测试100集(12)性能指标资源使用率

    在性能测试中,资源使用率是评估系统硬件效率的关键指标,主要包括以下四类:#性能测试##性能压测策略##软件测试#1.CPU使用率定义:CPU处理任务的时间占比,计算公式为1-空闲时间/总...

    Linux 服务器常见的性能调优_linux高性能服务端编程

    一、Linux服务器性能调优第一步——先搞懂“看什么”很多人刚接触Linux性能调优时,总想着直接改配置,其实第一步该是“看清楚问题”。就像医生看病要先听诊,调优前得先知道服务器“哪里...

    Nginx性能优化实战:手把手教你提升10倍性能!

    关注△mikechen△,十余年BAT架构经验倾囊相授!Nginx是大型架构而核心,下面我重点详解Nginx性能@mikechen文章来源:mikechen.cc1.worker_processe...

    高并发场景下,Spring Cloud Gateway如何抗住百万QPS?

    关注△mikechen△,十余年BAT架构经验倾囊相授!大家好,我是mikechen。高并发场景下网关作为流量的入口非常重要,下面我重点详解SpringCloudGateway如何抗住百万性能@m...

    Kubernetes 高并发处理实战(可落地案例 + 源码)

    目标场景:对外提供HTTPAPI的微服务在短时间内收到大量请求(例如每秒数千至数万RPS),要求系统可弹性扩容、限流降级、缓存减压、稳定运行并能自动恢复。总体思路(多层防护):边缘层:云LB...

    高并发场景下,Nginx如何扛住千万级请求?

    Nginx是大型架构的必备中间件,下面我重点详解Nginx如何实现高并发@mikechen文章来源:mikechen.cc事件驱动模型Nginx采用事件驱动模型,这是Nginx高并发性能的基石。传统...

    Spring Boot+Vue全栈开发实战,中文版高清PDF资源

    SpringBoot+Vue全栈开发实战,中文高清PDF资源,需要的可以私我:)SpringBoot致力于简化开发配置并为企业级开发提供一系列非业务性功能,而Vue则采用数据驱动视图的方式将程序...

    Docker-基础操作_docker基础实战教程二

    一、镜像1、从仓库获取镜像搜索镜像:dockersearchimage_name搜索结果过滤:是否官方:dockersearch--filter="is-offical=true...

    你有空吗?跟我一起搭个服务器好不好?

    来人人都是产品经理【起点学院】,BAT实战派产品总监手把手系统带你学产品、学运营。昨天闲的没事的时候,随手翻了翻写过的文章,发现一个很严重的问题。就是大多数时间我都在滔滔不绝的讲理论,却很少有涉及动手...

    部署你自己的 SaaS_saas如何部署

    部署你自己的VPNOpenVPN——功能齐全的开源VPN解决方案。(DigitalOcean教程)dockovpn.io—无状态OpenVPNdockerized服务器,不需要持久存储。...

    Docker Compose_dockercompose安装

    DockerCompose概述DockerCompose是一个用来定义和管理多容器应用的工具,通过一个docker-compose.yml文件,用YAML格式描述服务、网络、卷等内容,...

    京东T7架构师推出的电子版SpringBoot,从构建小系统到架构大系统

    前言:Java的各种开发框架发展了很多年,影响了一代又一代的程序员,现在无论是程序员,还是架构师,使用这些开发框架都面临着两方面的挑战。一方面是要快速开发出系统,这就要求使用的开发框架尽量简单,无论...

    Kubernetes (k8s) 入门学习指南_k8s kubeproxy

    Kubernetes(k8s)入门学习指南一、什么是Kubernetes?为什么需要它?Kubernetes(k8s)是一个开源的容器编排系统,用于自动化部署、扩展和管理容器化应用程序。它...

    取消回复欢迎 发表评论: