源码解析python中randint函数的效率缺陷

来自：网络

时间：2022-06-08

阅读：

一、前言

前几天，在写一个与差分隐私相关的简单程序时，我发现了一些奇怪的东西：相对于其他的随机数生成函数，Python的random.randint()函数感觉很慢。由于 randint() 是 Python 中最为常用的生成随机整数的API，因此我决定深入挖掘其实现机制以了解其运行效率较低的原因。

本文深入探讨了 random 模块的实现，并讨论了一些更为快速的生成伪随机整数的替代方法。

二、对randint()运行效率的测试

首先，我们可以先观察一下random.randint()的运行效率：

$ python3 -m timeit -s 'import random' 'random.random()'
10000000 loops, best of 3: 0.0523 usec per loop
$ python3 -m timeit -s 'import random' 'random.randint(0, 128)'
1000000 loops, best of 3: 1.09 usec per loop

很明显，在生成一个大小在[0, 128]中的随机整数的成本，大约是在生成大小在[0, 1)之间的随机浮点数的 20 倍。

三、从源码分析randint()的缺陷

接下来，我们将从python的源码，来解析randint()的实现机制。

random.random()

首先从random()开始说。该函数定义在Lib/random.py文件中，函数random.random() 是Random类的random方法的别名，而Random.random()直接从_Random继承了random方法。继续向下追溯就会发现，random方法的真正定义是在Modules/_randommodule.c中实现的，其实现代码如下：

static PyObject *
random_random(RandomObject *self, PyObject *Py_UNUSED(ignored))
{
    uint32_t a=genrand_int32(self)>>5, b=genrand_int32(self)>>6;
    return PyFloat_FromDouble((a*67108864.0+b)*(1.0/9007199254740992.0));
}

其中 getrand_int32() 函数是一个C语言实现的梅森旋转算法，其能够快速生成伪随机数。

总结一下，当我们在Python中调用random.random()时，该函数直接调用了C函数，而该C函数唯一的功能就是：生成随机数，并将genrand_int32()的结果转换为浮点数，除此之外没有做任何额外的步骤。

random.randint()

现在让我们看看randint()的实现代码：

def randint(self, a, b):
    """Return random integer in range [a, b], including both end points.
    """
    return self.randrange(a, b+1)

randint函数会调用randrange()函数，因此我们再观察randrange()的源码。

def randrange(self, start, stop=None, step=1, _int=int):
    """Choose a random item from range(start, stop[, step]).

    This fixes the problem with randint() which includes the
    endpoint; in Python this is usually not what you want.
    """
    # This code is a bit messy to make it fast for the
    # common case while still doing adequate error checking.
    istart = _int(start)
    if istart != start:
        raise ValueError("non-integer arg 1 for randrange()")
    if stop is None:
        if istart > 0:
            return self._randbelow(istart)
        raise ValueError("empty range for randrange()")

    # stop argument supplied.
    istop = _int(stop)
    if istop != stop:
        raise ValueError("non-integer stop for randrange()")
    width = istop - istart
    if step == 1 and width > 0:
        return istart + self._randbelow(width)
    if step == 1:
        raise ValueError("empty range for randrange() (%d,%d, %d)" % (istart, istop, width))

    # Non-unit step argument supplied.
    istep = _int(step)
    if istep != step:
        raise ValueError("non-integer step for randrange()")
    if istep > 0:
        n = (width + istep - 1) // istep
    elif istep < 0:
        n = (width + istep + 1) // istep
    else:
        raise ValueError("zero step for randrange()")
    if n <= 0:
        raise ValueError("empty range for randrange()")
    return istart + istep*self._randbelow(n)

在调用下一层的函数之前，randrange()需要对于函数参数进行大量的检查。不过，如果我们不是用stop参数，那么检查速度就会快一些，经过一堆检查之后，才可以调用_randbelow()方法。

默认情况下，_randbelow() 被映射到 _randbelow_with_getrandbits()：

def _randbelow_with_getrandbits(self, n):
    "Return a random int in the range [0,n).  Raises ValueError if n==0."

    getrandbits = self.getrandbits
    k = n.bit_length()  # don't use (n-1) here because n can be 1
    r = getrandbits(k)          # 0 <= r < 2**k
    while r >= n:
        r = getrandbits(k)
    return r

从该函数的源码可以发现：该函数的逻辑是计算出n的位数，而后按照位数生成随机比特，因此当n的大小不为2的次幂时，该函数可能需要多次调用getrandbits()。getrandbits()是一个利用C语言定义的函数，该函数最终也会调用 getrand_int32()，但由于该函数相对于 random() 函数需要更多的处理过程，导致其运行速度慢两倍。

总而言之，通过python代码或者C代码都可以调用由C所定义的函数。由于 Python 是字节码解释的，因此，任何在调用C函数之前的，用python语言定义的处理过程，都会导致函数的运行速度比直接调用 C 函数慢很多。

这里有几个实验可以帮助我们检验这个假设。首先，让我们尝试在 randrange 中通过调用没有stop参数的 randrange 来减少中间的参数检查过程，提高程序执行的速度：

$ python3 -m timeit -s 'import random' 'random.randrange(1)'
1000000 loops, best of 3: 0.784 usec per loop

正如预期的那样，由于中间运行过程的减少，此时randrange()运行时间比原始的 randint() 好一些。可以在 PyPy 中重新运行比较运行时间。

$ pypy -m timeit -s 'import random' 'random.random()'
100000000 loops, best of 3: 0.0139 usec per loop
$ pypy -m timeit -s 'import random' 'random.randint(0, 128)'
100000000 loops, best of 3: 0.0168 usec per loop

正如预期的那样，PyPy 中这些调用之间的差异很小。

四、更快的生成随机整数的方法

所以 randint() 结果非常慢。当只需要生成少量随机数的时候，可以忽视该函数带来的性能损失，当需要生成大量的随机数时，就需要寻找一个效率够高的方法。

random.random()

一个技巧就是使用random.random()代替，乘以我们的整数限制从而得到整数，由于random()可以生成均匀的[0,1)分布，因此扩展之后也可以得到整数上的均匀分布：

$ python3 -m timeit -s 'import random' 'int(128 * random.random())'
10000000 loops, best of 3: 0.193 usec per loop

这为我们提供了 [0, 128)范围内的伪随机整数，速度更快。需要注意的是：Python 以双精度表示其浮点数，精度为 53 位。当限制超过 53 位时，我们将使用此方法获得的数字不是完全随机的，多的位将丢失。如果不需要这么大的整数，就可以忽视这个问题。

直接使用 getrandbits()

另一种生成伪随机整数的快速方法是直接使用 getrandbits()：

$ python3 -m timeit -s 'import random' 'random.getrandbits(7)'
10000000 loops, best of 3: 0.102 usec per loop

此方法快速，但是生成数据范围有限：它支持的范围为[0,2^n]。如果我们想限制范围，取模的方法无法做到范围的限制——这会扭曲分布；因此，我们必须使用类似于上面示例中的 _randbelow_with_getrandbits()中的循环。但是会减慢速度。

使用 Numpy.random

最后，我们可以完全放弃 random 模块，而使用 Numpy：

$ python3 -m timeit -s 'import numpy.random' 'numpy.random.randint(128)'
1000000 loops, best of 3: 1.21 usec per loop

生成单个数据的速度很慢。那是因为 Numpy 不适合仅用于单个数据：numpy能够将成本摊销在用 C语言创建or操作的大型数组上。为了证明这一点，下边给出了生成 100 个随机整数所需时间：

$ python3 -m timeit -s 'import numpy.random' 'numpy.random.randint(128, size=100)'
1000000 loops, best of 3: 1.91 usec per loop

仅比生成单个慢 60%！每个整数 0.019 微秒，这是目前最快的方法——比调用 random.random() 快 3 倍。这种方法如此之快的原因是Numpy将调用开销分摊到所有生成的整数上，并且在 Numpy 内部运行一个高效的 C 循环来生成它们。总之，如果要生成大量随机整数，建议使用 Numpy；如果只是一次生成一个，它可能没有特别高效。

1、背景已安装了 Python3.6.4，需要再安装 Python3.9 版本2、操作步骤（1）寻找当前 Python3.9 版本最新稳定版的子版本通过官网查找，目前为 3.9.18，下载到本地文件：Python-3.9.18.tg

2024-03-17 01:50:35

数据预处理的优化缺失值处理： interpolate() 函数：使用插值方法填充缺失值。 KNNImputer() 模块：通过 K 最近邻算法估计缺失值。 MICE 方法：通过多重插补创建多个数据集并组合结

2024-03-15 21:10:46

一、分析页面打开今日BBNews网址 https://news.bicido.com ，下拉选择【编程】栏目1.1、分析请求F12打开开发者模式，然后点击Network后点击任意一个请求，Ctrl+F开启搜索，输入标题

2024-03-15 21:03:08

很多人都听说过爬虫，我也不例外。曾看到别人编写的爬虫代码，虽然没有深入研究，但感觉非常强大。因此，今天我决定从零开始，花费仅5分钟学习入门爬虫技术，以后只需轻轻一爬就能查看

2024-03-15 21:01:49

&emsp;&emsp;本文介绍基于Python中ArcPy模块，对大量栅格遥感影像文件批量进行无效值（NoData值）填充的方法。&emsp;&emsp;在处理栅格图像文件时，我们经常会遇到图像中存在有无效

2024-03-15 21:00:14

pandas的DataFrame可以通过设置参数使得在jupyter notebook中显示的更加美观，
但是，将DataFrame的数据导出excel时，却只能以默认最朴素的方式将数据写入excel。本文介绍一种简

2024-03-15 20:56:37

我们在使用pandas处理完数据之后，最终总是要把数据作为一个文件保存下来，
那么，保存数据最常用的文件是什么呢？
我想大部分人一定会选择csv或者excel。刚接触数据分析时，我也是这

2024-03-15 20:55:50

Pandas无疑是我们数据分析时一个不可或缺的工具，它以其强大的数据处理能力、灵活的数据结构以及易于上手的API赢得了广大数据分析师和机器学习工程师的喜爱。然而，随着数据量

2024-03-15 00:55:56

1. 本篇文章目标将下面的excel中的寄存器表单读入并构建一个字典
2. openpyxl的各种基本使用方法2.1 打开工作簿wb = openpyxl.load_workbook('test_workbook.xlsx'

2024-03-12 23:59:32

F-String（格式化字符串字面值）是在Python 3.6中引入的，它是一种非常强大且灵活的字符串格式化方法。它允许你在字符串中嵌入表达式，这些表达式在运行时会被求值并转换为字符串，

2024-03-12 12:07:02

building-a-simple-redis-server-with-python前几天我想到,写一个简单的东西会很整洁雷迪斯-像数据库服务器。虽然我有很多 WSGI应用程序的经验,数据库服务器展示了一种新

2024-03-12 12:04:50

人工智能时代，最需要学习的编程语言是：python 。笔者是个 python 小白，昨天花了两个小时，第一次成功运行起来 python 项目。项目是 powerpoint-extractor ，可以将 ppt 文件中的

2024-03-11 18:44:06

一、介绍在上节 Python实现企业微信上下班自动打卡程序内容之后，我们继续优化自动打卡程序。接下来增加如下内容：实现打卡时间随机范围处理节假日不打卡的情况实现定时调度

2024-03-11 18:35:32

本文介绍基于Python中whitebox模块，对大量长时间序列栅格遥感影像的每一个像元进行忽略NoData值的多时序平均值求取。在文章Python ArcPy批量计算多时相遥感影像的各像元平均

2024-03-09 22:37:42

最近用到百度飞桨的 PaddleOCR，研究了一下PaddleOCR的服务化部署，简单记录一些部署过程和碰到的问题。基础环境 paddlepaddle 2.5.2 python 3.7 paddlehub 2.1.0 PaddleOCR 2.

2024-03-09 22:30:58

前言Python 是一门上手非常快的语言，学习python这门编程语言达到能够正常使用的程度，需要掌握的点包括：语言基础特性数据类型流程控制函数调用面向对象模块与包下面从这6

2024-03-08 22:46:37

Python作为一门灵活、充满技巧的语言，有着很多奇技淫巧，今天小编就跟大家分享一下在平时工作中所积累的技巧，这里面既有语法上的技巧，也有库函数的应用，可以帮助大家在平时的工作

2024-03-08 22:42:14

上一篇文章Python中那些简单又好用的特性和用法发出后，群里的小伙伴又给补充了几个好用的用法，结合生产实用经验汇总整理如下，各位看官如有需要请自取反射，反射是一种机制，可以

2024-03-08 22:37:59

一般来说，我们先用pandas分析数据，然后用matplotlib之类的可视化库来显示分析结果。
而pandas库中有一个强大的工具--plot函数，可以使数据可视化变得简单而高效。1. plot 函数

2024-03-08 22:36:32

pandas中的cut函数可将一维数据按照给定的区间进行分组，并为每个值分配对应的标签。
其主要功能是将连续的数值数据转化为离散的分组数据，方便进行分析和统计。1. 数据准备下

2024-03-07 01:23:55

Python作为我的主力语言帮助我开发了许多DevOps运维自动化系统，这篇文章总结几个我在编写Python代码过程中用到的几个简单又好用的特性和用法，这些特性和用法可以帮助我们更高

2024-03-07 01:22:01

一文搞懂如何自己写一个Python库你是否曾想过为自己的Python项目编写一个库，以便在不同项目中重复使用代码？并且能在PyPI仓库中发布，并通过pip install 库名来安装使用编写Pyth

2024-03-07 01:21:09

高级优化：字节码优化Cpython 解释器将 Python 源代码编译为字节码，然后由虚拟机执行。字节码优化涉及修改字节码以提高性能。常见的优化技术包括：import disdef fib(n):if n <

2024-03-05 23:19:26

与 C/C++ 的互操作Cpython 可以直接调用 C/C++ 代码，因为它通过 CPython 解释器内部的 C 接口公开了一个 CPython api。这允许开发人员使用 Python 访问 C/c++ 库，从而利用它

2024-03-05 23:16:12

处理大量数据时，经常需要对数据进行分组和汇总，groupby为我们提供了一种简洁、高效的方式来实现这些操作，从而简化了数据分析的流程。1. 分组聚合是什么分组是指根据一个或多个

2024-03-05 23:07:26

最近，我在 Python 潮流周刊中分享了一个超级火爆的项目，这还不到一个月，它在 Github 上已经拿下了 8K star 的亮眼成绩，可见其受欢迎程度极高！国内还未见有更多消息，我趁着周末把

2024-03-05 23:06:19

&emsp;&emsp;本文介绍基于Python中ArcPy模块，实现基于栅格图像批量裁剪栅格图像，同时对齐各个栅格图像的空间范围，统一其各自行数与列数的方法。&emsp;&emsp;首先明确一下我们

2024-03-04 22:58:28

使用 pandas 进行数据分析时，第一步就是读取文件。
在平时学习和练习的过程中，用到的数据量不会太大，所以读取文件的步骤往往会被我们忽视。然而，在实际场景中，面对十万，百万级别

2024-03-04 22:54:15

在进行统计分析时，pandas提供了多种工具来帮助我们理解数据。
pandas提供了多个聚合函数，其中包括均值、标准差、最大值、最小值等等。
此外，pandas还可以进行基于列的统计分析

2024-03-04 22:53:49

在pandas中，索引（index）是用于访问数据的关键。
它为数据提供了基于标签的访问能力，类似于字典，可以根据标签查找和访问数据。而pandas的轴（axis）是指数据表中的一个维度，可以理解为

2024-03-04 22:53:23

2020-10-21

2021-03-02

2020-05-07

2020-05-26

2021-01-13

2021-04-02

2020-05-09

2020-05-10

2020-10-21

源码解析python中randint函数的效率缺陷

目录

一、前言

二、对randint()运行效率的测试

三、从源码分析randint()的缺陷

random.random()

random.randint()

四、更快的生成随机整数的方法

random.random()

直接使用 getrandbits()

使用 Numpy.random

热点内容

免费资源网

在线工具

扫一扫随时看

本站下载频道