14赞

用urllib2限制

作者：雯颜哥_135 | 2023-08-31 18:47

如何解决《用urllib2限制》经验，为你挑选了1个好方法。

使用时可以轻松限制kbps urllib2吗？如果是,您可以指导我的任何代码示例或资源将不胜感激.

1> Markus Jarde..：

模块中有urlretrieve(url, filename=None, reporthook=None, data=None)功能urllib.如果将reporthook-function/object实现为令牌桶或漏桶,则具有全局速率限制.

编辑:经过仔细检查,我发现reporthook按照我的想法进行全球限速并不容易.reporthook仅给出下载的数量和总大小,这些信息本身不足以与令牌桶一起使用的信息.解决此问题的一种方法是将最后下载的数量存储在每个速率限制器中,但使用全局令牌桶.

编辑2:将两个代码组合成一个例子.

"""Rate limiters with shared token bucket."""

import os
import sys
import threading
import time
import urllib
import urlparse

class TokenBucket(object):
    """An implementation of the token bucket algorithm.
    source: http://code.activestate.com/recipes/511490/

    >>> bucket = TokenBucket(80, 0.5)
    >>> print bucket.consume(10)
    True
    >>> print bucket.consume(90)
    False
    """
    def __init__(self, tokens, fill_rate):
        """tokens is the total tokens in the bucket. fill_rate is the
        rate in tokens/second that the bucket will be refilled."""
        self.capacity = float(tokens)
        self._tokens = float(tokens)
        self.fill_rate = float(fill_rate)
        self.timestamp = time.time()
        self.lock = threading.RLock()

    def consume(self, tokens):
        """Consume tokens from the bucket. Returns 0 if there were
        sufficient tokens, otherwise the expected time until enough
        tokens become available."""
        self.lock.acquire()
        tokens = max(tokens,self.tokens)
        expected_time = (tokens - self.tokens) / self.fill_rate
        if expected_time <= 0:
            self._tokens -= tokens
        self.lock.release()
        return max(0,expected_time)

    @property
    def tokens(self):
        self.lock.acquire()
        if self._tokens < self.capacity:
            now = time.time()
            delta = self.fill_rate * (now - self.timestamp)
            self._tokens = min(self.capacity, self._tokens + delta)
            self.timestamp = now
        value = self._tokens
        self.lock.release()
        return value

class RateLimit(object):
    """Rate limit a url fetch.
    source: http://mail.python.org/pipermail/python-list/2008-January/472859.html
    (but mostly rewritten)
    """
    def __init__(self, bucket, filename):
        self.bucket = bucket
        self.last_update = 0
        self.last_downloaded_kb = 0

        self.filename = filename
        self.avg_rate = None

    def __call__(self, block_count, block_size, total_size):
        total_kb = total_size / 1024.

        downloaded_kb = (block_count * block_size) / 1024.
        just_downloaded = downloaded_kb - self.last_downloaded_kb
        self.last_downloaded_kb = downloaded_kb

        predicted_size = block_size/1024.

        wait_time = self.bucket.consume(predicted_size)
        while wait_time > 0:
            time.sleep(wait_time)
            wait_time = self.bucket.consume(predicted_size)

        now = time.time()
        delta = now - self.last_update
        if self.last_update != 0:
            if delta > 0:
                rate = just_downloaded / delta
                if self.avg_rate is not None:
                    rate = 0.9 * self.avg_rate + 0.1 * rate
                self.avg_rate = rate
            else:
                rate = self.avg_rate or 0.
            print "%20s: %4.1f%%, %5.1f KiB/s, %.1f/%.1f KiB" % (
                    self.filename, 100. * downloaded_kb / total_kb,
                    rate, downloaded_kb, total_kb,
                )
        self.last_update = now


def main():
    """Fetch the contents of urls"""
    if len(sys.argv) < 4:
        print 'Syntax: %s rate url1 url2 ...' % sys.argv[0]
        raise SystemExit(1)
    rate_limit  = float(sys.argv[1])
    urls = sys.argv[2:]
    bucket = TokenBucket(10*rate_limit, rate_limit)

    print "rate limit = %.1f" % (rate_limit,)

    threads = []
    for url in urls:
        path = urlparse.urlparse(url,'http')[2]
        filename = os.path.basename(path)
        print 'Downloading "%s" to "%s"...' % (url,filename)
        rate_limiter = RateLimit(bucket, filename)
        t = threading.Thread(
            target=urllib.urlretrieve,
            args=(url, filename, rate_limiter))
        t.start()
        threads.append(t)

    for t in threads:
        t.join()

    print 'All downloads finished'

if __name__ == "__main__":
    main()

仅供参考:我编写了一个通用的"read_limiting_rate()"函数,该函数适用于Python3中的所有可读对象.http://pastie.org/3120175

推荐阅读

程序员
无法从链接中删除下划线

如何解决《无法从链接中删除下划线》经验，为你挑选了1个好方法。 ... [详细]
程序员
排序字符串是O(n ^ 2logn)是真的吗？

如何解决《排序字符串是O(n^2logn)是真的吗？》经验，为你挑选了1个好方法。 ... [详细]
程序员
在Firebase Hosting上提供gzip压缩文件

如何解决《在FirebaseHosting上提供gzip压缩文件》经验，为你挑选了1个好方法。 ... [详细]
程序员
Android Studio 2.0 - NoSuchAlgorithmException:SHA256WITHDSA签名不可用

如何解决《AndroidStudio2.0-NoSuchAlgorithmException:SHA256WITHDSA签名不可用》经验，为你挑选了1个好方法。 ... [详细]
程序员
Java方法重载:参数的顺序是否会影响延迟？

如何解决《Java方法重载:参数的顺序是否会影响延迟？》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何离线安装适用于Windows 10的D3D11 SDK图层

如何解决《如何离线安装适用于Windows10的D3D11SDK图层》经验，为你挑选了1个好方法。 ... [详细]
程序员
当PHP没有被修改时,PHP是否优化了数组类型的函数参数,而不是通过引用显式传递的？

如何解决《当PHP没有被修改时,PHP是否优化了数组类型的函数参数,而不是通过引用显式传递的？》经验，为你挑选了0个好方法。 ... [详细]
程序员
为什么sbt编译失败并出现StackOverflowError？

如何解决《为什么sbt编译失败并出现StackOverflowError？》经验，为你挑选了1个好方法。 ... [详细]
程序员
使用Protractor获取ng-repeat ng-repeat

如何解决《使用Protractor获取ng-repeatng-repeat》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何处理Spring Boot重定向到/ error？

如何解决《如何处理SpringBoot重定向到/error？》经验，为你挑选了0个好方法。 ... [详细]
程序员
如何在Powershell哈希表中获得特定值的名称？

如何解决《如何在Powershell哈希表中获得特定值的名称？》经验，为你挑选了0个好方法。 ... [详细]
程序员
递归函数中堆栈溢出的原因

如何解决《递归函数中堆栈溢出的原因》经验，为你挑选了0个好方法。 ... [详细]
程序员
UICollectionViewCell和UICollectionView的高度相等

如何解决《UICollectionViewCell和UICollectionView的高度相等》经验，为你挑选了2个好方法。 ... [详细]
程序员
PyCharm类型暗示古怪

如何解决《PyCharm类型暗示古怪》经验，为你挑选了1个好方法。 ... [详细]
程序员
如何使用Angular 2(beta和更新版本)加载RxJS(和zone.js/reflect-metadata)？

如何解决《如何使用Angular2(beta和更新版本)加载RxJS(和zone.js/reflect-metadata)？》经验，为你挑选了1个好方法。 ... [详细]
程序员
SQL有MAX(COUNT)错误

如何解决《SQL有MAX(COUNT)错误》经验，为你挑选了1个好方法。 ... [详细]
程序员
再现"关闭一个foreach的变量"得到了

如何解决《再现"关闭一个foreach的变量"得到了》经验，为你挑选了2个好方法。 ... [详细]
程序员
张量流softmax回归始终预测1

如何解决《张量流softmax回归始终预测1》经验，为你挑选了1个好方法。 ... [详细]
程序员
Qt安装程序框架:自动更新

如何解决《Qt安装程序框架:自动更新》经验，为你挑选了1个好方法。 ... [详细]
程序员
什么构成"有效"C标识符？

如何解决《什么构成"有效"C标识符？》经验，为你挑选了3个好方法。 ... [详细]

雯颜哥_135

这个屌丝很懒，什么也没留下！

关注作者

Tags | 热门标签

RankList | 热门文章