• 欢迎访问搞代码网站,推荐使用最新版火狐浏览器和Chrome浏览器访问本网站!
  • 如果您觉得本站非常有看点,那么赶紧使用Ctrl+D 收藏搞代码吧

用python可以下载网页源码吗

python 搞java代码 3年前 (2022-05-21) 14次浏览 已收录 0个评论

python可以下载网页的源代码,使用urllib库,或者使用更为方便的requests库。

import urllib2
def download(url, num_retries = 5):
    '''
    function: 下载<a href="https://www.gaodaima.com/tag/%e7%bd%91%e9%a1%b5" title="查看更多关于网页的文章" target="_blank">网页</a>源代码,如果遇到 5xx 错误状态,则继续尝试下载,直到下载 num_retries 次为止。
    '''
    print "downloading " , url
    try:
        html = urllib2.urlopen(url).read()
    except urllib2.URLError as e:
        print "download error: " , e.reason
        html = None
        if num_retries > 0:
            if hasattr(e,'code') and 500 <= e.code < 600:
                return download(url, num_retries-1)

    return html

www#gaodaima.com来源gao.dai.ma.com搞@代*码网搞代码

其中 url 即为你想现在的网页地址。 num_reties 为遇到 5xx 错误的时候,重试下载的次数。

更多学习内容,请点击搞代码网。

来源:搞代码网:原文地址:https://www.gaodaima.com


搞代码网(gaodaima.com)提供的所有资源部分来自互联网,如果有侵犯您的版权或其他权益,请说明详细缘由并提供版权或权益证明然后发送到邮箱[email protected],我们会在看到邮件的第一时间内为您处理,或直接联系QQ:872152909。本网站采用BY-NC-SA协议进行授权
转载请注明原文链接:用python可以下载网页源码吗
喜欢 (0)
[搞代码]
分享 (0)
发表我的评论
取消评论

表情 贴图 加粗 删除线 居中 斜体 签到

Hi,您需要填写昵称和邮箱!

  • 昵称 (必填)
  • 邮箱 (必填)
  • 网址