python爬虫中如何使用url下载器-创新互联-快上网网站建设公司

python爬虫中如何使用url下载器-创新互联

这篇文章给大家分享的是有关python爬虫中如何使用url下载器的内容。小编觉得挺实用的，因此分享给大家做个参考。一起跟随小编过来看看吧。

创新互联建站坚持“要么做到，要么别承诺”的工作理念，服务领域包括：网站设计、成都做网站、企业官网、英文网站、手机端网站、网站推广等服务，满足客户于互联网时代的资兴网站设计、移动媒体设计的需求，帮助企业找到有效的互联网解决方案。努力成为您成熟可靠的网络建设合作伙伴！

下载器的作用就是接受URL管理器传递给它的一个url，然后把该网页的内容下载下来。python自带有urllib和urllib2等库（这两个库在python3中合并为urllib），它们的作用就是获取指定的网页内容。不过，在这里我们要使用一个更加简洁好用而且功能更加强大的模块：Requests。

Requests并非python自带模块，需要安装。关于其具体使用方法请查看以往文章，在此不多做介绍。

下载器接受一个url作为参数，返回值为下载到的网页内容（格式为str）。下面就是一个简单的下载器，其中只有一个简单的函数download()：

'''
-----------------------------------------------------------------
HtmlDownloader
'''
class HtmlDownloader(object):
    def download(self, url):
        print "start download"
        if url is None:
            return None
            print "url is None"
        user_agent = 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/63.0.3239.108 Safari/537.36'
        headers = {'User-Agent':user_agent}
        print "start requests"
        r = requests.get(url, headers=headers)
        #判断响应状态
        if r.status_code == 200:
            r.encoding = 'utf-8'
            print "该页面下载成功！{}".format(url)
            return r.text
        else:
            print "该页面下载失败！{}".format(url)
        return None

在requests请求中设置User-Agent的目的是伪装成浏览器，这是一只优秀的爬虫应该有的觉悟。

感谢各位的阅读！关于python爬虫中如何使用url下载器就分享到这里了，希望以上内容可以对大家有一定的帮助，让大家可以学到更多知识。如果觉得文章不错，可以把它分享出去让更多的人看到吧！

分享标题：python爬虫中如何使用url下载器-创新互联
本文来源：http://www.cdkjz.cn/article/csjjji.html

多年建站经验

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

咨询相关问题或预约面谈，可以通过以下方式与我们联系

网站建设

网站推广

案例

方案

电商网站开发

微信小程序

我们

联系

精准传达 • 有效沟通

查看其它板块

python爬虫中如何使用url下载器-创新互联

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接

网络推广

Network promotion

网站方案

Solution

电商网站开发

E-commerce & System

我们

About Us

联系

Contact Us

精准传达 • 有效沟通

查看其它板块

python爬虫中如何使用url下载器-创新互联

相关资讯

linux命令下载文件 linux命令行切换桌面命令

jquery插入对象 jquery 对象

ios开发ar导航 苹果手机ar导航是什么意思

mysql怎么安装会闪退 mysql安装一半退出了怎么办

苹果电脑指法快捷键 苹果电脑指令大全

关于mb.jquery的信息

html5系列代码 html5在线代码编辑器

linux上批处理命令行 linux 批量执行命令

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线 成都：13518219792 座机：028-86922220

友情链接 交换友情链接

ios开发ar导航苹果手机ar导航是什么意思

苹果电脑指法快捷键苹果电脑指令大全

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接