大学网课搜题引擎
首页
高校帮
网络数据采集与Python爬虫【09.06初版】
第三章 web页面爬取
题目详情
判断题
urllib库包含了多个子package,用于处理http请求、响应、url编码、错误异常等,它们是( )。
A
urllib.requests[|]urllib.error[|]urllib.parse[|]urllib.robotparser
查看答案与解析
多选题
使用urllib库定制http请求参数中的user-agent的方法是( )。
多选题
使用Requests库爬取web页面时,最常用的方法是( )。
多选题
设计爬取Web页面的简单程序时,通常的步骤是( )。
判断题
下列选项中,( )是对Python中Requests的正确描述。
多选题
Python库Requests是一个可用于( )的工具库。
多选题
使用Requests发出请求后,为了确保能够正确获得响应,通常会使用一个函数进行验证,这个函数是( )。
多选题
使用urllib库发起http请求(post方法)时,下列用法正确的语句是( )。
多选题
下列代码中,使用了requests的Session对象,并调用prepare_request()为使prepped为赋值。有关Prepped这个对象的作用,下列描述最为符合的是( )。from requests import Request, Sessions = Session()req = Request('GET', url, data=data, headers=headers)prepped = s.prepare_request(req)# do something with prepped.bodyprepped.body = 'Seriously, send exactly these bytes.'# do something with prepped.headersprepped.headers['Keep-Dead'] = 'parrot'resp = s.send(prepped, stream=stream, verify=verify, proxies=proxies, cert=cert, timeout=timeout)print(resp.status_code)
多选题
python中有一个自带的http工具库,它是( )。
多选题
使用requests.post()方法发送http请求时,可以对参数( )进行赋值,向服务器传递表单参数。
多选题
使用urllib库发起http请求(get方法)时,下列用法正确的语句是( )。
多选题
使用urllib处理异常时通常要引入( )这个package。
多选题
下列代码是为了完成( )操作。payload = {'key1': 'value1', 'key2': 'value2'}r = requests.post("http://httpbin.org/post", data=payload)print(r.text)
多选题
使用requests.get()方法发送http请求时,可以对参数( )进行赋值,向服务器传递url参数。
多选题
使用requests爬取页面时,为了保存用户cookie可以使用下列哪个对象( )。
多选题
Requests库在实现Cookie管理时需要使用( )存放Cookie。
网络数据采集与Python爬虫【09.06初版】
章节列表
第一章 网络数据采集概述
18
第二章 网络爬取相关的Web技术
40
第三章 web页面爬取
17
第四章 web页面内容解析
19
第五章 自动跨越身份认证
10
第六章 RIA网站数据爬取
14
第七章 构建健壮的爬虫系统
18
第八章 构建高性能的爬虫系统
9
urllib库包含了多个子package,用于处理http请求、响应、url编码、错误异常等,它们是( )。 - 第三章 web页面爬取 - 网络数据采集与Python爬虫【09.06初版】 - 高校帮 | 大学网课搜题引擎