大学网课搜题引擎
首页
融优学堂
Python网络爬虫与信息提取
3 第一周 网络爬虫之规则
题目详情
简答题
Requests库中,以下代表从服务器返回HTTP协议内容部分猜测获得编码方式的属性是:
A、.encoding
B、.headers
C、.text
D、.apparent_encoding
查看答案与解析
简答题
以下哪个是不合法的HTTP URL? A、https://223.252.199.7/course/BIT-1001871002#/ B、https://dwz.cn/hMvN8 C、https://210.14.148.99/ D、news.sina.com.cn:80
简答题
如果一个网站的根目录下没有robots.txt文件,以下说法错误的是: A、网络爬虫应该以不对服务器造成性能骚扰的方式爬取内容。 B、网络爬虫的不当爬取行为仍然具有法律风险。 C、网络爬虫可以肆意爬取该网站内容。 D、网络爬虫可以不受限制的爬取该网站内容并进行商业使用。
简答题
在Requests库中,以下哪个函数是基础性函数?即,只需要一个函数即可完成全部功能。 A、post() B、request() C、get() D、delete()
简答题
Robots协议的全称是: A、网络爬虫排除标准 B、罗伯特协议 C、机器人协议 D、网络爬虫标准
简答题
以下说法错误的是: A、Robots协议是一种约定。 B、Robots协议可以作为法律判决的参考性“行业共识”。 C、Robots协议是互联网上的国际准则,必须严格遵守且受技术约束。 D、Robots协议告知网络爬虫哪些页面可以抓取,哪些不可以。
简答题
在Requests库中,体现推送数据操作的函数是: A、patch() B、get() C、delete() D、head()
简答题
在Requests库的get()方法中,timeout参数用来约定请求的超时时间,请问该参数的单位是什么? A、秒 B、毫秒 C、分钟 D、微秒
简答题
Requests库中,以下代表从服务器返回HTTP协议头所推荐编码方式的属性是: A、.text B、.headers C、.encoding D、.apparent_encoding
简答题
百度的关键词查询提交接口如下,其中,keyword代表查询关键词:https://www.baidu.com/s?wd=keyword请问,提交查询关键词该使用Requests库的哪个方法? A、.get() B、.patch() C、.patch() D、.patch()
简答题
获取网络上某个URL对应的图片或视频等二进制资源,应该采用Response类的哪个属性 A、.content B、.head C、.text D、.status_code
简答题
下面哪些功能网络爬虫做不到? A、爬取某个人电脑中的数据和文件 B、分析教务系统网络接口,用程序在网上抢最热门的课。 C、爬取网络公开的用户信息,并汇总出售。 D、持续关注某个人的微博或朋友圈,自动为新发布的内容点赞。
简答题
以下选项不是Python Requests库提供方法的是: A、.get() B、.push() C、.post() D、.head()
简答题
Requests库中,下面哪个最可能是由于URL格式错误造成异常? A、requests.URLRequired B、requests.HTTPError C、requests.TooManyRedirects D、requests.ConnectionTimeout
简答题
Requests库中的get()方法最常用,下面哪个说法正确? A、HTTP协议中GET方法应用最广泛,所以,get()方法最常用。 B、 get()方法是其它方法的基础,所以最常用。 C、 服务器因为安全原因对其他方法进行限制,所以,get()方法最常用。 D、 网络爬虫主要进行信息获取,所以,get()方法最常用。
简答题
Requests库中,检查Response对象返回是否成功的状态属性是: A、.raise_for_status B、.status_code C、.status D、.headers
简答题
下面哪个不是网络爬虫带来的负面问题? A、性能骚扰 B、法律风险 C、隐私泄露 D、商业利益
简答题
在Requests库中,通过设定headers中哪个键能够模拟不同浏览器? A、user-agent B、connection C、accept-encoding D、accept
简答题
在Requests库的get()方法中,能够定制向服务器提交HTTP请求头的参数是什么? A、data B、headers C、json D、cookies
简答题
Requests库中,下面哪个是由于DNS查询失败造成的获取URL异常? A、requests.ConnectionError B、requests.Timeout C、requests.HTTPError D、requests.URLRequired
Python网络爬虫与信息提取
章节列表
3 第一周 网络爬虫之规则
20
4 第二周 网络爬虫之提取
20
5 第三周 网络爬虫之实战
20
6 第四周 网络爬虫之框架
20