![](/index/img/qc-side/indexLogo4.png)
qq:800819103
在线客服,实时响应![](/index/img/qc-side/indexLogo5.png)
qq群
在线客服,实时响应![](/index/img/qc-side/indexLogo6.png)
客服电话
13318873961代理IP如何帮助爬虫爬取猫眼电影影片?想要获取最近热映影片,当然是用爬虫来爬取。今天我们就来看下,爬虫是如何爬取猫眼电影热映影片信息的。首先我们先打开猫眼电影的热映榜单页面,右键检查分析页面,查找目标信息位置。
具体代码如下:
import requests
import re
url = 'http://maoyan.com/board'
headers = {'User-Agent': '具体agent信息'}
response = requests.get(url, headers=headers)
pattern = re.compile(r'
([\d\D]*?)
') # 只显示一个
dd_list = pattern.findall(response.text)
for dd in dd_list:
# 电影名字
title_pattern = re.compile(r'
name = title_pattern.findall(dd)
print(name[0].strip())
# 电影主演
people_pattern = re.compile(r'
([\d\D]*?)
')
people = people_pattern.findall(dd)
print(people[0].strip())
# 上映时间
time_pattern = re.compile(r'
([\d\D]*?)
')
time = time_pattern.findall(dd)
print(time[0])
# 评分
score_pattern1 = re.compile(r'([\d\D]*?)')
score_first = score_pattern1.findall(dd)[0]
score_pattern2 = re.compile(r'([\d\D]*?)')
score_last = score_pattern2.findall(dd)[0]
print(score_first + score_last)
通过上述代码,我们就可以获取到猫眼电影热映影片的电影名字、主演、上映时间和评分信息了。黑洞代理服务器爬虫代理,数据采集服务服务提供商,为您提供更快,更可靠的服务。
相关文章内容简介
1 代理IP如何帮助爬虫爬取猫眼电影影片?
代理IP如何帮助爬虫爬取猫眼电影影片?想要获取最近热映影片,当然是用爬虫来爬取。今天我们就来看下,爬虫是如何爬取猫眼电影热映影片信息的。首先我们先打开猫眼电影的热映榜单页面,右键检查分析页面,查找目标信息位置。 具体代码如下: import∵requests import∵re url∵=∵'http://maoyan.com/board' headers∵=∵{'User-Agent':... [阅读全文]
最新标签
推荐阅读
19
2019-01
干货分享!获取代理服务器地址的两种方法
要使用代理服务器,首先需要获取代理服务器详细地址,它应该是IP地址或URL,比如“ www.heidongdaili.com ”。假如代理服务器提供URL作为其地址,则有时候代表此代理服务器的IP地址不稳定,它可能
18
2019-01
浅谈云服务器五大主要用途
云服务器,兼顾独具特色的地理优势与云服务器特有的高性能优势。作为依托云计算技术开发的新兴的互联网基础设施建设,云服务器其实并不仅是用作托管网站,还有其他使用用途。那么云服
10
2019-05
ip代理浏览器功能越来越强大
现在看到很多网络技术在完善,而且出现了ip代理浏览器,而且功能方面也是越来越强大,可支持常用软件代理上网,为大家带来上网的便利,可以开展更多信息业务。代理黑洞代理IP,一款
07
2018-11
网页ip代理能隐藏自己的IP吗
大数据时代的到来,数据采集被应用到各方面,当你在访问网页时,浏览器至少会把20多项有关你个人的信息在您毫无觉察的情况下悄悄地送往服务器上。根据你的个人信息,给你推送产品...
热门文章