
qq:800819103
在线客服,实时响应
qq群
在线客服,实时响应
客服电话
13318873961代理IP如何帮助爬虫爬取猫眼电影影片?想要获取最近热映影片,当然是用爬虫来爬取。今天我们就来看下,爬虫是如何爬取猫眼电影热映影片信息的。首先我们先打开猫眼电影的热映榜单页面,右键检查分析页面,查找目标信息位置。
具体代码如下:
import requests
import re
url = 'http://maoyan.com/board'
headers = {'User-Agent': '具体agent信息'}
response = requests.get(url, headers=headers)
pattern = re.compile(r'
([\d\D]*?)
') # 只显示一个
dd_list = pattern.findall(response.text)
for dd in dd_list:
# 电影名字
title_pattern = re.compile(r'
name = title_pattern.findall(dd)
print(name[0].strip())
# 电影主演
people_pattern = re.compile(r'
([\d\D]*?)
')
people = people_pattern.findall(dd)
print(people[0].strip())
# 上映时间
time_pattern = re.compile(r'
([\d\D]*?)
')
time = time_pattern.findall(dd)
print(time[0])
# 评分
score_pattern1 = re.compile(r'([\d\D]*?)')
score_first = score_pattern1.findall(dd)[0]
score_pattern2 = re.compile(r'([\d\D]*?)')
score_last = score_pattern2.findall(dd)[0]
print(score_first + score_last)
通过上述代码,我们就可以获取到猫眼电影热映影片的电影名字、主演、上映时间和评分信息了。黑洞代理服务器爬虫代理,数据采集服务服务提供商,为您提供更快,更可靠的服务。
相关文章内容简介
1 代理IP如何帮助爬虫爬取猫眼电影影片?
代理IP如何帮助爬虫爬取猫眼电影影片?想要获取最近热映影片,当然是用爬虫来爬取。今天我们就来看下,爬虫是如何爬取猫眼电影热映影片信息的。首先我们先打开猫眼电影的热映榜单页面,右键检查分析页面,查找目标信息位置。 具体代码如下: import∵requests import∵re url∵=∵'http://maoyan.com/board' headers∵=∵{'User-Agent':... [阅读全文]
最新标签
推荐阅读
17
2019-04
有效时间长短不同的代理ip在实际应用中有何区别?
代理ip分短效和长效,都适合什么人使用?估计代理IP这个词,大家都不少听说吧,但是你知道代理IP的一些知识么?知道怎么用么?知道都有哪些人使用么?
18
2019-05
HTTP代理IP进行网络爬虫的关键因素
网络市场中提供HTTP代理IP商家数量众多,在挑选时建议选择隐匿度高的代理IP,例如黑洞代理,所有HTTP代理IP均为高匿名代理IP,安全性高,可以有效阻止对方追踪到用户真实IP地址。使用HTTP代
14
2019-01
盘点网络爬虫几种常见类型
网络爬虫根据系统结构和实现技术,大概可以分成以下几种类型:通用网络爬虫、聚焦网络爬虫、增量式网络爬虫、深层网络爬虫。 实际的网络爬虫系统通常是几种爬虫技术相结合实现的。
08
2019-05
检测ip代理有效性的一些方法
当大家在使用ip代理,一般都是采用付费的,由于免费的ip代理可用率很低,有效性也很低,并且在用前还要检测ip的有效性,所以ip代理有效性要怎么检测呢?接下来就和大家分享一些有关测试
热门文章