python爬虫实践——爬取豆瓣电影

小例子:转载自https://blog.csdn.net/MTbaby/article/details/79165890

#-*- coding:utf-8 -*-
import requests
from lxml import etree
import time

url1 = 'https://movie.douban.com/subject/26942674/'
data = requests.get(url1).text
s=etree.HTML(data)

film_name=s.xpath('//*[@id="content"]/h1/span[1]/text()')#电影名
director1=s.xpath('//*[@id="info"]/span[1]/span[2]/a/text()')#编剧

actor=s.xpath('//*[@id="info"]/span[3]/span[2]/a/text()')#主演
movie_time=s.xpath('//*[@id="info"]/span[13]/text()')#片长

ds = []
for d in director1:
    ds.append(d)

acs = []
for a in actor:
    acs.append(a)

print ('电影名:',film_name)
print ('导演:',ds)
print ('主演:',acs)
print ('片长:',movie_time)

返回:

电影名: ['神秘巨星 Secret Superstar']
导演: ['阿德瓦·香登']
主演: ['塞伊拉·沃西', '梅·维贾', '阿米尔·汗', '拉杰·阿晶', '提斯·沙马', '卡比尔·谢赫', '法如克·贾法尔', '马努杰·沙玛', '莫娜·安伯加卡尔', '尼基塔·阿南德', '尚', '莫纳利·塔库尔']
片长: ['150分钟']

猜你喜欢

转载自blog.csdn.net/muzhiqian/article/details/85126260