欧美一级特黄大片做受成人-亚洲成人一区二区电影-激情熟女一区二区三区-日韩专区欧美专区国产专区

python實現(xiàn)的爬取電影下載鏈接功能示例-創(chuàng)新互聯(lián)

本文實例講述了python實現(xiàn)的爬取電影下載鏈接功能。分享給大家供大家參考,具體如下:

創(chuàng)新互聯(lián)是一家網(wǎng)站制作、成都做網(wǎng)站,提供網(wǎng)頁設(shè)計,網(wǎng)站設(shè)計,網(wǎng)站制作,建網(wǎng)站,按需制作,網(wǎng)站開發(fā)公司,2013年至今是互聯(lián)行業(yè)建設(shè)者,服務(wù)者。以提升客戶品牌價值為核心業(yè)務(wù),全程參與項目的網(wǎng)站策劃設(shè)計制作,前端開發(fā),后臺程序制作以及后期項目運營并提出專業(yè)建議和思路。
#!/usr/bin/python
#coding=UTF-8
import sys
import urllib2
import os
import chardet
from bs4 import BeautifulSoup
reload(sys)
sys.setdefaultencoding("utf-8")
#從電影html頁面中獲取視頻下載地址
def get_movie_download_url(html):
  soup=BeautifulSoup(html,'html.parser')
  fixed_html=soup.prettify()
  td=soup.find('td',attrs={'style':'WORD-WRAP: break-word'})
  url_a=td.find('a')
  url_a=url_a.string
  return url_a
#從電影html頁面中獲取電影標題
def get_movie_title(html):
  soup=BeautifulSoup(html,'html.parser')
  fixed_html=soup.prettify()
  title=soup.find('h2')
  title=title.string
  return title
#訪問url,返回html頁面
def get_html(url):
  req=urllib2.Request(url)
  req.add_header('User-Agent','Mozilla/5.0')
  response=urllib2.urlopen(url)
  html=response.read()
  return html
#從電影列表頁,獲取電影的url,拼接好,存到列表后返回
def get_movie_list(url):
  m_list = []
  html = get_html(url)
  soup=BeautifulSoup(html,'html.parser')
  fixed_html=soup.prettify()
  a_urls=soup.find_all('a',attrs={'class':'ulink'})
  host = "http://www.ygdy8.net"
  for a_url in a_urls:
    m_url=a_url.get('href')
    m_list.append(host+m_url)
  return m_list
#存入txt文件
def file_edit(wr_str):
  f1 = open(r'e:\down_load_url.txt','a')
  f1.write(wr_str)
  f1.close()
#傳入電影url的列表集合,獲取下載地址,并寫入文件
def write_to_txt(a_urls):
  for a_url in a_urls:
    html=get_html(a_url)
    html=html.decode('GBK')
    write_title=get_movie_title(html)
    write_url=get_movie_download_url(html)
    file_edit(write_title+"\n")
    file_edit(write_url+"\n")
    file_edit("\n")
#傳入頁數(shù),返回這幾頁的url列表
def get_pages_url(num):
  urls_list = []
  url="http://www.ygdy8.net/html/gndy/dyzz/list_23_"
  for n in range(1,num+1):
    new_url = url+str(n)+".html"
    urls_list.append(new_url)
  return urls_list
if __name__=='__main__':
  pages = 2 #打算爬取幾頁電影
  p_url = get_pages_url(pages)
  for i in p_url:
    write_to_txt(get_movie_list(i))#執(zhí)行寫入
  print "done"

網(wǎng)站題目:python實現(xiàn)的爬取電影下載鏈接功能示例-創(chuàng)新互聯(lián)
鏈接分享:http://aaarwkj.com/article16/icjgg.html

成都網(wǎng)站建設(shè)公司_創(chuàng)新互聯(lián),為您提供企業(yè)建站、定制網(wǎng)站、網(wǎng)站建設(shè)、響應(yīng)式網(wǎng)站、軟件開發(fā)App設(shè)計

廣告

聲明:本網(wǎng)站發(fā)布的內(nèi)容(圖片、視頻和文字)以用戶投稿、用戶轉(zhuǎn)載內(nèi)容為主,如果涉及侵權(quán)請盡快告知,我們將會在第一時間刪除。文章觀點不代表本網(wǎng)站立場,如需處理請聯(lián)系客服。電話:028-86922220;郵箱:631063699@qq.com。內(nèi)容未經(jīng)允許不得轉(zhuǎn)載,或轉(zhuǎn)載時需注明來源: 創(chuàng)新互聯(lián)

綿陽服務(wù)器托管
亚洲欧美国产另类精品| 国产精品伦理一区二区三区| 国产亚洲精品福利视频| 成人爱爱视频免费观看| 日韩一区二区人妻在线| 欧美黄片在线播放视频| 国产精品天天影视久久| 亚洲精品av一区二区久久| 刘亦菲毛片一区二区三区| 久久亚洲欧美国产精品观看| 国产精品夫妇在线激情啪| 午夜久久精品国产亚洲av| 亚洲一区有码在线观看| 久久精品色妇熟妇丰满人妻| 成人性生交视频免费看| 日韩在线国产精品一区| 手机av在线 中文字幕| 蜜桃av网站免费观看| 色噜噜狠狠狠久久综合一区 | 最新手机免费黄色av网站| 日韩成人手机视频在线观看| 可以直接看内射的视频| 日本亚洲精品在线观看| 精品不卡一区二区三区| 国产片精品一区在线观看| 美女爽到高潮久久久| 一区二区三区人妻系列| 精品人妻一区两区三区| 亚洲男人av天堂东京热| 国产精品一级在线播放| 亚洲国产日韩欧美第一页| 啊啊舒服爽用力爱我视频| 日韩二区三区在线视频| 国产精品一区二区激情视频| 婷婷色中文字幕综合在线| 亚洲天堂人妻一区二区| 青青草原精品资源视频 | 国产精品久久久99| 国产成人精品久久一区二区三区| 日韩中文字幕视频一区| 91亚洲婷婷国产综合精品|