python抓取網頁中鏈接的靜態圖片

2020-02-22 23:02:19

字體：大中小

來源：轉載

供稿：網友

本文實例為大家分享了python抓取網頁中鏈接的靜態圖片的具體代碼，供大家參考，具體內容如下

# -*- coding:utf-8 -*-  #http://tieba.baidu.com/p/2460150866 #抓取圖片地址  from bs4 import BeautifulSoup import urllib.request from time import sleep  html_doc = "http://tieba.baidu.com/p/2460150866"  def get_image(url):  req = urllib.request.Request(url)  webpage = urllib.request.urlopen(req)   html = webpage.read()  soup = BeautifulSoup(html, 'html.parser')   #抓取圖片地址  #抓取img標簽且class為BDE_Image的所有內容  img_src=soup.findAll("img",{'class':'BDE_Image'})  i = 1  for img in img_src:   img_url = img.get('src') #抓取src  # print(img)   req = urllib.request.Request(img_url)   u = urllib.request.urlopen(req)   data = u.read()   with open("AutoCodePng20180119-"+str(i)+".jpg", 'wb') as f:    sleep(2)    f.write(data)    i += 1  def getImg(url):  html = urllib.request(url)  page = html.read()  soup = BeautifulSoup(page, "html.parser")  imglist = soup.find_all('img') #發現html中帶img標簽的數據，輸出格式為<img xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx，存入集合  lenth = len(imglist) #計算集合的個數  for i in range(lenth):   print imglist[i].attrs['src'] #抓取img中屬性為src的信息,例如<img src="123456" xxxxxxxxxxxxxxxx,則輸出為123456

以上就是本文的全部內容，希望對大家的學習有所幫助，也希望大家多多支持武林站長站。

上一篇：Python實現PS濾鏡特效Marble Filter玻璃條紋扭曲效果示例

下一篇：Python模塊搜索路徑代碼詳解