国产探花免费观看_亚洲丰满少妇自慰呻吟_97日韩有码在线_资源在线日韩欧美_一区二区精品毛片,辰东完美世界有声小说,欢乐颂第一季,yy玄幻小说排行榜完本

首頁 > 編程 > Python > 正文

python抓取網頁中鏈接的靜態圖片

2020-02-22 23:02:19
字體:
來源:轉載
供稿:網友

本文實例為大家分享了python抓取網頁中鏈接的靜態圖片的具體代碼,供大家參考,具體內容如下

# -*- coding:utf-8 -*-  #http://tieba.baidu.com/p/2460150866 #抓取圖片地址  from bs4 import BeautifulSoup import urllib.request from time import sleep  html_doc = "http://tieba.baidu.com/p/2460150866"  def get_image(url):  req = urllib.request.Request(url)  webpage = urllib.request.urlopen(req)   html = webpage.read()  soup = BeautifulSoup(html, 'html.parser')   #抓取圖片地址  #抓取img標簽且class為BDE_Image的所有內容  img_src=soup.findAll("img",{'class':'BDE_Image'})  i = 1  for img in img_src:   img_url = img.get('src') #抓取src  # print(img)   req = urllib.request.Request(img_url)   u = urllib.request.urlopen(req)   data = u.read()   with open("AutoCodePng20180119-"+str(i)+".jpg", 'wb') as f:    sleep(2)    f.write(data)    i += 1  def getImg(url):  html = urllib.request(url)  page = html.read()  soup = BeautifulSoup(page, "html.parser")  imglist = soup.find_all('img') #發現html中帶img標簽的數據,輸出格式為<img xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx,存入集合  lenth = len(imglist) #計算集合的個數  for i in range(lenth):   print imglist[i].attrs['src'] #抓取img中屬性為src的信息,例如<img src="123456" xxxxxxxxxxxxxxxx,則輸出為123456 

以上就是本文的全部內容,希望對大家的學習有所幫助,也希望大家多多支持武林站長站。

發表評論 共有條評論
用戶名: 密碼:
驗證碼: 匿名發表
主站蜘蛛池模板: 松溪县| 盱眙县| 焦作市| 乐清市| 靖江市| 永川市| 三门县| 彭阳县| 兴安县| 普洱| 宁国市| 伊川县| 蓝田县| 灵石县| 桐庐县| 城口县| 永福县| 林西县| 罗城| 泗阳县| 靖西县| 葫芦岛市| 枣强县| 华容县| 黔西| 万宁市| 邮箱| 宿州市| 老河口市| 华蓥市| 奇台县| 湟源县| 宽甸| 江川县| 洛阳市| 普陀区| 云林县| 大足县| 大足县| 醴陵市| 枣庄市|