频道栏目
首页 > 程序开发 > Web开发 > Python > 正文
python网络爬虫抓取图片
2013-08-14 13:50:37           
收藏   我要投稿

利用python抓取网络图片的步骤:

1.根据给定的网址获取网页源代码

2.利用正则表达式把源代码中的图片地址过滤出来

3.根据过滤出来的图片地址下载网络图片

 

import re
import urllib

def getHtml(url):
    page = urllib.urlopen(url)
    html = page.read()
    return html

def getImg(html):
    reg = r'src="(.+?\.jpg)" pic_ext'
    imgre = re.compile(reg)
    imglist = imgre.findall(html)
    x = 0
    for imgurl in imglist:
        urllib.urlretrieve(imgurl,'%s.jpg' % x)
        x = x + 1        
   
html = getHtml("https://tieba.baidu.com/p/2460150866")
getImg(html)

 

点击复制链接 与好友分享!回本站首页
相关TAG标签 爬虫 图片 网络
上一篇:python 自动抓取代理ip
下一篇:飘逸的python - 鲜为人知的参数
相关文章
图文推荐
文章
推荐
点击排行

关于我们 | 联系我们 | 广告服务 | 投资合作 | 版权申明 | 在线帮助 | 网站地图 | 作品发布 | Vip技术培训 | 举报中心

版权所有: 红黑联盟--致力于做实用的IT技术学习网站