分享web开发知识

注册/登录|最近发布|今日推荐

主页 IT知识网页技术软件开发前端开发代码编程运营维护技术分享教程案例
当前位置:首页 > 软件开发

web crawling(plus6) pic mining

发布时间:2023-09-06 01:15责任编辑:傅花花关键词:暂无标签
#Author:Mini
#!/usr/bin/env python
import urllib.request
import re
import urllib.error
headers=("User-Agent","Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:56.0) Gecko/20100101 Firefox/56.0")
opener=urllib.request.build_opener()
opener.addheaders=[headers]
urllib.request.install_opener(opener)
keyword="连衣裙"
key=urllib.request.quote(keyword)
for i in range(1,101):
??try:
??????url="https://s.taobao.com/search?q="+key+"&imgfile=&js=1&stats_click=search_radio_all%3A1&initiative_id=staobaoz_20171003&ie=utf8&bcoffset=4&ntoffset=4&p4ppushleft=1%2C48&s="+str(i*44)
??????data=urllib.request.urlopen(url).read().decode("utf-8","ignore")
??????pat1=‘"pic_url":"//(.*?)"‘
??????pic=re.compile(pat1).findall(data)
??????print("success!")
??????print(pic)
??????for j in range(0,len(pic)):
??????????thispic=pic[j]
??????????thispicurl="http://"+thispic
??????????picf="E:/m/"+str(i)+"."+str(j)+".jpg"
??????????urllib.request.urlretrieve(thispicurl,filename=picf)
??except urllib.error.URLError as e:
??????if hasattr(e, "code"):
??????????print(e.code)
??????if hasattr(e, "reason"):
??????????print(e.reason)

web crawling(plus6) pic mining

原文地址:http://www.cnblogs.com/rabbittail/p/7623819.html

知识推荐

我的编程学习网——分享web前端后端开发技术知识。 垃圾信息处理邮箱 tousu563@163.com 网站地图
icp备案号 闽ICP备2023006418号-8 不良信息举报平台 互联网安全管理备案 Copyright 2023 www.wodecom.cn All Rights Reserved