python获取网站图片

程序员文章站 2024-01-17 18:24:40

...

# zhouxianglh 2013.05.03 python3.3
import urllib.request
from html.parser import HTMLParser
import re
import os
import shutil
import time
url = "http://www.douban.com/"
filePath = "D:\\temp"
# 读也HTML
urlContent = urllib.request.urlopen(url);
data = str(urlContent.read())
# 初始化文件目录
if  os.path.isdir(filePath):
#     os.removedirs(filePath)
    shutil.rmtree(filePath)
elif os.path.isfile(filePath):
    os.remove(filePath)
os.makedirs(filePath)
# 生成唯一文件名
intFlag = 0
def getTimeStr():
    global intFlag
    intFlag = intFlag + 1
    return time.strftime("%H%M%S") + str(intFlag)
# 解析HTML
# HTMLParser方式解析,这里HTMLParser类似于抽象类
class MyHtmlParser(HTMLParser):
    def handle_starttag(self, tag, attrs):
        '获取 img标签'
        if tag == "img" :
            for imageUrl in attrs:
                '获取src属性'
                if imageUrl[0] == 'src':
                    imageUrl = imageUrl[1]
                    imageUrl = re.sub("[\\\\']", "", imageUrl)
                    iamgeUrlArr = imageUrl.split("/")
                    imgFilePath = iamgeUrlArr[len(iamgeUrlArr) - 1]
                    try:
                        imgData = urllib.request.urlopen(imageUrl).read()
                        imgFilePath = filePath + os.sep + imgFilePath + getTimeStr() + ".jpg"
                        imageFile = open(imgFilePath, "wb")
                        imageFile.write(imgData)
                        imageFile.close()
                        print("下载文件", imageUrl, "成功,另存路径:" + imgFilePath)
                    except  :
                        print("****下载文件 ", imageUrl, " 出错:")
parser = MyHtmlParser()
# 解析HTML
parser.feed(data)
print("获取图片操作完成")

相关标签： python python获取网站图片

上一篇：大家都用的是什么编译环境？该如何解决

python获取网站图片

获取笑话集网站笑话数据的后台代码，获取笑话后台代码_PHP教程

php获取某个网站了内容而且保存为TXT 下次直接从txt读取

php 该如何获取从百度搜索进入网站的关键词

如何利用.htaccess防盗链网站图片_PHP教程

php获取远程图片并下载保存到本地

Python从单元素字典中获取key和value的实例

python opencv实现切变换不裁减图片

PHP获取网站源目录有几种方法

iOS拍照后使用该图片（获取照片的ALasset传到相册）

用js获取点击图片的值!_javascript技巧

python获取网站图片

获取笑话集网站笑话数据的后台代码，获取笑话后台代码_PHP教程

php获取某个网站了内容 而且保存为TXT 下次直接从txt读取

php 该如何获取从百度搜索进入网站的关键词

如何利用.htaccess防盗链网站图片_PHP教程

php获取远程图片并下载保存到本地

Python从单元素字典中获取key和value的实例

python opencv实现切变换 不裁减图片

PHP获取网站源目录有几种方法

iOS拍照后使用该图片（获取照片的ALasset传到相册）

用js获取点击图片的值!_javascript技巧

php获取某个网站了内容而且保存为TXT 下次直接从txt读取

python opencv实现切变换不裁减图片