Python轻松爬取Rosimm写真网站全部图片

程序员文章站 2022-06-22 15:21:44

RosimmImage 爬取 "Rosimm写真" 网站图片有图有真相 "全部代码传送门：https://github.com/SiberiaDante/RosimmImage" 仅供学习参考使用 ......

RosimmImage

爬取网站图片

有图有真相

Python轻松爬取Rosimm写真网站全部图片

def main_start(url):
    """
    爬虫入口，主要爬取操作
    """
    try:
        r = requests.get(url+'.html', headers=HEADERS, timeout=10).text
        print(url+'.html')
        name_index = 0
        # 套图名，也作为文件夹名
        folder_name = BeautifulSoup(r, 'lxml').find(
            'h1',class_='article-title').find('a').text.encode('ISO-8859-1').decode('utf-8')
        with lock:
            if make_dir(folder_name):
                # 套图张数
                max_count = BeautifulSoup(r, 'lxml').find(
                    'div',class_='pagination2').find_all('li')[-2].find('a').get_text()
                print('-------max_count-----'+max_count)
                # 套图页面
                page_urls=[]
                for i in range(1,(int(max_count)+1)):
                    if i==1:
                        page_urls.append(url + '.html')
                    else:
                        page_urls.append(url + '_' + str(i)+'.html')

                # 图片地址
                for index, page_url in enumerate(page_urls):
                    print('-----page_url-----'+page_url)
                    result = requests.get(
                        page_url, headers=HEADERS, timeout=10).text
                    img_url=BeautifulSoup(result,'lxml').find('article',class_='article-content').find_all('img')
                    for s_img_url in img_url:
                        real_img='http://www.rosimm8.com'+s_img_url.get('src')
                        print('-----real_img-----'+real_img)
                        name_index=name_index+1
                        save_pic(real_img,name_index)
    except Exception as e:
        print(e)

仅供学习参考使用

上一篇：入门设计模式之装饰模式

下一篇： .NET 6开发TodoList应用引入第三方日志库

Python轻松爬取Rosimm写真网站全部图片

RosimmImage

爬取网站图片

有图有真相

Python爬虫实战之爬取美剧网站全部视频

Python爬虫爬取某网站动漫图片-附完整代码

荐用Python爬取COS网页全部图片

Python轻松爬取Rosimm写真网站全部图片

Python爬取mn52网站美女图片以及图片防盗链的解决方法

Python3爬虫之爬取网站图片

Python爬虫实战之爬取网站全部图片(一)

微博 Qzone 微信当你用Python爬取网站遇到反爬，你应该这样做，轻松解决反爬问题

python利用bs4爬取外国高清图片网站

python利用 request bs4 模块爬取imgur网站图片

Python轻松爬取Rosimm写真网站全部图片

RosimmImage

爬取网站图片

有图有真相

Python爬虫实战之爬取美剧网站全部视频

Python爬虫爬取某网站动漫图片-附完整代码

荐 用Python爬取COS网页全部图片

Python轻松爬取Rosimm写真网站全部图片

Python爬取mn52网站美女图片以及图片防盗链的解决方法

Python3爬虫之爬取网站图片

Python爬虫实战之爬取网站全部图片(一)

微博 Qzone 微信 当你用Python爬取网站遇到反爬，你应该这样做，轻松解决反爬问题

python利用bs4爬取外国高清图片网站

python利用 request bs4 模块爬取imgur网站图片

荐用Python爬取COS网页全部图片

微博 Qzone 微信当你用Python爬取网站遇到反爬，你应该这样做，轻松解决反爬问题