手把手教你用 Python 爬虫煎蛋妹纸海量图片

智能座舱语音测试避坑指南:从唤醒率到方言识别,这些场景你测全了吗? 本文深入解析智能座舱语音测试的关键场景与避坑指南,涵盖唤醒率测试、方言识别、多音区交互等复杂场景。通过实战案例与自动化测试方案,帮助开发者全面提升语音系统的可靠性与用户体验,特别关注环境噪声干扰与方言覆盖策略。 阅读详情

我们的目标是用Python网络爬虫来干一件略污事情

最近听说煎蛋上有好多可爱的妹子,而且爬虫从妹子图抓起练手最好,毕竟动力大嘛。而且现在网络上的妹子很黄很暴力,一下接受太多容易营养不量,但是本着有人身体就比较好的套路,特意分享下用点简单的技术去获取资源。

以后如果有机会,再给大家说说日本爱情动(大)作(雾)片的种子搜索爬取,多多关注。

请先准备

作案工具

我们只准备最简单的

python 2.7.11

Google Chrome

安装的时候记得把pip带上,这样可以方便我们安装一些好用的包,来方便我们干坏事(学习)的过程。

需要用到的包

包括更佳符合人类的HTTP库–requests

用来解析html文件,快速提取我们需要的内容–beautifulsoup4

也可以用下面的命令快速安装

pip install requests

pip install beautifulsoup4

干正事

从一次正常需求说起

每天在互联网上冲来冲去,浏览着大量的信息,观看这各种鼻血喷发的图片,于是作为新时代青年的我们,怎么能忍受被这些大量的垃圾信息充斥的互联网,我们要反抗,我们要下载!

请,看,下,图

当你在网上冲浪的时候遇到这样的图片,我就问你:

虐不虐?虐死了!

下不下?下!

开始吧

获取图片的CSS选择器的规则

import requests
from bs4 import BeautifulSoup
res = requests.get('undefined)
html = BeautifulSoup(res.text) for index, each in enumerate(html.select('#comments img')):
    with open('{}.jpg'.format(index), 'wb') as jpg:
        jpg.write(requests.get(each.attrs['src'], stream=True).content)

首先,我们需要定位我们需要的图片


根据我们之前的准备的作案工具,使用chrome来访问网页undefined

然后打开开发者工具菜单 -> 更多工具 -> 开发者工具

看下图右边的神器

点击这个图标会出现块选择器,

鼠标移动我们感兴趣的部分

按照图片指示点击区域

右边神器中就会出现我们所需要的img标签

查看之前最后一个以#comments开头的标签,

它包含了所有img的子标签。


下面让我们来一些

神秘的事

打开cmd或者终端

输入python

输入以下神秘代码

现在偷偷看一下你的当前目录

是不是有很多(污)的图片

咳咳是这样的

名词解释

网络爬虫

网络爬虫(又被称为网页蜘蛛,网络机器人,在FOAF社区中间,更经常的称为网页追逐者),是一种按照一定的规则,自动地抓取万维网信息的程序或者脚本。另外一些不常使用的名字还有蚂蚁、自动索引、模拟程序或者蠕虫。


爬虫的使用对很多工作都是很有用的,但是对一般的社区,也需要付出代价。使用爬虫的代价包括:

网络资源:在很长一段时间,爬虫使用相当的带宽高度并行地工作。

服务器超载:尤其是对给定服务器的访问过高时。

质量糟糕的爬虫,可能导致服务器或者路由器瘫痪,或者会尝试下载自己无法处理的页面。

个人爬虫,如果过多的人使用,可能导致网络或者服务器阻塞。


适用场景

1 为您的应用系统等检测“机器人”数据流量 
2 为您的业务系统提供恶意IP、手机号码数据,为恶意注册、登录、交易、刷单、黄牛等场景提供数据支持 
3 为企业内部风控部门提供多纬度、分场景、更及时、全局联防的底层数据支撑 
4 对恶意爬虫(爬取企业核心数据等)多纬度数据支撑 
5 其他……




二十三、 爬取mzsock网站写真社区 本次爬取的网站是mzsock。具体网址:http://mzsock.com/。 阅读详情

相关推荐

【LangChain编程:从入门到实践】实现多模态代理

【LangChain编程:从入门到实践】实现多模态代理 关键词:LangChain, 多模态代理, 自然语言处理, 机器学习, 知识图谱, 对话系统, 代码生成, AI代理 1. 背景介绍 随着人工智

欢迎来到我的CSDN空间!这里聚焦AI大模型应用实战,分享前沿技术、实战案例与开发经验。 550

手把手教你用Python爬虫煎蛋妹纸海量图片

我们的目标是用爬虫来干一件略污事情 最近听说煎蛋上有好多可爱的妹子,而且爬虫从妹子图抓起练手最好,毕竟动力大嘛。而且现在网络上的妹子很黄很暴力,一下接受太多容易营养不量,但是本着有人身体就比较好的套路,特意分享下用点简单的技术去获取资源。 以后如果有机会,再给大家说说日本爱情动(大)作(雾)片的种子搜索爬取,多多关注。   请先准备 作案工具 我们只准备最简单的       ...

weixin_33885253的博客 525

54页PPT质量意识培训.ppt

【54页PPT】质量意识培训.ppt

Python爬虫入门学习例子之煎蛋网(福利哦)

初学Python爬虫,学习资料是这篇博客:Python爬虫入门教程 经过前边两个例子(糗事百科爬虫和百度贴吧爬虫)的学习,我自己写了一个练习的例子:爬煎蛋网的妹子图,福利哦(*^__^*)  #煎蛋网爬图 #导入了BeautifulSoup4(正则)和requests(代替urllib2,但是我不会使,还是用的lib2)包 #注意1:煎蛋的页数是倒着来的,从大往小来,输入的时候要注意 #注意2:

login_sonata的博客 4131

煎蛋网妹子图爬虫(requests库实现)

煎蛋网妹子图爬虫(requests库实现) 文章目录煎蛋网妹子图爬虫(requests库实现)一、前言环境配置二、完整代码 一、前言 说到煎蛋爬虫,相比很多人都写过,我这里试着用request库简单的完成,爬取煎蛋网的妹子图并保存到本地,直接上爬取效果。 环境配置 1、requests库 2、BeautifulSoup库 3、os库 二、完整代码 import requests from bs...

Paramete的博客 1180

Python Scrapy 爬取煎蛋网妹子图实例(一)

前面介绍了爬虫框架的一个实例,那个比较简单,这里在介绍一个实例 爬取 煎蛋网 妹子图,遗憾的是 上周煎蛋网还有妹子图了,但是这周妹子图变成了 随手拍, 不过没关系,我们爬图的目的是为了加强实战应用,管他什么图了先爬下来再说。 言归正传 这个实例,主要是讲将图片爬了下来,保存到本地,这个在上周已经实现了,这周有进一步做了讲图片信息保存到了数据库中。 代码结构 如上图...

weixin_30556161的博客 276

Scrapy框架爬取海量妹子图

版权声明:本文为博主原创文章,博客地址:https://blog.csdn.net/m0_37615390,未经博主允许不得转载。 阅读文本大概需要 5 分钟。 上次用两篇文章讲了 Scrapy 爬虫框架和储存数据工具 MongoDB,今天我们用这两个工具完成一个项目。 今天要完成的项目的是用 Scrapy 框架爬取煎蛋网妹子图片,这个项目之前用常规方法已经做过一次,为什么这次还...

Python知识圈 462

十大流氓软件

一、众矢之地——3721  3721的上网助手、地址栏搜索及网络实名可谓是老牌的流氓软件了,它存在的问题最多,也是网络上网友骂声最多的,理所当然地名列榜首。  经常在网上冲浪兴致正高时,电脑突然一阵慢如蜗牛,十有八九是因为要弹出3721的安装对话框。他经常不知不觉的潜入电脑,添加用户不需要的按钮、IE工具条、在地址菜单项中添加非法内容,还修改注册表设置开机自动启动。  此外,它经常

欢迎来到iCOLIN的Blog 17万+

这些年我用过的软件

文章目录1. uTools2. BCompare3. Wireshare4. Postman5. Sourcetree6. Another Redis Desktop Manager7. XMind8. 逍遥模拟器9. ScreenToGif 1. uTools 可以看成是集成多个轻量型软件,就如同微信小程序一样,使用方便。 官网下载:https://u.tools/ 2. BCompare 用于文本的比较 下载链接搜索「鹏哥儿的Echo」,回复 BCompare 获取 3. Wireshare 免费开源的

YopenLang的博客 8万+

51自学网,各种软件自学视频的地方

http://www.51zxw.net/study.asp?vip=10777676 [url=http://www.51zxw.net/study.asp?vip=10777676]51自学网-专业培训老师录制的视频教程,让学习变得很轻松[/url] 强烈向大家推荐一个好网站,[url=http://www.51zxw.net/study.asp?vip=1077767

xrqrenqiang的博客 8万+

小车手app安卓版下载_偶趣app交友约会 - 偶趣app下载最新版 - 安卓版

偶趣app安卓版是一款基于地理位置定位的社交软件,在这里,每个人都有兴趣参与到各种各样的社交活动中来,每个人都会有更多有趣的社交体验,平台上有很多活动,用户可以随时加入他们感兴趣的活动,他们也可以在这里找到很多单身的资源,从而成功的脱单,是一个非常可靠的交友平台,感兴趣的朋友快来下载看看吧。偶趣app特点1. 速配交友,根据用户兴趣标签,缘分速配对的TA,实时聊天交友,聊天约会交友不尴尬。2. 大...

weixin_39851048的博客 5731

[动态维护图连通性] LOJ#122. 【强制在线】动态图连通性

学一发黑科技 给边设一个权值,对每一种权值 iii 维护权值大于等于 iii 的边构成的最大生成树 TiTiT_i 加边 一个边刚被加入时的权值设为0,如果它连接两个联通块,就把它设为树边,否则设为非树边 删边 假设要删除边 (x,y)(x,y)(x,y),设它的权值为 www 如果它是一条非树边,直接删去,否则要找一条边替代它。 显然替代它的边的边权小于等于 www 设删掉这条边...

CE玩家 1万+

煎蛋网妹子图爬虫

自从开了自己的站点,就好久没来写过CSDN的博客了。维护自己那个站点的功夫确实也画的比较多,所以这里也就没怎么更新了。由于自己也是大四了,需要考雅思出国,能留给自己兴趣爱好的时间就更加的少了。现在雅思也考完了,学校的水课还没有开始考,处于这种大四退休生活中的我终于又有时间来写博客了。

陀罗地 3925

爬虫煎蛋网妹子图 大爬哦

今天为了测试一下urllib2模块中的headers部分,也就是模拟客户端登陆的那个东东,就对煎蛋网妹子图练了一下手,感觉还可以吧。分享一下! 代码如下 # coding:UTF-8 import urllib2,urllib,re,random def getHtml(url) : request = urll...

weixin_34001430的博客 446

[Python 爬虫]煎蛋网 OOXX 妹子图爬虫(1)——解密图片地址

之前在鱼C论坛的时候,看到很多人都在用 Python爬虫煎蛋网的妹子图,当时我也写过,爬了很多的妹子图片。后来煎蛋网把妹子图的网页改进了,对图片的地址进行了加密,所以论坛里面的人经常有人问怎么请求的页面没有链接。这篇文章就来说一下煎蛋网 OOXX 妹子图的链接获取方式。首先说明一下,之前煎蛋网之所以增加了反爬虫机制,应该就是因为有太多的人去爬他们的网站了。爬虫频繁的访问网站会给网站带来压力,...

husongbo的博客 3万+
上一篇: 对Python的深度学习库Theano的介绍
下一篇: Python基础教程之字符串
coco510
博客等级 码龄12年 15粉丝 30原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值