高中生
What?

- 金币
- 255
- 好评
- 9
- 信誉
- 100


|
本帖最后由 DDG667 于 2022-7-16 14:08 编辑
好久没发帖了。
不知道轮坛让不让发这种,如有违规,联系删除
废话不多说,开始
目标网站wmgirl.com我第一次写爬虫就是爬的它,应该对新手友好。
1,环境配置
要用的软件是很久很久以前我破解的pydroid3(懒得去蓝奏云了,自己翻我贴子吧 ),浏览器(都可以,我用via)和抓包工具(自己搞去,也就抓个header)
没错,态度就是这么好(应该不会挨打吧)
[有什么不懂的评论区见,也可以私聊]
要用到的模块有re(正则表达式模块,自带的不用下),requests(第三方模块,要下载)
首先
我这是下载过了才没报错
如果你是第一次安装,应该会
无法导入
那么就要用pip安装了,pydroid3自带有terminal
里面的包管理好像只有pip
输入
然后回车执行
挂代理会快一些,你也可以用清华源加速
- pip install requests -i https://pypi.tuna.tsinghua.edu.cn/simple some-package
复制代码
临时使用,推荐这种
如果报黄色错误,说pip版本过低,就把via"内容",""里的复制出来输入然后回车更新pip,再照上面的安装requests
内容应该是下面这个
- /data/user/0/ru.iiec.pydroid3/files/aarch64-linux-android/bin/python3.9 -m pip install --upgrade pip
复制代码
配置好环境就可以开始写代码了
这个网站好像没有反爬,但还是要教萌新写下header,不然以后遇到有的爬不到数据
抓包,抓header,其实这个设不设自己浏览器的都可以。
我用这个,9.9.9.9应该不是作者做的
找了半天就这个安卓12可以用,CA装不装都无所谓,我们就抓个header而已
目标应用via(你的浏览器)
先不开抓包,先点进网站。
随便找个分类,分类好爬
这里我选,我选什么呢?算了让Python帮我选。
它选第一个
小姐姐
爬虫先从简单的开始,所以随便选一个
然后查看源码
不是via的在链接前加入
一样可以看源码
在第140行左右我们找到了图片的url
学过HTML的都懂<img src="图片url"...
把<img...>复制下来备用
论坛貌似只能传12张图,12张后再按加号没反应了,算了,换第二篇。
|
本帖子中包含更多资源
您需要 登录 才可以下载或查看,没有账号?立即注册
x
|