Daily

2026-05-06

5篇笔记
2-Learning 4791 字
用积木拼一个最小职位爬虫

用积木拼一个最小职位爬虫 前三讲我们已经把"原理"和"积木"准备好了——知道爬虫是什么、浏览器和服务器怎么对话、四种采集通道分别在干什么、每个基础动作能产生什么效果。 这一讲要做一件非常重要的事:把这些零散积木第一次拼起来,做出一个真正能跑

2-Learning 39788 字
当 requests 不够用时——进入动态网页与浏览器自动化

当 requests 不够用时——进入动态网页与浏览器自动化 前面我们的爬虫跑得很顺,因为目标站点是"服务端渲染"——HTML 直接把数据吐给你。 但真实的招聘网站几乎没有这么友好。 猎聘、BOSS 直聘、前程无忧、鱼泡——用 reques

2-Learning 15498 字
练手

练手 开始真正动手——用最少的代码,搭一个能跑、能看到数据、能反复运行的职位爬虫。 用一个专门给爬虫练手的网站 quotes.toscrape.comhttps://quotes.toscrape.com它的"职位版"是 realpytho

2-Learning 1509 字
练手网站

练手网站 练手网站 网站 适合练什么 地址 Quotes to Scrape JS JS 渲染后的 DOM 抓取 Quotes JShttps://quotes.toscrape.com/js/ Quotes to Scrape JS De

2-Learning 13073 字
从能跑到能稳定跑很久——爬虫的工程化跃迁

从能跑到能稳定跑很久——爬虫的工程化跃迁 前几讲,已经能写出一个会发请求、会解析、会绕反爬的爬虫了。但它还只是个"脚本"——点一下运行,它跑完就结束。 而真实项目里的爬虫要做的事完全不一样: 24 小时不停跑,有时候要连续跑几个月 要抓几百