本书首先介绍了开发环境的配置,接着讨论了Web网站的构成和页面渲染、动态网页和静态网页对爬虫造成的影响,紧接着详细介绍了信息校验型反爬虫、动态渲染反爬虫、文本混淆反爬虫知识、特征识别反爬虫的原理、实现和绕过,然后概览了App数据爬取的关键和常用的反爬虫手段,最后介绍了常见的编码和加密原理、JavaScript代码混淆知识、前端禁止事件以及与爬虫相关的法律知识和风险点。
##(居然都没看到基本好书,还是在应用的时候看官方文档,博客这些吧,什么主题阅读,看两三本就应该回归现实,书那么多挑两三本就行了,别想着穷尽)这本书最基本的概念都没搞清楚就在东拼西凑了,什么是爬虫,什么是反爬虫,什么是反反爬虫。该写什么都搞不清楚,看了评论又是一本抄来抄去的书。不过,作为一本科普读物来说,还是讲了一些我不知道的东西的。最后还提到了法律法规,这一点还是与时俱进的。
评分##完全可以说是抄袭。比如,第二章nginx就是完全翻译的官方文档,一个字都不多不少。无语了
评分##东拼西凑
评分##这本书基本涵盖了市面上所有的反爬虫手段!能成功劝退一大批初学爬虫的同学,真是内涵又深刻啊!
评分##真的辣鸡,想起来他们以前发的课程吹的,找到书一看,质量也太差了
评分##基本上就是CSDN的例子堆到一起,垃圾
评分##因为自己写过 几个反爬虫的页面组件,研究过一段时间,真好奇拿来看看 看来评价很差啊😱… 幸亏不是花钱买的…
评分##怎么说呢 就是 什么阿猫阿狗都可以出书
评分##东拼西凑