别用无头浏览器摸小红书,一个WebDriver标记送你禁言7天

0 82926
小戈上周四晚上十点多给我发消息,说他的号被禁言了,点申诉弹出来一句"该账号涉嫌使用自动化工具",下面没有申诉按钮,只有一行字:禁言至7月30...

小戈上周四晚上十点多给我发消息,说他的号被禁言了,点申诉弹出来一句"该账号涉嫌使用自动化工具",下面没有申诉按钮,只有一行字:禁言至7月30日。

他整个人是懵的。他没买粉没刷赞没导私域,就是写了个 Python 脚本,用 Selenium 挂着无头 Chrome,每天凌晨把同行的爆款笔记标题、点赞数、评论数抓回来做竞品表。跑了快一个月,挺顺,突然就黑了。

这件事我得写出来,因为最近群里问"有没有好用的采集工具"的人越来越多了,大家都想偷懒抓数据。我直接说结论:别碰无头浏览器,平台现在一眼就能认出你。

别用无头浏览器摸小红书,一个WebDriver标记送你禁言7天

1 无头 Chrome 的破绽比你想的多

小戈一开始觉得自己藏得挺好。加了随机 UA、加了请求间隔、还用了代理 IP。但他不知道,无头浏览器从根上就漏了。

第一个是 UA 异常。正常用户浏览器访问小红书,UA 是完整的一套带渲染引擎标识的。无头 Chrome 默认的 UA 里经常缺这少那,或者带着 headless 字样,平台一看就知道不是人在点。

第二个更致命,navigator.webdriver 这个值是 true。真人浏览器这个值永远是 false,无头模式下它默认是 true。你改 UA 没用,这个值在底层,普通反爬都不用深算,扫一眼就中。小戈后来查了下自己抓包的数据,这个值确实一直挂着。

第三个是点击节奏。脚本 0.5 秒一次点击,匀速、无停顿、无鼠标移动轨迹。真人翻笔记是滑动、停顿、偶尔回拉。这套行为节拍在前面讲设备层风控那篇里说过,平台现在盯着的是"你怎么发"不是"你发什么"。

2 反爬不是看你内容,是看你的请求指纹

小戈问我:我没发任何违规笔记,凭什么禁言我?

答案很简单,平台管的是"你用什么方式访问"。无头浏览器发出的请求,从 TLS 指纹、字体列表、Canvas 渲染特征到 CPU 核心数,整套跟真实浏览器都不一样。这些加在一起叫设备指纹,前面写 302 万脚本号那篇里点过,现在识别维度已经下沉到设备层了。

而且爬虫请求还有个典型特征:高频、规律、目标集中。真人一天刷几十条笔记,分布在不同时段。脚本一晚上扫几百条同类型笔记,请求密度一眼假。平台不关心你抓的是啥,抓这个动作本身就是违规。

3 禁言 7 天起,而且没有申诉入口

小戈最难受的不是被禁,是找不到说理的地方。普通违规限流还能去申诉页写材料,自动化爬取这种,系统直接给个禁言截止日期,申诉按钮都不给你。

这跟前面说的导流类申诉不通过是一个逻辑:系统判定你是机器行为,不是内容违规,人工复核的口子对你关死了。反复触发的话,从禁言 7 天升级到永久封号,实名也可能进黑名单。小戈那个号算是运气好,第一次抓,只禁了 7 天。

4 想做竞品分析,正路其实有三条

小戈这一个月白干了,数据表没了不说,号还搭进去。我跟他聊完,给他指了几条不踩线的路。

第一条,小红书的创作中心后台本身就有数据看板,粉丝画像、笔记表现、行业指数都能看,虽然不如自己爬的细,但合规。

第二条,蒲公英的灵犀、千瓜、新红这类第三方平台,是拿了官方数据授权的,他们去爬不违规,你买他们的报告就行。这就跟前面讲获客软件那个 317% 的逻辑一样:有没有官方接口,是合规和裸奔的分界线。

第三条,手动 Sampling。同行前十篇爆款你真花半小时点一遍,记个 Excel,比脚本抓的更有用,因为你顺带能看评论区在吵什么。

5 任何无头浏览和自动化爬取都是高危

我把话放这儿:只要是 Headless Chrome、Playwright、Puppeteer 这类去摸小红书,风险等级就是高危,没有"小心点就没事"这回事。前面讲设备层风控那篇提到无头浏览器是 SSS 级实测 7 天永封,小戈这次只禁 7 天算轻的,可能跟他是第一次、爬的量不算太大有关。

你要是真想用技术提效,记住一个判断标准:工具是不是官方授权的。是,就放心用;不是,别用。这个标准在获客软件选型、企微防封、AI 托管那几篇里反复出现过,到爬取这块一样成立。

小戈这周老老实实手动翻了二十个同行号,跟我说反而看出不少之前脚本没抓到的东西,比如人家评论区怎么引导长评的。账号 7 月 30 号解封,他说解封后第一件事是把那个 Python 脚本删了。你们要是也在用类似东西,赶紧停,别等禁言通知弹出来才后悔。评论区报你用的什么采集方式,我帮你看踩没踩这条红线。

最后修改时间:
靠谱引流库
上一篇 2026年07月27日 09:34
下一篇 2026年07月27日 09:38

评论已关闭