进阶Go

Anubis给 HTTP 请求称重, 阻止 AI 爬虫

Anubis 是一个用 Go 语言编写的开源 HTTP 请求过滤中间件,通过评估请求特征来识别并阻止 AI 爬虫,保护网站内容和服务器资源。它在 GitHub 上已获得 2 万 star,适合被爬虫问题困扰的站点运营者。

21.2K 星标
672 分叉
345 问题
71 浏览
Go
MIT
收录日期

项目概述

Anubis 是一个用 Go 语言编写的开源 HTTP 请求过滤中间件,通过评估请求特征来识别并阻止 AI 爬虫,保护网站内容和服务器资源。它在 GitHub 上已获得 2 万 star,适合被爬虫问题困扰的站点运营者。

过去两年,AI 爬虫成了网站运营者最头疼的问题之一。大模型厂商不断抓取网页内容用于训练,普通流量和恶意爬虫混在一起,难以辨别。Anubis 这个开源项目,用一种相当诗意的说法来应对——给每一个传入的 HTTP 请求“称灵魂”。

项目由 TecharoHQ 开发,用 Go 语言编写。仓库介绍只有一句话,但 star 数已经超过 2.1 万,可见这个问题有多普遍。

它到底解决什么问题

网站日志里会出现大量非人类流量,它们不像普通用户那样浏览页面,而是快速抓取文本、图片,甚至绕过 robots.txt。Anubis 的思路是:在请求到达真实服务器之前,先判断它“够不够像真人”。如果请求被判定为 AI 爬虫,就直接拦下来。

它的特点可以归纳为:

  • 开源免费,代码完整托管在 GitHub,任何人可以审查、修改。
  • Go 语言实现,部署产物是单一二进制,资源占用相对低。
  • 活跃维护,仓库有 871 次提交,还有 281 个 open issues 在讨论边界情况。

这类工具为什么值得关注

AI 爬虫问题不会消失,只会越来越普遍。对于内容创作者、独立站长来说,流量和带宽都是成本,被爬虫白白消耗很浪费。Anubis 提供了一种轻量的防御思路:把判断前置,而不是等攻击发生后再处理。

当然,官方公开的技术细节有限,比如具体用什么特征来识别 AI 爬虫,目前没有明确说明。想深入了解的话,只能直接读源码。

使用前需要知道的事

Anubis 不是安装即用的 SaaS,而是需要自己部署的服务。官方没有提供托管版本,所有配置都通过环境变量或命令行参数完成。这意味着你要有一定的服务器运维基础。但正因为是开源项目,社区里已经有不少二次开发和部署教程。

另外,它拦截的是“疑似 AI 爬虫”,这意味着误伤正常用户的可能性始终存在。部署前最好先小范围测试,观察对真实用户访问的影响,再逐步扩大范围。

如果你也被异常爬虫流量困扰,不妨把 Anubis 加入测试列表。先在小规模流量下跑一段时间,观察它对正常请求的影响,再决定要不要全面启用。

AI 爬虫反爬虫Go开源HTTP 请求过滤中间件爬虫防护AI 检测

项目评分

0.0 (0 评价)

分享

常见问题

Anubis: 给 HTTP 请求称重, 阻止 AI 爬虫 是什么?

Anubis 是一个用 Go 语言编写的开源 HTTP 请求过滤中间件,通过评估请求特征来识别并阻止 AI 爬虫,保护网站内容和服务器资源。它在 GitHub 上已获得 2 万 star,适合被爬虫问题困扰的站点运营者。

Anubis: 给 HTTP 请求称重, 阻止 AI 爬虫 用什么语言开发?

Anubis: 给 HTTP 请求称重, 阻止 AI 爬虫 主要使用 Go 开发。

Anubis: 给 HTTP 请求称重, 阻止 AI 爬虫 使用什么开源协议?

Anubis: 给 HTTP 请求称重, 阻止 AI 爬虫 基于 MIT 协议开源。

相关项目

暂无结果

探索更多

相似工具

Axóncaptcha

Axóncaptcha 是一种先进的机器人保护解决方案,通过分析用户真实行为(如打字方式)而非仅输入内容,实时识别并阻止机器人、垃圾邮件和滥用行为。该方案注重用户隐私,在验证过程中优先保护数据安全,并对自动化威胁做出即时响应。

Cytation AI

Cytation AI

Cytation AI 是一个社交信息流平台,将 Instagram、X、TikTok、YouTube 和新闻聚合到一处,并对每一条内容进行事实核查和 AI 扫描。深度伪造、AI 生成图像和虚假声明会被自动标记。背后有超过 13.5 万人信任的验证引擎。公开信息有限,详情以官网为准。

Verol

Verol

Verol 是一款 Chrome 扩展,为 ChatGPT、Claude 和 Gemini 添加独立验证层。它通过解析回答、执行实时网络查找,并经由后端管道验证来源,提供即时判决、置信度指标和可点击来源。无数据跟踪,历史记录仅存本地。提供5次免费运行,付费计划从每月4.99美元起。

Unveri

Unveri

Unveri(应用内也叫 Authentis)是一款打字真实性追踪工具。你在它的编辑器里打字时,它会记录键入行为,统计手打与粘贴的字符数、速度、退格与删除,并生成仪表板与可打印报告,证明文字确为真人逐字键入。

ModelVerify.ai

ModelVerify.ai

ModelVerify.ai 用于在你信任或付费之前,核验某个 LLM 接口或网关是否真正调用其宣称的模型。你提供密钥、基础地址与模型 ID,它会将实际行为与官方指纹比对,识别被偷换的模型、漂移与延迟问题。

Fishy Email

Fishy Email

Fishy Email 是一款通过电子邮件本身工作的 AI 钓鱼检测工具。用户无需安装应用或扩展,只需将可疑邮件转发至 [email protected],约30秒即可获得完整的 AI 分析。分析结果包含颜色编码的裁决、对每个危险信号的通俗解释以及后续行动建议。每个邮箱地址可获得5次免费检查,无账户要求。

评论

评论

0
0/500 字符

暂无评论

成为第一个评论的人

开源项目

探索、学习和贡献开源AI项目,推动人工智能技术的发展

查看全部