跳到主内容

robots.txt 在线生成

对 39 只主流 AI 爬虫逐只设置放行或屏蔽,实时生成 robots.txt 内容。生成的文件需放置于网站根目录(如 https://你的域名/robots.txt)后生效。

快捷策略:
OpenAI
  • GPTBot模型训练
    ChatGPT(训练数据)
    放行
  • OAI-SearchBot搜索索引
    ChatGPT 联网搜索
    放行
  • ChatGPT-User实时抓取
    ChatGPT 实时浏览
    放行
  • ChatGPT Agent实时抓取
    ChatGPT Agent 模式
    放行
Anthropic
  • ClaudeBot模型训练
    Claude(训练数据)
    放行
  • Claude-User实时抓取
    Claude 实时浏览
    放行
  • Claude-SearchBot搜索索引
    Claude 联网搜索
    放行
Perplexity
  • PerplexityBot搜索索引
    Perplexity AI 搜索
    放行
  • Perplexity-User实时抓取
    Perplexity 实时浏览
    放行
字节跳动
  • Bytespider搜索索引
    豆包 / 抖音搜索 / 头条搜索
    放行
DeepSeek
  • DeepSeekBot模型训练
    DeepSeek(训练数据)
    放行
月之暗面
  • KimiBot模型训练
    Kimi(训练数据)
    放行
  • Kimi-SearchBot搜索索引
    Kimi 联网搜索
    放行
  • Kimi-User实时抓取
    Kimi 实时浏览
    放行
智谱
  • ChatGLM-Spider模型训练
    智谱清言 / ChatGLM(语料采集)
    放行
阿里
  • TongyiBot搜索索引
    通义千问 / 夸克 AI
    放行
华为
  • PanguBot模型训练
    盘古大模型(训练数据)
    放行
  • PetalBot搜索索引
    花瓣搜索 / 小艺助手
    放行
百度
  • Baiduspider搜索索引
    百度搜索 / 文心一言
    放行
  • YiyanBot搜索索引
    文心一言
    放行
微软
  • Bingbot搜索索引
    Bing / Copilot / ChatGPT 搜索
    放行
Google
  • Googlebot搜索索引
    Google 搜索 / AI Overviews / Gemini
    放行
  • Google-Extended训练控制
    Gemini(训练控制开关)
    放行
  • Google-CloudVertexBot模型训练
    Vertex AI(企业模型定制)
    放行
  • GoogleOther模型训练
    Google 内部研发用途
    放行
Meta
  • Meta-ExternalAgent模型训练
    Meta AI / Llama(训练数据)
    放行
  • Meta-ExternalFetcher实时抓取
    Meta AI 实时抓取
    放行
Apple
  • Applebot-Extended训练控制
    Apple Intelligence(训练控制开关)
    放行
Common Crawl
  • CCBot训练语料
    多家大模型训练语料库
    放行
Amazon
  • Amazonbot搜索索引
    Alexa AI
    放行
  • Amzn-User实时抓取
    Alexa / Rufus 实时问答
    放行
DuckDuckGo
  • DuckAssistBot搜索索引
    Duck.ai / DuckAssist
    放行
Cohere
  • Cohere Crawler模型训练
    Cohere 模型训练
    放行
TikTok
  • TikTokSpider搜索索引
    TikTok 搜索与 AI 功能
    放行
Mistral
  • MistralAI-User实时抓取
    Le Chat 实时浏览
    放行
Manus(蝴蝶效应)
  • Manus-User实时抓取
    Manus Agent 实时浏览
    放行
Exa
  • ExaBot搜索索引
    Exa AI 搜索 API
    放行
Tavily
  • TavilyBot搜索索引
    Tavily 搜索 API
    放行
Linkup
  • LinkupBot搜索索引
    Linkup 搜索 API
    放行

生成的 robots.txt

封禁 0 / 39
# robots.txt · AI 爬虫访问规则
# 由 QVSO 在线生成
# 策略:封禁 0 只 / 共 39 只 AI 爬虫

# 当前配置为放行全部 AI 爬虫( robots.txt 默认即放行,以下内容可留空 )

User-agent: *
Allow: /

使用方法:将内容保存为 robots.txt 并上传至网站根目录,使 https://你的域名/robots.txt 可访问即可生效;部署后可切到「校验已有文件」确认 39 只 AI 爬虫的实际放行/屏蔽状态。 robots.txt 为君子协定(声明层),服务器是否真的执行拦截,可用AI 爬虫模拟访问验证执行层。

工具简介

robots.txt 是站点根目录下的爬虫访问约定文件,AI 爬虫与搜索引擎爬虫均应先读取该文件再决定抓取范围。 本工具收录 39 只主流 AI 爬虫的 UA token,按运营方分组,可逐只切换放行或屏蔽;默认提供「全部放行」 「仅屏蔽训练类」「全部屏蔽」三种常用策略。需要说明:robots.txt 属于君子协定,主流 AI 厂商会遵守, 但无法约束不遵守协定的抓取行为;如需强制拦截,应在 CDN 或防火墙层面按 UA 或 IP 段处理。 生成的文件内容可直接复制或下载,支持附加 Sitemap 指令,覆盖站点根目录的同名文件后即时生效。 「校验已有文件」输入域名即可在线解析站点现有 robots.txt,按与完整检测报告一致的口径输出 39 只爬虫的 放行/屏蔽矩阵与命中规则。各项结果仅供分析参考。

相关工具