首页 /建站技术

推荐的WordPress网站Robots.txt设置

RCRay Chan·2024-06-22·约 7 分钟·建站技术

如题 第一部分:


User-agent:Disallow:/wp-admin/Disallow:/readme.htmlDisallow:/wp-login.phpDisallow:/wp-register.phpDisallow:/trackback/Allow:/wp-admin/admin-ajax.phpAllow:.jsAllow:.CSSDisallow:/wp-content/cache/Disallow:/feed/Disallow:/?s=Disallow:/search/Disallow:?ver= 解释: User-agent: - 这行后面应该有一个值,但这里是空的。通常,它指定了适用的搜索引擎爬虫。空值意味着以下规则适用于所有爬虫。 Disallow:/wp-admin/ - 禁止爬虫访问 /wp-admin/ 目录及其子目录。 Disallow:/readme.html - 禁止爬虫访问 readme.html 文件。 Disallow:/wp-login.php - 禁止爬虫访问 WordPress 登录页面。 Disallow:/wp-register.php - 禁止爬虫访问 WordPress 注册页面。 Disallow:/trackback/ - 禁止爬虫访问 trackback 功能相关页面。 Allow:/wp-admin/admin-ajax.php - 允许爬虫访问 admin-ajax.php 文件。 Allow:.js - 允许爬虫访问所有 JavaScript 文件。 Allow:.CSS - 允许爬虫访问所有 CSS 文件。 Disallow:/wp-content/cache/ - 禁止爬虫访问缓存目录。 Disallow:/feed/ - 禁止爬虫访问所有 feed 页面(GSC报告中的feed索引是啥)。 Disallow:/?s= - 禁止爬虫访问搜索结果页面。 Disallow:/search/ - 禁止爬虫访问搜索页面。 Disallow:?ver= - 禁止爬虫访问包含版本参数的 URL。 这些设置主要是为了保护网站的敏感区域,如管理后台、登录页面等,同时允许爬虫访问一些必要的资源文件(如 JS 和 CSS)。 第二部分:


User-agent: CCBotDisallow: / User-agent: ChatGPT-UserDisallow: / User-agent: GPTBotDisallow: / User-agent: Google-ExtendedDisallow: / User-agent: Applebot-Extended Disallow: /User-agent: anthropic-aiDisallow: / User-agent: ClaudeBot Disallow: /User-agent: OmgilibotDisallow: / User-agent: OmgiliDisallow: / User-agent: FacebookBotDisallow: / User-agent: DiffbotDisallow: / User-agent: BytespiderDisallow: / User-agent: ImagesiftBot Disallow: / User-agent: PerplexityBotDisallow: / User-agent: cohere-aiDisallow: / 解释: 这些屏蔽规则专门针对特定的AI爬虫或机器人: CCBot: 用于 Common Crawl 项目的爬虫。ChatGPT-User: 可能是 ChatGPT 用户的爬虫。GPTBot: OpenAI 的 GPT 模型爬虫。Google-Extended: Google 的扩展爬虫。Applebot-Extended: Apple 的扩展爬虫。anthropic-ai: Anthropic 公司的 AI 爬虫。ClaudeBot: 可能是 Anthropic 的 Claude AI 模型爬虫。Omgilibot 和 Omgili: Omgili 搜索引擎的爬虫。FacebookBot: Facebook 的爬虫。Diffbot: 用于网页内容提取的爬虫。Bytespider: 字节跳动(TikTok 母公司)的爬虫。ImagesiftBot: 图像搜索爬虫。PerplexityBot: Perplexity AI 的爬虫。cohere-ai: Cohere AI 公司的爬虫。 上面这些就是常见的AI内容生成工具, 它们会抓取我们网站的内容来做训练素材, 或者直接在内容生产的时候调用我们的数据或进行总结, 有时候不想被“偷”内容, 可以直接屏蔽它们的爬虫. 简单总结, That’s it. 做外链的两个方向

内容来源

🌊
@独立站与SEO艺术

微信公众号 · 成海

UP 主页 →

专注谷歌 SEO 实战的外贸独立站公众号,覆盖关键词研究、内容策略、外链建设、EEAT 全链路。

RC

站长

Ray Chan

外贸独立站操盘手

做过外贸谈单、建过站、跑过 SEO、也拍 YouTube。常年服务国内工厂出海,坑踩过,路跑通,货都在这铺子里。