只收录规范且可索引的 URL
不要把重定向、错误页、重复参数页或明确禁止索引的 URL 混入 Sitemap,避免发出矛盾信号。
站长技术 SEO 与 AI 可发现性指南
了解 robots.txt、sitemap.xml、llms.txt 如何协同工作。
输入域名时默认检测根目录 /sitemap.xml;输入完整文件地址时将检测该地址。
Sitemap 是用于声明站点重要 URL 的 XML 文件,也可以是指向多个分片地图的 Sitemap 索引。它能帮助搜索引擎发现新页面、更新页面和复杂站点结构,但提交 Sitemap 不代表页面一定被收录。
健康的 Sitemap 应能稳定访问、符合 XML 结构、提供正确 Content-Type,并通过 robots.txt 或搜索平台主动暴露。检测器将可访问性、结构、编码、URL 记录、声明方式和响应性能合并为可解释的健康分。
不要把重定向、错误页、重复参数页或明确禁止索引的 URL 混入 Sitemap,避免发出矛盾信号。
按内容类型、语言或更新时间拆分 Sitemap,再以 sitemapindex 统一组织,便于更新和故障定位。
在 robots.txt 中声明 Sitemap,并在搜索平台提交以观察抓取时间与处理错误。
只有页面内容发生实质更新时才维护 lastmod,避免给抓取调度提供低质量信号。
不会。Sitemap 是帮助发现 URL 的提示,抓取、索引和排名仍由搜索引擎根据页面情况决定。
常见入口是站点根目录的 /sitemap.xml,也可以使用其他公开地址,并从 robots.txt 或搜索平台声明该地址。
当站点存在多个 Sitemap 分片、不同语言或大量 URL 时,索引文件能集中列出各个 Sitemap。
robots.txt 声明是通用且易发现的公开入口;缺少它并不使 Sitemap 无效,但会损失一条可靠发现渠道。