Sitemap.xml生成工具

免费在线生成sitemap.xml网站地图工具。输入网站根URL,自动抓取同源链接,生成符合sitemaps.org规范的XML站点地图。支持自定义页面更新频率(changefreq)、页面优先级(priority)等参数,一键复制或下载sitemap.xml。

生成Sitemap.xml
高级选项
Sitemap.xml 结果
就绪,请输入网站URL并点击生成
Sitemap.xml生成结果将显示在此处...

功能特性

自动抓取链接

从指定根URL出发,自动递归抓取网站内的同源页面链接,自动跳过图片、CSS、JS等静态资源文件。

标准XML格式

生成严格遵循sitemaps.org 0.9协议规范的XML,包含loc、lastmod、changefreq、priority四大核心节点。

自定义参数

可设置抓取深度(1-5层)、页面更新频率(always到never 7档)、优先级(0.1-1.0),满足不同SEO策略。

一键复制下载

生成结果支持一键复制到剪贴板,或直接下载为sitemap.xml文件,方便上传到网站根目录。

同源安全抓取

仅抓取与根URL同协议、同域名、同端口的页面链接,避免越权爬取外部网站,符合爬虫礼仪。

深度限制保护

默认抓取深度强制为1层,防止对大型网站发起过深爬取,兼顾效率与站点服务器友好。

使用说明

操作步骤

  • 在「网站根URL」输入框中填入您的网站首页地址,例如 https://www.example.com
  • 点击「高级选项」可展开更多配置:抓取深度、更新频率(changefreq)、页面优先级(priority)。
  • 点击「生成Sitemap」按钮,工具将自动抓取网站内的页面链接并生成XML。
  • 生成完成后,可点击「复制XML」一键复制到剪贴板,或点击「下载sitemap.xml」保存为本地文件。
  • 将下载的 sitemap.xml 文件上传到网站根目录(如 public_html/wwwroot/)。

参数说明

  • 抓取深度:从首页开始递归抓取的层级数。1=仅首页直接链接,2=再深入一层,依此类推。建议从1层开始,小网站可逐步增加。
  • changefreq(更新频率):告知搜索引擎该页面大概多久更新一次。新闻类站选daily/hourly,博客选weekly,公司介绍页选monthly/yearly。
  • priority(优先级):相对本网站其他页面的重要程度,0.1最低,1.0最高。首页通常设1.0,主要栏目0.8-0.9,详情页0.5-0.7。

提交到搜索引擎

  • Google:登录 Google Search Console → Sitemaps → 输入 sitemap.xml URL提交。
  • 百度:登录 百度资源平台 → 普通收录 → sitemap → 提交URL。
  • Bing:登录 Bing Webmaster Tools → Sitemaps → Submit sitemap。
  • 同时建议在 robots.txt 中添加一行 Sitemap: https://www.example.com/sitemap.xml,方便爬虫自动发现。

常见问题

Sitemap.xml是什么?为什么需要它?
Sitemap(站点地图)是一个XML文件,列出网站上所有重要页面的URL,帮助搜索引擎爬虫(如Googlebot、Bingbot)更智能、更高效地发现和抓取您的网站页面。特别对于页面较深新站未建立外链大量动态内容的网站,提交Sitemap能显著提升收录速度和覆盖率。
标准的sitemap.xml格式是怎样的?
一个标准的sitemap.xml以 <?xml version="1.0" encoding="utf-8"?> 开头,根节点为 <urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">,每个页面用一个 <url> 节点包含 <loc>(URL,必须)、<lastmod>(最后修改时间,ISO8601格式)、<changefreq>(更新频率)、<priority>(优先级0.0-1.0)四个子节点。单个sitemap文件最多5万个URL或50MB,超出需使用sitemap索引文件拆分。
抓取深度设置多少合适?会不会把网站爬挂?
建议从1层或2层开始,中小网站通常2层即可覆盖大部分页面。本工具默认深度1层,每层请求均为HTTP GET(与普通浏览器访问一致),且自动跳过图片/CSS/JS等静态资源。若您的网站有反爬或CDN限流(如Cloudflare),可能会被拦截,此时建议使用服务端Sitemap生成插件或手动维护。
生成的URL数量很少或为空怎么办?
可能原因:①目标网站启用了Cloudflare/反爬机制,返回验证码而非真实HTML;②页面大量使用JavaScript动态渲染(SPA),普通爬取无法解析DOM中的链接;③内链使用了非<a href="">的方式绑定。解决方案:尝试提升抓取深度;或使用支持无头浏览器的爬虫工具;对SPA站点可在SSR服务端渲染后抓取。
sitemap.xml提交后多久会被收录?
搜索引擎没有固定的收录时效。新站通常提交后数天到数周开始逐步收录,老站有一定权重的情况下可能几小时到1-2天就会发现抓取。收录速度还取决于页面内容质量、robots.txt是否允许、网站整体权重等因素。可以在Search Console的「索引覆盖率」报告中查看具体状态。
单页应用(SPA/Vue/React)能用本工具抓取吗?
本工具使用的是普通HTTP + HtmlAgilityPack解析,不执行JavaScript,因此对纯前端渲染的SPA页面,只能抓到初始HTML中的静态链接,无法解析路由跳转生成的内容。SPA站点建议:①开启SSR/SSG预渲染;②使用服务端生成sitemap的中间件(如sitemap-generator-cli + Puppeteer)。