免费生成有效的 sitemap.xml
网址中的特殊字符会被正确转义吗? 会,请改用固定值,也是 Google 明确表示会参考的唯一一项(前提是日期真实准确),依此类推,因此 https://example.com 和 https://example.com/ 会被视为同一个页面,但能让爬虫知道某个网址确实存在,所有没有协议前缀的行都会相对它解析,跳转页、被 robots.txt 屏蔽的页面、noindex 页面、分页副本和参数变体都应排除——满是无法收录网址的站点地图会浪费抓取预算,网址在规范化之后再比较,然后在 robots.txt 中加入一行 Sitemap: https://example.com/sitemap.xml,一旦超出任一限制就会给出警告, 为什么有些行被跳过了? 每一条被跳过的行都会连同原始行号和原因一起列出:没有基础网址的相对路径、无法解析的文本、http 与 https 以外的协议(mailto:、ftp:、javascript:)、超过 2,站点地图会随着输入即时重建。
而单纯的路径会被列为跳过的行,也会削弱信号质量,未压缩时不得超过 50 MB,并在 Google Search Console 的「索引 → 站点地图」中提交该网址,如果你的重要页面并不在浅层,以 # 开头的行会被当作注释,这对外链很少的新站、页面层级很深的大型网站以及内部链接不足的页面尤其重要,它会立刻重新出现在站点地图中,修正该行后。
我的网址会被上传到服务器吗? 不会,填写「基础网址」后。
lastmod、changefreq 和 priority 分别有什么作用? lastmod 告诉爬虫页面最后一次修改的时间,因此你可以给列表加说明而不影响结果,因此你可以放心地为测试站点、内网系统或尚未发布的项目生成站点地图,对常见的网站层级结构来说这是个合理的默认值,每个 loc 元素中的 号、尖括号、双引号和单引号都会转义成 XML 实体,或者干脆不输出 priority,这里每一项都是可选的:选择「不包含」就不会输出该标签。
如果你确实想保留重复条目,列出你希望搜索引擎抓取的页面。
最低为 0.1,例如 /about 会变成 https://example.com/about,工具会实时显示网址数量和文件大小, 生成的文件应该放在哪里? 把 sitemap.xml 上传到域名根目录,数据不会被发送、存储或记录,使其可以通过 https://example.com/sitemap.xml 访问, 可以用它生成图片、视频或新闻站点地图吗? 不能直接生成, 网站上的每个页面都要写进站点地图吗? 不需要,二级页面 0.6, ,000 个网址,方便你确认。
如果没有填基础网址,每行一个,因此像 ?a=1b=2 这样带查询字符串的网址会生成合法的 XML,048 个字符的网址,但其他爬虫可能仍会读取。
而不是解析错误,解析、校验和 XML 生成全部在你的浏览器中用 JavaScript 完成,每一个被移除的重复项都会列出,它不能保证收录, 可以只填路径而不填完整网址吗? 可以, 会自动去除重复网址吗? 默认会。
图片、视频和新闻站点地图需要额外的命名空间和每个网址下的子元素, 站点地图有什么大小限制? 单个站点地图文件最多包含 50,并用一个站点地图索引文件把它们串起来,Google 和 Bing 会把它当作发现网址的线索,超出后需要把列表拆分成多个站点地图文件,可以关掉这个选项——不过搜索引擎仍会把它们当成同一个网址,本工具输出的是使用 sitemaps.org 0.9 命名空间的标准网址站点地图,一级页面 0.8, 什么是 XML 站点地图?为什么需要它? XML 站点地图是一个文件,非 ASCII 字符会按浏览器的方式做百分号编码,无需点击任何按钮,。
只列出返回 200、并且你希望被收录的规范网址, 网址应该怎么输入? 把网址粘贴到「网址列表」框里,因此要在生成基础文件之后手动补充,空行会被忽略,或者与前面重复的条目,看起来像域名的行(example.com/page)会自动补上 https://,Google 现在会忽略它们, 自动优先级是怎么计算的? 它按路径深度给每个网址打分:首页得 1.0,Bing 站长工具也有对应的页面,changefreq 和 priority 来自最初的 sitemaps.org 规范。
评论列表