HTML 站点地图是一个标准的网页,而非机器可读文件,它以结构化、可点击的格式列出网站的主要类别和页面,旨在方便用户和搜索引擎爬虫访问。与 XML 站点地图(其存在的唯一目的就是为搜索引擎提供完整的 URL 索引)不同,HTML 站点地图是一个任何用户都可以打开的页面,用于查看网站完整的类别树结构。对于产品目录而言,如果用户需要多次点击才能访问深层产品页面,HTML 站点地图则为用户和爬虫提供了一条直接路径,让他们能够快速找到通过常规浏览可能无法发现的内容。
为什么 HTML 网站地图对产品可发现性至关重要
拥有数百个类别和子类别的大型产品目录可能会将产品深埋在网站层级结构中,以至于购物者和搜索引擎爬虫都无法仅通过常规导航可靠地找到它们。HTML 站点地图就像一个扁平化的综合索引,将所有主要类别集中在一个位置,为爬虫提供指向其他类别的内部链接,否则爬虫可能只能通过主菜单找到这些类别。这直接提升了自然搜索排名,因为指向同一页面的内部链接越多,爬虫抓取的频率就越高,索引的可靠性也越高。与它带来的影响相比,添加站点地图的成本很低,尤其对于那些随着时间推移不断添加类别却从未更新主导航的零售商而言更是如此。
HTML站点地图的工作原理
HTML站点地图通常是一个单独的页面,通常从网站页脚链接,按类别和子类别进行分层组织,与网站的页面结构相对应,但不会取代网站结构。 导航结构如果它反映了用于组织产品信息流本身的相同分类体系,那么它就最有用,因为信息流中存在的类别 google_product_category 或者自定义类别字段,但它们并未在网站导航中显示,因此对于购物者和搜索引擎爬虫来说都是不可见的,直到 HTML 站点地图将其显示出来。一些零售商会根据驱动该页面的同一类别数据源动态生成此页面。 面包屑导航确保网站地图、面包屑导航和信息流分类都描述相同的层级结构,而不是随着时间的推移而演变成网站结构的三个不一致版本。
例如:
<item>
<g:id>SKU-33210</g:id>
<g:title>Ceramic Pour-Over Coffee Dripper</g:title>
<g:google_product_category>Home & Garden > Kitchen & Dining > Coffee & Tea</g:google_product_category>
<g:product_type>Kitchen > Coffee & Tea > Pour-Over Brewers</g:product_type>
</item>
<!-- Corresponding HTML sitemap entry structure -->
<li>
<a href="/zh-CN/collections/kitchen">Kitchen & Dining</a>
<ul>
<li><a href="/zh-CN/collections/coffee-tea">Coffee & Tea</a>
<ul><li><a href="/zh-CN/collections/pour-over-brewers">Pour-Over Brewers</a></li></ul>
</li>
</ul>
</li>
保持 product_type Feed 中的层级结构与 HTML 站点地图中列出的类别保持一致,确保爬虫无论沿着哪个路径访问,都能访问到同一类别树的一致且链接良好的版本。
相关概念
HTML站点地图的最佳效果是与网站的整体导航结构保持一致,而不是引入一套独立且相互冲突的分类体系。它们与面包屑导航相辅相成,为爬虫提供了一个扁平化的索引,指向面包屑导航逐层展示的同一层级结构。对于大型目录而言,站点地图和面包屑导航的结合显著提升了其自然搜索的可抓取性,否则仅靠层级深度可能会将整个类别隐藏起来。