06. URL、信息架构、内链与多语言 · 资料陈述 · 教学步骤 5

让列表真正可抓取

大型集合只靠客户端无限滚动,用户和爬虫都难稳定发现深页。

原知识点:发现页应提供可抓取分页、面包屑、相关页和快速跳页,避免只靠客户端无限滚动。

执行步骤

  1. 确定集合总量、每页数量和排序稳定规则;小集合不必为了SEO强加分页。
  2. 为每页生成独立URL和服务端可见内容,并用<a href>顺序连接下一页,必要时提供页码/跳转。
  3. 让每个分页页自指canonical;不要把第2页以后全部canonical到第1页。
  4. 关闭JavaScript后从第1页逐页到达深页,并检查按钮增强不会成为唯一发现方式。
  5. 测试第1页、末页、超出末页、非法参数、排序/筛选变体的内容、状态码和索引规则。

可复制工作表

集合:__;总项__;每页__;总页__
稳定排序:__
第1页URL:__
第2页URL:__
下一页HTML链接:__
各页canonical规则:__
无JS深页路径测试:__
末页下一页处理:__
越界页状态:__
非法参数状态:__
排序/筛选索引规则:__
页面项重复/遗漏检查:__

完整示例

【完整示例】120个工具按稳定名称排序,每页20个,形成?page=1至?page=6;每页自指canonical并用<a href="?page=3">下一页</a>连接。关闭JS仍可到第6页;?page=7返回404;加载更多只是体验增强。每页20个只是本集合选择,不是通用SEO阈值。

完成清单

  • 每个分页页有独立URL、服务端内容和可抓取的顺序链接。
  • 分页页自指canonical,未全部指向第一页。
  • 关闭JavaScript仍可从第一页到达末页内容。
  • 末页、越界、非法参数和筛选变体均返回预定状态与索引信号。

当前官方依据

平台规则会变化,行动前以打开后的当前官方页面为准。

适用条件

内容集合规模较大。

来源:StickerBaker SEO评测