网站地址后面多出一串问号、等号和字母,不一定是网址出了问题。筛选产品、翻页、记录广告来源,都可能用到URL参数。真正要检查的是:这些参数有没有产生大量重复页面,或者让重要内容被错误处理。

URL、SEO标题和页面主标题的一致性
久歌网络原创示意图

先看懂一个参数网址

https://example.com/products/?material=steel&page=2

问号前是路径,问号后是查询字符串。其中 material=steel 和 page=2 是两个参数,用 & 连接。前者可以表示筛选材质,后者可以表示第二页;实际作用由网站程序决定。

参数并不意味着页面一定通过局部刷新加载,也不意味着搜索引擎不能收录。判断时要打开页面,看内容如何变化。

先按用途分类,别一刀切删除

常见参数 用途 检查重点
utm_source 等 记录访问来源 内容是否与原页面相同,统计是否仍需要保留
sort 改变排列顺序 是否生成大量近似版本
material、size 等 筛选产品 是否对应独立而有价值的搜索需求
page 翻页 不同页是否展示不同产品,链接能否正常访问
lang、region 语言或地区选择 各版本是否有稳定可访问的网址

例如,只有广告来源不同的两个网址,可能展示完全相同的页面;第二页产品列表却通常与第一页不同。这两种情况不能采用同一个处理方案。

参数会带来哪些SEO问题

问题通常出在数量和一致性。筛选条件可以无限组合,导致同一批产品出现很多近似页面;内部链接又混用不同版本,让抓取与统计都更难整理。

对小型网站,不必一看到参数就担心“抓取预算耗尽”。先用抓取记录、索引报告和页面样本确认问题是否真实存在。没有证据时,优先保证客户能正常筛选和浏览。

canonical适合处理真正重复或高度相近的版本

rel="canonical" 用于表达你希望采用的规范网址。它是规范化信号,搜索引擎会综合其他信号判断,不是强制命令。

对于内容相同的来源追踪版本,可以统一指向对应的主要页面。但不要把所有参数页都指向首页,也不要把内容不同的分页、语言页或有独立需求的筛选页全部指向同一页。

配置后还要检查导航、Sitemap和其他规范化设置是否一致,避免一处指向A、一处又推荐B。

robots.txt和noindex解决的是不同问题

robots.txt 主要控制抓取。被禁止抓取的网址,仍可能因其他来源的链接被搜索引擎知道;它不是确保网址从结果中消失的方法。

noindex 用于表达不希望页面被收录,但搜索引擎需要能够抓取页面,才有机会看到这条指令。如果先用 robots.txt 拦住页面,再期待其中的 noindex 生效,就可能达不到目的。

对于几乎无限、没有搜索价值的筛选组合,可以评估抓取限制,但应先列出规则影响范围并抽样验证。别用一条笼统规则误伤分页、图片或重要产品入口。

内部链接和统计参数,也要分开管理

站内导航和正文链接通常应指向稳定、正确的主要网址。广告或外部推广需要来源参数时,按统一命名规则管理,不要随意更改导致历史数据无法对比。

审核网站时,也不应该默认排除所有参数页。先检查典型样本,再根据用途调整抓取范围,否则可能恰好漏掉最需要修复的筛选和分页问题。

已经上线的网址,不要为了整齐随便改

URL参数优化的目标,是减少无意义的重复、让有价值的页面容易访问。不是把问号全部删掉,也不是看到英文不顺就重写已有地址。

需要改动时,先确认链接、统计、规范网址和跳转的影响,再安排上线与复查。可以结合网站技术检查整理参数清单,把每一种情况的处理理由写清楚,后续维护才不会反复出错。

Harry Wong
Harry是多年B2B外贸营销领域从业者,在Alibaba国际等公司有多年的外贸营销推广工作经验