
Googlebot如何读取您的网站:您可能从未考虑过的3件事
您的产品页面已经三周未被索引——而且不是内容问题
一位销售液压配件的朋友去年推出了一批新产品页面。
三周后,Google Search Console (GSC) 仍然显示“已发现——当前未索引”。他认为内容是问题所在,于是重写了每个页面描述。又过了两周,毫无变化。
我在GSC的URL检查工具中查看了渲染截图。页面结构存在,但包含产品规格、材料详情和技术参数的部分完全是空白的。
我们找到了原因:他用Elementor构建了页面,并将产品规格部分设置为仅在访客滚动到该位置时出现。当Googlebot渲染页面时,它没有模拟用户滚动,因此该块从未被触发。每次Google看到页面时,看到的都是空白区域,判断页面没有实质性内容,于是拒绝将其索引。
他重写了两次内容。内容从来都不是问题所在。
这就是“被爬取”和“被理解”之间的差距:Googlebot可能访问了你的页面,但这并不代表它看到了你希望它看到的内容。
爬取和渲染是两回事
大多数人认为Googlebot访问网站的方式和你用浏览器打开一样:它到达,页面加载,看到一切,然后就这样了。
实际过程是这样的:
- 步骤1:发现URL
- 步骤2:爬取(下载HTML)——Googlebot在此处离开
- 步骤3:渲染(执行JavaScript)——这一步通常在几分钟到几小时内完成
- 步骤4:索引(存入数据库以便参与排名)
Google的JavaScript SEO文档明确指出:爬取和渲染是两个完全独立的过程,各自有独立的处理队列。
在步骤2中,Googlebot下载你的HTML文件后离开。此时,它还没有看到任何需要运行JavaScript才能出现的内容——它只有原始的HTML外壳。
在步骤3中,HTML被放入渲染队列,Google的网络渲染服务(WRS)——一个基于Headless Chrome的系统——执行JavaScript并重构动态内容。目前这个等待时间通常以分钟到小时计。
关键不在于等待时间的长短。关键在于在渲染过程中内容是否真正可见。
有一种Googlebot确实无法看到的内容:仅在点击按钮后加载的内容,例如“加载更多”或只有在展开某部分时才从服务器获取的内容。Googlebot不会模拟点击,因此这些内容永远不会出现在其渲染结果中。
Elementor等类似页面构建器使用的“滚动出现”动画则稍微复杂一些。如果动画仅控制内容的出现方式——例如淡入或向上滑动——并且内容已在HTML中,Googlebot通常可以看到它。
但如果动画也触发了服务器请求数据,就可能出现问题。大多数Elementor滚动动画属于第一类。让我的朋友液压配件页面空白的原因,很可能是某个插件配置阻止了关键JavaScript文件的加载路径。GSC渲染截图中出现空白区域是最直接的证据。
哪个Googlebot正在访问你的网站?
这里有一个很多人不知道的事实。
Googlebot并非单一的爬虫。谷歌有桌面版Googlebot、移动版Googlebot(智能手机)、图片爬虫、视频爬虫以及其他类型的爬虫。
那么现在主要访问你网站的是哪个?移动版Googlebot。
自2023年起,谷歌已完成对所有网站的移动优先索引迁移。谷歌移动版Googlebot看到的内容几乎在所有情况下都被用于索引和排名。
这意味着什么?
对于排名,谷歌看的不是精心设计的桌面版产品页面,而是移动版。如果你的移动端和桌面端内容不同,谷歌索引只包含移动端看到的部分。
移动端内容更少意味着排名潜力更低
这是移动优先索引中最常见的陷阱。
谷歌的要求很明确:移动页面的内容必须与桌面页面匹配(内容对等)。从移动端移除的内容对排名毫无贡献。
安全的情况:
- 移动端将规格详情放在可折叠部分,但内容存在于初始HTML中——谷歌可以正常索引。
- 响应式设计以不同布局呈现内容——使用相同的HTML,CSS控制不同屏幕的显示。
存在SEO风险的情况:
- 为了保持移动页面“简洁”,你删除了桌面页面上出现的产品描述或规格。
- 移动端内容仅在有人点击JavaScript驱动的“加载更多”按钮后才出现。
- 你运行独立的m-dot网站,但其内容比主站单薄得多。
那些被移除的内容不在谷歌索引中,无论桌面版多么详细。
这里有一个值得思考的问题:“移动优先”是否意味着牺牲桌面体验?
不,这两个目标并不冲突——但你需要理解每种体验服务于谁:
对于B2B出口买家,移动端接触可能帮助他们发现你。但当他们在电脑上打开你的网站比较规格、查看PDF并提交询盘表单时,转化才会发生。两种情况都很重要;只是发生在不同设备上。
Google推荐响应式设计,正是因为它能同时服务两个目标:相同的HTML,通过CSS控制不同屏幕上的布局。Googlebot获取完整内容,移动用户获得适配布局,桌面买家获得专业的宽屏展示——三者互不妥协。
真正的危险不在于偏好某一种设备,而在于落入两个陷阱:削弱移动端内容(损害排名)和忽视桌面端体验(损害转化率)。响应式设计可以同时避免这两种风险。
抓取预算:中小型外贸网站需要担心吗?
谷歌自己的表述是:
“抓取预算并不是大多数发布商需要担心的事情。”
页面数量不超过几千的网站通常不需要主动管理抓取预算。
这是事实——但有一个例外。
低价值URL的积累。
WordPress会自动生成许多你甚至没有意识到的URL:
- 标签归档页面:/tag/stainless-steel/
- 分页类别页面:/category/products/page/2/
- 搜索结果:/?s=wire+mesh
- 带参数的筛选URL:/products/?color=silver&size=large
这些页面本身没有搜索价值,但Googlebot每次访问时仍然会考虑它们。因此,你真正重要的产品页面可能会在抓取队列中被延后,新页面可能需要更长时间才能被发现。
这不是“用尽”抓取预算的情况,而是分散Googlebot注意力的情况。
对于中小型外贸网站来说,抓取预算不需要成为核心关注点。但你应该定期清理这些低价值URL——使用robots.txt或noindex——以便Googlebot可以专注于你真正希望它看到的页面。
如何判断Googlebot实际“看到”了什么?
你不必猜测。五分钟内就能检查出来。
- 打开 Google Search Console。
- 打开URL检查工具。
- 输入页面URL。
- 选择“测试实时URL”。
- 打开“截图”标签。
你将看到Googlebot渲染页面后生成的实际截图。如果截图中的内容为空白,或某个区域未加载,那就是Googlebot实际看不到的内容——这些内容不会被索引。
立即检查你最重要的产品页面。如果截图中的产品描述或规格为空白,你就找到了排名无法提升的真正原因。
关键要点
来源:Google搜索中心 — Googlebot文档 · JavaScript SEO基础知识 · 移动优先索引最佳实践 · 大型网站抓取预算管理
