流量保卫战:HubSpot 如何通过“格式重构”夺回 Google 精选摘要?
开篇引入
在 SEO(搜索引擎优化)的世界里,最令人沮丧的事情莫过于此:你的文章明明稳居 Google 首页前列,内容质量上乘,但网站的有机流量(Organic Traffic)却在持平甚至下降。这听起来像是一个悖论,但却是 HubSpot 曾面临的真实危机。
经过严密的数据侦查,他们发现“真凶”并非竞争对手的上位,而是 Google 搜索结果页(SERP)规则的变迁——**精选摘要(Featured Snippets)**的泛滥正在截断用户的点击。
本文将完整复盘 HubSpot 团队如何通过一次严谨的 A/B 测试,发现了一个无需重写内容、仅靠修改 HTML 格式代码就能显著提升“第零位”占据率的低成本高回报策略。这是一场关于让算法“读懂”你的内容的精彩实验。
第一幕:流量消失之谜与嫌疑人锁定
[00:00 - 00:40]
核心观点
HubSpot 发现尽管排名未变,流量却在流失,核心原因是“精选摘要”出现频率翻倍,抢占了原本属于自然排名第一的点击量。
深度阐述
故事始于一个反常的数据现象。HubSpot 的营销团队监控到,其博客的有机流量增长停滞,甚至在某些板块出现了下滑。诡异的是,当他们检查关键词排名时,发现并没有显著变化——文章依然稳稳地排在 Google 首页。
“是什么导致了这种负面影响?”
调查小组将目光锁定在了 Featured Snippets(精选摘要) 上。这是 Google 为了提升用户体验,直接在搜索结果顶部抓取并展示网页核心内容的方框。对于用户来说,这意味着无需点击进入网页就能获得答案;而对于内容创作者来说,这被称为“零点击搜索”危机。
HubSpot 的数据显示,相比几年前,现在的搜索结果中出现精选摘要的频率是过去的 两倍以上。这意味着,即使你排在第一位,只要没有占据这个“第零位”的摘要框,用户很可能在看完摘要后就离开了,或者点击了那个被 Google 选中的“天选之子”。
重要原话:
“More specifically, it was the rapidly increasing amount of featured snippets that were showing up in the search results and taking clicks away from position one.”
(具体来说,是搜索结果中迅速增加的精选摘要,它们正在从排名第一的位置夺走点击量。)
第二幕:数据侦查与残酷真相
[00:40 - 02:00]
核心观点
通过对 5000 个查询词的数据抓取,团队发现尽管拥有大量首页排名,HubSpot 在精选摘要的争夺战中表现惨淡,大量潜在流量被浪费。
深度阐述
为了验证假设,HubSpot 并没有凭空猜测,而是启动了一项大规模的数据抓取工程。
-
样本筛选:他们收集了 5,000 个 HubSpot 已经在 Google 首页获得排名的查询词(Queries)。
-
锁定意图:为了确保样本的高相关性,这些查询词全部包含“How to(如何)”、“What is(什么是)”、“How do/does(怎么做)”等疑问词。因为这类问题最容易触发 Google 的问答机制,从而生成精选摘要。
-
爬虫分析:通过爬虫工具,他们分析了这 5000 个搜索结果页面。
数据揭示的现状:
-
29% 的查询词触发了精选摘要。
-
71% 的查询词没有触发(或者是广告、地图包等其他形式)。
最让团队心惊的数据是:在那些已经触发了精选摘要、且 HubSpot 本身就排在首页的搜索结果中,HubSpot 极少出现在精选摘要的位置上。
这意味着,虽然内容被 Google 认可为高质量(排在首页),但 Google 的算法并不认为这些内容适合作为“最佳答案”直接展示。
重要原话:
“For us, that means a lot of traffic left on the table.”
(对我们来说,这意味着大量的流量被白白浪费了。)
第三幕:算法的语言障碍
[02:00 - 03:20]
核心观点
Google 依靠 H2 和 H3 标签来提取列表内容,但格式的不规范(如混乱的序号样式)会让算法感到困惑,导致抓取失败。
深度阐述
为什么高质量的内容无法被选中?团队提出了一个假设:格式问题。
Google 的爬虫毕竟是机器,它需要清晰的 HTML 结构来理解文章的逻辑。特别是在处理“列表类”摘要(List-based Snippets)时,Google 倾向于抓取页面中的 H2(二级标题) 和 H3(三级标题) 作为列表项。
然而,HubSpot 的工程师发现,Google 的算法在识别上存在“阅读障碍”。即使内容是列表形式,如果 HTML 代码不够干净,或者格式不符合 Google 的偏好,算法就会“困惑”。
一个典型的失败案例:
在检查一个本该赢得摘要的页面时,团队发现 Google 抓取的内容乱七八糟,甚至无法识别出这不仅是一段话,而是一个步骤列表。
核心痛点在于序号的格式。HubSpot 之前的很多文章中,标题序号使用的是“1)”、“2)”这样的括号形式,或者代码中夹杂了大量无意义的标签(Spam tags,如多余的 span 或 style 属性)。这对人类阅读没有影响,但对机器来说,这是巨大的干扰噪音。
重要原话:
“Since Google uses an algorithm to extract content for the snippets, if something isn’t formatted cleanly, it won’t understand what’s going on.”
(因为 Google 使用算法来提取摘要内容,如果某些东西格式不干净,它就无法理解发生了什么。)
第四幕:代码清洗实验
[03:20 - 05:08]
核心观点
通过对 62 篇文章进行“代码清洗”(规范 H 标签层级、统一序号格式、移除冗余代码),HubSpot 成功将精选摘要的获取率提升了 10%,证明了结构化数据的力量。
深度阐述
基于上述发现,HubSpot 设计了一个严谨的 A/B 测试。
实验设计:
-
样本:挑选 62 篇 高流量博客文章。这些文章目前均未获得精选摘要,但对应的搜索词在 Google 上确实存在摘要位置(被竞对占据或空缺)。
-
分组:随机平均分为两组。一组为控制组(不做任何改动),另一组为实验组。
操作指南:实验组做了什么?
HubSpot 没有增加任何一段新文字,他们只做了“清洁工”的工作:
-
重构标题层级:
-
确保 H1 仅作为页面总标题。
-
将文章内的小标题明确设定为 H2。
-
将列表项下的细分点设定为 H3。
-
补救措施:如果文章原本没有 H2 引导语,人为添加一个(例如“以下是具体步骤:”)。
-
-
统一列表符号:
- 将原本的
1)、2)等带括号的格式,统一修改为1.、2.这种更标准的列表样式。
- 将原本的
-
代码净化:
- 移除 HTML 标题标签中所有多余的代码,特别是那些可能由富文本编辑器自动生成的无关
span标签或样式属性。
- 移除 HTML 标题标签中所有多余的代码,特别是那些可能由富文本编辑器自动生成的无关
实验结果:
提交 Google 重新索引(Re-crawling)后,结果令人振奋:
-
实验组:精选摘要的获取率提升了 10% 以上。
-
控制组:获取率依然在 0% 到 5% 之间波动(自然波动)。
更重要的是,数据证实,当文章成功占据精选摘要位置后,该页面的净流量(Net Traffic)出现了显著增长。这打破了“精选摘要会降低点击率”的担忧——在某些查询中,占据 Position Zero 带来的曝光远超点击流失。
个人感受
观看这个视频,最大的感受是**“魔鬼藏在细节里”**。我们往往过度关注内容的创作——辞藻是否华丽、论点是否新颖,却忽略了我们最核心的读者之一其实是 Google 的爬虫机器人。
HubSpot 团队展现出的不是单纯的营销技巧,而是一种工程师思维。他们没有盲目猜测,而是通过定义问题、收集数据、提出假设、控制变量实验,最后得出结论。这种科学的 SEO 优化方法,比任何“黑帽”技巧都更令人信服,也更具可持续性。看到他们仅仅把 1) 改成 1. 就能挽回流量,让人不由感叹技术标准的严谨性对商业结果的巨大杠杆作用。
延伸思考
-
语义搜索与 AI 的未来:
这个实验虽然针对的是传统搜索引擎,但在 AI 搜索(如 ChatGPT Search 或 Google SGE)时代,逻辑结构的重要性只会增加。AI 模型同样依赖清晰的结构化数据来理解和引用内容。格式清晰的内容,未来被 AI 采信的概率也会更高。
-
内容的可访问性(Accessibility):
清洁的代码不仅对 SEO 友好,对使用屏幕阅读器的视障用户也更友好。Google 算法的偏好,本质上往往与良好的用户体验(UX)和无障碍设计标准是一致的。
-
旧内容的资产盘活:
很多企业拥有海量的历史文章。这个案例告诉我们,与其不断生产新内容,不如定期“打扫”旧房间。通过技术手段批量优化旧文章的 HTML 结构,可能是 ROI(投资回报率)最高的增长策略。
精华收获:如何让 Google 爱上你的内容
如果你希望复刻 HubSpot 的成功,请立即检查你网站上的高排名文章,并执行以下**“格式重构清单”**:
1. 严格的标题层级制度
-
H1:全页只能有一个,即文章大标题。
-
H2:用于主要章节或步骤的引导(Google 抓取列表的入口)。
-
H3:用于具体的列表项或步骤细节。
-
操作:切勿为了字号大小而混用 H 标签,必须按逻辑层级使用。
2. 标准化符号语言
-
弃用:
1)、Step 1(纯文本形式)、(1)。 -
启用:
1.、2.、3.。或者直接使用 HTML 的有序列表<ol>和无序列表<ul>标签,这是机器最易读的格式。
3. 代码极简主义
-
清理:检查源码,确保 H 标签内部没有奇怪的
class、id或style属性干扰。 -
纯净:标题就是标题,不要在标题标签里包裹图片或大段无关文字。
4. 目标锁定
- 不要试图优化所有文章。优先筛选那些已进入 Google 首页(前 5 名),且搜索词带有**“是什么”、“怎么做”**意图,但尚未获得精选摘要的文章。这是你的“低垂之果”。