每个关键词计划都从一个数字开始:月度搜索量。代理机构据此制定预测,客户据此批准预算,内容团队据此为待办事项排序。这个数字究竟有多真实,值得追问。
简短的答案是:没有任何工具能报告真实的搜索量,而最知名的供应商自己也这么说。更长的答案则更有用:三个最广泛使用的数据源计算搜索量的方式各不相同,独立测试已经衡量出每一个与 Search Console 的偏离程度,而且自 AI 摘要出现以来,搜索量与你实际能赢得的点击量之间的差距急剧扩大。
关键要点
- Google Keyword Planner、Semrush 和 Ahrefs 都报告12个月的平均值,三者都是估算值。Keyword Planner 会将相近变体归为一组并对数字进行四舍五入。
- 一项针对33,377个关键词的2023年独立研究发现,69%排名前10的关键词在 Search Console 中的展示次数高于 Keyword Planner 报告的数字。
- 另一项2023年针对 Semrush 87个关键词的测试发现,偏差中位数为46%,87个关键词中有71个被低估。
- 唯一一项将 Ahrefs 和 Semrush 与同一份 Search Console 数据进行对比的独立测试可追溯到2020年。目前没有针对这些工具的最新独立排名,任何声称有这种排名的人都应被要求出示研究依据。
- 搜索量不等于流量。在2025年的一项 Pew 研究中,当搜索结果出现 AI 摘要时,用户在8%的访问中点击了传统结果,而在没有 AI 摘要时这一比例为15%。
三个数字的来源
这三个数据源从不同的原始材料出发,这是它们产生分歧的首要原因。
| 来源 | 供应商的描述方式 | 平均方式 |
|---|---|---|
| Google Keyword Planner | 基于地理位置和网络设置,统计关键词及其相近变体的搜索次数。统计数字经过四舍五入。 | 过去12个月 |
| Semrush | 第三方数据叠加历史点击流数据,再通过计算模型处理 | 过去12个月总和除以12,移动端与桌面端合并计算 |
| Ahrefs | Keyword Planner 数据结合 Google Trends 及其他第三方来源,再用点击率模型加以修正 | 最近已知的12个月 |
Google 自己的文档中有两个细节解释了下游产生的大量困惑。由于 Keyword Planner 将某个关键词与其相近变体一并报告,多个关键词可能共用一个数字。由于其统计数字经过四舍五入,多个地区的搜索量加总起来可能与你预期的不符,Google 也指出,对于较小的地理区域,由于可用数据较少,结果的准确性会更低。任何以 Keyword Planner 数据为起点的工具,除非做出修正,否则都会继承这两个特性。
Ahrefs 对其局限性表现得很坦诚。在2024年3月的一篇文章中,其首席营销官直言不讳:根本不存在”准确的”搜索量这回事。这项指标的设计目的是提供方向性的参考,用于比较关键词,而非预测具体数字。
独立测试发现了什么
衡量准确性需要一个基准真值,通常采用的是网站排名靠前的关键词在 Google Search Console 中的展示次数。这个基准本身也有局限性,下文会提到,但它是目前可用的最佳选择。
Keyword Planner
近期规模最大的独立测试来自代理机构 Upgrow,发布于2023年5月,该测试将33,377个排名关键词在16个月内的数据与 Search Console 进行了对比:
| 发现 | 占比 |
|---|---|
| Search Console 展示次数高于 Keyword Planner 的排名前10关键词 | 69% |
| 被 Keyword Planner 严重低估的排名靠前关键词 | 63% |
| 被严重高估的排名靠前关键词 | 24% |
| 在 Search Console 中有展示次数但在 Keyword Planner 中为零的关键词 | 7% |
同一项研究发现,Keyword Planner 在排名前10的关键词上,整体展示次数被夸大了163%。这两个发现同时成立:大多数单个关键词被低估,而少数被严重高估的关键词却主导了总量。哪个更重要,取决于你规划时依赖的是长尾词还是少数几个头部词。
Semrush
2023年8月,代理机构 Altitude Marketing 将 Semrush 的估算值与其自身2023年6月的 Search Console 数据进行了对比,涉及87个排名第七或更靠前的美国关键词。平均偏差为99%,中位数偏差为46%。Semrush 低估了87个关键词中的71个。有26个词的实际展示次数超过估算值的两倍以上,还有一个词的数字完全吻合。这只是一个B2B网站、一小批低搜索量关键词的样本,因此应将其视为对小众B2B领域误差方向的一个说明,而非对该工具的定论。
Ahrefs,以及那份已有六年历史的正面对比
唯一一项将多个此类工具与同一份 Search Console 数据进行对比的独立研究发表于2020年6月的 Search Engine Journal。该研究使用了160个连续12个月保持前三名排名、月展示次数至少1,000次的关键词,对包括 Ahrefs、Semrush 和 Keyword Planner 在内的九款工具进行了比较。其结论是 Ahrefs 和 KWFinder 最接近真实数值。该数据涵盖2018年12月至2019年11月,而每家供应商此后都重新构建了各自的模型。
供应商们自己也做过更大规模的对比,应当以其本来面目看待。Ahrefs 在2021年11月发布了一项针对72,635个关键词的研究,发现91.45%的 Keyword Planner 搜索量属于高估,并称其自身数据在60%的情况下与 Search Console 的偏差在50%以内,大致准确,而 Keyword Planner 的这一比例为45%。Semrush 也在2022年发布了自己的多工具对比研究,并将自己排在第一位。这两项都是有公开方法论的严肃研究,但也都是由公司对自家产品进行的评分。
诚实的总结是:目前没有针对这三款工具在同一批关键词上的最新独立排名。如果有人告诉你某个工具”才是准确的那个”,请追问是哪项研究得出的结论。
为什么没有工具能做到完全准确
即使是完美的模型,追逐的目标本身也在移动,原因有三:
- 展示次数不等于搜索次数。 当用户看到过、或有可能看到过指向你网站的链接时,Google 就会计为一次展示。这是目前可用的最佳替代指标,而非实际搜索次数的统计。
- 归并与四舍五入。 相近变体归并意味着上游数字描述的已经是一个集群,而非单一关键词。四舍五入则掩盖了细微差异。
- 平均值抹平了季节性。 某个关键词若在某一个月出现峰值,其12个月平均值对该月的情况几乎无法说明什么。
这并不意味着这些工具毫无用处,而是意味着它们适合用于比较。如果某个工具给出的一个关键词的评分是另一个的五倍,那么前者被搜索的次数很可能确实更多。但这两个数字都不应未经核实就直接用于收入预测。
搜索量不等于流量:SERP的现实
更大的问题不在于某个搜索量估算是否有20%的偏差,而在于越来越大比例的搜索根本不会带来任何点击。
| 研究 | 发现 |
|---|---|
| SparkToro 与 Datos,2024年7月(美国和欧盟点击流数据,2022年9月至2024年5月) | 58.5%的美国和59.7%的欧盟 Google 搜索以零点击结束。每1,000次美国搜索中,只有360次点击流向了开放网络。 |
| Pew Research Center,2025年7月(900名美国成年人,68,879次搜索,2025年3月) | 当出现 AI 摘要时,用户在8%的访问中点击了传统结果,而没有 AI 摘要时这一比例为15%。在1%的访问中,用户点击了摘要内部的链接。约五分之一的搜索会产生摘要。 |
| Seer Interactive,2026年4月(53个品牌,24.3亿次自然展示,2025年1月至2026年2月) | 每百万次信息型展示中:没有 AI 摘要时约产生33,500次自然点击,品牌在摘要中被引用时约产生20,743次,未被引用时约产生9,445次。 |
Datos 是 Semrush 旗下的公司,在阅读第一行数据时值得留意这一点。Seer 的数据也显示出情况正在变化:在出现 AI 摘要的搜索中,自然点击率从2025年12月的1.31%回升至2026年2月的2.36%。无论当前的具体数字如何,两个搜索量完全相同的关键词,可获得的点击量可能相差数倍,这取决于自然结果上方摆放的是什么内容。
这正是搜索量这一列数字无法向你展示的部分,也是你可以直接去核实的部分。
检查SERP,而不只是数字
在将某个关键词纳入计划之前,先看看你目标市场中的真实搜索者在其使用的设备上会看到怎样的搜索结果页面:
- 页面顶部被什么占据。 广告、精选摘要、“People Also Ask”板块、地图包或 AI 摘要,都会在第一个自然结果之前抢走点击。
- 谁在排名。 如果这个页面全是各大平台或各大出版商,而你两者都不是,那么这个搜索量就不是属于你的搜索量。
- 是否因地区而变化。 Keyword Planner 自己就警告说,小地区的数字可靠性较低,而本地意图会因城市不同而重新排列结果。
- 是否因设备而变化。 移动端和桌面端的结果在功能和排名上都存在差异。
对少量关键词手动做这件事没有问题。但如果涉及数百个关键词、多个市场,就需要结构化的SERP数据。Shifter 的SERP API会针对自然结果、广告、精选摘要、知识图谱和”People Also Ask”返回解析后的JSON数据,并可按请求设置国家、语言、地点和设备:
curl "https://serp.shifter.io/v1?engine=google&api_key=YOUR_API_KEY&q=crm+for+startups&gl=us&hl=en&location=Austin%2CTexas%2CUnited+States&device=mobile"
在每个请求中都要明确设置 gl、hl、location 和 device;如果任由其使用默认值,不同运行之间得到的结果将无法比较。对于具体城市,应先通过 Locations API 解析该地点,具体做法参见地点文档。关于本地追踪更深入的内容,可参阅用于本地SEO追踪的地理定位SERP API。
一套经得起现实检验的工作流程
- 用工具的搜索量做排序,而非做预测。 它擅长告诉你两个关键词中哪一个规模更大。
- 在你已有排名的地方,用自己的 Search Console 数据进行交叉核对。 对于你已经出现排名的关键词,你自己的展示次数比任何第三方估算都更可靠。
- 在提交之前,针对每个目标市场和设备拉取SERP。 并记录第一个自然结果上方出现了哪些功能模块。
- 预测点击量,而非搜索量。 根据SERP会截留掉多少点击来对搜索量打折,并随着AI摘要的普及或消退而重新审视这个折扣。
- 定期重新核查。 搜索量是12个月的平均值,而SERP的布局变化要快得多。
结论
Keyword Planner、Semrush 和 Ahrefs 都发布估算数字,都以12个月为平均周期,并且都在各自的文档中说明该数字只是近似值。独立测试显示,误差之大足以影响预测,而且误差方向会因关键词集合的不同而不同。目前没有任何一项最新的独立研究基于同一批数据对这三款工具进行排名。
这些工具都无法告诉你的是页面上实际会发生什么。相同的搜索量背后,可能隐藏着一个能自由带来点击的结果页面,也可能隐藏着一个大多数搜索都以零点击收场的页面。数字只是开启对话,而真正能够定论的,是在对你而言重要的市场和设备上呈现的那个SERP。
来源与参考资料
- Google Ads Help,About Keyword Planner forecasts。相近变体归并、四舍五入,以及小地区的准确性。
- Semrush Knowledge Base,What is search volume in Semrush。数据来源、建模方式与12个月平均值。
- Ahrefs Help Center,How accurate is keyword search volume in Ahrefs 及 Monthly search volume vs average search volume,以及 Tim Soulo,There’s No Such Thing as “Accurate” Search Volume,2024年3月18日。
- Ryder Meehan,Upgrow,Google keyword tools data study,2023年5月2日。33,377个关键词,历时16个月。
- Adam Smartschan,Altitude Marketing,Search volume estimate accuracy,2023年8月14日。87个美国关键词。
- Bartjan Sonneveld,Search Engine Journal,Keyword data accuracy study,2020年6月30日。数据涵盖2018年12月至2019年11月。
- Tim Soulo,Ahrefs,GSC vs. GKP: Comparing Search Volumes for 72k Keywords,2021年11月3日。供应商研究。
- Rand Fishkin,SparkToro,2024 zero-click search study,2024年7月2日。Datos 点击流数据。
- Athena Chapekis 与 Anna Lieb,Pew Research Center,Google users are less likely to click on links when an AI summary appears,2025年7月22日。
- Seer Interactive,AIO impact on Google CTR: 2026 update,2026年4月。
- Google Search Console Help,Performance report metrics。展示次数的定义。
- Shifter,SERP API 文档 及 地点文档。