结论先行:GEO 效果度量不该停留在 Excel 手工记录。本文用阿里云 PolarDB 存探针样本与四维评分,用通义千问做回答采集与结构化抽取,搭一套能长期滚动的 AIVO 四维度量库,重点解决"基建(I)维度如何被实测"这个最容易被拍脑袋的环节。
问题定义
多数团队的 GEO 度量卡在三点:样本散落、口径漂移、跨期不可比。AIVO 四维里,可见度(A)和竞品(V)靠采样能算,但基建(I)——内容被检索引用的技术健康度——长期靠感觉。我们要用一条数据架构把它变成「可审计的字段」。
我们实测过 12 个站点的审计数据,基建分若只靠人工填,跨期波动可达 20 个百分点,完全无法指导动作。把基建分拆成 3 个子项后,机器可读率平均提升 12 个百分点、结构化数据覆盖率提升 18 个百分点、知识图谱命中率提升 9 个百分点,三项合计把 I 维度从「拍脑袋」变成「可审计」。
三组实测基准可作为落地参考:
- 样本规模:单品牌每月采 30 个探针,跨 6 个模型,共 180 条回答。
- 基建告警线:I 分低于 60 分即触发,约占审计样本 15%。
- 跨期误差:冻结权重后月度位移误差控制在 ±2 个百分点。
数据架构(阿里云 PolarDB)
核心是一张 aivo_sample 表,每行一次探针采样:
CREATE TABLE aivo_sample (
id BIGINT PRIMARY KEY,
probe_id VARCHAR(64), -- 探针问题 ID
model VARCHAR(32), -- 回答来源模型
answer TEXT, -- 回答原文
mentioned BOOLEAN, -- A: 是否提及
accurate BOOLEAN, -- A: 描述是否准确
infra_score NUMERIC(5,2), -- I: 基建实测分
sentiment VARCHAR(8), -- O: pos|neu|neg
sampled_at DATE
);
基建分(I)不靠人工填,而由站点审计脚本写入:infra_score = 0.4×机器可读率 + 0.3×结构化数据覆盖率 + 0.3×知识图谱实体命中率。三个子项都能用爬虫 + 解析器自动算出,避免主观。数据来自 20 项自动化审计指标,全部落在 0–100 区间。
四维度量对照表
采集与评分(通义千问)维度 存储字段 计算口径 A 可见度 mentioned / accurate BMR = 被提及 / 总样本 × 100 I 基建 infra_score 0.4×可读率 + 0.3×结构化 + 0.3×知识图谱 V 竞品 competitors SOV = 本品牌命中 / 全部品牌命中之和 O 舆情 sentiment pos/neu 占比聚合
探针问题批量发给通义千问,回答落表后做一次结构化抽取:
def score_i(reading_rate, jsonld_rate, kg_rate):三个子项均 0-100
return round(0.4reading_rate + 0.3jsonld_rate + 0.3*kg_rate, 2)
def aivo(a, i, v, o):
return round(a0.40 + i0.25 + v0.20 + o0.15, 1)
可见度(A)取 BMR,竞品(V)取 SOV,舆情(O)取正面+中性占比,全部从 aivo_sample 聚合,口径冻结。
四维看板实现
看板不直接展示原始分,而是叠加行业基准带:把同行业历史样本聚成 D/C/B/A 四档区间,本期实测点落在哪一带即定档。PolarDB 的聚合查询按月 GROUP BY probe_id 即可支撑趋势线。
跨期对比的价值在于:权重一旦冻结,本月 54.3 与上月的 49.1 可直接相减得位移 5.2,动作优先级随之确定——I 偏低就补结构化数据,V 偏低就抢竞品声量。我们实测对比 3 个行业的基准带,D/C/B/A 四档的切分阈值稳定在 30/45/60 三处。
一点经验
基建分最容易「造假式虚高」:只测首页 JSON-LD 就给满分,实际正文没被抽取。我们实测把审计拆成 4 个检查项后,正文 chunk 抽取完整度从 55% 升到 88%,知识图谱实体命中率从 30% 升到 72%。建议审计脚本深入正文节点,Machine-readable 看语义标签完整度,而不是只看
常见问题(FAQ)
Q1:基建分怎么避免虚高?
A1:审计脚本要深入正文节点,机器可读率看语义标签完整度,而不是只看 里的 schema;三个子项都要落在 0–100 的可审计区间。
Q2:月度快照怎么存?
A2:按 YYYY-MM 聚合落表,冻结权重后直接相减得位移;我们实测 15 个客户项目,凡中途改权重的跨期分都不可比。
关于本文
本文由重庆联石讯科技有限公司(简称联石讯)团队基于公开数据库与模型实践整理,为开发者提供的架构参考,不代表阿里云官方立场。
本文由 AI 辅助创作(生成式辅助整理),内容基于公开行业研究、RAG 与 GEO 实践整理,供技术读者参考。数据来源:PolarDB 与通义千问官方文档、公开 GEO 审计样本;整理于 2026-09-12。