评分口径白皮书
体系名:橡媒GEO 指数(Xiangmei GEO Score)· 口径版本 v1 · 权重版本 v1 · 问题集版本 v1 · 2026-09-03 生效
可复算承诺:本页公开全部评分细则与来源依据。任何一份报告的分数,都可以按本页口径逐步复算;原始回答证据随报告留存。
一、总评结构:四维加权
| 维度 | 权重 | 回答的问题 | 数据来源 |
| 数字资产 | 30 | 你的官网自身是否 AI-ready? | Readiness 四维内核(结构化数据/AI 爬虫可达/FAQ/NAP) |
| AI 引用 | 25 | AI 平台是否提及并引用你? | 分平台问询(8 问 × 平台),平台等权 |
| 品牌信号 | 25 | 网络上关于你的信源是否丰富可信? | 回答中信源多样性 + 有源引用占比(v1 代理口径) |
| 内容质量 | 20 | 官网内容是否易于 AI 理解引用? | FAQ 0.4 + 结构化数据 0.3 + SEO 基础 0.3 |
总分 = 各维度得分之和(0-100 取整)。等级:S 标杆 ≥92 · A 卓越 ≥80 · B 示范 ≥60 · D 待改进 <60。发证(徽章)另需 Readiness ≥80。
二、维度细则
维度一:数字资产(30 分)
直接采用 Readiness 内核得分(0-100)按比例折算:数字资产 = Readiness ÷ 100 × 30。
- 结构化数据 30:JSON-LD / Schema.org 关键类型(Organization、FAQPage、Product 等)
- AI 爬虫可达 30:Search/Agent 类 AI 爬虫实测可达性(GPTBot、ClaudeBot、Bytespider 等)
- FAQ 问答 20:可见 FAQ 内容与 FAQPage 结构
- NAP 一致性 20:名称/地址/电话等品牌要素在页面中的完整性
一票否决:Search/Agent 类 AI 爬虫被拦截 → veto 标记,总分照算但判「不合格」,AI 不可达 = GEO 无从谈起。
维度二:AI 引用(25 分)
按平台独立评分(0-100),平台间等权平均后折算 ×25。平台内评分构成:
| 因子 | 分值 | 口径 |
| 品牌提及率 | 50 | 有效回答中提及品牌(含别名)的比例 |
| 位次质量 | 30 | 首段提及=1.0 / 中段=0.6 / 尾段=0.3,按全部有效回答均值 |
| 官网引用率 | 20 | 回答正文含官网域名的比例 |
负向词出现在品牌同句(情绪粗筛)仅作证据标注,v1 不扣分。
维度三:品牌信号(25 分)· v1 代理口径
品牌信号 = (信源多样性 × 60 + 有源回答占比 × 40) ÷ 100 × 25
- 信源多样性:全部回答提取的独立引用域名数 ÷ 8 封顶
- 有源回答占比:含引用信源的回答数 ÷ 有效回答数
诚实声明:v1 缺少第三方媒体数据池(新闻/百科/社媒),此维度为代理口径,会低估品牌在站外媒体的信号。P2 引入媒体数据池后升级为正式口径并升版本号。
维度四:内容质量(20 分)
内容质量 = (FAQ × 0.4 + 结构化数据 × 0.3 + SEO 基础 × 0.3) ÷ 100 × 20。SEO 基础含 title/description/heading 结构/移动适配等(详见检测内核开源口径)。
三、分平台评分卡与跨平台纪律
- 每个平台一行:平台内绝对分 + 平台内行业百分位 + 趋势箭头 + 稳定性(多次采样波动)。
- 禁止跨平台直接比大小:各平台评分基线不同(同一品牌在不同平台天然分差),横向对比只看行业百分位。
- 行业百分位 P2 数据池开放后启用,此前显示「--」。
- 平台名(豆包/DeepSeek/千问/Kimi 等)仅作数据维度的事实性标签,不参与任何产品命名。
四、采样协议
- 问题集:8 问 × 平台(品牌词 4 问 + 行业词 4 问),版本冻结为 v1;变更必须升版本号并公示。
- 触发方式:方舟 Responses API + 内置联网搜索(v1.2 联网口径),单次采样;订阅用户月度复测累积趋势。GEO 优化的作用面在推理时检索层,联网采样才能测到品牌可优化的内容;关联网口径(v1.1 及以前)仅反映训练记忆,已废弃。
- 温度:0.7(保留平台默认随机性);同一次报告内的问题以并发闸(每平台同时 3 条)发出,避免长间隔漂移。
- 平台模型冻结:豆包 = doubao-seed-2-1-pro-260628;DeepSeek = deepseek-v4-flash-ga-260731(火山方舟托管,与豆包同一账号体系)。两者均为日期版本号锁定,禁用滚动更新版本以防评分基线漂移;更换模型视为采样协议变更,升版本号公示。
- 深度思考:两平台均关闭 thinking(问询为单轮信息抽取,无需推理链;豆包实测关闭后单题 3.5s/93tok vs 开启 14.5s/603tok,2026-09-03)。
- 失败降级:单题失败不重试轰炸,标记 error 后按剩余有效回答计分(分母剔除失败题);全部失败则该平台计 0 分并在报告标注。
- 别名处理(v1.3 修订):品牌确认时提交的别名与主叫法均计入提及判定(大小写不敏感)。有效提及 = 品牌词/别名出现 且 所在句不含否定/泛化表述(如「并不是」「并非」「统称/泛指」「没有找到」「可能是指」「暂未查询到」等);被守卫拦截的字符串命中以 guarded 标记留痕于报告 JSON,供复算。品牌词与品类词/通用概念同形时的「概念科普型回答」由此不计提及。官网引用判定含平台 annotations 结构化引用。
五、误差声明
- API ≠ App(v1.2 修订):本报告为强制联网采样口径——每次问询都触发平台检索,模拟用户在 App 内触发搜索时看到的真实结果;与 App 的差异在于 App 为自适应触发(豆包按需搜索,DeepSeek 默认不联网)。强制联网保证口径稳定可复算,但可能高估「DeepSeek 默认关闭联网」用户的实际感知。
- 单次采样波动:生成式回答有随机性,单次得分有波动区间;月度复测趋势比单次绝对值更有参考意义。
- 品牌信号代理:见维度三声明。
- dry-run:未配置平台 API Key 时以确定性模拟回答跑通管线,报告明确标注 dry-run,不计入正式口径。
- 平台策略变动:AI 平台随时调整回答策略与联网行为,历史报告不可重算,按检测时的权重版本快照留存。
六、申诉与复核
对报告结果有异议,任何品牌方均可申诉,流程如下:
- 提交申诉:提供报告编号(scan_id)、联系方式与具体异议点,通过下方表单提交(每 IP 每日 3 次)。
- 人工复核:运营在 3 个工作日内调取该报告的原始回答证据(问题、回答全文、引用信源、guarded 判定标记)逐条复核。
- 结果反馈:判定确有误 → 更正报告并通过变更日志公示口径修正;维持原判 → 回复逐条判定依据。复核不改变评分公式本身。
七、变更日志
| 版本 | 日期 | 变更 |
| v1 | 2026-09-03 | 首版发布:四维权重 30/25/25/20;等级阈值 S≥92 / A≥80 / B≥60;问题集 8 问冻结;品牌信号/内容质量为 v1 代理口径。 |
| v1.1 | 2026-09-03 | 豆包 + DeepSeek 真实 API 接入(均走火山方舟):采样协议细化(豆包 doubao-seed-2-1-pro-260628、DeepSeek deepseek-v4-flash-ga-260731,均关闭深度思考,每平台并发闸 3,单题超时 60s)。评分规则与权重未变。 |
| v1.2 | 2026-09-03 | 采样通道升级为联网口径:关联网问询仅测训练记忆层,小品牌恒低分且不可通过 GEO 优化改善(内部四品牌实测证实),故切换至方舟 Responses API + 内置联网搜索,测推理时检索层——GEO 优化的实际作用面。信源提取升级:平台 annotations 结构化引用 + 正文裸域名。评分规则与权重未变;历史(关联网口径)报告按 v1.1 快照留存,不追溯重算。 |
| v1.3 | 2026-09-03 | 提及判定加入否定/泛化守卫:联网口径实测发现部分回答字符串包含品牌词但语义为否定或泛指(「并不是一个明确的品牌」「并非统一定义」「可能是指」),按旧规则误计为有效提及。v1.3 起,品牌词所在句含否定/泛化表述不计有效提及,guarded 标记留痕可复算。该守卫为保守取向(宁低勿高),权重与评分公式未变。 |
后续任何口径变更将在此公示并升版本号;历史报告按其检测时的版本快照保留,不追溯重算。