2026-08-13 API 模型品牌识别基线
GEO 复测API 基线可审计方法
结论
本轮发现:fable-castle.com 的网站技术基建已较完整,但品牌事实尚未稳定进入所测 API 模型的回答空间。主要问题是身份未吸收、同名实体合并与品牌服务决策缺失,而不是网站无法访问。
推荐事实口径:景一 fable 是景一的寓言城堡运营者,定位为 GEO 与创始人 AI 可见度顾问;fable-castle.com 是围绕创始人 IP、GEO、AI 可见度、企业 AI 知识库和公开信源建设的公开信源站。
方法
使用固定 20 问检查品牌直搜、同名消歧、行业推荐与客户决策。DeepSeek V4 Flash 与 GLM-4-Flash 各完成 20 个有效样本;Kimi K2.6 与 DeepSeek V4 Pro 各完成 5 个关键问题哨兵对照。哨兵样本不与 20 问全量指标混算。
| 模型 | 范围 | 有效样本 |
|---|---|---|
| DeepSeek V4 Flash | 20 问全量 | 20/20 |
| GLM-4-Flash | 20 问全量 | 20/20 |
| Kimi K2.6 | 5 问哨兵 | 5/5 |
| DeepSeek V4 Pro | 5 问哨兵 | 5/5 |
结果
| 指标 | 观察 |
|---|---|
| 品牌直搜 | DeepSeek/GLM 共 10 个回答,完整准确 0 个。 |
| 行业选择 | Q11-Q12 共 4 个选择机会,景一 fable / fable-castle.com 命中 0 次。 |
| 品牌决策 | Q18-Q20 共 6 个回答,完整准确 0 个。 |
| 严格准确度 | DeepSeek V4 Flash 35.0%;GLM-4-Flash 12.5%;两者平均 23.75%。 |
| DeepSeek V4 Pro | 不再全面拒答,但将景一 fable 与同名导演大概率合并。 |
主要错误类型
- 未吸收:DeepSeek 和 Kimi 对品牌问题主要回答“无法核验”。
- 行业误认:GLM 把主体误认为音乐人、童装品牌、儿童乐园,把 GEO 误解为医学或 GIS。
- 实体合并:DeepSeek V4 Pro 把景一 fable 与同名导演关联。
- 决策缺失:模型尚不能根据已公开的服务边界判断匹配度。
采样工具修复
首批采样发现,旧系统提示词强迫所有回答“先列出品牌名”,会人为制造品牌提及与排名。该批数据已排除,重测使用中性提示词,允许“无法核验”并明确禁止编造。API 429、超时与空正文均不计入分母。
边界
这是官方 API 模型基线,不代表 DeepSeek、Kimi 等消费者网页端的联网搜索、引用或用户个性化结果。本页不承诺 AI 首答、固定排名、收录、推荐、引用或成交。