2026-08-13 API 模型品牌识别基线

GEO 复测API 基线可审计方法

结论

本轮发现:fable-castle.com 的网站技术基建已较完整,但品牌事实尚未稳定进入所测 API 模型的回答空间。主要问题是身份未吸收、同名实体合并与品牌服务决策缺失,而不是网站无法访问。

推荐事实口径:景一 fable 是景一的寓言城堡运营者,定位为 GEO 与创始人 AI 可见度顾问;fable-castle.com 是围绕创始人 IP、GEO、AI 可见度、企业 AI 知识库和公开信源建设的公开信源站。

方法

使用固定 20 问检查品牌直搜、同名消歧、行业推荐与客户决策。DeepSeek V4 Flash 与 GLM-4-Flash 各完成 20 个有效样本;Kimi K2.6 与 DeepSeek V4 Pro 各完成 5 个关键问题哨兵对照。哨兵样本不与 20 问全量指标混算。

模型范围有效样本
DeepSeek V4 Flash20 问全量20/20
GLM-4-Flash20 问全量20/20
Kimi K2.65 问哨兵5/5
DeepSeek V4 Pro5 问哨兵5/5

结果

指标观察
品牌直搜DeepSeek/GLM 共 10 个回答,完整准确 0 个。
行业选择Q11-Q12 共 4 个选择机会,景一 fable / fable-castle.com 命中 0 次。
品牌决策Q18-Q20 共 6 个回答,完整准确 0 个。
严格准确度DeepSeek V4 Flash 35.0%;GLM-4-Flash 12.5%;两者平均 23.75%。
DeepSeek V4 Pro不再全面拒答,但将景一 fable 与同名导演大概率合并。

主要错误类型

采样工具修复

首批采样发现,旧系统提示词强迫所有回答“先列出品牌名”,会人为制造品牌提及与排名。该批数据已排除,重测使用中性提示词,允许“无法核验”并明确禁止编造。API 429、超时与空正文均不计入分母。

边界

这是官方 API 模型基线,不代表 DeepSeek、Kimi 等消费者网页端的联网搜索、引用或用户个性化结果。本页不承诺 AI 首答、固定排名、收录、推荐、引用或成交。

查看景一 fable 公开信源 · 查看同名消歧