GEO 研究方法

最后更新:2026-07-22 | 方法公开可复核

本页说明寓言城堡在 GEO(生成式引擎优化)研究中的测量方法、指标定义、评分协议和数据来源。目标是建立可复现的基线,所有结论可核验。

两类测量

API 能力基准

使用官方 API 进行系统化测试。保存模型、参数、日期、提示词、来源 URL 和原始结构化响应。结果只能代表该 API 与配置,不代表消费端最终体验。

消费端平台观察

覆盖豆包、DeepSeek、Kimi、腾讯元宝、百度/文心、微信搜一搜、ChatGPT、Perplexity 等平台。使用固定问题集、固定账户类型、固定地区和固定日期人工执行。保存截图、可点击来源和事实核对结果。不使用未授权抓取、自动登录或反向工程。

重要:API 结果不得标记为消费端平台结果。两种测量严格区分,互不混用。

指标定义

指标定义分母
出现率回答中是否出现目标人物、品牌或域名有效回答数
可点击引用率回答是否提供能打开并指向本站规范 URL 的来源有效回答数
事实准确率角色、品牌、方法和服务事实是否正确可核对断言数
来源页面分布引用落在哪类页面引用总数
固定问题覆盖率多少目标问题出现正确实体问题总数

「引用潜力」「推荐概率」等不可验证指标不在对外报告中使用。所有量化结论附带定义、样本量、日期和来源。

固定问题集 v1

12 道问题:4 个发现类、4 个比较类、4 个决策类。题目在 30 天周期内不修改。问题集在 Day 0 冻结并发布。

评分协议

证据等级

等级定义可用于
A法规、官方文档、原始论文、第一方数据研究结论和产品规则
B可复核行业报告、公开数据集带来源的背景判断
C本站真实测试,公开方法、样本、日期和限制案例与基线
D个人经验或启发式判断明确标注为建议,不作为事实

固定节奏

时间内容
Day 0发布前基线,真值表与问题集冻结
Day 7抓取与索引变化
Day 14实体与来源变化
Day 30首份公开复盘报告

所有对外报告都披露样本量、平台、版本或账户类型、地区、时间、方法和限制。