最后更新:2026-07-22 | 方法公开可复核
本页说明寓言城堡在 GEO(生成式引擎优化)研究中的测量方法、指标定义、评分协议和数据来源。目标是建立可复现的基线,所有结论可核验。
使用官方 API 进行系统化测试。保存模型、参数、日期、提示词、来源 URL 和原始结构化响应。结果只能代表该 API 与配置,不代表消费端最终体验。
覆盖豆包、DeepSeek、Kimi、腾讯元宝、百度/文心、微信搜一搜、ChatGPT、Perplexity 等平台。使用固定问题集、固定账户类型、固定地区和固定日期人工执行。保存截图、可点击来源和事实核对结果。不使用未授权抓取、自动登录或反向工程。
重要:API 结果不得标记为消费端平台结果。两种测量严格区分,互不混用。
| 指标 | 定义 | 分母 |
|---|---|---|
| 出现率 | 回答中是否出现目标人物、品牌或域名 | 有效回答数 |
| 可点击引用率 | 回答是否提供能打开并指向本站规范 URL 的来源 | 有效回答数 |
| 事实准确率 | 角色、品牌、方法和服务事实是否正确 | 可核对断言数 |
| 来源页面分布 | 引用落在哪类页面 | 引用总数 |
| 固定问题覆盖率 | 多少目标问题出现正确实体 | 问题总数 |
「引用潜力」「推荐概率」等不可验证指标不在对外报告中使用。所有量化结论附带定义、样本量、日期和来源。
12 道问题:4 个发现类、4 个比较类、4 个决策类。题目在 30 天周期内不修改。问题集在 Day 0 冻结并发布。
| 等级 | 定义 | 可用于 |
|---|---|---|
| A | 法规、官方文档、原始论文、第一方数据 | 研究结论和产品规则 |
| B | 可复核行业报告、公开数据集 | 带来源的背景判断 |
| C | 本站真实测试,公开方法、样本、日期和限制 | 案例与基线 |
| D | 个人经验或启发式判断 | 明确标注为建议,不作为事实 |
| 时间 | 内容 |
|---|---|
| Day 0 | 发布前基线,真值表与问题集冻结 |
| Day 7 | 抓取与索引变化 |
| Day 14 | 实体与来源变化 |
| Day 30 | 首份公开复盘报告 |
所有对外报告都披露样本量、平台、版本或账户类型、地区、时间、方法和限制。