做GEO在线采样,题集是唯一的变量控制手段:题面必须用真实客户语言、底层意图由系统标注、四个必填字段保证最低题量、题集生成后冻结并版本化,跨轮才可比。换句话说,四个必填字段直接决定最低题量——它不是随客户填写完整度浮动,而是有一个硬性下限。
一、四个必填字段是可比性的前提
四个必填字段决定最低题量,这不是为了省事,而是为了保证不同项目之间的可比性。初版规则曾允许“字段为空就跳过依赖它的题”,结果被否掉:这会让题量由客户填写完整度决定,不同项目题数差异过大,失去可比性。于是改为必填四字段,四项不全不能开始正式采样。最低题量从此有了稳定起点,不再取决于客户愿意填多少选填项。
二、字段清单与生成下限
四个必填字段是:brand_name 品牌名称、company_name 企业主体、industry 行业、core_offerings 核心业务与服务。其中核心业务允许填 1–5 项,不同业务分别建题。关键要求是:仅凭这四个字段就必须能生成不少于 20 道基础题。也就是说,哪怕客户一个选填项都不填,题集也能成立。
三、三档题量与标准 30 题配比
最低题量按档位划分:
- 基础诊断:20 题,适用首次采样、低成本监测。
- 标准诊断:30 题,适用正式项目、周期复采。
- 深度诊断:50 题,适用竞品、地域、多业务分析。
标准 30 题内部有固定配比:自然需求与推荐 10 题、具体业务场景 6 题、品牌值不值得选 5 题、品牌与企业认知 4 题、来源与事实核验 3 题、方法论控制题 2 题。配比固定,意味着同类项目之间的结构可以相互比较。
四、选填字段只做替换与扩展
地域、目标客户、痛点、场景、预算、竞品、差异化这些都是选填字段。它们的作用不是凑数,而是把通用题换成更精准的题,或在基础题上扩展。重要边界是:选填字段不减少基础题量。基础题量由必填四字段撑起,选填只是让题目更贴近客户真实语境。
五、大模型补字段:只能出候选,不能当事实
大模型补字段的思路有明显风险:行业归类错误、把宣传话术当核心业务、虚构目标客户/竞品/地域,而且字段错误会扩散进整套题集,最终得到“结构完整但测错对象”的 Benchmark。因此字段分三层:
- confirmed:客户明确填写,可直接生成题目。
- verified:从官网、工商、产品页等公开证据提取并经过规则校验,可用。
- inferred:大模型推断,只能生成候选题,必须带置信度与依据,需客户确认。
铁律是:最低题量不得依赖大模型补全字段。未确认字段不能用断言表述,只能弱表达。
六、冻结题集,跨轮才可比
题集生成后必须冻结并版本化。只有同一套题集在多个采样轮次中保持不变,结果才可比较;任何字段调整或题目替换都应形成新版本,而不是在旧版本上随手改。四个必填字段决定最低题量,本质是用最少的锁定条件换来一个可复用的基线,选填字段和大模型推断都只是在这个基线上做精修。

