附录D|Epistemic Status(认识状态)与因果措辞
版本:V1.0(第一版)
用途:约束研究、交付、报告、销售和代理转述中的结论强度。
一、五轴认识标注
任何重要结论都不能只写“可信度高”或给出统一分数。至少分别标注:
Epistemic Status(认识状态)
× Observability(可观测性)
× Claim Mode(命题性质)
× Causal Confidence(因果置信度)
× Scope(适用范围)
五个维度互不补偿。记录完整不能证明因果,编码一致不能证明命题真实,样本量大不能自动扩大适用范围。
二、Epistemic Status(认识状态)
| 状态 | 含义 | 允许表达 | 禁止表达 |
|---|---|---|---|
| Accepted(已接受) | 当前项目正式接受的定义、边界或治理规则 | “本体系当前采用……” | “人工智能内部必然如此运行” |
| Operational Hypothesis(操作性假设) | 有理由提出并可指导登记实验,但尚未验证 | “我们提出……并将通过……检验” | “已经证明……” |
| Validated Pattern(已验证模式) | 按预定义口径获得充分、可审查重复支持并通过正式准入 | 只在登记范围内表述 | 跨行业、跨引擎或跨时间无条件推广 |
| Rejected(已否定) | 已被反证或正式禁止的通用说法、方法或推论 | 作为反例、历史决策或禁止项引用 | 改名后重新恢复 |
| Unknown(未知) | 当前证据或观测能力不足 | “当前无法判断,需要……” | 用常识、客户意愿或智能体补全 |
| Draft(草案) | 尚未通过正式审查的新定义、结构或方法 | “草案供讨论与测试” | 冒充正式基线或客户承诺 |
当前正式Validated Pattern(已验证模式)登记为空。
三、Observability(可观测性)
| 类型 | 定义 | 示例 | 禁止升级 |
|---|---|---|---|
| Direct Observation(直接观测) | 可检查的原始输入、输出、页面状态、显示引用、工具轨迹、时间戳或正式业务记录 | 保存的一次完整人工智能回答 | 不等于完整内部过程 |
| Coded Observation(编码观测) | 按明确Codebook(编码手册)从原始记录生成的字段 | 编码答案是否提及变量、如何归属实体 | 不等于命题天然真实 |
| Inference(推断) | 从一组观测和证据形成的解释 | 某差异可能与证据不足有关 | 不得写成直接事实或机制 |
| Latent or Unknown(潜在或未知) | 当前无法直接观察或识别的过程 | 内部权重、隐藏候选集合、完整检索或生成路径 | 不得以人工智能自述代替观测 |
失败、超时、拒答、截断、偏题和工具异常必须分别记录,不能统一编码为No Mention(未提及)。
四、Claim Mode(命题性质)
| 类型 | 回答的问题 | 典型表达 | 所需边界 |
|---|---|---|---|
| Descriptive Claim(描述性命题) | 观察到了什么 | “在已记录的20次有效回答中,8次出现目标实体” | 分母、条件、时间与编码规则 |
| Comparative Claim(比较命题) | 相对谁更高、更低或不同 | “在同一探针与时间窗口下,甲的正确归属率高于乙” | 比较集合、共同口径、缺失与不确定性 |
| Causal Claim(因果命题) | 某项改变是否导致结果 | “干预对答案变化产生了有限贡献” | 反事实、对照、污染、替代解释与因果等级 |
| Predictive Claim(预测命题) | 未来可能发生什么 | “在相同范围内可能继续出现该模式” | 预测窗口、漂移、外部有效性与失败条件 |
| Normative Constraint(规范性约束) | 应该或不得做什么 | “内容必须真实并获得授权” | 不能包装为人工智能算法偏好 |
| Recommendation Claim(推荐命题) | 谁在什么条件下适合某对象 | “对满足条件甲、乙的用户,可将企业纳入候选” | 资格、证据、权衡、风险和替代选项 |
五、C0—C5 Causal Confidence(因果置信度)
| 等级 | 当前含义 | 允许措辞 | 不允许的越级解释 |
|---|---|---|---|
| C0(无法判断) | 设计无法判断因果方向 | “观察到同期状态或前后差异,不能归因” | “干预有效” |
| C1(方向信号) | 时间顺序与假设一致,但替代解释较多 | “变化方向与假设一致,构成初步信号” | “干预导致变化” |
| C2(对照支持) | 有合格基线或比较,并处理部分替代解释 | “现有证据与有限贡献一致” | 忽略污染、工具变化或外部事件 |
| C3(重复支持) | 有更强比较、实施忠实度和结构化重复或证伪支持 | “在限定范围内获得较强贡献支持” | 把重复次数当成独立复现 |
| C4(跨批复现候选) | 暂定为更强跨批复现 | 只能说明“候选”,并列明未知准入条件 | 项目团队自行授予C4 |
| C5(强经验规律候选) | 暂定为接近稳定、可复现和高外部有效性的强支持 | 当前不得作为项目结论授予 | 宣称普遍规律或内部机制 |
C4与C5的正式准入标准保持Unknown(未知)。等级必须绑定一条明确Causal Claim(因果命题),不能对整个项目、整家公司或整套服务一次性评级。
六、Scope(适用范围)
每项结论至少绑定:
- Entity(实体);
- Decision Situation(决策情境);
- Query Cluster(查询簇);
- Functional Probe(功能性探针);
- Paraphrase(同义改写);
- Run or Dependency Cluster(运行或依赖簇);
- Engine and Product Mode(引擎与产品模式);
- Account and Context State(账户与上下文状态);
- Region and Language(地区与语言);
- Time Window(时间窗口);
- Evidence and Instrument Version(证据与测量工具版本)。
“在本次测试中”不能省略上述关键条件,也不能被改写为“人工智能普遍认为”。
七、从观察到结论的升级门
Raw Record(原始记录)
→ Completeness Check(完整性检查)
→ Versioned Coding(版本化编码)
→ Descriptive Result(描述性结果)
→ Operational Hypothesis(操作性假设)
→ Predefined Test(预定义检验)
→ Structured or Independent Replication(结构化或独立复现)
→ Validated Pattern Candidate(已验证模式候选)
→ Formal Admission Review(正式准入审查)
→ Validated Pattern(已验证模式)
任一门未通过时,结论停留在当前状态;不能因为客户需要、市场表达或报告完整性要求而越级。
八、报告措辞对照
| 观察或证据状态 | 合规措辞 | 禁止措辞 |
|---|---|---|
| 单次答案出现品牌 | “本次答案提及了目标实体” | “人工智能已经认识该品牌” |
| 页面显示为引用 | “答案显示引用该页面” | “人工智能信任该来源” |
| 页面公开可访问 | “页面在检查时可公开访问” | “人工智能已经收录或检索” |
| 多次答案出现相似模式 | “在限定样本中观察到条件化重复” | “模型形成稳定认知” |
| 干预后指标上升 | “观察到干预后变化;因果等级为C0或C1” | “本次优化带来提升” |
| 有合格比较与部分替代解释处理 | “现有证据与有限贡献一致,等级为C2” | “已经证明全部变化由服务导致” |
| 企业不适配但答案未推荐 | “答案执行了与资格一致的正确排除” | “品牌可见性失败” |
| 资料不足 | “当前为Unknown(未知),需要补充……” | “根据行业常识可判断……” |
| 未实施动作 | “形成No Action(不行动)记录及复查条件” | “项目没有产出” |
| 真实行为测试尚未执行 | “系统为行为验证候选” | “系统已经稳定运行” |
九、销售与代理转述边界
销售、代理商和客户报告不得:
- 把章节、Skill(技能)或文件数量写成效果证明;
- 把Deterministic Integration-ready(确定性集成就绪)写成真实DeepSeek(深度求索)行为通过;
- 把Mention(提及)、Citation(引用)、Absorption(吸收)、Attribution(归属)和Decision Use(决策使用)合并为“收录”;
- 使用“人工智能更信任”“提高内部权重”“保证推荐”“必然获客”等越权表达;
- 删除失败、无变化、负向、无法判断、不行动、护栏或适用范围;
- 用业务结果倒推人工智能中介链成立;
- 自行授予Validated Pattern(已验证模式)、C4或C5。
十、结论登记模板
每条重要结论至少记录:
| 字段 | 内容 |
|---|---|
| 结论编号与原文 | 可被逐字复核的结论 |
| Epistemic Status(认识状态) | 当前知识阶段 |
| Observability(可观测性) | 直接、编码、推断或未知 |
| Claim Mode(命题性质) | 描述、比较、因果、预测、规范或推荐 |
| Causal Confidence(因果置信度) | C0—C5;非因果命题标记不适用 |
| Scope(适用范围) | 完整条件边界 |
| 来源 | 原始记录、对象编号和版本 |
| 反证与替代解释 | 什么会削弱、限制或推翻该结论 |
| 允许措辞 | 对内、客户、公开与代理版本 |
| 禁止推论 | 不得由此推出的更强结论 |
十一、来源
本附录主要提炼自:
- 第3章《GEO Epistemology(GEO认识论)》;
- 第16章《Measurement and Attribution(测量与归因)》;
GEO-Service-System-v2/contracts/CORE_CONTRACTS.md;GEO-Service-System-v2/contracts/GATES_AND_PERMISSIONS.md。
本附录不产生新的因果等级,也不改变正式假设登记。当前Validated Pattern(已验证模式)仍为空。