Skip to content

阶段 2:Test Fixture、Grounding 与 Validator ​

问题 ​

模型第一次分析能抓到方向,但会补不存在的时间、概括错误、把小样本说成稳定模式。

分析 ​

先用 Self-Audit 修正 hallucination,再建立 Fact / Inference / Hypothesis / Unknown。

第二层问题 ​

即使 Skill 已加载,模型仍把 15 个任务数成 14,把高等代数 3 次数成 2。

推导 ​

问题不再是“看没看规则”,而是让语言模型做了 deterministic counting。

结论 ​

程序负责算准,模型负责想明白。

文件 ​

weekly_validator.py