Appearance
阶段 2:Test Fixture、Grounding 与 Validator
问题
模型第一次分析能抓到方向,但会补不存在的时间、概括错误、把小样本说成稳定模式。
分析
先用 Self-Audit 修正 hallucination,再建立 Fact / Inference / Hypothesis / Unknown。
第二层问题
即使 Skill 已加载,模型仍把 15 个任务数成 14,把高等代数 3 次数成 2。
推导
问题不再是“看没看规则”,而是让语言模型做了 deterministic counting。
结论
程序负责算准,模型负责想明白。
文件
weekly_validator.py