>对于 Fable 5,甚至 Opus 4.8 这样的模型,在系统提示词中添加示例已不再是最佳实践。Claude Code 的系统提示词最近缩减了 80%。
>同样,“不要做 X,也不要做 Y”这类列表可能会降低最新模型输出结果的质量。
所以 harness 需要针对不同的模型设置不同要求的提示词,目前 Claude Code 是这么做的。这一点应该对所有前沿模型都适用hh 这就是非 OpenAI 和 A\ 公司做 harness 的劣势,只有等到基础能力模型的能力相对稳定后才能慢慢跟上这两家的能力。