3 Matching Annotations
  1. Aug 2026
    1. A model that absorbs permissions into itself has dissolved permissions. Absorption doesn’t end the harness. Absorption inverts the harness.

      全文最反直觉的一段,也是对“harness 是护城河”的反向预言:凡是能被权重吸收的 harness 能力迟早被吸收,Claude Code 删掉 80% 系统提示就是佐证。推论很实在——靠 harness 工程建立的优势,寿命按模型迭代周期计;能沉淀下来的是权限、身份、信任这些朝向人的接口。

    1. shows that system design – not model capability alone – can unlock frontier-level long-horizon performance

      方向性判断我同意:真正的运行单元是模型×harness×工具环境×上下文策略,不是裸模型。但“系统设计能解锁”和“这次提升由系统设计造成”是两回事,后者需要固定模型、只换 harness 的对照实验。目前公开材料只支持前者。

  2. Apr 2026
    1. a harness encodes an assumption about what the model can't do on its own

      这一洞见是Agent工程演进的底层逻辑:脚手架是对模型当前能力边界的妥协。随着基座模型能力跃升,曾经的“必要组件”可能沦为冗余开销。因此,解构并剔除过时假设,是保持系统简洁高效的关键。