Indi
Under the Sun with Paddy paddysun.top

AI 编码代理读代码比人快,但上下文有限,且每次会话都“从头入职”。我用同任务、同模型的双臂对照实测 AOCI:成本几乎持平(+0.7%),真实工具错误率从 8.0% 降到 3.2%,错误从“已执行的破坏”变成“被拦截的意图”。当 agent 干得比人审得快,只有审计执行轨迹才能发现测试假绿。 Source…

讨论

还没有评论,来说第一句吧。

Under the Sun with Paddy 的其他文章