AI 编码代理读代码比人快,但上下文有限,且每次会话都“从头入职”。我用同任务、同模型的双臂对照实测 AOCI:成本几乎持平(+0.7%),真实工具错误率从 8.0% 降到 3.2%,错误从“已执行的破坏”变成“被拦截的意图”。当 agent 干得比人审得快,只有审计执行轨迹才能发现测试假绿。 Source…
AI 编码代理读代码比人快,但上下文有限,且每次会话都“从头入职”。我用同任务、同模型的双臂对照实测 AOCI:成本几乎持平(+0.7%),真实工具错误率从 8.0% 降到 3.2%,错误从“已执行的破坏”变成“被拦截的意图”。当 agent 干得比人审得快,只有审计执行轨迹才能发现测试假绿。 Source…
讨论
登录后参与讨论
还没有评论,来说第一句吧。