Human in the Loop:别让人成为 Agent 的瓶颈

最近有个流行的缩写 HITL,即 Human in the Loop,描述的是在 Agent 流程中引入人类节点。

Agent 可以在很短时间里完成过去需要人长时间执行的工作:检索和理解代码、修改多个文件等。但 Agent 完成任务之后,人仍然需要理解修改、判断风险并作出决策。Agent 的执行速度提高了,人的判断速度却没有同步提高。

研发流程的瓶颈正在发生转移。过去:代码生产与任务执行、现在:理解、验证与决策

Agent 节省了执行时间,却可能制造更多等待人确认的任务。如果仍然沿用“Agent 每执行一步,人就审核一步”的协作方式,人会成为整个系统的瓶颈。所以,在 Agentic Software Development 中,人机协同的关键不是把人插入更多流程节点,而是重新设计人的注意力如何被调用。

两个例子

用 Review 工作台汇聚多角色决策

在一个生成式 UI 项目,页面模块不是由设计师直接产出,而是根据不同策略、业务数据和基础设计规范自动生成。

因为内容是生成的,每一批产物都需要前端、后端、产品经理和设计师共同 Review。前端关注实现约束,后端关注数据和接口,产品经理关注策略目标和业务效果,设计师关注视觉质量和规范一致性。

如果沿用传统的逐级审批流程,不同角色会在不同时间、不同渠道查看不同版本的产物。版本难以对齐,意见难以汇总,一轮评审需要经过多次等待和往返。

但这个项目需要快速、持续地上线几十个策略。如果每一批生成结果都要经历这样的流程,生成式 UI 即使提高了内容生产效率,也会被后面的人工评审完全抵消。

为了解决这个问题,我 Vibe 了一个 Review 工作台,把不同角色关心的信息以结构化、版本化的方式组织起来,并按版本记录评审意见。所有参与者看到的是同一批产物、同一组上下文和完整的历史意见。

在这个基础上,我只需要组织一次电话会议,就可以让所有角色在同一个上下文里集中评审,一次性完成筛选和决策。

工作台没有替代任何一个角色的专业判断。它解决的是判断之前的信息组织,以及判断之后的意见汇聚。它把分散、异步、逐级的反馈,压缩成了一次高密度的集体决策。

正是因为评审流程获得了足够高的决策吞吐量,这个生成式 UI 项目才真正具备可行性,并最终成功上线。

用产品观察台降低上下文负担

在另一个项目,团队建设一套端到端能力,让产品经理通过与 Codex 对话,自己完成一个承接页并最终上线。

从交互形式上看,产品经理始终处于同一个对话上下文中。但一个端到端项目包含大量持续变化的信息,比如:迭代在哪里?用到了哪些数据指标?使用了哪一种设计风格?当前处于什么阶段?下一步是什么?已经授权了哪些协议?

这些信息虽然存在于 Codex 的上下文里,却不等于人能够稳定地理解和记住它们。如果状态只散落在聊天记录中,产品经理就需要不断回看对话、恢复上下文和确认进度。对话越长,信息越多,人越容易迷失方向。

此时限制项目推进的不是 Agent 能否继续执行,而是人是否仍然知道项目在哪里、为什么这样做,以及接下来应该做什么。

为此,我开发了一个“产品观察台”,把散落在 Agent 上下文中的关键信息提取出来,以稳定、结构化的方式持续呈现。

产品经理仍然通过同一个对话完成工作,但不再需要依赖自己的短期记忆管理整个项目。对话记录被转化为当前状态,隐含上下文被转化为可见信息,漫长的执行过程被压缩为当前阶段和下一步。

产品观察台同样没有替代人的决策。它更像是 Agent 工作流与人之间的一个观察界面,让人能够用更低的理解成本持续掌握全局。

总结

现在,除了为 Agent 设计更好的 Harness,也要同时思考人的负载在哪里。比如,跨团队合作、注意力。有时,为人设计是提升全局效率的手段。

In the AGI era, Human could be out of the Loop.