← 返回趋势与播客

当 Agent 进入代码库,交付开始有了新的单位

交付要形成一条能被检查、修改与验收的工作链,一段回答或一次调用还不够。

趋势文章 · 参考来源:OpenAI · Introducing Codex·2025.05.16

软件团队正在遇到一个比“会不会写代码”更具体的问题:当模型能够读仓库,改文件并跑测试,它到底是一个更快的输入框,还是一个进入交付流程的新角色?OpenAI 在 Codex 的发布中,把任务放进带代码与工具的隔离环境,让 Agent 能完成修改、验证并交出可复核的结果。这种变化提醒我们,企业真正需要设计任务从提出到验收的边界。

这会改变 FDE 的切入点。我们不会先问该接哪一个模型,而会先拆开一次交付:谁定义完成?哪些事实可以由系统读取?哪些动作必须经过人确认?失败后结果回到哪里?当这些问题没有答案时,Agent 越能干,过程越不可控;当答案清晰时,Agent 才能把一段段零散的人力工作,收束为有责任边界的生产单元。

下一阶段的工程组织要给开发者配一套工具,也要为高频任务建立可追踪的上下文、测试与回滚机制。模型的能力增长会继续,但能不能留下业务价值,取决于每一次自动执行之后,企业是否拿到了可以再次使用的结果和判断。