文章

我还在对话模式,是不是落后了?——一场 2.7 万人围观的讨论

我在 V2EX 发了一个关于 Agent 自动开发的困惑帖,27000 次点击、226 人收藏、191 条回复。这篇是提问的原文和我从回复里捞出的真话。

我还在对话模式,是不是落后了?——一场 2.7 万人围观的讨论

四月底我在 V2EX 程序员节点发了一个帖子,标题是:

现在网上都在说 Agent 自动开发,我还是在对话模式,是不是落后了?

没想到成了热帖:27000+ 次点击,226 人收藏,191 条回复。这篇把我的原始困惑和回复里捞出来的真话都记下来——因为”普通但真实”的行业状态,确实很少有人写。

我当时的困惑

我用 AI 辅助开发一年半,Claude、GPT、Cursor、Windsurf 每天都在用,算重度用户。但我的真实工作方式还是人主导 + AI 辅助的对话模式:遇到问题问 AI、让 AI 优化一段逻辑、review 一段代码、生成基础结构。

而网上的文章都在讲:AI 自己拆任务、自己写代码、自动 code review、自动提 PR——人只需要把需求说清楚。看多了开始焦虑。所以我抛了四个问题:

  1. 真的有人在真实项目里长期用 Agent 写代码吗(不是 demo)?
  2. “人只写需求,Agent 全自动”的流程真的存在吗?怎么搭的?
  3. 前端和后端的自动化难度是不是差别很大?
  4. 大家真实的模式到底是哪种——A)人写代码+AI 辅助;B)人设计结构+AI 写大部分代码;C)Agent 开发+人 review;D)Agent 基本接管?

回复里的行业真实图景

191 条回复过滤掉互相抬杠的部分,我提炼出这几条:

主流是 B 到 C 之间,D 只存在于个人项目。最多人给出的自我定位是”B 与 C 之间”或”基本上 C”。好几个人的原话高度一致:工作项目 C 模式(review 会看关键逻辑),个人项目 D 模式(完全不看代码);”自己项目全 AI 都不用 review,公司项目盯着 review,出事直接走人”。

一线大厂的高赞回复最扎心。一位大厂同学(9 个 ❤️)说:模式是 C,完全接管还不行,需要人做决策——”现在效率很高,但比以前更累。以前写代码还可以放空自己,现在脑子需要一直做判断、做决策”。他已经完全不 care 代码长什么样,核心工作变成了给足上下文;前后端没差别,团队已经全栈化。

UI 还原是公认的天花板。这条几乎没有争议:figma 丢给 AI 能还原 80-90%,最后一公里必须人工。有人点破了根源——Figma 的图层设计和 Web 不是一比一映射,这是底层上的差异,不是模型能力问题。更有意思的是一个反直觉观察:”网上全在喊前端彻底没了,结果大公司里最难让 AI 一步到位的恰恰是前端,后端纯逻辑反而小几轮就能收敛。”

接口变更的本质是上下文问题。我问”后端接口经常改字段,Agent 能自动感知吗”,最诚实的回答是:”他发现接口改了,你不告诉他新接口,他也只能瞎猜瞎试。告诉他新接口文档,可以自动调整。”解法大家也一致:文档同步机制、skill/hooks 自动更新、MCP 直接接入接口平台。

信任要靠工程手段挣来,不是靠模型许诺。往 C/D 走的人都在做同一件事:测试先行。”Spec 驱动还不够严谨,因为 spec 还是语言;TDD 才是核心——测试用例先行,越细越好,这样才能提升信心。”还有人让 AI 每次输出代码的同时附带风险报告和测试用例。

也有清醒的冷水。”能一把梭的项目可能只是简单的管理后台或玩具项目”、”AI 开发目前缺乏最佳实践,是闭眼狂奔阶段”、”前端开发的复杂性被低估了,能用和好用是完全不同的概念”、”写后台管理的前端和写重交互 toC 页面的前端完全不是一个概念”。

我现在的答案

发帖时我以为自己在问”我是不是落后了”,看完 191 条回复才发现真正的问题是“信任的边界画在哪里”

  • 对话模式不是落后,是把信任边界画得保守——每一步都过人的手
  • Agent 模式不是先进,是把边界外推——推到哪里,取决于你有没有测试、文档、规范这些工程护栏接得住
  • 所有说”完全不看代码”的人,要么在个人项目里(代价自己扛),要么已经建好了护栏(TDD、多轮 review、风险报告)

所以答案不是”快点切到 Agent”,而是先建护栏,再推边界。护栏建到哪,手就可以放到哪。

至于那句”效率更高但人更累”——我想它才是这个时代给开发者的真实账单:AI 接走了打字,把决策密度还给了人。这笔账怎么算,每个人得自己签字。

本文由作者按照 CC BY 4.0 进行授权