从 2021 年的代码补全,到 2025 年的 Agent Mode,AI 编程工具的交互单位发生了明显变化。开发者不再只让模型补出当前函数,而是交代一个目标,让它查找相关文件、修改多处代码、运行命令,并根据错误继续修正。
这不是“补全变长了”,而是模型开始进入一个带反馈的执行循环。
智能体比聊天多了哪一步
聊天模型通常给出建议,开发者负责把建议复制到工程中。编程智能体可以观察仓库、选择工具、执行修改、读取测试结果,再决定下一步。它的输出不只是一段文字,而是一串对真实环境的操作。
循环带来了更高完成度。一个跨文件重构如果第一次遗漏引用,编译错误会成为新的上下文,智能体可以继续搜索和修复。软件工程本来就是不断获取反馈的过程,智能体只是把其中一部分循环自动化。
但它也会累积错误。第一步误解需求,后续十步可能非常勤奋地把错误方向实现完整。执行次数增加,不代表目标理解更准确。
任务边界比 Prompt 文采更重要
给智能体一句“优化这个项目”通常不会得到稳定结果。更有效的任务应包含目标、不能改变的行为、相关目录、验收命令和完成条件。例如明确“保持接口兼容,通过这些测试,不修改数据库结构”。
这与给新人分配任务很相似:背景和权限不足会让人反复猜测,范围无限又难以收尾。AGENTS.md、项目文档、测试和静态检查,本质上都在把团队隐性知识变成智能体可读取的约束。
未来代码库是否“适合 AI”,很大程度取决于它是否也适合一个刚加入团队的人:能否快速启动、测试是否可靠、目录职责是否清晰、错误信息是否可操作。
权限必须随动作逐级收紧
读取代码、修改文件、执行测试、安装依赖、访问网络和推送分支,风险逐级增加。为了省事而一次授予全部权限,会让提示注入、错误命令或依赖脚本拥有过大影响范围。
比较稳妥的模式是默认在隔离环境工作,限制可写目录和网络,让高影响动作需要确认,并保留完整操作记录。智能体生成的提交也要经过与人工代码相同的 CI 和评审,不能因为“测试跑过一次”就跳过责任链。
我的理解:开发者正在成为反馈系统的设计者
当写代码本身越来越快,清晰需求、可靠测试、短反馈周期和可回退提交会更加值钱。开发者的工作重心从逐行生产,部分转向设计智能体可以安全运行的环境。
这并不降低编程能力的重要性。恰恰因为智能体能一次改很多文件,人必须更快看懂差异,识别架构偏离和安全风险。不了解代码时,自动化只是把未知修改扩大。
Agent Mode 的长期意义,是让软件工程的质量基础暴露出来:文档混乱、测试脆弱、构建缓慢的项目,很难通过 AI 一夜变好;边界清晰、反馈可靠的项目,则会获得明显放大。
参考资料
本文是 2026 年整理断更期时写下的回顾,发布日期按事件所处阶段归档。