EN
AI模型

桌面 Agent 之战:Codex、Antigravity 与 Cursor 正在重写软件开发入口

Codex、Google Antigravity 与 Cursor 都在把产品重心从代码编辑器移向多 Agent 桌面工作台。本文比较三条路线,并预测桌面 Agent 将如何改变开发流程、软件组织、安全边界与 IDE 的未来。

Jacky Wang 9 分钟阅读 41 阅读

过去两年,AI 编程工具的竞争集中在一个问题上:谁能更准确地补全代码、理解仓库并修改更多文件。如今,OpenAI Codex、Google Antigravity 与 Cursor 几乎同时把产品重心移向一种新的形态——独立于传统编辑器、可以并行调度多个 Agent 的桌面工作台。

这不是简单地给 IDE 换一层聊天界面。新的桌面 Agent 不再围着当前文件和光标工作,而是围着任务、运行环境、权限、证据和交付结果组织软件开发。开发者的核心动作也随之改变:从亲自写每一段代码,转向分派任务、提供约束、检查证据并决定什么可以合并和发布。

真正的竞争因此不再只是“谁的模型写代码更强”,而是:谁能成为人类监督数字工程团队的操作系统。

三家公司为何同时走向桌面 Agent?

聊天框和 IDE 侧栏适合处理短任务,但当 Agent 可以连续工作几十分钟甚至数小时,旧界面会迅速暴露局限:多个任务混在同一窗口、Agent 与人类争用本地文件、审批请求不断打断工作、云端结果难以接回本地,开发者还要在终端、浏览器、GitHub 和部署平台之间反复核对。

桌面 Agent 试图把这些问题收拢到一个任务中心:每个 Agent 拥有独立上下文和执行环境,任务可以并行运行,产出通过 diff、截图、视频、测试日志和部署状态交付给人类复核。

三家公司抵达了相似的产品形态,但出发点并不相同。

Codex:把桌面做成多 Agent 指挥中心

OpenAI 在 2026 年 2 月推出 Codex macOS 应用,并在 3 月扩展到 Windows。官方把它定义为 Agent 的“command center”:用户可以按项目组织多个任务,让 Agent 在隔离的 Git worktree 中并行工作,在同一个线程里查看变更、评论 diff,并在需要时把代码交回编辑器。

Codex 的明显优势是把本地执行、云端任务、Skills、自动化和 ChatGPT 账户体系连接起来。它不要求开发者放弃现有 IDE,而是把编辑器降为众多工作界面之一:复杂任务可以先由 Agent 在隔离环境中完成,人类再决定是否进入本地工作树。

OpenAI 的长期方向也已经超出代码生成。官方明确表示,Codex 正从“写代码的 Agent”变成“使用代码在电脑上完成工作”的 Agent,并计划通过云端触发器让自动化在电脑关闭后继续运行。

这条路线的核心不是重做 VS Code,而是建立一套跨本地、云端和知识工作的 Agent 控制层。

Antigravity:把多模态创作与软件执行放进同一平台

Google 最初把 Antigravity 描述为 agent-first development platform:Agent 可以跨编辑器、终端和浏览器完成任务,并用计划、截图和其他 artifacts 向用户解释结果。2026 年 Google I/O 发布的 Antigravity 2.0 更进一步,成为独立桌面应用,支持多个 Agent 并行执行,例如一个 Agent 开发网站,另一个同时生成品牌资产。

Google 的差异化来自其产品覆盖面。Antigravity 不只连接代码仓库,还能自然延伸到 Gemini 模型、Android、Firebase、Google AI Studio、Chrome DevTools 和 Google Cloud。它更像一个面向“构建者”的工作台,而不只是专业程序员的代码工具。

Antigravity 2.0 同时加入 subagents、hooks 和异步任务管理,并把相同的 Agent harness 提供给 CLI 与 SDK。桌面端因此不是孤立产品,而是 Google Agent 运行时的一块可视化控制面板。

如果这条路线成立,未来产品经理、设计师或创业者可能不需要先进入一个代码项目:他们可以从需求、视觉资产或业务数据开始,让不同 Agent 在后台把这些输入汇合成可运行的软件。

Cursor:从 AI IDE 变成 Agent 工作空间

Cursor 的起点最接近传统开发者:它先以 VS Code 分支和智能补全占领编辑器,然后逐步加入 Agent、CLI、云端执行和远程机器。2026 年推出的 Cursor 3 则从头构建了一个以 Agent 为中心的新界面——Agents Window。

这个界面统一展示本地 Agent、worktree、云端 Agent 和远程 SSH 环境,并支持多仓库管理。开发者可以让多个 Agent 并行工作,在云端与本地之间移交会话,再随时切回完整 IDE 深入编辑。云端 Agent 还会通过截图、视频和日志证明自己测试过什么,而不只提交一份 diff。

Cursor 随后继续把运行时向外扩张:Agent 可以在隔离虚拟机里操控软件和浏览器,也可以运行在企业自己的 Mac、Linux 或第三方沙箱中。官方的目标已经不是“最聪明的编辑器”,而是能够自动创建 PR、处理 CI、跟进评论、监控发布并发现回归的“self-driving codebase”。

Cursor 的优势在于它仍然保留了最顺滑的人工接管路径。对于需要随时进入代码细节的工程师,Agent 工作区与 IDE 共存,比完全离开编辑器更容易迁移。

三条路线的真正区别

表面上,三款产品都有多 Agent、并行任务、隔离环境和成果审查。更深层的差异是它们希望控制哪一层:

  • Codex 更像通用 Agent 控制面:以任务和线程为中心,强调 Skills、自动化、本地与云端连续性;
  • Antigravity 更像 Google 构建生态的统一入口:把代码、浏览器、设计资产、移动端与云服务放入同一 Agent 平台;
  • Cursor 更像从 IDE 内部生长出来的软件工程系统:强调仓库、PR、测试、部署和人类随时接管代码。

短期内没有一种路线会彻底胜出。大型团队会更在意权限、审计和私有执行环境;个人开发者会偏好低摩擦、本地感强的工具;非专业开发者则可能选择能直接生成、预览和发布完整应用的平台。

我的判断:未来 12–18 个月会发生什么?

以下是基于当前产品路线的预测,而不是已经发生的事实。

1. IDE 不会消失,但会退到“精密操作模式”

Agent 工作台将成为启动任务、追踪进度和审查结果的默认入口;IDE 则用于高风险修改、复杂调试和需要人类精确控制的局部工作。开发者进入 IDE 的频率可能下降,但每次进入时处理的问题会更难。

2. Diff 将不再是充分的交付证据

当 Agent 开始修改前端、桌面应用、数据流程和部署配置,仅看代码差异无法证明任务完成。截图、视频、测试报告、浏览器轨迹、性能对比、数据库迁移检查和生产监控会成为标准化的“证据包”。谁能让证据可信、易读、可复现,谁就更容易获得用户授权。

3. 本地与云端的边界会变成动态调度问题

简单、敏感或需要访问本机状态的任务在本地执行;耗时、并行或需要专用环境的任务进入云端或企业自托管机器。同一个会话会在这些环境之间迁移,用户无需理解底层容器、虚拟机或 worktree。

4. Agent 之间会出现真正的角色分工

今天的“多 Agent”经常只是同时运行多个相似模型。下一阶段会出现更稳定的角色:规划 Agent 拆解任务,执行 Agent 修改代码,验证 Agent 独立复现结果,安全 Agent 检查权限与数据流,发布 Agent 观察上线后的真实信号。关键不是数量更多,而是责任边界更清晰。

5. 权限设计会成为桌面 Agent 的核心产品能力

当 Agent 能点击桌面、读取仓库、访问浏览器、调用云服务并发布软件,传统的“每条命令弹窗确认”会导致审批疲劳。产品会转向能力范围、持续时间、目标资源和风险等级组合的授权方式,例如“允许这个 Agent 在该 worktree 内运行测试,但不得访问生产凭据或对外发布”。

再看 2–3 年:软件团队会怎样变化?

最可能发生的不是程序员被一个万能 Agent 直接取代,而是软件组织的吞吐结构发生改变。

一个工程师可能同时监督 5–20 个并行任务,亲自编写的代码比例下降,花在需求拆解、验收标准、架构边界和异常处理上的时间上升。初级工作不会完全消失,但“照着票据实现一个明确功能”的价值会明显降低;能够判断需求是否合理、系统是否真的可运行、结果是否安全的人会更重要。

代码仓库也会为 Agent 重构。高质量的 AGENTS.md、可重复环境、稳定测试、结构化日志、清晰模块边界和机器可读的发布流程,会从工程整洁度问题变成直接影响产能的资产。过去只有大型团队愿意投入的内部平台工程,可能被 Agent 倒逼成为普通项目的基础设施。

与此同时,软件开发会与知识工作逐渐合流。当桌面 Agent 能同时操作代码、浏览器、表格、文档和业务系统,“开发任务”与“运营任务”的界线会变得模糊。大量内部工具不再先写 PRD、排期、开发和部署,而是由业务人员描述目标,Agent 生成工具,并由工程团队提供权限模板、数据边界和质量闸门。

这个方向最大的风险是什么?

桌面 Agent 的危险不只在于写错代码,而在于它们拥有越来越完整的行动链:读取上下文、修改文件、运行命令、打开浏览器、调用第三方服务,甚至发布到生产环境。

因此,未来的竞争很可能由以下能力决定,而不仅是模型跑分:

  • 隔离环境能否防止任务相互污染;
  • 凭据是否按任务最小化暴露并可随时撤销;
  • Agent 的每个关键动作是否可审计、可回放;
  • 高风险动作是否有独立验证与人类最终授权;
  • 任务失败后能否安全回滚,而不是只生成一段解释;
  • 团队能否知道哪些结果来自真实运行,哪些只是模型声称完成。

桌面 Agent 越强,产品就越需要把“可操作”与“已授权”、“已经运行”与“已经验证”明确分开。

结论:下一代开发工具不是更聪明的编辑器

Codex、Antigravity 和 Cursor 的共同信号非常清楚:AI 编程正在离开单文件、单对话、单 Agent 的阶段。下一代开发工具的核心界面不会是一块更聪明的代码编辑区,而是一个能够调度多个执行环境、组织长期任务、展示证据并控制权限的 Agent 工作台。

短期竞争看模型质量和使用体验;长期竞争看运行时、生态、信任与组织记忆。真正建立护城河的公司,不一定是第一个让 Agent 写出更多代码的公司,而可能是第一个让个人和团队放心地把更多真实工作交出去的公司。

参考资料

推荐站内阅读

发表评论