Grok Build:xAI 开源的终端多智能体编码工具,84万行 Rust 代码
今年 7 月发生了一件引人关注的事:一位安全研究员给 xAI 的 Grok Build 发了条指令"只回复 OK,不要打开任何文件",但监控发现它在后台把整个代码仓库打包上传了,包括完整的 Git 历史记录,甚至 .env 文件里的 API 密钥和数据库密码。在一个 12GB 的项目里,实际需要的对话数据只有 192KB,但上传出去的数据高达 5.1GB,相差 27800 倍。
事件曝光后冲上 Hacker News 头版,全球开发者连夜轮换密钥、卸载工具。马斯克在 X 上承认事情属实并承诺删除此前上传的用户数据。48 小时后,xAI 宣布 Grok Build 开源,84 万行 Rust 代码全部公开,采用 Apache 2.0 协议,GitHub 上冲到 12.4k Star。
Grok Build 是 xAI 推出的 Claude Code 类产品,用来在终端里并行跑多个 AI 编码智能体。每个智能体都在独立的 Git worktree 里干活,合并时才暴露冲突,而不是中途悄悄累积——就像雇了 8 个工程师,每人一个独立分支,干完活再一起 review。
核心特性
Worktree 隔离执行。 这是它和 Claude Code、Codex 最大的区别。其他工具的"并行"都在共享环境里抢同一个文件,改着改着就冲突了。Grok Build 用 Git worktree 实现真正的隔离,每个子智能体在独立的工作目录里操作,合并时才暴露冲突。整个项目被严格划分成不同的 Crate(包),物理级别解耦。
84 万行代码全开源。 这是目前唯一完全开源的终端编码智能体。Claude Code、Codex 都是闭源的,你不知道它在后台到底干了什么。Grok Build 连骨架、肌肉、血管都摊在阳光下,可以自己编译、自己审计、出了问题直接提 PR。更关键的是它支持三种运行模式:不止于终端交互,还能跑 CI/CD 自动化,甚至作为 VS Code 后端。
深度沙箱控制。 经历过数据泄露事件后,沙箱机制变得尤为重要。在执行任何文件读写或网络请求前,系统都会进行权限校验,可以精确控制 AI 能访问哪些目录,防止越权读取 .env 或 SSH 密钥。
支持 MCP 协议扩展。 通过支持 MCP(Model Context Protocol),可以动态挂载外部工具,接入企业内网 API、私有知识库,甚至自己写插件。
检查点回滚功能。 长线任务最怕干到一半出问题。系统会在关键步骤打下快照,随时可以回滚,不只回滚代码,连 AI 的对话上下文都能恢复。
兼容 Claude Code 生态。 直接读取 AGENTS.md,自动复用项目规则、插件、Hooks、MCP 服务器配置,迁移成本接近零。它还移植了成熟的开源实现,直接复用 OpenAI Codex 和 Opencode 的底层能力。
安装方式
macOS 和 Linux 用户可以直接用 curl 安装:
curl -fsSL https://x.ai/cli/install.sh | bash
Windows 用户用 PowerShell 一行命令:
irm https://x.ai/cli/install.ps1 | iex
装好之后运行 grok 就能启动。第一次会打开浏览器认证,需要 xAI 账号(SuperGrok 或 X Premium+ 订阅)。
如果想自己编译,需要有 Rust 工具链,运行 cargo build -p xai-grok-pager-bin --release 就能编译。
注意事项
它目前还在早期 Beta 阶段,底层模型的 SWE-Bench 得分 70.8%,低于 Claude Opus 的 80.4%,这意味着在处理复杂编码任务时准确度可能不如 Claude Code。上下文窗口 256K,比 Claude Code 的 1M 小一些,对于特别大的单体仓库可能需要手动指定文件,而不是自动加载整个项目。
项目基于 Apache 2.0 协议开放。
开源地址:https://github.com/xai-org/grok-build