GSD Core:9天2000Star,解决AI编程上下文腐烂问题,每个任务给AI一个全新200K上下文
9天收了2000 Star。又一个 AI 编码工具在 GitHub 火了,它叫 GSD Core。连 Amazon、Google、Shopify、Webflow 的工程师都在用它。
社区真实案例:有人连续用了3个月,复杂任务完成度能做到95%,已经用它做出了自己的 SaaS 产品。另外一位系统工程师,没有任何编程经验,用它一个月生成了25万行代码,做出了一个完整的应用。
核心问题:上下文腐烂
GSD Core 要解决的核心问题就是上下文腐烂。
说的是 Claude Code 或者 Cursor 连续跑上几十个任务后,AI 的输出质量就会明显开始下滑。它会把之前定好的规则忘掉,反复追问已经回答过的问题,有时还会编造出一些根本不存在的东西。说白了就是因为 AI 的记忆里面塞进了太多信息,任务一长就分不清哪些是重点,哪些只是噪音。
最直接的 vibecoding 方式,所有对话和代码全都塞进同一个上下文当中,越往后越乱。GSD 的思路是:每个任务都会在一个干净的上下文里面去执行,这样即便跑到第50个任务,也和第1个任务一样清爽。
GSD 给每个任务都给 AI 一个崭新的200K token 上下文窗口。这听上去有些奢侈,但带来的效果却很明显。每个任务都在干净的上下文里执行,AI 根本就不需要背着之前所有任务的包袱向前走。这就好比每次开会都会换一间全新的会议室,而不是挤在一间越来越乱的房间里硬撑。
6个命令,每个只做一件事
它把整个开发过程拆成了6个命令,每个命令只做一件事。
01 项目初始化:/gsd-new-project 会先把你的想法转变成结构化的需求以及路线图,它会一步步来询问你所遇到的麻烦,协助你把需求梳理得更加清楚。
02 阶段讨论:/gsd-discuss-phase 则是在动手之前,先把实现细节聊透彻,消除掉那些灰色区域,避免掉后面反复返工的情况。
03 阶段规划:/gsd-plan-phase 会把每一个阶段拆解成具体的任务。走探究 → 计划 → 验证这样的循环,直到计划审查通过为止。
04 阶段执行:/gsd-execute-phase 负责去执行任务,沿用波浪式的并行执行方式,每个执行器都会获得一个全新的上下文窗口。
05 工作验证:/gsd-verify-work 检查构建出来的内容,诊断失败缘由,并且生成修复计划。
06 发布:/gsd-ship 则从验证阶段创建 PR,完成最终的交付。
这套流程看上去稍微有些重,实际使用起来反而比那种大杂烩式的 AI 编码方式更让人省心。因为每个阶段都拥有明确的边界,AI 就不需要在一个超长会话里同时去处理需求、规划、编码以及验证等多项工作。
其他细节特性
波浪式并行执行:它会先剖析任务相互之间的依赖关系,把那些没有依赖的任务放进一波里面并行执行,有依赖的任务则安排到后面的波次里依次推进。比如在 Wave 1 里跑任务 A 以及任务 B,它们互不干扰;到了 Wave 2 再跑任务 C,它需要依赖 A 和 B 所产出的成果。这样既保障了效率,又不会让 AI 在一堆纠缠不清的任务当中乱了阵脚。
原子 Git 提交:每个任务做完,它都会做一次 Git 提交。这样的好处是,如果哪个任务出问题了,很容易就回滚过去。
Nyquist 验证层:经常看到有人吐槽,用 AI 写代码写得很快,结果代码跑起来全是 bug。为了解决这个问题,它在 AI 动手写代码之前,会先确认一件事:写完以后怎么验证。它让每个任务都提前准备好验证方式,一条测试命令或者是一套明确的检查步骤都可以,总之要有。这样 AI 写完以后先跑一遍验证,确认真没问题,任务才算完成。
上下文窗口监控:它会实时显示上下文的使用率。到60%就会发出警告,到了70%就进入临界状态。这样有个好处是就能提前决定是不是要新开一个会话,防止窗口被撑满之后任务失败。
如何安装
打开电脑终端,复制下面的命令执行一下:
npx @opengsd/gsd-core@latest
执行到最后,页面会展示15种 AI 编程工具。按照序号提示,输入需要的数字编号就可以了。
注意装完后还不能直接用。打开上面选择的 AI 编程终端,比如 Claude Code,就在终端里执行 claude,然后就可以用上面提到的命令了。
注意事项
小项目建议不要用它,直接用 Claude Code 就好了,更省心。
顺便说一下,GSD Core 源自 get-shit-done 项目。今年4月原作者失联后,社区 Fork 出了现在的 GSD Core。
项目基于 MIT 协议开放。
开源地址:https://github.com/open-gsd/gsd-core