xidaduo 发表于 2026-7-15 20:45:46

给「一人全干」做了一套 Skill,优化了 Grok 4.5 的短板,让中阶模型也能发挥威力

自从 Grok 4.5 发布之后,一直在高强度使用,总体感觉就一个字:快!

但是快的背后也有代价。相对于 Fable 5 、GPT 5.6 Sol higher 这些更强的模型来说,Grok 在这些更难的任务上还是有一些差距:

长任务的理解和执行

更加复杂的架构理解

用户交互体验

问题深度诊断

于是乎,根据自己最近的项目全干工作经验,写了一套 skill 。这套 skill 可以从产品到实现全自动化,人只需要:

输入任务

评审每个阶段的结果和验收

这套 skill 同时弥补了中低阶模型相对于更高级强大模型之间的差距,相当大程度上解决了 Grok 4.5 一些短板的地方。

implement skill 也可以单独拿来解决日常的小任务、修复小 bug 之类的,可以用 Claude Sonnet 5 、GPT Terra 这些多快好省的模型进行这一步的操作,效果也比较好。

总的来说,建立起来了一套比较可靠也比较实用的开发规范,感兴趣的朋友可以试试,使用过程如果有什么问题希望及时反馈,我会同步更新,非常感谢。

仓库: https://github.com/superchun/solo-ship

安装大致是:

git clone https://github.com/superchun/solo-ship.git
cd solo-ship
./scripts/install.sh --all   # agents / claude / codex / grok 软链
页: [1]
查看完整版本: 给「一人全干」做了一套 Skill,优化了 Grok 4.5 的短板,让中阶模型也能发挥威力