查看: 3|回复: 0

给「一人全干」做了一套 Skill,优化了 Grok 4.5 的短板,让中阶模型也能发挥威力

[复制链接]

3

主题

25

回帖

59

积分

注册会员

积分
59
发表于 2026-7-15 20:45:46 | 显示全部楼层 |阅读模式
自从 Grok 4.5 发布之后,一直在高强度使用,总体感觉就一个字:快!

但是快的背后也有代价。相对于 Fable 5 、GPT 5.6 Sol higher 这些更强的模型来说,Grok 在这些更难的任务上还是有一些差距:

长任务的理解和执行

更加复杂的架构理解

用户交互体验

问题深度诊断

于是乎,根据自己最近的项目全干工作经验,写了一套 skill 。这套 skill 可以从产品到实现全自动化,人只需要:

输入任务

评审每个阶段的结果和验收

这套 skill 同时弥补了中低阶模型相对于更高级强大模型之间的差距,相当大程度上解决了 Grok 4.5 一些短板的地方。

implement skill 也可以单独拿来解决日常的小任务、修复小 bug 之类的,可以用 Claude Sonnet 5 、GPT Terra 这些多快好省的模型进行这一步的操作,效果也比较好。

总的来说,建立起来了一套比较可靠也比较实用的开发规范,感兴趣的朋友可以试试,使用过程如果有什么问题希望及时反馈,我会同步更新,非常感谢。

仓库: https://github.com/superchun/solo-ship

安装大致是:

git clone https://github.com/superchun/solo-ship.git
cd solo-ship
./scripts/install.sh --all   # agents / claude / codex / grok 软链
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.

在本版发帖
返回顶部