编程能力排名是 claude fable5 > gpt sol extra > claude 4.8 吗?
看到说,规划用 claude ,代码用 gpt 。那具体编码能力是claude fable5 > gpt sol extra > claude 4.8 吗? 个人感觉 kimi 3 和 GLM 5.2 比 GPT 写得好,但打不过 Claude 。参考编程能力排行榜
https://arena.ai/leaderboard/code/webdev 差不多 体感上是这样 体感好像是这么回事 @mmdsun 这个排行不靠谱,kimi3 排第 1 了。 4.8 快没法用了 这种直接看榜单就行了... 体感是没什么意义
https://arena.ai/leaderboard/agent
https://artificialanalysis.ai/models?intelligence=artificial-analysis-intelligence-index#intelligence 编程任务差不多是这样。但是其他任务就不一定了。 我经常使用 opus 和 gpt 进行互审,我的感受是 GPT 在细节上更好一点,opus 在整体架构上更好一点。 sol 前端太差了我都让 Claude 出前端样式再让 sol 改