Grok 4.5 发布,部分 Benchmark 超过 Opus 4.8
https://x.ai/news/grok-4-5https://pbs.twimg.com/media/HMuQw2BXUAAJaQd?format=webp&name=medium
亮点:
在 DeepSWE ,Terminal Bench 中超过 Opus 4.8 Max
$2 百万输入 / $6 百万输出
80 TPS
Token 效率比 GPT 5.5 ,Opus 4.8 高。Artificial Analysis 单任务花费少于 GLM 5.2
支持视觉,500K 上下文,马斯克说后续将扩展到 1M
如果体验能跟上分数,Grok 又能上桌了。 难道说?明天 GPT 5.6 ,这两天真热闹啊 cursor 已经上了, 而且叫 cursor grox 4.5 @jjx #2 是的,而且计费放在 First-party models 试试老马的怎么样。 效果如何? minimax 一点也不服气,有人评分比的过我 怪不得 a\天天一惊一乍上蹿下跳,coding 场景下的竞争压力确实大 有 7 天使用,赶紧薅羊毛 已在 Cursor 中用上 Grok 4.5 ,体验中,也跟大家分享个 cursor 号池,性价是真的高 https://ydy.ca/r/Xpo
页:
[1]
2