@privil 但是楼主押宝的是 GB10 ,他的“显存”带宽很小。如果楼主买的是 rtx pro 6000 maxQ ,4 卡集群,我都认为合理。
GB10 就注定了大模型能跑,跑不快,小模型跑不过显卡。
AI 泡沫不炸之前,肯定划算。。。因为硬件保值。不考虑硬件的话,绝对不划算
op 买四台 4090 都比这个跑的快
@sentinelK #10 这玩意最近几个月都翻倍了。那是真炸裂啊
@privil 主要是还有个 Minimax H3 ,这个相比较 qwen3.8-27B ,要更炸裂一点。
相当于把 seedance2.0 的生产力下发给了终端。
@sentinelK #7 就算按 7:3 ,也不是 15~20 年啊,最多翻个 3 倍,算 10 年。
主要是这种估算变数比较大:
那里面估算的时候,取的是平均单次 API 调用花费¥0.004 ,这本身就有些低估。而且现在涨价了,估计单价这项得翻个几倍。
再加上多路并发,也可以有个几倍。
@sillydaddy 硬件如果要 10 年回本,那可以认为全生命周期就是无法回本的。
这里还存在新的软件架构不支持老硬件的风险
上游租用 gpu 部署模型也没大幅涨价吧,买全款和那些 21 年上车房子的有啥区别
https://i.imgur.com/agAJ0Rd.png
DGX Spark 硬件只能跑量化模型吧?
到目前为止 隐私定律还在发力除非 ai 厂商真的要涨价 10 倍