查看: 11|回复: 9

跑本地大模型 电费要多少?

[复制链接]

0

主题

7

回帖

14

积分

新手上路

积分
14
发表于 2026-7-8 09:13:07 | 显示全部楼层 |阅读模式
想了解下跑本地 LLM 的兄弟们,有算过 1 度电能产出多少 token 么。

https://www.douyin.com/video/7651445609950281713
一度电 500 万,不懂啥模型
回复

使用道具 举报

0

主题

1

回帖

2

积分

新手上路

积分
2
发表于 2026-7-8 09:17:55 | 显示全部楼层
取决于你开多少卡, 一张 4090 跑推理,算他 400w 。10 张卡,不算其他电力的损耗,持续高负载推理一小时 至少 4 度电。  现在 LLM 最大的问题就在于此,其产出的价值都别说设备损耗了,电费都不见得能跑出来。
回复

使用道具 举报

2

主题

1

回帖

8

积分

新手上路

积分
8
发表于 2026-7-8 09:31:13 | 显示全部楼层
我记得我问过 AI ,其实现阶段 token 算上电费和设备损耗基本不赚钱,特别是深度推理
回复

使用道具 举报

3

主题

5

回帖

19

积分

新手上路

积分
19
发表于 2026-7-8 09:31:43 | 显示全部楼层
直觉上应该不会这么少的 token
回复

使用道具 举报

0

主题

3

回帖

6

积分

新手上路

积分
6
发表于 2026-7-8 09:44:50 | 显示全部楼层
不算输入,只有 216k 输出,0.25 度电,按视频 6 毛钱一度电来算,7 毛 5 每百万 token 。配置铭凡 7455hx+crucial 64G + rtx pro 4500 。模型用的是 Nvidia/Qwen3.6-27B-NVFP4 ,按照平均生成速度 60tokens/s 。
回复

使用道具 举报

0

主题

11

回帖

22

积分

新手上路

积分
22
发表于 2026-7-8 12:00:19 | 显示全部楼层
没算过,电费一个月 500 ,我一张 5090 跑 qwen-27b ,主机所在的房间火炉似的,温度比外面高一度以上,但本地模型效果垃圾得一 b ,又慢又卡🤮,玩多了真的觉得没啥意思,还是得云端模型才行
回复

使用道具 举报

0

主题

7

回帖

14

积分

新手上路

积分
14
 楼主| 发表于 2026-7-8 12:27:43 | 显示全部楼层
@VeteranCat #1 TDP450 吧,我记得,那跑不了 400w 吧,稳定能跑到 350w 就很不错了。8 卡 40990 的使用效果是怎样的,没部署过,评判不了。

@ldy619354397 #2 以现在市面上的定价,token 工厂生产商应该是不赚钱的,但人家的收入不在这

@BingoXuan #4 这种小参数的,没什么应用场景吧,我感觉最少要到 35B ,70B 算凑合。
回复

使用道具 举报

0

主题

8

回帖

16

积分

新手上路

积分
16
发表于 2026-7-8 13:00:50 | 显示全部楼层
@BingoXuan 这么对比 DeepSeek 和 opencode  zen 的免费模型真的很有性价比了
回复

使用道具 举报

1

主题

6

回帖

15

积分

新手上路

积分
15
发表于 2026-7-8 14:22:37 | 显示全部楼层
能产多少 token 取决于你用的什么卡、跑的什么参数的模型、模型架构是什么、跑的什么量化、有没有用其他优化。
按照现在个人本地部署普遍 qwen3.6 27b 或者 gemma4 31b 的情况下(两个都是能以单卡 5090 32G ,q4 量化部署的,参数量相对比较大的稠密模型),其实大概 60-80 左右的 tps 也出不了多少 token ,粗算一下一度电也就能出 40wtoken 左右。
自部署换用 MoE 模型倒是个提升吞吐量数字的好办法,可是消费级单卡能部署的 MoE 模型实际用起来都太笨了没什么用途,尤其有些 MoE 模型还默认强制开深度思考,那就更慢了。
回复

使用道具 举报

0

主题

2

回帖

4

积分

新手上路

积分
4
发表于 2026-7-8 14:32:41 | 显示全部楼层
以 token 提供商的角度, 即使你只计算电费, 也要 cover 训练使用的电...
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.

在本版发帖
返回顶部