论坛
BBS
默认
简体中文
繁體中文
登录
全球主机MJJ交流论坛
»
论坛
›
主机交流
›
VPS综合讨论
›
最近 token 烧得多了,自己手搓了个智能路由 MiniRouter ...
返回列表
发新帖
查看:
8
|
回复:
0
最近 token 烧得多了,自己手搓了个智能路由 MiniRouter
[复制链接]
lpffernando
lpffernando
当前离线
积分
3
1
主题
0
回帖
3
积分
新手上路
新手上路, 积分 3, 距离下一级还需 47 积分
新手上路, 积分 3, 距离下一级还需 47 积分
积分
3
关注TA
发消息
发表于 2026-7-13 21:40:03
|
显示全部楼层
|
阅读模式
最近发现一个很现实的问题:Fable 、GPT-5.6 、GLM-5.2 这些强模型真的很好用。
但是……如果每一次 AI 请求都调用最贵模型,账单真的扛不住。
比如:✍️ “帮我润色一句话” 📄 “总结一篇文章” 💻 “解释一段代码”
这些任务,真的需要每次都上最强模型吗?
于是我做了一个小工具:
MiniRouter 🚀 它可以帮你自动判断任务难度,然后选择合适的模型。
你只需要一个入口:
model = minirouter/auto
后面交给它:
🚀 简单任务 → 快模型(便宜、响应快)
⚖️ 日常开发 → 均衡模型(速度和质量平衡)
🧠 复杂推理 / 疑难排查 → 强模型(保证效果)
🖼 图片、多模态任务 → 视觉模型(适用于无 vision 能力的 LLM )
除了自动选模型,它还能帮你管理:
✅ 多模型统一 API ✅ OpenAI / Anthropic 兼容 ✅ 多渠道自动切换 ✅ API Key 和额度控制 ✅ Token 、费用、延迟统计 ✅ 查看每次为什么选择这个模型
简单来说:
让不同模型各司其职,而不是所有事情都用“大炮打蚊子”。
这个项目主要适合:
👨💻 AI 应用开发者 🤖 Agent / 工作流开发者 🏢 团队内部 AI 平台 ☁️ 有多个模型订阅或 API 的用户
如果你也在折腾 AI 应用,欢迎体验。
MiniRouter 已开源:GitHub:lpffernando/MiniRouter
欢迎 Star ⭐,也欢迎交流模型调度、Agent 架构。
回复
使用道具
举报
返回列表
发新帖
高级模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登录后才可以回帖
登录
|
立即注册
本版积分规则
发表回复
回帖并转播
回帖后跳转到最后一页
浏览过的版块
水池
Archiver
|
手机版
|
小黑屋
|
全球主机MJJ交流论坛
Powered by
Discuz!
X5.0
© 2001-2026
Discuz! Team
.
在本版发帖
返回顶部
快速回复
返回顶部
返回列表