查看: 3|回复: 3

借助语音大模型,实现 Linux 下的语音输入,邀请 Linux 桌面用户试试

[复制链接]

4

主题

25

回帖

62

积分

注册会员

积分
62
发表于 6 天前 | 显示全部楼层 |阅读模式
起因是昨天下午看到 IT 之家这个新闻:

识别、合成、实时交互全球第一,Qwen-Audio-3.0 系列语音模型上线阿里千问 AI 平台   https://www.ithome.com/0/990/679.htm

于是我搞了一套适用于大部分 linux 发行版和桌面环境的流程。平台送了 36000s (有效期 3 个月),到期后的话,我看了一下价格是每秒 0.00022 元

代码开源在 这里

截图如下,邀请用 linux 桌面的朋友们来试试。有用的话留个⭐呀。这套 flow 个人感觉在 linux 桌面环境很轻量,以后更换模型也很简单,稍微适配一下就可以了。

回复

使用道具 举报

4

主题

25

回帖

62

积分

注册会员

积分
62
 楼主| 发表于 6 天前 | 显示全部楼层
效果还是不错的,对于冒号,顿号、文字中夹杂着 APP 、10000 这种字母和数字,识别都还 OK
回复

使用道具 举报

0

主题

6

回帖

12

积分

新手上路

积分
12
发表于 6 天前 | 显示全部楼层
回去试试好不好使
回复

使用道具 举报

4

主题

25

回帖

62

积分

注册会员

积分
62
 楼主| 发表于 6 天前 | 显示全部楼层
@enpitsulin #2 谢谢欢迎反馈
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.

在本版发帖
返回顶部