查看: 5|回复: 0

最近看到一个挺有意思的 TTS 项目:sanoTTS。

[复制链接]

16

主题

0

回帖

48

积分

新手上路

积分
48
发表于 1 小时前 | 显示全部楼层 |阅读模式
最近看到一个挺有意思的 TTS 项目:sanoTTS。

它的思路很直接:把 TTS 做到足够小。

最小的 heart-nano 只有 294K 参数,模型权重 337KB,最大的也就 2.27M 参数。甚至可以直接跑在大约 $3 的 ESP32-S3 上,不需要云端,也不需要 NPU。

而且浏览器里也能直接跑,WebAssembly 全部在本地完成,不需要把文本上传服务器。

目前有 11 个声音、6 种语言,Python、NPM、Arduino/PlatformIO 都能用。

我觉得这种项目比单纯把模型越做越大更有意思。

以后一个小玩具、一块 MCU,甚至一个网页,可能自己就能直接“开口说话”。

AI 不一定非得塞进云端。

能跑进 337KB 里,才是真的有点东西。

GitHub:https://github.com/Ampixa/sanoTTS

#


本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

关注公众号

相关侵权、举报、投诉及建议等,请发 E-mail:2776601884@qq.com

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|青ICP备2025004122号-1

在本版发帖
关注公众号
返回顶部