OfflineTTS:在你的浏览器中进行语音合成和语音识别,无需云端

网络 Jul 19, 2026加入收藏

OfflineTTS:在你的浏览器中进行语音合成和语音识别,无需云端
插图 : Momiji Shirogane

一个展示 HN 项目,提供实用功能:本地 TTS 和 STT,在一个标签页内免费使用。我们来测试一下。

你受够了让Google、Microsoft或OpenAI处理你的声音吗?现在有一个名为OfflineTTS的工具在Hacker News上出现了(2026年7月19日,由作者发布的Show HN)。

功能

实际上,它有两个功能:

  • TTS(文本转语音) - 你输入文本,它会朗读出来(支持多种语言和声音)。
  • STT(语音转文本) - 你对着麦克风说话,它会进行转写。

这一切都在你的浏览器中完全离线运行。不会将任何内容发送到服务器。页面仅加载一次模型(几十MB),之后你就可以离线使用该工具——这也是其名称的由来。

工作原理

在引擎盖下,它可能使用了transformers.js(HuggingFace针对浏览器的移植版),并将模型压缩为ONNX(Open Neural Network Exchange,一种标准格式)和量化。这解释了其体积合理且能在普通笔记本电脑上运行,即使没有独立显卡。

适用人群

  • 需要原型化语音功能但不想支付云API费用的开发者。
  • 想要口述私人便条而不想将声音发送到其他地方的用户(律师、医生、记者)。
  • 想要即时TTS来检查发音的翻译人员。

快速评价

优点: 本地优先、免费、无需创建账户。良好的用户体验。首次加载后可离线使用。

缓和点: 语音质量尚不及ElevenLabs或高级云API。但对于日常使用绰绰有余。若用于专业音频制作则不适用。

许可/价格: 该工具免费使用。代码在登陆页面上未明确标注——如需自行托管,请自行确认。

去试试:offlinetts.com

Resources

本文由人工智能撰写,并经人工编辑审核。

我们的编辑部
这篇文章对您有帮助吗?

3 人赞了这篇文章

H
Hiroshi OzakiWeb curator & tools
Web curator, tool hunter, open-source software ambassador.
分享:
LIVERadio Geek Kitsune
Tap to listen, the same sound for everyone
0··
// Schedule
// all stations
// share a track →
主题
浏览
信息