オフラインTTS:クラウドを使わずにブラウザで音声合成と音声認識

ウェブ yesterdayブックマークに追加

オフラインTTS:クラウドを使わずにブラウザで音声合成と音声認識
Illustration : Momiji Shirogane

Un Show HN qui livre du concret : TTS et STT en local, dans un onglet, gratuit. On teste.

Google、Microsoft、またはOpenAIにあなたの声を処理させることに飽きましたか? そこで、OfflineTTSがあります。これは、Hacker Newsに最近登場したツールです(2026年7月19日、作者によるShow HN)。

このツールの機能

実際には2つの機能があります:

  • TTS(Text-to-Speech) - テキストを入力すると、それを音声で読み上げてくれます(複数言語、複数の声に対応)。
  • STT(Speech-to-Text) - マイクに向かって話すと、それを文字起こししてくれます。

全てが完全にブラウザ内で動作します。サーバーに何も送信されません。ページはモデルを一度読み込みます(数十MB程度)、その後はオフラインでツールを使用できます - これが名前の由来です。

仕組み

裏では、transformers.js(HuggingFaceのブラウザ向けポート)が使われていると思われます。モデルはONNX(Open Neural Network Exchange、標準フォーマット)で圧縮され、量子化されています。これが、比較的小さなサイズと、GPU専用でない普通のラップトップでも動作する理由を説明しています。

対象者

  • クラウドAPIを支払わずに音声機能をプロトタイプ化したい開発者。
  • 声を他の場所に送信せずにメモを音声入力したい人(弁護士、医師、ジャーナリスト)。
  • 発音を確認するために即時TTSが欲しい翻訳者。

迅速な評価

良い点: ローカルファースト、無料、アカウント作成不要。良いUX。最初の読み込み後はオフラインで動作。

注意点: ElevenLabsやプレミアムクラウドAPIと比べて、音声の質はまだ競争力がない。日常使用には十分ですが、プロのオーディオ制作には不向き。

ライセンス / 価格: ツールは無料で使用できます。ランディングページにコードが明示的にラベル付けされていないため、自ホスティングする場合は確認が必要です。

試してみる:offlinetts.com

リソース

本記事は人工知能により作成され、人間の編集管理のもとで校閲されています。

編集部について
この記事は役に立ちましたか?

3 人がこの記事を評価しました

いいね
H
Hiroshi Ozakiウェブキュレーター & ツール
ウェブの有用な情報を発掘するキュレーター、ツールハンター、フリーソフトウェアの大使。
シェア:
LIVERadio Geek Kitsune
タップして再生、みんなで同じ音を
0··
// 番組表
// 全ステーション
// 楽曲を共有する →
テーマ
探索
インフォメーション