sanoTTS logo

sanoTTS

開く

294k〜2.3M パラメータの超小型ニューラル TTS。ブラウザまたは約 3 ドルの ESP32-S3 でオフライン合成。11 ボイス、6 言語、GPL-3.0。

共有:
代替ツールを見る

sanoTTS は Ampixa の超小型ニューラル音声合成ファミリーです。名前はネパール語で「小さい」。GitHub の Ampixa/sanoTTS は GPL-3.0 で、作成日は 2026-07-11。2026-09-05 の API では約 186 star。README のパラメータ数は 294k(heart-nano、int8 重み 337 KB)から 2.27M(heart、24 kHz)です。Python 経路は numpy 推論で、PyTorch も ONNX Runtime も使いません。ブラウザは WebAssembly、サーバ不要。Arduino / PlatformIO 移植は約 3 ドルクラスの ESP32-S3 向けです。

より大きなオープンウェイト多言語 TTS と音声デザインが必要なら Breeze TTS 2、ホスト型 API なら ElevenLabs Turbo v2.5 を見てください。

主な機能

  • 数百 KB で一式heart-nano は 294k / 337 KB の完全 TTS スタックと書かれています。大きい声(hearthfcamy-1p8mamykristinviidamy-1p1m)はサイズと音質のトレードオフです。
  • クラウド不要:Python CLI、ブラウザ WASM、マイコンファームウェアはすべてローカル。声は初回に huggingface.co/ampixa/sanoTTS から入り、GitHub Releases が予備です。
  • 6 言語、11 ボイス:英語、ネパール語、ヒンディー語、ベトナム語、インドネシア語、中国語(README 準拠)。
  • espeak-ng フォネマイザ同梱:ブラウザデモは端末内で音素化します。1 ボイス 4 MB 未満がプロジェクトのサイズ主張です。
  • 入れ方pip install sanottsnpm install sanotts-web、Arduino zip / PlatformIO lib_deps、または ライブデモ

制約:GPL-3.0 はコピーレフトです。プロプライエタリ製品に入れると Apache-2.0 の TTS よりライセンス作業が増えます。音質はフロンティアのホスト型声に届きません。star はまだ少なく、SCOREQ / UTMOS で sub-15M 首位という記述は作者側の主張であり、独立監査ではありません。

使用シナリオ

  • オフラインガジェット:ネットも NPU もない ESP32-S3 の玩具やバッジ。
  • 静的サイト:WASM とボイスファイルを CDN に置く。文書上の経路は sanotts-web
  • ローカルスクリプトsanotts say "Hello" --voice amy -o hello.wav。GPU 不要。

料金

ソフトウェアは GPL-3.0 で無料です。ホスト推論の SKU はありません。ハードウェアは手元のボード。README の 3 ドルは狙っている ESP32-S3 クラスであり、Ampixa がボードを売っているわけではありません。

はじめに

  1. ブラウザデモ に文を入れる。アップロードはありません。
  2. または pip install sanotts のあと sanotts say "Hello from a two megabyte voice." --voice amy -o hello.wav
  3. 声は既定で ~/.cache/sanotts/。Hugging Face が使えなければ SANOTTS_VOICE_SOURCE=github
  4. マイコンは arduino/README.md に従い、voices-v1 / voices-v2 の量子化ボイスを焼く。

一次情報:GitHub README

よくある質問

GPU は必要か?

不要です。Python は numpy、MCU は ESP32-S3 の int8 です。

商用利用は?

バイナリを配布するなら GPL-3.0 は対応するソース開示を求めます。ライセンスを読んでください。このページは法律助言ではありません。

重みはどこか?

Hugging Face ampixa/sanoTTS。予備が GitHub Releases です。

代替案

  • Breeze TTS 2:より大きな英中オープンウェイト TTS。音声デザインとクローン。
  • ElevenLabs Turbo v2.5:ホスト型低遅延 TTS。
  • OpenAI tts-1:すでに OpenAI を払っている場合の簡単な API TTS。

ヒント

  1. ボードを焼く前にブラウザデモで heart を聞く。
  2. CI では SANOTTS_VOICE_SOURCE を固定する。
  3. GPL を MIT/Apache アプリへ雑に混ぜない。ライセンスが製品制約です。

まとめ

sanoTTS はアリーナ点数よりバイトとミリワットを気にする人向けの TTS です。294k〜2.3M の声がブラウザと安価マイコンで動きます。デモリポジトリ から始めてください。

コメント

まだコメントがありません。最初のコメントを投稿してください!