sanoTTS は Ampixa の超小型ニューラル音声合成ファミリーです。名前はネパール語で「小さい」。GitHub の Ampixa/sanoTTS は GPL-3.0 で、作成日は 2026-07-11。2026-09-05 の API では約 186 star。README のパラメータ数は 294k(heart-nano、int8 重み 337 KB)から 2.27M(heart、24 kHz)です。Python 経路は numpy 推論で、PyTorch も ONNX Runtime も使いません。ブラウザは WebAssembly、サーバ不要。Arduino / PlatformIO 移植は約 3 ドルクラスの ESP32-S3 向けです。
より大きなオープンウェイト多言語 TTS と音声デザインが必要なら Breeze TTS 2、ホスト型 API なら ElevenLabs Turbo v2.5 を見てください。
主な機能
- 数百 KB で一式:
heart-nanoは 294k / 337 KB の完全 TTS スタックと書かれています。大きい声(heart、hfc、amy-1p8m、amy、kristin、vi、id、amy-1p1m)はサイズと音質のトレードオフです。 - クラウド不要:Python CLI、ブラウザ WASM、マイコンファームウェアはすべてローカル。声は初回に huggingface.co/ampixa/sanoTTS から入り、GitHub Releases が予備です。
- 6 言語、11 ボイス:英語、ネパール語、ヒンディー語、ベトナム語、インドネシア語、中国語(README 準拠)。
- espeak-ng フォネマイザ同梱:ブラウザデモは端末内で音素化します。1 ボイス 4 MB 未満がプロジェクトのサイズ主張です。
- 入れ方:
pip install sanotts、npm install sanotts-web、Arduino zip / PlatformIOlib_deps、または ライブデモ。
制約:GPL-3.0 はコピーレフトです。プロプライエタリ製品に入れると Apache-2.0 の TTS よりライセンス作業が増えます。音質はフロンティアのホスト型声に届きません。star はまだ少なく、SCOREQ / UTMOS で sub-15M 首位という記述は作者側の主張であり、独立監査ではありません。
使用シナリオ
- オフラインガジェット:ネットも NPU もない ESP32-S3 の玩具やバッジ。
- 静的サイト:WASM とボイスファイルを CDN に置く。文書上の経路は
sanotts-web。 - ローカルスクリプト:
sanotts say "Hello" --voice amy -o hello.wav。GPU 不要。
料金
ソフトウェアは GPL-3.0 で無料です。ホスト推論の SKU はありません。ハードウェアは手元のボード。README の 3 ドルは狙っている ESP32-S3 クラスであり、Ampixa がボードを売っているわけではありません。
はじめに
- ブラウザデモ に文を入れる。アップロードはありません。
- または
pip install sanottsのあとsanotts say "Hello from a two megabyte voice." --voice amy -o hello.wav。 - 声は既定で
~/.cache/sanotts/。Hugging Face が使えなければSANOTTS_VOICE_SOURCE=github。 - マイコンは
arduino/README.mdに従い、voices-v1/voices-v2の量子化ボイスを焼く。
一次情報:GitHub README。
よくある質問
GPU は必要か?
不要です。Python は numpy、MCU は ESP32-S3 の int8 です。
商用利用は?
バイナリを配布するなら GPL-3.0 は対応するソース開示を求めます。ライセンスを読んでください。このページは法律助言ではありません。
重みはどこか?
Hugging Face ampixa/sanoTTS。予備が GitHub Releases です。
代替案
- Breeze TTS 2:より大きな英中オープンウェイト TTS。音声デザインとクローン。
- ElevenLabs Turbo v2.5:ホスト型低遅延 TTS。
- OpenAI tts-1:すでに OpenAI を払っている場合の簡単な API TTS。
ヒント
- ボードを焼く前にブラウザデモで
heartを聞く。 - CI では
SANOTTS_VOICE_SOURCEを固定する。 - GPL を MIT/Apache アプリへ雑に混ぜない。ライセンスが製品制約です。
まとめ
sanoTTS はアリーナ点数よりバイトとミリワットを気にする人向けの TTS です。294k〜2.3M の声がブラウザと安価マイコンで動きます。デモ か リポジトリ から始めてください。
コメント
まだコメントがありません。最初のコメントを投稿してください!
関連ツール
Breeze TTS 2
breezeblue.ai/breeze-tts-2
BreezeBlueのオープンウェイト多言語TTS。リアルタイム対話向けに設計され、参照音声なしの音声デザインと参照ガイドの音声ディレクションに対応。初回音声は40ms未満。
Spark-X2.5-4B
huggingface.co/XHToken/Spark-X2.5-4B
XHToken の効率的な 4B オープンウェイトモデル。ハイブリッド滑り窓注意機構でネイティブ 1M コンテキストを実現。コーディング・エージェント性能が高く、Apache 2.0、多言語。
Ling-3.0-flash
huggingface.co/inclusionAI/Ling-3.0-flash
inclusionAI の MIT ハイブリッド線形 MoE。総パラメータ 124B、活性化 5.1B。2026-08-21 に Hugging Face で再確認。
関連インサイト

Grok Bot と Hermes Bot:一人に、ようやく参謀本部と事務局がつく
Grok Bot は Cursor Pro+ に入った。Hermes Bot は VPS で走る。より賢いチャット窓ではない。助言するのは参謀本部、実行するのは事務局、決裁するのはあなただ。
Windows で OpenCode Go を Codex に繋ぐ。二セット目のツールは開くな
ChatGPT でログインした Codex デスクトップは、ピッカーにほぼ GPT しか出さない。Windows では OpenCode Go だけを開けば、すでに課金している Grok、GLM、Kimi、DeepSeek、MiniMax が同じセレクタに戻る。鍵はマシンから出ず、ネイティブ GPT もそのまま残る。
Codex を閉じ込めているのはモデルではなく、ピッカーだ
OpenCode Go、Grok、Z.ai にはすでに課金しているのに、Codex のピッカーはほぼ GPT しか出さない。コミュニティ製の codex-router が教えるのは手順ではない。すでに買ったモデル能力をセレクタに戻すこと。鍵はマシンから出ず、ネイティブ GPT もそのまま残る。