📢 X投稿文
複数言語対応のTTS、Kokoro-onnx。ONNX Runtimeで、量子化版は80MBと軽量。M1でほぼリアルタイム処理、CPU/GPU両対応。
https://github.com/thewh1teagle/kokoro-onnx
🤖 AI考察
■ **概要**
Kokoro-TTS を ONNX Runtime で軽量化したローカル TTS で、CPU/GPU 両対応・~300MB(量子化版~80MB)の小フットプリント。
■ **特徴・用途**
- **推論効率**: macOS M1 で準リアルタイムを実現し、CPU 環境でも実用速度が見込める。
- **展開容易性**: quantized モデルが ~80MB と Docker/エッジ環境での配置障壁が低く、冷起動時間も短い可能性。
- **多言語対応**: 複数言語・複数ボイス選択肢があり、単言語エンジンより柔軟性が高い。
■ **結論**
オンプレ TTS の代替基盤として検討価値あり;あなたの環境の Audio8 冷起動時間(~240秒)や VOICEBOX_GENERATION_TIMEOUT の設定課題を緩和できれば、kurage/backend/tts_gen.py の フォールバック優先度を入れ替える選択肢になり得る。