📢 X投稿文
小規模(87M)なKokoroモデルをRust実装。高品質な音声合成を高速に実行。英語・中国語・日本語・ドイツ語対応のTTSツール。
https://github.com/lucasjinreal/Kokoros
🤖 AI考察
■ 概要
87M パラメータの軽量 TTS モデル Kokoro を Rust で高速推論する実装で、ストリーミング対応により 1-2s の time-to-first-audio を実現。
■ 特徴・用途
OpenAI 互換 API で並列処理に対応し、組み込みや WASM ビルドが可能な設計。複数言語対応(英語・中国語・日本語・ドイツ語)で、ASMR やデジタルヒューマンのような実用的なユースケースが示唆されている。HuggingFace top 2 に位置する品質を小規模モデルで実現しており、エッジデバイスやサーバーサイド推論の両方に適用可能。
■ 結論
低遅延・軽量・API 互換な TTS が必要な実装では検討価値があるが、言語品質の「一部対応」表記から日本語を含む非英語圏では精度検証が前提。