📢 X投稿文
本をAI朗読化。LLMが話者や語調を自動判定、Qwen3-TTS で自然な音声生成。ローカルLLMに対応し、ブラウザで1行ずつ調整可能
https://github.com/Finrandojin/alexandria-audiobook
🤖 AI考察
■ **概要**
LLMがテキストを話者・台詞・TTS指示に自動解析し、Qwen3-TTSでオーディオブック化するローカルパイプライン。
■ **特徴・用途**
1. **LLM二段階パイプライン** — 初期解析→エラー修正パスで、話者分離・属性タグ除去・ナレーション/台詞の分岐統合を自動化。Ollama/LM Studioなど互換APIで柔軟に切り替え可能。
2. **ブラウザエディタによる細部調整** — 各行をHTMLで手動編集し、バッチ処理してから最終エクスポート。品質ゲートと試行錯誤を両立。
3. **ローカル実行と拡張性** — テキスト/LLM/TTSがオフライン統合されプライバシー確保、Qwen3限定ながら理論的に他TTS挿込も可能。
■ **結論**
LLM-TTS統合では良設計だが、Qwen3への依存度・長編テキストのエディタスケーラビリティ・日本語を含む多言語エラーパターンの完全性は実装前に確認推奨。