13.2 · Text-to-Speech (TTS) Requirements
Fungsi
Mengubah teks AI menjadi suara yang natural - ini adalah "suara" AI Companion.
Kebutuhan
| Aspek | Requirement |
|---|---|
| Kualitas suara | Natural, tidak terdengar robotik |
| Bahasa | English (American/British - opsi pilihan) |
| Kecepatan | Adjustable speed (slow/normal/fast) |
| Latency | < 2 detik untuk generate response |
| Emosi | Mampu mengekspresikan antusiasme, empati, dorongan |
| Konsistensi | Suara yang sama di setiap sesi (identitas AI) |
Penggunaan di ELJoy
| Konteks | Jenis TTS |
|---|---|
| AI berbicara | Real-time TTS dari respons AI |
| Repeat After Me | TTS untuk kalimat model |
| Shadowing | Pre-recorded atau TTS untuk audio yang diikuti |
| Instruction | TTS untuk instruksi sesi latihan |
Provider Candidates
- ElevenLabs
- Google Cloud TTS
- Azure Neural TTS
- OpenAI TTS