Voice AI und Conversational Interfaces: Die Stimme der künstlichen Intelligenz
Herausgegeben von der Tanagra Akademie · Zuletzt aktualisiert am
Alle Inhalte sind mit Hilfe von KI entstanden.
Bis Mitte 2025 folgte jeder Sprachassistent demselben Muster: Erst hört das System zu (Speech-to-Text), dann denkt es nach (LLM), dann antwortet es (Text-to-Speech). Diese Kaskade funktioniert, hat aber einen grundlegenden Nachteil: Während das System spricht, ist es taub. Es kann nicht unterbrochen werden, registriert keine Zwischenfragen und erzeugt jene unangenehmen Pausen, die jeder kennt...
Auf einen Blick
| Kategorie | KI-Werkzeuge |
|---|---|
| Niveau | Fortgeschritten |
| Dauer | 45 Min |
| Sprache | Deutsch |
| Zugang | im Abo enthalten |
| Zuletzt aktualisiert |
Inhalt des Kurses
- Lektion 1: Der Architekturwechsel: von der Kaskade zum Full-Duplex
- Lektion 2: Die neuen Voice-Modelle: GPT-Live-1, Gemini 3.8 Live und mehr
- Lektion 3: Voice-Plattformen: ElevenLabs, Deepgram, AssemblyAI
- Lektion 4: Voice Agents im Kundenservice: Parloa, Cognigy und der deutsche Markt
- Lektion 5: Voice Cloning, TTS-Produktion und neue Anwendungen
- Lektion 6: Regulierung: EU AI Act Art. 50 und Kennzeichnungspflicht
- Lektion 7: Praxis: Ihre eigene Voice-Lösung planen und umsetzen
Vollständiger Kurs
Dieser Kurs ist Teil des Akademie-Abos. Enthalten sind alle Kurse des Katalogs, laufende Aktualisierungen und neue Kurse während der Laufzeit.