OpenAI hat auf Bluesky eine frühe Ankündigung zum neuen Voice-Feature GPT-Live gemacht: Das Modell kann nun gleichzeitig hören und sprechen. Dafür hat das Unternehmen den gesamten Voice-Stack von der Client-Seite bis zum Modell selbst neu aufgebaut.
Kurz & knapp
- GPT-Live kann während des Sprechens kontinuierlich zuhören
- Der Voice-Stack wurde komplett neu architektiert – von Client bis Modell
- Audio fließt kontinuierlich, ohne dass tiefere Reasoning-Prozesse oder Tool-Nutzung das Gespräch unterbrechen
- Feature soll sich "natürlich" in der ChatGPT-Skalierung anfühlen
Was das bedeutet
Die Architektur-Überarbeitung zielt darauf ab, dass Nutzer ChatGPT unterbrechen können, während das Modell noch spricht – ähnlich wie in natürlichen Gesprächen. Bislang mussten Sprachmodelle meist warten, bis sie fertig gesprochen hatten, bevor sie neue Eingaben verarbeiten konnten.
Für deutsche Unternehmen, die Sprachschnittstellen in ihre Anwendungen integrieren, könnte das ein Hinweis sein, dass Echtzeit-Gesprächsfähigkeiten bei KI-Assistenten zum Standard werden. Offen bleibt, wann GPT-Live für alle Nutzer verfügbar ist und welche technischen Anforderungen es mit sich bringt.
Quellen
Redaktionell verantwortet von Ideal Syka. Quellen und Arbeitsweise: Redaktion & Methode. Hinweise und Korrekturen: ai@i6eal.de.




