[{"data":1,"prerenderedAt":30},["ShallowReactive",2],{"nr-de-google-gemini-3-8-live-sprach-ki":3},{"slug":4,"title":5,"dek":6,"date":7,"time":8,"publishedAt":9,"updated":10,"updatedAt":10,"dateFmt":11,"updatedFmt":10,"kind":12,"tier":13,"author":14,"authorName":15,"topics":16,"tracker":22,"trackerLabel":23,"headlineStat":24,"image":25,"ogImage":26,"imageAlt":5,"csv":10,"minutes":27,"words":28,"html":29},"google-gemini-3-8-live-sprach-ki","Google stellt Gemini 3.8 Live vor – Sprach-KI mit Echtzeit-Reasoning","Google hat zwei neue Audio-Modelle gelauncht, die Sprachagenten mit erweiterten Denkfähigkeiten ausstatten. Gemini 3.8 Live Extended Thinking führt Benchmarks an und soll OpenAIs GPT-Live-1 Konkurrenz machen.","2026-09-16","08:14","2026-09-16T08:14:00+02:00","","16. September 2026","news","standard","ideal-syka","Ideal Syka",[17,18,19,20,21],"Sprach-KI","Gemini","Google","Extended Thinking","Voice Agents","\u002Fstand-der-ki","KI-Fortschritt","Gemini 3.8 Live Extended Thinking führt Speech-to-Speech-Quality-Index mit 82,6 Punkten an","\u002Fnewsroom\u002Fimg\u002Fgoogle-gemini-3-8-live-sprach-ki.webp","\u002Fog-nr\u002Fgoogle-gemini-3-8-live-sprach-ki.de.png",2,444,"\u003Cp>Google hat am 15. September 2026 \u003Cstrong>Gemini 3.8 Live\u003C\u002Fstrong> und \u003Cstrong>Gemini 3.8 Live Extended Thinking\u003C\u002Fstrong> vorgestellt – zwei neue Sprach-KI-Modelle, die natürlichere und intelligentere Sprachinteraktionen ermöglichen sollen. Die Modelle können komplexe Aufgaben im Hintergrund bearbeiten, ohne das Gespräch zu unterbrechen, und sollen damit ein neuer Standard für sprachgesteuerte KI-Agenten werden.\u003C\u002Fp>\n\u003Ch2>Kurz &amp; knapp\u003C\u002Fh2>\n\u003Cul>\n\u003Cli>\u003Cstrong>Gemini 3.8 Live Extended Thinking\u003C\u002Fstrong> führt den Speech-to-Speech-Quality-Index von Artificial Analysis mit \u003Cstrong>82,6 Punkten\u003C\u002Fstrong> an\u003C\u002Fli>\n\u003Cli>Modell erreicht \u003Cstrong>68,6 % auf τ-Voice\u003C\u002Fstrong> und \u003Cstrong>35,1 % auf Sierra&#39;s τ-Voice-banking-Benchmark\u003C\u002Fstrong> bei Agentic-Task-Completion\u003C\u002Fli>\n\u003Cli>Verfügbar ab sofort über \u003Cstrong>Gemini API, Google Workspace und die Gemini App\u003C\u002Fstrong>\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Tom Ouyang\u003C\u002Fstrong> (Principal Engineer) und \u003Cstrong>Malini Jaganathan\u003C\u002Fstrong> (Technical Staff) führen die Gemini Audio Team an\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Ch2>Zwei Modelle für unterschiedliche Anforderungen\u003C\u002Fh2>\n\u003Cp>Google differenziert zwischen zwei Varianten: \u003Cstrong>Gemini 3.8 Live\u003C\u002Fstrong> ist auf Skalierbarkeit und Kosteneffizienz ausgelegt und kombiniert Gesprächsintelligenz mit flüssigem Dialog und visueller Kontextualisierung. \u003Cstrong>Gemini 3.8 Live Extended Thinking\u003C\u002Fstrong> richtet sich an komplexe Aufgaben und bietet erhöhte Intelligenz sowie mehrstufiges Reasoning.\u003C\u002Fp>\n\u003Cp>Besonders hervorzuheben ist die Fähigkeit beider Modelle, \u003Cstrong>Unterbrechungen zu handhaben, zwischen Sprachen zu wechseln und ihren Denkprozess zu erklären\u003C\u002Fstrong>, während sie arbeiten. Das soll die Interaktion mit KI intuitiver und weniger frustrierend machen.\u003C\u002Fp>\n\u003Ch2>Benchmark-Führerschaft und Leistung\u003C\u002Fh2>\n\u003Cp>Gemini 3.8 Live Extended Thinking punktet mit starken Messergebnissen: Das Modell erreicht \u003Cstrong>97,7 % auf Big Bench Audio\u003C\u002Fstrong> und führt damit mehrere Industrie-Benchmarks an. Diese Zahlen deuten darauf hin, dass Google bei Sprach-KI-Qualität derzeit an der Spitze steht – besonders relevant im direkten Vergleich zu OpenAIs \u003Cstrong>GPT-Live-1\u003C\u002Fstrong>, das als Konkurrenzprodukt gilt.\u003C\u002Fp>\n\u003Cdiv class=\"tbl-scroll\">\u003Ctable>\n\u003Cthead>\n\u003Ctr>\n\u003Cth>Metrik\u003C\u002Fth>\n\u003Cth>Wert\u003C\u002Fth>\n\u003C\u002Ftr>\n\u003C\u002Fthead>\n\u003Ctbody>\u003Ctr>\n\u003Ctd>Speech-to-Speech Quality Index\u003C\u002Ftd>\n\u003Ctd>82,6\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>τ-Voice (Agentic Task Completion)\u003C\u002Ftd>\n\u003Ctd>68,6 %\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Sierra&#39;s τ-Voice-banking\u003C\u002Ftd>\n\u003Ctd>35,1 %\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Big Bench Audio\u003C\u002Ftd>\n\u003Ctd>97,7 %\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003C\u002Ftbody>\u003C\u002Ftable>\u003C\u002Fdiv>\n\u003Ch2>Verfügbarkeit und Zugang\u003C\u002Fh2>\n\u003Cp>Die neuen Modelle sind \u003Cstrong>ab sofort\u003C\u002Fstrong> für Entwickler und Unternehmen verfügbar – über die Gemini API für Custom-Integrationen, über Google Workspace für Geschäftsanwender und über die Gemini App für Einzelnutzer. Das bedeutet: Wer heute ein Sprach-Interface braucht, kann die neuen Modelle unmittelbar in Produktion nehmen.\u003C\u002Fp>\n\u003Ch2>Was das für deutsche Unternehmen bedeutet\u003C\u002Fh2>\n\u003Cp>Für deutsche Unternehmen eröffnet sich hier eine wichtige Entscheidung: Sprach-KI wird zum Commodity-Feature. Wer Kundensupport, interne Assistenten oder Voice-Commerce-Lösungen plant, kann jetzt auf bewährte, produktionsreife Modelle setzen – ohne lange auf Eigenentwicklung zu warten. Die Benchmark-Führerschaft von Gemini 3.8 Live Extended Thinking macht Google hier zum Favoriten, zumindest bei der reinen Sprachqualität. Offen bleibt, wie sich die Modelle bei deutschsprachigen Anwendungsfällen und branchenspezifischen Anforderungen verhalten – das werden die kommenden Wochen zeigen.\u003C\u002Fp>\n\u003Ch2>Quellen\u003C\u002Fh2>\n\u003Cul>\n\u003Cli>\u003Ca href=\"https:\u002F\u002Fblog.google\u002Finnovation-and-ai\u002Fmodels-and-research\u002Fgemini-models\u002Fgemini-3-8-live-gemini-3-8-live-extended-thinking\u002F\">blog.google\u003C\u002Fa>\u003C\u002Fli>\n\u003Cli>\u003Ca href=\"https:\u002F\u002Fdeepmind.google\u002Fblog\u002Fintroducing-gemini-3-8-live-and-3-8-live-extended-thinking\u002F\">Google DeepMind\u003C\u002Fa>\u003C\u002Fli>\n\u003Cli>\u003Ca href=\"https:\u002F\u002Fwww.unite.ai\u002Fgoogle-launches-gemini-3-8-live-and-extended-thinking-voice-models\u002F\">unite.ai\u003C\u002Fa>\u003C\u002Fli>\n\u003Cli>\u003Ca href=\"https:\u002F\u002Fsiliconangle.com\u002F2026\u002F09\u002F15\u002Fgoogles-new-speech-model-gemini-3-8-live-supports-real-time-reasoning\u002F\">SiliconANGLE\u003C\u002Fa>\u003C\u002Fli>\n\u003Cli>\u003Ca href=\"https:\u002F\u002Fthe-decoder.de\u002Fgoogle-deepmind-stellt-gemini-3-8-live-fuer-sprach-agenten-vor\u002F\">The Decoder (DE)\u003C\u002Fa>\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Cp>\u003Cem>Redaktionell verantwortet von \u003Ca href=\"\u002Fautor\u002Fideal-syka\">Ideal Syka\u003C\u002Fa>. Quellen und Arbeitsweise: \u003Ca href=\"\u002Fredaktion\">Redaktion &amp; Methode\u003C\u002Fa>. Hinweise und Korrekturen: \u003Ca href=\"mailto:ai@i6eal.de\">ai@i6eal.de\u003C\u002Fa>.\u003C\u002Fem>\u003C\u002Fp>\n",1789553681015]