[{"data":1,"prerenderedAt":30},["ShallowReactive",2],{"nr-de-google-gemini-agentic-video-understanding":3},{"slug":4,"title":5,"dek":6,"date":7,"time":8,"publishedAt":9,"updated":10,"updatedAt":10,"dateFmt":11,"updatedFmt":10,"kind":12,"tier":13,"author":14,"authorName":15,"topics":16,"tracker":22,"trackerLabel":23,"headlineStat":24,"image":25,"ogImage":26,"imageAlt":5,"csv":10,"minutes":27,"words":28,"html":29},"google-gemini-agentic-video-understanding","Google macht Videos für KI intelligenter: Gemini spart 88 % Token ein","Mit 'agentic video understanding' können Geminis neue Modelle Videos gezielt analysieren statt sie komplett durchzukauen. Das spart massiv Kosten und verbessert die Genauigkeit.","2026-09-02","09:59","2026-09-02T09:59:00+02:00","","2. September 2026","news","standard","ideal-syka","Ideal Syka",[17,18,19,20,21],"Gemini","Video-Analyse","KI-Kosten","Google DeepMind","Agentic AI","\u002Fki-preis","KI-Preise & Token-Kosten","88 % Token-Einsparung bei Video-Analyse","\u002Fnewsroom\u002Fimg\u002Fgoogle-gemini-agentic-video-understanding.webp","\u002Fog-nr\u002Fgoogle-gemini-agentic-video-understanding.de.png",3,502,"\u003Cp>Google hat eine neue Fähigkeit für seine Gemini-Modelle gelauncht, die Video-Analyse grundlegend verändert: \u003Cstrong>agentic video understanding\u003C\u002Fstrong>. Statt Videos Bild für Bild mit fester Framerate durchzuarbeiten, können die Modelle jetzt aktiv entscheiden, welche Segmente sie sich anschauen, wie schnell sie spulen und ob sie Frames, Audio oder Transkripte nutzen. Das Ergebnis ist beeindruckend – und vor allem: deutlich billiger.\u003C\u002Fp>\n\u003Ch2>Kurz &amp; knapp\u003C\u002Fh2>\n\u003Cul>\n\u003Cli>\u003Cstrong>Verfügbar für\u003C\u002Fstrong>: Gemini 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite über die Gemini API, Google AI Studio und Gemini Enterprise Agent Platform\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Einsparungen\u003C\u002Fstrong>: Token-Verbrauch um bis zu \u003Cstrong>88 % gesenkt\u003C\u002Fstrong>, Kosten um bis zu \u003Cstrong>66 % reduziert\u003C\u002Fstrong>, Genauigkeit um bis zu \u003Cstrong>7 % verbessert\u003C\u002Fstrong>\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Besonders effektiv bei\u003C\u002Fstrong>: Langform-Videos (10-Minuten-Tutorials bis 90-Minuten-Vorträge und mehrstündige Aufnahmen)\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Start\u003C\u002Fstrong>: Ab sofort verfügbar für Video-Uploads und YouTube-Videos\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Ch2>Wie das alte System funktionierte – und warum es ineffizient war\u003C\u002Fh2>\n\u003Cp>Bisher verarbeitete Gemini Videos im \u003Cstrong>statischen Modus\u003C\u002Fstrong>: Das Modell fraß sich mit fester Framerate (Standard: 1 FPS, konfigurierbar) durch die gesamte Datei. Das bedeutete für lange Videos ein Dilemma: Entweder hohe Token-Kosten oder Qualitätsverlust durch Sampling. Besonders bei Langform-Content (Vorlesungen, Tutorials, mehrstündige Aufnahmen) war das ein echtes Problem – kritische Details gingen verloren oder die Rechnung wurde unbezahlbar.\u003C\u002Fp>\n\u003Ch2>Das neue Prinzip: Zielgerichtete Videoanalyse\u003C\u002Fh2>\n\u003Cp>Agentic video understanding funktioniert anders. Das Modell übernimmt \u003Cstrong>aktiv die Kontrolle\u003C\u002Fstrong>: Es entscheidet, welche Videoabschnitte relevant sind, scannt sie mit variabler Geschwindigkeit, nutzt parallele Datenquellen (Frames, Audio, Transkripte) und springt gezielt zu interessanten Momenten. Das ist ähnlich wie \u003Cstrong>agentic vision\u003C\u002Fstrong> für Bilder – nur eben für Videos.\u003C\u002Fp>\n\u003Cp>Das Ergebnis sind beeindruckende Benchmarks:\u003C\u002Fp>\n\u003Cdiv class=\"tbl-scroll\">\u003Ctable>\n\u003Cthead>\n\u003Ctr>\n\u003Cth>Metrik\u003C\u002Fth>\n\u003Cth>Verbesserung\u003C\u002Fth>\n\u003C\u002Ftr>\n\u003C\u002Fthead>\n\u003Ctbody>\u003Ctr>\n\u003Ctd>Token-Verbrauch\u003C\u002Ftd>\n\u003Ctd>bis zu \u003Cstrong>88 % Reduktion\u003C\u002Fstrong>\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Kosten\u003C\u002Ftd>\n\u003Ctd>bis zu \u003Cstrong>66 % Ersparnis\u003C\u002Fstrong>\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Genauigkeit\u003C\u002Ftd>\n\u003Ctd>bis zu \u003Cstrong>7 % Verbesserung\u003C\u002Fstrong>\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003C\u002Ftbody>\u003C\u002Ftable>\u003C\u002Fdiv>\n\u003Cp>Besonders interessant: \u003Cstrong>Gemini 3.7 Flash\u003C\u002Fstrong> mit agentic understanding sitzt jetzt an der &quot;Accuracy-to-Cost Pareto-Frontier&quot; – das heißt, es gibt kein anderes getestetes Modell, das bei gleicher Genauigkeit günstiger ist oder bei gleichen Kosten genauer.\u003C\u002Fp>\n\u003Ch2>Neue Use-Cases werden möglich\u003C\u002Fh2>\n\u003Cp>Die Fähigkeit eröffnet Anwendungen, die vorher zu teuer oder zu ungenau waren: \u003Cstrong>Sub-Sekunden-Moment-Retrieval\u003C\u002Fstrong> (&quot;Finde die exakte Stelle, wo das Produkt gezeigt wird&quot;), präzisere \u003Cstrong>Anomalieerkennung\u003C\u002Fstrong> (&quot;Wann passiert etwas Ungewöhnliches?&quot;), genaues \u003Cstrong>Counting\u003C\u002Fstrong> (&quot;Wie viele Personen sind im Video?&quot;). Für Unternehmen, die Videos automatisiert analysieren, ist das ein echter Capability-Sprung.\u003C\u002Fp>\n\u003Cp>Aktiviert wird das Feature über die API – einfach die Konfiguration auf &quot;agentic&quot; setzen in Google AI Studio oder der Gemini Enterprise Agent Platform. Funktioniert mit Video-Uploads und YouTube-Videos.\u003C\u002Fp>\n\u003Ch2>Was das für deutsche Unternehmen bedeutet\u003C\u002Fh2>\n\u003Cp>Für Firmen, die Videos in ihre KI-Workflows einbauen wollen – von Medienunternehmen über Sicherheit bis zu Dokumentenanalyse – ändert sich die Kostenrechnung erheblich. 66 % Kostenersparnis bei besserer Qualität machen Video-KI-Anwendungen plötzlich wirtschaftlicher. Besonders für längere Inhalte (Schulungsvideos, Überwachungsmaterial, Archivanalyse) könnte das ein Tipping Point sein. Allerdings: Die Fähigkeit ist noch auf Googles Modelle beschränkt – wer bereits auf anderen Plattformen investiert hat, muss neu evaluieren, ob ein Wechsel sich lohnt.\u003C\u002Fp>\n\u003Ch2>Quellen\u003C\u002Fh2>\n\u003Cul>\n\u003Cli>\u003Ca href=\"https:\u002F\u002Fblog.google\u002Finnovation-and-ai\u002Fmodels-and-research\u002Fgemini-models\u002Fintroducing-agentic-video-in-gemini\u002F\">blog.google\u003C\u002Fa>\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Cp>\u003Cem>Redaktionell verantwortet von \u003Ca href=\"\u002Fautor\u002Fideal-syka\">Ideal Syka\u003C\u002Fa>. Quellen und Arbeitsweise: \u003Ca href=\"\u002Fredaktion\">Redaktion &amp; Methode\u003C\u002Fa>. Hinweise und Korrekturen: \u003Ca href=\"mailto:ai@i6eal.de\">ai@i6eal.de\u003C\u002Fa>.\u003C\u002Fem>\u003C\u002Fp>\n",1788341041856]