Google bringt Echtzeit-Sprach-KI Gemini 3.8 Live

Google hat zwei neue Echtzeit-Sprachmodelle vorgestellt: Gemini 3.8 Live und eine Extended-Thinking-Variante, die Sprach- und Multimodal-Interaktion auf ein neues Level heben sollen.

Google zieht nach: Mit Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking hat der Konzern zwei neue Echtzeit-Sprachmodelle vorgestellt.

Gemini 3.8 Live soll Sprachinteraktionen flüssiger und natürlicher machen – mit niedriger Latenz, also fast ohne Verzögerung.

Die Extended-Thinking-Variante kann komplexere Aufgaben verstehen und im Hintergrund Werkzeuge nutzen, während ihr sprecht.

Das ist wichtig, weil Echtzeit-Sprach-KI der nächste große Schritt ist: Assistenten, die euch wirklich verstehen, sofort antworten und dabei nicht nur Text, sondern auch Bilder oder Video verarbeiten können.

OpenAI hat das mit GPT-4o vorgemacht, jetzt zieht Google nach.

Für euch bedeutet das: Die KI-Assistenten werden immer mehr wie echte Gesprächspartner – und dringen tiefer in euren Alltag vor.

Google bringt Echtzeit-Sprach-KI Gemini 3.8 Live
Ausgestrahlt von