Menü
Alle Artikel
Short-News

Google stellt Gemini 3.8 Live vor: KI-Agenten können jetzt sprechen und gleichzeitig Aufgaben erledigen

Mit Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking entwickelt Google sprachbasierte KI weiter. Die neuen Modelle können während eines laufenden Gesprächs Informationen verarbeiten, Werkzeuge nutzen und mehrstufige Aufgaben bearbeiten. Für Unternehmen entstehen dadurch neue Möglichkeiten in Kundenservice, Wissensmanagement und Automatisierung.

Google stellt zwei neue Sprachmodelle vor

Am 15. September 2026 hat Google zwei neue KI-Modelle vorgestellt: Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking. Beide wurden speziell für natürliche Sprachinteraktionen entwickelt und sollen Gespräche mit KI deutlich flüssiger gestalten.

Während Gemini 3.8 Live auf schnelle und natürliche Dialoge ausgelegt ist, kann die Extended-Thinking-Variante komplexere Aufgaben bearbeiten und dabei zusätzliche Rechenzeit für die Verarbeitung nutzen.

Besonders interessant ist die Fähigkeit, während eines laufenden Gesprächs weitere Aufgaben auszuführen. Die KI kann beispielsweise externe Werkzeuge aufrufen, Informationen verarbeiten und anschließend mit dem Nutzer weiterarbeiten, ohne dass der gesamte Dialog bis zum Abschluss jeder einzelnen Aktion unterbrochen werden muss.

Vom Sprachassistenten zum handlungsfähigen KI-Agenten

Bisher wurden sprachbasierte KI-Anwendungen häufig vor allem für einfache Fragen, Diktate oder die Umwandlung von Sprache in Text eingesetzt. Die neuen Gemini-Modelle erweitern diese Möglichkeiten.

Durch asynchrone Funktionsaufrufe können Anwendungen externe Systeme nutzen, während die sprachliche Interaktion weiterläuft. Ein KI-Agent könnte beispielsweise während eines Kundengesprächs Informationen aus einem CRM-System abrufen, einen Termin prüfen oder eine Anfrage für die weitere Bearbeitung vorbereiten.

Google demonstriert unter anderem Anwendungen, bei denen KI mehrstufige Buchungsprozesse koordiniert oder während eines Gesprächs technische Aufgaben bearbeitet. Auch visuelle Informationen können in die Verarbeitung einbezogen werden.

Damit entsteht eine neue Form der Zusammenarbeit zwischen Mensch und KI. Statt einzelne Fragen nacheinander zu beantworten, können sprachbasierte Systeme zunehmend mehrere zusammenhängende Arbeitsschritte unterstützen.

Neue Möglichkeiten für Kundenservice und interne Prozesse

Für mittelständische Unternehmen könnten sich dadurch insbesondere in Bereichen mit vielen wiederkehrenden Gesprächen interessante Anwendungsmöglichkeiten ergeben.

Im Kundenservice könnten Voice Agents Standardanfragen bearbeiten, Informationen aus Wissensdatenbanken abrufen oder Anliegen für Mitarbeitende vorstrukturieren. Im technischen Support könnten sie Schritt für Schritt durch Fehleranalysen führen und dabei auf vorhandene Dokumentationen zugreifen.

Auch für interne Prozesse entstehen neue Perspektiven. Mitarbeitende könnten beispielsweise während ihrer Arbeit Fragen an ein sprachbasiertes Wissenssystem stellen, ohne dafür zwischen verschiedenen Anwendungen wechseln zu müssen.

In der Einarbeitung neuer Mitarbeitender wäre denkbar, dass ein KI-Assistent Fragen zu internen Abläufen beantwortet, passende Dokumente findet und bei organisatorischen Aufgaben unterstützt.

Die technische Grundlage dafür wird mit den neuen Modellen leistungsfähiger. Ob solche Anwendungen tatsächlich zuverlässig funktionieren, hängt allerdings weiterhin von der Qualität der angebundenen Daten, der Systemintegration und der konkreten Umsetzung ab.

Mehr Automatisierung bedeutet auch mehr Verantwortung

Je mehr Aufgaben KI-Agenten übernehmen, desto wichtiger werden klare organisatorische und technische Rahmenbedingungen.

Ein sprachbasierter Assistent, der lediglich Informationen bereitstellt, benötigt andere Berechtigungen als ein Agent, der Termine verändert, Kundendaten verarbeitet oder Bestellungen auslöst.

Unternehmen müssen deshalb definieren, welche Aktionen automatisiert durchgeführt werden dürfen und an welchen Stellen eine menschliche Freigabe erforderlich ist.

Gerade bei personenbezogenen Daten müssen außerdem Datenschutzanforderungen berücksichtigt werden. Dazu gehören beispielsweise geeignete Zugriffsrechte, transparente Informationen über die Datenverarbeitung und eine sorgfältige Prüfung der eingesetzten Systeme.

Die neuen technischen Möglichkeiten ersetzen diese Anforderungen nicht. Sie machen eine durchdachte Integration in bestehende Unternehmensprozesse vielmehr noch wichtiger.

Fazit: Sprache wird zur Schnittstelle für komplexe KI-Anwendungen

Mit Gemini 3.8 Live zeigt Google, wie sich die Interaktion mit Künstlicher Intelligenz weiterentwickelt. Sprache wird zunehmend zu einer Schnittstelle, über die nicht nur Informationen abgerufen, sondern auch komplexere Aufgaben angestoßen und begleitet werden können.

Für den Mittelstand entstehen dadurch neue Möglichkeiten, insbesondere im Kundenservice, technischen Support und internen Wissensmanagement.

Entscheidend wird jedoch sein, die Technologie nicht isoliert zu betrachten. Erst durch die Verbindung mit geeigneten Unternehmensdaten, klar definierten Prozessen und verantwortungsvollen Berechtigungen können aus leistungsfähigen Sprachmodellen tatsächlich hilfreiche KI-Agenten entstehen.

Quellen

Google, 15. September 2026: „Introducing Gemini 3.8 Live and Gemini 3.8 Live Extended Thinking“

Google, 15. September 2026: „New Gemini Audio models for developers“

 

Teilen LinkedIn WhatsApp E-Mail

#worksmarter im Postfach

Wissen und News,
direkt aus der Praxis.

Praxisfälle, News und Werkzeuge für deinen Alltag. Konkreter Input und echter Mehrwert für dein Unternehmen.