NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Gemini 3.8 Live: Google unterbietet OpenAI beim Sprechen

Googles neue Sprachmodelle wechseln mitten im Gespräch zwischen 97 Sprachen und erledigen Tool-Calls im Hintergrund – zu einem Bruchteil der Kosten der Konkurrenz.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
16. SEPTEMBER 2026
3 MIN. LESEZEIT
Skizze eines Mikrofons mit Sprachwellen in Elektroblau, kinewsletter.ch Stil
Skizze eines Mikrofons mit Sprachwellen in Elektroblau, kinewsletter.ch Stil
INHALT
0197 Sprachen, mitten im Satz gewechselt02Ein Bruchteil vom Preis03Der Haken: OpenAI klingt noch besser04Warum das für Schweizer Voicebots zählt
INHALT
0197 Sprachen, mitten im Satz gewechselt02Ein Bruchteil vom Preis03Der Haken: OpenAI klingt noch besser04Warum das für Schweizer Voicebots zählt
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Google liefert die derzeit stärksten Werte auf den Sprach-Benchmarks zum günstigsten Preis – und nimmt dafür in Kauf, dass OpenAI im direkten Zuhören immer noch angenehmer wirkt.

Google DeepMind hat am 15. September 2026 zwei neue Sprachmodelle veröffentlicht: Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking. Beide sind ab sofort über die Gemini API und Google AI Studio verfügbar. Laut Google erreicht die Extended-Thinking-Variante 82,6 Punkte auf dem Speech-to-Speech-Index von Artificial Analysis und damit Platz eins – vor OpenAIs GPT-Live-1 Astra mit 81,5 und Grok Voice Think Fast 2.0 mit 81,3 Punkten. Kosten tut das Ganze deutlich weniger als bei der Konkurrenz.

97 Sprachen, mitten im Satz gewechselt

Gemini 3.8 Live erkennt laut Google 97 unterstützte Sprachen und wechselt automatisch zwischen ihnen – nicht erst beim nächsten Gespräch, sondern mitten im laufenden. Dazu kommen zwei Fähigkeiten, die Sprachassistenten bisher regelmässig stolpern liessen:

  • Das Modell führt Tool-Calls und API-Anfragen im Hintergrund aus, während es weiterspricht. Es kann einen Auftrag also bestätigen und weiterplaudern, während die Abfrage noch läuft.
  • Es verarbeitet visuellen Input nahezu in Echtzeit – Googles Demos zeigen das Modell beim Kommentieren einer Schachpartie und beim Durchführen eines Mitarbeiter-Onboardings.

Die Extended-Thinking-Variante denkt und spricht gleichzeitig: Sie überbrückt Rechenzeit mit Einwürfen wie «Lass mich das kurz prüfen». Beim agentischen Benchmark τ-Voice, der echte Kundendienst-Szenarien nachstellt, kommt sie laut Google auf 68,6 Prozent – knapp vor GPT-Live-1 Astra mit 67,9 Prozent.

Ein Bruchteil vom Preis

Der eigentliche Hebel ist der Preis. Für die Listenpreise nennt der Fachdienst The Decoder 0,005 US-Dollar pro Minute Audio-Input und 0,018 Dollar pro Minute Output – rund 1,38 Dollar pro Gesprächsstunde. Für OpenAIs GPT-Live-1 rechnet The Decoder mit mindestens 3,00 Dollar. Die unabhängige Messung von Artificial Analysis bestätigt die Richtung: Dort kostet eine Stunde Audio-Input bei GPT-Live-1 Astra 5,83 Dollar und bei Grok Voice Think Fast 2.0 4,80 Dollar.

Der Haken: OpenAI klingt noch besser

Punkte gewinnen ist das eine, natürlich klingen das andere. GPT-Live-1 arbeitet im Full-Duplex-Modus – es hört zu und spricht gleichzeitig, wie zwei Menschen am Telefon. The Decoder hält OpenAIs Modell deshalb weiterhin für das natürlichere Gegenüber und vermutet, dass Google erneut auf Preis statt auf Klangqualität optimiert hat. Passend dazu: Das günstigere Gemini 3.8 Live landet in der Speech Agent Arena, die menschliche Präferenz misst, nur auf Platz zwei.

Warum das für Schweizer Voicebots zählt

Für Schweizer KMU mit Voicebot-Plänen verschiebt sich damit die Rechnung. Deutsch, Französisch und Italienisch in einem einzigen Modell – ohne Sprachumschaltung im Dialog – war bisher der teuerste Teil einer mehrsprachigen Hotline.

Kurz gesagt: Google liefert die derzeit stärksten Werte auf den Sprach-Benchmarks zum günstigsten Preis – und nimmt dafür in Kauf, dass OpenAI im direkten Zuhören immer noch angenehmer wirkt.

Quellen

Gemini 3.8 Live and 3.8 Live Extended Thinking (Google Blog)↗ EXTERNER LINKArtificial Analysis Speech-to-Speech Leaderboard↗ EXTERNER LINKGoogle launches Gemini 3.8 Live (The Decoder)↗ EXTERNER LINKGemini 3.8 Audio Model Card (Google DeepMind)↗ EXTERNER LINKGoogle Releases Gemini 3.8 Live-Extended (OfficeChai)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
GoogleOpenAIxAI
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines Tonstudios mit Mischpult, Kondensatormikrofon am Galgen und Kopfhörern, kinewsletter.ch Stil
Illustration eines Tonstudios mit Mischpult, Kondensatormikrofon am Galgen und Kopfhörern, kinewsletter.ch Stil
NEUE MODELLE·24. SEPTEMBER 2026

Alibaba macht KI-Sprache um bis zu 95 Prozent billiger

Alibabas Qwen-Team hat Qwen-Audio-3.1 veröffentlicht: fünf Modelle für Spracherkennung, Sprachsynthese und Echtzeit-Dialog, dazu Preissenkungen von bis zu 95 Prozent. Die Modelle laufen ausschliesslich als Cloud-API – offene Gewichte gibt es nur für die ältere Qwen3-ASR-Reihe.

Illustration einer Balkenwaage mit Münzen gegen ein Zahnrad in einer Werkstatt, kinewsletter.ch Stil
Illustration einer Balkenwaage mit Münzen gegen ein Zahnrad in einer Werkstatt, kinewsletter.ch Stil
NEUE MODELLE·23. SEPTEMBER 2026

Claude Opus 5.5: Fable-Niveau zum tieferen Preis

Anthropic hat Claude Opus 5.5 veröffentlicht. Das Modell arbeitet laut Anthropic auf Fable-5.1-Niveau, kostet im Betrieb aber 40 Prozent weniger als Opus 5.

Illustration einer Balkenwaage mit Münzstapel in Elektroblau, kinewsletter.ch Stil
Illustration einer Balkenwaage mit Münzstapel in Elektroblau, kinewsletter.ch Stil
NEUE MODELLE·23. SEPTEMBER 2026

OpenAI halbiert die API-Preise für GPT-6 Sol und Luna

OpenAI hat GPT-6 Sol und Luna veröffentlicht und die API-Preise halbiert. Für Schweizer Teams mit Agenten-Workloads schrumpft die Token-Rechnung auf die Hälfte.

Illustration einer Waage mit Preisschild und Stoppuhren auf einer Werkbank am Fenster, kinewsletter.ch Stil
Illustration einer Waage mit Preisschild und Stoppuhren auf einer Werkbank am Fenster, kinewsletter.ch Stil
NEUE MODELLE·22. SEPTEMBER 2026

xAI bringt Grok 4.7 – günstig, aber kein Spitzenreiter

xAI hat Grok 4.7 veröffentlicht: 2 US-Dollar pro Million Input-Token, 6 Dollar für Output – ein Bruchteil dessen, was Claude Fable 5.1 kostet. Im unabhängigen Artificial Analysis Intelligence Index landet das Modell mit 46 Punkten aber nur im Mittelfeld. Für Schweizer Teams heisst das: günstig rechnen, aber nicht blind auf lange Agenten-Läufe setzen.

Skizze einer Waage mit Münzen und Dokumentenstapel in Elektroblau, kinewsletter.ch Stil
Skizze einer Waage mit Münzen und Dokumentenstapel in Elektroblau, kinewsletter.ch Stil
NEUE MODELLE·21. SEPTEMBER 2026

600-Milliarden-Modell für einen Dollar pro Million Token

StepFun hat am 20. September 2026 Step 5 Preview gestartet: ein Sparse-MoE-Modell mit rund 600 Milliarden Parametern, 1 Million Token Kontext und einem Listenpreis von 1 US-Dollar pro Million Input-Token. Die Gewichte sollen am 15. Oktober offengelegt werden.

Handgezeichnete Illustration: Dirigentenpodest mit Notenstaender vor leeren Orchesterstuehlen, kinewsletter.ch Stil
Handgezeichnete Illustration: Dirigentenpodest mit Notenstaender vor leeren Orchesterstuehlen, kinewsletter.ch Stil
NEUE MODELLE·12. SEPTEMBER 2026

Sakana teilt Fugu auf: ein Modell, das andere Modelle dirigiert

Sakana AI hat Fugu Max und Fugu Ultra v2 veröffentlicht. Beide sind keine klassischen Sprachmodelle, sondern gelernte Dirigenten, die Aufgaben auf einen Pool anderer Modelle verteilen. Fugu Max kostet 2 US-Dollar pro Million Input-Token – und die Schweiz fällt nicht unter den EU-Ausschluss.

Mehr aus Neue Modelle →