Zum Inhalt springen
Google

Gemini 3.8 Flash

Googles schnelles Arbeitstier-Modell, mit Fortschritten bei Coding und Agenten gegenüber 3.7 Flash und demselben Einführungspreis.

Qualität

Modalität

Multimodal

Context

1M tokens

Zugang

Geschlossen

Fabians Take

FM

"Bei der reinen Modellfähigkeit hat Google gegenüber OpenAI und Anthropic den Anschluss verloren, und das zählt weniger, als es klingt. Ein guter Harness und gute Verbindungen zu allem anderen, was du nutzt, sind oft mehr wert als die letzten paar Punkte an Fähigkeit. Ich nutze viele Google-Dienste, darum ist Flash für mich ein günstiger, schneller, fähiger Teamkollege, besonders innerhalb des Antigravity-Harness. Es ist inzwischen auch hervorragend darin, Videos für mich anzuschauen und auszuwerten."

Gemini 3.8 Flash erschien am 2. September 2026, drei Wochen nach 3.7 Flash. Google hat das Versprechen unverändert gelassen: Geschwindigkeit und Preis statt maximaler Intelligenz, mit den Fortschritten konzentriert auf Software-Engineering, agentische Aufgaben und mehrstufiges Reasoning.

Der Preis, den du im Auge behalten solltest

0,75 Dollar pro Million Eingabe-Tokens und 3,75 Dollar pro Million Ausgabe-Tokens, genau das, was 3.7 Flash gekostet hat. Das Datum, das du dir im Kalender markieren solltest, ist der 1. Januar 2027, wenn der Einführungspreis endet und sich beide Zahlen auf 1,50 und 7,50 Dollar verdoppeln. Wenn du einen Workload auf der Flash-Kostenrechnung planst, rechne mit dem Preis von 2027.

Die Cyber-Variante

Google hat am selben Tag ein Schwestermodell veröffentlicht, 3.8 Flash Cyber. Es läuft mit bewusst gelockerten Sicherheitsvorkehrungen für Security-Arbeit und ist über das neue Fairwind Program auf vertrauenswürdige Verteidiger beschränkt, das Behörden, Betreiber kritischer Infrastruktur und Software-Maintainer abdeckt, die sich bewerben und akzeptiert werden. Es ist nichts, was ein Leser in der Gemini-App auswählen kann, darum bekommt es hier keinen eigenen Eintrag.

Wo es sich einordnet

Bei der reinen Fähigkeit hat Google gegenüber den Frontier-Modellen von OpenAI und Anthropic den Anschluss verloren. Das zählt weniger, als es die Benchmark-Tabellen nahelegen. Wie clever das Modell ist, erweist sich als nur ein Teil eines funktionierenden Setups. Der andere Teil ist die Software drumherum: was es sehen kann, was es erreichen kann, welche deiner anderen Tools es bedienen kann. In KI-Kreisen nennt man diese Hülle den Harness, und für die tägliche Arbeit ist er oft mehr wert als die letzten paar Punkte an roher Fähigkeit.

Genau darum funktioniert Flash für mich speziell als Teamkollege. Ich nutze viele Google-Dienste, das Modell sitzt also schon direkt neben den Dingen, an denen ich arbeite, und innerhalb von Antigravity ist es günstig, schnell und fähig genug. Es ist ausserdem hervorragend darin geworden, Videos anzuschauen und auszuwerten, ein Job, bei dem die meisten Modelle immer noch schwach sind.

Der Rest der Empfehlung für Flash bleibt gleich: nutze es für Volumen, und wisse, wo das Volumen endet. Bei harter Logik oder folgenreichem Reasoning wechsle zu einem Frontier-Modell und lass Flash alles drumherum erledigen.

Das Fazit

Am besten für: Ausführungsarbeit mit hohem Volumen: Coding, Agenten, Texte und alles, wo Geschwindigkeit und Preis wichtiger sind als maximale Intelligenz.

Pro

  • Fortschritte gegenüber 3.7 Flash bei Software-Engineering, agentischen Aufgaben und mehrstufigem Reasoning
  • Einführungspreis gilt bis Ende 2026
  • Sofortige Antwortzeiten bei 1M Tokens Context
  • Stark im Anschauen und Auswerten von Videos
  • Sitzt schon in den Google-Diensten und -Tools, mit denen du ohnehin arbeitest

Contra

  • Preise verdoppeln sich am 1. Januar 2027 auf $1,50/$7,50
  • Output weiterhin auf 64K Tokens begrenzt
  • Bei wirklich schwierigem Reasoning hinter den Frontier-Modellen

Specs

  • Preis $0,75/M Eingabe, $3,75/M Ausgabe (Einführungspreis bis 31. Dezember 2026, danach $1,50/$7,50 ab 1. Januar 2027)
  • Kostenstufe Günstig
  • ⚡
    Geschwindigkeit Sofort
  • Lizenz Proprietär
Entwickler-Doku

Zugriff auf dieses Modell über