Bild mit KI erzeugt
Google hat Gemini 3.8 Flash am 2. September 2026 veröffentlicht, drei Wochen nach der Vorgängerversion 3.7 Flash. Das Modell läuft in der Gemini-App für Pro- und Ultra-Konten, im KI-Modus der Suche, in Google Tabellen und über die Programmierschnittstelle.
Der Takt ist bemerkenswert. The Register zählt vier Flash-Versionen in vier Monaten und liest daraus eher Wettbewerbsdruck als einen Plan. Für dich als Betreiber einer Webseite ist die Zahl trotzdem weniger wichtig als zwei andere Dinge: Dieses Modell beantwortet inzwischen Fragen über dein Unternehmen, und es ist billig genug, um selbst eines auf deiner Webseite zu betreiben.
Was Gemini 3.8 Flash kann
Flash ist Googles Arbeitspferd, nicht das Spitzenmodell. Genau darauf zielt die Baureihe: solide Leistung zu einem Preis, bei dem sich Dauerbetrieb rechnet. Gegenüber der Vorversion sind laut Model Card vor allem die Programmier- und Agentenaufgaben besser geworden. Auf DeepSWE v1.1 steht es bei 73,7 Prozent nach 65,3, auf Terminal-bench 2.1 bei 89,4 nach 85,8 Prozent.
Die technischen Eckdaten aus der Modelldokumentation:
| Merkmal | Wert |
|---|---|
| Modellname | gemini-3.8-flash |
| Kontextfenster | 1.048.576 Token |
| Maximale Ausgabe | 65.536 Token |
| Wissensstand | März 2026 |
| Eingabe | Text, Bild, Video, Audio, PDF |
| Ausgabe | nur Text |
Die Eingabeseite ist der eigentliche Unterschied zu vielen Konkurrenten. Video und Audio gehen direkt hinein, ohne Umweg über ein zweites Werkzeug. Dazu kommen Anbindungen, die im Alltag zählen: Suche als Beleg, Google Maps, Ausführen von Code, Verarbeiten einer URL. Die Denktiefe lässt sich in drei Stufen einstellen, was direkt auf die Kosten durchschlägt.
Was Gemini 3.8 Flash kostet
Über die Schnittstelle zahlst du 0,75 Euro je Million Eingabe-Token und 3,75 Euro je Million Ausgabe-Token. Zwischengespeicherte Eingaben kosten 0,075. Eine kostenlose Stufe zum Ausprobieren gibt es ebenfalls.
Ein Punkt gehört dick unterstrichen, weil er in den meisten Meldungen untergeht. Das sind Einführungspreise. Google nennt sie in der Preisübersicht selbst mit Ablaufdatum: Sie gelten bis zum 31. Dezember 2026. Ab dem 1. Januar 2027 stehen dort 1,50 und 7,50, also das Doppelte. Wer heute eine Anwendung darauf aufbaut und mit den aktuellen Zahlen kalkuliert, rechnet ab Neujahr mit der Hälfte des tatsächlichen Budgets.
Wo Gemini 3.8 Flash wirklich stark ist
Die Benchmark-Zahlen oben stammen von Google. Das Analysehaus Artificial Analysis misst mit eigenen Verfahren nach, und dort landet Gemini 3.8 Flash im Intelligenz-Index bei 59 Punkten. Das ist gleichauf mit GPT-5.6 Sol und Grok 4.6 und drei Punkte über der Vorversion. Claude Fable 5.1 liegt mit 66 Punkten vorn, Claude Opus 5 mit 63.
Beim Preis je Aufgabe dreht sich das Bild. Dort kostet Gemini 3.8 Flash 0,58, während Fable 5.1 bei 3,76 liegt, also ungefähr das Sechsfache. Damit ist es das günstigste Modell auf diesem Leistungsniveau.
Das ist die ehrliche Einordnung: Beim Können bringt Gemini 3.8 Flash wenig Neues. Der Fortschritt steckt im Verhältnis von Leistung zu Preis. Für die schwersten Aufgaben bleibt der Abstand nach oben bestehen. Für alles, was in Menge und dauerhaft laufen soll, ist genau dieses Verhältnis die entscheidende Zahl.
Gemini 3.8 Flash beantwortet Fragen über dein Unternehmen
Hier wird es für deine Webseite konkret. Das Modell läuft im KI-Modus der Google-Suche. Wer dort nach einem Handwerker in deiner Stadt, nach Öffnungszeiten oder nach einem Preis fragt, bekommt eine zusammengefasste Antwort, und die entsteht aus dem, was Google im Netz findet.
Deine Webseite ist damit nicht mehr nur ein Ziel, auf das jemand klickt. Sie ist Rohstoff für eine Antwort, die ohne Klick auskommt. Zwei Dinge folgen daraus.
Erstens werden Angaben wichtiger, die man leicht schleifen lässt. Öffnungszeiten, Adresse, Leistungen, Preise. Steht auf deiner Webseite etwas Veraltetes, wird das Veraltete zusammengefasst. Zweitens gewinnt, wer Fragen klar beantwortet, statt um sie herumzuschreiben. Ein Abschnitt mit einer Überschrift, die eine echte Frage stellt, und einer Antwort direkt darunter ist für ein Sprachmodell auswertbar. Eine Marketingseite ohne belastbare Aussage ist es nicht.
Wie das systematisch aussieht, habe ich im Beitrag zu Generative Engine Optimization aufgeschrieben, als Leistung findest du es unter GEO und KI-Suche. Neu ist daran durch Gemini 3.8 Flash nichts. Es wird nur schneller wirksam, weil Google die Antworten jetzt mit einem Modell erzeugt, das billig genug für den Masseneinsatz ist.
Was Gemini 3.8 Flash für einen Assistenten auf deiner Webseite bedeutet
Einen Tag nach Gemini erschien GPT-6 Astra, und ich habe damals vorgerechnet, dass ein Assistent auf einer Webseite mit einem Spitzenmodell rund 13 Cent je Gespräch kostet, bei tausend Gesprächen im Monat also etwa 135 Euro. Mein Fazit dort war, dass Astra für diese Aufgabe das falsche Werkzeug ist.
Gemini 3.8 Flash ist das richtige. Dieselbe Rechnung: Eine Anfrage mit 2.000 Token Eingabe, weil der passende Ausschnitt deiner Inhalte mitgeschickt wird, und 500 Token Antwort kostet hier etwa 0,3 Cent. Ein Gespräch mit drei Fragen liegt bei rund einem Cent, tausend Gespräche im Monat bei ungefähr 10 Euro. Ab Januar 2027 wird daraus das Doppelte, also 20 Euro.
Das ist die Größenordnung, in der sich ein Assistent für Öffnungszeiten, Leistungen und Preise auch für einen kleinen Betrieb rechnet. Entscheidend bleibt trotzdem nicht das Modell, sondern was du ihm mitgibst. Ein Assistent kann nur beantworten, was auf deiner Webseite sauber aufbereitet steht. Wie ich so etwas aufsetze, steht auf der Seite zur KI-Bot-Integration, und der Vergleich mit dem Spitzenmodell steht im Beitrag zu GPT-6 Astra.
Mein Fazit zu Gemini 3.8 Flash
Für meine tägliche Arbeit ist Flash das Modell, das die Menge wegarbeitet: Texte prüfen, Daten sortieren, Entwürfe durchgehen. Für die kniffligen Stellen greife ich weiter zu einem stärkeren Modell. Diese Arbeitsteilung ist kein Kompromiss, sie ist die vernünftige Nutzung.
Zwei Dinge nimm mit. Wenn du etwas darauf aufbaust, kalkuliere mit den Preisen ab Januar 2027 und nicht mit denen von heute. Und wenn deine Webseite in KI-Antworten vorkommen soll, ändert dieses Modell an der Aufgabe nichts, es macht sie nur dringlicher: aktuelle Angaben, klare Antworten, überprüfbare Aussagen.
Quellen
Häufige Fragen zu Gemini 3.8 Flash
Was ist Gemini 3.8 Flash?
Gemini 3.8 Flash ist das Arbeitspferd-Modell von Google, veröffentlicht am 2. September 2026. Es verarbeitet Text, Bilder, Video, Audio und PDF und antwortet in Text. Das Kontextfenster fasst rund 1.048.576 Token, die Antwort bis zu 65.536. Der Wissensstand reicht bis März 2026. Es steckt in der Gemini-App für Pro- und Ultra-Konten, im KI-Modus der Google-Suche und in Google Tabellen.
Was kostet Gemini 3.8 Flash?
Über die Schnittstelle 0,75 Euro je Million Eingabe-Token und 3,75 Euro je Million Ausgabe-Token. Das ist ein Einführungspreis bis zum 31. Dezember 2026. Ab dem 1. Januar 2027 verdoppelt Google auf 1,50 und 7,50. Zwischengespeicherte Eingaben kosten 0,075 und danach 0,15. Es gibt außerdem eine kostenlose Stufe mit Begrenzungen zum Ausprobieren.
Ist Gemini 3.8 Flash besser als GPT-6 Astra?
Beim reinen Können nicht. Im Intelligenz-Index von Artificial Analysis liegen beide etwa gleichauf, und beide bleiben hinter Claude Fable 5.1. Der Unterschied liegt im Preis: Gemini 3.8 Flash kostet je Aufgabe 0,58 gegenüber 3,76 beim stärksten Konkurrenten. Für Aufgaben, die kein Spitzenmodell brauchen, ist das der bessere Kauf. Für die schwersten Aufgaben bleibt der Abstand nach oben bestehen.
Muss ich wegen Gemini 3.8 Flash etwas an meiner Webseite ändern?
Nichts Grundsätzliches. Das Modell steckt aber im KI-Modus der Google-Suche und beantwortet dort Fragen über dein Unternehmen aus dem, was es im Netz findet. Deshalb gilt dasselbe wie vorher, nur mit mehr Nachdruck: klare Antworten auf echte Fragen, saubere Technik, aktuelle Öffnungszeiten und Preise, strukturierte Daten. Wer nichts Belastbares veröffentlicht, über den entsteht die Antwort trotzdem, nur ohne ihn.
Eignet sich Gemini 3.8 Flash für einen Chatbot auf meiner Webseite?
Ja, dafür ist es gebaut. Eine typische Anfrage mit 2.000 Token Eingabe und 500 Token Antwort kostet damit etwa 0,3 Cent, ein Gespräch mit drei Fragen rund einen Cent. Tausend Gespräche im Monat liegen bei etwa 10 Euro. Zum Vergleich: Mit einem Spitzenmodell wie GPT-6 Astra wären es rund 135 Euro. Rechne die Verdopplung ab Januar 2027 aber ein.
Was ist Gemini 3.8 Flash Cyber?
Eine eigene Ausgabe für Sicherheitsaufgaben, die Google nur über sein Fairwind-Programm an geprüfte Tester ausgibt. Sie soll unbekannte Schwachstellen selbstständig finden und laut Google 2,6 Mal so viele korrekte Fehlerkorrekturen in Chrome liefern wie die besten kommerziellen Modelle. Für normale Webseiten-Betreiber ist sie nicht verfügbar und auch nicht nötig.