Google hat am 2. September Gemini 3.8 Flash veröffentlicht. Das Modell soll längere Programmieraufgaben und mehrstufige Arbeitsabläufe zuverlässiger abschließen. Dafür führt es laut Google zusätzliche Denkschritte und Werkzeugaufrufe aus. Entwickler können es über die Gemini-API und AI Studio nutzen; in der Gemini-App erhalten Pro- und Ultra-Abonnenten Zugang.
Was drinsteckt
- Kontext: bis zu eine Million Tokens für Texte, Bilder, Audio und Video; Textausgaben bis 64.000 Tokens.
- Steuerung: drei Denkstufen – niedrig, mittel und hoch. Mittel ist die API-Voreinstellung.
- Cyber-Variante: Gemini 3.8 Flash Cyber für Schwachstellensuche und Fehlerbehebung ist ausgewählten Sicherheitsteams im Fairwind-Programm vorbehalten.
Der Einführungspreis läuft aus
Google nennt folgende API-Tarife in US-Dollar je Million Tokens:
| Zeitraum | Eingabe | Ausgabe |
|---|---|---|
| Bis 31.12.2026 | 0,75 | 3,75 |
| Ab 01.01.2027 angekündigt | 1,50 | 7,50 |
Schon vorher können aufwendige Aufgaben mehr Tokens verbrauchen. Google weist zudem auf mögliche Falschaussagen und Zeitüberschreitungen hin.
Einordnung: Entscheidend sind Erfolgsquote, Laufzeit und Kosten pro erledigter Aufgabe. Wer umstellt, sollte diese Werte mit eigenen Arbeitsabläufen messen. Niedrigere Denkstufen können den Verbrauch senken; Gemini 3.7 Flash bleibt unterstützt.