Gemini 3 Flash: Wenn Tempo endlich auch Hirn hat
Schnell ist nicht automatisch gut. Schnell und schlau ist das neue Arbeitstier.
Reasoning, das man messen kann
GPQA Diamond: 90.4%. Humanity’s Last Exam: 33.7% ohne Tools. Das ist nicht Deko, das ist ein echter Hinweis darauf, dass Speed hier nicht mit Blindflug erkauft wird.
Multimodal im selben Flow
Text, Bilder, Audio, Video und PDFs rein. Text raus.
Das klingt banal, ist in der Praxis aber genau das, was Teams brauchen, wenn Workflows nicht in fünf Spezialmodelle zerfallen sollen.
Coding und agentische Workflows
Auf SWE-bench Verified kommt Gemini 3 Flash auf 78%.
Das ist eine Ansage für Prototypen, Debugging und hohe Frequenz im Terminal oder IDE-Alltag.
Effizienz, die später auf der Rechnung steht
Bei hoher Denkstufe braucht Gemini 3 Flash im Schnitt rund 30% weniger Tokens als Gemini 2.5 Pro, gemessen auf typischem Traffic.
Das ist der Unterschied zwischen "cooler Demo" und "läuft als Standard in Produktion".
| Kurzprofil | Gemini 3 Flash (Preview) |
| Model ID | gemini-3-flash-preview |
| Token-Limits (In / Out) | 1,048,576 / 65,536 |
| Preise (Input / Output) | $0.50 / $3 pro 1M Tokens |
Mein Take: Default-Material für Volumen
Gemini 3 Flash ist für mich genau die Klasse Modell, die man im Alltag wirklich braucht. Schnell genug für interaktive Produkte, schlau genug für mehr als FAQ-Antworten, und effizient genug, dass man es ohne Bauchweh skalieren kann. Für viele einfache Aufgaben und für anspruchsvollere mit hohem Volumen wird das sehr wahrscheinlich eines meiner Lieblingsmodelle.