Gemini 3.6 Flash vs. Gemini 3.1 Pro: Preis, Benchmark und 6 Tests mit identischer Eingabeaufforderung

Gemini 3.6 Flash vs. Gemini 3.1 Pro

Gemini 3.6 Flash Das kam nicht gerade unbewegt an. Google stellte es als schnelleres, effizienteres Flash-Modell vor, doch viele reagierten gleich: Moment mal, wo bleibt das Pro-Upgrade?

Das macht den Vergleich interessanter als ein gewöhnliches Datenblatt. Gemini 3.6 Flash soll für die Programmierung, für Agenten und für alltägliche multimodale Aufgaben kostengünstiger, schneller und leistungsfähiger sein. Gemini 3.1 Pro, Inzwischen trägt es nach wie vor die Bezeichnung “Pro” und ist auf komplexere Denkprozesse und anspruchsvollere Aufgaben ausgerichtet.

Also haben wir sie auf die einzige Weise getestet, die wirklich zählt: gleiche Aufgabe, gleiche Aufgabenstellung, gleiche Eingabe, gleiche Bewertungsregeln.

In diesem Testbericht vergleichen wir Gemini 3.6 Flash und Gemini 3.1 Pro anhand realer Aufgaben: rForschungssynthese, Code-Reparatur, Zusammenfassung langer Texte, Datenauswertung, Screenshot-Analyse und SEO-Texterstellung. In jeder Runde lautet die zentrale Frage ganz einfach: Welcher Ausgabe kann man leichter vertrauen, welche lässt sich leichter bearbeiten und wiederverwenden?

API-Status Stable vs. Preview

Gemini 3.6 Flash wird als „Stable“ geführt; Gemini 3.1 Pro trägt die Bezeichnung „Preview API“.

Offizieller Verkaufspreis $7.50 im Vergleich zu $12+

Pro 1 Million ausgegebener Token gemäß den Standardpreisen für kostenpflichtige APIs, vor den Pro-Tarifen mit langen Eingabeaufforderungen.

Unser Durchlauf mit derselben Eingabeaufforderung 4 Siege gegen 2

Flash gewann vier redaktionelle Bewertungen auf Aufgabenebene; Pro gewann in den Bereichen Forschungszusammenfassung und Screenshot-Analyse.

Wenn Sie Modelle vergleichen möchten, ohne eine Vielzahl separater Tabs zu öffnen, beginnen Sie mit dem GLBGPT-Modell-Hub und dieselbe Eingabe über mehrere KI-Modelle hinweg ausführen, bevor man einer Behauptung zur Markteinführung Glauben schenkt. Das ist für diese Art von Bewertung wichtig, denn die einzig ehrliche Methode, Modelle zu vergleichen, besteht darin, dieselbe Aufgabe durch sie laufen zu lassen und die Ergebnisse zu betrachten.

Gemini 3.6 Flash vs. Gemini 3.1 Pro – Kurzantwort

In unserem API-Test mit identischer Eingabe erwies sich das Modell „Gemini 3.6 Flash“ insgesamt als das leistungsstärkere Modell in der Praxis: Es gewann vier der sechs redaktionellen Bewertungen auf Aufgabenebene und lieferte bei mehreren praktischen Aufgaben sauberere Erstentwürfe.

Gemini 3.1 Pro Preview lieferte die besser veröffentlichungsfähigen, SEO-orientierten Forschungsempfehlungen und die ausführlichere Screenshot-Analyse. Flash bewältigte die Aufgaben in den Bereichen Programmierung, Langtextverarbeitung, Datenauswertung und SEO-Bearbeitung effektiver.

Wohin führt 3.6 Flash nun? Nützlichkeit des ersten Entwurfs

Flash schnitt in den Bereichen Programmierung, Zusammenfassung langer Texte, Datenauswertung und SEO-Bearbeitung besser ab, während der erste Entwurf leichter wiederverwendbar blieb.

Wo 3.1 Pro noch punkten kann Klar strukturierte Argumentation und fundiertere Kritik an der Benutzeroberfläche

Pro lieferte eine fundiertere Antwort mit Datenanalyse und eine detailliertere Überprüfung der Screenshots, insbesondere wenn die Antwort eine umfassendere Kritik erforderte.

Was noch nicht geklärt ist Längere und risikoreichere Arbeitsabläufe

Bei diesem Durchlauf wurden sechs kontrollierte API-Aufgaben verwendet. Dies bedeutet nicht, dass sich jede Produktions-Workload, jede Anbieter-Route oder jede Long-Context-Ebene auf dieselbe Weise verhält.

Gemini 3.6 Flash vs. Gemini 3.1 Pro – Offizielle technische Daten

Google gab bekannt, Gemini 3.6 Flash am 21. Juli 2026, neben dem Gemini 3.5 Flash-Lite und dem Gemini 3.5 Flash Cyber. In diesem Ankündigungsbeitrag stellt Google das 3.6 Flash als ein effizienteres Flash-Modell für Programmierung, Wissensarbeit, multimodale Leistung und agentische Arbeitsabläufe dar. Falls das kostengünstigere Modell aus derselben Produktreihe ebenfalls auf Ihrer Auswahlliste steht, ist unser Gemini 3.5 Flash-Lite Testbericht darauf wird separat eingegangen.

Auf der offiziellen Gemini-API-Modellseite ist der Modellcode wie folgt aufgeführt: gemini-3.6-flash. Es ist als „Stable“ gekennzeichnet, unterstützt die Eingabe von Text, Bildern, Videos, Audiodateien und PDF-Dateien und gibt Text als Ausgabe zurück. Die angegebenen Token-Limits liegen bei 1.048.576 Eingabe-Token und 65.536 Ausgabe-Token. Eine über diesen direkten Vergleich hinausgehende Bewertung, die sich ausschließlich auf das Modell konzentriert, finden Sie in unserem vollständigen Gemini 3.6 Kurzrezension.

Das Gemini 3.1 Pro ist ein Modell der etwas anderen Art. Google hat angekündigt, Gemini 3.1 Pro am 19. Februar 2026, wobei der Schwerpunkt auf komplexen Aufgaben und fortgeschrittenem logischem Denken liegt. Google teilte mit, dass das Modell derzeit in einer Vorschauversion eingeführt werde, um die Aktualisierungen vor der allgemeinen Verfügbarkeit zu validieren.

Offizielle Google-Seite zur Veröffentlichung von Gemini 3.6 Flash mit dem Starttermin 21. Juli 2026.
Gemini 3.6 Blitzmeldung, aufgezeichnet am 22. Juli 2026.
Offizielle Google-Seite zur Veröffentlichung von Gemini 3.1 Pro mit der Ankündigung vom 19. Februar 2026.
Ankündigung zu Gemini 3.1 Pro, aufgezeichnet am 22. Juli 2026.

Bei API-Vergleichen kommt es auf die genaue Bezeichnung an. Auf der offiziellen Modellseite wird gemini-3.1-pro-vorschau, kein stabiles Pro-Label. Es weist dieselben angegebenen Obergrenzen für Eingabe- und Ausgabetoken auf wie Gemini 3.6 Flash: 1.048.576 Eingabetoken und 65.536 Ausgabetoken. Um die Pro-Seite nach dem Lesen der Spezifikationen auszuprobieren, öffnen Sie die Gemini 3.1 Pro – Produktseite und führen Sie eine der Befehle aus diesem Artikel aus.

Wenn Sie statt bloßer Notizen zum Modellcode eine Schritt-für-Schritt-Anleitung zur Einrichtung benötigen, dann ist die Gemini 3.1 Pro – Benutzerhandbuch Das ist der übersichtlichere nächste Schritt, bevor Sie mit dem Testen der Prompts beginnen.

Gemini-API-Modellseite, auf der „gemini-3.6-flash“ als stabiles Modell mit einem Eingabekontextfenster von 1 M dargestellt wird.
gemini-3.6-flash wird als „Stable“ mit einem Eingabefenster von 1 Million Token aufgeführt.
Gemini-API-Modellseite, auf der „gemini-3.1-pro-preview“ als Vorschaumodell angezeigt wird.
gemini-3.1-pro-vorschau wird als „Vorschau“ mit denselben Eingabe-/Ausgabegrenzwerten aufgeführt.

Preisvergleich zwischen Gemini 3.6 Flash und Gemini 3.1 Pro

Bei der regulären kostenpflichtigen Nutzung der Gemini-API ist Gemini 3.6 Flash günstiger als Gemini 3.1 Pro Preview. Die Preisseite für Gemini API Gibt Gemini 3,6 Flash bei $1,50 pro 1 Mio. Eingabetoken und $7,50 pro 1 Mio. Ausgabetoken an.

Die Gemini 3.1 Pro Preview bietet zwei Standard-Preisstufen. Für Prompts bis zu 200.000 Token beträgt der Preis $2,00 pro 1 Million Eingabe-Token und $12,00 pro 1 Million Ausgabe-Token. Für Prompts mit mehr als 200.000 Tokens steigen die Preise auf $4,00 für Eingabe- und $18,00 für Ausgabetoken pro 1 Million Tokens. Eine Pro-spezifische Kostenaufschlüsselung finden Sie unter Gemini 3.1 Pro – Preisübersicht neben dem Tisch aufschlagen.

ModellStandard-EinsatzpreisStandard-AusgabepreisWichtiger Hinweis
Gemini 3.6 Flash$1.50 / 1 Mio. Token$7,50 / 1 Mio. TokenStabiles Modell; der Verkaufspreis beinhaltet Thinking-Token
Gemini 3.1 Pro Vorschau$2.00 / 1M Token unter 200.000 Prompt-Token$12.00 / 1 Mio. Token unter 200.000 Prompt-TokenVorschau-Modell; ab 200.000 Prompt-Token gilt die höhere Preisstufe
Gemini 3.1 Pro Vorschau, langer Prompt$4.00 / 1 Mio. Token über 200.000 Prompt-Token$18.00 / 1 Mio. Token über 200.000 Prompt-TokenWichtig für Tests mit langem Kontext

Der Preis allein sagt nichts über die Qualität eines Modells aus. Ein günstigeres Modell, das mehr Wiederholungsversuche benötigt, kann in der Praxis teuer werden. Ein langsameres Modell kann sich dennoch lohnen, wenn es bei einer besonders wichtigen Aufgabe eine falsche Antwort verhindert. Wenn Ihre Prompts häufig den Kontext oder die Kontingente ausreizen, überprüfen Sie die Leitfaden zu den Einschränkungen von Gemini 3.1 Pro bevor wir den Preis als ausschlaggebenden Entscheidungsfaktor betrachten. Aus diesem Grund erfassen wir bei jedem Test sowohl die Kosten als auch die Ergebnisqualität.

Gemini 3.6 Flash vs. Gemini 3.1 Pro – Benchmark-Ergebnisse

Google's Gemini 3.6 Beitrag zur Flash-Einführung verleiht dem Modell eine überzeugende Leistungsbilanz. Laut Google verwendet 3.6 Flash beim Artificial Analysis Index 17% weniger Ausgabetoken als 3.5 Flash, übertrifft DeepSWE und MLE Bench und steigert die von OSWorld verifizierte Leistung im Vergleich zu 3.5 Flash.

Das ist ein gutes Zeichen, beantwortet aber nicht die Frage, die uns hier interessiert. Die eigentliche Frage ist nicht nur, wie sich Flash 3.6 im Vergleich zur früheren Version Gemini 3.5 – Kurzrezension; die Frage ist, ob 3.6 Flash nun in der Praxis bei der Bearbeitung derselben Eingabeaufforderung mit Gemini 3.1 Pro mithalten kann.

Bei Gemini 3.1 Pro sieht es bei den offiziellen Benchmark-Ergebnissen anders aus. Im Beitrag zur Einführung von Gemini 3.1 Pro, Google hob seine fortschrittlichen Schlussfolgerungsfähigkeiten hervor und gab an, dass 3.1 Pro einen verifizierten ARC-AGI-2-Wert von 77,11 TP40T erreicht habe. Das lässt leicht vermuten, dass Pro die schwierigeren Schlussfolgerungstests gewinnen dürfte. Doch genau solche Vermutungen möchte dieser Artikel vermeiden.

Der Drittanbieter Vergleich künstlicher Analysen Die von uns erfassten Daten zeigen einen deutlich stärkeren Kontrast: Gemini 3.6 Flash erscheint schneller, kostengünstiger und hat einen höheren Intelligenzindex als Gemini 3.1 Pro Preview. Das sind nützliche Hintergrundinformationen, aber es handelt sich nicht um ein offizielles Ergebnis von Google, und sie ersetzen nach wie vor nicht die Tests mit identischen Eingabeaufforderungen.

Highlights der „Artificial Analysis“-Vorschau für Gemini 3.6 Flash und Gemini 3.1 Pro.
Vergleichstabelle für Modelle zur künstlichen Analyse. Dieser Screenshot zeigt die unten aufgeführten Werte für den Intelligence-Index eines Drittanbieters, den Mischpreis, die Ausgabegeschwindigkeit, die Zeit bis zum ersten Token und das Kontextfenster.
QuelleMetrischGemini 3.6 FlashGemini 3.1 Pro VorschauSo wird es verwendet
Google-VertreterDeepSWE49%Kein direkter Vergleich mit 3.1 Pro im Beitrag zur Einführung von 3.6 FlashIn der offiziellen Darstellung wird vor allem 3.6 Flash mit 3.5 Flash verglichen
Google-VertreterMLE-Bank63.9%Kein direkter Vergleich mit 3.1 Pro im Beitrag zur Einführung von 3.6 FlashNützlich für die Kodierung/Agenten-Erwartungen, kein endgültiger Beweis
Google-VertreterOSWorld-geprüft83.0%Kein direkter Vergleich mit 3.1 Pro im Beitrag zur Einführung von 3.6 FlashNützlich im Zusammenhang mit der Computernutzung
Künstliche AnalyseIntelligenzindex5046Kontext von Benchmark-Tests durch Dritte
Künstliche AnalyseAusgangsgeschwindigkeit280 Token/s119 Token/sGeschwindigkeitskontext von Drittanbietern
Künstliche AnalyseZeit bis zum ersten Token11,71 s33,44 sLatenzkontext von Drittanbietern
Künstliche AnalyseDurchschnittspreis$1.16 / 1 Mio. Token$1.74 / 1 Mio. TokenGetrennt von den offiziellen API-Preisen verwenden

Datenabbildung: Momentaufnahme der künstlichen Analyse

Vergleich durch einen Drittanbieter, erfasst am 22. Juli 2026. Verwenden Sie dies als Referenzkontext, nicht als offizielle Aussage von Google.

Intelligenzindex: 3,6 Flash
50
Intelligenzindex: 3,1 Pro
46
Ausgabegeschwindigkeit: 3,6 Flash
280 t/s
Ausgabegeschwindigkeit: 3.1 Pro
119 t/s

So haben wir den Gemini 3.6 Flash im Vergleich zum Gemini 3.1 Pro getestet

Bei jedem Test werden für beide Modelle dieselbe Aufgabenstellung, dieselbe Eingabe und dieselben Bewertungskategorien verwendet. Wir betrachten eine gute Antwort nicht als Beweis dafür, dass ein Modell insgesamt besser ist. Das Ziel ist enger gefasst und aussagekräftiger: Es soll gezeigt werden, wie sich jedes Modell bei bestimmten Aufgaben verhält.

Wir haben jede Ausgabe anhand folgender Kategorien bewertet:

KategorieWonach wir gesucht haben
Qualität der ErgebnisseIst die Antwort tatsächlich brauchbar?
Anleitung wie folgtHat das Modell das Format, die Grenzen und die Einschränkungen eingehalten?
GenauigkeitWurden erfundene Fakten, Preise, Links oder Behauptungen vermieden?
Tiefe der ArgumentationWurden dabei Kompromisse und versteckte Einschränkungen berücksichtigt?
StrukturLässt sich die Ausgabe leicht überfliegen und wiederverwenden?
GeschwindigkeitEnd-to-End-Reaktionszeit in Sekunden
KostenGeschätzt auf der Grundlage der offiziellen Preise für API-Eingabe- und -Ausgabe-Token

Der Test wurde über dieselbe API-Route unter Verwendung genau der angeforderten Modell-IDs durchgeführt: gemini-3.6-flash und gemini-3.1-pro-vorschau. Für jede Aufgabe wurden die Rohausgaben, die Token-Nutzung, die Latenz sowie die offiziellen Schätzungen der API-Kosten protokolliert.

Wenn das Programmieren der Hauptgrund dafür ist, dass Sie diese beiden Modelle miteinander vergleichen, sollten Sie dieses Ergebnis mit dem bestes AI-Modell für die Codierung als Anhaltspunkt nehmen, anstatt sich allein auf eine Fehlerbehebungsaufforderung zu verlassen.

Methodenbeschreibung: Hierbei handelt es sich um einen API-Workflow-Test mit identischer Eingabeaufforderung und nicht um einen Branchen-Benchmark. Die Latenz bezeichnet die lokale End-to-End-Laufzeit ausgehend von diesem Arbeitsbereich. Die Kosten werden anhand offizieller Angaben geschätzt. Preise für die kostenpflichtige Stufe des Gemini-API-Standards Überprüft am 22. Juli 2026. Für die Screenshot-Aufgabe wurde ein speziell für diesen Test erstelltes synthetisches Bild der Checkout-Seite bzw. des Dashboards verwendet.

Wenn Sie noch dabei sind, ein Standardmodell für umfassendere Arbeiten auszuwählen, dann ist das Leitfaden zu den besten KI-Modellen ist ein besserer nächster Schritt, als dieses Gemini-Paar isoliert zu betrachten.

Und wenn Ihre eigentliche Entscheidung eher zwischen Google und OpenAI als zwischen Flash und Pro fällt, dann ist die Vergleich zwischen GPT-5 und Gemini 2.5 Pro ist ein besserer nächster Schritt als eine weitere Benchmark-Tabelle, die ausschließlich Gemini enthält.

T01 Zusammenfassung der Forschungsergebnisse

Die Empfehlung von Pro las sich eher wie ein ausgefeilter Text eines SEO-Teams, obwohl in einer Anmerkung zur Matrix das Quellpaket falsch angegeben war.

Pro
T02 Fehlerbehebung bei der Codierung

Beide haben das Problem gelöst, aber Flash wies in den Tests robustere Dezimalwert-Prüfungen auf.

Blitzlicht
T03 Zusammenfassung mit umfangreichem Kontext

Pro bot mehr Funktionen, aber Flash war übersichtlicher und sicherer, was die Formulierungen im Vorschaumodus betraf.

Blitz, leicht
T04 Datenauswertung

Beide haben die Rechnung richtig gelöst; Flash verwendete die bekanntere Schreibweise für die Division und eine übersichtlichere, scanfreundliche Struktur.

Blitzlicht
T05 Screenshot-Analyse

Flash war präzise; Pro lieferte umfassendere Informationen zu Vertrauenswürdigkeit, Typografie und Risiken bei der mobilen Nutzung.

Pro, geringfügig
T06 SEO-Texterstellung/-Bearbeitung

„Flash“ klang natürlicher und klarer; „Pro“ war zwar unauffällig, aber klanglich zu dramatisch.

Blitzlicht

Gemini 3.6 Flash vs. Gemini 3.1 Pro – Ergebnisse bei gleicher Eingabeaufforderung

Anstatt die Testdaten in einer einzigen zusammengefassten Übersicht zu verbergen, werden in diesem Abschnitt die einzelnen Testanforderungen jeweils auf einer eigenen Vergleichskarte für Gemini 3.6 Flash und Gemini 3.1 Pro dargestellt. Jede Karte enthält die API-Laufdaten für die jeweilige Eingabeaufforderung sowie kurze Auszüge aus den tatsächlichen Rohausgaben, sodass der Vergleich mehr ist als nur eine Ergebnistabelle.

Aufgabenergebnis / T01

Forschungssynthese

Gewinner: Gemini 3.1 Pro Vorschau
Gemini 3.6 Flash
Punktzahl
4.23
Verstrichen
22,8 s
Kosten
$0.0471
Ausgabe
6.206 Token
Gemini 3.1 Pro Vorschau
Punktzahl
3.76
Verstrichen
48,0 s
Kosten
$0.0874
Ausgabe
7.217 Token

Aufgabeneinstellung: Jedes Modell musste eine interne Kaufempfehlung mit einer Länge von 120 bis 160 Wörtern verfassen, wobei ausschließlich auf ein vorgegebenes Datenpaket zurückgegriffen werden durfte. Das Datenpaket enthielt Modell-IDs, offizielle API-Preise, Käuferbeschränkungen, unbekannte Informationen sowie eine strenge Liste mit vier fehlenden Informationen.

Nebeneinander angeordnete Screenshots der Forschungsergebnisse von Gemini 3.6 Flash und Gemini 3.1 Pro Preview.

Tatsächliche Blitzleistung
Für unser fünfköpfiges SEO-Content-Team empfehlen wir, „gemini-3.6-flash“ als primäres Standardmodell festzulegen und „gemini-3.1-pro-preview“ gezielt einzusetzen.
Tatsächliche Pro-Ausgabe
(Die Preise für Prompts mit mehr als 200.000 Tokens sind im Quellpaket nicht enthalten).

Was dies zeigt: Pro hat die Empfehlung in einem besser für Suchmaschinen optimierten Stil aufbereitet und einen zurückhaltenderen Verkaufston gewählt. Flash hat die angegebenen Preisstufen präziser dargestellt; in der Matrix von Pro wurde fälschlicherweise angegeben, dass eine Preisangabe von Flash im Quellpaket fehlte.

Fazit der Redaktion: „Pro“ gewinnt diese auf das Verfassen von Texten ausgerichtete Aufgabe, da seine Empfehlung eher einem fertigen internen SEO-Briefing entspricht; allerdings sollte der Hinweis zur Preisgestaltung vor der Veröffentlichung korrigiert werden.

Aufgabenergebnis / T02

Behebung eines Programmierfehlers

Gewinner: Gemini 3.6 Flash
Gemini 3.6 Flash
Punktzahl
4.73
Verstrichen
9,1 s
Kosten
$0.0166
Ausgabe
2.131 Token
Gemini 3.1 Pro Vorschau
Punktzahl
4.51
Verstrichen
13,2 s
Kosten
$0.0231
Ausgabe
1.853 Token

Aufgabeneinstellung: Die Aufgabe bestand in einem kleinen JavaScript-Kostenrechner, der zwei absichtlich eingebaute Fehler enthielt: Er behandelte Preise pro Million Token als Preise pro Token und verwendete die höhere „Pro“-Stufe bei >=200.000 Token statt nur ab 200.000.

Tatsächliche Blitzleistung
console.assert(Math.abs(actual – expected) < 1e-9, `Test 1 fehlgeschlagen: Erwartet ${expected}, erhalten ${actual}`);
Tatsächliche Pro-Ausgabe
console.assert(test1 === 0.00525, `Test 1 fehlgeschlagen: Erwartet wurde 0.00525, erhalten wurde ${test1}`);

Was dies zeigt: Bei beiden Modellen wurde das Modul mit einem minimalen Patch behoben, doch Flash führte sicherere, auf Toleranzen basierende Fließkomma-Tests durch, während Pro eine strenge dezimale Gleichheit verwendete.

Fazit der Redaktion: Beide Lösungen funktionierten. Flash war besser für den produktiven Einsatz geeignet, da bei den Tests sicherere Dezimalprüfungen verwendet wurden.

Aufgabenergebnis / T03

Zusammenfassung mit umfangreichem Kontext

Gewinner: Gemini 3.6 Flash, leicht
Gemini 3.6 Flash
Punktzahl
4.53
Verstrichen
15,0 s
Kosten
$0.0455
Ausgabe
3.489 Token
Gemini 3.1 Pro Vorschau
Punktzahl
4.2
Verstrichen
28,2 s
Kosten
$0.0732
Ausgabe
3.949 Token

Aufgabeneinstellung: Die Eingabeaufforderung verwendete ein wiederholtes Planungsprotokoll mit nachträglichen Konfliktnotizen zu fehlenden Screenshots, der Berichterstattung über Token-Kosten, dem Veröffentlichungsdruck am Freitag, der Sicherheit der Modell-ID und der Behandlung von API-Fehlern.

Tatsächliche Blitzleistung
Stellen Sie sicher, dass Gemini 3.1 Pro nicht als "stabil" bezeichnet wird, wenn seine Modell-ID "Preview" lautet.
Tatsächliche Pro-Ausgabe
Gemini 3.1 Pro gilt als stabil, bzw. der Text wird angepasst, sodass es nicht als stabil bezeichnet wird, wenn die ID "Preview" lautet.

Was dies zeigt: Flash hielt sich an die sicherere redaktionelle Regel: Bezeichne Gemini 3.1 Pro nicht als stabil, wenn die API-Modell-ID „Preview“ angibt. Pro bot zwar mehr Funktionen, doch der Wortlaut der Checkliste konnte so interpretiert werden, dass die Stabilität an erster Stelle stand.

Fazit der Redaktion: Pro sorgte für mehr Struktur, während Flash bei der Formulierung des Vorschau-Status klarer und sicherer war.

Aufgabenergebnis / T04

Datenauswertung

Gewinner: Gemini 3.6 Flash
Gemini 3.6 Flash
Punktzahl
4.18
Verstrichen
10,5 s
Kosten
$0.0181
Ausgabe
2.368 Token
Gemini 3.1 Pro Vorschau
Punktzahl
4.21
Verstrichen
17,1 s
Kosten
$0.0276
Ausgabe
2.258 Token

Aufgabeneinstellung: Als Eingabedaten diente eine 14-tägige Kanaltabelle mit Angaben zu Ausgaben, Klicks, Anmeldungen, bezahlten Konversionen, Umsatz und Verweildauer auf der Seite. Das Modell musste den ROAS bewerten, den Kanal ohne Ausgaben separat behandeln, die Rate der bezahlten Konversionen bewerten und eine Empfehlung für die nächste $300-Budgetaufteilung aussprechen.

Nebeneinander angeordneter Screenshot der Ausgabedaten der Datenauswertung von Gemini 3.6 Flash und Gemini 3.1 Pro Preview.

Tatsächliche Blitzleistung
Organisches LinkedIn ($45 Umsatz bei $0 Ausgaben; die Berechnung ergibt einen undefinierten/unendlichen ROAS).
Tatsächliche Pro-Ausgabe
Anmeldungen sind in diesem Zusammenhang eine „Vanity-Metrik“, da sie keine tatsächlichen Einnahmen garantieren.

Was dies zeigt: Beide Modelle ergaben die korrekten Rangfolgen und die korrekte Budgetaufteilung. Flash erleichterte die Lesbarkeit der Berechnungen, indem es das vertraute Divisionszeichen anstelle der Schrägstrichnotation verwendete, und das nummerierte Layout blieb bei beiden Berechnungen einheitlich.

Nächster Schritt: Für Ranglisten im Tabellenkalkulationsstil, Budgetaufteilungen und Kanalanalysen vergleichen Sie diese Aufgabe mit der Die besten KI-Tools für die Datenanalyse Leitfaden.

Fazit der Redaktion: Flash gewinnt diese Aufgabe in puncto Präsentation. Pro lieferte eine hilfreiche Erklärung zur Qualität der Registrierungen, doch das Berechnungsformat von Flash lässt sich schneller lesen und überprüfen.

Aufgabenergebnis / T05

Screenshot-Analyse

Gewinner: Gemini 3.1 Pro Vorschau, leicht
Gemini 3.6 Flash
Punktzahl
4.68
Verstrichen
11,2 s
Kosten
$0.0165
Ausgabe
1.950 Token
Gemini 3.1 Pro Vorschau
Punktzahl
4.57
Verstrichen
20,7 s
Kosten
$0.0296
Ausgabe
2.261 Token

Aufgabeneinstellung: Das Ausgangsbild war ein synthetischer Screenshot der GLBGPT-Kasse/des Dashboards, der speziell für diesen Test erstellt wurde. Es zeigte eine Pro-Monatsabrechnung, eine Rabattwarnung, eine Schaltfläche „Jetzt bezahlen“, eine Bestellübersicht, einen Hinweis auf die nachträgliche Steuerberechnung sowie einen Hinweis zum Trust-Badge für Mobilgeräte.

Screenshot des fiktiven GLBGPT-Checkout-Dashboards, der für den T05-Screenshot-Analysetest verwendet wurde.
Tatsächliche Blitzleistung
Die spärliche Gestaltung beeinträchtigt das visuelle Vertrauen: Der übermäßige leere Weißraum in beiden Hauptfeldern vermittelt einen unfertigen Eindruck.
Tatsächliche Pro-Ausgabe
Mangelhafte Typografie der Schaltfläche: Der Text "Jetzt bezahlen" innerhalb der grünen Schaltfläche ist unverhältnismäßig klein und in einer dünnen, schwarzen Schriftart dargestellt.

Was dies zeigt: Pro hat weitere designspezifische Probleme identifiziert, darunter die Typografie der Schaltflächen, das Vertrauen in die Preisangaben und die Platzierung von Vertrauenssignalen auf Mobilgeräten. Das Audit von Flash war zwar zutreffend, aber weniger konkret.

Fazit der Redaktion: Pro gewinnt knapp, da seine Beobachtungen einem Designer konkretere Ansatzpunkte für Verbesserungen liefern.

Aufgabenergebnis / T06

SEO-Texte verfassen/bearbeiten

Gewinner: Gemini 3.6 Flash
Gemini 3.6 Flash
Punktzahl
4.39
Verstrichen
19,9 s
Kosten
$0.0366
Ausgabe
4.818 Token
Gemini 3.1 Pro Vorschau
Punktzahl
4.11
Verstrichen
34,9 s
Kosten
$0.0641
Ausgabe
5.291 Token

Aufgabeneinstellung: Jedes Modell musste einen GLBGPT-Vergleichsabschnitt ausschließlich als HTML neu verfassen, geschützte kommerzielle Angaben exakt beibehalten, die genaue CTA-URL angeben, erfundene Testergebnisse vermeiden und den Umfang zwischen 180 und 260 Wörtern einhalten.

Gemini 3.6 Flash vs. Gemini 3.1 Pro: Das endgültige Fazit

Gemini 3.6 Flash schneidet in diesem Vergleich am besten ab und gewinnt vier der sechs Aufgaben mit identischer Aufgabenstellung. Die besten Ergebnisse erzielte es in den Bereichen Programmierung, Zusammenfassung langer Texte, Datenauswertung und SEO-Bearbeitung. Die Vorschauversion von Gemini 3.1 Pro lieferte nach wie vor die bessere Forschungszusammenfassung und die detailliertere Screenshot-Analyse, was zeigt, dass das Pro-Modell eine ausgefeiltere oder scharfsinnigere Antwort liefern kann, wenn bei der Aufgabe Tiefe gefragt ist.

Flash war bei diesem kontrollierten API-Lauf zudem schneller und kostengünstiger. Diese Kombination führte hier zu einem insgesamt besseren Ergebnis, macht Flash jedoch nicht zu einem universellen Ersatz für Pro: Die tatsächlichen Ergebnisse zeigen, dass die Modellqualität je nach Aufgabe weiterhin variiert, selbst wenn die Eingabeanweisung exakt gleich bleibt.

Zu Ihrer eigenen Gemini 3.6 Flash vs. Gemini 3.1 Pro Zum Vergleich: Führen Sie dieselbe reale Eingabe über beide Modelle in GLBGPT und das fertige Werk im direkten Vergleich zu beurteilen.

Gemini 3.6 Flash vs. Gemini 3.1 Pro – Häufig gestellte Fragen

Wann wurde Gemini 3.6 Flash veröffentlicht?

Google kündigte am 21. Juli 2026 „Gemini 3.6 Flash“ an. Auf der offiziellen Gemini-API-Modellseite sind aufgeführt gemini-3.6-flash als stabiles Modell.

Ist Gemini 3.1 Pro dasselbe wie Gemini 3.1 Pro Preview?

Für Preisangaben und technische Vergleiche zur API verwenden Sie bitte das offizielle Etikett gemini-3.1-pro-vorschau. In Googles Ankündigung vom Februar 2026 heißt es, dass Gemini 3.1 Pro als Vorschauversion veröffentlicht wurde, um Updates vor der allgemeinen Verfügbarkeit zu validieren.

Wann kommen der Gemini 3.5 Pro oder der Gemini 3.6 Pro auf den Markt?

Stand 22. Juli 2026 hat Google eine offizielle Stellungnahme zum Gemini 3.5 Pro abgegeben, jedoch kein konkretes Datum für die Markteinführung genannt. In der Gemini 3.6 Flash-Ankündigung, Laut Google wird das Modell Gemini 3.5 Pro derzeit gemeinsam mit Partnern getestet, und das Unternehmen plant, es “sobald es fertig ist” allgemein verfügbar zu machen. Ich habe weder ein offizielles Veröffentlichungsdatum von Google noch eine offizielle Ankündigung für das Modell Gemini 3.6 Pro gefunden.

Ersetzt Gemini 3.6 Flash die Version Gemini 3.1 Pro?

Nicht offiziell. Gemini 3.6 Flash ist ein stabiles Flash-Modell, dessen Schwerpunkte auf Geschwindigkeit, Kosten, Codierung, multimodaler Arbeit und agentischer Ausführung liegen. Gemini 3.1 Pro Preview ist auf fortgeschritteneres logisches Denken und komplexe Aufgaben ausgerichtet. Die Tests mit identischen Eingabeaufforderungen in diesem Artikel sollen aufzeigen, wo derzeit die praktische Lücke liegt.

Können öffentliche Benchmarks den Sieger bestimmen?

Nein. Benchmarks helfen dabei, Erwartungen zu formulieren, ersetzen jedoch keine kontrollierten Tests mit identischen Aufgabenstellungen. In diesem Artikel wird zwischen offiziellen Benchmark-Angaben, Benchmark-Daten von Drittanbietern und unseren eigenen Testergebnissen auf Aufgabenebene unterschieden.

Warum wird in diesem Artikel die Bezeichnung „Gemini 3.1 Pro Preview“ verwendet und nicht einfach „Gemini 3.1 Pro“?

Im für Leser bestimmten Text des Artikels kann “Gemini 3.1 Pro” verwendet werden, in den technischen Tabellen sollte jedoch gemini-3.1-pro-vorschau. Das ist die offizielle API-Bezeichnung, die auf den Modell- und Preisseiten für den Gemini verwendet wird.

Ist Gemini 3.6 Flash günstiger als Gemini 3.1 Pro Preview?

Ja, gemäß der Standardpreisgestaltung für die kostenpflichtige Gemini-API. Gemini 3.6 Flash kostet $1,50 pro 1 Million Eingabetoken und $7,50 pro 1 Million Ausgabetoken. Die Preise für Gemini 3.1 Pro Preview beginnen bei $2,00 für Eingabe- und $12,00 für Ausgabetoken pro 1 Million Token, wobei für Prompts mit mehr als 200.000 Token eine höhere Preisstufe gilt.

Unterstützen beide Modelle ein Kontextfenster von 1 Million Token?

Auf den offiziellen Seiten zum Gemini-API-Modell sind für beide 1.048.576 Eingabetoken aufgeführt gemini-3.6-flash und gemini-3.1-pro-vorschau. In der Praxis spielt der Langkontext-Test nach wie vor eine Rolle, da ein großes Fenster keine perfekte Wiederauffindbarkeit garantiert.

Sollte der Artikel offizielle Screenshots enthalten?

Ja, aber Screenshots sollten die Aussagen untermauern und nicht den gesamten Artikel ersetzen. Der Hauptvergleich sollte anhand übersichtlicher Tabellen, Datenkarten, Preisbalken, Benchmark-Zusammenfassungen und Ergebnistabellen mit identischen Eingabeaufforderungen dargestellt werden.

Welche Aufgaben waren im Test mit identischer Aufgabenstellung enthalten?

Der API-Lauf umfasste sechs Aufgaben: Forschungszusammenfassung, Behebung von Programmierfehlern, Zusammenfassung langer Texte, Datenauswertung, Screenshot-Analyse sowie SEO-Texterstellung/-Bearbeitung. Bei jedem Lauf wurden die Latenzzeit, die Anzahl der Eingabe- und Ausgabetoken, die geschätzten Kosten sowie eine Bewertung durch den Prüfer erfasst.

Wird in diesem Artikel behauptet, dass Gemini 3.6 Flash besser ist als Gemini 3.1 Pro?

Man kann sagen, dass Gemini 3.6 Flash in diesem spezifischen API-Test mit identischer Eingabe insgesamt besser abgeschnitten hat. Es sollte jedoch nicht behauptet werden, dass Flash generell für jede Arbeitslast besser ist, da Pro bei der Zusammenfassung der Forschungsergebnisse und der Screenshot-Analyse bessere Ergebnisse erzielte.

Wo wurden die Tests mit identischer Aufgabenstellung durchgeführt?

Die Tests wurden über dieselbe API-Route unter Verwendung der exakten Modell-IDs durchgeführt. gemini-3.6-flash und gemini-3.1-pro-vorschau. Hierbei handelt es sich nicht um einen GLBGPT-UI-Test, und die lokale Zeitangabe sollte als End-to-End-Anfragezeit und nicht als latenz auf Anbieterseite verstanden werden.

Warum hat Gemini 3.6 Flash insgesamt gewonnen, obwohl Pro in einigen Qualitätskategorien gewonnen hat?

Flash hat gewonnen, weil es bei mehr Aufgaben die überzeugendere, wiederverwendbare Lösung geliefert hat. Die Forschungszusammenfassung und die Screenshot-Analyse von Pro waren zwar besser, doch Flash konnte in den Bereichen Programmierung, Zusammenfassung langer Texte, Datenauswertung und SEO-Bearbeitung punkten.

Warum wird GLBGPT in diesem Vergleich erwähnt?

Modellvergleiche lassen sich leichter durchführen, wenn Leser mehrere Modelle an einem Ort testen können. GLBGPT ist hier von Bedeutung, da der Leser im nächsten Schritt nicht nur die Spezifikationen liest, sondern denselben Prompt für verschiedene Modelle ausführt und die Ergebnisse vergleicht.

Teilen Sie den Beitrag:

Verwandte Beiträge