Google-KI-Modelle im Überblick: Gemini Release-Daten und Chronologie
Liste der Gemini-Modelle von Google mit Release-Datum und Kontextfenster - plus eine Chronologie der wichtigsten Meilensteine von Gemini 1.0 (2023) bis zur Gemini-3-Generation (2026).

Google löste mit der Gemini-Reihe den Vorgänger Bard (PaLM 2) ab. Schon früh hat Gemini auf ein großes Kontextfenster von einer Million Token gesetzt:
| Release-Datum | Modellname | Kontextfenster |
|---|---|---|
| 06.12.2023 | Gemini 1.0 Nano | 32.768 Token |
| 13.12.2023 | Gemini 1.0 Pro | 32.768 Token |
| 08.02.2024 | Gemini 1.0 Ultra | 32.768 Token |
| 15.02.2024 | Gemini 1.5 Pro | 1.000.000 Token (bis 2.000.000) |
| 14.05.2024 | Gemini 1.5 Flash | 1.000.000 Token |
| 30.01.2025 | Gemini 2.0 Flash | 1.000.000 Token |
| 05.02.2025 | Gemini 2.0 Pro | 2.000.000 Token |
| 25.03.2025 | Gemini 2.5 Pro | 1.000.000 Token |
| 17.04.2025 | Gemini 2.5 Flash | 1.000.000 Token |
| 18.11.2025 | Gemini 3 Pro | 1.000.000 Token |
| 03.12.2025 | Gemini 3 Deep Think | 1.000.000 Token |
| 17.12.2025 | Gemini 3 Flash | 1.000.000 Token |
| 19.02.2026 | Gemini 3.1 Pro | 1.000.000 Token |
| 03.03.2026 | Gemini 3.1 Flash-Lite | 1.000.000 Token |
| 19.05.2026 | Gemini 3.5 Flash | 1.000.000 Token |
Kontextfenster-Angaben beziehen sich auf das jeweils standardmäßig verfügbare Eingabefenster; die Gemini-3-Generation liefert zusätzlich bis zu 64.000 Token Ausgabe.
- Dezember 2023: Gemini 1.0 (Nano, Pro): Googles erste von Grund auf multimodale Modellgeneration
- Februar 2024: Gemini 1.0 Ultra: Top-Modell der ersten Generation, Einsatz im Bezahldienst "Gemini Advanced"
- Februar 2024: Gemini 1.5 Pro: Mixture-of-Experts-Architektur und erstmals ein 1-Million-Token-Kontextfenster
- Mai 2024: Gemini 1.5 Flash: schnelle, günstige Variante für den Masseneinsatz
- Januar 2025: Gemini 2.0 Flash: neues Standardmodell mit nativer Bild- und Audio-Ausgabe
- Februar 2025: Gemini 2.0 Pro: bis dahin größtes Kontextfenster der Reihe (2 Millionen Token)
- März 2025: Gemini 2.5 Pro: integriertes "Thinking" (Reasoning) mit Chain-of-Thought
- April 2025: Gemini 2.5 Flash: schnelles Reasoning-Modell für hohe Volumen
- November 2025: Gemini 3 Pro: neue Generation mit Sparse-Mixture-of-Experts-Architektur
- Dezember 2025: Gemini 3 Deep Think + 3 Flash: besonders gründliche Reasoning-Stufe + die schnelle Variante der 3er-Generation
- Februar 2026: Gemini 3.1 Pro: Weiterentwicklung des Flaggschiffs
- März 2026: Gemini 3.1 Flash-Lite: auf Tempo und Kosten optimiert
- Mai 2026: Gemini 3.5 Flash: erster öffentlicher Release der 3.5-Familie
- Gemini x.x: die Modellgeneration (1.0, 1.5, 2.0, 2.5, 3, 3.5)
- Pro: das leistungsstärkste Allround-Modell der jeweiligen Generation
- Flash: schnelle, günstige Variante für hohe Volumen
- Flash-Lite / Nano: besonders schlanke, schnelle Modelle
- Deep Think: Reasoning-Variante mit besonders gründlichem "Thinking"