# gemini-25-flash-lite-stable-ga-google-2025-07-22

## Veille

Gemini 2.5 Flash-Lite - Google - Stabile Allgemeine Verfügbarkeit - Kosteneffizient - Schnellstes Modell - Developer Blog

## Titre Article

Gemini 2.5 Flash-Lite is now stable and generally available - Google Developers Blog

## Date

2025-07-22

## URL

https://developers.googleblog.com/en/gemini-25-flash-lite-is-now-stable-and-generally-available/

## Keywords

Gemini 2.5 Flash-Lite, KI, maschinelles Lernen, Google AI Studio, Vertex AI, großes Sprachmodell, kosteneffizient, Geschwindigkeit, Latenz, multimodal, Kontextfenster, Grounding with Google Search, Code Execution, URL Context, Übersetzung, Klassifizierung

## Authors

Logan Kilpatrick (Group Product Manager), Zach Gleicher (Product Manager)

## Ton

**Profil:** Produktentwickler | Institutionelle Developer Relations | Informativ-technisch | Experte

Googles Produktmanager übernehmen die Stimme des Google Developers Blog, gerichtet an ein technisches Publikum. Der Fokus auf Modellspezifikationen (Kosteneffizienz, Geschwindigkeit, Latenz, Kontextfenster) entspricht den Prioritäten von Entwicklern. Zugängliche Fachsprache (multimodal, Grounding, Code Execution) demonstriert die Tiefe der Fähigkeiten. Professioneller und selbstbewusster Ton, typisch für Googles Entwicklerkommunikation. Funktionszentrierte Struktur mit Verfügbarkeitsinformationen erleichtert die Übernahme. Typisch für entwicklerorientierte Produktankündigungen (im Stil von AWS What's New, Azure Updates), die der Entwicklercommunity technische Details für Integrationsentscheidungen liefern.

## Pense-betes

- **Schnellstes und kosteneffizientestes Modell** der Gemini-2.5-Familie
- **Preisgestaltung**: **0,10 $ pro 1 Mio. Input-Tokens**, **0,40 $ pro 1 Mio. Output-Tokens**
- **40% Reduzierung der Audio-Input-Preise** seit dem Preview-Start
- **Geringere Latenz** als 2.0 Flash-Lite und 2.0 Flash über ein breites Spektrum von Prompts
- **Kontextfenster von 1 Million Tokens**
- **Native Reasoning-Fähigkeiten**
- **Erweiterte Tools**: Grounding with Google Search, Code Execution, URL Context
- **Optimiert für latenzsensible Anwendungen**: Übersetzung, Klassifizierung
- **Benchmarks**: übertrifft 2.0 Flash-Lite in Code, Mathematik, Wissenschaft, Reasoning, multimodalem Verständnis
- **Praxiseinsätze**: Satlyt (**45% Latenzreduzierung**, **30% geringerer Energieverbrauch**), HeyGen (Automatisierung der Videoplanung, **über 180 Sprachen**), DocsHound (Verarbeitung langer Videos, Tausende extrahierter Screenshots), Evertune (schnelle Synthese großer Datenmengen)
- **Stabile Version**: "gemini-2.5-flash-lite" angeben, Preview-Alias wird am **25. August** entfernt

## RésuméDe400mots

Google gab die **stabile allgemeine Verfügbarkeit** von Gemini 2.5 Flash-Lite bekannt und markiert damit einen bedeutenden Fortschritt in der Gemini-2.5-Modellfamilie. Positioniert als **das schnellste und kosteneffizienteste Modell**, mit einem Preis von **0,10 $ pro Million Input-Tokens und 0,40 $ pro Million Output-Tokens**, ist Flash-Lite darauf ausgelegt, außergewöhnliche Intelligenz pro Dollar zu liefern. Diese Veröffentlichung baut auf dem Erfolg von 2.5 Pro und 2.5 Flash auf und vervollständigt die 2.5-Modellreihe für den großflächigen Produktionseinsatz.

**Leistungs- und Latenzoptimierung**

Gemini 2.5 Flash-Lite ist speziell für **latenzsensible Anwendungen** wie Übersetzung und Klassifizierung optimiert, bei denen Geschwindigkeit und Kosteneffizienz Priorität haben, ohne die Qualität zu beeinträchtigen. Es zeigt über ein breites Spektrum von Prompts hinweg **geringere Latenz** als seine Vorgänger 2.0 Flash-Lite und 2.0 Flash. Zudem hat Google die **Preise für Audio-Input seit dem Preview-Start um 40% gesenkt**, was die finanzielle Zugänglichkeit weiter stärkt.

**Benchmark-Qualität**

Trotz seiner kosteneffizienten Positionierung zeigt das Modell **hohe Qualität in verschiedenen Benchmarks**, einschließlich Code, Mathematik, Wissenschaft, Reasoning und multimodalem Verständnis, und **übertrifft dabei 2.0 Flash-Lite**. Entwickler, die mit 2.5 Flash-Lite arbeiten, haben Zugriff auf einen robusten Funktionsumfang, darunter ein **Kontextfenster von 1 Million Tokens**, steuerbare Thinking-Budgets und native Tool-Unterstützung. Zu diesen Tools gehören **Grounding with Google Search, Code Execution und URL Context**, die anspruchsvollere und stärker integrierte KI-Anwendungen ermöglichen.

**Validierte Praxisanwendungen**

Praktische Anwendungen von Gemini 2.5 Flash-Lite sind bereits in mehreren erfolgreichen Einsätzen sichtbar. **Satlyt** nutzt dessen Geschwindigkeit, um eine **45%ige Latenzreduzierung** für kritische Bord-Diagnosen und eine **30%ige Senkung des Energieverbrauchs** für seine dezentrale Weltraum-Computing-Plattform zu erzielen. **HeyGen** setzt auf das Modell, um die Videoplanung zu automatisieren, Inhalte zu optimieren und Videos in **mehr als 180 Sprachen** zu übersetzen, was globale und personalisierte Nutzererlebnisse ermöglicht. **DocsHound** verwandelt Produktdemos in umfassende Dokumentationen, indem es lange Videos schnell verarbeitet und Tausende von Screenshots extrahiert. **Evertune** profitiert von der Geschwindigkeit von Flash-Lite, um große Mengen an Modell-Outputs schnell zu scannen und zu synthetisieren und liefert damit dynamische und zeitnahe Analysen für Marken, die ihre Darstellung in KI-Modellen überwachen.

**Zugänglichkeit und Einsatz**

Entwickler können die **stabile Version** von Gemini 2.5 Flash-Lite nutzen, indem sie in ihrem Code **"gemini-2.5-flash-lite"** angeben, wobei der Preview-Alias am **25. August** entfernt wird. Das Modell ist in **Google AI Studio und Vertex AI** verfügbar und lädt Entwickler ein, seine Fähigkeiten für den Aufbau innovativer KI-Lösungen zu erkunden. Diese strategische Positionierung von Flash-Lite als bevorzugte Wahl für kosteneffiziente, latenzsensible Anwendungen veranschaulicht Googles Engagement, eine mehrstufige Modellreihe anzubieten, die den unterschiedlichen Bedürfnissen von Entwicklern gerecht wird – von ultraschneller Inferenz bis hin zu tiefem Reasoning – bei gleichzeitig wettbewerbsfähiger Preisgestaltung zur Demokratisierung des Zugangs zu fortschrittlicher KI.

## GrapheDeConnaissance

- Google —publie→ Gemini 2.5 Flash-Lite (TECHNOLOGIE, 0.99)
- Logan Kilpatrick —publie→ Gemini 2.5 Flash-Lite stable GA (EVENEMENT, 0.98)
- Zach Gleicher —publie→ Gemini 2.5 Flash-Lite stable GA (EVENEMENT, 0.98)
- Gemini 2.5 Flash-Lite —fait_partie_de→ Gemini 2.5 Flash-Lite (TECHNOLOGIE, 0.99)
- Gemini 2.5 Flash-Lite —mesure→ $0.10 / 1M tokens input, $0.40 / 1M tokens output (MESURE, 0.99)
- Gemini 2.5 Flash-Lite —surpasse→ Gemini 2.0 Flash-Lite (TECHNOLOGIE, 0.95)
- Gemini 2.5 Flash-Lite —utilise→ Grounding with Google Search (TECHNOLOGIE, 0.97)
- Gemini 2.5 Flash-Lite —observé_dans→ Google AI Studio (TECHNOLOGIE, 0.98)
- Gemini 2.5 Flash-Lite —observé_dans→ Vertex AI (TECHNOLOGIE, 0.98)
- Satlyt —utilise→ Gemini 2.5 Flash-Lite (TECHNOLOGIE, 0.97)
- Satlyt —mesure→ réduction de 45% de la latence des diagnostics onboard (MESURE, 0.96)
- HeyGen —utilise→ Gemini 2.5 Flash-Lite (TECHNOLOGIE, 0.97)
- DocsHound —utilise→ Gemini 2.5 Flash-Lite (TECHNOLOGIE, 0.97)
- Evertune —utilise→ Gemini 2.5 Flash-Lite (TECHNOLOGIE, 0.97)
- Gemini 2.5 Flash-Lite —mesure→ fenêtre de contexte de 1 million de tokens (MESURE, 0.99)

---
Canonical: https://www.thekb.eu/de/fiches/gemini-25-flash-lite-stable-ga-google-2025-07-22/
