# gemini-25-flash-lite-stable-ga-google-2025-07-22

## Veille

Gemini 2.5 Flash-Lite - Google - Disponibilidad general estable - Rentable - Modelo más rápido - Developer Blog

## Titre Article

Gemini 2.5 Flash-Lite is now stable and generally available - Google Developers Blog

## Date

2025-07-22

## URL

https://developers.googleblog.com/en/gemini-25-flash-lite-is-now-stable-and-generally-available/

## Keywords

Gemini 2.5 Flash-Lite, IA, aprendizaje automático, Google AI Studio, Vertex AI, modelo de lenguaje de gran tamaño, rentable, velocidad, latencia, multimodal, ventana de contexto, Grounding with Google Search, Code Execution, URL Context, traducción, clasificación

## Authors

Logan Kilpatrick (Group Product Manager), Zach Gleicher (Product Manager)

## Ton

**Perfil:** Desarrollador de producto | Relaciones institucionales con desarrolladores | Informativo-técnico | Experto

Los product managers de Google adoptan la voz del Google Developers Blog dirigida a una audiencia técnica. El enfoque en las especificaciones del modelo (rentabilidad, velocidad, latencia, ventana de contexto) responde a las prioridades de los desarrolladores. Un lenguaje técnico accesible (multimodal, grounding, code execution) demuestra la profundidad de las capacidades. Tono profesional y confiado, típico de las comunicaciones de desarrolladores de Google. Estructura centrada en funciones con información de disponibilidad que facilita la adopción. Típico de los anuncios de producto orientados a desarrolladores (al estilo de AWS What's New, Azure Updates), proporcionando detalles técnicos a la comunidad de desarrolladores que toma decisiones de integración.

## Pense-betes

- **Modelo más rápido y rentable** de la familia Gemini 2.5
- **Precios**: **0,10 $ por 1M de tokens de entrada**, **0,40 $ por 1M de tokens de salida**
- **Reducción del 40% en el precio de la entrada de audio** desde el lanzamiento en preview
- **Menor latencia** que 2.0 Flash-Lite y 2.0 Flash en una amplia gama de prompts
- **Ventana de contexto de 1 millón de tokens**
- **Capacidades de razonamiento nativas**
- **Herramientas avanzadas**: Grounding with Google Search, Code Execution, URL Context
- **Optimizado para aplicaciones sensibles a la latencia**: traducción, clasificación
- **Benchmarks**: supera a 2.0 Flash-Lite en código, matemáticas, ciencia, razonamiento, comprensión multimodal
- **Despliegues reales**: Satlyt (**reducción del 45% en la latencia**, **30% menos consumo de energía**), HeyGen (automatización de la planificación de vídeos, **más de 180 idiomas**), DocsHound (procesamiento de vídeos largos, miles de capturas extraídas), Evertune (síntesis rápida de grandes volúmenes)
- **Versión estable**: especificar "gemini-2.5-flash-lite", alias de preview eliminado el **25 de agosto**

## RésuméDe400mots

Google anunció la **disponibilidad general estable** de Gemini 2.5 Flash-Lite, marcando un avance significativo en la familia de modelos Gemini 2.5. Posicionado como **el modelo más rápido y rentable**, con un precio de **0,10 $ por millón de tokens de entrada y 0,40 $ por millón de tokens de salida**, Flash-Lite está diseñado para ofrecer una inteligencia excepcional por dólar. Este lanzamiento se apoya en el éxito de 2.5 Pro y 2.5 Flash, completando la gama de modelos 2.5 lista para un uso de producción a gran escala.

**Optimización del rendimiento y la latencia**

Gemini 2.5 Flash-Lite está particularmente optimizado para **aplicaciones sensibles a la latencia**, como la traducción y la clasificación, donde la velocidad y la eficiencia de costes tienen prioridad sin comprometer la calidad. Presenta **menor latencia** que sus predecesores, 2.0 Flash-Lite y 2.0 Flash, en una amplia gama de prompts. Además, Google ha **reducido el precio de la entrada de audio en un 40%** desde el lanzamiento en preview, reforzando su accesibilidad económica.

**Calidad en los benchmarks**

A pesar de su posicionamiento rentable, el modelo demuestra **una alta calidad en diversos benchmarks**, incluyendo código, matemáticas, ciencia, razonamiento y comprensión multimodal, **superando a 2.0 Flash-Lite**. Los desarrolladores que construyen con 2.5 Flash-Lite tienen acceso a un sólido conjunto de funciones, incluyendo una **ventana de contexto de 1 millón de tokens**, presupuestos de razonamiento controlables y soporte nativo de herramientas. Estas herramientas incluyen **Grounding with Google Search, Code Execution y URL Context**, permitiendo aplicaciones de IA más sofisticadas e integradas.

**Aplicaciones reales validadas**

Las aplicaciones prácticas de Gemini 2.5 Flash-Lite ya son visibles en varios despliegues exitosos. **Satlyt** aprovecha su velocidad para lograr una **reducción del 45% en la latencia** en diagnósticos críticos a bordo y una **caída del 30% en el consumo de energía** de su plataforma de computación espacial descentralizada. **HeyGen** se apoya en el modelo para automatizar la planificación de vídeos, optimizar contenido y traducir vídeos a **más de 180 idiomas**, permitiendo experiencias de usuario globales y personalizadas. **DocsHound** convierte demostraciones de producto en documentación completa procesando rápidamente vídeos largos y extrayendo miles de capturas de pantalla. **Evertune** se beneficia de la velocidad de Flash-Lite para escanear y sintetizar rápidamente grandes volúmenes de salidas de modelos, proporcionando un análisis dinámico y oportuno para las marcas que monitorizan su representación en los modelos de IA.

**Accesibilidad y despliegue**

Los desarrolladores pueden empezar a usar la **versión estable** de Gemini 2.5 Flash-Lite especificando **"gemini-2.5-flash-lite"** en su código, ya que el alias de preview se elimina el **25 de agosto**. El modelo está disponible en **Google AI Studio y Vertex AI**, invitando a los desarrolladores a explorar sus capacidades para construir soluciones de IA innovadoras. Este posicionamiento estratégico de Flash-Lite como opción predilecta para aplicaciones rentables y sensibles a la latencia ilustra el compromiso de Google de ofrecer una gama de modelos de varios niveles que aborde las diversas necesidades de los desarrolladores, desde la inferencia ultrarrápida hasta el razonamiento profundo, manteniendo al mismo tiempo precios competitivos para democratizar el acceso a la IA avanzada.

## GrapheDeConnaissance

- Google —publie→ Gemini 2.5 Flash-Lite (TECHNOLOGIE, 0.99)
- Logan Kilpatrick —publie→ Gemini 2.5 Flash-Lite stable GA (EVENEMENT, 0.98)
- Zach Gleicher —publie→ Gemini 2.5 Flash-Lite stable GA (EVENEMENT, 0.98)
- Gemini 2.5 Flash-Lite —fait_partie_de→ Gemini 2.5 Flash-Lite (TECHNOLOGIE, 0.99)
- Gemini 2.5 Flash-Lite —mesure→ $0.10 / 1M tokens input, $0.40 / 1M tokens output (MESURE, 0.99)
- Gemini 2.5 Flash-Lite —surpasse→ Gemini 2.0 Flash-Lite (TECHNOLOGIE, 0.95)
- Gemini 2.5 Flash-Lite —utilise→ Grounding with Google Search (TECHNOLOGIE, 0.97)
- Gemini 2.5 Flash-Lite —observé_dans→ Google AI Studio (TECHNOLOGIE, 0.98)
- Gemini 2.5 Flash-Lite —observé_dans→ Vertex AI (TECHNOLOGIE, 0.98)
- Satlyt —utilise→ Gemini 2.5 Flash-Lite (TECHNOLOGIE, 0.97)
- Satlyt —mesure→ réduction de 45% de la latence des diagnostics onboard (MESURE, 0.96)
- HeyGen —utilise→ Gemini 2.5 Flash-Lite (TECHNOLOGIE, 0.97)
- DocsHound —utilise→ Gemini 2.5 Flash-Lite (TECHNOLOGIE, 0.97)
- Evertune —utilise→ Gemini 2.5 Flash-Lite (TECHNOLOGIE, 0.97)
- Gemini 2.5 Flash-Lite —mesure→ fenêtre de contexte de 1 million de tokens (MESURE, 0.99)

---
Canonical: https://www.thekb.eu/es/fiches/gemini-25-flash-lite-stable-ga-google-2025-07-22/
