La competencia entre los modelos de inteligencia artificial se midió mucho tiempo en capacidades: quién razona mejor, quién escribe código más limpio, quién alucina menos. Esta semana, Google lanzó Gemini 3.7 Flash dejando en claro que hay una nueva métrica que importa cada vez más.
MÁXIMA VELOCIDAD
Google lanzó la IA más rápida del mundo: todo lo que tenés que saber de Gemini 3.7 Flash
El nuevo modelo de Google que alcanza los 340 tokens por segundo. La respuesta de OpenAI llegó el mismo día con una promesa de velocidades todavía mayores.
En pocas palabras
- Google lanza Gemini 3.7 Flash: El modelo alcanza 340 tokens por segundo, superando a sus competidores en velocidad.
- Competencia con OpenAI: La contraofensiva de OpenAI promete un modo ultrarrápido para GPT Sol a 750 tokens por segundo.
- Desafío pendiente: El retraso en el lanzamiento de Gemini 3.5 Pro genera dudas sobre la competitividad de Google.
Según mediciones independientes de Artificial Analysis, Gemini 3.7 Flash alcanza 340 tokens de salida por segundo, posicionándose como el modelo más rápido disponible en el mercado.
Para dimensionar ese número, lo podemos comparar con la competencia. GPT-5.6 Luna, el segundo más veloz, llega a 152 tokens por segundo. Los modelos más avanzados de Anthropic y OpenAI, Fable 5 y GPT Sol, se quedan en 63 y 62 tokens por segundo respectivamente.
Flash es más del doble de rápido que su competidor más cercano y más de cinco veces más rápido que los modelos tope de gama.
El precio también bajó. 3.7 Flash cuesta la mitad que su predecesor 3.6 Flash, a 0,75 dólares por millón de tokens de entrada y 3,75 por millón de tokens de salida.
¿Qué significa generar 340 tokens por segundo?
Los tokens son las unidades con las que los modelos procesan y generan texto. A mayor velocidad de generación, más rápido recibe el usuario una respuesta completa.
Para un uso casual eso puede ser irrelevante. Para un desarrollador corriendo cientos de consultas automatizadas, procesando código en tiempo real o ejecutando flujos de trabajo encadenados, la diferencia entre 60 y 340 tokens por segundo es la diferencia entre una herramienta que frena el trabajo y una que lo acelera.
Google apuntó específicamente a ese perfil de usuario. Según la empresa, 3.7 Flash mejora en depuración de código, planificación de tareas de múltiples pasos y generación de aplicaciones web completas con menos instrucciones.
"Una ejecución más disciplinada implica menos supervisión manual y menos reintentos en los flujos de trabajo de ingeniería", dijo Google en su blog.
El modelo ya entró en el top 10 de LLM Arena para tareas de desarrollo web, la plataforma donde usuarios evalúan comparativamente los distintos modelos disponibles.
Google gana en velocidad, pero no en todos los benchmarks
En las comparativas que publicó Google con la presentación del modelo lo miden contra Claude Sonnet 5, GPT-5.6 Terra y Muse Spark 1.2. Los modelos que dejó afuera de las tablas son precisamente los más relevantes, Fable 5 de Anthropic y GPT Sol de OpenAI.
Cuando se miran los benchmarks independientes, 3.7 Flash gana en velocidad pero no necesariamente en todas las capacidades avanzadas. Es un modelo de la familia Flash, diseñado para eficiencia y velocidad, no para ser el más capaz en tareas de razonamiento complejo.
Los modelos más poderosos del mercado son más lentos precisamente porque hacen más.
La contraofensiva de OpenAI: la promesa de un modo ultrarrápido a 750 tokens
El mismo día que Google lanzó 3.7 Flash, OpenAI anunció que prepara un modo ultrarrápido para GPT Sol que prometería alcanzar 750 tokens por segundo, más del doble que Gemini.
Los 340 tokens de Gemini son una medición independiente verificada. Los 750 tokens de OpenAI son una promesa de lanzamiento futuro, sin fecha confirmada ni pruebas.
Son números de distinta naturaleza. Pero el anuncio definió que la velocidad pasó de ser una característica técnica a ser un argumento de marketing central.
El desafío pendiente de Google
Mientras Google amplía su gama Flash, el modelo que realmente importa para competir en el segmento más avanzado del mercado sigue sin fecha.
Gemini 3.5 Pro, el modelo insignia que se esperaba para este año, acumula retrasos que los inversores empezaron a notar.
Bloomberg reportó que esa demora intensificó las dudas sobre si Google puede superar a sus competidores en las áreas de mayor valor comercial, especialmente la programación de IA avanzada.
El CEO Sundar Pichai dijo en la última presentación de resultados que el objetivo es lanzar modelos a mayor velocidad, y que ya se están dedicando recursos significativos al entrenamiento de Gemini 4.
La empresa está mirando adelante, pero el problema es que mientras Gemini 4 se entrena y 3.5 Pro se retrasa, OpenAI y Anthropic siguen lanzando.
-------------
Más contenido en Urgente24
La economía pierde lugar: La política domina la evaluación de la gestión Milei y la empeora
Independiente echó a Quinteros, pero hubo uno que la pasó peor: Botafogo se comió seis
Colonos de Israel asedian Cisjordania y Estados Unidos por primera vez los llama "matones"
China y Rusia aceleran sus aviones de pasajeros para dejar atrás a Airbus y Boeing
Más allá de las urnas: Las exigencias de Ignacio Torres para un pacto entre LLA y el PRO









