Google apuesta a modelos más rápidos mientras acelera el desarrollo de Gemini 4. La compañía busca ganar terreno frente a OpenAI y Anthropic en la carrera por la IA.
¿Qué significa generar 340 tokens por segundo?
Los tokens son las unidades con las que los modelos procesan y generan texto. A mayor velocidad de generación, más rápido recibe el usuario una respuesta completa.
Para un uso casual eso puede ser irrelevante. Para un desarrollador corriendo cientos de consultas automatizadas, procesando código en tiempo real o ejecutando flujos de trabajo encadenados, la diferencia entre 60 y 340 tokens por segundo es la diferencia entre una herramienta que frena el trabajo y una que lo acelera.
Google apuntó específicamente a ese perfil de usuario. Según la empresa, 3.7 Flash mejora en depuración de código, planificación de tareas de múltiples pasos y generación de aplicaciones web completas con menos instrucciones.
"Una ejecución más disciplinada implica menos supervisión manual y menos reintentos en los flujos de trabajo de ingeniería", dijo Google en su blog.
El modelo ya entró en el top 10 de LLM Arena para tareas de desarrollo web, la plataforma donde usuarios evalúan comparativamente los distintos modelos disponibles.
Google gana en velocidad, pero no en todos los benchmarks
En las comparativas que publicó Google con la presentación del modelo lo miden contra Claude Sonnet 5, GPT-5.6 Terra y Muse Spark 1.2. Los modelos que dejó afuera de las tablas son precisamente los más relevantes, Fable 5 de Anthropic y GPT Sol de OpenAI.
Cuando se miran los benchmarks independientes, 3.7 Flash gana en velocidad pero no necesariamente en todas las capacidades avanzadas. Es un modelo de la familia Flash, diseñado para eficiencia y velocidad, no para ser el más capaz en tareas de razonamiento complejo.
Los modelos más poderosos del mercado son más lentos precisamente porque hacen más.
La contraofensiva de OpenAI: la promesa de un modo ultrarrápido a 750 tokens
El mismo día que Google lanzó 3.7 Flash, OpenAI anunció que prepara un modo ultrarrápido para GPT Sol que prometería alcanzar 750 tokens por segundo, más del doble que Gemini.
Los 340 tokens de Gemini son una medición independiente verificada. Los 750 tokens de OpenAI son una promesa de lanzamiento futuro, sin fecha confirmada ni pruebas.
Son números de distinta naturaleza. Pero el anuncio definió que la velocidad pasó de ser una característica técnica a ser un argumento de marketing central.
El desafío pendiente de Google
Mientras Google amplía su gama Flash, el modelo que realmente importa para competir en el segmento más avanzado del mercado sigue sin fecha.
Gemini 3.5 Pro, el modelo insignia que se esperaba para este año, acumula retrasos que los inversores empezaron a notar.
Bloomberg reportó que esa demora intensificó las dudas sobre si Google puede superar a sus competidores en las áreas de mayor valor comercial, especialmente la programación de IA avanzada.
El CEO Sundar Pichai dijo en la última presentación de resultados que el objetivo es lanzar modelos a mayor velocidad, y que ya se están dedicando recursos significativos al entrenamiento de Gemini 4.
La empresa está mirando adelante, pero el problema es que mientras Gemini 4 se entrena y 3.5 Pro se retrasa, OpenAI y Anthropic siguen lanzando.
-------------
Más contenido en Urgente24
La economía pierde lugar: La política domina la evaluación de la gestión Milei y la empeora
Independiente echó a Quinteros, pero hubo uno que la pasó peor: Botafogo se comió seis
Colonos de Israel asedian Cisjordania y Estados Unidos por primera vez los llama "matones"
China y Rusia aceleran sus aviones de pasajeros para dejar atrás a Airbus y Boeing
Más allá de las urnas: Las exigencias de Ignacio Torres para un pacto entre LLA y el PRO