Las grandes firmas de inteligencia artificial aceleran el despliegue de modelos para agentes autónomos y reducen tiempos de respuesta.
La carrera global por el dominio de la inteligencia artificial entró en una fase determinante con el lanzamiento de Gemini 3.7 Flash por parte de Google DeepMind, una actualización orientada de lleno a la ejecución de tareas de programación, flujos de trabajo autónomos y optimización de costos en sistemas agénticos. Esta presentación coincide con movimientos estratégicos de sus principales competidores: OpenAI con su infraestructura Ultrafast sobre silicio especializado y DeepSeek con el ajuste tarifario de su modelo V4 Pro.
El giro de Google hacia la economía por paso
El lanzamiento de Gemini 3.7 Flash, concretado a escasas tres semanas de la versión previa, responde a una estrategia enfocada en la autonomía operativa más que en el conocimiento enciclopédico de un chatbot convencional. En evaluaciones de ingeniería de software complejas como DeepSWE 1.1 y Terminal-Bench, el modelo registró avances de hasta 16 puntos porcentuales y triplicó su desempeño en pruebas de terminal autónoma frente a su antecesor.
La arquitectura del modelo prioriza la planificación multietapa, la consulta de herramientas en tiempo real y la autocorrección ante fallos de ejecución. Para incentivar su adopción, la tecnológica fijó una tarifa promocional de 0.75 dólares por millón de tokens de entrada y 3.75 dólares por millón de salida hasta el cierre de 2026, buscando abaratar el costo computacional de agentes que ejecutan cientos de llamadas encadenadas por proceso.
Reacomodo interno en DeepMind y retrasos en la gama alta
La salida de este modelo ocurre en medio de una reestructuración operativa en Alphabet. Demis Hassabis asumió la presidencia y el cargo de científico en jefe corporativo, mientras Koray Kavukcuoglu tomó las riendas operativas de Gemini y la investigación de frontera.
A la par de estos movimientos y de la salida de investigadores históricos para fundar nuevos proyectos independientes, el lanzamiento del modelo insignia Gemini 3.5 Pro continúa sin fecha fija de salida, evidenciando tensiones en la asignación de capacidad de cómputo para modelos de mayor escala.
OpenAI y DeepSeek: la disputa por latencia y rentabilidad
Mientras Google apuesta al volumen económico, OpenAI activó el nivel de interfaz de programación Ultrafast para su modelo GPT-5.6, ejecutado sobre los procesadores de escala de oblea de Cerebras Systems. Esta tecnología procesa hasta 750 tokens de salida por segundo al eliminar el cuello de botella de transferencia de datos entre servidores tradicionales, enfocándose en tareas donde cada milisegundo cuenta, como la detección de fraudes y la atención síncrona por voz.
En el mercado asiático, DeepSeek formalizó la salida de V4 Pro introduciendo esquemas tarifarios de mayor costo y bandas horarias de alta demanda. La compañía china avanza en una ronda de capital respaldada por una valuación estimada en 74,000 millones de dólares, acelerando la contratación de ingenieros para desarrollar chips propios que reduzcan su dependencia de proveedores extranjeros de hardware.



Cinco lecciones que los insectos pueden enseñarnos para tomar mejores decisiones
¿Cuándo será el próximo eclipse solar total en México?