El nuevo modelo de razonamiento de Google, Gemini 2.5 Deep Think, es el más avanzado de la compañía hasta la fecha, gracias a su capacidad para explorar y considerar múltiples ideas de forma simultánea con el objetivo de ofrecer la mejor respuesta posible. Aunque se presentó por primera vez en mayo, durante el evento Google I/O 2025, no será hasta este viernes cuando los usuarios de la suscripción Ultra de Google puedan comenzar a utilizarlo.
Gemini 2.5 Deep Think es también el primer modelo multiagente de Google disponible públicamente. Este sistema genera múltiples agentes de IA que trabajan en paralelo para resolver una misma pregunta, lo que requiere un uso considerable de recursos computacionales, pero ofrece respuestas más profundas, razonadas y precisas. Según Google, aunque este modelo puede tardar horas en razonar, ya es capaz de resolver problemas matemáticos complejos mucho más rápido que versiones anteriores. La compañía confía en que esta tecnología impulse el ámbito de la investigación académica y científica, y ha abierto la puerta a recibir retroalimentación que le ayude a mejorar el enfoque multiagente.
“Deep Think puede ayudar a las personas a abordar problemas que requieren creatividad, planificación estratégica y mejoras paso a paso”, explicó Google en una publicación de blog.
Deep Think: rendimiento de vanguardia
El rendimiento de Deep Think destaca en exigentes benchmarks diseñados para medir habilidades de codificación, ciencia, conocimiento y razonamiento. En particular, ha demostrado resultados sobresalientes en Humanity’s Last Exam (HLE), una de las pruebas más rigurosas para evaluar el entendimiento multidisciplinar. Gemini 2.5 Deep Think logró una puntuación del 34,8 % sin herramientas, frente al 25,4 % de Grok 4 (xAI) y el 20,3 % del modelo o3 de OpenAI, según datos compartidos por Google.

Además, este nuevo modelo tiene la capacidad de generar respuestas significativamente más largas y detalladas que los modelos de IA tradicionales, lo que puede ser clave en tareas complejas y procesos iterativos.
¿Cómo funciona según cada tipo de tarea?
- Desarrollo y diseño iterativos: Google destaca el rendimiento de Deep Think en tareas que requieren la construcción progresiva de un producto o idea. Por ejemplo, puede contribuir al diseño web mejorando tanto la estética como la funcionalidad de forma coordinada.
- Descubrimiento científico y matemático: Gracias a su habilidad para analizar problemas de alta complejidad, el modelo puede asistir en la formulación de conjeturas matemáticas, análisis de literatura científica o validación de hipótesis. Esto lo convierte en un potencial aliado para investigadores académicos.
- Desarrollo algorítmico y programación avanzada: Deep Think destaca especialmente en desafíos de codificación de alto nivel, donde se requiere evaluar múltiples alternativas, compensaciones y complejidades temporales antes de generar una solución eficaz.
En las próximas semanas, Google compartirá Gemini 2.5 Deep Think con un grupo selecto de evaluadores a través de la API de Gemini, con el objetivo de explorar nuevas aplicaciones de su sistema multiagente en entornos reales. La compañía quiere comprender mejor cómo desarrolladores, empresas y universidades pueden beneficiarse de este nuevo enfoque de IA colaborativa.



