Qwen 3.7 Max de Alibaba Establece Nuevos Referentes para Modelos de Agentes IA con Contexto de 1M Tokens
Alibaba lanzó Qwen 3.7 Max, un modelo frontier de pesos cerrados que logra 60,6 en SWE-Pro y 92,4 en GPQA Diamond, a un precio de $2,50/$7,50 por millón de tokens. Ejecuta más de 1.000 llamadas a herramientas de forma autónoma y cuenta con modo de razonamiento extendido nativo para flujos agénticos de largo horizonte.
El equipo Qwen de Alibaba publicó Qwen 3.7 Max el 19 de mayo — un modelo frontier de pesos cerrados que supera a todos sus competidores en benchmarks de programación agéntica y razonamiento de largo plazo.
Los resultados son contundentes: 60,6 en SWE-Pro (el benchmark de ingeniería de software), 69,7 en Terminal-Bench 2.0 y 92,4 en GPQA Diamond. Esos valores lo sitúan por encima del nivel frontier actual en tareas que evalúan específicamente la capacidad de un modelo para mantener un plan largo sin degradarse en alucinaciones.
Lo que diferencia a este modelo
Qwen 3.7 Max está construido sobre una ventana de contexto de un millón de tokens y un modo de razonamiento extendido nativo que se activa cuando el modelo determina que un problema requiere planificación en múltiples pasos. No es un añadido externo: la arquitectura de razonamiento extendido es la vía de inferencia predeterminada para tareas complejas, no un parámetro opcional.
El equipo demostró una ejecución en la que el modelo realizó más de 1.000 llamadas autónomas a herramientas de forma secuencial: leyendo archivos, ejecutando pruebas, revisando registros y escribiendo parches sin intervención humana. Eso representa un salto cualitativo respecto a modelos que pierden coherencia tras 50 o 100 llamadas.
La velocidad de inferencia se describe como 10 veces superior a la de versiones anteriores de Qwen, gracias a una optimización a nivel de compilador en la plataforma de chips propios de Alibaba. En proveedores externos la mejora es menor, pero la latencia en DashScope sigue siendo notablemente inferior a la de modelos comparables.
Precio y acceso
A $2,50 por millón de tokens de entrada y $7,50 por millón de tokens de salida, Qwen 3.7 Max está disponible únicamente como API — sin pesos abiertos. Se puede acceder a través de DashScope, OpenRouter y Together AI. Ese precio lo sitúa por debajo de GPT-5.5 Instant en coste de entrada, ofreciendo además una ventana de contexto nativa más amplia.
Alibaba no ha anunciado si publicará los pesos abiertos ni cuándo. Los lanzamientos anteriores de Qwen siguieron el patrón de API cerrada primero, seguida de una versión para la comunidad. Aquí no hay plazos confirmados.
Implicaciones para el mercado de agentes
El triple benchmark — programación (SWE-Pro), operaciones de terminal (Terminal-Bench) y razonamiento de nivel posgrado (GPQA Diamond) — cubre las tres capacidades básicas de los frameworks de agentes empresariales actuales. Un modelo que puntúa alto en los tres a este precio restructura el coste de los productos SaaS agénticos que se están construyendo ahora mismo.
Para desarrolladores que trabajan con pipelines de agentes, la ventana de 1M tokens y el modo de razonamiento extendido son los diferenciadores prácticos. Mantener el contexto completo de una base de código sin fragmentación, y conservar la coherencia a través de más de 1.000 pasos de herramientas, elimina una categoría de hacks de ingeniería de la que dependen la mayoría de los pipelines actuales.
La decisión de mantener los pesos cerrados sigue siendo un obstáculo para equipos que necesitan auto-alojamiento por razones de cumplimiento normativo. Pero para el desarrollo API-first, el perfil de benchmarks y el precio hacen que Qwen 3.7 Max merezca una evaluación seria frente a las alternativas actuales.
Lecturas relacionadas
- Modelos de IA El Qwen3.8-Max de Alibaba supera a GPT-5.6 Sol y Claude Fable 5 en benchmarks clave
- Modelos de IA Alibaba presenta Qwen3.8-Max, un modelo de 2,4 billones de parámetros que dice superar a todos menos a Fable 5
- Modelos de IA Qwen3.6-27B de Alibaba Supera a un Modelo MoE de 397B en Codificación — El Modelo de Código Abierto que Vale la Pena Autoalojar