Qwen de Alibaba en 2026: de líder open-source a modelos insignia cerrados

AI-модели в этой статье
Mientras los managers pagan por ChatGPT Plus y Claude Pro, Alibaba ha construido uno de los ecosistemas de IA más grandes del mundo – con chat gratuito, modelos abiertos y precios de API varias veces inferiores a los de la competencia. Qwen (se pronuncia “chuén”, de 通义千问 – “Mil Preguntas”) superó a mediados de 2026 en número de descargas a todos sus equivalentes occidentales y se convirtió en una herramienta que todo manager debería conocer. Pero en medio año el ecosistema cambió de forma considerable: los modelos insignia pasaron a ser cerrados, desarrolladores clave abandonaron el proyecto y la estrategia se desplazó de “todo gratis” al modelo habitual de “lo mejor se paga”.
La ventaja principal de Qwen para un manager es simple: es un asistente de IA completo, disponible gratis a través de Qwen Chat – sin suscripción, sin límite de solicitudes. Hacia abril de 2026, las descargas de los modelos Qwen se acercaron a los 1.000 millones – la familia representa más del 50% de todas las descargas de modelos abiertos del mundo. La app de consumo de Qwen tiene 203 millones de usuarios activos mensuales, el tercer puesto mundial tras ChatGPT y DouBao.

¿Qué hace diferente a Qwen?
La diferencia clave de Qwen frente a la mayoría de competidores es la escala y la flexibilidad. Alibaba publica una parte importante de sus modelos en abierto en Hugging Face – cualquier empresa puede descargarlos y desplegarlos en sus propios servidores. Entre quienes han usado Qwen como base está Oylan, el modelo de lenguaje nacional de Kazajistán. Al mismo tiempo, los modelos insignia de la serie 3.7 (Max y Plus) solo están disponibles vía API – Alibaba se acerca cada vez más al modelo de OpenAI y Anthropic.
- La mayoría de los modelos Qwen están disponibles para descarga y despliegue en servidor propio – pero no todos: la serie 3.7 es cerrada. Para empresas con requisitos estrictos de seguridad de datos, los modelos abiertos (Qwen3.6-Plus, Qwen 4 Coder) siguen siendo de los mejores del mundo.
- Los modelos insignia funcionan bajo un principio de especialización: cada solicitud activa solo el “segmento de conocimiento” necesario, sin usar el modelo completo. El resultado práctico es que un modelo del tamaño de un portátil da una calidad de respuesta que antes requería equipos de servidor de coste elevado.
- La serie de modelos de texto Qwen3 soporta 119 idiomas y dialectos; las versiones más recientes soportan 201 idiomas, incluido el español.
- Texto, imágenes, vídeo, audio, síntesis de voz – todo en un mismo ecosistema.
Qué sabe hacer Qwen en julio de 2026
La línea Qwen cubre hoy prácticamente todos los tipos de tareas a los que se enfrenta una empresa moderna:
- Agentes de nueva generación. Qwen 3.7 Max (mayo de 2026) está diseñado como “modelo agéntico” – capaz de ejecutar de forma autónoma cadenas de más de 1.000 llamadas a herramientas en una sola sesión sin perder calidad. Contexto de 1 millón de tokens, el nivel de alucinaciones más bajo entre los modelos de frontera (22,9%).
- Agente multimodal. Qwen 3.7 Plus (GA desde el 1 de junio de 2026) entiende texto, imágenes y vídeo, ve la pantalla y devuelve las coordenadas de los elementos de la interfaz (GUI agent grounding). Contexto de 1 millón de tokens, precio de $0,40/$1,60 por millón de tokens – 6 veces más barato que Qwen 3.7 Max.
- Código de nuevo nivel. Qwen 4 Coder 32B-A3B (2 de junio de 2026) – primer modelo abierto en superar el 82% en SWE-Verified. Arquitectura MoE: 32.000 millones de parámetros, de los cuales solo 3.000 millones están activos – funciona en un Mac con 24 GB de memoria a 58 tokens/seg. Licencia Apache 2.0.
- Trabajo con documentos largos. Qwen3.6-Plus retiene en memoria hasta 1 millón de tokens – unas 2.000 páginas A4 por solicitud. Se puede cargar un informe anual completo, la base de tickets de soporte o todo un repositorio de código y hacer preguntas sobre el conjunto.
- Razonamiento complejo. Qwen3.7-Max en modo de cadena de razonamiento alcanza 92,4% en GPQA Diamond – por encima de Claude Opus 4.6 Max (91,3%) y K2.6 Thinking (90,5%). En problemas matemáticos (Apex Math) – 44,5% frente al 34,5% de Claude Opus 4.6 Max.
- Programación agéntica. Qwen3.6-35B-A3B funciona junto a Claude Code, Qwen Code y herramientas similares, y resuelve tareas al nivel de Claude Sonnet 4.5 a un coste varias veces menor. Licencia abierta – se puede desplegar dentro de la empresa.
- Voz y vídeo en un solo modelo. Qwen3.5-Omni entiende simultáneamente texto, imágenes, audio y vídeo dentro de una arquitectura única. Sobre ella funciona “Audio-Visual Vibe Coding” – un modo en el que la tarea se describe por voz y con vídeo de la pantalla, y el modelo genera el código.
- Generación de imágenes y voz. Qwen-Image-2512 produce imágenes fotorrealistas con renderizado preciso de texto multilínea – algo poco frecuente en los modelos generativos. Qwen3-TTS sintetiza voz con clonación para narración y asistentes de voz.
- Top entre los modelos abiertos. Qwen3.5-Max-Preview está en el top 5 de LM Arena con 1464 puntos – primer puesto entre modelos chinos y sexto a nivel mundial. Qwen3.5-397B-A17B es el tercer mejor resultado entre los modelos open-source del mundo, comparable a GPT-5 y Claude Opus.
Modelos principales de Qwen (julio 2026)
Hacia mediados de 2026, Alibaba ha construido una de las líneas de modelos más amplias de la industria.

Qwen 3.7 Max – Buque insignia agéntico (mayo de 2026)
Qwen 3.7 Max (sin espacio en la notación técnica – Qwen3.7-Max) se anunció en el Alibaba Cloud Summit del 20 de mayo de 2026, tras aparecer discretamente en LM Arena el 14 de mayo. La serie 3.7 incluye dos modelos: Qwen3.7-Max (buque insignia de texto para razonamiento y tareas agénticas) y Qwen3.7-Plus (agente multimodal, GA desde el 1 de junio de 2026).
Características clave de Qwen3.7-Max:
- Contexto de 1 millón de tokens – el doble que Qwen 3.6 Max (256K)
- Arquitectura agéntica – el modelo puede ejecutar sesiones autónomas de hasta 35 horas, encadenando más de 1.000 llamadas a herramientas consecutivas sin perder calidad. En la demo del summit, el modelo optimizó de forma autónoma un kernel a través de más de 1.000 modificaciones de código, logrando una aceleración de 10x en la inferencia
- El nivel de alucinaciones más bajo entre los modelos de frontera – 22,9%
- Modo “Thinking” – cadena de razonamiento conmutable, visible en la interfaz de Qwen Chat
Resultados en benchmarks:
| Benchmark | Qwen3.7-Max | Comparación |
|---|---|---|
| Intelligence Index v4.0 | 56,6 | 5º puesto mundial, 1º entre modelos chinos |
| GPQA Diamond | 92,4% | Por encima de Claude Opus 4.6 Max (91,3%) |
| Apex Math | 44,5% | Por encima de Claude Opus 4.6 Max (34,5%) |
| MRCR-v2 128K (contexto largo) | 90,4% | Por encima de Qwen3.6-Plus (85,9%) |
| Terminal-Bench Hard (código) | 50,8% | – |
Importante: Qwen3.7 solo está disponible vía API – no hay pesos abiertos. Alibaba, históricamente, publica versiones abiertas tras un preview cerrado (como ocurrió con Qwen 3.6), pero para la serie 3.7 no se han anunciado plazos. Esto forma parte de una tendencia más amplia: los buques insignia se están cerrando.
Qwen 3.7 Plus – Agente multimodal (GA desde el 1 de junio de 2026)
Qwen3.7-Plus apareció en LM Arena el 14 de mayo como preview y salió en disponibilidad general (GA) el 1 de junio de 2026. Es la versión multimodal de la serie 3.7: el modelo recibe texto, imágenes y vídeo como entrada y devuelve texto.
Diferencia clave respecto a Qwen3.7-Max:
- GUI Agent Grounding – el modelo “ve” una captura de pantalla y devuelve coordenadas de píxel exactas de los elementos de la interfaz. Esto permite construir agentes autónomos que manejan aplicaciones de forma visual – sin necesidad de API
- Contexto de 1 millón de tokens, hasta 65.536 tokens de salida, presupuesto interno de razonamiento de hasta 256K tokens
- Parámetro
preserve_thinking– conserva el estado del razonamiento entre llamadas a herramientas dentro del ciclo agéntico - Precio de $0,40 / $1,60 por millón de tokens (entrada/salida) – 6 veces más barato que Qwen 3.7 Max
Qwen 3.7 Plus es un modelo cerrado (solo API, sin pesos abiertos). Para un manager, esto es una señal importante: los modelos multimodales más capaces de Qwen ahora solo están disponibles vía API en la nube, no para despliegue local.
Qwen3.6-Plus – Buque insignia con contexto de 1 millón de tokens
Lanzado en abril de 2026 como respuesta a Gemini 2.5 y GPT-5. La arquitectura híbrida combina atención lineal y mezcla dispersa de expertos – lo que permite trabajar con documentos enormes sin perder velocidad.
- Contexto de hasta 1 millón de tokens – unas 2.000 páginas A4 por solicitud. Se puede cargar un repositorio de código entero, un informe anual o una base de tickets de soporte.
- 78,8% en SWE-bench Verified – casi al nivel de los buques insignia cerrados en tareas de programación.
- Audio-Visual Vibe Coding: describe la tarea por voz y muestra el mockup en cámara – el modelo genera el código.
- Licencia Apache 2.0 – los pesos se pueden descargar y ejecutar localmente.
Qwen3.5 – Familia de modelos multimodales
Lanzada en marzo de 2026, disponible en Microsoft Azure. La diferencia clave: los modelos “entienden” texto, imágenes, audio y vídeo como un todo dentro de una sola arquitectura. Una misma consulta puede referenciar a la vez un documento cargado, una captura de pantalla, un fragmento de vídeo y contexto de texto.
La serie cubre un rango sin precedentes – desde 0,8 mil millones de parámetros (funciona en un smartphone) hasta 397 mil millones (comparable con GPT y Claude):
- Qwen3.5-4B / 9B – los más “inteligentes” de su categoría de peso; funcionan en un portátil y superan a modelos 2–3 veces más grandes. Incluso en un teléfono.
- Qwen3.5-27B – seguimiento estricto de instrucciones: informes estructurados, formularios, tareas de varios pasos.
- Qwen3.5-35B-A3B – equilibrio entre calidad y velocidad: 35.000 millones de parámetros, pero solo 3.000 millones activos.
- Qwen3.5-122B-A10B – análisis complejo y grandes volúmenes de información.
- Qwen3.5-397B-A17B – buque insignia de código abierto; en el test GDPval-AA supera a su predecesor Qwen3-235B en 361 puntos. Tercer mejor resultado entre los modelos open-source del mundo.
Común a toda la serie:
- Se pueden cargar unas 400 páginas A4 por solicitud; si es necesario, el contexto se amplía al equivalente de un libro pequeño.
- Dos modos de trabajo – “Pensar” (razonamiento paso a paso para tareas complejas) y “No Pensar” (respuestas instantáneas para lo rutinario) – conmutables dentro de un mismo modelo sin cambiar de servicio.
- Soporte para 201 idiomas, incluido el español.
- En tests independientes compite con los principales modelos multimodales a un coste significativamente menor.
El cambio entre modos es una de las innovaciones clave de Qwen3/3.5. No hace falta elegir entre un modelo “inteligente” y uno “rápido”: el mismo modelo se adapta a la complejidad de la tarea. Para analizar un informe financiero – modo de análisis profundo. Para responder “¿a qué hora es la reunión?” – respuesta instantánea sin demora.
Qwen3-235B – Buque insignia de texto de código abierto
Lanzado en abril de 2025, entrenado con el doble de datos que la generación anterior. La arquitectura especializada permite alcanzar calidad de buque insignia con un coste computacional significativamente menor – algo perceptible al trabajar vía API.
- El código del modelo es abierto – cualquier empresa puede descargarlo y ejecutarlo en sus propios servidores. Requiere hardware de servidor serio.
- El modelo “reflexiona” antes de responder – verifica la lógica paso a paso. Importante para cálculos complejos, análisis legal, planificación financiera.
- Qwen3-Max – versión en la nube vía API para quienes no quieren gestionar la instalación en servidor propio.
- Hasta 200 páginas A4 por solicitud; en modo extendido, hasta 400 páginas.
Qwen3-30B – Opción óptima para servidor corporativo
Modelo de clase empresarial: procesa solicitudes de forma rápida y económica pese a su gran tamaño. En calidad supera a modelos más antiguos que requerían el triple de recursos.
- Para equipos que necesitan un asistente potente en su propio servidor, sin el gasto de un centro de datos completo.
- Hasta 200 páginas A4 en una sola solicitud.
Qwen3-Coder-Next – Modelo para desarrolladores (febrero de 2026)
Modelo especializado para escribir y revisar código. En tests independientes supera a los modelos de DeepSeek y otras compañías, con resultados comparables a Claude Sonnet 4.5.
Para un manager, probablemente sea una herramienta no de uso directo, sino para el equipo de desarrollo: el modelo es capaz de mantener en memoria todo el proyecto – no un archivo aislado, sino el repositorio completo. Ejecutarlo en servidor propio requiere unos 51 GB de RAM.
Qwen 4 Coder – Primer codificador open-source con 82% en SWE-Verified (junio de 2026)
Qwen 4 Coder 32B-A3B, lanzado el 2 de junio de 2026, es el primer modelo que marca la transición a la cuarta generación de Qwen, y el primer modelo abierto en superar el 80% en SWE-Verified – el benchmark que mejor correlaciona con la productividad real de un desarrollador.
- Arquitectura MoE: 32.000 millones de parámetros en total, 3.000 millones activos por token. Contexto de 256K
- 82% en SWE-Verified – por encima de Devstral, Qwen3.6-Coder y de todos los modelos que pueden ejecutarse en un portátil
- Funciona en un Mac con 24 GB: 58 tokens/seg en un M4 Pro – uso completo sin necesidad de servidor
- Entrenado con tests reales: a diferencia de sus predecesores, Qwen 4 Coder se entrenó con reinforcement learning sobre resultados de ejecución de tests de tareas reales de GitHub, no solo sobre un corpus de código
- Licencia Apache 2.0 sin restricciones – se puede integrar en productos comerciales, hacer fine-tuning y revender
Para un director de TI o responsable de desarrollo, Qwen 4 Coder es motivo para revisar el gasto en suscripciones: un modelo que se puede ejecutar en el portátil de trabajo de un desarrollador resuelve tareas al nivel de los buques insignia en la nube.
La línea de modelos impresiona, pero elegir el modelo correcto es solo parte del trabajo. La diferencia entre “obtener una respuesta” y “obtener un resultado fiable” está en saber formular las consultas y verificar las conclusiones. A eso dedicamos nuestro módulo gratuito.
Qwen da acceso gratis a modelos potentes – pero el resultado depende de cómo formules la tarea. 9 ejercicios prácticos para comprobarlo tú mismo.
Sin pago requerido • Notificación al lanzamiento
Qwen3-VL – Análisis de imágenes y documentos
Entiende imágenes, vídeo (de más de una hora de duración), documentos PDF y texto manuscrito. El reconocimiento de texto funciona en 32 idiomas, incluido el español: sube el escaneo de un contrato o la foto de una pizarra tras una reunión y obtén texto estructurado.

Qwen3.5-Omni – Multimodalidad nativa (marzo de 2026)
Texto, imágenes, audio y vídeo se procesan con una arquitectura única, sin codificadores separados. Mejores resultados de su clase en 215 tareas de comprensión de audio y contenido audio-visual. Soporta entrada y salida de voz en tiempo real en español, búsqueda web integrada y llamadas a herramientas externas. Sobre Omni se implementa el escenario Audio-Visual Vibe Coding: el desarrollador describe los requisitos por voz y muestra la interfaz en vídeo – el modelo escribe el código.
Qwen3-TTS y Qwen-Image-2512 – Voz e imágenes
Qwen3-TTS (licencia abierta) – síntesis de voz con clonación y generación en streaming para asistentes de voz y narración. Qwen-Image-2512 – modelo de generación de imágenes actualizado con detalle fotorrealista y renderizado de texto de calidad: titulares multilínea, párrafos, elementos de marca – justo donde suelen fallar Midjourney y DALL-E.
Modelos para despliegue local
Alibaba ofrece una línea de modelos compactos que se pueden ejecutar en hardware propio – desde un portátil hasta un servidor corporativo:
| Dónde ejecutar | Modelo | Doc. máx. | Para qué tareas |
|---|---|---|---|
| Smartphone o tablet | Qwen3-0.6B | ~50 pág. | Autocompletado, prompts simples |
| Portátil normal (4 GB RAM) | Qwen3-1.7B | ~50 pág. | Borradores de correos, resúmenes |
| Portátil potente (8 GB RAM) | Qwen3-4B | ~50 pág. | Análisis de documentos, calidad de antiguos modelos top |
| PC de trabajo (16 GB RAM) | Qwen3-8B | ~200 pág. | Documentos complejos, tablas, diálogos largos |
| Servidor de departamento (32 GB RAM) | Qwen3-14B | ~200 pág. | Asistente de equipo completo |
| Servidor corporativo (48 GB RAM) | Qwen3-32B | ~200 pág. | Calidad cercana a los mejores modelos cloud |
| Clúster de servidores (140+ GB) | Qwen3-235B | ~400 pág. | Calidad insignia, compite con GPT y Claude |
Si tu empresa no puede enviar datos a servidores externos – finanzas, sanidad, sector público – puedes descargar el modelo que necesites y desplegarlo dentro de tu red corporativa. Los datos nunca salen de tu perímetro. Esto es imposible con ChatGPT o Claude.
Qwen3-4B, que cabe en un portátil normal (desde 4 GB de memoria), demuestra una calidad comparable a la de un modelo que antes requería todo un rack de servidores. Es uno de los ejemplos más claros de lo rápido que avanza la eficiencia de los modelos abiertos.
Guía práctica para elegir hardware, instalar Ollama y comparar modelos locales con los de nube – en la guía de LLM locales para managers.
Cómo se posiciona Qwen frente a la competencia
El buque insignia Qwen3-235B compite en tests independientes con DeepSeek-R1, o1, Grok-3 y Gemini 2.5 Pro. Para las tareas empresariales del día a día, los modelos de gama media dan resultados al nivel de los mejores servicios en la nube.
| Criterio | Qwen | ChatGPT / Claude | DeepSeek |
|---|---|---|---|
| Calidad de buque insignia | Muy alta (compite con GPT y Claude) | Muy alta | Muy alta |
| Acceso web gratuito | Sí, chat.qwen.ai sin límites | Limitado | Limitado |
| Se puede ejecutar en servidor propio | Parcialmente – hasta la serie 3.6 y Qwen 4 Coder; la serie 3.7 es cerrada | No | Parcialmente |
| Coste de API | El más bajo de su clase ($0,40/$1,60 en 3.7 Plus) | Medio–alto | Bajo |
| Trabajo con imágenes y vídeo | Sí (3.7 Plus, 3.5-Omni) | Sí | Limitado |
| Soporte del español | Buena | Excelente | Buena |
Para el 90% de las tareas empresariales – redacción, análisis de datos, resumen de documentos – Qwen 3.7 Plus da un resultado comparable al de Claude Sonnet 5, con un precio 5 veces menor.
Qwen, DeepSeek, ChatGPT – hay decenas de modelos, pero las tareas son las mismas. En el módulo gratuito probarás 9 escenarios reales de manager y entenderás qué herramienta te conviene.
Sin pago requerido • Notificación al lanzamiento
Resultados en nuestro benchmark (actualización – julio 2026)
Qwen es el ecosistema con más presencia en nuestro benchmark: 5 modelos entre los 25 primeros de 42 evaluados. Todos accesibles directamente. Los resultados se basan en 80 escenarios de tareas reales de manager (análisis, planificación, comunicación, gestión de equipos).
Los tres buques insignia – Qwen 3.6 Plus, Qwen 3.7 Max y Qwen 3.7 Plus – se han analizado más arriba con los datos más recientes del benchmark (puesto, puntuación, precio por tarea y fecha del test, en las tarjetas bajo sus títulos). Quedan dos modelos de gama media:
Qwen 3.6 Flash supera a Gemini 3.5 Flash a un precio varias veces menor; Qwen 3.6 27B destaca especialmente en planificación. En relación precio/calidad, Qwen 3.6 Plus resulta más convincente tanto que Claude Sonnet 5 como que GPT-5.4 Mini – con un precio notablemente más bajo.
La gran paradoja de la línea: Qwen 3.7 Max es más caro que Qwen 3.6 Plus, pero queda por debajo en la clasificación general. Su ventaja está concretamente en las categorías de “planificación” y “gestión de equipos” – si esas tareas son clave para ti, Max se justifica.
El perfil de Qwen 3.6 Plus en las ocho categorías muestra con claridad la brecha: buen desempeño en trabajo con texto y análisis – y fallos allí donde se necesita contexto local.
Debilidades comunes de toda la línea Qwen:
- Legislación laboral local – inventa artículos y sanciones que no existen. No conviene resolver cuestiones legales críticas sin verificación.
- Cálculos financieros – errores aritméticos sistemáticos.
- Conocimiento de contexto regional – la categoría más débil en todos los modelos Qwen.
Estrategia de uso: Qwen 3.6 Plus como modelo principal para el 80% de las tareas. Qwen 3.7 Plus para operaciones rutinarias masivas, cuando el presupuesto es crítico. Qwen 3.7 Max se justifica solo para tareas de planificación y gestión de equipos, donde es concretamente más fuerte.
Resultados interactivos completos →
Pruébalo tú mismo: planificación + legislación laboral
Qué observar: Qwen suele entregar una estructura de plan excelente (la planificación es su categoría más fuerte), pero al citar la legislación laboral mexicana a menudo inventa artículos y sanciones inexistentes (el conocimiento regional es su categoría más débil). DeepSeek tiene el mismo problema con la normativa local, y Kimi K2.6 es el mejor planificador, pero también flojea en los detalles regulatorios locales.
Aplicación práctica para un manager
La mayoría de managers que prueban Qwen empiezan con Qwen Chat – la interfaz web gratuita con acceso a los modelos actuales. Soporta búsqueda web, generación de imágenes y análisis de documentos sin ninguna suscripción. Un buen punto de entrada para quien quiera evaluar la herramienta antes de hablar con el departamento de TI.
Qwen maneja con solvencia documentos en español: escaneos de contratos, notas manuscritas, fotos de pizarras tras reuniones. Sube una foto – obtén texto estructurado. El reconocimiento funciona en 32 idiomas, y la calidad en español es notablemente mejor que en muchas herramientas occidentales.
Un escenario aparte es el despliegue corporativo sin depender de la nube. Para empresas a las que no se les permite enviar datos fuera de su perímetro, Qwen ofrece algo que no está disponible en ChatGPT ni en Claude: los modelos se pueden descargar y ejecutar en servidores propios. Es la misma lógica que siguen las administraciones públicas al construir sistemas de IA soberanos – el control de los datos importa más que la comodidad del acceso en la nube.
Por último, Qwen3-Omni y Qwen3-TTS permiten crear un asistente de voz en español: reconocimiento de voz, procesamiento de la consulta y síntesis de voz – todo dentro de un mismo ecosistema, sin necesidad de conectar varios servicios distintos.
Giro estratégico: de open-source a modelos cerrados
En la primera mitad de 2026 se produjo un cambio que altera la propuesta de valor principal de Qwen. Alibaba pasó sus modelos insignia – Qwen3.7-Max y Qwen3.7-Plus – a formato cerrado (solo API, sin pesos abiertos). Esto pone a Alibaba en competencia directa con OpenAI y Anthropic por los contratos de API corporativos.
El enfoque no abandona el open-source por completo: Qwen3.6-35B-A3B y Qwen 4 Coder se lanzaron con licencia Apache 2.0. Pero la tendencia es clara – los modelos más capaces ahora son cerrados. Alibaba ha confirmado que seguirá publicando modelos abiertos, pero no hay compromisos claros sobre plazos para abrir la serie 3.7.
En medio de este giro, el equipo perdió a figuras clave. En marzo de 2026 dejó el proyecto el líder técnico Lin Junyang, quien escribió en redes sociales: “me stepping down. bye my beloved qwen”. Ese mismo día renunció Yu Bowen, responsable del post-entrenamiento. Antes ya había salido Hui Binyuan, investigador principal de código. Un colega del equipo comentó: “Sé que irte no ha sido tu elección”. Las acciones de Alibaba cayeron un 5,3% ese día.
Para un manager que está evaluando Qwen, esto crea una situación de doble filo:
- Los modelos open-source siguen siendo sólidos – Qwen3.6-Plus y Qwen 4 Coder se pueden descargar y ejecutar localmente. Para las tareas donde el control de datos es crítico, nada ha cambiado.
- Los mejores modelos nuevos solo están vía API – si necesitas un agente multimodal (3.7 Plus) o la máxima calidad de razonamiento (3.7 Max), tendrás que pagar por acceso en la nube, como con ChatGPT o Claude.
- Inestabilidad en el equipo – la salida de los arquitectos del proyecto genera incertidumbre a largo plazo, aunque de momento no ha afectado al ritmo de lanzamientos.
Limitaciones y riesgos
- Cierre de los buques insignia: los modelos más potentes de la serie 3.7 no están disponibles para descargar. Si habías construido tu estrategia sobre un ecosistema totalmente abierto, tendrás que replantearla o usar modelos de la generación anterior.
- Pérdida de talento: la salida del líder técnico y del responsable de post-entrenamiento en marzo de 2026 es una señal seria. Alibaba reorganizó el equipo creando un centro de desarrollo transversal para modelos base, pero las consecuencias a largo plazo aún no están claras.
- Censura y filtros: como todos los modelos chinos, Qwen tiene restricciones integradas sobre ciertos temas políticos e históricos. Rara vez supone un problema para tareas empresariales.
- Riesgos geopolíticos: el modelo pertenece a Alibaba (China). Para algunas organizaciones esto puede ser una limitación al usar la API en la nube. La solución es el despliegue local de las versiones open-source.
- Calidad en español: pese al soporte anunciado para más de 200 idiomas, la calidad de las respuestas en español puede ser algo inferior a la del inglés. Se recomienda probar con tus propias tareas concretas.
- Integraciones: hay muchas menos conexiones listas para usar con servicios occidentales – Slack, Notion, Google Workspace – que en ChatGPT o Claude. Qwen está mejor integrado con herramientas empresariales chinas.
Tarifas y disponibilidad
| Opción | Coste | Para quién |
|---|---|---|
| chat.qwen.ai | Gratis | Probar Qwen sin registrar una API |
| Qwen3-0.6B / 4B (descarga) | Gratis | Ejecutar en portátil, control total de los datos |
| Qwen 4 Coder 32B-A3B (descarga) | Gratis (Apache 2.0) | Programar en portátil, 82% en SWE-Verified |
| Qwen3-235B (descarga) | Gratis | Buque insignia local, requiere clúster de servidores |
| Qwen3.7-Plus (API, GA) | $0,40 / $1,60 por millón entrada/salida | Agente multimodal, GUI grounding, contexto de 1M |
| Qwen3.7-Max (API) | $2,50 / $7,50 por millón entrada/salida | Buque insignia de texto, escenarios agénticos, contexto de 1M |
| Qwen3.6-Plus (preview) | Gratis durante el preview | Contexto de 1M tokens, código abierto |
| Qwen3.5-Plus (API) | $0,40 / $2,40 por millón entrada/salida | Tareas regulares, equilibrio precio-calidad |
| Qwen3.5-397B-A17B (API) | $0,39 / $2,34 por millón entrada/salida | Buque insignia con licencia abierta |
Para comparar: un análisis equivalente de un informe de 100 páginas con GPT-4o costaría alrededor de $0,35, con Claude Sonnet, unos $0,55. Qwen3.7-Plus ofrece análisis multimodal 3 veces más barato que Claude Sonnet.
Qwen sigue ofreciendo tres puntos de entrada: chat gratuito, API en la nube barata y despliegue local. Pero con la serie 3.7 el equilibrio se ha desplazado: los modelos más potentes ahora están solo en la nube, y para el despliegue local quedan versiones excelentes – aunque ya no las mejores.
¿Vale la pena probarlo?
Hace medio año, el argumento principal a favor de Qwen era sencillo: “lo mismo que ChatGPT, pero gratis y de código abierto”. Hacia julio de 2026, el panorama es más complejo.
El código abierto no ha desaparecido – Qwen 4 Coder con 82% en SWE-Verified y Qwen3.6-Plus con Apache 2.0 siguen siendo los modelos open-source más fuertes de su categoría. Para empresas que necesitan control local sobre los datos, las alternativas siguen siendo escasas. Pero los modelos más nuevos y capaces – Qwen 3.7 Max y 3.7 Plus – ahora son cerrados y solo están disponibles vía API. Alibaba sigue el mismo camino que OpenAI y Anthropic: los modelos de investigación se publican en abierto, los buques insignia comerciales no.
En la mayoría de las tareas, hoy todos los modelos top dan resultados comparables, y la diferencia no es evidente en el trabajo diario. Qwen 3.7 Plus, a $0,40/$1,60, hace lo mismo por lo que Claude Sonnet 5 cobra $2/$10 – análisis multimodal, escenarios agénticos, trabajo con pantalla. Para tareas masivas, es un ahorro considerable.
La salida de desarrolladores clave y la reorganización del equipo son un riesgo que conviene vigilar. Por ahora el ritmo de lanzamientos no se ha frenado, pero eso no es garantía de nada. Si construyes procesos críticos sobre Qwen, es razonable tener una alternativa de respaldo – DeepSeek u otros modelos en la nube con una estructura corporativa más estable.
Pasa de las reseñas a la práctica
Programa completo: módulo Foundation con práctica en Qwen, ChatGPT, Claude, DeepSeek + especializaciones en gestión de proyectos, analítica y automatización. Aprende a elegir herramientas con criterio.
Fuentes
- Qwen Chat – interfaz web gratuita – chat oficial de Alibaba, funciona sin registro
- Sitio oficial de Qwen – documentación y descripción de todos los modelos
- Modelos Qwen en Hugging Face – 433 modelos abiertos para descargar, más de 300 millones de descargas
- Repositorio de Qwen en GitHub – código fuente y documentación, más de 40 repositorios
- API a través de Alibaba Cloud Model Studio – acceso en la nube a Qwen-Plus y Qwen-Max

Stanislav Belyaev
Engineering Leader en Microsoft18 anos liderando equipos de ingenieria. Fundador de mysummit.school. 700+ graduados en Yandex Practicum y Stratoplan.







