Última actualización: 2026-09-08
Qwen es la familia de modelos de lenguaje de pesos abiertos de Alibaba Cloud, con arquitecturas densas y de mezcla de expertos (MoE). Sus tamaños van de 0,5 mil millones a más de 2 millones de millones de parámetros. El modelo estrella actual activa unos 95 mil millones de parámetros por paso, de un total de 2,4 millones de millones. Iguala a los modelos de frontera en benchmarks de programación y matemáticas con una fracción del cómputo. La mayoría de los pesos más pequeños se pueden autoalojar gratis, también para uso comercial.
Acerca de Qwen
Qwen (abreviatura de Tongyi Qianwen) es la familia de modelos de lenguaje y el asistente de chat con IA de Alibaba Cloud. Salió en versión beta en abril de 2023 y se abrió al público ese septiembre. Llegó a 203 millones de usuarios activos al mes en febrero de 2026, un salto del 554 % en un solo mes. Además, se convirtió en la familia de modelos de pesos abiertos más descargada de Hugging Face, con más de 700 millones de descargas en enero de 2026. Superó a Llama, de Meta, en descargas acumuladas.
La familia abarca de 0,5 mil millones a más de 1 millón de millones de parámetros, con arquitecturas densas y de mezcla de expertos. El modelo estrella Qwen3-235B activa solo 22 mil millones de parámetros por paso para mantener bajos los costes de inferencia. Qwen Chat, la aplicación gratuita en chat.qwen.ai, tiene clientes nativos para iOS, Android, Windows y macOS. Los desarrolladores acceden a los mismos modelos mediante Model Studio (DashScope) de Alibaba Cloud, una API compatible con OpenAI. La mayoría de los pesos se publican con licencia abierta para autoalojarlos sin regalías. La última versión, Qwen 3.6-Plus, salió el 2 de abril de 2026. Con ese ritmo de lanzamientos, Qwen sigue compitiendo con los laboratorios occidentales de frontera pese a las restricciones de EE. UU. a la exportación de chips.
Capturas de pantalla

Precios
Nivel gratuito: 1M de tokens por modelo durante 90 días tras activar Model Studio. 47/M de salida. 80 por encima).
00/M de salida. La aplicación Qwen Chat para el público sigue siendo gratuita.
| Plan | Precio mensual | Qué incluye |
|---|---|---|
| Qwen Chat (Free) | Gratis | |
| Qwen3.8-Flash API | Gratis | por token |
| Qwen3.7-Plus API | Gratis | por token, escalonado a partir de 256K |
| Qwen3.8-Max API | Gratis | por token |
Funciones por plan
| Función | Qwen3.8-Max API | Qwen Chat (Free) | Qwen3.7-Plus API | Qwen3.8-Flash API |
|---|---|---|---|---|
| Ventana de contexto | 1M (262K nativos) | 128K | 1M (con tarifa escalonada a partir de 256K) | 1M |
| Coste del token de entrada | $2.00/M | Gratis | $0.40/M (≤256K) | $0.15/M |
| Coste del token de salida | $6.00/M | Gratis | $1.60/M (≤256K) | $0.47/M |
Funciones principales
- Modo de pensamiento híbrido: Se puede alternar entre un modo rápido sin pensamiento para respuestas ágiles y un modo de razonamiento lento y deliberado para tareas complejas. Así controlas con un solo interruptor el equilibrio entre velocidad y profundidad.
- Ventana de contexto de 1M de tokens: La API del nivel Plus admite una ventana de contexto de 1 millón de tokens y hasta 65 536 tokens de salida. Permite analizar un código completo o procesar documentos del tamaño de un libro en una sola llamada.
- Entrada multimodal: texto, imagen, audio y vídeo: Qwen Chat maneja texto, comprensión de imágenes con Qwen2.5-VL, entrada de audio con Qwen2.5-Audio (voz, música y sonidos naturales) y comprensión de vídeo, todo en la misma interfaz de chat.
- Compatible con más de 119 idiomas: Los modelos Qwen3 admiten 119 idiomas y dialectos, y Qwen3.5 amplía la cobertura a 201 idiomas. Es una de las familias de LLM más multilingües que existen.
- Programación en 92 lenguajes: Qwen2.5-Coder, entrenado con 5,5 millones de millones de tokens, admite 92 lenguajes de programación y alcanzó un 69,6 % en SWE-bench Verified, entre los mejores modelos de pesos abiertos para programar.
- Arquitectura MoE de Qwen 3.6 con el doble de rendimiento: Qwen 3.6 usa la activación dispersa de mezcla de expertos, ya madura, con fusión de kernels AITemplate. Según la ficha, ofrece aproximadamente el doble de rendimiento de inferencia que Qwen 2.5 en hardware comparable.
- Qwen Max: 2,4 millones de millones de parámetros, ya disponible: Alibaba llevó su modelo estrella Max a disponibilidad general en agosto de 2026. Es un modelo multimodal MoE de 2,4 millones de millones de parámetros que activa 95 mil millones por token. Ahora se cobra a las tarifas estándar por token de la API de Alibaba Cloud Model Studio.
- Qwen 3.6: 6 tamaños y licencia libre de regalías: Qwen 3.6 salió en mayo de 2026 en seis tamaños de modelo con licencia abierta. Permite el despliegue comercial gratuito, y las empresas ajustan el cómputo a la complejidad de cada tarea.
Ventajas
- Es la familia de modelos de pesos abiertos más descargada del mundo, con 700M de descargas en Hugging Face en enero de 2026. Eso le da una comunidad grande, muchos ajustes finos disponibles y soporte activo de terceros.
- La API es bastante más barata que las alternativas de frontera: unas 40 veces menos que GPT-4o en tokens de entrada. Eso la hace viable para cargas de producción de gran volumen.
- La licencia abierta evita la dependencia de un proveedor en los despliegues autoalojados. La licencia propia de Llama, en cambio, limita el uso comercial gratuito a un umbral fijo de usuarios activos al mes.
- El modo de pensamiento híbrido deja que cada desarrollador elija la profundidad de razonamiento por consulta. Es una palanca concreta de ahorro que GPT-4o y los modelos base de Claude no tienen.
- El modelo del nivel Plus empata con GPT-5 mini en SWE-bench Verified con 72,4, lo que muestra rendimiento de programación de frontera sin precios de frontera.
Desventajas
- Los modelos Qwen se niegan a responder sobre temas que chocan con las posturas políticas del Gobierno chino, como el estatus del Gobierno de Taiwán o ciertos hechos históricos. Eso limita su uso en periodismo o investigación política.
- La calidad de la generación de imágenes queda por detrás de modelos específicos como Stable Diffusion o DALL-E 3, según pruebas de analistas independientes en 2025.
- Depurar y modificar código existente es más flojo que escribir código nuevo desde cero. Los analistas señalan refactorizaciones torpes que una herramienta como Claude Sonnet resuelve mejor.
- Las mejores funciones de API y las cuotas gratuitas están sobre todo en la región de Singapur. El despliegue Global no tiene cuota gratuita y los endpoints de China continental se limitan a cuentas registradas en China.
Información del producto
- Nube
- Sí
- Autoalojado
- Sí
- En tus instalaciones (on-premise)
- Sí
- Idiomas
- Inglés, Chino simplificado, Chino tradicional, Japonés, Coreano, Y más de 114 adicionales
- Entrenamiento
- Documentación oficial de la API, Tutoriales en vídeo de YouTube, Discord de la comunidad, Ejemplos en GitHub, Guías de Hugging Face Hub
Tratamiento de datos
- Cumplimiento normativo
- Alibaba Cloud ISO 27001 · SOC 2
Preguntas frecuentes
¿Cuánto cuesta Qwen en realidad?
Qwen Chat, el chatbot para el público general, es gratis. La API de Alibaba Cloud Model Studio se factura por token (región de Singapur). Qwen3.8-Flash cuesta $0.15 de entrada y $0.47 de salida por millón. Qwen3.7-Plus cuesta $0.40 de entrada y $1.60 de salida por millón, hasta 256K de contexto. Qwen3.8-Max cuesta $2.00 de entrada y $6.00 de salida por millón. Ahora mismo no hay inferencia por lotes para ninguno de estos modelos en esa región.
¿Qué incluye el nivel gratuito de Qwen?
Qwen Chat, en chat.qwen.ai, se puede usar completo y sin suscripción: chat de texto, comprensión de imágenes y vídeo, generación de imágenes, búsqueda en la web y ejecución de código. Además, las cuentas nuevas de Alibaba Cloud Model Studio reciben 1 millón de tokens de API gratis por modelo durante 90 días desde la activación. Pasada esa cuota, las llamadas a la API se facturan por token al precio estándar.
¿Qué alternativas hay a Qwen?
Claude conviene a los equipos que quieren el mejor razonamiento en inglés y soporte empresarial. GPT-4o tiene el ecosistema de herramientas más amplio para equipos que ya trabajan con él. DeepSeek iguala o supera a Qwen en benchmarks de programación, y encaja cuando no necesitas la amplitud de idiomas y modalidades de Qwen.
¿Qwen o DeepSeek: cuál elegir?
DeepSeek V4 lidera en benchmarks puros, con cerca de un 83,7 % en SWE-bench y un 99,4 % en AIME, y cobra menos que Qwen-Max por token de salida. La ventaja de Qwen es la amplitud: decenas de idiomas, entrada multimodal de texto, imagen, audio y vídeo, y una API de Model Studio compatible con OpenAI que DeepSeek no iguala. Si buscas la mejor puntuación en programación, elige DeepSeek. Si creas productos multilingües o multimodales, elige Qwen.
¿Cómo se empieza a usar Qwen?
Para un uso casual, abre chat.qwen.ai o instala la aplicación para iOS, Android, Windows o macOS y empieza a chatear sin coste. Para desarrollar, crea una cuenta de Alibaba Cloud, activa Model Studio y obtén una clave de API en la consola de DashScope. Como el endpoint es compatible con OpenAI, la mayoría de los SDK actuales funcionan con solo cambiar la URL base. Prueba primero con Qwen-Flash antes de pasar a Qwen-Plus o Qwen-Max en producción.
Mejores alternativas
- Claude: Claude razona mejor en inglés y ofrece soporte empresarial; Qwen cubre más idiomas con una fracción del coste de la API.
- GPT-4o: GPT-4o tiene el ecosistema más amplio; Qwen permite el autoalojamiento con licencia abierta y cobra mucho menos por token.
- DeepSeek: DeepSeek lidera en SWE-bench, mientras que Qwen admite imagen, audio y vídeo, y más idiomas, en una sola herramienta.