El equipo de desarrollo de inteligencia artificial de Alibaba reveló el miércoles el modelo de inteligencia artificial multimodal y de código abierto denominado Qwen3.6-35B-A3B. Este lanzamiento confirma la continua consolidación de la empresa en el mercado de tecnologías avanzadas y su compromiso de ofrecer soluciones innovadoras para desarrolladores y empresas que dependen de la inteligencia artificial en sus operaciones diarias.
Una arquitectura técnica innovadora para el ahorro de recursos
El nuevo modelo se basa en una arquitectura técnica conocida como «mezcla de expertos dispersos», una tecnología revolucionaria que permite ofrecer un rendimiento de programación sólido e independiente con solo una fracción del costo computacional requerido por los modelos densos de mayor tamaño. Este modelo avanzado consta de un total de 35 mil millones de parámetros, pero su característica más destacada radica en que activa únicamente 3 mil millones de parámetros durante cada proceso de inferencia o procesamiento de datos.
Este diseño inteligente del modelo lo hace mucho más eficiente en su funcionamiento en comparación con los modelos densos que ofrecen un rendimiento similar, ya que reduce significativamente el consumo de recursos computacionales y energía. A pesar de esta huella económica y ambientalmente ligera, las pruebas han demostrado la capacidad del modelo para gestionar los escenarios de programación más complejos exigidos por los desarrolladores, convirtiéndose en un punto de inflexión en el mundo de la programación automatizada.
Superioridad en pruebas estándar
El nuevo modelo logró resultados impresionantes en las pruebas estándar, superando tanto a su predecesor Qwen3.5-35B-A3B como al modelo competidor Gemma4-31B de Google en tareas de programación complejas. Esta superioridad se evidencia en los siguientes resultados:
- En la prueba Terminal-Bench 2.0, una medida ampliamente utilizada para evaluar las capacidades de programación autónoma de la inteligencia artificial, el modelo registró 51.5 puntos, superando al modelo de Google, que obtuvo 42.9 puntos.
- En la prueba avanzada SWE-bench Pro, el modelo alcanzó los 49.5 puntos en comparación con los aproximadamente 35.7 puntos del modelo de Google.
- En la prueba SWE-bench Verified, el modelo registró 73.4 puntos frente a los 52.0 puntos de su competidor directo.
Además, el modelo obtuvo las puntuaciones más altas en otras evaluaciones importantes como QwenClawBench, NL2Repo y Claw-Eval, lo que demuestra su supremacía integral en su categoría y su capacidad superior para escribir y analizar código de programación con una eficiencia inigualable.
Funciones avanzadas de razonamiento y mejoras
Estos resultados representan un gran salto cualitativo en comparación con la versión anterior lanzada el pasado mes de febrero, que registró 67.0 puntos en las evaluaciones verificadas. El equipo de desarrollo de Alibaba destacó las mejoras sustanciales introducidas en los flujos de trabajo de las interfaces front-end y en la capacidad de razonamiento e inferencia a nivel de repositorios de código completos.
Entre las adiciones más notables del nuevo modelo se encuentra la función de «retención de razonamiento», que mantiene el contexto de inferencia a lo largo de múltiples rondas de conversación. Esta innovadora característica reduce drásticamente la carga computacional y el tiempo empleado durante los procesos de desarrollo de software iterativo, brindando a los desarrolladores una experiencia más fluida y eficiente que permite a la inteligencia artificial recordar pasos anteriores y construir sobre ellos sin necesidad de volver a procesar todo el contexto desde cero.
Opciones flexibles para empresas y desarrolladores
Desde el punto de vista operativo y con un enfoque orientado al respaldo empresarial, el modelo se ha lanzado bajo la licencia abierta Apache 2.0, lo que lo hace accesible para uso comercial y de investigación con una alta flexibilidad. Los desarrolladores pueden acceder al modelo fácilmente a través de plataformas populares como Hugging Face, mediante la plataforma Qwen Studio o a través de la interfaz de programación de aplicaciones (API) oficial.
Para garantizar una transición fluida a los usuarios actuales, el nuevo modelo comparte la misma arquitectura técnica básica que su predecesor, lo que significa que se espera que las herramientas existentes utilizadas en entornos de desarrollo abiertos, como la herramienta vLLM, funcionen directamente con él sin necesidad de realizar modificaciones de código adicionales que puedan entorpecer el flujo de trabajo.
Este potente lanzamiento sitúa al modelo Qwen3.6-35B-A3B como una opción rentable para los desarrolladores empresariales que buscan construir agentes de programación basados en inteligencia artificial y desarrollar flujos de trabajo de múltiples pasos. La verdadera ventaja competitiva radica en la capacidad del modelo para ejecutarse sin problemas en unidades de procesamiento gráfico (GPU) orientadas a consumidores comunes al utilizar técnicas de cuantización, manteniendo al mismo tiempo su capacidad para competir con modelos más grandes y complejos. Por último, cabe destacar que este modelo es el primero de pesos abiertos de la familia de nuevas versiones, y se espera que próximamente se lancen otros tamaños adicionales para satisfacer las diversas necesidades de un mercado tecnológico en constante crecimiento.
Preguntas frecuentes
¿Qué distingue al modelo Qwen3.6-35B-A3B de otros modelos?
El modelo destaca por el uso de la tecnología de «mezcla de expertos dispersos», ya que cuenta con un total de 35 mil millones de parámetros, pero consume únicamente 3 mil millones de parámetros en cada proceso de procesamiento, lo que ofrece un rendimiento de programación superior a un costo computacional muy bajo en comparación con otros modelos.
¿Cómo supera el nuevo modelo al de la empresa Google?
El modelo logró una superioridad notable en las pruebas de programación estándar reconocidas mundialmente, registrando 51.5 puntos en la prueba Terminal-Bench 2.0 en comparación con los 42.9 puntos del modelo Gemma4-31B, y también destacó en otras pruebas complejas de escritura de código como SWE-bench Pro.
¿Qué es la función de «retención de razonamiento» añadida al modelo moderno?
Es una nueva característica técnica que permite al modelo conservar el contexto de inferencia y la lógica utilizados durante rondas de conversación anteriores, lo que reduce la carga computacional y acelera el proceso de desarrollo de software iterativo sin necesidad de volver a procesar los datos desde el principio.
¿Se puede ejecutar el modelo en ordenadores comunes?
Sí, gracias a su alta eficiencia y su peso ligero durante la ejecución, el modelo puede funcionar en unidades de procesamiento gráfico (GPU) destinadas a consumidores al utilizar técnicas de cuantización, lo que lo hace ideal para empresas emergentes y desarrolladores independientes.