Alibaba lanza Qwen3.8-Max con 2.4T parámetros

Alibaba lanza Qwen3.8-Max con 2.4T parámetros

⏱ Tiempo de lectura: 4 min

Alibaba presentó Qwen3.8-Max, su modelo de lenguaje más avanzado hasta la fecha, con 2.4 billones de parámetros. El nuevo modelo de lenguaje multiplica por siete la capacidad del Qwen3.5 lanzado en febrero, activando 95 mil millones de parámetros al procesar consultas. Soporta contextos de hasta 1 millón de tokens, suficiente para analizar más de 200 páginas de texto o 100 horas de video en una sola solicitud.

Arquitectura y rendimiento de Qwen3.8-Max

Aunque Alibaba no detalla la arquitectura completa, existe la posibilidad de que use Gated DeltaNet, el mecanismo de atención que implementaron en modelos anteriores. Esta tecnología escala linealmente en lugar de hacerlo de forma cuadrática, reduciendo significativamente los requisitos de memoria y procesamiento conforme crece el tamaño de la consulta. En pruebas internas, el modelo completó un proyecto de código de 16 días sin intervención humana y realizó optimización de chip design con más de 500 pasos. En el benchmark Frontend Code Arena obtuvo 1.668 puntos, quedando apenas 37 puntos por debajo de Claude Opus 5 de Anthropic.

Disponibilidad, capacidades y lanzamiento

Qwen3.8-Max está disponible desde hoy en la plataforma en la nube de Alibaba. La empresa planea publicarlo como código abierto la próxima semana junto con una versión más eficiente llamada Qwen3.8-27B. El modelo genera respuestas de hasta 131.000 tokens y superó en pruebas a más de una docena de modelos fronterizos, incluyendo Muse Spark 1.1 de Meta. La información proviene de SiliconANGLE.

Aspecto Detalle
Parámetros totales 2.4 billones
Parámetros activos 95 mil millones
Contexto máximo 1 millón de tokens (200+ páginas o 100 horas de video)
Generación máxima 131.000 tokens por respuesta
Benchmark Frontend Code Arena 1.668 puntos (37 puntos debajo de Claude Opus 5)
Prueba de código Completó proyecto de 16 días sin intervención humana
Disponibilidad inicial Plataforma en la nube de Alibaba (hoy)
Open source Próxima semana, junto con Qwen3.8-27B
Mecanismo de atención Posiblemente Gated DeltaNet (no confirmado)

Preguntas frecuentes sobre Qwen3.8-Max

¿Cuáles son las principales mejoras respecto a Qwen3.5?

Qwen3.8-Max tiene aproximadamente siete veces más parámetros que Qwen3.5. Soporta contextos significativamente más amplios (1 millón de tokens frente a lo no especificado en Qwen3.5) y demuestra mejor rendimiento en tareas complejas como optimización de chip design y desarrollo de código extendido.

¿Cuándo estará disponible para el público?

El modelo ya está disponible en la plataforma en la nube de Alibaba desde hoy. Alibaba planea lanzarlo como código abierto la próxima semana, lo que permitirá que desarrolladores lo descarguen y usen de forma gratuita en sus servidores.

¿Cuál es la diferencia entre Qwen3.8-Max y Qwen3.8-27B?

Qwen3.8-Max es la versión más capaz con 2.4 billones de parámetros. Qwen3.8-27B será una versión optimizada para hardware menos potente, facilitando su uso en entornos con recursos limitados. No se especifica el costo de acceso en la plataforma en la nube.

Qué falta por confirmar

Aunque Qwen3.8-Max demuestra capacidades impresionantes, Alibaba aún no ha compartido detalles de su arquitectura completa ni ha confirmado si usa Gated DeltaNet. Tampoco ha especificado costos de inferencia en su plataforma en la nube ni modelos de precios para acceso empresarial. El comportamiento real en tareas no incluidas en los benchmarks internos permanece por evaluar en la comunidad de desarrolladores una vez disponible como código abierto.

En Inteligencia Artificial, el lanzamiento de Qwen3.8-Max refuerza la competencia en modelos de contexto largo frente a Claude y GPT. ¿Veremos que desarrolladores hispanohablantes adopten esta alternativa abierta para proyectos locales?

Fuente: siliconangle.com

Deja una respuesta

Subir