NRamosDev · Blog

QWEN 3.8 FLASH-NEXT: PREVIEW DE QWEN4 QUE ALIBABA SUELTA ANTES QUE QWEN4 — 125B MoE con 6B activos

#youtube#nramosdev#ia#análisis

TL;DR

QWEN 3.8 FLASH-NEXT: PREVIEW DE QWEN4 QUE ALIBABA SUELTA ANTES QUE QWEN4 — 125B MoE con 6B activos

Qwen ya no espera a Qwen4: Alibaba libera HOY la arquitectura que la va a sustentar en abierto, de la mano de Qwen3.8-Flash-Next. 125B parámetros con solo 6B activos por token, un preview multimodal que trae dos novedades de cabecera: la atención lineal GDN y la nueva Qwen Sparse Attention. ¿Se podrá correr en local? Te cuento lo confirmado, lo filtrado y lo que falta por saber.

Capítulos del vídeo

  • 0:00 — Introducción — Qwen libera el preview de la arquitectura Qwen4
  • 0:31 — Lo confirmado — ficha de lanzamiento del modelo
  • 1:04 — Arquitectura — los cambios GDN y Qwen Sparse Attention
  • 1:40 — Los specs filtrados — 125B totales, 6B activos y 51B de embeddings N-gram
  • 2:16 — Debate local — 6B activo no significa que corra como un 6B
  • 2:51 — Incógnitas — benchmarks, licencia y precio sin publicar
  • 3:12 — Cadencia de Alibaba — Max, 27B y Flash-Next en el mismo mes
  • 3:43 — Cierre — qué esperamos de la liberación de hoy

El contexto

DATOS CLAVE

Análisis

  • Modelo multimodal MoE open-weight sobre la arquitectura Qwen4 de próxima generación

  • Release anunciado para hoy 26 de agosto a las 15:00 UTC en ModelScope, variantes estándar y FP8

  • Dos cambios de cabecera confirmados: Gated Delta Network (GDN) y Qwen Sparse Attention (QSA)

Puntos clave

Fuentes

Conclusión

  • Specs filtrados (no oficiales): 125B parámetros totales, 6B activos por token, 51B de embeddings N-gram

Artículo generado automáticamente desde el vídeo publicado en nramosdev. Cada número citado proviene de la investigación verificada del pipeline.

([nr])

¿Te ha gustado? Suscríbete al canal para más análisis de IA en español.

Ver en YouTube

Artículos relacionados