Blog
Análisis por escrito de cada vídeo del canal.
QWEN 3.8 FLASH-NEXT: PREVIEW DE QWEN4 QUE ALIBABA SUELTA ANTES QUE QWEN4 — 125B MoE con 6B activos
Qwen ya no espera a Qwen4: Alibaba libera HOY la arquitectura que la va a sustentar en abierto, de la mano de Qwen3.8-Flash-Next. 125B parámetros con solo 6B ac
QWEN 3.8 FLASH-NEXT YA ESTÁ AQUÍ: 125B MoE con 6B activos que arrasa en código y agéntica — análi...
El modelo de la arquitectura Qwen4 ya está publicado en abierto y los datos son oficiales: 125B parámetros con solo 6B activos por token, más 51B de embeddings
70B en 4GB de VRAM: la compresión neural de 2026, ¿es real?
En 2026 el "breakthrough de compresión neural" para meter un 70B en pocos GB de VRAM NO es una única técnica, sino TRES frentes que se atacan en paralelo: 1.
Autonomous Kernel Patching: agentes LLM que reparan el kernel Linux en tiempo real
"Parcheo autónomo del kernel": agentes LLM que (1) analizan un CVE/patch, (2) reproducen la vulnerabilidad con un PoC en una VM, (3) generan el patch y (4) lo
El Intel Gaudi 4 NO EXISTE: desmontando el mito del "rey de open weights" vs la H200
¿Te han dicho que el "Intel Gaudi 4" va a destronar a la H200 de Nvidia como rey de la inferencia de open weights? Es falso: el Gaudi 4 no existe. El último ace
Qwen 3.6 27B: RTX 3090 vs AMD vs Mac vs Strix Halo — ¿qué tarjeta comprar?
¿Por qué una RTX 3090 de 2020 gana a hardware nuevo de 2026? Ancho de banda manda. Benchmarks reales.
Stable Diffusion Ultra 100B: la verdad tras el mito del modelo local
¿Te han dicho que existe un Stable Diffusion Ultra de 100 mil millones de parámetros que corre en tu gráfica? Es falso. En este vídeo desmontamos el hype: Stabl
TU NAVEGADOR ES UN SERVIDOR DE IA: enjambres de agentes con WebGPU, sin APIs de nube
¿Y si tus agentes de IA corrieran en el navegador de tu usuario, sin pagar un solo céntimo por una API de la nube? En este vídeo desmontamos el mito del "WebGPU
Grok 3 Mini Local: Desmontando el Mito
La idea original de YouTube decía: "Grok-3 Mini Local: Running the world's most uncensored 8B model on consumer hardware". **Esto es FALSO en su premisa centr
MISTRAL LARGE 3 EN LOCAL: el MITO del 2-bit en GPU de consumo 💀
¿Te han dicho que puedes correr "Mistral Large 3 de 123B" en una GPU de 48GB con cuantización 2-bit? Es falso — y en este vídeo lo demostramos con datos. Mistra
BitNet 1.58b: ¿Un modelo de 70B en tu móvil? Verificamos la promesa
**NO existe hoy un modelo BitNet de 70B parámetros.** El modelo oficial más grande de Microsoft sigue siendo BitNet-b1.58-2B-4T (2.4B params, abril 2025). La
DeepSeek Harness: el arnés open-source que quiere destronar a Claude Code
DeepSeek ha abierto el código de su arnés de agentes — "todo es un plugin" sobre el kernel Cordis. En este vídeo desgranamos DeepSeek Harness: la arquitectura d
Meta Muse Glimmer 30B: el agente IA de Meta que corre 100% local
¿Agentes de IA locales, siempre activos y sin pagar por token? Analizamos Muse Glimmer 30B de Meta: arquitectura, benchmarks y si de verdad corre en tu máquin
NVIDIA NEMOTRON 3.5 LIGHTNING: el open 30B de NVIDIA para agentes
¿Un modelo open de NVIDIA con 30B MoE que corre en una sola GPU y es 4x más rápido para agentes? Analizamos el Nemotron 3.5 Lightning.
Qwen3.8-27B YA está aquí: 27B denso, Apache 2.0 y multimodal que supera a Opus4.6 Max en código.
Qwen3.8-27B ha llegado por fin a Hugging Face. El modelo que la comunidad local llevaba semanas esperando ya está disponible: 27,8 mil millones de parámetros, a
Qwen 3.8 Max: el gigante de 2,4 billones que promete abrir sus pesos
Análisis técnico del Qwen 3.8 Max de Alibaba: arquitectura Mixtura de Expertos, 983K de contexto, benchmarks frente a GPT-5 y Claude, y la promesa de open weights.