El panorama open-weight de agosto 2026
"Open-weight" es una etiqueta sobre la licencia, no sobre el hardware que necesitás. Los tres modelos más comentados de este semestre lo dejan clarísimo.
Qwen3.6 — el que de verdad podés correr vos
Alibaba mantuvo la cadencia de release más activa del semestre: Qwen3.5 en febrero, Qwen3.6 en abril. La variante densa de 27B es el punto dulce real — corre en una o dos GPUs de consumo en cuantización Q4, con 262K de contexto nativo y capacidad multimodal. Es, hoy, la opción más práctica para alguien que quiere self-hosting de verdad sin comprar un rack.
Kimi K3 — abierto, pero de escala de datacenter
Moonshot AI liberó Kimi K3 en julio: 2.8 billones de parámetros en arquitectura MoE, con 104B activos por token y una ventana de contexto de aproximadamente 1M de tokens. Es, según sus propias métricas, el modelo open-source más grande liberado hasta la fecha. Pero "liberado" no significa "corrible en tu escritorio" — activar 104B de parámetros por token sigue siendo una carga que pide infraestructura de datacenter, no una GPU de consumo.
DeepSeek V4 — la historia de eficiencia más fuerte del lote
DeepSeek reseteó su arquitectura hacia atención híbrida en abril: la variante V4-Pro llega a 1.6 billones de parámetros totales con 49B activos, la variante V4-Flash se queda en 284B totales / 13B activos. Incluso la variante "chica" (Flash) pide del orden de 170GB de VRAM en cuantización Q4 — fuera del alcance de una GPU individual, pero factible en un servidor multi-GPU dedicado.
El resumen honesto
Si tenés una o dos GPUs y querés correr algo hoy: Qwen3.6 27B. Si querés la capacidad máxima open-weight y no te importa pagarle a un proveedor que lo hostee: Kimi K3 o DeepSeek V4 vía API. La palabra "abierto" te dice qué podés hacer con la licencia — no qué podés correr en tu máquina.