Modelos
Modelos comerciales y open-weight — mismo template para ambos, así se mantienen comparables y fáciles de actualizar cuando cambian de versión. Cada fila muestra cuándo se verificó por última vez; los modelos cambian rápido, no confíes en una fila vieja.
| Modelo | Tipo | Lanzamiento | Contexto | Auto-hosteable | Fortaleza | Veredicto | Fuente |
|---|---|---|---|---|---|---|---|
| Claude (Anthropic) Anthropic |
comercial | 2026 · generación 5 | 200k | no | Cuatro niveles (Haiku 4.5 / Sonnet 5 / Opus 5 / Fable 5) — de barato-y-rápido a código agéntico complejo. Buen equilibrio costo/calidad en el nivel Sonnet. | El default razonable si no te importa depender de la nube y querés el mejor equilibrio calidad/costo por nivel. | fuente ↗ verificado 2026-08-21 |
| ChatGPT / GPT-5.6 + Codex (OpenAI) OpenAI |
comercial | 2026 · familia GPT-5.6 | 128k | no | Codex ya no es un producto aparte — es un stack unificado GPT-5+Codex. El modelo de código actual es GPT-5.3-Codex, con una variante Max para trabajo agéntico largo y una Mini más barata. | Fuerte específicamente en tareas de código de formato largo/agéntico vía Codex; ChatGPT normal para todo lo demás. | fuente ↗ verificado 2026-08-21 |
| Gemini (Google) Google DeepMind |
comercial | 2026 · familia 3.x | 1000k | no | 3.1 Pro y 3 Deep Think para razonamiento frontier; 3.5/3.6 Flash para agentes y código a menor costo; contexto de hasta 1M tokens en las variantes tope. | La opción de ventana de contexto más grande si necesitás meter documentos enormes de una sola vez. | fuente ↗ verificado 2026-08-21 |
| Qwen3.6 (Alibaba) Alibaba (Qwen Team) |
open-weight | abril 2026 | 262k | sí | Familia con la cadencia de release más activa de H1 2026. La variante 27B densa es el punto dulce para self-hosting real: contexto nativo de 262K, multimodal, buen desempeño en código. | La mejor opción práctica para correr localmente hoy si tenés 1-2 GPUs de consumo — es lo que este sitio corre en producción. | fuente ↗ verificado 2026-08-21 |
| Kimi K3 (Moonshot AI) Moonshot AI |
open-weight | julio 2026 | 1048k | no | El modelo open-source más grande lanzado hasta la fecha, con atención híbrida (Kimi Delta Attention) y modo de razonamiento siempre activo. Contexto de ~1M tokens. | Abierto no siempre significa auto-hosteable — este es el ejemplo: la licencia es libre, el hardware necesario no. | fuente ↗ verificado 2026-08-21 |
| DeepSeek V4 (DeepSeek) DeepSeek |
open-weight | abril 2026 (Preview) | 1000k | no | Reset arquitectónico a atención híbrida, la historia de eficiencia más fuerte del grupo open-weight en cómputo-por-token pese al tamaño. | Mejor relación capacidad/cómputo del lote open-weight, pero self-hosting real solo si tenés infraestructura multi-GPU propia. | fuente ↗ verificado 2026-08-21 |
Notas de hosting local
Claude (Anthropic)Solo API/cloud — sin pesos abiertos.
ChatGPT / GPT-5.6 + Codex (OpenAI)Solo API/cloud.
Gemini (Google)Solo API/cloud (el hermano abierto es Gemma, no Gemini).
Qwen3.6 (Alibaba)La variante densa 27B corre en 1-2 GPUs de consumo (Q4) — el mismo tamaño que Sol, el modelo primario de este sitio.
Kimi K3 (Moonshot AI)Pesos abiertos, pero 2.8T parámetros es escala de datacenter — no entra en hardware de consumo aunque sea "open-weight".
DeepSeek V4 (DeepSeek)V4-Flash (la variante chica) todavía pide ~172GB VRAM en Q4 — fuera de alcance de una sola GPU de consumo, factible en un rack multi-GPU dedicado.