Paulo Vila AI Tier 0: 96.2% | Ahorrado: $148.50 USD

Modelos

Modelos comerciales y open-weight — mismo template para ambos, así se mantienen comparables y fáciles de actualizar cuando cambian de versión. Cada fila muestra cuándo se verificó por última vez; los modelos cambian rápido, no confíes en una fila vieja.

ModeloTipoLanzamientoContextoAuto-hosteableFortalezaVeredictoFuente
Claude (Anthropic)
Anthropic
comercial 2026 · generación 5 200k no Cuatro niveles (Haiku 4.5 / Sonnet 5 / Opus 5 / Fable 5) — de barato-y-rápido a código agéntico complejo. Buen equilibrio costo/calidad en el nivel Sonnet. El default razonable si no te importa depender de la nube y querés el mejor equilibrio calidad/costo por nivel. fuente ↗
verificado 2026-08-21
ChatGPT / GPT-5.6 + Codex (OpenAI)
OpenAI
comercial 2026 · familia GPT-5.6 128k no Codex ya no es un producto aparte — es un stack unificado GPT-5+Codex. El modelo de código actual es GPT-5.3-Codex, con una variante Max para trabajo agéntico largo y una Mini más barata. Fuerte específicamente en tareas de código de formato largo/agéntico vía Codex; ChatGPT normal para todo lo demás. fuente ↗
verificado 2026-08-21
Gemini (Google)
Google DeepMind
comercial 2026 · familia 3.x 1000k no 3.1 Pro y 3 Deep Think para razonamiento frontier; 3.5/3.6 Flash para agentes y código a menor costo; contexto de hasta 1M tokens en las variantes tope. La opción de ventana de contexto más grande si necesitás meter documentos enormes de una sola vez. fuente ↗
verificado 2026-08-21
Qwen3.6 (Alibaba)
Alibaba (Qwen Team)
open-weight abril 2026 262k Familia con la cadencia de release más activa de H1 2026. La variante 27B densa es el punto dulce para self-hosting real: contexto nativo de 262K, multimodal, buen desempeño en código. La mejor opción práctica para correr localmente hoy si tenés 1-2 GPUs de consumo — es lo que este sitio corre en producción. fuente ↗
verificado 2026-08-21
Kimi K3 (Moonshot AI)
Moonshot AI
open-weight julio 2026 1048k no El modelo open-source más grande lanzado hasta la fecha, con atención híbrida (Kimi Delta Attention) y modo de razonamiento siempre activo. Contexto de ~1M tokens. Abierto no siempre significa auto-hosteable — este es el ejemplo: la licencia es libre, el hardware necesario no. fuente ↗
verificado 2026-08-21
DeepSeek V4 (DeepSeek)
DeepSeek
open-weight abril 2026 (Preview) 1000k no Reset arquitectónico a atención híbrida, la historia de eficiencia más fuerte del grupo open-weight en cómputo-por-token pese al tamaño. Mejor relación capacidad/cómputo del lote open-weight, pero self-hosting real solo si tenés infraestructura multi-GPU propia. fuente ↗
verificado 2026-08-21

Notas de hosting local

Claude (Anthropic)Solo API/cloud — sin pesos abiertos.
ChatGPT / GPT-5.6 + Codex (OpenAI)Solo API/cloud.
Gemini (Google)Solo API/cloud (el hermano abierto es Gemma, no Gemini).
Qwen3.6 (Alibaba)La variante densa 27B corre en 1-2 GPUs de consumo (Q4) — el mismo tamaño que Sol, el modelo primario de este sitio.
Kimi K3 (Moonshot AI)Pesos abiertos, pero 2.8T parámetros es escala de datacenter — no entra en hardware de consumo aunque sea "open-weight".
DeepSeek V4 (DeepSeek)V4-Flash (la variante chica) todavía pide ~172GB VRAM en Q4 — fuera de alcance de una sola GPU de consumo, factible en un rack multi-GPU dedicado.