Paulo Vila AI Tier 0: 96.2% | Economizado: 148,50 USD

Modelos

Modelos comerciais e open-weight — mesmo template para ambos, para manter comparabilidade e facilitar atualizações ao mudar de versão. Cada linha mostra a data da última verificação; os modelos mudam rapidamente, não confie em linhas antigas.

ModeloTipoLançamentoContextoAuto-hospedávelFortalezaVereditoFonte
Claude (Anthropic)
Anthropic
comercial 2026 · geração 5 200k não Quatro níveis (Haiku 4.5 / Sonnet 5 / Opus 5 / Fable 5) — de barato-e-rápido a código agêntico complexo. Bom equilíbrio custo/qualidade no nível Sonnet. O padrão razoável se você não se importa em depender da nuvem e quer o melhor equilíbrio qualidade/custo por nível. fonte ↗
verificado 2026-08-21
ChatGPT / GPT-5.6 + Codex (OpenAI)
OpenAI
comercial 2026 · família GPT-5.6 128k não O Codex não é mais um produto separado — é um stack unificado GPT-5+Codex. O modelo de código atual é GPT-5.3-Codex, com uma variante Max para trabalho agêntico longo e uma Mini mais barata. Forte especificamente em tarefas de código de formato longo/agêntico via Codex; ChatGPT normal para tudo mais. fonte ↗
verificado 2026-08-21
Gemini (Google)
Google DeepMind
comercial 2026 · família 3.x 1.000k não 3.1 Pro e 3 Deep Think para raciocínio frontier; 3.5/3.6 Flash para agentes e código a menor custo; contexto de até 1M tokens nas variantes topo. A opção de janela de contexto maior se precisar inserir documentos enormes de uma só vez. fonte ↗
verificado 2026-08-21
Qwen3.6 (Alibaba)
Alibaba (Equipe Qwen)
open-weight abril 2026 262k sim Família com a cadência de release mais ativa do H1 2026. A variante 27B densa é o ponto ideal para self-hosting real: contexto nativo de 262K, multimodal, bom desempenho em código. A melhor opção prática para rodar localmente hoje se você tiver 1-2 GPUs de consumo — é o que este site roda em produção. fonte ↗
verificado 2026-08-21
Kimi K3 (Moonshot AI)
Moonshot AI
open-weight julho 2026 1.048k não O modelo open-source mais grande lançado até a data, com atenção híbrida (Kimi Delta Attention) e modo de raciocínio sempre ativo. Contexto de ~1M tokens. Aberto nem sempre significa auto-hospedável — este é o exemplo: a licença é livre, o hardware necessário não. fonte ↗
verificado 2026-08-21
DeepSeek V4 (DeepSeek)
DeepSeek
open-weight abril 2026 (Preview) 1.000k não Reset arquitetônico para atenção híbrida, a história de eficiência mais forte do grupo open-weight em computação-por-token apesar do tamanho. Melhor relação capacidade/cómputo do lote open-weight, mas self-hosting real apenas se tiver infraestrutura multi-GPU própria. fonte ↗
verificado 2026-08-21

Notas de hospedagem local

Claude (Anthropic)Apenas API/cloud — sem pesos abertos.
ChatGPT / GPT-5.6 + Codex (OpenAI)Apenas API/cloud.
Gemini (Google)Apenas API/cloud (o irmão aberto é Gemma, não Gemini).
Qwen3.6 (Alibaba)A variante densa 27B roda em 1-2 GPUs de consumo (Q4) — o mesmo tamanho do Sol, o modelo primário deste site.
Kimi K3 (Moonshot AI)Pesos abertos, mas 2.8T parâmetros é escala de datacenter — não entra em hardware de consumo mesmo sendo 'open-weight'.
DeepSeek V4 (DeepSeek)V4-Flash (a variante pequena) ainda exige ~172GB de VRAM em Q4 — fora do alcance de uma GPU de consumo, viável em um rack multi-GPU dedicado.