Modelos
Modelos comerciais e open-weight — mesmo template para ambos, para manter comparabilidade e facilitar atualizações ao mudar de versão. Cada linha mostra a data da última verificação; os modelos mudam rapidamente, não confie em linhas antigas.
| Modelo | Tipo | Lançamento | Contexto | Auto-hospedável | Fortaleza | Veredito | Fonte |
|---|---|---|---|---|---|---|---|
| Claude (Anthropic) Anthropic |
comercial | 2026 · geração 5 | 200k | não | Quatro níveis (Haiku 4.5 / Sonnet 5 / Opus 5 / Fable 5) — de barato-e-rápido a código agêntico complexo. Bom equilíbrio custo/qualidade no nível Sonnet. | O padrão razoável se você não se importa em depender da nuvem e quer o melhor equilíbrio qualidade/custo por nível. | fonte ↗ verificado 2026-08-21 |
| ChatGPT / GPT-5.6 + Codex (OpenAI) OpenAI |
comercial | 2026 · família GPT-5.6 | 128k | não | O Codex não é mais um produto separado — é um stack unificado GPT-5+Codex. O modelo de código atual é GPT-5.3-Codex, com uma variante Max para trabalho agêntico longo e uma Mini mais barata. | Forte especificamente em tarefas de código de formato longo/agêntico via Codex; ChatGPT normal para tudo mais. | fonte ↗ verificado 2026-08-21 |
| Gemini (Google) Google DeepMind |
comercial | 2026 · família 3.x | 1.000k | não | 3.1 Pro e 3 Deep Think para raciocínio frontier; 3.5/3.6 Flash para agentes e código a menor custo; contexto de até 1M tokens nas variantes topo. | A opção de janela de contexto maior se precisar inserir documentos enormes de uma só vez. | fonte ↗ verificado 2026-08-21 |
| Qwen3.6 (Alibaba) Alibaba (Equipe Qwen) |
open-weight | abril 2026 | 262k | sim | Família com a cadência de release mais ativa do H1 2026. A variante 27B densa é o ponto ideal para self-hosting real: contexto nativo de 262K, multimodal, bom desempenho em código. | A melhor opção prática para rodar localmente hoje se você tiver 1-2 GPUs de consumo — é o que este site roda em produção. | fonte ↗ verificado 2026-08-21 |
| Kimi K3 (Moonshot AI) Moonshot AI |
open-weight | julho 2026 | 1.048k | não | O modelo open-source mais grande lançado até a data, com atenção híbrida (Kimi Delta Attention) e modo de raciocínio sempre ativo. Contexto de ~1M tokens. | Aberto nem sempre significa auto-hospedável — este é o exemplo: a licença é livre, o hardware necessário não. | fonte ↗ verificado 2026-08-21 |
| DeepSeek V4 (DeepSeek) DeepSeek |
open-weight | abril 2026 (Preview) | 1.000k | não | Reset arquitetônico para atenção híbrida, a história de eficiência mais forte do grupo open-weight em computação-por-token apesar do tamanho. | Melhor relação capacidade/cómputo do lote open-weight, mas self-hosting real apenas se tiver infraestrutura multi-GPU própria. | fonte ↗ verificado 2026-08-21 |
Notas de hospedagem local
Claude (Anthropic)Apenas API/cloud — sem pesos abertos.
ChatGPT / GPT-5.6 + Codex (OpenAI)Apenas API/cloud.
Gemini (Google)Apenas API/cloud (o irmão aberto é Gemma, não Gemini).
Qwen3.6 (Alibaba)A variante densa 27B roda em 1-2 GPUs de consumo (Q4) — o mesmo tamanho do Sol, o modelo primário deste site.
Kimi K3 (Moonshot AI)Pesos abertos, mas 2.8T parâmetros é escala de datacenter — não entra em hardware de consumo mesmo sendo 'open-weight'.
DeepSeek V4 (DeepSeek)V4-Flash (a variante pequena) ainda exige ~172GB de VRAM em Q4 — fora do alcance de uma GPU de consumo, viável em um rack multi-GPU dedicado.