Modelos de IA

28

Encontra o modelo certo para a tua tarefa. Filtra por pontos fortes, compara preços e decide.

Filtrar por fornecedor

28modelos
Claude Fable 5 logo

Claude Fable 5

Anthropic

Condicional

Modelo de fronteira da classe Mythos da Anthropic — o Claude mais forte disponível publicamente até hoje, liderando todos os principais benchmarks no lançamento. O veredicto permanece CONDITIONAL por duas restrições ativas: preço apenas por créditos a $10/$50 por 1M de tokens sem opção de assinatura, e um classificador de segurança que dispara em excesso em tarefas rotineiras de código, redirecionando-as silenciosamente para um fallback no Opus 4.8. Recorra ao Fable 5 quando o delta de capacidade justificar o custo; para trabalho rotineiro, o Sonnet 5 é a alternativa mais previsível.

Entrada
$10 / 1M tokens
Saída
$50 / 1M tokens
Contexto
1M context, 128K max output
Claude Haiku 4.5 logo

Claude Haiku 4.5

Anthropic

Recomendado

A referência de custo-benefício da Anthropic a $1/$5 por 1M de tokens — o nível rápido e barato contra o qual os concorrentes se comparam, com contexto de 200K e saída de 64K. Melhor para trabalho de alto volume e sensível à latência: classificação, extração, sumarização, roteamento. Recorra ao Opus 4.8 ou ao Sonnet 5 quando for necessário raciocínio profundo em múltiplas etapas.

Entrada
$1 / 1M tokens
Saída
$5 / 1M tokens
Contexto
200K tokens
Claude Opus 4.8 logo

Claude Opus 4.8

Anthropic

Recomendado

O modelo de raciocínio carro-chefe da Anthropic e o incumbente prático da fronteira em capacidade implantável — contexto de 1M tokens a $5/$25 por 1M de tokens, incluído em todos os planos de assinatura. Nossa escolha para trabalho intensivo em revisão: revisão de código, refatoração sob restrições e tarefas de ritmo deliberado. Codificação agêntica forte, raciocínio analítico de primeira linha e acesso estável por assinatura fazem dele o carro-chefe padrão para a maioria das equipes em produção.

Entrada
$5 / 1M tokens
Saída
$25 / 1M tokens
Contexto
1M tokens
Claude Sonnet 4.6 logo

Claude Sonnet 4.6

Anthropic

Condicional

Superado pelo Claude Sonnet 5 (lançado em 30 de junho de 2026) como o cavalo de batalha padrão de nível médio. O preço de $3/$15 e o contexto de 1M tokens do Sonnet 4.6 agora são igualados por um sucessor com um salto de 13,4 pontos no Terminal-Bench 2.1 pela mesma tabela de preços. Escolha o 4.6 apenas para implantações fixadas ou onde os ~30% a mais de tokens do Sonnet 5 e a remoção de temperature/top_p/top_k sejam desclassificantes.

Entrada
$3 / 1M tokens
Saída
$15 / 1M tokens
Contexto
1M tokens
Claude Sonnet 5 logo

Claude Sonnet 5

Anthropic

Recomendado

O Sonnet mais agêntico da Anthropic entrega desempenho próximo ao do Opus 4.8 por cerca de metade do preço, com +13,4 pontos no Terminal-Bench 2.1 sobre o Sonnet 4.6. O novo tokenizador infla as contagens em ~30%, então o preço introdutório ($2/$10 por MTok até 31 de agosto) mantém a migração neutra em custo, mas as equipes devem recalcular os orçamentos antes de trocar. Ele substitui o Sonnet 4.6 como padrão em todos os planos Claude, ideal para codificação agêntica, depuração brownfield e pipelines de produção — não para as tarefas mais difíceis de raciocínio de fronteira ou cibersegurança.

Entrada
$3 / 1M
Saída
$15 / 1M
Contexto
1M tokens
G

GLM-5.2

Z.ai

Condicional

Melhor modelo de código com pesos abertos, 1M tokens de contexto e licença MIT — supera o GPT-5.5 em múltiplos benchmarks por uma fração do custo, mas ainda fica atrás do Claude Opus 4.8 nas tarefas mais difíceis de longa duração.

Entrada
$1.40 / 1M tokens
Saída
$4.40 / 1M tokens
Contexto
1M tokens
GPT-4.1 logo

GPT-4.1

OpenAI

Recomendado

O destino padrão de migração para cargas de trabalho do GPT-4 Turbo: mesmo formato de requisição, custo menor, contexto de 1M tokens — converta payloads legados de function_call para o formato tools e siga em frente.

Entrada
$2 / 1M tokens
Saída
$8 / 1M tokens
Contexto
1M tokens
GPT-4o (Retired from ChatGPT, API-only) logo

GPT-4o (Retired from ChatGPT, API-only)

OpenAI

Condicional

GPT-4o (May 2024) has been superseded by the GPT-5.x family and delisted from OpenAI's flagship API pricing page. It remains available through the API but is no longer a current-generation model. Use only where migration to GPT-5.x is blocked; otherwise, GPT-5.5 or GPT-5.4 offer better performance at comparable cost.

Entrada
$2.50 / 1M tokens
Saída
$10 / 1M tokens
Contexto
128K tokens
GPT-5.5 logo

GPT-5.5

OpenAI

Recomendado

O modelo fronteira comercial de uso geral da OpenAI e a âncora implantável da OpenAI enquanto a família GPT-5.6 permanece sob restrição governamental — $5/$30 por 1M de tokens com contexto de 1M+. Raciocínio sólido, amplo suporte ao ecossistema e disponibilidade pública total fazem dele um padrão de produção confiável, embora modelos mais baratos agora o igualem em tarefas específicas. Para a maioria das equipes, ele continua sendo a referência pela qual os novos modelos são medidos.

Entrada
$5 / 1M tokens
Saída
$30 / 1M tokens
Contexto
1M+ tokens (922K in / 128K out)
GPT-5.5-Cyber logo

GPT-5.5-Cyber

OpenAI

Condicional

85,6% no CyberGym — maior pontuação de modelo único — mas acesso restrito apenas para defensores credenciados.

Entrada
N/A
Saída
N/A
Contexto
Trusted Access for Cyber; not commercial API
GPT-5.6 Luna logo

GPT-5.6 Luna

OpenAI

pending

O nível de orçamento do GPT-5.6 da OpenAI — TerminalBench 2.1 com 82,5% por $1/$6 por 1M de tokens, superando Claude Haiku 4.5 e Gemini Flash em capacidade por dólar. A ressalva: a Luna está restrita a ~20 parceiros confiáveis, sem verificação independente ou data de GA. Melhor para equipes que constroem arquiteturas de roteamento de modelos que podem escalar falhas baratas para Terra ou Sol.

Entrada
$1 / 1M tokens
Saída
$6 / 1M tokens
Contexto
Fastest and most cost-efficient GPT-5.6 tier.
GPT-5.6 Sol logo

GPT-5.6 Sol

OpenAI

Recomendado

O GPT-5.6 Sol é o modelo de fronteira mais custo-efetivo, liderando em benchmarks de codificação e competitivo em raciocínio complexo a uma fração do custo dos concorrentes. O veredicto é reforçado pela divulgação do endurecimento de segurança GPT-Red — o modelo foi treinado adversarialmente contra um modelo dedicado de red-teaming por RL de auto-jogo em escala de fronteira, tornando-o 6x mais robusto a injeções de prompt.

Entrada
$5 / 1M tokens
Saída
$30 / 1M tokens
Contexto
Same rate card as GPT-5.5. Ultra mode costs more.
GPT-5.6 Terra logo

GPT-5.6 Terra

OpenAI

pending

O cavalo de batalha de nível médio do GPT-5.6 — capacidade de classe GPT-5.5 pela metade do preço ($2,50/$15 por 1M de tokens), com TerminalBench 2.1 em 84,3% empatando com Claude Fable 5. A ressalva: todas as alegações são fornecidas pelo fornecedor, a Terra está restrita a ~20 parceiros e não há data de GA confirmada. Para a maioria das cargas de trabalho em produção, a Terra seria a opção pragmática padrão quando disponível; GPT-5.5 e Opus 4.8 são as alternativas atuais.

Entrada
$2.50 / 1M tokens
Saída
$15 / 1M tokens
Contexto
Roughly 2x cheaper than GPT-5.5 for similar perf.
GPT-Live-1 logo

GPT-Live-1

OpenAI

Condicional

O primeiro modelo de voz full-duplex da OpenAI — ouve e fala simultaneamente, um salto além do Modo de Voz Avançado baseado em turnos. Delega raciocínio complexo ao GPT-5.5 em segundo plano enquanto mantém o fluxo conversacional. Veredito CONDICIONAL: é a melhor experiência de voz do ChatGPT disponível, mas é um modelo integrado ao produto, sem API e com suporte irregular a idiomas.

Entrada
ChatGPT subscription
Saída
ChatGPT subscription
Contexto
ChatGPT Voice only
GPT-Live-1 mini logo

GPT-Live-1 mini

OpenAI

Condicional

A variante gratuita do GPT-Live-1 — mesma arquitetura full-duplex em um pacote menor e mais rápido, servindo como modelo de voz padrão para usuários do ChatGPT Free. Compartilha as inovações principais: interação contínua, suporte a palavra de ativação e delegação ao GPT-5.5. As mesmas limitações se aplicam: sem API, qualidade irregular entre idiomas. Uma atualização substancial em relação ao antigo modo de voz baseado em turnos para usuários gratuitos.

Entrada
Free (ChatGPT)
Saída
Free (ChatGPT)
Contexto
ChatGPT Voice only
Gemini 2.5 Pro logo

Gemini 2.5 Pro

Google

Recomendado

Agora a escolha econômica para contexto longo: um corte de 40% no preço (junho de 2026) tornou as análises de corpus completo acessíveis para orçamentos médios — a maior janela de contexto disponível com forte integração ao ecossistema Google.

Entrada
$1.25 / 1M tokens
Saída
$10 / 1M tokens
Contexto
1M tokens
Gemini 3.5 Flash logo

Gemini 3.5 Flash

Google

Recomendado

O destaque de eficiência de custos do Google para automação agêntica de desktop a $1,50/$9 por 1M de tokens com contexto de ~1M. O Computer Use nativo atinge 78,4 no OSWorld-Verified — a apenas 0,3 pontos do GPT-5.5 por aproximadamente um terço do custo. A ressalva relevante: a ferramenta Computer Use é uma prévia pública que ainda não está na API de produção, portanto verifique a disponibilidade do endpoint antes de integrá-la.

Entrada
$1.50 / 1M tokens
Saída
$9 / 1M tokens
Contexto
1M tokens
Gemini 3.5 Pro logo

Gemini 3.5 Pro

Google

pending

O modelo de fronteira pré-GA do Google — agora em seu quarto adiamento e 'meses atrasado' segundo a Bloomberg. O contexto de 2M tokens, o pipeline multimodal nativo e o raciocínio Deep Think continuam sendo capacidades reais, mas não há um cronograma de GA confirmado. A capacidade de codificação é a principal deficiência.

Entrada
Not yet published
Saída
Not yet published
Contexto
Est. $5-15/$30-60 per 1M. 2M ctx. Not GA.
G

Grok 4.5

SpaceXAI

Condicional

Modelo de codificação agêntica com preço competitivo a $2/$6 por 1M de tokens com 500K de contexto — os benchmarks publicados pela xAI o colocam no meio do pelotão, atrás do Fable 5 e GPT-5.5, embora lidere sobre o Opus 4.8 no DeepSWE e Terminal-Bench 2.1. O destaque real é a eficiência de custo: 4,2× mais eficiente em tokens que o Opus 4.8 no SWE-Bench Pro. Ideal para equipes que precisam de codificação forte por uma fração do preço de ponta. Ainda não disponível na UE.

Entrada
$2 / 1M tokens
Saída
$6 / 1M tokens
Contexto
500K tokens
H

Hy3

Tencent

Condicional

Modelo agêntico MoE de pesos abertos Apache 2.0 (295B total, 21B ativos) com forte confiabilidade em chamadas de ferramentas e comportamento anti-alucinação, mas a codificação fica atrás do GLM-5.2 e o self-hosting exige 8+ GPUs. Nível gratuito no OpenRouter até 21 de julho — depois $0,20/$0,80 por 1M de tokens. Ideal para agentes de programação self-hosted e trabalho com documentos de contexto longo, onde licenciamento permissivo importa mais do que pontuações absolutas em benchmarks.

Entrada
$0.20 / 1M
Saída
$0.80 / 1M
Contexto
256K tokens
I

Inkling

Thinking Machines Lab

Condicional

O Inkling é o melhor argumento até agora para levar a sério a IA multimodal de pesos abertos. Entrega raciocínio e codificação competitivos com segurança de ponta em pesos abertos e esforço de pensamento controlável, tudo sob Apache 2.0. Mas a Thinking Machines é honesta ao dizer que não é o mais forte no geral — a factualidade fica para trás (SimpleQA 43,9%) e o self-hosting exige hardware pesado (2TB de VRAM). Condicional: uma base atraente para organizações que precisam ter e ajustar um modelo multimodal próprio, não para equipes que buscam o melhor desempenho pronto para uso.

Entrada
$1.87 / 1M tokens
Saída
$4.68 / 1M tokens
Contexto
Up to 1M tokens native
K

Kimi K3

Moonshot AI

Condicional

O carro-chefe MoE de 2,8T da Moonshot AI — o maior modelo de pesos abertos já lançado — lidera em codificação front-end no Arena WebDev e compete com o Opus 4.8 em tarefas de codificação de longa duração. O preço fixo de $3/$15 por 1M o mantém acessível, mas ainda fica atrás do Fable 5 e GPT 5.6 Sol em benchmarks de execução precisa, e os pesos permanecem apenas hospedados até 27 de julho. Ideal para equipes que fazem codificação agêntica de contexto longo, que toleram verbosidade e não precisam de self-hosting imediato.

Entrada
$3.00 / 1M
Saída
$15.00 / 1M
Contexto
1M tokens, $0.30/1M cached
Llama 4 Maverick logo

Llama 4 Maverick

Meta

Condicional

O principal modelo de código aberto para equipes que precisam de auto-hospedagem, soberania de dados ou querem evitar dependência de fornecedor de API.

Entrada
Free (self-hosted) or $0.20 / 1M tokens (hosted)
Saída
Free (self-hosted) or $0.60 / 1M tokens (hosted)
Contexto
10M tokens
MAI-Code-1-Flash logo

MAI-Code-1-Flash

Microsoft

Condicional

O primeiro modelo de codificação interno da Microsoft — um MoE esparso pequeno, rápido e agressivamente otimizado em custo a $0,75/$4,50 por 1M de tokens. Oferece uma vantagem de 16 pontos sobre o Claude Haiku 4.5 no SWE-Bench Pro usando até 60% menos tokens. Ele foi construído especificamente para fluxos de trabalho Copilot de alto volume — autocompletar, refatorações, scaffolds — não é um modelo de fronteira. Melhor dentro do ecossistema Copilot; o acesso por API externo ainda está sendo implementado.

Entrada
$0.75 / 1M tokens
Saída
$4.50 / 1M tokens
Contexto
256K context
Muse Spark 1.1 logo

Muse Spark 1.1

Meta

Condicional

O primeiro modelo de IA pago da Meta e sua primeira investida no mercado comercial de codificação — $1,25/$4,25 por 1M de tokens com 1M de contexto, orquestração nativa de subagentes, suporte a MCP/ferramentas e capacidade de uso de computador por cerca de 4× abaixo do preço da Anthropic/OpenAI. Lidera em benchmarks de uso de ferramentas, mas fica 7 pontos atrás do Opus 4.8 em codificação pura no SWE-Bench Pro. Pesos fechados, prévia pública apenas nos EUA. Ideal para equipes que priorizam orquestração de uso de ferramentas com baixo custo.

Entrada
$1.25 / 1M tokens
Saída
$4.25 / 1M tokens
Contexto
1M tokens
Mythos 5 (Claude Mythos 5) logo

Mythos 5 (Claude Mythos 5)

Anthropic

Condicional

O modelo de cibersegurança mais forte do mundo (83,8% CyberGym) — construído sobre os pesos do Fable 5 com os classificadores de segurança removidos. O acesso foi suspenso após a diretiva de exportação de 12 de junho; parcialmente restaurado em 26 de junho para ~100 organizações críticas dos EUA designadas (Project Glasswing). O veredicto permanece CONDITIONAL: a capacidade é de elite, mas o acesso é controlado por designação federal. Não é uma API pública — utilizável apenas se sua organização estiver na lista do Departamento de Comércio.

Entrada
$10 / 1M tokens
Saída
$50 / 1M tokens
Contexto
1M tokens (restricted access)
O

Ornith-1.0

DeepReinforce

Condicional

Uma família de modelos open-source para programação agentiva com licença MIT que entrega resultados comparáveis aos melhores modelos — superando o Claude Opus 4.7 tanto no Terminal-Bench 2.1 quanto no SWE-Bench Verified — mas exige self-hosting com recursos significativos de GPU e vem de um laboratório novo com histórico limitado.

Entrada
Free (MIT license)
Saída
Free (MIT license)
Contexto
256K tokens
S

Sakana Fugu

Sakana AI

Condicional

Orquestrador multiagente que iguala modelos de fronteira em benchmarks-chave ao rotear por um pool de agentes especialistas — mas o roteamento opaco e a dependência de plataforma limitam a transparência.

Entrada
$5 / 1M tokens
Saída
$30 / 1M tokens
Contexto
272K tokens (>272K: $10/$45 per 1M)