Modelos de IA
28Encontra o modelo certo para a tua tarefa. Filtra por pontos fortes, compara preços e decide.
Filtrar por fornecedor
Claude Fable 5
Anthropic
Modelo de fronteira da classe Mythos da Anthropic — o Claude mais forte disponível publicamente até hoje, liderando todos os principais benchmarks no lançamento. O veredicto permanece CONDITIONAL por duas restrições ativas: preço apenas por créditos a $10/$50 por 1M de tokens sem opção de assinatura, e um classificador de segurança que dispara em excesso em tarefas rotineiras de código, redirecionando-as silenciosamente para um fallback no Opus 4.8. Recorra ao Fable 5 quando o delta de capacidade justificar o custo; para trabalho rotineiro, o Sonnet 5 é a alternativa mais previsível.
- Entrada
- $10 / 1M tokens
- Saída
- $50 / 1M tokens
- Contexto
- 1M context, 128K max output
Claude Haiku 4.5
Anthropic
A referência de custo-benefício da Anthropic a $1/$5 por 1M de tokens — o nível rápido e barato contra o qual os concorrentes se comparam, com contexto de 200K e saída de 64K. Melhor para trabalho de alto volume e sensível à latência: classificação, extração, sumarização, roteamento. Recorra ao Opus 4.8 ou ao Sonnet 5 quando for necessário raciocínio profundo em múltiplas etapas.
- Entrada
- $1 / 1M tokens
- Saída
- $5 / 1M tokens
- Contexto
- 200K tokens
Claude Opus 4.8
Anthropic
O modelo de raciocínio carro-chefe da Anthropic e o incumbente prático da fronteira em capacidade implantável — contexto de 1M tokens a $5/$25 por 1M de tokens, incluído em todos os planos de assinatura. Nossa escolha para trabalho intensivo em revisão: revisão de código, refatoração sob restrições e tarefas de ritmo deliberado. Codificação agêntica forte, raciocínio analítico de primeira linha e acesso estável por assinatura fazem dele o carro-chefe padrão para a maioria das equipes em produção.
- Entrada
- $5 / 1M tokens
- Saída
- $25 / 1M tokens
- Contexto
- 1M tokens
Claude Sonnet 4.6
Anthropic
Superado pelo Claude Sonnet 5 (lançado em 30 de junho de 2026) como o cavalo de batalha padrão de nível médio. O preço de $3/$15 e o contexto de 1M tokens do Sonnet 4.6 agora são igualados por um sucessor com um salto de 13,4 pontos no Terminal-Bench 2.1 pela mesma tabela de preços. Escolha o 4.6 apenas para implantações fixadas ou onde os ~30% a mais de tokens do Sonnet 5 e a remoção de temperature/top_p/top_k sejam desclassificantes.
- Entrada
- $3 / 1M tokens
- Saída
- $15 / 1M tokens
- Contexto
- 1M tokens
Claude Sonnet 5
Anthropic
O Sonnet mais agêntico da Anthropic entrega desempenho próximo ao do Opus 4.8 por cerca de metade do preço, com +13,4 pontos no Terminal-Bench 2.1 sobre o Sonnet 4.6. O novo tokenizador infla as contagens em ~30%, então o preço introdutório ($2/$10 por MTok até 31 de agosto) mantém a migração neutra em custo, mas as equipes devem recalcular os orçamentos antes de trocar. Ele substitui o Sonnet 4.6 como padrão em todos os planos Claude, ideal para codificação agêntica, depuração brownfield e pipelines de produção — não para as tarefas mais difíceis de raciocínio de fronteira ou cibersegurança.
- Entrada
- $3 / 1M
- Saída
- $15 / 1M
- Contexto
- 1M tokens
GLM-5.2
Z.ai
Melhor modelo de código com pesos abertos, 1M tokens de contexto e licença MIT — supera o GPT-5.5 em múltiplos benchmarks por uma fração do custo, mas ainda fica atrás do Claude Opus 4.8 nas tarefas mais difíceis de longa duração.
- Entrada
- $1.40 / 1M tokens
- Saída
- $4.40 / 1M tokens
- Contexto
- 1M tokens
GPT-4.1
OpenAI
O destino padrão de migração para cargas de trabalho do GPT-4 Turbo: mesmo formato de requisição, custo menor, contexto de 1M tokens — converta payloads legados de function_call para o formato tools e siga em frente.
- Entrada
- $2 / 1M tokens
- Saída
- $8 / 1M tokens
- Contexto
- 1M tokens
GPT-4o (Retired from ChatGPT, API-only)
OpenAI
GPT-4o (May 2024) has been superseded by the GPT-5.x family and delisted from OpenAI's flagship API pricing page. It remains available through the API but is no longer a current-generation model. Use only where migration to GPT-5.x is blocked; otherwise, GPT-5.5 or GPT-5.4 offer better performance at comparable cost.
- Entrada
- $2.50 / 1M tokens
- Saída
- $10 / 1M tokens
- Contexto
- 128K tokens
GPT-5.5
OpenAI
O modelo fronteira comercial de uso geral da OpenAI e a âncora implantável da OpenAI enquanto a família GPT-5.6 permanece sob restrição governamental — $5/$30 por 1M de tokens com contexto de 1M+. Raciocínio sólido, amplo suporte ao ecossistema e disponibilidade pública total fazem dele um padrão de produção confiável, embora modelos mais baratos agora o igualem em tarefas específicas. Para a maioria das equipes, ele continua sendo a referência pela qual os novos modelos são medidos.
- Entrada
- $5 / 1M tokens
- Saída
- $30 / 1M tokens
- Contexto
- 1M+ tokens (922K in / 128K out)
GPT-5.5-Cyber
OpenAI
85,6% no CyberGym — maior pontuação de modelo único — mas acesso restrito apenas para defensores credenciados.
- Entrada
- N/A
- Saída
- N/A
- Contexto
- Trusted Access for Cyber; not commercial API
GPT-5.6 Luna
OpenAI
O nível de orçamento do GPT-5.6 da OpenAI — TerminalBench 2.1 com 82,5% por $1/$6 por 1M de tokens, superando Claude Haiku 4.5 e Gemini Flash em capacidade por dólar. A ressalva: a Luna está restrita a ~20 parceiros confiáveis, sem verificação independente ou data de GA. Melhor para equipes que constroem arquiteturas de roteamento de modelos que podem escalar falhas baratas para Terra ou Sol.
- Entrada
- $1 / 1M tokens
- Saída
- $6 / 1M tokens
- Contexto
- Fastest and most cost-efficient GPT-5.6 tier.
GPT-5.6 Sol
OpenAI
O GPT-5.6 Sol é o modelo de fronteira mais custo-efetivo, liderando em benchmarks de codificação e competitivo em raciocínio complexo a uma fração do custo dos concorrentes. O veredicto é reforçado pela divulgação do endurecimento de segurança GPT-Red — o modelo foi treinado adversarialmente contra um modelo dedicado de red-teaming por RL de auto-jogo em escala de fronteira, tornando-o 6x mais robusto a injeções de prompt.
- Entrada
- $5 / 1M tokens
- Saída
- $30 / 1M tokens
- Contexto
- Same rate card as GPT-5.5. Ultra mode costs more.
GPT-5.6 Terra
OpenAI
O cavalo de batalha de nível médio do GPT-5.6 — capacidade de classe GPT-5.5 pela metade do preço ($2,50/$15 por 1M de tokens), com TerminalBench 2.1 em 84,3% empatando com Claude Fable 5. A ressalva: todas as alegações são fornecidas pelo fornecedor, a Terra está restrita a ~20 parceiros e não há data de GA confirmada. Para a maioria das cargas de trabalho em produção, a Terra seria a opção pragmática padrão quando disponível; GPT-5.5 e Opus 4.8 são as alternativas atuais.
- Entrada
- $2.50 / 1M tokens
- Saída
- $15 / 1M tokens
- Contexto
- Roughly 2x cheaper than GPT-5.5 for similar perf.
GPT-Live-1
OpenAI
O primeiro modelo de voz full-duplex da OpenAI — ouve e fala simultaneamente, um salto além do Modo de Voz Avançado baseado em turnos. Delega raciocínio complexo ao GPT-5.5 em segundo plano enquanto mantém o fluxo conversacional. Veredito CONDICIONAL: é a melhor experiência de voz do ChatGPT disponível, mas é um modelo integrado ao produto, sem API e com suporte irregular a idiomas.
- Entrada
- ChatGPT subscription
- Saída
- ChatGPT subscription
- Contexto
- ChatGPT Voice only
GPT-Live-1 mini
OpenAI
A variante gratuita do GPT-Live-1 — mesma arquitetura full-duplex em um pacote menor e mais rápido, servindo como modelo de voz padrão para usuários do ChatGPT Free. Compartilha as inovações principais: interação contínua, suporte a palavra de ativação e delegação ao GPT-5.5. As mesmas limitações se aplicam: sem API, qualidade irregular entre idiomas. Uma atualização substancial em relação ao antigo modo de voz baseado em turnos para usuários gratuitos.
- Entrada
- Free (ChatGPT)
- Saída
- Free (ChatGPT)
- Contexto
- ChatGPT Voice only
Gemini 2.5 Pro
Agora a escolha econômica para contexto longo: um corte de 40% no preço (junho de 2026) tornou as análises de corpus completo acessíveis para orçamentos médios — a maior janela de contexto disponível com forte integração ao ecossistema Google.
- Entrada
- $1.25 / 1M tokens
- Saída
- $10 / 1M tokens
- Contexto
- 1M tokens
Gemini 3.5 Flash
O destaque de eficiência de custos do Google para automação agêntica de desktop a $1,50/$9 por 1M de tokens com contexto de ~1M. O Computer Use nativo atinge 78,4 no OSWorld-Verified — a apenas 0,3 pontos do GPT-5.5 por aproximadamente um terço do custo. A ressalva relevante: a ferramenta Computer Use é uma prévia pública que ainda não está na API de produção, portanto verifique a disponibilidade do endpoint antes de integrá-la.
- Entrada
- $1.50 / 1M tokens
- Saída
- $9 / 1M tokens
- Contexto
- 1M tokens
Gemini 3.5 Pro
O modelo de fronteira pré-GA do Google — agora em seu quarto adiamento e 'meses atrasado' segundo a Bloomberg. O contexto de 2M tokens, o pipeline multimodal nativo e o raciocínio Deep Think continuam sendo capacidades reais, mas não há um cronograma de GA confirmado. A capacidade de codificação é a principal deficiência.
- Entrada
- Not yet published
- Saída
- Not yet published
- Contexto
- Est. $5-15/$30-60 per 1M. 2M ctx. Not GA.
Grok 4.5
SpaceXAI
Modelo de codificação agêntica com preço competitivo a $2/$6 por 1M de tokens com 500K de contexto — os benchmarks publicados pela xAI o colocam no meio do pelotão, atrás do Fable 5 e GPT-5.5, embora lidere sobre o Opus 4.8 no DeepSWE e Terminal-Bench 2.1. O destaque real é a eficiência de custo: 4,2× mais eficiente em tokens que o Opus 4.8 no SWE-Bench Pro. Ideal para equipes que precisam de codificação forte por uma fração do preço de ponta. Ainda não disponível na UE.
- Entrada
- $2 / 1M tokens
- Saída
- $6 / 1M tokens
- Contexto
- 500K tokens
Hy3
Tencent
Modelo agêntico MoE de pesos abertos Apache 2.0 (295B total, 21B ativos) com forte confiabilidade em chamadas de ferramentas e comportamento anti-alucinação, mas a codificação fica atrás do GLM-5.2 e o self-hosting exige 8+ GPUs. Nível gratuito no OpenRouter até 21 de julho — depois $0,20/$0,80 por 1M de tokens. Ideal para agentes de programação self-hosted e trabalho com documentos de contexto longo, onde licenciamento permissivo importa mais do que pontuações absolutas em benchmarks.
- Entrada
- $0.20 / 1M
- Saída
- $0.80 / 1M
- Contexto
- 256K tokens
Inkling
Thinking Machines Lab
O Inkling é o melhor argumento até agora para levar a sério a IA multimodal de pesos abertos. Entrega raciocínio e codificação competitivos com segurança de ponta em pesos abertos e esforço de pensamento controlável, tudo sob Apache 2.0. Mas a Thinking Machines é honesta ao dizer que não é o mais forte no geral — a factualidade fica para trás (SimpleQA 43,9%) e o self-hosting exige hardware pesado (2TB de VRAM). Condicional: uma base atraente para organizações que precisam ter e ajustar um modelo multimodal próprio, não para equipes que buscam o melhor desempenho pronto para uso.
- Entrada
- $1.87 / 1M tokens
- Saída
- $4.68 / 1M tokens
- Contexto
- Up to 1M tokens native
Kimi K3
Moonshot AI
O carro-chefe MoE de 2,8T da Moonshot AI — o maior modelo de pesos abertos já lançado — lidera em codificação front-end no Arena WebDev e compete com o Opus 4.8 em tarefas de codificação de longa duração. O preço fixo de $3/$15 por 1M o mantém acessível, mas ainda fica atrás do Fable 5 e GPT 5.6 Sol em benchmarks de execução precisa, e os pesos permanecem apenas hospedados até 27 de julho. Ideal para equipes que fazem codificação agêntica de contexto longo, que toleram verbosidade e não precisam de self-hosting imediato.
- Entrada
- $3.00 / 1M
- Saída
- $15.00 / 1M
- Contexto
- 1M tokens, $0.30/1M cached
Llama 4 Maverick
Meta
O principal modelo de código aberto para equipes que precisam de auto-hospedagem, soberania de dados ou querem evitar dependência de fornecedor de API.
- Entrada
- Free (self-hosted) or $0.20 / 1M tokens (hosted)
- Saída
- Free (self-hosted) or $0.60 / 1M tokens (hosted)
- Contexto
- 10M tokens
MAI-Code-1-Flash
Microsoft
O primeiro modelo de codificação interno da Microsoft — um MoE esparso pequeno, rápido e agressivamente otimizado em custo a $0,75/$4,50 por 1M de tokens. Oferece uma vantagem de 16 pontos sobre o Claude Haiku 4.5 no SWE-Bench Pro usando até 60% menos tokens. Ele foi construído especificamente para fluxos de trabalho Copilot de alto volume — autocompletar, refatorações, scaffolds — não é um modelo de fronteira. Melhor dentro do ecossistema Copilot; o acesso por API externo ainda está sendo implementado.
- Entrada
- $0.75 / 1M tokens
- Saída
- $4.50 / 1M tokens
- Contexto
- 256K context
Muse Spark 1.1
Meta
O primeiro modelo de IA pago da Meta e sua primeira investida no mercado comercial de codificação — $1,25/$4,25 por 1M de tokens com 1M de contexto, orquestração nativa de subagentes, suporte a MCP/ferramentas e capacidade de uso de computador por cerca de 4× abaixo do preço da Anthropic/OpenAI. Lidera em benchmarks de uso de ferramentas, mas fica 7 pontos atrás do Opus 4.8 em codificação pura no SWE-Bench Pro. Pesos fechados, prévia pública apenas nos EUA. Ideal para equipes que priorizam orquestração de uso de ferramentas com baixo custo.
- Entrada
- $1.25 / 1M tokens
- Saída
- $4.25 / 1M tokens
- Contexto
- 1M tokens
Mythos 5 (Claude Mythos 5)
Anthropic
O modelo de cibersegurança mais forte do mundo (83,8% CyberGym) — construído sobre os pesos do Fable 5 com os classificadores de segurança removidos. O acesso foi suspenso após a diretiva de exportação de 12 de junho; parcialmente restaurado em 26 de junho para ~100 organizações críticas dos EUA designadas (Project Glasswing). O veredicto permanece CONDITIONAL: a capacidade é de elite, mas o acesso é controlado por designação federal. Não é uma API pública — utilizável apenas se sua organização estiver na lista do Departamento de Comércio.
- Entrada
- $10 / 1M tokens
- Saída
- $50 / 1M tokens
- Contexto
- 1M tokens (restricted access)
Ornith-1.0
DeepReinforce
Uma família de modelos open-source para programação agentiva com licença MIT que entrega resultados comparáveis aos melhores modelos — superando o Claude Opus 4.7 tanto no Terminal-Bench 2.1 quanto no SWE-Bench Verified — mas exige self-hosting com recursos significativos de GPU e vem de um laboratório novo com histórico limitado.
- Entrada
- Free (MIT license)
- Saída
- Free (MIT license)
- Contexto
- 256K tokens
Sakana Fugu
Sakana AI
Orquestrador multiagente que iguala modelos de fronteira em benchmarks-chave ao rotear por um pool de agentes especialistas — mas o roteamento opaco e a dependência de plataforma limitam a transparência.
- Entrada
- $5 / 1M tokens
- Saída
- $30 / 1M tokens
- Contexto
- 272K tokens (>272K: $10/$45 per 1M)