Modèles d’IA

28

Trouvez le bon modèle pour votre tâche. Filtrez par point fort, comparez les tarifs et décidez.

Filtrer par fournisseur

28modèles
Claude Fable 5 logo

Claude Fable 5

Anthropic

Conditionnel

Le modèle frontière de classe Mythos d'Anthropic — le Claude le plus puissant jamais rendu public, en tête de tous les grands benchmarks à son lancement. Le verdict reste CONDITIONNEL en raison de deux contraintes actuelles : une tarification uniquement à crédits de $10/$50 par 1M tokens sans option d'abonnement, et un classificateur de sécurité qui se déclenche trop souvent sur des tâches de codage courantes, les redirigeant silencieusement vers un repli sur Opus 4.8. Optez pour Fable 5 lorsque le gain de capacité justifie le coût ; pour le travail courant, Sonnet 5 est l'alternative la plus prévisible.

Entrée
$10 / 1M tokens
Sortie
$50 / 1M tokens
Contexte
1M context, 128K max output
Claude Haiku 4.5 logo

Claude Haiku 4.5

Anthropic

Recommandé

La référence rapport qualité-prix d'Anthropic à $1/$5 par 1M tokens — le palier rapide et économique auquel les concurrents se comparent, avec un contexte de 200K et une sortie de 64K. Idéal pour les charges à fort volume sensibles à la latence : classification, extraction, résumé, routage. Passez à Opus 4.8 ou Sonnet 5 lorsqu'un raisonnement profond en plusieurs étapes est nécessaire.

Entrée
$1 / 1M tokens
Sortie
$5 / 1M tokens
Contexte
200K tokens
Claude Opus 4.8 logo

Claude Opus 4.8

Anthropic

Recommandé

Le modèle de raisonnement phare d'Anthropic et le titulaire pratique de la frontière en capacité déployable — contexte de 1M tokens à $5/$25 par 1M tokens, inclus dans tous les plans d'abonnement. Notre choix pour le travail axé sur la revue : revue de code, refactoring sous contraintes et tâches à rythme délibéré. Un codage agentique solide, un raisonnement analytique de premier ordre et un accès stable par abonnement en font le modèle phare par défaut pour la plupart des équipes de production.

Entrée
$5 / 1M tokens
Sortie
$25 / 1M tokens
Contexte
1M tokens
Claude Sonnet 4.6 logo

Claude Sonnet 4.6

Anthropic

Conditionnel

Supplanté par Claude Sonnet 5 (sorti le 30 juin 2026) comme cheval de bataille par défaut du segment intermédiaire. La tarification $3/$15 de Sonnet 4.6 et son contexte de 1M tokens sont désormais égalés par un successeur affichant un bond de 13,4 points sur Terminal-Bench 2.1 à la même grille tarifaire. Ne choisissez 4.6 que pour des déploiements figés ou lorsque le nombre de tokens ~30% plus élevé de Sonnet 5 et la suppression de temperature/top_p/top_k sont rédhibitoires.

Entrée
$3 / 1M tokens
Sortie
$15 / 1M tokens
Contexte
1M tokens
Claude Sonnet 5 logo

Claude Sonnet 5

Anthropic

Recommandé

Le Sonnet le plus agentique d'Anthropic offre des performances proches d'Opus 4.8 pour environ la moitié du prix, avec +13,4 points sur Terminal-Bench 2.1 par rapport à Sonnet 4.6. Le nouveau tokenizer gonfle les décomptes d'environ 30%, si bien que la tarification de lancement ($2/$10 par MTok jusqu'au 31 août) rend la migration neutre en coût, mais les équipes devraient recalculer leurs budgets avant de basculer. Il remplace Sonnet 4.6 comme modèle par défaut sur tous les plans Claude, idéal pour le codage agentique, le débogage de code existant et les pipelines de production — pas pour les raisonnements frontière les plus difficiles ni les tâches de cybersécurité.

Entrée
$3 / 1M
Sortie
$15 / 1M
Contexte
1M tokens
G

GLM-5.2

Z.ai

Conditionnel

Meilleur modèle de codage open weight avec un contexte de 1M tokens et licence MIT — bat GPT-5.5 sur plusieurs benchmarks pour une fraction du coût, mais reste derrière Claude Opus 4.8 sur les tâches à horizon long les plus difficiles.

Entrée
$1.40 / 1M tokens
Sortie
$4.40 / 1M tokens
Contexte
1M tokens
GPT-4.1 logo

GPT-4.1

OpenAI

Recommandé

La cible de migration par défaut pour les workloads GPT-4 Turbo : même format de requête, coût inférieur, contexte de 1M tokens — convertissez les payloads function_call hérités au format tools et passez à la suite.

Entrée
$2 / 1M tokens
Sortie
$8 / 1M tokens
Contexte
1M tokens
GPT-4o (Retired from ChatGPT, API-only) logo

GPT-4o (Retired from ChatGPT, API-only)

OpenAI

Conditionnel

GPT-4o (May 2024) has been superseded by the GPT-5.x family and delisted from OpenAI's flagship API pricing page. It remains available through the API but is no longer a current-generation model. Use only where migration to GPT-5.x is blocked; otherwise, GPT-5.5 or GPT-5.4 offer better performance at comparable cost.

Entrée
$2.50 / 1M tokens
Sortie
$10 / 1M tokens
Contexte
128K tokens
GPT-5.5 logo

GPT-5.5

OpenAI

Recommandé

Le modèle frontière commercial généraliste d'OpenAI et le point d'ancrage OpenAI déployable tant que la famille GPT-5.6 reste sous restriction gouvernementale — $5/$30 par 1M tokens avec un contexte de 1M+. Un raisonnement solide, un large écosystème d'outils et une disponibilité publique complète en font un choix par défaut fiable en production, même si des modèles moins chers l'égalent désormais sur certaines tâches. Pour la plupart des équipes, il reste la référence à laquelle les nouveaux modèles sont comparés.

Entrée
$5 / 1M tokens
Sortie
$30 / 1M tokens
Contexte
1M+ tokens (922K in / 128K out)
GPT-5.5-Cyber logo

GPT-5.5-Cyber

OpenAI

Conditionnel

85,6 % CyberGym — meilleur score mono-modèle — mais accès restreint aux défenseurs habilités uniquement.

Entrée
N/A
Sortie
N/A
Contexte
Trusted Access for Cyber; not commercial API
GPT-5.6 Luna logo

GPT-5.6 Luna

OpenAI

pending

Le niveau budgétaire de la famille GPT-5.6 d'OpenAI — TerminalBench 2.1 à 82,5 % pour 1/6 $ par million de tokens, moins cher que Claude Haiku 4.5 et Gemini Flash en rapport capacité-prix. La réserve : Luna est limitée à ~20 partenaires de confiance, sans vérification indépendante ni date de disponibilité générale. Idéal pour les équipes construisant des architectures de routage de modèles qui peuvent escalader les échecs bon marché vers Terra ou Sol.

Entrée
$1 / 1M tokens
Sortie
$6 / 1M tokens
Contexte
Fastest and most cost-efficient GPT-5.6 tier.
GPT-5.6 Sol logo

GPT-5.6 Sol

OpenAI

Recommandé

GPT-5.6 Sol est le modèle frontière le plus rentable, en tête des benchmarks de codage et compétitif sur les raisonnements difficiles pour une fraction du coût de ses pairs. Verdict renforcé par la divulgation du durcissement de sécurité GPT-Red — le modèle a été entraîné de manière adversariale contre un modèle de red teaming dédié en self-play RL à l'échelle frontière, le rendant 6x plus robuste aux injections de prompt.

Entrée
$5 / 1M tokens
Sortie
$30 / 1M tokens
Contexte
Same rate card as GPT-5.5. Ultra mode costs more.
GPT-5.6 Terra logo

GPT-5.6 Terra

OpenAI

pending

Le cheval de bataille intermédiaire de la gamme GPT-5.6 — des capacités de classe GPT-5.5 à moitié prix (2,50/15 $ par million de tokens), avec TerminalBench 2.1 à 84,3 % à égalité avec Claude Fable 5. La réserve : toutes les affirmations proviennent du fournisseur, Terra est limitée à ~20 partenaires et aucune date de disponibilité générale n'est confirmée. Pour la plupart des charges de travail en production, Terra serait le choix pragmatique par défaut une fois disponible ; GPT-5.5 et Opus 4.8 sont les alternatives actuelles.

Entrée
$2.50 / 1M tokens
Sortie
$15 / 1M tokens
Contexte
Roughly 2x cheaper than GPT-5.5 for similar perf.
GPT-Live-1 logo

GPT-Live-1

OpenAI

Conditionnel

Le premier modèle vocal full-duplex d'OpenAI — écoute et parle simultanément, un saut au-delà du mode Advanced Voice séquentiel. Délègue le raisonnement complexe à GPT-5.5 en arrière-plan tout en maintenant le flux conversationnel. Verdict CONDITIONNEL : c'est la meilleure expérience vocale ChatGPT disponible, mais c'est un modèle intégré au produit, sans API et avec un support linguistique inégal.

Entrée
ChatGPT subscription
Sortie
ChatGPT subscription
Contexte
ChatGPT Voice only
GPT-Live-1 mini logo

GPT-Live-1 mini

OpenAI

Conditionnel

La variante gratuite de GPT-Live-1 — même architecture full-duplex dans un format plus petit et plus rapide, servant de modèle vocal par défaut pour les utilisateurs de ChatGPT Free. Partage les innovations fondamentales : interaction continue, support du mot d'activation et délégation à GPT-5.5. Mêmes limitations : pas d'API, qualité linguistique inégale. Une amélioration substantielle par rapport à l'ancien mode vocal séquentiel pour les utilisateurs gratuits.

Entrée
Free (ChatGPT)
Sortie
Free (ChatGPT)
Contexte
ChatGPT Voice only
Gemini 2.5 Pro logo

Gemini 2.5 Pro

Google

Recommandé

Désormais le choix économique pour le contexte long : une baisse de prix de 40 % (juin 2026) a rendu les traitements complets de corpus accessibles aux budgets moyens — la plus grande fenêtre de contexte disponible avec une intégration solide dans l'écosystème Google.

Entrée
$1.25 / 1M tokens
Sortie
$10 / 1M tokens
Contexte
1M tokens
Gemini 3.5 Flash logo

Gemini 3.5 Flash

Google

Recommandé

La référence de Google en efficacité-coût pour l'automatisation agentique du poste de travail, à $1.50/$9 par 1M tokens avec un contexte d'environ 1M. Le Computer Use natif obtient 78,4 sur OSWorld-Verified — à 0,3 point de GPT-5.5 pour environ un tiers du coût. LA réserve à connaître : l'outil Computer Use est en préversion publique, pas encore dans l'API de production ; vérifiez la disponibilité de l'endpoint avant de l'intégrer.

Entrée
$1.50 / 1M tokens
Sortie
$9 / 1M tokens
Contexte
1M tokens
Gemini 3.5 Pro logo

Gemini 3.5 Pro

Google

pending

Le modèle frontière pré-GA de Google — désormais à son quatrième report et « des mois de retard » selon Bloomberg. Le contexte de 2M tokens, le pipeline multimodal natif et le raisonnement Deep Think restent des capacités réelles, mais aucun calendrier de disponibilité générale confirmé n'existe. La capacité de codage est la lacune principale.

Entrée
Not yet published
Sortie
Not yet published
Contexte
Est. $5-15/$30-60 per 1M. 2M ctx. Not GA.
G

Grok 4.5

SpaceXAI

Conditionnel

Modèle de codage agentique à prix compétitif à 2 $ / 6 $ par million de tokens avec 500K de contexte — les benchmarks publiés par xAI le placent en milieu de peloton derrière Fable 5 et GPT-5.5, même s'il devance Opus 4.8 sur DeepSWE et Terminal-Bench 2.1. Ce qui compte vraiment, c'est le rapport coût-efficacité : 4,2x plus efficient en tokens qu'Opus 4.8 sur SWE-Bench Pro. Idéal pour les équipes qui ont besoin de codage performant à une fraction des tarifs de pointe. Pas encore disponible dans l'UE.

Entrée
$2 / 1M tokens
Sortie
$6 / 1M tokens
Contexte
500K tokens
H

Hy3

Tencent

Conditionnel

Modèle agentique MoE à poids ouverts sous licence Apache 2.0 (295B total, 21B actifs) avec une fiabilité solide en appel d'outils et un bon comportement anti-hallucination, mais le codage est en retrait par rapport à GLM-5.2 et l'auto-hébergement exige 8 GPU ou plus. Niveau gratuit sur OpenRouter jusqu'au 21 juillet — ensuite 0,20 $/0,80 $ par million de tokens. Idéal pour les agents de codage auto-hébergés et le travail documentaire longue durée où la licence permissive prime sur les scores absolus de benchmarks.

Entrée
$0.20 / 1M
Sortie
$0.80 / 1M
Contexte
256K tokens
I

Inkling

Thinking Machines Lab

Conditionnel

Inkling est la meilleure raison à ce jour de prendre au sérieux l'IA multimodale à poids ouverts. Il offre un raisonnement et un codage compétitifs avec une sécurité à poids ouverts de premier ordre et un effort de réflexion contrôlable, le tout sous licence Apache 2.0. Mais Thinking Machines est honnête : ce n'est pas le plus puissant globalement — la factualité est en retrait (SimpleQA 43,9 %) et l'auto-hébergement exige du matériel sérieux (2 To de VRAM). Conditionnel : une base convaincante pour les organisations qui ont besoin de posséder et de fine-tuner un modèle multimodal, pas pour les équipes qui cherchent des performances maximales prêtes à l'emploi.

Entrée
$1.87 / 1M tokens
Sortie
$4.68 / 1M tokens
Contexte
Up to 1M tokens native
K

Kimi K3

Moonshot AI

Conditionnel

Le flagship MoE de 2,8T de Moonshot AI — le plus grand modèle à poids ouverts jamais publié — mène le codage front-end sur Arena WebDev et rivalise avec Opus 4.8 sur les tâches de codage à horizon long. Des tarifs fixes de 3 $ / 15 $ par million de tokens le rendent accessible, mais il reste derrière Fable 5 et GPT 5.6 Sol sur les benchmarks d'exécution précise, et les poids restent hébergés uniquement jusqu'au 27 juillet. Idéal pour les équipes faisant du codage agentique à contexte long qui tolèrent la verbosité et n'ont pas besoin d'auto-hébergement immédiat.

Entrée
$3.00 / 1M
Sortie
$15.00 / 1M
Contexte
1M tokens, $0.30/1M cached
Llama 4 Maverick logo

Llama 4 Maverick

Meta

Conditionnel

Le modèle open source de référence pour les équipes qui ont besoin d'auto-hébergement, de souveraineté des données, ou qui cherchent à éviter l'enfermement propriétaire des API.

Entrée
Free (self-hosted) or $0.20 / 1M tokens (hosted)
Sortie
Free (self-hosted) or $0.60 / 1M tokens (hosted)
Contexte
10M tokens
MAI-Code-1-Flash logo

MAI-Code-1-Flash

Microsoft

Conditionnel

Le premier modèle de codage maison de Microsoft — un MoE sparse petit, rapide et agressivement optimisé en coût à $0,75/$4,50 par 1M tokens. Il offre une avance de 16 points sur Claude Haiku 4.5 sur SWE-Bench Pro tout en utilisant jusqu'à 60% de tokens en moins. Il est conçu spécifiquement pour les workflows Copilot à haut volume — auto-complétions, refactorisations, échafaudages — ce n'est pas un modèle frontière. Meilleur au sein de l'écosystème Copilot ; l'accès API en dehors est encore en déploiement.

Entrée
$0.75 / 1M tokens
Sortie
$4.50 / 1M tokens
Contexte
256K context
Muse Spark 1.1 logo

Muse Spark 1.1

Meta

Conditionnel

Le premier modèle d'IA payant de Meta et sa première offensive sur le marché du codage commercial — 1,25 $ / 4,25 $ par million de tokens avec 1M de contexte, orchestration native de sous-agents, support MCP / outils et capacité computer-use à environ 4x en dessous des tarifs Anthropic/OpenAI. En tête sur les benchmarks d'utilisation d'outils, mais en retrait de 7 points sur Opus 4.8 en codage pur sur SWE-Bench Pro. Poids fermés, aperçu public limité aux États-Unis. Idéal pour les équipes qui privilégient l'orchestration d'outils à bas coût.

Entrée
$1.25 / 1M tokens
Sortie
$4.25 / 1M tokens
Contexte
1M tokens
Mythos 5 (Claude Mythos 5) logo

Mythos 5 (Claude Mythos 5)

Anthropic

Conditionnel

Le modèle de cybersécurité le plus puissant au monde (83,8% CyberGym) — construit sur les poids de Fable 5 avec les classificateurs de sécurité retirés. L'accès a été suspendu après la directive d'exportation du 12 juin ; partiellement restauré le 26 juin pour ~100 organisations américaines désignées d'infrastructure critique (Project Glasswing). Le verdict reste CONDITIONNEL : la capacité est d'élite, mais l'accès est verrouillé par désignation fédérale. Pas une API publique — utilisable uniquement si votre organisation figure sur la liste du Département du Commerce.

Entrée
$10 / 1M tokens
Sortie
$50 / 1M tokens
Contexte
1M tokens (restricted access)
O

Ornith-1.0

DeepReinforce

Conditionnel

Une famille de modèles open source agentic coding sous licence MIT qui atteint des benchmarks compétitifs avec les modèles frontier — battant Claude Opus 4.7 à la fois sur Terminal-Bench 2.1 et SWE-Bench Verified — mais qui nécessite un autohébergement avec des ressources GPU significatives et provient d'un nouveau labo au track record limité.

Entrée
Free (MIT license)
Sortie
Free (MIT license)
Contexte
256K tokens
S

Sakana Fugu

Sakana AI

Conditionnel

Orchestrateur multi-agents qui égale les modèles de pointe sur les principaux benchmarks en routant à travers un pool d'agents experts — mais le routage opaque et la dépendance à la plateforme limitent la transparence.

Entrée
$5 / 1M tokens
Sortie
$30 / 1M tokens
Contexte
272K tokens (>272K: $10/$45 per 1M)