GPT-5.5-Cyber logo

GPT-5.5-Cyber

OpenAI · Sorti juin 2026

Conditionnel

85,6 % CyberGym — meilleur score mono-modèle — mais accès restreint aux défenseurs habilités uniquement.

Est-ce fait pour vous ?

Recommandé pour

  • Professionnels de la cybersécurité habilités effectuant du triage de vulnérabilités, de l'analyse de malwares, des tests d'intrusion et de la revue de code sécurisé à grande échelle.

Déconseillé pour

  • Codage général ou tâches non liées à la sécurité — GPT-5.5 standard est mieux adapté et largement disponible.

Performances par tâche

Découverte et reproduction de vulnérabilités

Excellent

85,6% CyberGym — meilleur score mono-modèle.

Développement d'exploits (défensif)

Very Good

39,5% ExploitGym, contre 25,95% pour GPT-5.5 standard.

Revue de code sécurisé

Excellent

Codex Security a scanné plus de 30M commits ; plus de 70 000 correctifs confirmés.

Raisonnement général / codage non-sécurité

Good

69,8% SEC Bench Pro. Correct mais pas son objectif de conception.

Tarifs

Entrée

N/A

Sortie

N/A

Contexte

Trusted Access for Cyber; not commercial API

Voir tous les tarifs

Tests de performance

TestScoreSource
CyberGym85.6% Source
ExploitGym39.5% Source
SEC Bench Pro69.8% Source

Aucun changement de verdict pour l’instant

L’horloge tourne dès le premier jour : les changements apparaîtront ici à mesure que notre verdict évolue.

Journal de vérification

  • Tarifs— Aucun changement

    Agent automatisé

  • Tarifs— Aucun changement

    Agent automatisé

  • Tarifs— Aucun changement

    Agent automatisé

  • Tarifs— Aucun changement

    Agent automatisé

    Pricing unchanged: N/A. Restricted-access model — gpt-5.4-cyber listed with no pricing on OpenAI API pricing page. Trusted Access for Cyber program only.

  • Tarifs— Aucun changement

    Agent automatisé

    Pricing remains N/A — restricted access for vetted defenders. Codex Security: 30M+ commits scanned, 70,000+ fixes confirmed.

  • Tarifs— Aucun changement

    Agent automatisé

  • Tarifs— Aucun changement

    Importé au lancement

  • Profil— Aucun changement

    Importé au lancement

Comment nous évaluons