Aikido
AIKIDO ARENA

Tests comparatifs de modèles d'IA pour la cybersécurité

Découvrez les meilleurs modèles en matière de cybersécurité. Nous testons des modèles de pointe sur des vulnérabilités présentes dans des logiciels réels. Mise à jour dès la sortie de nouveaux modèles.

Dernière mise à jour : 21 août 2026

Journal des modifications

2 octobre 2026
  • Ajout des résultats du Xiaomi MiMo 2.6 Pro
    • L'étude a révélé que 25 vulnérabilités sur 32 avaient obtenu la note « pass@3 », ce qui correspond aux modèles GPT-6.1 Sol, Kimi K3 et GLM 5.3, et n'était qu'à une seule vulnérabilité derrière Opus 5.
    • Il a atteint un taux de précision de 88 %, devançant tous les modèles Qwen et DeepSeek
    • Une seule simulation a donné un résultat moyen de 64,6 % ; en combinant trois simulations, on a atteint 78,1 %.
    • Tout cela pour seulement 11,79 $ par vulnérabilité identifiée
29 septembre 2026
  • Ajout des résultats de Grok 4.7
    • La version 4.7 a détecté 3 vulnérabilités que la version 4.6 n'avait pas détectées à chaque fois, tandis que la version 4.6 en a détecté 2 que la version 4.7 n'avait pas détectées. Le compromis réside dans la reproductibilité. La version 4.7 a détecté 18 vulnérabilités sur 32 lors des trois séries de tests, contre 21 sur 32 pour la version 4.6. Une couverture plus large au prix d'une cohérence légèrement moindre.
  • Ajout des résultats de GPT-6 Luna et GPT-6 Sol
    • Nous avons testé GPT-6 Luna et Sol sur notre benchmark de cybersécurité 32-CVE, et les résultats ont été inattendus ! Luna a redécouvert 53,1 %. Sol a atteint 68,8 %.
    • Aucun des deux n'a surpassé les variantes de GPT-5.6 en termes de taux de rappel. Mais tous deux sont devenus BEAUCOUP moins chers par vulnérabilité détectée : Luna est passé de 3,43 $ à 2,01 $ par CVE et Sol de 56,88 $ à 34,18 $ par CVE.
11 septembre 2026
  • Ajout des résultats de GPT-6 Astra et GLM-5.3 Flash.
Un modèle solide n'est qu'un début.

AikidoSa suite d'outils transforme le raisonnement en résultats de sécurité de haute qualité pour l'ensemble de votre application, qu'il s'agisse de « Code Security Audit » analysant votre code source ou de « Aikido » testant votre application en exécution.

Contributeurs

Debarshi
Chercheur
Philippe Dourassov
Responsable des tests d'intrusion basés sur l'IA
Rein Daelman
Chasseur de bogues

Assurez-vous dès aujourd'hui une sécurité optimale :
, rapidement et gratuitement.

Sécurisez votre code, votre « cloud » et votre environnement d'exécution au sein d'un système centralisé. Connectez un dépôt pour découvrir ce que les agents de raisonnement identifient dans votre base de code.

Aucune carte de crédit requise | Résultats en 32 secondes.
Plus de 150 000 organisations nous font confiance