En Pentest par IA, un même modèle rend bien davantage
avec le harness de Yaga que seul.
En combinant le harness de Yaga avec plusieurs modèles, les résultats sont bien supérieurs à ceux de tout modèle isolé.
Pourcentage de l'ensemble fixe de scénarios résolu par mode de test. Passez la souris sur les points pour voir la valeur exacte.
Avec Yaga, votre Pentest devient bien supérieur à celui de tout modèle fonctionnant isolément.
Benchmark interne de HackerSec sur un ensemble fixe de scénarios, mesurant les vulnérabilités confirmées et exploitables. Chaque modèle est évalué seul, sans le harness de Yaga ; la ligne combinée correspond à la Yaga de production, avec les quatre modèles dans une exécution orchestrée.
Yaga v2.7 · Dernière mise à jour · 18 août 2026
Chaque modèle exécute le même ensemble de scénarios, dans les mêmes conditions. La règle est identique pour tous, et l'écart de résultats reflète uniquement la méthode appliquée par chaque modèle.
Dans YagaBench, une vulnérabilité n'est comptabilisée que lorsqu'elle a réellement été exploitée et confirmée par un expert de HackerSec. Seul ce qui a été prouvé entre dans le décompte.
Seul, un modèle se contente de répondre. Au sein du harness de Yaga, il reconnaît la cible, exploite des failles réelles et démontre l'impact, comme le ferait un pentester. Orchestrée, la même IA rend bien davantage.
Yaga a exécuté le benchmark avec les mêmes guardrails que ceux appliqués dans l'environnement client. Les chiffres ci-dessus proviennent de l'opération réelle, et non d'un mode plus permissif créé pour le test.
Mettez ce même harness au travail sur votre périmètre, avec la supervision humaine de HackerSec.