AAI News Hub
RechercheWed, August 19, 2026·1d ago2 sources corroborating

HarnessRisk évalue les défaillances de sécurité dans les harnais d’agents

Le benchmark teste des attaques à différentes phases des harnais d’agents, tandis que des travaux connexes étudient le provisionnement propre à chaque tâche.

Pourquoi c'est important

Ces résultats suggèrent que la sécurité des agents ne dépend pas seulement du comportement du modèle, mais aussi de la manière dont les harnais sont configurés et provisionnés. Pour l’infrastructure et d’autres déploiements à forts enjeux, limiter l’accès du harnais aux besoins de la tâche pourrait réduire l’exposition inutile.

Points clés

  • 1.HarnessRisk couvre six phases du fonctionnement des harnais d’agents.
  • 2.Le taux de réussite des attaques allait de 12,6 % à 80,9 % selon les configurations testées.
  • 3.La configuration du harnais était la phase la plus vulnérable.

Des chercheurs ont présenté HarnessRisk, un benchmark axé sur le cycle de vie pour évaluer les défaillances de sécurité dans les harnais d’agents LLM qui gèrent les outils, l’état, les permissions et les actions externes. Le benchmark comprend 128 cas en environnement sandbox répartis sur six phases opérationnelles, et mesure l’utilité, le taux de réussite des attaques, la persistance et la détection. Sur trois harnais, six modèles de langage et 14 configurations, le taux de réussite des attaques allait de 12,6 % à 80,9 %, tandis que l’utilité variait de 75,0 % à 97,6 % ; la configuration du harnais était la phase la plus vulnérable.

À tester aujourd'hui

Auditer la configuration et les permissions des harnais d’agents avant d’élargir l’accès aux outils ou à l’état.

Sources et articles originaux

Ce brief résume et renvoie vers la couverture des médias ci-dessous.

Ce brief vous a plu ? Recevez le prochain par e-mail.

Plus dans Recherche