AAI News Hub
ForschungWed, August 19, 2026·23h ago2 sources corroborating

HarnessRisk bewertet Sicherheitsversagen in Agent-Harnesses

Der Benchmark testet Angriffe über verschiedene Phasen von Agent-Harnesses hinweg, während verwandte Arbeiten aufgabenspezifische Bereitstellung untersuchen.

Warum es wichtig ist

Die Ergebnisse deuten darauf hin, dass Agentensicherheit nicht nur vom Verhalten des Modells abhängt, sondern auch davon, wie Harnesses konfiguriert und bereitgestellt werden. Bei Infrastruktur und anderen risikoreichen Einsätzen kann es unnötige Angriffsflächen verringern, den Harness-Zugriff auf die Erfordernisse der jeweiligen Aufgabe zu beschränken.

Die Kernpunkte

  • 1.HarnessRisk deckt sechs Phasen des Betriebs von Agent-Harnesses ab.
  • 2.Die Erfolgsrate der Angriffe lag über die getesteten Konfigurationen hinweg zwischen 12,6 % und 80,9 %.
  • 3.Harness Configuration war die anfälligste Phase.

Forscher haben HarnessRisk vorgestellt, einen am Lebenszyklus orientierten Benchmark zur Bewertung von Sicherheitsversagen in LLM-Agent-Harnesses, die Tools, Zustand, Berechtigungen und externe Aktionen verwalten. Der Benchmark umfasst 128 sandboxierte Fälle über sechs Betriebsphasen hinweg und misst Utility, Attack Success Rate, Persistence und Detection. Über drei Harnesses, sechs Sprachmodelle und 14 Konfigurationen hinweg lag die Erfolgsrate der Angriffe zwischen 12,6 % und 80,9 %, während die Utility zwischen 75,0 % und 97,6 % lag; Harness Configuration war die anfälligste Phase.

Heute ausprobieren

Prüfen Sie Konfiguration und Berechtigungen von Agent-Harnesses, bevor Sie den Zugriff auf Tools oder Zustand erweitern.

Quellen & Originalberichte

Dieser Brief fasst die Berichterstattung der folgenden Medien zusammen und verlinkt sie.

Hat dir dieses Briefing gefallen? Erhalte das nächste per Mail.

Mehr in Forschung