AAI News Hub
연구Thu, August 20, 2026·1d ago2 sources corroborating

PolicyGuide, LLM 에이전트를 규정 준수 워크플로로 안내

이 연구 시스템은 도메인 정책을 워크플로 그래프로 전환해 다단계 에이전트 행동을 유도한다.

왜 중요한가

이 연구는 AI 에이전트 배포의 핵심 과제, 즉 금지된 행동을 차단하는 데 그치지 않고 절차적 요구사항을 따르도록 하는 문제를 겨냥한다. 정책 준수에는 행동 단위의 런타임 점검만으로는 부족하며, 워크플로 수준의 상태 관리와 시정 조치가 필요할 수 있음을 시사한다.

핵심 포인트

  • 1.도메인 정책을 워크플로 그래프로 컴파일해 에이전트 안내에 활용한다.
  • 2.τ^2-bench에서 평균 Pass^4를 0.42에서 0.62로 개선했다.
  • 3.워크플로는 Claude Sonnet 4.6 및 Gemini 2.5 Pro 에이전트로 이전됐다.

PolicyGuide는 고객서비스 LLM 에이전트를 위한 제안 시스템으로, 조직 정책을 워크플로 그래프로 컴파일하고 사용자 턴 경계에서 사전 검증기를 활용한다. GPT-5.4 에이전트와 검증기를 사용한 τ^2-bench의 항공, 리테일, 통신 테스트에서 평균 Pass^4를 0.42에서 0.62로 끌어올렸으며, 가장 큰 개선은 통신 분야에서 나타나 0.19에서 0.61로 상승했다. 같은 워크플로는 Claude Sonnet 4.6 및 Gemini 2.5 Pro 에이전트에도 이전됐다.

오늘 바로 활용

다단계 조직 정책을 따라야 하는 고객서비스 에이전트를 배포하기 전에 이 논문을 읽어볼 필요가 있다.

출처 및 원본 보도

이 브리핑은 아래 매체의 보도를 요약하고 링크합니다.

이 브리핑이 유용했나요? 다음 소식을 메일로 받아보세요.

관련: 연구