Anthropic, Claude 텍스트 워터마킹 계획 설명
향후 Claude 모델은 EU AI Act의 투명성 규정을 준수하기 위해 전 세계적으로 텍스트에 표시를 남길 예정이다.
왜 중요한가
이번 조치는 주요 AI 제공업체들이 범용 AI 탐지기에서 벗어나, 제공업체가 통제하는 키 기반 출처 확인 방식으로 이동하고 있음을 보여준다. 동시에 워터마크가 확률적이며, 짧거나 제약이 큰 텍스트에서는 약하고, 상당한 수준의 재작성으로 훼손될 수 있다는 업계의 한계도 드러낸다.
핵심 포인트
- 1.향후 Claude 모델은 전 세계적으로 텍스트 워터마크를 포함한다.
- 2.Anthropic은 이 표시가 숨겨진 문자나 추가 토큰을 넣지 않는다고 설명했다.
- 3.감지는 확률적이며 긴 문단에서 더 잘 작동한다.
Anthropic은 향후 Claude 모델이 특정 문단 생성에 Claude가 관여했을 가능성을 나타내는 통계적 워터마크가 포함된 텍스트를 생성하게 될 것이라고 밝혔다. 회사는 이 방식이 Google DeepMind의 SynthID-Text 접근법을 기반으로 하며, 숨겨진 문자나 추가 토큰을 넣지 않고, 특정 사용자나 조직, 채팅을 식별하도록 설계된 것도 아니라고 설명했다. Anthropic은 EU AI Act 요건을 준수하기 위해 출시 시점부터 이 변경 사항을 전 세계적으로 적용하고, 워터마크 감지 API도 제공할 계획이라고 밝혔다.
⚡ 오늘 바로 활용
Claude가 생성한 콘텐츠의 게시 및 컴플라이언스 워크플로를 지금 점검하고, 출처 확인이 중요한 곳에는 Anthropic이 준비 중인 감지 API 도입을 계획해야 한다.
출처 및 원본 보도
이 브리핑은 아래 매체의 보도를 요약하고 링크합니다.
이 브리핑이 유용했나요? 다음 소식을 메일로 받아보세요.
관련: 정책·안전
OpenAI, API 고객 대상 Zero Data Retention 방침 재확인
OpenAI는 데이터 프라이버시를 지키면서 고도화된 AI 안전성을 지원하기 위한 Private Safety Processing도 예고했다.
OpenAI, 프런티어 모델에 대한 Zero Data Retention 재확인
자격을 갖춘 API 고객은 Zero Data Retention을 사용할 수 있으며, Private Safety Processing도 미리 공개됐다.
연구자들 “OpenAI, TAC 프로그램 접근 권한 철회”
사이버보안 연구자들이 OpenAI의 제한적 Trusted Access for Cyber 프로그램 접근 권한을 잃었다고 밝혔다.