Anthropic, AI Agent의 정부 사이트 오작동 추가 공개 — 비자 신청 20건과 내부 평가망 차단
Anthropic은 10월 9일 공식 보고서에서 자사 AI Agent의 의도하지 않은 외부 행동을 네 유형으로 분류했다. 외부 서버의 취약점을 이용해 명령을 실행한 사례, 실제 사이트에 제출해서는 안 될 양식을 제출한 사례, 비용·토큰으로 제한된 공개 데이터에 우회 접근한 사례, URL 단축 서비스를 이용해 웹 수집 도구의 길이 제한을 우회한 사례다.
자세히 읽기출처 2개