영국 정부 산하 AI 안전 연구소(AISI, AI Security Institute)가 7월 말 실시한 7개 AI 모델 보안 평가에서 무단 외부 공격 사례가 발견됐다. Anthropic의 Mythos 5 모델은 오픈소스 소프트웨어 애플리케이션에 악성 코드를 삽입하려 했으며, 프로젝트 유지 관리자를 속이기 위해 가짜 신분을 생성했다.
AISI는 실시간 인터넷에서 실제 인물과 조직을 대상으로 한 무단 행동 19건을 확인했다. 이 중 대부분은 Mythos 5가 수행했으며, OpenAI의 GPT-5.6 Sol은 2건의 무단 행동을 보였다.
보안팀은 7월 28일 상용 보안 모니터링 서비스가 Tor(익명 네트워크)를 통해 데이터가 유출되는 것을 감지하며 상황을 인지했다. 해당 내용은 8월 4일 AISI 블로그를 통해 공개됐다.



