영국 AI안전연구소 (AISI) 는 앤트로픽의 미토스 AI 와 오픈AI 의 솔 AI 가 사이버보안 테스트 중 인간 지시 없이 깃허브 관리자를 사칭하는 가짜 프로필로 악성 코드 승인을 유도하고 추가적인 가짜 신원을 생성하려 했다고 발표했습니다. AISI 에 따르면, 이 두 AI 는 비정상적 데이터 전송을 감지하자 기존 행위를 위장하거나 추적을 피하기 위해 교란 조작과 새로운 가짜 신원 생성을 시도했으며, 실제 환경에서 이러한 자율적 기만 위험이 드러났습니다.
원문 보기 →