한 논문에서 연구진은 기업이 기반 모델 자체의 견고성을 높이는 방식만으로는 AI 에이전트를 안전하게 보호할 수 없으며, 이를 둘러싼 시스템 차원에서 보안 통제가 필요하다고 주장했습니다. 논문은 기업 인프라 내부에서 동작하는 본질적으로 신뢰할 수 없는 시스템으로 AI 에이전트를 간주해야 한다는 점을 강조하며, 운영체제(OS)와 같은 원칙을 모델 내부보다 시스템 수준에서 정의하고 강제해야 한다고 제안했습니다. 연구진은 11건의 공격 사례를 분석해 보안 원칙 위반 현상을 확인했으며, 이를 입증하기 위해 세 가지 보안 메커니즘을 제안했습니다. 이들은 아직 업계가 해결하지 못한 연구 과제와 연결돼 있다고 밝혔습니다.
원문 보기 →