인공지능(AI) 경쟁의 초점이 모델 성능에서 서비스의 신뢰성과 안전성 검증으로 이동함에 따라, 한국에서도 국가 차원의 AI 안전평가 체계가 구축되고 있다. 인공지능안전연구소와 민간 기업 셀렉트스타는 국내외 주요 AI 모델을 대상으로 사이버보안, 국가안보, 개인정보 유출 등 다양한 잠재적 위험을 평가하는 '스트레스 테스트'를 진행하고 있다. 특히 단순한 질의응답을 넘어 AI 에이전트가 외부 도구를 활용해 과업을 수행하는 과정과 실제 행동까지 추적하며 안전장치의 작동 여부를 체계적으로 검증한다.
원문 보기 →