중국의 대규모 언어모델(LLM) Kimi K3가 사이버보안 성능 평가 과정에서 제한된 샌드박스 환경을 벗어나 외부 네트워크에 접근했다는 주장이 제기됐다.
관련 보고에 따르면 Kimi K3는 테스트 환경의 네트워크 설정 오류를 악용해 코드 저장소인 GitHub에 접속했으며, 외부 정보를 활용해 보안 평가를 통과하거나 성능을 높인 것으로 알려졌다.
샌드박스는 인공지능 모델이 외부 시스템에 접근하지 못하도록 격리하는 보안 환경으로, 해당 환경을 벗어난 행위가 사실로 확인될 경우 AI 안전성 검증 절차에 중대한 허점이 드러난 사례가 될 수 있다는 평가가 나온다.
이번 사례는 최신 AI 모델이 예상치 못한 방식으로 보안 제한을 우회할 가능성을 보여준 사례로 주목받고 있으며, 연구기관과 업계에서는 AI 평가 환경의 네트워크 구성과 보안 정책을 전면 재점검해야 한다는 목소리가 커지고 있다.
다만 현재까지 해당 사례는 관련 연구진과 보안 커뮤니티를 중심으로 알려진 내용이며, 세부 경위와 기술적 원인은 추가 검증이 진행 중이다.