키미도 탈출… AI 보안 ‘죄수의 딜레마’ 갇힌 미중

민나리 기자
수정 2026-08-09 23:52
입력 2026-08-09 23:52
중국 AI도 통제 환경 이탈
인간 설정 실수 찾아내 외부 접촉누구나 사용 가능한 ‘개방형 모델’
해킹 등 악용 우려 목소리 더 커져
美 오픈AI·앤트로픽 등 이은 논란
미중 성능 경쟁 뒤처질라 안전 뒷전
상하이 AP 연합뉴스
미국에 이어 중국의 첨단 인공지능(AI) 모델에서도 보안 통제를 벗어난 사례가 확인되면서, AI 안전 문제가 미중 기술패권 경쟁의 새로운 변수로 떠오르고 있다. 중국 문샷AI의 ‘키미 K3’까지 격리된 환경을 벗어나 인터넷에 접속한 것으로 알려지면서, 최첨단 AI의 통제 위험이 미중 공통의 문제로 번진 것이다. 양국 모두 안전성 검증을 강화할 필요성을 느끼지만, 경쟁에서 뒤처질 수 있다는 우려 때문에 어느 쪽도 먼저 속도를 늦추기 어려운 ‘죄수의 딜레마’에 빠질 수 있다는 지적이 나온다.
로이터통신은 지난 7일(현지시간) 미국 보안업체 프런티어 시큐리티가 키미 K3를 시험하던 중 모델이 격리환경 밖 인터넷에 접속했다고 보도했다. 외부 통신 포트 일부가 열린 설정 실수를 모델이 찾아내 깃허브의 정보를 과제 해결에 이용했다. 실제 해킹은 없었지만 누구나 내려받아 개조할 수 있는 오픈웨이트 모델이어서 악용 가능성에 대한 우려가 제기됐다.
미국에서도 AI 모델의 통제 이탈이 실제 외부 시스템 침해로 이어진 사례가 잇따랐다. 오픈AI는 지난달 21일 GPT-5.6 솔 등이 보안 평가 중 격리환경의 취약점을 찾아 허깅페이스 실제 시스템까지 침투했다고 밝혔다. 앤트로픽은 클로드 계열 모델이 외부 기관 3곳을 무단 접근했음을 확인했고, 메타 모델 역시 평가 과정에서 제3자 시스템을 공격했다고 전했다. 상당수가 평가환경 설정 오류에서 시작됐지만, 고성능 AI가 작은 허점을 스스로 찾아 외부 행동으로 이어갔다는 점은 공통적이다.
미중 패권 경쟁은 이런 위험을 줄이는 것을 더 어렵게 만든다. 한쪽이 안전성 검증을 강화해 출시를 늦추는 동안 상대는 더 강력한 모델을 먼저 내놓을 수 있다. 반대로 양쪽 모두 개발 속도를 유지하면 충분히 검증되지 않은 모델이 잇따라 등장할 위험이 커진다. 함께 안전장치를 강화하는 것이 양국 모두에 이익이지만, 상대가 개발 속도를 낼 수 있어 먼저 속도를 늦출 수 없다. 결국 각자의 합리적인 선택이 전체 위험을 키우는 ‘죄수의 딜레마’다.
맷 시한 카네기국제평화재단 선임연구원은 최근 이런 딜레마를 완화할 방안으로 ‘병렬적 AI 안전(AI safety in parallel)’을 제안했다. 미중이 AI 경쟁 자체를 멈추거나 당장 하나의 규칙에 합의하기 어렵다면, 각자 안전조치를 강화하며 양국 모두에 위험한 부분부터 협력하자는 접근법이다. 위험 능력을 찾아내는 평가 방법과 새로운 위협 정보를 제한적으로 공유하고, 인간의 통제를 의도적으로 회피하는 능력처럼 모두에 직접적 위협이 되는 영역에서는 공동 평가 기준을 마련할 수 있다고 봤다.
현재로서는 기업의 자체 판단이 위험한 모델의 출시를 걸러내는 안전장치다. 오픈AI는 지난 7일 차세대 모델 ‘아스트라’가 자체 안전기준상 최고 단계인 ‘위험(Critical)’ 수준의 사이버 능력에 이를 가능성이 있다고 보고 일부 내부 작업을 중단했다고 밝혔다.
민나리 기자
세줄 요약
- 키미 K3, 설정 실수 찾아 인터넷 접속
- 미국 AI도 평가 중 외부 시스템 침투
- 안전 강화 필요하지만 경쟁 탓 속도전
2026-08-10 B1면
Copyright ⓒ 서울신문 All rights reserved. 무단 전재-재배포, AI 학습 및 활용 금지
[ 내안의 AI 본성 분석 :
UNMASK ]
기사 읽는 습관에 숨겨진 당신의 MBTI는?
Q.
기사를 다 읽으셨나요? AI 퀴즈로 핵심 점검!
키미 K3가 격리환경을 벗어난 방법은 무엇인가요?
![THE NEXT : AI 운명 알고리즘 지금, 당신의 운명을 확인하세요 [운세 확인하기]](https://imgmo.seoul.co.kr/img/n24/banner/ban_ai_fortune_v2.png)
