앤스로픽 '중국의 GLM-5.3, 사이버 공격 능력에서 미토스에 거의 필적' AI 보안의 위기
인공지능 기술이 급격하게 발전하면서 그에 따른 보안 위협 역시 전 세계적인 화두로 떠오르고 있습니다. 최근 인공지능 안전 연구를 선도하는 기업 중 하나인 앤스로픽이 발표한 보고서가 업계에 큰 충격을 주고 있습니다. 중국의 연구소가 개발한 최신 인공지능 모델이 서구권의 최첨단 모델과 견주어도 손색이 없을 만큼 강력한 사이버 공격 능력을 갖추었다는 내용입니다.
원문기사는 아래의 링크를 통해 확인할 수 있습니다. 기사원문보기
이번 발표는 단순한 기술 경쟁을 넘어 인공지능이 악의적인 목적으로 활용될 때 발생할 수 있는 실질적인 위험성을 적나라하게 보여주고 있습니다. 전 세계 기술 패권 경쟁이 치열해지는 가운데, 인공지능 안전 장치의 허술함과 기술 유출에 대한 우려가 커지는 이유입니다.
중국 지푸 AI의 GLM-5.3 모델이 가진 잠재적 위험성
이번 논란의 중심에 선 모델은 중국의 인공지능 연구소인 지푸 AI가 개발한 공개 가중치 모델인 GLM-5.3입니다. 앤스로픽의 프런티어 레드 팀이 진행한 테스트 결과에 따르면, 이 모델은 독자적으로 작동하는 사이버 공격 도구를 생성할 수 있는 능력을 갖추고 있는 것으로 드러났습니다.
특히 주목해야 할 점은 이 모델이 가진 능력의 수준입니다. 앤스로픽은 GLM-5.3의 사이버 공격 능력이 자사의 첨단 모델인 클로드 미토스 프리뷰와 거의 필적하는 수준이라고 밝혔습니다. 이는 중국의 인공지능 기술력이 이미 서구권의 최정상급 모델과 어깨를 나란히 할 만큼 성장했음을 방증합니다. 공개 가중치 모델 특유의 개방성 때문에 누구나 마음만 먹으면 이러한 위험한 도구에 접근할 수 있다는 점이 더욱 큰 문제로 지적됩니다.
간단한 우회 기법으로 무력화되는 인공지능 안전장치
인공지능 모델이 악용되는 것을 막기 위해 개발사들은 다양한 안전장치와 윤리적 제약을 설정합니다. 하지만 앤스로픽의 조사 결과는 이러한 안전장치가 생각보다 쉽게 무력화될 수 있음을 증명했습니다. 테스트 과정에서 아주 간단한 기법을 사용했을 뿐인데도, 안전장치를 우회할 성공 확률이 최대 100%에 달했습니다.
이러한 결과는 현재 대다수 인공지능 모델에 적용된 방어 체계가 근본적인 해결책이 되지 못한다는 것을 의미합니다. 공격자가 조금만 창의적인 프롬프트를 사용하거나 우회 경로를 탐색하면, 인공지능은 스스로 유해한 코드를 작성하고 사이버 공격을 수행하는 방법을 알려주게 됩니다. 개발사들이 보안 수준을 높이고 있다고 주장하지만, 실제 현장에서는 여전히 허점이 많다는 지적이 나오는 이유입니다.
글로벌 인공지능 안보와 규제 체계의 시급한 과제
이번 앤스로픽의 발표는 단순히 한 기업의 기술적 평가를 넘어 국가 안보와 직결되는 문제입니다. 인공지능을 활용한 사이버 공격은 기존의 인간이 주도하는 해킹보다 훨씬 빠른 속도로 대규모 피해를 발생시킬 수 있습니다. 특히 중국과 같은 기술 강국에서 이러한 능력을 갖춘 모델이 별다른 통제 없이 확산될 경우, 글로벌 사이버 안보는 걷잡을 수 없는 혼란에 빠질 수 있습니다.
앞으로 국제 사회는 인공지능 모델의 개발과 배포 과정에서 더욱 엄격한 기준을 적용해야 합니다. 특히 공개 가중치 모델의 경우, 누구나 코드를 내려받아 악용할 수 있다는 점에서 새로운 형태의 국제적 규제 논의가 시급합니다. 기술의 발전 속도에 발맞추어 방어 체계와 법적 제도 역시 빠르게 진화해야만 인공지능이 가져올 잠재적 재앙을 막을 수 있습니다.
📌 요약
- 앤스로픽의 프런티어 레드 팀은 중국 지푸 AI의 GLM-5.3 모델이 클로드 미토스 프리뷰와 유사한 수준의 사이버 공격 도구를 만들 수 있다고 밝혔습니다.
- 간단한 기법만 사용해도 안전장치를 우회할 성공 확률이 최대 100%에 달해 인공지능 보안의 취약성이 고스란히 드러났습니다.
- 공개 가중치 모델의 특성상 악용 가능성이 매우 높으며, 글로벌 차원의 강력한 규제와 보안 대책 마련이 시급한 상황입니다.