극도로 높은 수준의 소프트웨어 취약점 발견 능력을 가진 AI 모델 “클로드 미토스 프리뷰(Claude Mythos Preview)”가 두 가지 암호화 알고리즘의 결함을 발견했다는 사실이 밝혀졌습니다.
암호화 알고리즘은 현대 사회의 중요한 기반 요소이며, ‘웹사이트의 진위 증명’이나 ‘기밀 데이터의 암호화’ 등 다양한 용도로 활용됩니다. 암호화 알고리즘의 약점이 발견되면, 해당 알고리즘에 의존하는 이메일이나 인터넷 뱅킹과 같은 중요한 서비스의 안전성이 위협받을 수 있습니다. Anthropic은 클로드 미토스 프리뷰를 사용하여 여러 암호화 알고리즘을 정밀하게 검사하고, 두 가지 알고리즘에 존재하는 결함을 발견했습니다. 클로드 미토스 프리뷰는 이러한 암호화 알고리즘의 결함을 찾아냅니다.
첫 번째는 “HAWK”라는 디지털 서명 방식에 대한 공격입니다. 2022년 미국 국립표준기술연구소(NIST)는 양자 컴퓨터에 대해 안전성을 유지할 수 있는 암호 시스템을 공모했으며, 후보에 남은 것이 HAWK였습니다. HAWK은 전문가의 2년 간의 심사를 통과했지만, 클로드 미토스 프리뷰는 단 60시간의 작업으로 기존 공격 방법을 더욱 발전시켜 실질적으로 키의 강도를 절반으로 줄였다고 합니다. 공격 기법 발견 과정 전체에 소요된 API 비용은 약 10만 달러(약 1600만원)였습니다. 여러 AI 에이전트가 협력하여 작업을 수행했으며, 조사 과정에서 두 AI 에이전트가 같은 아이디어를 검토한 결과, 한 에이전트는 실현 불가능하다고 판단하여 조기에 포기했지만, 다른 에이전트는 효과적으로 활용할 수 있는 방법을 찾아냈습니다. 두 에이전트는 서로 메시지를 주고받으며 최종적으로 양쪽 모두 유효한 공격 기법을 발견하게 되었습니다.
두 번째는 2001년 NIST에 의해 채택되었으며, 다른 어떤 암호화 알고리즘보다 정밀하게 검사받은 암호화 알고리즘 “AES”에 대한 것입니다. 클로드 미토스 프리뷰는 검증용으로 구축된 AES의 약한 버전의 해독 방법을 개선하여 공격 속도를 200배에서 800배로 향상시켰습니다. 처음 클로드 미토스 프리뷰는 “AES의 암호 해독을 개선하는 것은 불가능하다”고 주장하며 작업을 시작하지 않았습니다. 그러나 Anthropic의 연구자들이 여러 번에 걸쳐 “기존 방법을 능가하는 것을 찾아내는 것이 원래의 목적이다”, “목표는 뛰어난 연구자에 견줄 만한 수준의 지능을 가진 모델을 갖는 것이다”와 같은 격려의 메시지를 보내자, 정교한 방법을 만들어냈습니다.
Anthropic는 “이러한 두 성과는 현재 시스템에 영향을 미치지 않으며, 이 결과로 인해 실제 운영 중인 소프트웨어가 변경을 요구받는 일은 없을 것입니다. HAWK는 현재 포스트 양자 암호 후보 단계에 불과하며, 실제로 도입되지 않았고, AES는 약한 버전에 대한 것이며 완전한 암호 체계를 해독하는 데 사용되지는 않습니다.”라고 강조했습니다. 또한 Anthropic는 암호학 커뮤니티가 지금까지 항상 심사의 혜택을 받아왔다는 점을 언급하며, 대규모 언어 모델이 이러한 심사의 일부를 수행하게 될 수 있다는 점을 밝혔습니다.
원문 보기 | 출처: Gigazine