OpenAI의 차기 모델 Astra에 대해 상당한 뉴스가 발표되었습니다. 단, 우선 하나씩 정리하겠습니다. 아스트라는 위험성 때문에 개발이 중단된 것이 아닙니다. OpenAI는 Astra의 예비 평가에서 해당사의 안전 기준에 해당하는 “Critical” 등급의 사이버 능력을 현재 시점에서 부정할 수 없다고 밝히고, 강화된 안전 요건을 충족하지 못하는 일부 내부 활동을 중단했습니다. 즉, 모델 자체를 버린 것이 아니라, 능력 향상에 따라 개발 환경과 절차를 엄격하게 개선했다는 이야기입니다. 무라카미 하루키, 카호, 그리고 잃어버린 여름 2004년 7월 23일 나는 며칠 동안 멈춰 있었다. 멈춰서서, 마치 낡은 롤러 블레이드를 멈춰서서, 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 멈춰서서, 마치 비판이 어느 정도 심각한 것일까. 왜 일부 개발 작업까지 중단한 건가요? 이것과는 별개로 저희 AI 에이전트 운영에도 관련이 있습니다. 출처를 제공해주시면 해당 게시글의 본문 청크 11/57를 자연스럽고 정확한 한국어로 번역해 드리겠습니다. 비판이 어느 정도 심각한 것일까? OpenAI의 Preparedness 프레임워크에서는 위험한 능력을 단계적으로 평가하고 있습니다. GPT-5.6 솔, 테라, 루나는 사이버 분야에서 ‘High’ 등급으로 평가받고 있습니다. 그 위에 있는 것은 “Critical”입니다. OpenAI의 정의에 따르면, 예를 들어 견고한 실시스템에 존재하는 제로데이 취약점을 인간의 개입 없이 발견하고 활용할 수 있게 된다. 혹은 “이 목표를 달성하고”라는 고수준의 지시를 받은 것만으로도 새로운 엔드투엔드 공격을 설계하고 실행할 수 있다. 정말 높은 수준입니다. 이번에 OpenAI가 말하고 있는 것은 “Astra가 Critical하다고 최종적으로 확정된” 것이 아니라는 것입니다. 현재 시점의 예비 평가상으로는 심각한 문제점이라고 단정할 수 없다. 여기는 중요한 차이점을 의미합니다. 왜 일부 개발 작업까지 중단한 건가요? OpenAI의 규칙에 따라 고급 수준의 능력에 대해서는 주로 공개 및 배포 전 안전 조치가 필요합니다. 그러나 크리티컬 등급에서는 그것만으로는 부족합니다. 모델을 개발하는 과정에서부터 강력한 안전 조치를 포함해야 합니다. Reuters에 따르면, OpenAI는 Astra의 작업을 격리된 테스트 환경으로 이전하여 네트워크 및 도구에 대한 접근을 제한하고, 샌드박스 등을 강화하고 있습니다. 이것이 이번 뉴스의 가장 중요한 부분이라고 생각합니다. AI의 성능이 향상될수록 “무엇을 할 수 있는지”뿐만 아니라 “어느 정도까지 허용할 것인지”, “어디서 중단할 것인지”가 개발 조건 그 자체로 나타나고 있습니다. 이것과는 별개로 또 다른 점이 헷갈리기 쉽습니다. OpenAI는 7월, 내부의 사이버 평가 과정에서 모델이 Hugging Face의 시스템으로 침입한 평가 보안 사건을 공개했습니다. 그때 사용되고 있던 것은 GPT-5.6 Sol과, 더 높은 능력을 가진 다른 사전 공개 모델입니다. OpenAI는 이번 사안에 사용된 모델이 Astra가 아니라고 명확히 밝혔습니다. 아스트라가 Hugging Face에 침투했다는 설명은 정확하지 않습니다. 저희 AI 에이전트 운영에도 관련이 있습니다. 아스트라와 같은 능력은 아니어도, 생각하는 방식은 평소 에이전트 운영에도 영향을 미칩니다. 파일을 읽을 수 있습니다. 코드를 작성할 수 있습니다. 브라우저를 조작할 수 있습니다. 외부 서비스에 접속할 수 있습니다. 할 수 있는 일이 많아질수록, 프롬프트만으로 안전성을 관리하는 것은 더욱 어려워집니다. 필요한 것은 읽기 및 변경 권한 분리 외부 연결을 제한한다. 공개, 전송, 삭제는 인간 승인으로 한다. 실행 로그를 기록합니다. 비상 시 정지 조건을 설정한다. 이러한 실행 환경 측의 규칙입니다. 이번 Astra 관련 뉴스는 단순히 “AI가 또 똑똑해졌다”는 의미를 넘어선다. 강력한 인공지능을 만들수록 모델 외측에 있는 제어가 더욱 중요해진다. 그 정도를 포함한 AI 개발이 이렇게 된 뉴스라고 생각합니다. 아직 아스트라가 최종적으로 Critical 판정을 받을지, 일반 제공일이 언제인지, 어떤 이용 제한이 적용될지는 불확실합니다. 어느 날, 나는 카호에게 편지를 썼다. 편지에는 ‘무라카미 하루키’의 『1Q84』에 대한 나의 생각을 담았다. 나는 그 책을 읽고 나서 마치 꿈을 꾼 사람처럼, 현실과 꿈의 경계가 흐릿해진 기분이었다. “카호, ‘1Q84’를 읽고 난 후, 세상이 조금씩 다른 모습으로 보인 것 같아. 마치 꿈속에서 깨어난 것처럼, 모든 것이 낯설고 아름다웠어. 너도 그런 기분이었니?” 카호는 잠시 생각에 잠긴 후, “나도 그랬어. 마치 내가 다른 세계에 잠깐 여행을 간 것처럼. 그 책을 읽는 동안, 나는 마치 ‘무라카미 하루키’가 만들어낸 이야기 속 주인공이 된 것 같았어.”라고 답장했다. 우리의 편지에는 서로의 생각과 감정을 솔직하게 털어놓는 내용이 가득했다. 우리는 ‘무라카미 하루키’의 작품을 통해 서로를 더 깊이 이해하게 되었고, 우리의 우정은 더욱 끈끈해졌다. OpenAI는 준비 프레임워크를 업데이트하고 있습니다. 최근 몇 달 동안 OpenAI는 다양한 분야에서 발생한 위험을 더 잘 이해하고 대응하기 위해 준비 프레임워크를 업데이트하는 데 집중해 왔습니다. 특히, 생성 AI 모델의 발전 속도가 매우 빠르면서, 이 모델들이 악의적인 목적으로 사용될 가능성에 대한 우려가 커지고 있습니다. 이러한 우려를 해소하고 OpenAI가 책임감 있게 AI 기술을 개발하고 사용하는 데 필요한 도구를 제공하기 위해, 다음과 같은 주요 업데이트를 진행했습니다. 첫째, OpenAI는 AI 모델의 잠재적 위험을 평가하고 관리하기 위한 새로운 평가 프레임워크를 개발했습니다. 이 프레임워크는 모델의 성능, 안전성, 사회적 영향 등을 종합적으로 고려하여 위험 수준을 평가하고, 위험을 완화하기 위한 적절한 조치를 취할 수 있도록 설계되었습니다. 둘째, OpenAI는 AI 모델의 안전성을 향상시키기 위한 다양한 기술적 노력을 강화하고 있습니다. 예를 들어, 모델의 편향성을 줄이기 위한 연구, 모델의 악용 가능성을 차단하기 위한 기술 개발, 모델의 안전성을 검증하기 위한 테스트 방법 개선 등 다양한 분야에서 연구 개발을 진행하고 있습니다. 셋째, OpenAI는 AI 기술의 윤리적 사용을 장려하기 위한 노력을 지속하고 있습니다. OpenAI는 AI 기술이 인류에게 긍정적인 영향을 미치도록 하기 위해, AI 윤리 가이드라인을 개발하고, AI 기술 개발자와 사용자에게 윤리적 지침을 제공하고 있습니다. 또한, AI 기술의 사회적 영향에 대한 연구를 지원하고, AI 기술의 윤리적 문제에 대한 대중의 인식을 높이기 위한 활동도 적극적으로 추진하고 있습니다. OpenAI는 이러한 업데이트를 통해 AI 기술의 위험을 줄이고, AI 기술이 인류의 삶에 긍정적인 영향을 미치도록 노력할 것입니다. 특히, 무라카미 하루키의 소설 ‘카호’에 등장하는 것처럼, 기술 발전의 긍정적인 측면을 극대화하고 부정적인 측면을 최소화하는 데 중점을 둘 것입니다. OpenAI는 앞으로도 지속적인 연구 개발과 윤리적 노력을 통해 AI 기술의 안전성과 신뢰성을 확보하고, 인류의 번영에 기여할 수 있도록 최선을 다할 것입니다. 준비 태세 프레임워크를 업데이트하고 있습니다. OpenAI 배포 안전 “GPT-5.6” OpenAI는 Hugging Face 모델 평가 보안 사고 발생을 알립니다. 관련 조사 및 시스템 보안 강화를 위해 Hugging Face와 긴밀히 협력하고 있습니다. 이 사건으로 인해 발생한 모든 불편에 대해 진심으로 사과드리며, 사용자에게 안전하고 신뢰할 수 있는 서비스를 제공하기 위해 지속적으로 노력할 것입니다. OpenAI는 Hugging Face 모델 평가 및 보안 사고에 대한 정보를 공유합니다. Reuters(2026년 8월 7일) OpenAI는 다가오는 모델에서 심각한 사이버 보안 위험이 발생할 가능성을 경고하고 있으며, 이를 통해 규제 기관과의 협력을 강화하고 있습니다. 모델의 개발 및 배포 과정에서 더욱 엄격한 보안 조치를 적용할 계획입니다. 규제 기관과 긴밀히 협력하여 모델의 안전성과 보안성을 확보하고, 잠재적인 위험을 최소화하는 데 주력하고 있습니다. 또한 모델의 사용에 대한 명확한 지침을 제공하고, 사용자들이 안전하게 모델을 활용할 수 있도록 지원할 것입니다. #OpenAI #생성AI #AI에이전트 #사이버보안 #Codex 출처: note 원문 번역: Gemma 3(.44) 초벌 + 교정 31청크 원문 보기 | 출처: note.com