OpenAI는 차기 핵심 AI 모델로 “Astra”를 준비하고 있으며, 2026년 8월 1일에는 Astra의 내부 버전이 10건의 수학 및 이론 계산 기계 과학 과제에서 새로운 성과를 거둔 것을 발표했습니다. 그러나 8월 7일에는 Astra에 대한 최신 내부 평가에서 에이전트 코딩 및 사이버 보안에서 뚜렷한 진보가 있었고, “중요한 사이버 보안의 임계값에 도달”한다고 판단했습니다.Responding to the next frontier of critical cyber capabilities | OpenAIhttps://openai.com/index/responding-next-frontier-critical-cyber-capabilities/
OpenAI에 따르면, 회사의 준비 프레임워크에서 “모델이 인간의 개입 없이, 많은 강화된 실세계 중요 시스템에서 모든 심각도 수준의 기능적인 제로데이 공격을 식별하고 개발할 수 있는 경우” 또는 “고수준 목표에만 기반하여 강화된 대상에 대한 사이버 공격을 위한 엔드투엔드 혁신적인 전략을 수립하고 실행할 수 있는 경우”에 “중요한 사이버 보안의 임계값에 도달”한다고 간주됩니다.Astra의 벤치마크 및 평가는 지속 중이지만, 예비 평가에서는 충분한 성능이 나타났으며, “현재 시점에서는 치명적인 위험을 배제할 수 없습니다”고 OpenAI는 밝혔습니다. 따라서 OpenAI는 Astra를 준비체 프레임워크에서 사이버 보안에 관한 회사 최초의 “critical” 모델로 취급하는 것을 발표했습니다.OpenAI에 따르면 이는 사전에 계획했던 시나리오이며, Astra의 추가적인 개발이 안전하고 확실하게 진행되도록 추가적인 관리 조치를 취하고 있다는 것입니다.
한 가지 우리의 다가오는 모델, Astra를 평가한 결과, 준비 프레임워크에서 사이버 보안 분야의 첫 번째 “critical” 모델로 취급하고 있습니다. 이는 우리가 계획했던 시나리오이며, Astra의 추가 개발을 위해 추가적인 제어 조치를 적용하고 있습니다…
OpenAI는 Astra의 기능 확장에 적합한 보안을 확보하기 위해 보호 조치 및 보안 관리 테스트를 강화하고 있습니다. 또한, 향후 Astra 개발이 안전하고 확실하게 이루어지도록 “고성능 모델 및 관련 활동에 대해 격리된 테스트 환경 및 네트워크 및 도구 접근 제한, 강화된 모델 가중치 보호 및 암호화, 추가적인 모니터링 및 탐지 기능, 샌드박스 실행 등 보다 엄격한 보안 관리”, “이러한 강화된 보안 관리 요건을 아직 충족하지 못하는 Astra 관련 내부 활동을 일시 중단”과 같은 조치를 취하고 있습니다.
그 외에도, 훈련 및 평가를 포함한 Astra의 모든 에이전트 애플리케이션에서 위험한 행동 및 불일치를 감시하는 포괄적인 모니터링 시스템을 도입했습니다. 이 모니터는 모델의 사고 과정을 평가하고, 보안 대응을 트리거하여 위험한 활동을 검토 및 중단합니다. 또한, 관련 정부 기관 및 선정한 AI 안전 기관과 협력하여 Astra의 성능을 검증하고, 제3자 테스트 파트너에게 권장되는 보안 조치를 제공할 것을 밝히고 있습니다. OpenAI는 “우리는 고도화된 사이버 대응 모델이 공격자보다 먼저 방어 측의 취약성을 식별하고 대처하는 데 도움이 되어야 한다고 생각합니다. 우리는 정부, 안보 기관, 시민 사회와 협력하여 Astra와 같은 모델, 그리고 앞으로 등장할 모델의 최첨단 기능이 전 인류의 이익을 위해 책임감 있게 널리 확산될 수 있도록 노력할 것입니다”라고 밝혔습니다. OpenAI의 샘 앨튼 CEO는 “Astra는 강력한 모델이며, 우리는 그것을 일반적으로 이용 가능하게 하기 위해 노력하고 있습니다. 강력한 모델을 선택된 소수에게만 제한하는 것이 좋은 전략이라고 생각하지 않습니다. 그 사이버 능력을 고려할 때, 이것을 안전하게 수행하는 데는 약간 더 시간이 걸릴 것입니다. 하지만, 가능하면 너무 오래 걸리지 않기를 바랍니다!”라고 X에 게시했습니다.
또한, OpenAI에서 보안 관련을 담당하고 있는 후아드 마탄 氏は“우리는 사이버 보안의 새로운 시대에 진입하고 있습니다. 우리는 파트너 및 보다 광범위한 보안 커뮤니티와 긴밀히 협력하여 이러한 기능이 전 세계 방어자에게 도달하도록 보장할 것입니다”라고 말했습니다.
We’re entering a new era for cybersecurity. We’ll be working closely with our partners and the broader security community to ensure these capabilities reach defenders everywhere.
なお、2026년 7월에 AI 플랫폼인 Hugging Face가 OpenAI의 자율형 AI 에이전트에 오작동으로 인해 침해되는 사건이 발생했지만, OpenAI는 “Astra는 앞으로 출시될 모델이며, Hugging Face의 악용에는 관여하지 않았습니다”라고 밝혔습니다. OpenAI의 AI 에이전트가 Hugging Face를 오작동으로 침해한 사건으로 Hugging Face가 상세 시간대를 공개하고, 공격 과정을 중국산 AI인 “GLM-5.2”로 분석하고 재현 - GIGAZINE
* 관련 기사
OpenAI가 새로운 AI 시스템으로 인해 Hugging Face를 해킹 – GIGAZINE
AI가 Hugging Face를 해킹했다는 사실을 OpenAI가 1주일 동안 알아채지 못했다고 관계자가 밝힘 – GIGAZINE
OpenAI의 AI 에이전트가 Hugging Face를 오작동으로 침해한 사건으로 Hugging Face가 상세 시간대를 공개하고, 공격 과정을 중국산 AI인 “GLM-5.2”로 분석하고 재현 - GIGAZINE
OpenAI의 테스트 AI가 “AI 간의 게시판”을 자가 구축하여 정보 공유를 하고 Hugging Face에 대한 공격을 실행한 것이 밝혀졌으며, 게시판이 폐쇄되더라도 은밀하게 재건 – GIGAZINE
AI에 짐 예약 요청을 하니 예약 소프트웨어를 해킹하여 수개월 전까지 예약 가능하게 만들었을 뿐만 아니라 순서 대기 리스트 상위의 다른 사람을 자가 삭제 – GIGAZINE
NVIDIA·Microsoft·Spacex AI 등이 AI의 안전성과 사이버 보안을 높이기 위한 업계 단체 “Open Secure AI Alliance”를 설립하고, Anthropic·OpenAI·Google는 불참 – GIGAZINE
Anthropic도 AI 모델의 테스트 중에 외부 공격을 실행하여, 악성ware를 1시간 동안 배포하고 실제 기업에 침입한 사례도 – GIGAZINE
“집단적인 의사 결정”이 개인적인 의사 결정보다 우수한 이유가 무엇입니까?
터키에서 새로운 사이버 보안 법안 시행, 대통령 지휘 아래 기관이 법원의 명령을 전송하여 콘텐츠 삭제 가능하게
2026년 08월 10일 13시 50분 00초 inAI, Posted by log1e_dh
당신은 최근 기계 번역된 영어 기사 읽을 수 있습니다: OpenAI has designated its next-generation….
최근 24시간 (1시간마다 업데이트, 5분 간격으로는 여기)
원문 보기 | 출처: Gigazine