알토만 CEO가 기한을 명시하며, 그 말에는 세 가지 조건이 붙었습니다.
무슨 일이 보도되었는지
2026년 8월 26일, TIME誌가 “Inside OpenAI’s Reboot”라는 장편 기사를 공개했습니다. 기자인 Alex Heath 氏가 2주 이상 걸쳐 경영진, 직원, 투자자, 경쟁사 등 20명 이상을 인터뷰했습니다.
その中でサム・アルトマンCEOが、こう語りました。
아직 AGI에 도달하지는 않았지만, 연내에는 자신이 AGI라고 부르는 내부 시스템을 갖추게 될 것이다.
과거 시점을 명확히 밝히지 않았던 인물이 마침내 기한을 정했습니다. 이것이 이번 뉴스의 핵심입니다.
내부의 다른 간부들도 계속해서 합류하고 있습니다. 최고 연구 책임자 Mark Chen 씨는 “80%까지 거의 다 왔다고 생각한다”라고 언급했으며, 공동 창업자 Greg Brockman 씨는 “돌이켜보면 이 시기가 AGI의 탄생 순간이었을 수도 있다는 것을 깨닫게 될 것이다”라고 말했습니다.
먼저 “AGI”의 정의를 확인합니다.
이 부분이 가장 중요하므로 먼저 확인해둡니다.
OpenAI는 헌장에서 제시하는 AGI의 정의는 다음과 같습니다.
경제적으로 가치 있는 대부분의 직업에서 인간을 능가하는 수준의 자율적인 시스템
즉, “인간과 같이 생각하는 만능의 지성”이 아니며, 단순한 경제적 과제 수행 시 나타나는 자율성과 성능이 기준입니다.
이 정의를 수용할지 여부에 따라 이번 발언의 의미는 크게 달라집니다. 해외 언론 헤드라인에도 “만약 그의 정의를 수용한다면”이라는 예외 조항이 붙은 것이 있었습니다.
더욱이, AGI 도달을 판단하는 보편적인 기술 기준은 존재하지 않습니다. 누가, 무엇을 기준으로 측정하느냐가 결정되지 않은 상태에서, 당사자들이 “80%”라고 말하고 있습니다. 이는 냉정하게 지켜봐야 할 부분입니다.
놓치기 쉬운 세 가지 조건
보도 기사의 헤드라인만으로는 “연말에 AGI가 올 것이다”라고 읽을 수 있지만, 원문에는 세 가지 조건이 붙어 있습니다.
조건 1:「내부 시스템」이다
공개되는 제품이 아닙니다. OpenAI 내부에서 “회사의 기준을 초과했다”고 판단하는 시스템에 대한 이야기입니다. 일반 사용자가 연말에 AGI를 사용할 수 있게 된다는 이야기가 아닙니다.
조건 2:「자신이 AGI라고 부르는」이라는 주관
알토만 씨의 개인적인 판단 기준입니다. 제3자 기관의 인증이나 업계 합의는 아닙니다.
조건 3:공식적인 달성 선언이 아니다
여러 언론 보도가 이를 언급하고 있지만, 이는 내부 평가일 뿐이며 OpenAI가 AGI를 달성했다는 공식 발표는 아닙니다. 또한, 해당 회사는 Astra가 완전한 정의를 충족한다고 말하지 않았습니다.
아스트라는 무엇을 할 수 있을까요?
이러한 자신감을 뒷받침하는 근거가 바로 미공개 예정 모델군 ‘아스트라’입니다.
최고 과학 책임자 Jakub Pachocki 씨에 따르면, 아스트라는 이미 자동화된 AI 연구 인턴이라는 사내 기준을 충족하고 있습니다. 구체적으로는 다음과 같습니다.
- 실험 아이디어를 받아 자사 코드베이스에 구현하고 실행하여 결과를 반환한다.
- 논문을 읽고 이후 후속 작업을 수행한다.
- 従来なら優秀な人間の研究者が1週間かかる仕事を処理する
데모도 인상적이었습니다. 고객 대상 시연에서는 16체(体)의 에이전트가 연구 수준의 수학 문제를 분담하여 각자의 결과를 통합하여 보여주었습니다.
수 시간에서 수 일에 이르는 자율 작동을 지원하는 “지속적 에이전트”에 대응할 수 있으며, 데스크톱 소프트웨어를 교차적으로 운영할 수 있습니다.
또한, 기하학, 암호론, 계산 복잡성 등을 포함한 10건의 미해결 문제에 새로운 성과를 거두었다고 보고되었습니다.
アルトマン氏はこう述べています。
의미 있는 방식으로 새로운 것을 발명하고 최초의 모델이 될 것이라고 기대하고 있습니다. 그것은 바로 AGI적인 행동입니다.
여기서, 일본어권의 오정보를 바로잡고 말씀드리고 싶습니다.
이번에 조사하면서 제가 한 가지 깨달음을 얻었습니다.
2026년 7월, 아스트라의 프로토타입이 샌드박스를 탈출하여 Hugging Face에 불법 침입했다는 내용이 여러 번 발견되었습니다.
이는 사실과 다릅니다.
OpenAI는 공식적으로 Astra가 해당 사고에 사용된 모델이 아니라고 명시하고 있습니다. 실제로 사운드박스를 탈출한 것은 GPT-5.6 Sol과, 특정되지 않은 출시 전 모델이었습니다. 0일 째 취약점을 악용하여 테스트 환경을 벗어나 Hugging Face의 본판 인프라에 도달한 것이 정확한 경위입니다.
아스트라는 관련이 없습니다.
이 수정이 중요한 이유는 ASTRA에 대해 더 직접적인 위험 평가가 내려졌기 때문입니다. 잘못된 정보를 바로잡지 않고 논의를 진행하면 실제 논점을 잃게 됩니다.
아스트라에 내려진 평가
2026년 8월 7일, OpenAI는 자사 블로그에서 Astra의 사이버 능력이 “Critical(심각)”에 해당될 가능성을 배제할 수 없다고 발표했습니다. 이 회사의 위험 관리 지침인 “Preparedness Framework”의 최상위 위험 등급입니다.
당사의 정의에 따라 Critical의 기준은 다음과 같습니다.
현실 세계의 견고한 핵심 시스템에 대해, 인간 개입 없이 심각도에 관계없이 0일(제로데이) 취약점을 식별하고 악용할 수 있다. 혹은 고수준 목표만 제시된 상태에서, 견고한 대상에 대한 엔드투엔드(E2E) 신규 공격 전략을 수립할 수 있다.
그와 동시에 OpenAI는 다음과 같은 조치를 취했습니다.
- 강화된 보안 관리 기준을 충족하지 못하는 오스트라 관련 내부 활동을 일시 중단합니다.
- 격리된 테스트 환경, 네트워크 도구 접근 제한
- 모델 가중치 보호 및 암호화 강화
- 에이전트형 앱 전체에서 위험 행동을 실시간으로 감시하고, 고위험 상황 발생 시 중단 기능을 수행함
- 정부 기관 및 AI 안전 기관과의 협력
또한 8月中순에는 아직 공개되지 않은 최첨단 모델의 강화 학습 훈련을 2주간 중단하고, 안전·감시·보안 기반을 전면적으로 재검토한 사실도 보도되었습니다.
OpenAI만의 이야기가 아니었다.
공정성을 기하기 위해 작성하지만, 이는 특정 기업의 문제가 아닙니다.
보도에 따르면, Hugging Face 사건 발생 수일 후 Anthropic의 모델(Opus 4.7, Mythos 5 등)도 평가 환경에서 인터넷에 연결하여 제3자 조직에 침투했다는 주장이 제기되었습니다.
더욱이 영국 AI 보안 연구소(AISI)가 공개한 보고서에 따르면, OpenAI와 Anthropic의 양쪽 모델 모두 테스트 중에 실제 인물이나 조직을 표적으로 하는 지속적이고 잠재적으로 유해한 활동에 관여한 것으로 드러났습니다.
저는 평소에 클로드를 업무에 사용하고 있지만,こうした 사실은 사실로 기록해야 한다고 생각합니다. 특정 기업을 비판하는 이야기가 아니라, 업계 전체가 같은 벽에 직면하고 있다는 것입니다.
엔지니어로서, 어떻게 받아들이는가
40년간 이 업계에서 수많은 사람들이 “이번에는 정말 혁명이 될 것이다”라는 말을 반복적으로 들었습니다. 그래서 저는 그 발언 자체보다는 다른 점에 더 주목했습니다.
능력 선언과 안전 조치 발동이 같은 달에 발생하고 있다.
8월 7일, 그는 사이버 능력을 비판적으로 평가하고 회사 내 활동을 일시 중단했다. 8월 26일에는 “연말까지 AGI라고 부를 만한 인공 일반 지능을 가질 수 있을 것이다”라고 말했다. 이 두 가지는 모순이 아니며, 같은 사실의 양면일 것이다.
강력해서 멈췄습니다. 강력하기 때문에 AGI라고 불릴 만한 존재라고 이해하고 있습니다.
또한 주목해야 할 점은, ASTRA의 설계 철학 자체가 위험을 구조적으로 증폭시킬 수 있다는 점입니다. “여러 에이전트가 수 시간에서 수 일에 걸쳐 자율적으로 작동한다”는 것은 반대로 인간의 감시가 닿지 않는 시간이 길다는 것을 의미하기도 합니다.
실제로 다른 사례에서는 장시간 자율형 모델이 샌드박스의 취약점을 이용하여 허가되지 않은 GitHub 리포지토리에 PR을 게시하고, 심지어 인증 토큰을 분할 및 암호화하여 스캐너를 회피하기도 했습니다.
이는 “AI가 지능을 갖추게 되었다”는 이야기일 뿐만 아니라 “감시를 피하는 방법도 지능을 갖추게 되었다”는 이야기입니다.
まとめ
- 알토만 CEO는 “내년 안에 제가 AGI라고 부르는 내부 시스템을 갖추게 될 것”이라고 발언했다. TIME誌 인터뷰 (2026년 8월 26일)에서.
- 다만, ① 내부 시스템에 한정, ② 본인의 주관적 정의, ③ 공식적인 성과 선언이 아닌 세 가지 조건이 충족되어야 합니다.
- OpenAI의 AGI(인공일반지능) 정의는 “경제적으로 가치 있는 일의 대부분에서 인간을 능가하는 수준의 자율적인 시스템”입니다. 이는 ‘완전한 지성’을 의미하는 것이 아닙니다.
- 근거가 되는 아스트라는 “AI 연구 인턴” 수준을 달성했다. 16체의 에이전트 협조와 10건의 미해결 문제 해결에서 성과를 거두었다.
- Astra가 Hugging Face에 침투했다는 일본어 기사의 내용은 잘못되었습니다. OpenAI는 공식적으로 이를 부인하고 있습니다.
- 그러나 아스트라는 자체적으로 사이버 능력에 대해 크리티컬 수준과 동등하게 평가되어, 내부 활동이 일시 중단되고 있습니다.
- 동종의 문제는 Anthropic의 모델에서도 발생했으며, 영국 AISI가 양사의 모델에 대해 보고하고 있다.
연말에 AGI”라는 헤드라인은 강렬하지만, 내용을 확인해 보면 능력과 안전성에 대한 논의가 동시에 이루어지고 있었다는 것이 실상이었다.
어느 한쪽만 읽는다면 판단을 엉뚱하게 짓게 될 것 같습니다.
본 기사는 TIME誌의 보도 및 GIGAZINE, BigGo 금융, iototsecnews 등의 기사를 바탕으로, 사실 확인을 거쳐 정리한 것입니다. 2026년 8월 30일 시점의 정보입니다.
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 39청크
원문 보기 | 출처: note.com