OpenAI는 “연구 가속화”와 안전성 우려를 공식적으로 발표했으며, Anthropic에서는 연구자들이 퇴사했다.
2026년 9월 현재, 인공지능 개발의 최전선에서는 안전성과 개발 속도에 관한 논의가 활발하게 진행되고 있습니다.
OpenAI는 9월 6일, AI 에이전트가 사내 연구 개발을 실제로 가속하고 있음을 보여주는 데이터를 공개했습니다.
같은 날, OpenAI의 최고 과학자 Jakub Pachocki 氏가 “An Alien Mind”라는 제목의 글을 공개하며, 현재 AI 연구소는 최대 속도로 개발을 지속할 만큼 충분한 안전 조치를 확립하지 못했다는 점을 시사했습니다.
한편, Anthropic에서는 연구자 제이콥 코존이 퇴사하면서 OpenAI와 Anthropic 간의 초지능 개발 경쟁을 엄중하게 비판한 사실이 9월 9일부터 10일에 걸쳐 보도되었습니다.
OpenAI, 인공지능 에이전트 기반 연구 가속화에 대한 연구 발표
OpenAI는 9월 6일 “연구 가속화: OpenAI 내부 시각”을 공개했습니다.
그에 따르면 2026년 초부터 연구자들 사이에서 코딩 에이전트 이용이 급격히 증가할 것으로 예상된다.
8월 중순에는 OpenAI의 연구 조직 전체에서 인간 연구자 1명당 3.1일 상당의 에이전트 가동 시간이 사용되는 상황이 발생했습니다.
연구자 1인당 실험 횟수는 증가하고 있으며, 2026년 8월에는 2025년 1월의 측정 시작 이후 최대치를 기록했습니다.
OpenAI는 계산 자원의 증가 등 다른 요인도 있기 때문에 이러한 숫자를 그대로 연구 속도 향상률로 처리할 수 없다고 설명하고 있습니다.
그와 더불어, 내부에서는 에이전트형 툴이 연구의 진보를 “의미 있는 방식으로 가속화하고 있다”는 인식과 함께, 그 긍정적인 영향을 주목하고 있습니다.
연구 인턴십 목표 달성
OpenAI는 인간의 지시 하에 숙련된 연구자가 수일이 소요되는 명확한 연구 과제를 수행할 수 있는 시스템을 “automated research intern”로 정의하고 있습니다.
이번 발표에서는 이 목표에 2026년 9월까지 도달했다고 밝혔습니다.
다음 목표는 더 광범위한 연구를 인간의 감독 하에 수행하는 “자동화된 AI 연구원”을 구축하는 것으로, OpenAI는 2028년 3월을 목표 시기로 제시하고 있습니다.
다만 OpenAI는 AI가 AI 연구를 급속도로 개선해 나가는 “recursive self-improvement (RSI)”에 대해, 안전하게 완전한 형태까지 진행하는 방법에 아직 확신하지 못한다고 명시하고 있습니다.
안전성을 충분히 확보할 수 없는 경우에는 개발 및 확산을 지연시키거나 중단하는 것을 고려하고 있습니다.
OpenAI 최고 과학자, “자발적 감속” 언급
9월 6일, OpenAI의 수석 과학자 야쿠브 파초키가 “An Alien Mind”를 공개했습니다.
파치오키 박사는 2023년에 추론 모델의 스케일링 연구에서 얻은 결과를 되돌아보며, 3년 후 현재 추론 모델이 컴퓨터를 조작하고, 인간이나 다른 AI와 협력하여 연구 프로젝트까지 수행하는 수준에 도달했다고 주장합니다.
그와 동시에,
현재 어떤 AI 연구소도 정렬 및 감시 문제에 대해 최대 속도로 스케일링을 장기간 지속할 만큼 충분히 해결하지 못하고 있다.
그것에 대한 인식을 보여주었습니다.
파치오키 박사는 공통의 안전 기준이 확립될 때까지 AI 연구소에서 자발적인 감속이 보편화될 것으로 기대한다고 보고 있습니다.
더 나아가 향후 AI 개발에 대해 정부 간 국제 협력을 최우선 과제 중 하나로 설정해야 한다고 주장합니다.
OpenAI는 이미 개발 속도를 일시적으로 낮추고 있었다.
OpenAI는 이전에 8월 18일에도 모델 개발 속도를 일시적으로 늦추는 것을 공식적으로 발표했습니다.
배경에는 연구 인프라에 대한 침해 사건과, 당시 개발 중이던 아스트라가 해당사의 Preparedness Framework에서 “Critical” 수준의 사이버 능력이 달성될 가능성이 있었습니다.
OpenAI는 감시, 정렬, 보안 강화를 위해 일시적으로 확장 속도를 늦췄다고 설명하고 있습니다.
9월 6일 연구 가속화 보고서에 따르면 7월 20일 이후 최신 모델에 대한 강화 학습을 약 2주간 중단한 사실이 밝혀졌습니다.
일부 연구는 안전 대책을 강화한 환경에서 재개되었지만, 중단된 상태가 이어졌던 연구도 있었습니다.
앤서니 훅(Anthropic) 연구자가 퇴사했습니다.
같은 시기에 Anthropic에서도 안전성에 대한 논의가 진행 중입니다.
금융 타임스 등의 보도에 따르면, Anthropic의 연구자 제이콥 코슨 씨가 퇴사했습니다.
Coxon 씨는 27세의 영국인 연구자로, Anthropic 이전에는 OpenAI에도 소속되어 있었습니다.
콕슨 교수는 OpenAI와 Anthropic이 자가 개선 능력을 갖춘 초지능 개발을 경쟁하는 상황을 인류의 생명을 건 도박으로 규탄하고 있습니다.
보도에 따르면 코슨 氏は、앤트로픽이 인공지능의 심각한 위험을 인지하는 한편, 다른 기업들이 개발을 계속하는 이상 자사만 멈출 수 없다는 생각에도 반대 입장을 보이고 있습니다.
현직 Anthropic 연구원으로부터도 강력한 우려
앤트로픽(Anthropic)에서 얼라인먼트 사이언스(alignment science)를 이끄는 이반 허비거(Evan Hubinger) 역시 AI로 인한 심각한 위험에 대해 높은 개인적인 평가를 내리고 있습니다.
보도에 따르면 허빙거 氏は、향후 10년 이내에 인공지능이 인류 규모의 심각한 위기로 이어질 가능성을 10%를 초과로 추정했으며, 초지능이 인간의 가치관에 완전히 부합하는 완성된 계획은 현재 시점에서는 존재하지 않는다고 보고 있습니다.
이는 Hubinger 씨 개인의 위험 평가이며, 확정된 과학적 예측이 아닙니다.
이번에 확인된 사항
2026년 9월 상순에 확인되는 움직임은 크게 세 가지입니다.
OpenAI는 AI 에이전트가 자체 AI 연구를 실제로 가속화하고 있다는 데이터를 바탕으로 공식적으로 발표했습니다.
동사무소의 최고 과학자는 안전 기준이 마련될 때까지 AI 연구소가 자발적으로 개발 속도를 늦출 가능성을 언급했습니다.
또한 Anthropic에서는 안전성을 연구하던 연구원이 초지능 개발을 둘러싼 기업 간 경쟁에 대한 우려를 이유로 퇴사했습니다.
AI의 능력 향상뿐만 아니라, 그 개발 속도와 안전성은 누가, 어떻게 관리할 것인지가 AI 기업 내부에서도 구체적인 과제로 다루어지고 있습니다.
OpenAI|연구 가속화: OpenAI 에이전트 기반 연구 가속, 자동화된 연구 인턴, 재귀적 자기 개선, 안전상의 이유로 인한 연구 중단에 대한 시각
OpenAI|외계 지능 – 야쿠브 파초키
OpenAI 최고 과학자의 논고로, 인공지능 연구의 가속화, 정렬, 감시, 자발적 감속, 국제 협력에 대해 논한다.
[https://openai.com/index/an-alien-mind/](https://openai.com/index/an-alien-mind/)
OpenAI|사이버 역량 강화를 위한 모델 개발 속도 조절 및 Astra 개발 과정에서의 안전 대책과 모델 개발 속도 일시적 감속 경위
Financial Times|앤트로픽 연구원, 초지능 개발 경쟁의 위험을 제기하며 퇴사…OpenAI와 앤트로픽의 경쟁을 비판하는 Jacob Coxon氏의 보도입니다.
코슨 씨의 퇴사 및 앤트로픽의 에반 허비거 최고 책임자의 AI 위험 평가에 대한 논의가 진행 중이다.
AI 인공지능 생성AI OpenAI Anthropic AI에이전트 AI연구 AI안전성 AI정렬 초지능 AI뉴스
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 29청크
원문 보기 | 출처: note.com