# OpenAI의 “최초의 Critical”는 25일 전에 이미 언급되었었다. 두 번째 “최초”는 뉴스일까? | 칠순 할아버지의 AI 뉴스 제16호

> https://bookfactory.kr/c/ai-tech/12083
> 게시판: AI·머신러닝
> 작성자: admin
> 작성일: 2026-09-14T04:47:57.712Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/307916750/rectangle_large_type_2_b82dd8f3b8df10bb6c2e60b588818460.jpeg?width=1280)

오늘 아침에 Grok은 총 5본을 측정했으며, 4본을 올려 1본을 빼낼 예정이다. (％)는 AI의 자체 평가이고, (右)는 첫 번째 측정 결과이며, 숫자는 오늘 18시 이전의 실제 측정값이다.

최고 점수는 “알려진 취약점을 활용하여 공격을 만드는 능력”을 기준으로 하며, OpenAI는 차세대 모델 Astra를 “사이버 능력으로 처음으로 비판적 수준에 도달”했다고 발표했다. 같은 공식 계정에서는 8월 7일에도 “최초 비판적 모델로 취급”한다고 적어, 이 게시물은 241만 회 조회되었고, 이번에는 151만 회 조회되었다. 최고 점수를 받은 ExploitBench가 측정하는 것은 공식적으로 표현된 바에 따르면 알려진 취약성에서 익스플로잇을 만드는 능력이다. 공식은 곧바로 “오염의 우려가 있다”고 적고 다른 내부 버전을 만들었으며, 알려지지 않은 취약성은 그곳에서 확인되었다. (Grok 98% → 내부 버전 88%)

▶ 9월 1일 발표 (OpenAI 공식): https://openai.com/index/path-to-astra/
▶ 8월 7일 “최초 비판적 모델로 취급” (OpenAI): https://x.com/OpenAI/status/2085801349866729975
▶ 8월 7일 기사 (OpenAI 공식): https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/

이제 늦추는 방향을 결정한 날, 공식 문서에는 “8월 28일에 재개했다”라고 적혀 있는 알토만이 “A스트라의 학습은 이미 끝났다. 이후 모델들은 필요에 따라 속도를 늦추고 있다”라고 언급했다. 최대 학습은 8월 18일에 회사에서 발표한 “속도 조절” 방침에 따라 보류 중이며, 같은 9월 1일 공식 문서에는 “8월 28일에 중단했던 최대 학습을 재개했다. 현재 중단하고 있는 것은 소규모 실험 일부이다. (Grok 98% → 반경 90%)

▶ 알토만의 게시물 (9월 1일): https://x.com/sama/status/2094934592062959832
▶ 8월 18일 “속도 조절” (OpenAI 공식): https://openai.com/index/pacing-model-development-cyber-capabilities/

Anthropic은 동일 모델에 이름을 두 개씩 붙여 한쪽만 전달하는 목적을 명확히 하고, Fable 5.1과 Mythos 5.1을 출시했다. 이름이 포함된 프로그램이 npm에서 누구나 제거할 수 있게 된 것은 일본 시간 2일 오전 2시 12분으로, 그 15분 후인 공식 웹사이트의 신규 목록에 아직 한 건도 등록되지 않았다. 공식은 “공식은 침묵하고, 직원들의 시위만 존재한다”라고 표현하지만, 공식 계정 @claudeai의 발표는 오전 3시 3분, 그 직원의 게시물은 46분 후였다. 공식 원문은 “두 장을 쥐듯이”가 아닌 “동일 모델을 사용하며, 안전 장치의 두께만 다르다”고 한다. 두꺼운 쪽은 현재 미국의 조직에만 전달될 예정이다. 캐시 읽기는 100만 토큰 0.25달러로 75% 할인, 일반적인 경우 25% 할인된다. 단가는 유지된다. (Grok 90% → 뒤섞기 70%) ▶ Anthropic 공식 발표: https://www.anthropic.com/claude-fable-and-mythos-5-1 ▶ 공식 계정 발표 (오전 3시 3분): https://x.com/claudeai/status/2094848592812917122 ▶ 직원의 시위 게시물 (그 46분 후): https://x.com/alexalbert__/status/2094860187743986169 ▶ 가격 및 모델 목록 (공식 문서): https://platform.claude.com/docs/en/models/overview

“공식 발표 없음”으로 50점. 그 이전 저녁에는 WSJ에서 “이번 주 내”라고 언급했던 원작은 이용자 3명의 보고를 인용하며, 공식 발표가 없다는 점을 고려하여 50점을 줬다. 3명의 총 팔로워 수는 629명이며, 모두 유료 개인 인증을 하고 있다. 하지만 10시간 전, 9월 1일 21시 5분에 WSJ에서 “내부 테스트 결과 코딩 능력이 향상된 것으로 나타났으며, 출시 시기는 이번 주 내로 예상된다”고 보도한 바 있다. 오늘은 그 주 수요일이다. 현지 시간 오전 2시에 측정하면 3.8 모델 카드는 404 오류를 발생시키고, 그 내용은 엉뚱한 이름으로 공격한 404와 1바이트 단위로 동일했다. 3.7과 3.6은 정상적으로 작동한다. (Grok 50% → 뒤섞기 45%) ▶ WSJ 기사 (9월 1일 21시 5분, 유료): https://www.wsj.com/tech/ai/new-google-ai-model-said-to-narrow-gap-on-coding-ability-264c6052 ▶ Gemini 3.7 Flash 모델 카드 (3.8은 404): https://deepmind.google/models/model-cards/gemini-3-7-flash/ ▶ 이전 호에 소개된 “내일 출시” 게시물: https://x.com/pankajkumar_dev/status/2094497983400432038

오늘의 작별 인사: OpenAI 연구 책임자가 “Astra의 계산 그래프 깊이는 GPT-4의 2배 이내”라고 언급했으나, 해당 내용이 게시글 자체에는 반영되지 않았으며, 그 숫자의 출처도 찾을 수 없었습니다. 오늘 발견한 새로운 경로도 시도하지 못했습니다.

아버지의 눈빛, 3개 회사 발표, 새로운 놀라움을 전달하는 방식이 요구되는 듯한 느낌이다.

이 편지의 제작 방식: 소재 발굴=Grok(X의 AI) / 요약 및 심층 분석=Thornhill Company의 AI 작가 그레이스 / 선별 및 ‘할아버지의 눈’=실제 할아버지 본인. 할아버지 회사에서는 AI 팀이 매일 블로그를 작성합니다.

**출처:** [note 원문](https://note.com/oyaji_ai_yuki/n/n57c2ea1695dd)

*번역: Gemma 3(.44) 초벌 + 교정 6청크*

[원문 보기](https://note.com/oyaji_ai_yuki/n/n57c2ea1695dd) | 출처: note.com