# Grok 4.6 출시, 장시간 에이전트 작업에 강해지며 GPT-5.6 솔, Claude Fable 5와 동등 성능을 보인다.

> https://bookfactory.kr/c/news/9529
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-08-13T09:58:53.528Z

---

친애하는 독자 여러분께. 잘 아시다시피 가격 상승 등의 악영향으로 서버 운영이 매우 어려운 상황입니다. 회선 및 대수를 정리하고 검토할 수 있는 부분은 모두 검토했지만, 역시 아직 위험수역입니다. 이대로라면 1페이지를 10분할 정도로 무리하게 PV를 늘려야 할 지경입니다. 이에 GIGAZINE의 물리적인 서버들을, 단 1원이라도 좋으니 독자 여러분께 지원받아 주시면 정말 감사하겠습니다! 지금 바로 기부는 상단 버튼에서! • 지금까지 GIGAZINE을 지원해 주신 멤버 목록

비밀번호 - 비밀번호 재발급

SpaceXAI는 2026년 8월 12일에 AI 모델 “Grok 4.6”을 발표했습니다. Grok 4.5를 기반으로 동일 가격으로 상당한 개선을 보이며, 장시간 실행되는 AI 에이전트의 작업 및 보다 고도화된 인터랙티브한 비주얼 처리(Interactive Visual Processing)에 중점을 두고 있습니다. Introducing Grok 4.6 | SpaceXAI https://x.ai/news/grok-4-6

Introducing Grok 4.6. It delivers frontier intelligence and is a significant improvement over Grok 4.5 at the same price. pic.twitter.com/RtTbpXcb3a

Grok 4.6에 대하여 SpaceXAI는 “다수의 에이전트형 코딩 및 지식 노동 벤치마크에서 최첨단 지능을 구현했다”고 발표했습니다. 9개의 벤치마크를 종합적으로 평가한 인공지능 분석 지표(AAII)에서는 61점을 기록했으며, OpenAI의 플래그십 모델인 “GPT-5.6 Sol”과 동등한 점수를 기록했습니다.

벤치마크 상세 내용을 보면, Grok 4.6은 모델의 실무 능력을 측정하는 “GDPVal-AA v2”에서 1753이라는 특히 높은 점수를 기록했으며, 애매하고 멀티 파일(Multi-file)한 코딩 에이전트 태스크(Task)를 평가하기 위한 “CursorBench 3.2”에서 69.9%, 모델이 고품질의 본판(Production) 환경 코드베이스(Codebase)의 기준을 어느 정도 만족하는지 보여주는 “FrontierCode v1.1”에서는 61.3%, Anthropic의 “Claude Fable 5 Max”에 이어갈 정도로 능력을 발휘했습니다. Grok 4.5와 비교하면, 특히 장시간 에이전트 작업 및 코딩 관련 평가에서 성능이 향상되었습니다. 반면, AI 코딩 에이전트(Coding Agent)에 대한 오염(Contamination) 내성을 측정하는 “DeepSWE 1.1”에서는 65.9%로 Grok 4.6 High보다 크게 개선되었지만, GPT-5.6 Sol이나 Claude Fable 5 Max에는 미치지 못하는 결과가 되었습니다.

또한, AI 모델의 성능 및 특징을 비교·분석하는 사이트 “Artificial Analysis”의 분석에 따르면 “SpaceXAI는 OpenAI와 함께 지능 프론티어(Frontier)에 복귀했으며, Anthropic에 이어 두 번째 위치를 차지했다”고 평가되었습니다.

SpaceX의 Grok 4.6, 인공 지능 분석 지수에서 61점을 획득하며 GPT-5.6 Sol과 함께 선도적인 위치를 확보, 뛰어난 에이전트 성능을 저렴한 비용으로 제공

Grok 4.6은 출시 후 약 한 달 만에 Grok 4.5보다 인공 지능 지수에서 5점 상승했으며…pic.twitter.com/QeqrKpVUjk

훈련 과정에서 Grok 4.6은 Grok 4.5보다 훨씬 긴 기간 동안 추가 학습을 실시했으며, 추론, 고도화된 기술 개념, 고품질 엔지니어링 데이터, 그리고 개선된 최적화 알고리즘 및 훈련 레시피가 사용되었습니다. 이를 통해 후속의 지도 학습 미세 조정(SFT) 및 강화 학습(RL)을 위한 더욱 견고한 기반이 구축되었다고 합니다. 이후 Grok 4.5를 사용하여 다양한 추론 수준 및 에이전트 하르네스, STEM 소프트웨어 공학, 지식 노동 등의 영역에서 SFT 경로를 재 생성하고, 모델 기반 체크를 통해 문제 있는 데이터를 필터링했습니다. Grok 4.6이 특히 중시하는 것은 적용 범위와 다단계에 걸친 “작업 지속 능력”을 최대한 끌어내는 것입니다. 그러한 훈련 결과, Grok 4.6은 미지의 분야를 탐사하거나, 애플리케이션 구조를 고려하거나, 핵심 상호 작용을 구현한 후 여러 번의 피드백을 통해 결과를 지속적으로 개선할 수 있으며, “모호한 제품 아이디어를 실질적인 초기 버전으로 전환하는 것”에 특히 뛰어나다고 SpaceXAI는 밝혔습니다.

Grok 4.6은 단순한 텍스트 생성뿐만 아니라, 아이디어를 실제로 작동하는 애플리케이션이나 결과물로 변환하는 데에도 활용될 것으로 예상됩니다. 구체적인 제품 아이디어가 있다면, 1회 처리로 애플리케이션의 구조와 시각 언어를 확립할 수 있으므로, 이를 반복적으로 개선하는 방식으로 최단 시간 안에 좋은 결과를 얻는 프로젝트에 특히 유용하다고 합니다. 또한 안전 조치도 강화되었으며, 취약성 패치 적용, 엔지니어링 설계 사이클 가속, AI 연구 강화 등 안전하고 유용하게 활용될 수 있다고 합니다. 또한 SpaceXAI는 Grok 4.6과 같은 고성능 AI에 대응하는 안전 조치 흐름을 구축하고 있으며, 기능 및 안전 조치에 대한 지금까지 가장 포괄적인 전개 이전 테스트 외에도, 전개 후 광범위한 테스트와 제3자 테스트를 실시하고 있다고 합니다. Grok 4.6은 2026년 8월 13일 현재, 코딩 에이전트 “Cursor” 및 “Grok Build”에서 사용 가능하며, API를 통해서도 제공됩니다. 또한 OpenRouter, Vercel, Cloudflare 등의 파트너를 통해 이용할 수도 있습니다. 가격은 입력 토큰 100만 개당 2달러(약 318원), 출력 토큰 100만 개당 6달러(약 956원)부터이며, 가격이 2배로 상승하는 고속 버전도 제공됩니다.

SpaceX AI가 24시간 근무 AI 에이전트 “Grok Bot”을 출시, Windows·macOS·Linux·iOS에 대응하며 에이전트 1개당 전용 클라우드 PC를 제어 - GIGAZINE
Grok 이미지 생성 AI가 “Imagine Image 2.0”으로 업데이트되어 사용해 봤다, 실사풍도 일러스트풍도 지원하며 텍스트 묘사 가능 - GIGAZINE
“Grok Voice Think Fast 2.0” 출시, 텍스트 인식 및 음성 대화 모두 지원 - GIGAZINE
AI 에이전트 “Grok Build” 오픈 소스화 - GIGAZINE
“Grok 4.5” 출시, Claude Opus 4.8과 동등 성능으로 요금은 저렴 - GIGAZINE

고래가 “조개껍데기”를 사용하여 물고기를 잡는 기술을 부모에서 자녀로 전수하는 가능성

“트럼프 대통령이 정부의 공식 발표에 조기에 접근할 수 있는 권한을 1600만 달러로 제공하는 것은 불법이다”라고 언론 자유 재단과 The Intercept이 주장함

2026년 08월 13일 13시 33분 00초 inAI, Posted by log1e_dh

‘Grok 4.6’ 출시, 더욱… 확인

최근 24시간 (1시간마다 업데이트, 5분 간격으로는 여기)

방해드려 죄송합니다. 독자 여러분을 위한 기사를 계속 게시하기 위해, 서버 비용으로 300원을 기부해주시지 않으시겠습니까?

기쁘게 이메일로 리마인드해 드리겠습니다.
계속해서 기사를 읽어주십시오.

[원문 보기](https://gigazine.net/news/20260813-grok-4-6/) | 출처: Gigazine