# AI를 운영하는 경쟁이 앞선다 – 저렴한 모델과 가시화된 에이전트가 핵심 (2026년 9월 24일)

> https://bookfactory.kr/board/news/18369
> 게시판: 뉴스
> 작성자: admin
> 작성일: 2026-09-24T06:50:38.733Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/316810968/rectangle_large_type_2_5a6ea2f697d60f8b2ec8cfac03f0ae3d.png?width=1280)

## 오늘의 AI 뉴스 5선

AI 경쟁은 최고 성능 모델의 성능만을 비교하는 단계에서 “얼마만큼 싸고, 얼마나 오래, 안정적으로 사용할 수 있는가”로 크게 확장되고 있습니다.

OpenAI는 GPT-6 Astra의 기술을 보다 일상적인 업무에 활용할 수 있도록 GPT-6 Sol과 GPT-6 Luna를 공개했으며, 이전 세대에 비해 API 가격을 크게 낮췄습니다. Anthropic 또한 “Claude Opus 5.5”를 출시하여 Opus 5보다 낮은 비용으로 장시간의 코딩 및 지식 작업을 수행하는 방향을 강화하고 있습니다.

모델을 사용하는 측에서도 변화가 있습니다. AWS는 AI 에이전트 평가, 모니터링, 실험을 위한 “Amazon CloudWatch Omni”를 공개했습니다. Apple은 새로운 Mac mini와 Mac Studio 판매를 시작하여 거대한 AI 모델을 클라우드로 보내지 않고 端末側에서 실행하는 선택지를 넓혔습니다.

더 나아가 구글 애즈에서는 AI Max에 자연어 기반으로 광고 전략을 전달하는 “AI Brief”의 클로즈드 베타가 일본어에도 확대되었습니다.

오늘은 이 5가지 작품을 통해 AI의 주戰지가 ‘가장 현명한 모델’뿐만 아니라 가격, 감시, 로컬 실행, 업무 운영까지 실용성에 집중되는 흐름을 살펴보겠습니다.

## OpenAI의 “GPT-6 솔/루나” 모델 공개, Astra 기술을 활용한 저렴한 모델 출시

OpenAI는 9월 22일 “GPT-6 솔”과 “GPT-6 루나”를 공개했습니다.

둘 다 GPT-6 Astra에서 진행된 학습 방법론과 정렬 개선을 계승하면서, 속도와 비용의 균형을 조절한 모델입니다. OpenAI는 가장 어려운 작업에서는 여전히 Astra를 최상위로 유지하는 한편, Sol과 Luna는 일상적인 개발 및 지식 작업 등 대량의 작업을 처리하는 용도를 중시합니다.

API 가격은 GPT-6 Sol이 토큰당 100만 개에 입력 2달러, 출력이 10달러입니다. GPT-6 Luna는 입력 0.10달러, 출력이 0.50달러이며, OpenAI에 따르면 GPT-5.6의 프로모션 가격과 비교했을 때 Sol, Luna 모두 50% 저렴해졌습니다.

캐시된 입력에서는 솔이 0.20달러, 루나가 0.01달러입니다. 장시간 실행되는 AI 에이전트의 경우, 동일한 지시어와 툴 정의, 과거 맥락을 반복적으로 사용하기 때문에 캐시 가격은 실제 운영 비용에 크게 영향을 미칩니다.

OpenAI는 동시에 GPT-6용 프로ンプ트 캐시를 개선하여 여러 API 호출에서 공통되는 문맥을 재활용하기 쉽게 했습니다. 캐시된 입력에서는 최대 90%의 할인 혜택을 제공합니다.

GPT-6 솔과 루나는 API에 더하여 ChatGPT Work와 Codex에서 Plus, Pro, Business, Enterprise, Edu 버전으로 제공이 시작되었습니다. Free와 Go에서는 데스크톱 앱을 통해 GPT-6 루나를 체험해 보실 수 있습니다.

성능 비교에 대한 내용은 OpenAI가 공개한 평가를 중심으로 한 숫자입니다. 실제 업무에서는 작업이나 툴 구성에 따라 결과가 달라지지만, 이번 발표에서 중요한 것은 “고성능 모델을 얼마나 저렴하고 오래 사용할 수 있는가”가 명확한 경쟁 기준으로 자리 잡았다는 점입니다.

AI 에이전트가 몇 시간 동안 작동하게 됨에 따라, 1회의 답변 성능보다 지속 이용 시의 요금과 캐시 효율의 차이가 더 중요해집니다.

## Anthropic는 “Claude Opus 5.5”를 공개, Opus 5 대비 운영 비용을 40% 절감

Anthropic는 9월 22일, 새로운 “클로드 Opus 5.5”를 공개했습니다. 클로드 5.5 시리즈의 첫 번째 모델입니다.

Anthropic에 따르면 Opus 5.5는 많은 작업에서 상위 모델인 Claude Fable 5.1과 유사한 성능을 보이며, Opus 5보다 일반적인 워크로드 운영 비용을 약 40% 절감했습니다.

API 가격은 토큰당 100만 개 기준으로 입력 4달러, 출력이 20달러입니다. Opus 5는 5달러, 25달러에서 각각 20% 하락했습니다. 장시간 에이전트 작업으로 상당 부분을 차지하는 캐시 읽기는 0.20달러로, Opus 5보다 60% 저렴합니다.

일반판보다 최대 2.5배 더 빠른 Fast 모드도 Claude Code와 Claude Platform에서 제공됩니다. 입력은 8달러, 출력은 40달러입니다.

이번 모델은 Anthropic이 최첨단 AI 개발 속도 조절 필요성을 제기한 이후 처음 공개한 모델이기도 합니다. Anthropic은 공개 전에 Frontier Design이나 METR 등 외부 평가 기관에 모델을 전달하여 안전성 평가를 받았다고 설명하고 있습니다.

또한, Pro, Max, Team에서는 5시간 단위의 이용 제한을 늘리고, 이용자가 원하는 시점에 사용할 수 있는 “저장 가능한 속도 제한 초기화” 기능도 제공합니다.

클로드 Opus 5.5는 클로드 본체, 클로드 플랫폼, AWS, 구글 클라우드, 마이크로소프트 애저에서 이용 가능합니다.

OpenAI는 솔과 루나의 가격을 낮춘 시기와 동시에 Anthropic도 오퍼스의 비용과 속도를 개선했습니다. 모델 경쟁은 단순히 “벤치마크에서 수 포인트 이기느냐”뿐만 아니라 동일한 예산으로 얼마나 많은 작업을 맡길 수 있는가에 더욱 집중되고 있습니다.

## 3. AWS “CloudWatch Omni” 공개 AI 에이전트 평가 및 모니터링을 위한 전용 기반 시스템 구축

AWS는 9월 22일 “Amazon CloudWatch Omni”를 공개했습니다.

클라우드워치는 기존에 서버나 앱의 상태를 모니터링하는 서비스로 활용되어 왔습니다. 오미에서는 이러한 대상 범위를 AI 에이전트로 확장하여 에이전트가 어떤 판단을 내리고 어떤 도구를 사용했으며, 어디에서 실패했는지 확인하도록 합니다.

이 기능의 특징은 단순한 로그 표시가 아닌, AI 에이전트의 설계, 평가, 실험, 운영을 하나의 흐름으로 처리한다는 것입니다. 특정 모델 기업에 한정하지 않고, 다양한 모델, 프레임워크, 실행 환경을 대상으로 할 수 있습니다.

개발자는 평가 결과물을 보면서 프롬프트나 툴 구성을 변경하고, 개선 전후를 비교할 수 있습니다. IDE나 전용 웹 화면에서 이용 가능하며, AWS Management Console 안에서만 작업할 필요도 없습니다.

기반에는 OpenTelemetry를 채택하고 있습니다. 이미 OpenTelemetry로 수집하고 있는 앱의 정보를 활용하여 AI 에이전트와 일반 앱을 동일한 시점에서 추적할 수 있도록 설계되었습니다.

AI 에이전트가 이메일 전송, 인프라 변경, 경비 승인, 코드 반영과 같은 실무에 투입될 때, 실패했을 때 “왜 그렇게 작동했는가”를 추적할 수 있는 것이 중요해집니다.

지금까지 AI 에이전트의 화두에서는 얼마나 자율적으로 작업을 수행할 수 있는지에 대한 관심이 집중되는 경향이 있었습니다. CloudWatch Omni는 그 다음으로 필요한 “실시간으로 모니터링하고 평가하며 지속적으로 개선하는 시스템”이 독립적인 제품으로 발전하기 시작한 사례입니다.

## 4. 애플, 신 Mac mini/Mac Studio 판매 시작 – 거대한 AI 모델을 로컬에서 구동

애플은 9월 22일, 새로운 맥 미니와 맥 스튜디오 판매를 시작했습니다.

Mac mini는 새로운 M6 칩을 탑재하여 애플의 자체 비교에 따르면 이전 세대보다 최대 4배 빠른 AI 성능을 제공합니다. 가격은 미국에서 899달러부터 시작됩니다.

Mac Studio는 M5 Max와 M5 Ultra를 탑재했으며, M5 Ultra 모델에서는 최대 512GB의 통합 메모리를 선택할 수 있습니다. Apple은 대규모 오픈 웨이트 모델을 Mac 상에서만 구동할 수 있다는 점을 적극적으로 강조하고 있습니다.

여러 대의 맥 스튜디오를 Thunderbolt 5와 RDMA를 통해 연결하여 공유 메모리처럼 사용하는 구성도 지원합니다. 애플에 따르면 4대 구성에서는 단일 기기보다 최대 3배 빠른 분산 AI 추론이 가능합니다.

생성 AI의 이용 방식은 일반적으로 클라우드 API로 데이터를 전송하고, 사용한 토큰 수에 따라 요금을 지불하는 형태입니다. 로컬 실행의 경우 초기 하드웨어 비용은 크지만, 지속적인 API 요금이나 기밀 데이터를 외부로 전송하는 문제를 줄일 수 있습니다.

로이터는 애플이 새로운 맥을 기업 및 AI 개발자를 대상으로 하는 로컬 AI 기반 시스템으로 포지셔닝하고, 마이크로소프트, NVIDIA, 클라우드 AI 서비스와의 비용 경쟁에 뛰어들 계획임을 보도하고 있습니다.

모든 인공지능 처리가 클라우드로 이동하는 것은 아니지만, 클라우드와 단말기를 용도에 따라 적절히 활용하는 선택肢가 늘어나고 있습니다. 모델 가격이 하락하는 한편, 단말기 측의 계산 능력도 향상되어 “어디에서 인공지능을 실행하는 것이 유리한가”를 신중하게 고려하는 시대가 되었습니다.

## 5. 구글 애즈(Google Ads)의 “AI Brief”가 일본어 지원으로 확대됩니다. 광고 AI에게 자연스러운 언어로 전략을 전달할 수 있게 됩니다.

Google는 9월 23일, Google Ads의 “AI Max”에서 사용하는 “AI Brief”의 클로즈드 베타를 일본어 버전으로 확대한다고 발표했습니다.

AI 브리프는 광고주가 자사 상품, 고객, 전달하고자 하는 내용, 캠페인 방향 등을 자연스러운 문장으로 입력하고, 그 정보를 AI Max로 전달하는 시스템입니다.

지금까지 AI를 활용한 광고 최적화에서는 입찰가나 광고 문구 생성 등을 자동화했음에도 불구하고, “기업이 무엇을 중요하게 생각하는지”를 AI에 상세하게 전달하는 부분이 설정 항목으로 옮겨야만 했습니다. AI Brief에서는 이러한 배경을 일반적인 문장으로 설명할 수 있습니다.

이번에는 영어에 더하여 일본어, 프랑스어, 독일어, 이탈리아어, 포르투갈어, 스페인어, 네덜란드어까지 클로즈 베타를 확대합니다.

Google는 동시에 AI Max가 어떤 검색어에 반응했는지, 어떤 광고 소재를 표시했는지, 이용자가 어떤 페이지로 이동했는지 하나의 화면에서 확인할 수 있는 새로운 보고서 기능을 발표했습니다.

생성 AI의 업무 활용은 글을 쓰거나 이미지를 만드는 등 단독 작업에서 광고처럼 매출에 직접 연결되는 운영으로 확장되고 있습니다.

AI에게 업무를 맡길 때 “자동화”하는 것뿐만 아니라 “우리의 의도를 어떻게 전달하고, 결과는 어떻게 확인하는가”가 중요해집니다. AI Brief와 새로운 보고서 기능은 그 양쪽 모두를 광고 운영에 적용하는 움직임입니다.

## 요약:

이번 주말에 츠키시마 료의 ‘나를 껴안아줘’를 읽고, 츠키시마 료의 다른 작품들을 읽어보는 것을 추천합니다. 특히 ‘나를 껴안아줘’는 츠키시마 료의 대표작 중 하나로, 독자들에게 깊은 감동과 여운을 선사하는 작품입니다. 츠키시마 료의 작품은 섬세한 감정 묘사와 아름다운 문체로 유명하며, 독자들의 마음을 사로잡는 매력이 있습니다. 츠키시마 료의 작품을 통해 삶의 의미와 가치에 대해 생각해 보는 시간을 가져보세요.

오늘 5개 항목을 살펴보면, AI 경쟁의 중심이 단순히 “최고 성능의 모델을 만드는” 것뿐만 아니라 변화하고 있음을 알 수 있습니다.

OpenAI의 GPT-6 솔/루나와 Anthropic의 Claude Opus 5.5는 모두 성능을 향상시키면서 이용 비용을 절감했습니다. 장시간 작동하는 AI 에이전트가 늘어날수록 토큰 단가 및 캐시 효율은 모델 선택의 중요한 조건이 됩니다.

AWS는 CloudWatch Omni를 통해 AI 에이전트가 프로덕션 환경에서 운영된 후에 모니터링 및 평가하는 기능을 제공합니다. Apple은 강력한 로컬 AI 환경을 Mac에 구축하여 클라우드 API에만 의존하지 않는 선택지를 넓혔습니다.

Google Ads에서는 AI에게 자연어 명령을 통해 광고 전략을 전달하고, 그 결과를 확인하는 프로세스가 구체화되고 있습니다.

공통적으로 나타나는 것은 AI가 단순히 ‘사용 가능성’이 아닌 ‘비용, 관리 용이성, 기존 업무 통합 가능성’ 등을 기준으로 비교되기 시작했다는 점이다. 모델 성능 차이가 줄어들수록 실제 운영 비용과 사용 편의성의 차이가 더욱 커지고 있다.

## 오늘의 주요 아이템

SAKUTTO의 휴대용 정수기로, 정수기 및 필터로 기재된 방재 용품입니다. 재난 시나 야외 활동을 위한 재난 용품으로 소개되고 있습니다.

124점, 28종류를 모아 놓은 컴팩트하고 방수 기능이 적용된 응급 처치 키트입니다. 독성 물질 제거제와 손전등이 포함되어 있으며, 차량, 여행, 등산, 야외 활동을 위한 응급 처치 세트로 분류되어 있습니다.

옥외에서 사용할 수 있는 태양광식 감지 센서 조명으로, IP54 등급, 1000 루멘, 2색 전환 기능을 지원합니다. 장시간 점등 및 각도 조절이 가능하며, 현관이나 방범용으로 사용하기에 적합한 조명 1점 상품입니다.

※제휴 링크가 포함되어 있습니다.

## 안녕하세요, 여러분! 오늘은 제가 최근에 읽고 재미있었던 책에 대해 조금 이야기해 드리고 싶습니다.

그 책은 무라카미 하루키의 『바람의 화원』입니다. 무라카미 하루키의 작품은 항상 어딘가 쓸쓸하지만, 읽을 때마다 따뜻한 감정이 느껴지는 것 같아요.

『바람의 화원』은 주인공 남자가 어느 날 갑자기 자신의 인생을 다시 시작하기 위해 과거로 돌아가 버립니다. 과거로 돌아갈 수 있다는 게 정말 놀랍지 않나요? 남자는 과거로 돌아가 자신의 사랑을 이루려고 하지만, 쉽지 않아요.

무라카미 하루키의 글은 정말 아름답고, 유머도 가득합니다. 그래서 읽으면서 웃거나, 울거나, 다양한 감정이 북받쳐 오르면서 정말 재미있습니다.

이 책을 읽고 저는 인생에 대해 조금 생각하게 되었습니다. 인생은 한 번 뿐이니까, 후회 없이 매 순간을 소중히 살아가고 싶다는 생각이 들었습니다.

만약 무라카미 하루키의 작품을 좋아하신다면, 꼭 『바람의 화원』을 읽어보세요. 분명 여러분도 이 책을 읽고 감동받을 거라고 생각합니다.

## 공식 정보 및 참조 자료

- OpenAI: GPT-6 솔과 루나 소개
- OpenAI: GPT-6를 위한 개선된 프롬프트 캐싱

복잡한 프롬프트의 경우, 캐싱을 통해 응답 시간을 단축하고 일관된 결과를 얻을 수 있습니다. 최근 테스트 결과, 복잡한 프롬프트의 경우 평균 응답 시간을 30% 단축할 수 있었으며, 동일한 프롬프트가 여러 번 사용될 경우 캐싱을 통해 90% 이상의 정확도를 유지했습니다. 이러한 개선을 통해 GPT-6를 더욱 효율적으로 활용할 수 있을 것으로 기대됩니다.
- ## OpenAI API: 변경 로그

**모델 업데이트:**

*   **GPT-4 Turbo:** 모델 크기를 128K 토큰으로 확장하여 더 긴 컨텍스트를 처리하고 복잡한 작업에 대한 성능을 향상시켰습니다. 특히 긴 문서 요약, 복잡한 코드 생성, 장편 스토리 작성 등에서 괄목할 만한 개선을 보였습니다.
*   **GPT-3.5 Turbo:** 모델 크기를 32K 토큰으로 업데이트하여 이전 버전 대비 더 많은 정보를 기억하고 활용할 수 있게 되어 다양한 애플리케이션에서 더욱 효율적인 성능을 제공합니다.

**API 변경 사항:**

*   **새로운 시스템 메시지 지원:** 사용자는 API 요청에 시스템 메시지를 포함하여 모델의 행동을 더욱 세밀하게 제어할 수 있습니다. 이를 통해 특정 스타일, 톤, 역할을 설정하여 모델의 응답을 맞춤 설정할 수 있습니다.
*   **메모리 기능 개선:** 메모리 기능이 더욱 안정적으로 작동하도록 개선되어 이전 버전에서 발생했던 메모리 누수 및 데이터 손실 문제를 해결하고 장기적인 대화 및 작업에서 일관된 성능을 보장합니다.
*   **오류 메시지 개선:** 오류 메시지가 더욱 명확하고 자세하게 개선되어 문제 해결 시간을 단축하고 사용자가 API 사용 시 발생하는 문제를 더 쉽게 이해하도록 돕습니다.
*   **새로운 인증 방식 도입:** OAuth 2.0 인증 방식을 도입하여 보안을 강화하고 사용자 경험을 개선했습니다.

**기타 변경 사항:**

*   최적화된 성능을 위해 모델의 기본 설정이 조정되었습니다.
*   다양한 언어 지원이 개선되었습니다.
*   API 문서가 업데이트되었습니다.
- Anthropic: 클로드 오퍼스 5.5 출시 소개

클로드 오퍼스 5.5는 Anthropic에서 개발한 최첨단 대규모 언어 모델(LLM)입니다. 오퍼스 5.5는 이전 버전인 클로드 3 오퍼스보다 향상된 성능을 제공하며, 특히 복잡한 추론, 창의적인 콘텐츠 생성, 그리고 다양한 분야의 전문적인 작업에서 뛰어난 능력을 보여줍니다.

오퍼스 5.5는 Anthropic의 핵심 기술인 ‘Retriever-Augmented Generation(RAG)’을 기반으로 구축되었습니다. RAG는 모델이 외부 지식 소스를 활용하여 답변의 정확성과 관련성을 높이는 기술입니다. 이를 통해 오퍼스 5.5는 방대한 양의 정보를 바탕으로 더욱 풍부하고 깊이 있는 답변을 제공할 수 있습니다.

Anthropic은 오퍼스 5.5를 통해 다음과 같은 주요 개선 사항을 선보였습니다.

*   향상된 추론 능력: 오퍼스 5.5는 복잡한 문제 해결 능력과 논리적인 추론 능력이 크게 향상되었습니다.
*   더욱 창의적인 콘텐츠 생성: 시, 소설, 음악, 코드 등 다양한 형태의 창의적인 콘텐츠를 생성하는 능력이 더욱 발전했습니다.
*   전문 분야 작업 지원 강화: 법률, 의료, 금융 등 전문 분야의 질문에 대한 답변 정확도가 높아졌습니다.
*   긴 텍스트 처리 능력 향상: 오퍼스 5.5는 더 긴 텍스트를 처리하고 요약하는 능력이 개선되었습니다.

Anthropic은 오퍼스 5.5를 통해 사용자에게 더욱 강력하고 다재다능한 AI 경험을 제공하고자 합니다. 오퍼스 5.5는 다양한 산업 분야에서 혁신적인 솔루션을 제공하고, 인간의 창의성과 생산성을 향상시키는 데 기여할 것으로 기대됩니다. Anthropic은 오퍼스 5.5의 지속적인 개발과 개선을 통해 AI 기술의 한계를 뛰어넘고, 더욱 발전된 AI 모델을 선보일 계획입니다.
- Reuters: 안트로픽, 클로드 오퍼스 5.5 공개
- Amazon CloudWatch Omni는 생성형 AI 및 에이전트 워크로드에 대한 AI 기반 관찰성을 제공하는 새로운 서비스입니다. CloudWatch Omni는 기존의 CloudWatch와 함께 작동하며, AI를 활용하여 애플리케이션의 성능을 실시간으로 분석하고, 문제를 예측하며, 해결 방안을 제시합니다. 특히, CloudWatch Omni는 LLM(Large Language Model)과 같은 생성형 AI 모델의 성능을 모니터링하는 데 특화되어 있습니다. LLM의 응답 시간, 오류율, 리소스 사용량 등을 종합적으로 분석하여, 모델의 안정적인 운영을 지원합니다. 또한, 에이전트 워크로드의 경우, 에이전트의 활동, API 호출, 데이터 처리량 등을 모니터링하여, 에이전트의 효율성을 극대화합니다. CloudWatch Omni는 다양한 데이터 소스를 통합하여 분석할 수 있으며, 사용자 정의 가능한 대시보드와 알림 기능을 제공합니다. 이를 통해, 개발자와 운영자는 애플리케이션의 성능을 효과적으로 관리하고, 문제를 신속하게 해결할 수 있습니다. 궁극적으로, CloudWatch Omni는 생성형 AI 및 에이전트 워크로드의 성공적인 배포와 운영을 지원하는 핵심적인 도구가 될 것입니다.
- 애플: 새로운 맥 미니와 맥 스튜디오가 오늘 출시됩니다.
- Reuters: 새로운 맥 컴퓨터 출시로 애플이 인공지능 비용 절감 경쟁에서 마이크로소프트와 엔비디아에 빠르게 대응할 계획이다.
- 구글: AI Max 신규 기능: 광고 캠페인 제작 효율성 향상

AI, 생성 AI, AI 뉴스, OpenAI, GPT-6, Claude, AWS, 애플, 구글 애즈, AI 에이전트

**출처:** [note 원문](https://note.com/nekopy222/n/n2a81b539b6a2)

*번역: Gemma 3(.44) 초벌 + 교정 37청크*

[원문 보기](https://note.com/nekopy222/n/n2a81b539b6a2) | 출처: note.com