서론
생성 AI 업계는 “1주일 동안 쉬었다가 浦島太郎가 되는” 정도의 속도로 움직이고 있습니다. 이번에는 2026년 7월 28일 ~ 8월 2일, 1주일 동안 텍스트, 이미지, 음성, 비디오, 코딩 에이전트의 5가지 분야에 대해 SaaS(클라우드 서비스), OSS(오픈 소스), 로컬 모델(온디바이스 실행)의 3가지 측면에서 동향을 정리했습니다. 각 서비스의 가격 정보와 가능한 한 객관적인 정밀도 평가(벤치마크 점수)도 함께 기재했습니다.
정보 출처는 TechCrunch, VentureBeat, MarkTechPost, 각 사 공식 발표, 벤치마크 전문 사이트(Artificial Analysis 등)를 중심으로 수집하고 있습니다. 다만 일부 수치 및 모델명은 정보 출처 간에 차이가 있어, 해당 경우에는 “※미확인”으로 명시하고 있습니다. 비즈니스 판단에 사용하실 때는 반드시 원본 정보를 확인해 주시기 바랍니다.
텍스트 기반 AI(LLM·챗봇) 동향
SaaS(클라우드 서비스)는 소프트웨어의 한 종류로, 인터넷을 통해 제공되는 서비스입니다. 사용자는 별도의 설치 없이 웹 브라우저를 통해 소프트웨어를 사용할 수 있으며, 데이터는 클라우드 서버에 저장됩니다.
SaaS는 기업이나 개인에게 다양한 기능을 제공하며, 비용 효율성, 유연성, 접근성 등의 장점을 가지고 있습니다. 예를 들어, 이메일 서비스, 협업 도구, CRM(고객 관계 관리) 시스템 등이 SaaS 형태로 제공되고 있습니다.
최근에는 클라우드 기술의 발전과 함께 SaaS 시장이 급성장하고 있으며, 앞으로도 더욱 다양한 분야에서 SaaS 서비스가 등장할 것으로 예상됩니다. 특히, 스타트업이나 중소기업에게 SaaS는 초기 투자 비용을 절감하고 빠르게 사업을 확장할 수 있는 좋은 방법이 될 수 있습니다.
이번 주 최대 변화는 요금 측면에서 있었습니다.
OpenAI는 7월 30일, GPT-5.6 패밀리 중 저가 모델 “루나(Luna)”를 80%, 중위 모델 “테라(Terra)”를 20% 인하했습니다. 루나는 100만 토큰당 입력 1달러/출력 6달러에서 0.2달러/1.2달러로, 테라는 2.5달러/15달러에서 2달러/12달러로 크게 낮아졌습니다. 최고급 모델 “솔(Sol)” 자체의 가격은 동일하게 유지되었지만, 대신 응답 속도를 최대 2.5배로 늘리는 “퍼스트 모드(Fast Mode)”(기본 요금의 2배)가 신설되어 기존의 “프리미엄 처리(Priority Processing)”를 대체했습니다. 가격 인하 정책은 ChatGPT Work 및 Codex 이용량 카운트에 자동으로 반영되는 시스템입니다.
Anthropic은 7월 28일, MCP(Model Context Protocol)의 신규 사양 “MCP 2026-07-28”에 대한 대응을 발표했습니다. 양방향의 스테이트풀한 프로토콜에서 서버리스 환경에서도 유연하게 작동할 수 있는 요청/응답형 “스테이트리스 코어”로 전환하며, OAuth/OIDC를 통한 인증 강화, 임베디드 UI 및 사설 네트워크 터널 등 연결 기능 확장에 힘썼습니다. MCP은 월간 SDK 다운로드 수가 4억 건을 넘어 올해 들어 4배에 달하는 성장을 보입니다.
정책적인 측면에서는 Anthropic CEO 다리오 아모데이 씨가 7월 27일, 오픈 웨이트 모델에 대한 자사의 입장을 공식 블로그에서 명확히 했습니다. “위험한 능력을 갖지 않은 오픈 웨이트 모델은 공공재이다”라고 하면서, Anthropic은 오픈 웨이트 모델의 금지를 주장한 적이 한 번도 없다고 명시했습니다. 이는 NVIDIA의 제ンスン·フアン CEO 등이 주도하고, Meta, Microsoft, Mistral, Hugging Face 등 다수의 기업이 서명한 “오픈 웨이트 모델에 대한 섣부른 규제에 반대한다” 공동 성명(7월 24일)에 대한 반론이라는 맥락에서, Anthropic은 동 성명에 불참이 화제가 되고 있었습니다. 아모데이 氏はむしろ、첨단 반도체의 대중 수출 규제 강화와 위험한 능력을 갖춘 모든 모델(오픈·클로즈드 무관하게)에 대한 안전성 검사 의무화가 우선 과제라고 강조했습니다.
요금
본 기사의 GPT-5.6 가격은 2026년 7월 30일 가격 개정 이후 API 가격입니다. OpenAI 제품 소개 페이지에는 출시 시 가격이 남아있는 페이지도 일부 있으므로, 참조 시 유의해 주십시오. 이하의 내용은 100만 토큰당의 입력 및 출력입니다.
- GPT-5.6 루나: 입력 0.20/출력 1.20 (7월 30일 80% 할인, 이전 가격은 1/6 달러)
- GPT-5.6 테라: 입력 2 / 출력 12 (7월 30일, 기존 가격 2.50/15 대비 20% 인하)
- GPT-5.6 솔루션: 입력 5원, 출력 30원에 고정. Fast 모드는 기본 요금의 2배.
- 키미 K3 API: 입력 3달러 / 출력 15달러, 캐시 입력 0.30달러 (클로드 손네트 5와 동급 수준)
오픈 소스 모델
지난주 예고되었던 무나카미 하루키의 ‘키미 K3’가 7월 27일 드디어 공식적으로 가중 공개되었습니다. 2.8조 파라미터(활성 10억 4천만)의 Mixture-of-Experts 모델로, 96분할·약 1.56TB의 파일이 Hugging Face에 공개되었습니다. 여기서 ‘2.8조’는 총 파라미터 수이며, 실제로 추론 시에 사용되는 것은 일부의 전문가(익스파트) 네트워크뿐이므로, 실질적인 계산량에 가까운 것은 활성 파라미터의 약 10억 4천만이라는 숫자입니다. 라이선스는 수정 MIT가 아닌 독점적인 ‘키미 K3 라이선스’이며, 연간 매출 2천만 달러 초과 모델 제공 사업 또는 월간 활성 사용자 1억 명 초과·월 매출 2천만 달러 초과 제품에는 별도 계약이 필요하다는 조건입니다. 과거 최대 규모의 오픈 웨이트 모델로 평가받고 있습니다.
인공지능 분석 지수는 57점을 기록했으며(2026년 8월 2일 기준), 오픈 웨이트의 1위를 유지하고 있습니다. 이 지수는 업데이트 빈도가 높아 본 기사 공개 이후 수치가 변동될 수 있다는 점을 유념해 주시기 바랍니다. 반면, 동일사의 AA-Omniscience 벤치마크에 따른 환각률(하르시네이션률)은 약 51%로, 전세대 Kimi K2.6의 39%에서 12% 상승했다는 보고도 있습니다(※Moonshot 공식 벤치마크 자료에는 기재되지 않았으며, 독립 측정에 의한 수치). 사실 정확도 자체는 33%에서 46%로 향상되었으며, “똑똑해졌지만, 잘못된 경우 단정하는 빈도도 늘었다”는 평가가 제시되었습니다. 참고로 Claude Fable 5의 동 지표는 54.9%로 나타났으며, 절대적인 수치로는 유사한 수준이지만, 평가 세트와 프롬프트 조건이 완전히 일치하지 않아 모델 간의 단순한 우열 비교로는 다루지 않는 것이 안전합니다.
더 주목할 만한 점은 Mira Murati氏가 이끄는 Thinking Machines Lab이 7월 30일에 공개한 “Inkling-Small”입니다. 7月中旬에 공개된 975B 파라미터(활성화 41B)의 Mixture-of-Experts 모델 “Inkling”의 경량화 버전으로, 276B 파라미터(활성화 12B)임에도 불구하고 본체와 거의 동일한 성능을 목표로 합니다. Apache 2.0 라이선스의 완전한 오픈 웨이트 모델로, Hugging Face에서 즉시 다운로드 가능하며, 해당 회사의 학습 플랫폼 “Tinker”에서의 미세 조정에도 바로 대응합니다. 인공 분석 지능 지수에서는 약 40점을 기록했으며, 본체 Inkling(41점)에 근접한 수치입니다. 미국에서 개발된 오픈 웨이트 모델로서, Nemotron 3 Ultra와 Gemma 4를 포함한 선택지가 다양해졌습니다.
알리바바는 7월 27일, 시각 언어 모델 “Qwen3.7 Flash”를 API 제한적으로 공개했습니다. 100만 토큰 컨텍스트와 영상 입력 대응이 특징이며, 가격은 입력 $0.03/출력 $0.13이라는 파격적으로 저렴하지만, 가중치 공개는 없고, 공식적인 벤치마크 수치는 아직 나오지 않았습니다.
지역 LLM/온디바이스
이번 주에는 대규모 신규 로컬 배포 건을 확인할 수 없었습니다. Qwen3.6 27B, Gemma 4 26B-A4B 등이 지속적으로 실용적인 수준의 모델로 자리 잡고 있습니다. Kimi K3의 가중치 공개로 자체 호스팅이 가능해졌지만, 공식에서 권장하는 구성은 64개 이상의 가속기를 탑재한 “슈퍼노드”이며, 개인의 로컬 환경보다는 기업의 자체 호스팅 영역에 적합하다고 볼 수 있습니다.
정밀도 평가
인공지능 분석 지수에서는 Kimi K3(57)가 오픈웨이트 부문에서 1위를 유지하는 가운데, 미국에서 나온 Inkling-Small(약 40)이 새로운 선택지로 추가되었습니다. 중국 세력과의 점수 차이는 여전히 존재하지만, 개발자의 다양한 오픈웨이트 세력이 두터워지고 있다는 인상이 있습니다.
Kimi K3의 독립 벤치마크에서 나타난 환각률 상승은 “점수만으로 도입 여부를 판단할 경우 간과할 수 있는 위험이 있다”는 점을 시사합니다. 특히 사실 쿼리 기반의 작업에 활용할 때는 자체 평가 세트에서의 검증을 지속적으로 권장합니다.
GPT-5.6 Luna의 가격 인하는 요약, 분류, 정형적인 코드 변경 등 대량의 API 처리를 수행하는 워크로드에게 특히 큰 영향을 미칩니다. 반면, 정확도가 요구되는 업무에서는 Terra와 Sol의 활용 방식 결정(라우팅)이 더욱 중요해질 것으로 보입니다.
2. 이미지 기반 인공지능 동향
어느 날, 나는 ‘카호’의 소설을 읽고 있었다. 꽤 오랫동안 멈춰있던 독서 습관을 되살린 건 우연한 계기로 접하게 된 SaaS 서비스였다. 솔직히 말해서, 나는 ‘무라카미 하루키’처럼 복잡하고 난해한 문체를 좋아하지 않는다. 오히려, 쉽고 명쾌한 설명으로 빠르게 문제를 해결해주는 서비스에 더 끌린다.
SaaS는 ‘무라카미 하루키’의 소설처럼 깊이 있는 철학을 담고 있는 것이 아니다. 오히려, 마치 ‘카호’가 겪는 것처럼, 일상적인 문제들을 해결해주는 실용적인 도구라고 생각한다. 특히, ‘무라카미 하루키’의 작품처럼, 낭만적인 감성을 자극하는 것보다는, 효율적인 업무 처리를 돕는 데 초점을 맞춘 서비스가 더 유용하다.
나는 SaaS를 통해 업무 효율성을 높이고, 시간을 절약하며, 더 중요한 일에 집중할 수 있게 되었다. 마치 ‘카호’가 삶의 새로운 가능성을 발견하는 것처럼, SaaS는 나에게도 새로운 기회를 제공하고 있다. 앞으로도 나는 SaaS를 통해 끊임없이 성장하고 발전할 것이다.
이번 주에도 대규모 신제품 발표는 없었고, 기존 모델의 평가가 확립된 주였습니다. 인공지능 분석 이미지 아레나(8월 시점)에서는 “GPT Image 2(high)”가 Elo 1339로 1위를 유지하고 있으며, 지난 주와 비교하여 순위에서 큰 변화는 없습니다. 2위는 “Reve 2.1”(Elo 1299), 3위는 “MAI-Image-2.5”(Elo 1270)라는 구도가 이어지고 있습니다.
이미지 편집 아레나에서도 “GPT Image 2(high)”가 1위를(Elo 1259) 기록했으며, “GPT Image 1.5(high)”, “MAI-Image-2.5”, “Nano Banana 2”, “Seedream 5.0 Pro”가 근소한 차이로 뒤를 추격하는 흐름입니다. 오픈 웨이트 세력에서는 “HunyuanImage 3.0 Instruct”가 Elo 1223점으로 1위를 차지하고 있습니다.
요금
지난주부터 큰 변동은 확인되지 않았습니다. 어도비 파이어플라이의 각 플랜(Standard $9.99/월, Pro $19.99/월, Premium $199.99/월)과 FLUX.2의 API 과금(Pro 버전 1매당 약 $0.055 등)은 유지되고 있습니다.
오픈 소스 모델, 로컬 실행
블랙 포레스트 랩스의 “FLUX.2”、 알리바바의 Qwen-Image 시리즈, 텐센트의 HunyuanImage 3.0을 중심으로 한 구도가 이어지고 있습니다. 대규모의 신규 OSS 이미지 모델 발표는 이번 주에는 확인되지 않았습니다. ComfyUI의 안정적인 운영과, Stability AI 및 NVIDIA의 협업에 따른 TensorRT+FP8 최적화도 정규 구성으로 계속해서 활용되고 있습니다.
정밀도 평가
GPT 이미지 2가 3개월 이상 1위를 지키고 있으며, 2위 이하와의 격차가 줄어드는 조짐은 아직 보이지 않습니다. 종합력으로는 GPT 이미지 2, 신흥 세력으로서 Reve·MAI-Image-2.5, 오픈 웨이트의 선택지로서 FLUX, 사실감 및 편집력에서는 Google 계열이라는 구도에, 이번 주에도 큰 변화는 없었습니다.
이미지 기반 콘텐츠는 움직임이 적었던 주였지만, 반대로 살펴보면 GPT Image 2의 우위가 구조적인 수준으로 확고해지고 있다고 해석할 수 있습니다. 신규 도입을 고려한다면, 오히려 “조용한 주” 시점에 기존 모델의 평가가 확고한 상태를 확인해 두는 것이 좋습니다.
3. 음성 기반 AI의 동향
최근 몇 년간 음성 기반 AI 기술은 놀라운 속도로 발전해 왔습니다. 특히, 자연어 처리 기술의 발전과 함께 음성 인식 정확도가 크게 향상되면서, 다양한 분야에서 활용 가능성이 높아지고 있습니다.
가장 주목할 만한 것은 스마트 스피커 시장의 성장입니다. 아마존의 에코, 구글의 홈, 애플의 홈팟 등 다양한 스마트 스피커가 출시되면서, 음성 명령을 통해 음악 재생, 정보 검색, 스마트 홈 기기 제어 등 다양한 기능을 사용할 수 있게 되었습니다. 이러한 스마트 스피커는 단순한 엔터테인먼트 기기를 넘어, 일상생활의 편리성을 높이는 핵심적인 역할을 수행하고 있습니다.
또한, 음성 기반 AI는 차량 내 인포테인먼트 시스템, 고객 상담 서비스, 챗봇 등 다양한 분야로 확장되고 있습니다. 특히, 자율 주행 기술과 연계하여 음성 명령을 통해 차량의 기능을 제어하고, 운전자의 안전을 지원하는 시스템 개발이 활발하게 진행되고 있습니다.
하지만 음성 기반 AI 기술은 아직 해결해야 할 과제도 많이 남아 있습니다. 음성 인식 정확도 향상, 다양한 억양과 방언에 대한 대응, 개인 정보 보호 문제 등 해결해야 할 문제들이 산적해 있습니다.
향후 음성 기반 AI 기술은 더욱 발전하여 우리의 삶에 더욱 깊숙이 자리 잡을 것으로 예상됩니다. 특히, 인공지능과 인간의 상호작용 방식에 대한 새로운 가능성을 제시하며, 우리의 삶을 더욱 편리하고 풍요롭게 만들어 줄 것입니다.
지난 10년간의 SaaS 성장 추세는 놀랍습니다. 2013년에는 SaaS 시장 규모가 약 2,000억 엔이었지만, 2023년에는 15조 엔 이상으로 급증했습니다. 이러한 성장의 배경에는 클라우드 컴퓨팅 기술의 발전과 함께 기업들이 IT 비용 절감 및 유연성을 확보하고자 SaaS 솔루션 도입을 적극적으로 추진했기 때문입니다.
특히 최근에는 인공지능(AI) 기술과 SaaS의 결합이 새로운 성장 동력으로 부상하고 있습니다. AI 기반의 SaaS 솔루션은 업무 자동화, 데이터 분석, 고객 서비스 등 다양한 분야에서 혁신적인 변화를 가져오고 있으며, 기업들의 생산성 향상에 크게 기여하고 있습니다.
무라카미 하루키는 이러한 변화의 흐름을 반영하듯 자신의 작품에 클라우드, 데이터, AI 등 현대 기술을 활용한 소재를 적극적으로 활용하고 있습니다. 그의 작품 ‘카호’ 역시 디지털 시대의 소통 방식과 인간 관계에 대한 질문을 던지는 점에서 의미가 있습니다. 2024년에는 무라카미 하루키의 새로운 작품이 출간될 예정이며, 그의 작품이 SaaS 시장의 미래를 어떻게 조망할지 귀추가 주목됩니다.
이번 주에는 음성 기반 AI의 대규모 신제품 발표는 적고, 대체로 조용한 한 주였습니다. 지난 주말에 알리바바가 출시한 “Qwen-Audio-3.0-TTS”(실시간에 적합한 Flash, 고품질에 적합한 Plus, 16개 언어 + 중국 방언 20개 지역 대응) 도입이 계속해서 주목받고 있으며, ElevenLabs와 비교했을 때 70% 전후로 저렴하다는 비교 기사도 나오고 있습니다.
OpenAI의 풀 듀플렉스 음성 모델 “GPT-Live”나 Anthropic의 음성 모드는 지난주에 출시된 기능의 정착 단계에 접어들었으며, “배경에서 움직이는 에이전트를 음성으로 어떻게 감독할 것인가”라는 주제가 여전히 중요하게 다루어지고 있습니다.
요금
TTS API 시장은 지난주부터 큰 변동이 없습니다. 표준 음성의 가격이 100만 문자당 약 4달러, 뉴럴 음성의 가격이 16달러 정도의 수준으로 유지되고 있습니다.
오픈 소스 모델/로컬
Whisper Large-v3, 경량 TTS 모델인 “코코로-82M”, ゼロショット 음성 클론 대응 모델 “챗터박스” 등, 기존 인기 모델 라인업에는 변화가 없었습니다. “문샤인”이나 “킷턴 TTS”와 같은 경량 로컬 모델의 구성도 마찬가지였습니다.
정밀도 평가
음성 AI는 이번 주에도 각 사별 자체 벤치마크가 중심이며, 제3자 중립 기관에 의한 대규모 비교는 제한적이라는 상황이 지속되고 있습니다. 풀 듀플렉스형 모델이 늘어남에 따라 자연스러움(MOS)뿐만 아니라, 간섭 저항성과 레이턴시와 같은 지표의 중요성이 커지고 있습니다.
Qwen-Audio-3.0-TTS와 같은 비용 효율적인 모델이 등장하면서 기존에 ElevenLabs를 유일한 선택지로 사용하고 있었던 구성도 재검토할 가치가 있습니다. 하지만 벤더 간의 가격 비교는 측정 조건(음성 길이, 언어, 품질 설정)이 일치하지 않는 경우가 많아 자체 사용 사례에서 직접 측정하는 것이 필수적입니다.
4. 영상 기반 AI의 동향
최근 영상 기반 AI 기술이 급격하게 발전하면서 콘텐츠 제작 방식에 큰 변화가 예상된다. 특히 숏폼 영상 플랫폼의 인기와 함께 AI가 자동으로 영상 콘텐츠를 생성하는 기술이 주목받고 있다.
이러한 기술 발전은 광고, 마케팅, 교육 등 다양한 분야에 적용될 수 있을 뿐만 아니라 개인 창작자들에게도 새로운 기회를 제공할 것으로 보인다. 예를 들어 ‘무라카미 하루키’의 소설을 기반으로 한 AI가 생성한 영상, 혹은 ‘카호’ 주연의 숏폼 드라마 등 상상 이상의 콘텐츠 제작이 가능해지고 있다.
하지만 영상 기반 AI 기술의 발전은 동시에 윤리적인 문제점도 야기한다. AI가 생성한 영상의 저작권 문제, 허위 정보 유포 가능성, 인간 창작자의 역할 변화 등 다양한 논의가 필요하다.
또한 ‘나쓰메 소세키’의 『이끼』를 AI가 분석하여 생성한 영상 콘텐츠가 화제가 되기도 했다. 이처럼 AI는 기존의 콘텐츠를 재해석하고 새로운 콘텐츠를 창작하는 데 활용될 수 있으며, 앞으로 더욱 다양한 분야에서 활용될 것으로 기대된다.
최근 발표된 자료에 따르면 2024년 영상 기반 AI 시장 규모는 약 150억 달러로 예상되며, 2030년에는 1,000억 달러 규모로 성장할 것으로 전망된다. 이러한 성장세는 AI 기술의 지속적인 발전과 함께 영상 콘텐츠 시장 전체의 변화를 이끌어낼 것으로 보인다.
그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 마치 텅 빈 셔츠처럼, 그녀는 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다. 그녀는 마치 텅 빈 셔츠처럼, 텅 빈 공간을 채워 넣으려고 애썼다. 그녀는 마치 텅 빈 셔츠처럼, 끊임없이 무언가를 찾고 있었다.
이번 주 역시 영상 AI의 대형 신제품 발표는 적고, Runway Gen-4.5, Kling 3.0, Seedance 2.0 계열의 운영이 계속 이어졌습니다. OpenAI Sora는 웹 앱 종료 및 API 종료(9월 24일 예정)라는 확정된 경로대로 큰 변화는 없었습니다.
요금
클링 3.0(멀티샷 스토리보드 모드 포함 시 약 0.10/초), Veo 3.1(파스트 모드 시 0.15/초 ~), 런웨이(스탠다드 플랜 월 12~15 달러) 등 요금 체계에 큰 변화는 확인되지 않았습니다.
오픈 소스 모델·로컬 실행
LTX-2.3와 Wan 2.7가 계속해서 주력 모델입니다. 로컬 실행에서는 Tencent HunyuanVideo 1.5 등이 대표적인 구성으로 사용되고 있습니다. 대규모의 신규 OSS 비디오 모델의 출시가 이번 주에도 확인되지 않았습니다.
정밀도 평가
인공 분석 비디오 아레나(Image-to-Video, 음성 없음)에서는 “제미니 오미 플래시”(Elo 1368)가 1위를 유지하고 있습니다. 음성 포함 부문에서는 “드림이나 시드런스 2.0 720p”(Elo 1196)가 근소한 차로 1위입니다. 오픈 웨이트 세력에서는 음성 포함 부문에서 “LTX-2.3 Pro”(Elo 956)가 꾸준히 1위를 기록하지만, 클로즈드 모델과의 격차는 여전히 큰 상황입니다. 수치는 일일 업데이트이므로 참고용 스냅샷으로 확인해주세요.
영상 콘텐츠 분야는 다른 분야보다 클로즈드(폐쇄형)와 오픈 웨이트(개방형)의 성능 차이가 두드러지게 나타나는 상황이 지속되고 있습니다. 제작용으로는 클로즈드형을, 실험 및 연구용으로는 LTX나 Wan과 같은 오픈 소스(OSS) 기반을 구분하여 사용하는 것이 현재 현실적인 선택지처럼 보입니다.
코딩 에이전트 동향
최근 몇 년간 코딩 에이전트 시장은 급격한 성장을 보이고 있습니다. 특히 인공지능 기술의 발전과 함께 코딩 에이전트의 활용 범위가 넓어짐에 따라 기업들은 생산성 향상 및 비용 절감을 위해 코딩 에이전트 도입을 적극적으로 검토하고 있습니다.
현재 시장에서 가장 활발하게 활동하는 코딩 에이전트들은 ‘코드마스터’, ‘AI 코더’, ‘프로그래머봇’ 등이 있으며, 이들은 다양한 프로그래밍 언어를 지원하고 간단한 코드 생성부터 복잡한 알고리즘 개발까지 수행할 수 있는 능력을 갖추고 있습니다.
특히 ‘코드마스터’는 사용자 인터페이스(UI) 디자인 자동화 기능에 강점을 가지고 있으며, ‘AI 코더’는 자연어 처리(NLP) 기반의 코드 생성 능력이 뛰어납니다. ‘프로그래머봇’은 오픈 소스 프로젝트에 대한 기여를 통해 빠르게 성장하고 있습니다.
최근 조사에 따르면 코딩 에이전트 시장의 연간 성장률은 30% 이상으로 예상되며, 2025년에는 1조 원 규모를 넘어설 것으로 전망됩니다. 이러한 성장세는 코딩 에이전트 기술의 발전과 더불어 소프트웨어 개발 시장의 변화에 따라 더욱 가속화될 것으로 보입니다. 또한 코딩 에이전트의 활용은 단순 반복 업무 자동화뿐만 아니라 새로운 아이디어 창출 및 혁신적인 서비스 개발에도 기여할 것으로 기대됩니다.
무라카미 하루키는 최근 인터뷰에서 자신의 작품에 등장하는 ‘SaaS’ 개념이 사실은 ‘인간 관계’를 상징한다고 밝혔습니다. 그는 “나는 사람들이 서로 연결되고 소통하는 방식에 깊은 관심을 가지고 있으며, 특히 온라인 공간에서의 관계는 현실 세계와는 또 다른 방식으로 사람들을 변화시킨다”고 말했습니다.
무라카미 하루키는 자신의 소설 속 등장인물들이 SaaS를 통해 정보를 얻거나, 다른 사람들과 교류하는 모습을 자주 묘사했는데, 이는 인간 관계의 중요성을 강조하기 위한 것이었습니다. 그는 “SaaS는 단순히 소프트웨어의 이름이 아니라, 현대 사회에서 인간이 어떻게 연결되는지를 보여주는 상징”이라고 설명했습니다.
그는 특히 ‘카호’가 SaaS를 통해 새로운 사람들을 만나고, 자신의 삶에 변화를 가져오는 과정을 통해 인간 관계의 긍정적인 측면을 보여주었다고 평가했습니다. 그는 “카호의 이야기는 우리가 디지털 시대에도 인간 관계를 소중히 여기고 적극적으로 관계를 맺어야 함을 일깨워준다”고 덧붙였습니다.
이번 주 최대 화제는 마이크로소프트가 7월 27일에 발표한 사이버 보안 특화 모델 “MAI-Cyber-1-Flash”와, 이를 결합한 멀티 에이전트 취약점 관리 시스템 “MDASH” 및 자율형 보안 운영 기반 “Project Perception”이었습니다. MAI-Cyber-1-Flash는 137B 파라미터(활성 5B)의 전용 모델로, MDASH 내의 작업의 최대 90%를 담당하며, 난이도가 높은 나머지 10%는 GPT-5.4로 에스컬레이션하는 설계입니다. 이 조합으로 CyberGym 벤치마크 95.95%(마이크로소프트 공표치)를 기록했으며, 비용 면에서는 기존 구성 대비 50% 감축되었다고 마이크로소프트가 설명하고 있습니다. Project Perception은 8월 3일에 공개 미리보기가 시작될 예정입니다.
하지만 이 95.95%라는 수치는 7월 28일 기준으로 사이버짐의 공개 리더보드에는 반영되지 않았으며, 동시에 공개된 순위에서는 위즈의 “Atlas” 에이전트가 90.9%로 1위를 차지하고 있었고, 마이크로소프트 자체의 5월 시점의 제출 값도 88.4% 그대로 남아 있었습니다. 벤더 공표의 수치와 제3자 검증 사이에는 여전히 격차가 있는 점에 유의해야 합니다.
OpenAI의 7월 30일 GPT-5.6 Luna·Terra 가격 인하는 Codex 내 고빈도 코드 변경 작업 비용에 직접적인 영향을 미치면서, 코딩 에이전트 운영 비용 구조에도 영향을 미칠 것으로 보입니다.
요금
- GPT-5.6 루나/테라: 앞서 언급했듯이 7월 30일에 80%/20% 할인 적용되었으며, Codex 이용량 카운트에도 자동으로 반영됩니다.
- MAI-사이버-1-플래시(MDASH 경로를 통해): 마이크로소프트에서 발표한 내용에 따라 기존 구성 비율 50%의 비용 절감 효과를 보이며(구체적인 단가는 공개되지 않음).
최근 몇 년 동안 오픈 소스 모델 툴의 중요성이 급격히 증가했습니다. 특히 인공지능 분야에서 이러한 툴들은 개발자들에게 혁신적인 가능성을 제공하며, 비용 효율적인 솔루션을 제공합니다.
이러한 오픈 소스 모델 툴들은 다양한 형태로 존재합니다. 예를 들어, TensorFlow, PyTorch, Keras와 같은 딥러닝 프레임워크는 오픈 소스 모델을 구축하고 훈련하는 데 널리 사용됩니다. 또한, Scikit-learn과 같은 머신러닝 라이브러리는 다양한 알고리즘을 제공하여 데이터 분석 및 예측 모델링을 지원합니다.
이러한 툴들은 사용자 친화적인 인터페이스와 강력한 기능을 제공하여, 숙련된 개발자뿐만 아니라 초보자도 쉽게 사용할 수 있도록 설계되었습니다. 또한, 활발한 커뮤니티 지원을 통해 문제 해결 및 기술 지원을 받을 수 있습니다.
특히, 무라카미 하루키의 작품처럼 복잡하고 미묘한 감정을 표현하는 모델을 구축하는 데 오픈 소스 툴들은 유용합니다. 다양한 데이터셋과 알고리즘을 활용하여, 창의적인 결과물을 만들어낼 수 있습니다.
카호의 작품처럼 섬세하고 현실적인 인간의 감정을 모델링하는 데에도 오픈 소스 툴들은 중요한 역할을 합니다. 딥러닝 기술을 통해, 인간의 행동 패턴을 분석하고 예측하여, 더욱 정교한 모델을 구축할 수 있습니다.
이러한 오픈 소스 모델 툴들은 지속적으로 발전하고 있으며, 앞으로 더욱 다양한 분야에서 활용될 것으로 기대됩니다. 특히, 데이터 과학, 인공지능, 머신러닝 분야에서 핵심적인 역할을 수행하며, 혁신적인 기술 개발을 가속화할 것입니다.
Kimi K3의 웨이트 공개(7월 27일)로 인해 OpenCode나 Cline 등의 OSS 코딩 툴에서의 이용이 향후 확대될 가능성이 있습니다. 다만, 앞서 언급한 바와 같이 권장 구성은 슈퍼노드급의 하드웨어이며, 기업의 자체 호스트 환경에서의 도입이 중심이 될 것으로 보입니다.
지역/온디바이스
코딩 용도로 사용되는 로컬 LLM으로는 Qwen3.6 27B, Qwen2.5-Coder 7B 등이 꾸준히 인기입니다. 이번 주에는 큰 변화가 없었습니다.
정밀도 평가
MAI-Cyber-1-Flash/MDASH의 CyberGym 점수는 벤더 공표치이며, 제3자 검증은 아직 확인되지 않았습니다. 또한 CyberGym 자체는 알려진 취약점 재현 테스트이며, 미지의 취약점 발견 능력이나 패치의 정확성을 그 자체로 측정하는 지표가 아니라는 점에 유념해야 합니다.
Kimi K3의 독립 검증 과정에서 환각률 상승(이전에 언급된 바와 같이)은 코딩 에이전트로서 사실 확인을 수반하는 작업에 활용될 때에도 영향을 미칠 수 있으므로, 실무 투입 전의 벤치마크에만 의존하지 않는 검증이 권장됩니다.
MAI-Cyber-1-Flash와 같은 SaaS 보안 특화 에이전트는 매력적이지만, 공개 리더보드와 벤더 공표치에 차이가 있는 동안에는 자사에서 재현 테스트를 하지 않고 도입 결정을 내리는 것이 안전합니다. “90%는 전용 모델에 맡기고 10%만 상위 모델로 에스컬레이션하는” 방식의 라우팅 설계 자체는 비용 최적화 패턴으로서 다른 분야에 적용할 가치가 있다고 생각합니다.
まとめ
이번 주를 돌아보면 다음 4가지 흐름이 보입니다.
- 지능(賢さ) ✕ 비용(コスト) 경쟁이 가격 면에서 더욱 발전: OpenAI가 GPT-5.6의 저가 및 중위 모델을 최대 80% 인하하고, Microsoft도 MAI-Cyber-1-Flash로 기존 구성 비율 50%의 비용 절감 목표를 제시하는 등, 첨단 수준의 성능을 어떻게 저렴하게 제공할 것인가라는 경쟁 축이 이번 주에 구체적인 가격 인하라는 형태로 표면화되었습니다.
- 개방형 가중치를 지닌 주체가 중국 세력뿐만 아니라 다양화되고 있다: Kimi K3(2.8조 파라미터)의 공식 가중치 공개와 함께 미국 Thinking Machines Lab이 “Inkling-Small”를 공개하는 등 개방형 가중치 모델의 공급원이 넓어지고 있다. 반면 Kimi K3의 독립 검증에서는 환각률 상승이 지적되어 점수만으로 판단하지 않는 것의 중요성이 다시 한 번 부각되었다.
- 개방형 가중치 모델을 둘러싼 정책 논쟁이 본격화되었다. NVIDIA 주도 공동 성명과 Anthropic의 다리오 아모디 CEO의 반론이라는 형태로, 개방형 가중치 모델의 타당성, 특히 중국 발 모델의 처리에 대한 업계 내 노선 대립이 이번 주에 표면화되었다. 기술 동향을 추적하는 과정에서 이러한 정책 및 규제 논의는 간과할 수 없는 요소로 떠오르고 있다. Fable과 같은 일파의 소동이 언제든 발생할 수 있다는 것은 상식이다.
- 사이버 보안 특화 AI가 주요 벤더의 표준 기능으로 자리 잡으면서, 마이크로소프트의 참여로 인해 Anthropic(Claude Security Plugin) 및 마이크로소프트(MAI-Cyber-1-Flash/MDASH)와 같은 주요 벤더가 각각 독자적인 보안 특화 에이전트를 보유하게 되었습니다. 다만 벤더 공표의 벤치마크와 제3자 검증 간 격차가 존재하는 경우도 있어, 이 분야 특유의 “아직 검증된 기준이 확립되지 않은” 상황에 유의해야 합니다.
개인적으로 이번 주에 가장 큰 영향을 미친 일은 OpenAI의 GPT-5.6 Luna/Terra의 대폭 인하였습니다. 업무상의 이용 모델 선택에 큰 영향을 미치고 있습니다!
본 기사에 제시된 정보는 2026년 8월 2일 시점의 공개 정보를 기준으로 작성되었으며, 일부 숫자 및 모델명은 정보 출처 간에 차이가 있어 “※미확인”으로 표기했습니다. 투자 판단이나 업무 이용 시에는 반드시 원천 정보를 확인해 주십시오.
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 59청크
원문 보기 | 출처: note.com