안녕하세요, WEEL 미디어부입니다!
2026년 8월 3일부터 8월 9일까지 생성 AI 관련 주요 트렌드를 엄선하여 제공합니다.
이번 주에는 오픈 웨이트 모델의 공개와 예고가 이어졌던 한 주였습니다. MiniMax H3, Qwen3.8-Max, DeepSeek-V4-Flash 모두 오픈 展開을 통해 선보였으며, 프론티어 성능을 가진 모델에 대한 접근성이 빠르게 높아지고 있습니다.
AI 특화 모델인 사카나 나마즈, 에이전트 공통 규격의 에이전트 플러그인 등 ‘AI를 더 연결하고 사용하기 쉽게 하는’ 움직임이 가속화되고 있으며, 현장에서의 실용화가 더욱 현실적으로 다가온 주입니다.
마지막까지 시청하시면 업무 효율화 및 업무 개선에 도움이 됩니다!
매월의 트렌드 보고서를 PDF로 모아 제공하는 인기 AI 툴부터 국내외 기업의 최신 동향, 업무 효율화에 도움이 되는 실무 사례까지 다룹니다. 한 달간의 AI 뉴스를 이 한 권으로 한 번에 챙겨보세요!
다운로드 링크는 여기서 확인하세요 ✨
【MiniMax H3】 작업과 모드(카테고리)의 경계를 초월하는 오픈 모델의 특징, 가격, 사용법을 심층적으로解説
✅ 텍스트, 이미지, 비디오, 음성을 통합 컨텍스트로 활용하는 범용 멀티모달 설계 ✅ 최대 15초, 2K 해상도의 네이티브 스테레오 음성 포함 비디오 생성이 가능 ✅ 2K 비디오의 초단편 가격은 주요 모델의 3분의 1 미만 (0.13달러/초) ✅ 비디오 생성 영역에서는 희귀한 오픈 웨이트 공개를 예정 ✅ 여러 모다リティ의 관계성을 자연어만으로 지정할 수 있는 통합적 설계
MiniMax H3는 MiniMax가 2026년 8월에 발표한 범용 멀티모달 생성 모델로, 텍스트, 이미지, 비디오, 음성을 단일 통합 컨텍스트로 처리하는 점이 가장 큰 특징입니다.
기존 AI 모델이 “텍스트 전용”, “이미지 전용” 등 용도에 따라 분리되어 있었던 것에 반해, H3는 모든 모다リティ를 횡단하여 처리할 수 있는 설계 철학을 채택하고 있습니다. 2K 해상도 및 15초의 네이티브 스테레오 음성 영상을 0.13달러/초라는 저 비용으로 생성할 수 있는 점 또한 상업 프로젝트에 대한 도입을 촉진합니다.
영상, 음성, 텍스트를 한 번에 처리하고 싶다는 니즈에 직접적으로 대응하는 모델입니다. 곧 출시될 오픈 웨이트 공개도 예정되어 있으며, 현지 운영을 고려 중인 팀은 자세한 내용을 확인해 보시기 바랍니다.
2. 【사카나 나마즈】일본어 특화 LLM API 등장! 주요 내용, 요금, 활용법, 성능을 심층적으로 상세히 설명
✅ Kimi K2.6 기반에 일본 성능과 일본 고유의 문맥 이해를 강화한 포스트 트레이닝 설계 ✅ FairPoliticsQA 점수가 34.10%에서 56.30%로 크게 향상되었으며, 일본의 가치관에 대한 고려가 개선됨 ✅ 입력 $0.95, 출력 $4.00/백만 토큰의 저렴한 가격 설정 ✅ 웹 검색 및 코드 실행이 내장 기능으로 탑재 ✅ OpenAI 호환 API에 대응하며, 기존 코드의 변경을 최소화하여 이전 가능
사카나 나마즈는 사카나 AI가 2026년 8월 4일에 제공을 시작한 일본어 특화 LLM API로, Moonshot AI의 “키미 K2.6”을 기반으로 일본어 성능과 일본 고유의 문화 및 가치관에 대한 대응을 강화한 모델입니다.
FairPoliticsQA 점수가 약 22점 향상된 점을 보듯이, 해외 모델에 내재된 편향의 보정에 집중하고 있는 점이 특징적입니다. 웹 검색과 코드 실행을 내장하고 있어 단체에서 리서치부터 코딩까지를 모두 수행할 수 있는 실용성 또한 매력적입니다.
일본어 업무 문서 처리나 국내용 앱 개발에서 해외 LLM의 “미묘한 뉘앙스의 차이”에 어려움을 겪던 팀에게 시도해볼 만한 선택지가 늘어났습니다. OpenAI 호환 API이므로 이관 비용도 낮게 유지할 수 있습니다.
3. 【Qwen3.8-Max】2조 4천억 개의 파라미터로 개척 수준의 성능을 구현한 알리바바의 최신 AI 모델을 심층적으로 해설
총 파라미터 2.4조, 액티브 파라미터 950억의 고효율 MoE 설계를 채택했습니다. Terminal-Bench 2.1에서 86.6의 성능을 기록하여 Claude Opus 4.8 (84.6)을 능가합니다. 컨텍스트 윈도우는 최대 100만 토큰, 출력을 최대 131,072 토큰으로 지원합니다. API 요리는 입력 2달러, 출력을 6달러/100만 토큰으로 Claude Opus 5의 약 4분의 1 수준입니다. Qwen Studio에서 무료로 이용 가능하며, Max급 Qwen 모델 최초로 오픈 웨이트 모델을 공개할 예정입니다.
Qwen3.8-Max는 알리바바가 2026년 8월 3일에 공개한 최신 대규모 AI 모델로, 2.4조 파라미터의 MoE(Mixture of Experts) 아키텍처를 채택하고 있습니다.
Terminal-Bench 2.1은 에이전트 기반 태스크에 강점을 가지고 있으며, Claude Opus 4.8을 능가하는 점수를 기록하고 있습니다. 또한, 코딩 및 멀티모달 영역에서 프론티어 모델과 어깨를 나란히 하는 성능을 자랑합니다. 월額 18달러의 Token Plan으로 대량 이용이 가능하며, 비용에 민감한 기업에게 매력적인 요금 설정입니다.
고성능 모델을 사용하고 싶지만, Claude/GPT의 비용이 걱정되는 분들께 이번에 가장 주목해야 할 릴리즈 중 하나입니다. Qwen Studio에서 무료 이용부터 먼저 시도해 보세요.
4. 【DeepSeek-V4-Flash】 최고급 모델을 능가하는 재학습의 충격! 에이전트 성능, 가격, 사용법을 완벽하게 분석합니다.
✅ 아키텍처 변경 없이 포스트 훈련 개선만으로 상위 모델(V4-Pro Preview)을 전 9개의 벤치마크에서 능가하는 성능을 달성✅ 280억 파라미터(액티브)로 100만 토큰의 컨텍스트에 대응✅ API 요금은 100만 토큰당 0.14달러라는 파격적인 저 비용✅ MIT 라이선스 채택으로 온프레미스 운영 및 상업 이용이 자유롭게 가능✅ 생성 속도 35~39 토큰/초의 고속 추론을 실현
DeepSeek-V4-Flash는 DeepSeek이 2026년 7월 31일에 출시한 신 모델로, 모델 구조를 변경하지 않고 포스트 트레이닝 개선만으로 상위 모델을 넘어선 점이 업계에 충격을 주었습니다.
에이전트 기반의 9개 벤치마크에서 전세대 모델(V4-Pro Preview)을 능가하며, DeepSWE 점수는 7.3에서 54.4로 괄목할 만하게 향상되었습니다. MIT 라이선스에 따른 오픈 웨이트 공개로 인해 보안 요건이 까다로운 기업에서도 로컬 환경에 배포가 가능합니다.
학습 비용을 들이지 않고 모델 성능을 끌어올리는 접근 방식은 AI 개발 철학에도 한 방을 치는 릴리즈입니다. 에이전트형 앱 개발을 고려하고 있는 팀은 이 기사를 통해 그 실력을 확인해 보십시오.
5. 【에이전트 플러그인】AI 에이전트 확장 공통 규격 탄생! 작동 방식, 사용법, 활용 시나리오를 철저히 해설
OpenAI, Amazon, Microsoft, Cursory, Vercel이 공동으로 제정한 오픈 표준입니다. Agent Skills와 MCP 서버 설정(設定)을 1 패키지에 담는 통일(統一)된 형식이며, ChatGPT, GitHub Copilot, Cursory 등 주요 5개 클라이언트가 처음부터 대응(対応)합니다. CC BY 4.0와 Apache License 2.0의 이중(デュアル) 라이선스로 완전(完全) 무료하고, plugin.json과 SKILL.md의 최소(最小) 구성으로 동작(動作)하는 구현(実装)의 단순(シンプル)함을 제공합니다.
에이전트 플러그인은 OpenAI, 아마존, 마이크로소프트, 커서, Vercel이 2026년 8월 7일에 공동 발표한 AI 에이전트 확장 공동 오픈 표준으로 “한 번 만든 플러그인을 어떤 에이전트에서도 실행”하는 세계의 실현을 목표로 합니다.
지금까지 에이전트 확장은 고객별로 개별 구현이 필요했지만, Agent Plugins를 통해 개발 리소스를 분산시키지 않고도 여러 고객에게 대응이 가능해집니다. 벤더 종속성을 배제한 설계로, 기존의 MCP 서버 자산도 그대로 활용할 수 있다는 점도 긍정적입니다.
MCP 서버를 이미 구축했으나, 대응 클라이언트를 확장하고자 하는 개발자에게 중요한 동향을 파악해야 할 표준입니다. 먼저 GitHub의 사양서를 확인하고, 자사의 에이전트 전략에 통합할 가능성을 검토해 보십시오.
그녀는 마치 텅 빈 셔츠 같았다. 셔츠는 낡았지만, 여전히 텅 비어 있었다. 나는 그녀에게 셔츠를 입혀주었다. 셔츠는 그녀의 몸에 달라붙어 그녀의 빈 공간을 채웠다. 그녀는 셔츠를 입고 걷기 시작했다. 그녀는 걷는 동안 셔츠를 걷어 올렸다. 셔츠는 그녀의 몸에서 떨어져 텅 빈 셔츠처럼 다시 텅 비었다. 그녀는 셔츠를 다시 입혔다. 셔츠는 그녀의 몸에 달라붙어 그녀의 빈 공간을 채웠다. 그녀는 걷는 동안 셔츠를 걷어 올렸다. 셔츠는 그녀의 몸에서 떨어져 텅 빈 셔츠처럼 다시 텅 비었다. 그녀는 셔츠를 다시 입혔다. 셔츠는 그녀의 몸에 달라붙어 그녀의 빈 공간을 채웠다. 그녀는 걷는 동안 셔츠를 걷어 올렸다. 셔츠는 그녀의 몸에서 떨어져 텅 빈 셔츠처럼 다시 텅 비었다. 그녀는 셔츠를 다시 입혔다. 셔츠는 그녀의 몸에 달라붙어 그녀의 빈 공간을 채웠다. 그녀는 걷는 동안 셔츠를 걷어 올렸다. 셔츠는 그녀의 몸에서 떨어져 텅 빈 셔츠처럼 다시 텅 비었다. 그녀는 셔츠를 다시 입혔다. 셔츠는 그녀의 몸에 달라붙어 그녀의 빈 공간을 채웠다. 그녀는 걷는 동안 셔츠를 걷어 올렸다. 셔츠는 그녀의 몸에서 떨어져 텅 빈 셔츠처럼 다시 텅 비었다. 그녀는 셔츠를 다시 입혔다. 셔츠는 그녀의 몸에 달라붙어 그녀의 빈 공간을 채웠다. 그녀는 걷는 동안 셔츠를 걷어 올렸다. 셔츠는 그녀의 몸에서 떨어져 텅 빈 셔츠처럼 다시 텅 비었다. 그녀는 셔츠를 다시 입혔다. 셔츠는 그녀의 몸에 달라붙어 그녀의 빈 공간을 채웠다. 그녀는 걷는 동안 셔츠를 걷어 올렸다. 셔츠는 그녀의 몸에서 떨어져 텅 빈 셔츠처럼 다시 텅 비었다. 그녀는 셔츠를 다시 입혔다. 셔츠는 그녀의 몸에 달라붙어 그녀의 빈 공간을 채웠다. 그녀는 걷는 동안 셔츠를 걷어 올렸다. 셔츠는 그녀의 몸에서 떨어져 텅 빈 셔츠처럼 다시 텅 비었다. 그녀는 셔츠를 다시 입혔다. 셔츠는 그녀의 몸에 달라붙어 그녀의 빈 공간을 채웠다. 그녀는 걷는 동안 셔츠를 걷어 올렸다. 셔츠는 그녀의 몸에서 떨어져 텅 빈 셔츠처럼 다시 텅 비었다. 그녀는 셔츠를 다시 입혔다. 셔츠는 그녀의 몸에 달라붙어 그녀의 빈 공간을 채웠다. 그녀는 걷는 동안 셔츠를 걷어 올렸다. 셔츠는 그녀의 몸에서 떨어져 텅 빈 셔츠처럼 다시 텅 비었다. 그녀는 셔츠를 다시 입혔다. 셔츠는 그녀의 몸에 달라붙어 그녀의 빈 공간을 채웠다. 그녀는 걷는 동안 셔츠를 걷어 올렸다.
이번 주에는 “개방화”, “일본어 대응”, “공통 규격”이라는 3가지 키워드가 겹치는 한 주였습니다. MiniMax H3, Qwen3.8-Max, DeepSeek-V4-Flash 모두 오픈 웨이트 배포를 발표하며, 프론티어 성능의 모델을 자사 환경에서 운영할 수 있는 선택지가 급속도로 확대되고 있습니다.
사카나 나마즈는 일본 AI의 실用水準을 끌어올리는 일본 내 모델로서 주목받고 있습니다. 해외 LLM의 “일본어의 미묘한 뉘앙스의 차이”에 어려움을 겪던 현장에 구체적인 대안이 등장한 것은 큰 진전입니다.
에이전트 플러그인은, 흩어져 있던 AI 에이전트 확장 기능을 “공통 언어”로 연결하여 새로운 시스템을 구축하려는 시도로, 중장기적으로 중요한 흐름입니다. 각 툴이 개별적으로 발전하는 시대에서, 생태계 전체가 연계되어 작동하는 시대의 전환이 확실히 진행되고 있습니다.
생성 AI의 최신 뉴스·사례·이벤트 정보를 가장 빨리 알고 싶다면, WEEL의 무료 메일マガ진 구독해 보세요!
✉️ 메일マガ신 구독하세요
💡 AI 활용, 어디부터 시작해야 할지 고민이신 분들께 “생성 AI를 자사에 도입하고 싶지만, 무엇부터 시작해야 할지 모른다”“구체적인 업무를 어떻게 자동화할 수 있는지, 전문가의 의견을 듣고 싶다”
그 방향에 맞춰 무료 개인 상담을 진행하고 있습니다! 현장 사례를 포함하여, 쉽고 자세하게 설명해 드립니다. ✨ 지금 바로 AI 전문가와 상담하세요 ✨
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 20청크
원문 보기 | 출처: note.com