# 샤오미, 멀티모달 AI “MiMo-V2.6-Pro/Flash” 및 강화학습 환경/코드를 공개

> https://bookfactory.kr/board/news/19405
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-10-01T05:24:33.824Z

---

이미지 출처: ChatGPT에 의해 ledge.ai 가 생성

중국 샤오미는 2026년 9월 22일, AI 모델 “MiMo-V2.6-Pro” 및 “MiMo-V2.6-Flash”를 공개했다. 두 모델은 텍스트, 이미지, 비디오, 음성을 입력으로 처리하며 최대 100만 토큰의 컨텍스트에 대응한다. 모델의 가중치에 더하여, 기술 보고서 및 강화 학습에 사용되는 환경 및 코드를 공개하고 있다.

## Pro는 1.02조 파라미터, Flash는 약 3100억

MiMo-V2.6-Pro는 총 파라미터 수 1.02조의 Mixture of Experts (MoE) 모델로, 처리 시 활성화되는 파라미터 수는 420억이다. MiMo-V2.6-Flash는 총 파라미터 수 약 3100억, 활성화 파라미터 수 150억의, 효율을 중시한 모델이다. 이 모두 텍스트, 이미지, 비디오, 음성을 이해하고 텍스트를 출력한다. 모델의 가중치는 MIT 라이선스로 공개되었다.

샤오미는 자사의 API 플랫폼 및 데스크톱 앱에서도 두 모델의 제공을 시작했다. Pro에는, 출력 속도를 최대 20배에 높이는 “UltraSpeed” 모드도 제공한다.

이 회사는 활용 예시로, 이미지 또는 텍스트로부터 블렌더용 3D 소재 제작, 화면을 확인하며 조작하는 컴퓨터 사용, 로봇 팔 시뮬레이션 등을 소개하고 있다.

## 강화 학습 과정 및 개발 자원 공개

샤오미는 코딩, 일반적인 에이전트 작업, 시각 정보 사용 작업, 사이버 보안 과제를 결합하여 강화 학습을 실시했다. 공식 특설 페이지에서는 자사의 코딩 평가에 대한 점수 변화와 학습에 소요된 비용 등을 그림으로 제시하고 있다.

■ MiMo-V2.6-Pro와 Flash의 강화 학습 중인 자사 코딩 평가의 변화

이미지 출처: 샤오미 MiMo 공식 특설 페이지

공개된 기술 보고서에서는 다른 답변의 질을 비교하여 학습에 반영하는 방법과 보상을 얻기 위한 부적절한 행동을 억제하는 대책을 설명하고 있다. 회사의 발표에 따르면, 장기적인 소프트웨어 개발을 평가하는 “DeepSWE v1.1”의 점수가 강화 학습을 통해 Flash에서 48.8에서 65.7, Pro에서 58.4에서 72.6로 상승했다. 이는 샤오미가 공개한 평가 결과이다.

모델과 함께 7000건 이상의 강화 학습용 작업 환경, 학습 프레임워크, 경량화된 에이전트 실행 환경도 공개했다.

## 외부 평가에서는 Pro가 46점, 비용과의 관계도 제시

AI 모델 성능 평가 전문 사이트인 Artificial Analysis에서는 MiMo-V2.6-Pro가 “Intelligence Index”에서 46점을 기록했다. 이 지표는 여러 평가 결과를 종합한 것으로, 샤오미는 공식 특설 페이지에서도 다른 모델과의 비교 그림을 소개하고 있다. 모델 간의 순위는 평가 대상과 측정 시점에 따라 달라진다.

■ Artificial Analysis Intelligence Index에서 MiMo-V2.6-Pro 등의 점수 비교

이미지 출처: Artificial Analysis (샤오미 MiMo 공식 특설 페이지 게재)

Artificial Analysis가 산출하는 Intelligence Index의 평가 작업당 가중 평균 비용은 약 0.13달러이다. 입력 및 출력 등의 토큰 요금과 사용량에서 산출된 평가상의 비용이며, 실제 이용 비용은 작업에 따라 다르다.

■ 성능 지표와 평가 작업당 비용 비교

이미지 출처: Artificial Analysis (샤오미 MiMo 공식 특설 페이지 게재)

관련 기사: 샤오미, 1조 파라미터급 AI 모델 “MiMo-V2.5-Pro”를 오픈 소스 공개, 장기 에이전트 태스크에서 Claude Opus 4.6에 근접한다고 주장

관련 기사: 샤오미, 자사 개발·제로에서 학습의 추론 특화 LLM “MiMo-7B”를 오픈 소스에서 공개 – 수학·코드 추론으로 선행

관련 기사: 중국 Moonshot AI, 2.8조 파라미터의 “Kimi K3” 발표 – 프론트엔드 개발 평가에서 Fable 5와 GPT-5.6 Sol을 상회하며 1위

[원문 보기](https://ledge.ai/articles/xiaomi_mimo_v2_6_pro_flash_release) | 출처: Ledge.ai