오픈 모델로 공개되고 있는 영상 생성 AI “MiniMax H3”의 개발팀이 온라인 게시판 Reddit에서 AMA(Ask Me Anything: 무엇이든 묻고 답하기 행사)를 실시하여 앞으로도 다양한 AI 모델을 공개할 예정임을 밝혔습니다. AMA: MiniMax H3 팀 — 무엇이든 물어보세요: 저희 오픈 비디오 생성 모델, 훈련 및 미래 계획에 대해 문의하세요 : r/StableDiffusion https://www.reddit.com/r/StableDiffusion/comments/1vh9rtw/ama_minimax_h3_team_ask_us_anything_about_our/
Reddit AMA에 참여해 주신 모든 분들께 감사드립니다! 커뮤니티 에너지는 믿을 수 없을 정도로 좋았고, MiniMax H3의 아키텍처, 워크플로우 및 미래에 대해 깊이 파고드는 것을 즐겼습니다. 🩵 놓치신 분들을 위해 다음 출시될 내용 및 YES WE WILL KEEP OPEN UNTIL… 요약이 있습니다. https://t.co/QiwIdxnxSB pic.twitter.com/UMspwuMfio
MiniMax는 중국에 본사를 둔 AI 개발 기업으로, GPT-5.5에 필적하는 성능의 “MiniMax M3”를 오픈 모델로 공개하는 등 고성능 AI 모델을 무상으로 공개해 왔습니다. 영상 생성 AI에 대해서도 “Hailuo 01” 및 “Hailuo 02”와 같은 모델을 개발했으며, 2026년 8월에는 “MiniMax H3”를 오픈 모델로 공개했습니다. 영상 생성 AI “MiniMax H3”가 공개되어 세계 2위 실력으로 오픈 모델로 공개 예정 - GIGAZINE
MiniMax H3는 “음성 지원 영상 생성 가능”, “일본어 대사 생성 가능”, “시작 프레임 및 종료 프레임 지정 가능”, “이미지, 오디오, 비디오를 참조로 입력하여 생성 가능”, “클로즈드 모델 최첨단 모델과 遜色ない 품질의 영상을 로컬 생성 가능” 등의 특징을 갖는 데서 인기를 모으고 있으며, 이미 자발적으로 개발된 고속화 LoRA 등도 배포되고 있습니다. 그런 MiniMax H3 개발팀이 2026년 8월 7일 Reddit에서 AMA(Ask Me Anything)를 실시하여 사용자들의 질문에 답변했습니다. AMA에서 답변된 내용 중 개발팀이 중요한 정보로 언급한 내용은 다음과 같습니다.
* **업스케일 모델 공개**
MiniMax H3의 클라우드 서비스 버전에서는 “H3-Regenerate-2K”라는 업스케일 모델을 사용하여 고해상도 영상을 출력할 수 있습니다. 이 H3-Regenerate-2K 모델 역시 MiniMax H3와 마찬가지로 오픈 모델로서 공개될 예정입니다.
* **저단계 버전 개발 검토**
MiniMax H3는 ComfyUI의 공식 워크플로우에서는 20단계로 생성합니다. MiniMax H3 개발팀은 4단계 또는 8단계로 생성할 수 있는 저단계 버전 개발을 검토 중이라고 합니다. 이미 배포되고 있는 자발적인 저단계 LoRA에 대해서도 “정말 훌륭하다”는 의견을 표명했습니다.
* **스파스 어텐션 버전 개발**
계산 효율을 향상시키는 “스파스 어텐션”은 인공지능 모델을 개발하는 방법 중 하나입니다. 기사 작성 시점에 공개된 MiniMax H3는 스파스 어텐션을 적용하지 않은 버전이며, 향후 스파스 어텐션을 적용한 효율 향상 버전이 공개될 예정입니다.
* **Ref2VA 모델**
MiniMax H3는 텍스트에서 비디오를 생성하고 프레임 참조 비디오를 생성하는 데 대응하는 FL2VA 버전과 이미지, 오디오, 비디오를 참조하여 비디오를 정제하는 Ref2VA 버전의 두 종류로 공개되어 있습니다. 이 중 Ref2VA 버전은 사전 학습 단계부터 “생성 비디오를 참조 비디오로 입력하여 비디오를 보완하면서 생성하는” 장시간 비디오 생성 방법을 지원합니다.
* **이미지 생성 및 이미지 편집 모델 공개 예정**
개발팀은 MiniMax H3의 파생 모델로서 이미지 생성 모델과 이미지 편집 모델을 오픈 모델로서 공개할 예정입니다. 현재 시점에서는 사후 학습을 통한 개선 작업 중입니다.
* **오픈 모델 지속 여부 답변**
개발팀은 “미래의 모델도 오픈 모델로 지속될 건가요?”라는 질문에 대해 “네. AGI(범용 인공지능)에 도달할 때까지 지속될 것입니다.”라고 답변했습니다.
* **라이선스 전환 예정**
MiniMax H3는 “MiniMax H3 COMMUNITY LICENSE AGREEMENT”라는 독자적인 라이선스를 채택하고 있으며, EU, 영국, 한국, 미국 사용자들은 MiniMax로부터 이용 허가를 받아야 합니다. 이 문제에 대해 개발팀은 “저작권 문제가 해결되면 Apache License 2.0으로 전환하는 것을 고려하고 있습니다.”라고 언급하며, 미래에 보다 관대한 라이선스로 전환할 가능성을 시사했습니다. AMA 내용은 다음 링크에서 확인할 수 있습니다. AMA: MiniMax H3 Team — Ask us anything about our open video generation model, training, and future plans : r/StableDiffusion [https://www.reddit.com/r/StableDiffusion/comments/1vh9rtw/ama_minimax_h3_team_ask_us_anything_about_our/](https://www.reddit.com/r/StableDiffusion/comments/1vh9rtw/ama_minimax_h3_team_ask_us_anything_about_our/)
## 관련 기사 영상 생성 AI “MiniMax H3” 등장, 세계 2위 실력으로 오픈 모델 형태로 공개 예정 - GIGAZINE
* 영상 생성 AI “FLUX 3 Video” 일반 공개, 1080p·20초 영상 생성 가능하며, 최근 중 오픈 모델도 공개 예정 - GIGAZINE
* 드디어 영상 생성 AI “HappyHorse 1.0” 누구나 사용 가능해져 사용해 봤다, 일본어 문구도 출력 가능하며 실사풍·애니메이션 풍 둘 다 OK - GIGAZINE
* 게임처럼 이동 가능한 세계를 실시간 생성하는 AI “HappyOyster 1.0” 등장하여 사용해 봤다 - GIGAZINE
* 영상 생성 AI “LTX-2.3” 개발팀이 AI 기업 “LTX”로 독립, 가상 세계 시뮬레이션을 가능하게 하는 세계 모델을 개발 중이며 오픈 모델 태세를 유지 - GIGAZINE
* Google이 더 빠르고 저렴한 이미지 생성 모델 “Nano Banana 2 Lite”와 영상 생성 모델 “Gemini Omni Flash” 발표 - GIGAZINE
Cloudflare가 AI 에이전트용 브라우저 “Kitesurf” 출시, Chromium보다 CPU·메모리 소비를 대폭 감소
2026년 08월 10일 12시 18분 00초 inAI, Posted by log1o_hf
최근 24시간 (1시간마다 업데이트, 5분 간격으로는 여기)
계속 기사를 읽어 주십시오.
원문 보기 | 출처: Gigazine