# [진실을 꿰뚫어 보는 힘] MiniMax H3의 본질 회복 테스트 [지역 영상 생성 AI]

> https://bookfactory.kr/c/news/9199
> 게시판: 뉴스
> 작성자: admin
> 작성일: 2026-08-10T05:57:51.591Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/302027460/rectangle_large_type_2_5ff922a34bc7f4835a5a7f42d6a696c1.jpeg?width=1280)

## **서론**

MiniMax H3는 로컬에서 실행 가능한 동영상 생성 AI 중 최고 성능을 자랑합니다. 본 기사에서는 그 성능을 더욱 심층적으로 확인해 보고자 합니다.

이미지·비디오 생성 AI, LLM을 포함하여 생성 AI의 경우 일관성은 가장 중요한 성능 중 하나입니다.

특히, 현대의 주류 AI는 트랜스포머(핵심 기술인 셀프 어텐션)이기 때문에, 입력 토큰 내의 모든 요소 간의 관계성을 동시에 계산하고, 컨텍스트(문맥이나 이미지·영상이라면 공간·시간) 내의 다른 어떤 토큰과 가장 강하게 관련(어텐션)되어 있는지 계산합니다.

그렇기에, 입력 데이터의 맥락에서 상호 관계를 정확하게 파악하고 추론하며, 일관성을 유지하고 본질을 꿰뚫는 능력이 바로 현대 AI의 진정한 성능이라고 할 수 있습니다.

단순히 아름다운 이미지나 데이터, 문장을 생성하는 것 외에는 주의 관계 없이 학습 데이터를 “そのまま” 출력하는 것이 더 적절할 것입니다.

실제로, 이미지 편집 AI로서 최고 수준의 ChatGPT는 높은 “스킨화력”을 자랑합니다.

## MiniMax H3로 시도해 보았습니다.

> 
> 
> 그녀는 립스틱부터 아이섀도우까지 물로 메이크업을 지우고 맨 얼굴을 드러낸다. 그리고 카메라를 응시한다. 이미지 크기, 각도, 포즈는 그대로 유지한다.
> 

![画像](https://assets.st-note.com/production/uploads/images/302026385/picture_pc_2835f8ddfcc8064adcd5aa6bb1cfff11.gif?width=1200)

![画像](https://assets.st-note.com/img/1786309364-cJghvKPz76LOtF4ulZS2UexB.jpg?width=1200)

특정 측면은 잘 파악하고 있다고 생각합니다. 다만, 나이 차이가 느껴져서 미완성 학습 데이터에 영향을 받고 있는 것 같습니다.

## 다른 예시

![画像](https://assets.st-note.com/production/uploads/images/302033953/picture_pc_bb64d794b705717d7bd096b880ea7eda.gif?width=1200)

![画像](https://assets.st-note.com/img/1786312770-ZI01QPLGsYfBlwrEn3tW6xcp.jpg?width=1200)

## まとめ

다른 예시나 프롬프트로도 시도해 보았지만, ChatGPT Image는 일반적인 화장을 완전히 지우는 것은 불가능했습니다.

![画像](https://assets.st-note.com/production/uploads/images/302057271/picture_pc_e2282f5993976d6e366f8937aa1e0cf6.gif?width=1200)

성인 자연 미외 데이터는 세상에 압도적으로 적기 때문에(수요도 없었으므로), 자연 미외가 될 것인지, 젊어질 것인지 되어버리는 것 같습니다.

다음은 관련 기사의 [PR]입니다.

**출처:** [note 원문](https://note.com/catap_art3d/n/n32e704d3b341)

*번역: Gemma 3(.44) 초벌 + 교정 11청크*

[원문 보기](https://note.com/catap_art3d/n/n32e704d3b341) | 출처: note.com