중국의 AI 기업인 DeepSeek이 AI 모델 “DeepSeek-V4-Flash-0731”을 상업적 이용이 가능한 라이선스 하에 오픈 모델로 공개했습니다. deepseek-ai/DeepSeek-V4-Flash-0731 · Hugging Face https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731 DeepSeek-V4-Flash-0731 · Models https://modelscope.ai/models/deepseek-ai/DeepSeek-V4-Flash-0731
⚠️ 참고 사항: DeepSeek-V4-Flash-0731은 프리뷰 버전과 동일한 모델 아키텍처와 크기를 유지합니다. 🔷 오늘 업데이트는 DeepSeek-V4-Flash API에만 적용됩니다. DeepSeek-V4-Pro API 및 App/Web 모델은 현재 변경되지 않았습니다. DeepSeek-V4-Pro의 공식 출시…
DeepSeek-V4-Flash-0731은 2026년 4월에 등장한 DeepSeek-V4-Flash의 업데이트 버전으로, 총 파라미터 수는 2840억 개, 활성 파라미터 수는 130억 개의 MoE(Mixture of Experts) 모델입니다. 제3자 기관인 Artificial Analysis가 실시한 인텔리전스 성능 테스트 결과는 다음과 같습니다. DeepSeek-V4-Flash-0731은 Google의 Gemini 3.6 Flash와 동등한 성능으로 평가되었으며, 오픈 모델 중에서는 Kimi K3와 GLM-5.2에 이어지는 성능으로 평가되었습니다.
코딩 성능에서는 GLM-5.2를 능가합니다.
에이전트 성능에서는 Gemini 3.6 Flash를 훨씬 능가했으며, OpenAI의 GPT-5.6 Luna를 0.1 포인트 상회했습니다.
DeepSeek-V4-Flash-0731은 모델 규모에 대한 성능의 높은 효율성을 특징으로 합니다. 아래 그래프는 가로축이 모델의 총 파라미터 수, 세로축이 인텔리전스 성능을 나타내는 것으로, DeepSeek-V4-Flash-0731이 파라미터 수에 비해 높은 성능을 갖추고 있음을 보여줍니다.
아래 그래프는 AI 모델의 비용 효율성을 나타내는 것으로, 가로축이 작업별 비용, 세로축이 인텔리전스 성능입니다. DeepSeek-V4-Flash-0731은 2026년 7월 말에 하락한 GPT-5.6 Luna보다 훨씬 저렴하며, 매우 비용 효율적인 모델임을 보여줍니다.
DeepSeek-V4-Flash-0731은 Hugging Face와 ModelScope에서 무료로 공개되어 있으며, 라이선스는 MIT 라이선스를 채택하고 있습니다. Hugging Face에서는 자원 봉사자들에 의해 양자화 버전이 다수 공개되고 있습니다. Quantized Models for deepseek-ai/DeepSeek-V4-Flash-0731 – Hugging Face https://huggingface.co/models?other=base_model:quantized:deepseek-ai/DeepSeek-V4-Flash-0731
원문 보기 | 출처: Gigazine