# 오픈 모델 'Gemma 4 31B'가 작업에 따라 'Claude Sonnet 5'와 동일한 품질을 40분의 1 비용으로 실현 가능

> https://bookfactory.kr/c/news/10545
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-08-23T13:41:38.047Z

---

새로운 AI 모델이 잇따라 등장해 벤치마크 점수의 최고 기록을 계속 경신하고 있지만, 작업에 따라서는 그렇게 고성능이 아닌 AI로도 충분한 경우가 많습니다. AI를 활용한 문서 관리 서비스를 개발하는 AlphaSense는 "재무 관련 작업에서 오픈 모델인 Gemma 4 31B가 Claude Sonnet 5와 동등한 성능을 발휘한다"는 테스트 결과를 공개했습니다.
How AlphaSense Pairs Frontier AI Models with Frontier Context
https://www.alpha-sense.com/resources/product-articles/frontier-ai-models-context
AI에 재무 정보를 분석시킬 때 정보를 읽히는 방법이 작업 효율에 큰 영향을 미칩니다. "관련된 모든 정보를 AI에 읽힌다"는 방법에서는 AI가 방대한 정보를 처리하게 되어 작업당 비용이 커집니다. 반면 "관련 정보 중에서 별도의 검색 시스템으로 특정 정보를 추출하여 AI에 읽힌다"는 방법이라면 비용을 억제할 수 있습니다. AlphaSense는 독자적인 정보 검색 기반인 "AlphaSense Search"를 개발했으며, AlphaSense Search와 각종 AI 모델을 조합했을 때의 재무 정보 분석 성능을 측정하여 공개했습니다. "GPT-5.6 Sol" "Claude Haike 4.5" "Claude Sonnet 5" "Claude Opus 4.8" "Claude Opus 5" "Kimi K3" "GLM-5.2" "Inkling" "Gemma 4 31B"를 대상으로 245개 문항의 재무 정보 분석 작업 답변 정확도를 측정한 결과는 아래와 같습니다. 세로축은 답변 정확도의 상대 점수(위로 갈수록 양호한 결과), 가로축은 작업당 비용의 중앙값(왼쪽으로 갈수록 저렴)을 나타냅니다. Gemma 4 31B는 무료로 공개된 오픈 모델이지만 폐쇄형 모델인 Claude Sonnet 5와 동등한 정확도로 처리에 성공했으며, 비용은 40분의 1이었습니다. 가장 높은 정확도를 보인 것은 GPT-5.6 Sol로 "품질과 가격의 균형이 뛰어난 모델"로 평가되었습니다.

AlphaSense의 테스트 결과에 대해 Google 공식 X 계정도 반응하며, "최첨단 모델이 항상 필요한 것은 아닙니다. 최근 벤치마크에서 Gemma 4 31B가 Claude Sonnet 5와 동등한 답변 품질을 약 40분의 1 비용으로 달성했습니다. 높은 비용 효율성과 낮은 지연 시간 덕분에 Gemma는 대형 모델로는 경제성이 없는 대용량 유스 케이스에 대응할 수 있습니다"라고 언급하며 Gemma 4 시리즈의 우위를 강조했습니다.

항상 최첨단 모델이 필요한 것은 아닙니다. 최근 벤치마크에서 Gemma 4 31B가 답변 품질에서 Sonnet 5와 동등한 수준을 약 40배 낮은 비용으로 달성했습니다. 높은 비용 효율성과 낮은 지연 시간 덕분에 Gemma는 대형 모델로는 비경제적인 대용량 유스 케이스를 가능하게 합니다.
pic.twitter.com/BfjPjlz0wY

[원문 보기](https://gigazine.net/news/20260823-gemma-4-benchmark/) | 출처: Gigazine