도쿄에 본사를 둔 AI 기업 사카나 AI(Sakana AI)가 여러 AI 모델에 작업을 할당하는 시스템 “후구 울트라 v2(Fugu Ultra v2)”와 “후구 맥스(Fugu Max)”를 발표했습니다. 후구 울트라 v2(Fugu Ultra v2)는 여러 벤치마크 테스트에서 GPT-6 아스트라(GPT-6 Astra)와 클로드 페이블 5.1(Claude Fable 5.1)을 상회합니다. 사카나 후구(Sakana Fugu) - 멀티 에이전트를 지휘하는 하나의 모델 https://sakana.ai/fugu/ Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier https://sakana.ai/fugu-max-release/ 사카나 AI의 후구 시리즈(Fugu series)는 여러 닫힌 모델(closed model)과 오픈 모델(open model)을 작업별로 나누어 사용하는 시스템으로, AI 모델 단독으로 사용하는 것보다 높은 성능을 발휘할 수 있습니다.
다음은 다양한 벤치마크 점수를 나열한 그래프입니다. “Fugu Ultra v2”, “Fugu Ultra v1.1”, “Claude Opus 5”, “Claude Fable 5”, “GPT-5.6 Sol”, “Kimi K3”, “Claude Fable 5.1”, “GPT-6 Astra” 등의 다양한 제품의 점수를 비교할 수 있습니다. Fugu Ultra v2는 여러 테스트에서 Claude Fable 5.1이나 GPT-6 Astra를 상회했습니다. 참고로 Fugu Ultra v2가 사용하는 모델에는 “Claude Fable 5”, “Claude Fable 5.1”, “GPT-6 Astra”가 포함되어 있지 않습니다.
Fugu Max는 다른 시리즈와 비교하여 사용 가능한 모델 종류가 증가했으며, 비용 효율적인 처리가 가능합니다.
다음은 에이전트 성능을 측정하는 Terminal Bench 2.1의 결과로, X축은 비용, Y축은 점수입니다. Fugu Max는 비교 모델 중에서 최고 점수를 달성하면서 동시에 비용을 절감하는 데 성공했습니다.
Fugu Ultra v2와 Fugu Max는 API 사용량 과금 방식 또는 구독 방식으로 이용 가능합니다. 100만 토큰당 API 요금은 다음과 같습니다.
구독 플랜의 월간 요금은 Standard Plan이 20달러(약 3080엔), Pro Plan이 100달러(약 1만 5400엔), Max Plan이 200달러(약 3만 8010엔)입니다.
원문 보기 | 출처: Gigazine