# 최첨단 AI 모델 “사고 과잉으로 인한 비용 증가”를 해결하기 위해 Kimi K3 기반으로 개발된 AI 모델 “Ember-1”이 등장

> https://bookfactory.kr/board/news/19544
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-10-01T23:25:11.280Z

---

파이어워크 AI가 추가 학습 서비스 확대를 위해 Kimi K3 기반 AI 모델 “Ember-1”을 발표했습니다. Ember-1은 Kimi K3에 비해 출력 토큰 수를 약 35% 줄이면서 성능을 유지하는 데 성공했습니다. Introducing Ember-1https://fireworks.ai/blog/ember-1

Ember-1은 파이어워크 AI의 “개발자가 필요로 하는 전문 모델을 만드는 프로젝트”의 1탄으로 개발된 모델이며, “최첨단 모델의 생각이 너무 길어서 토큰 사용량이 증가하여 총 비용이 높아지는 문제”를 해결하는 것을 목표로 합니다.

Kimi K3는 2026년 7월에 등장한 중국산 오픈 모델로, 일부 테스트에서 GPT-5.6 Sol이나 Claude Fable 5를 상회하는 성능을 보입니다. 그러나 최종 출력을 생성하기 전의 사고(Reasoning) 단계에서 긴 토큰을 소비하는 경향이 있으며, 출력 완료 시간과 총 비용의 높이가 문제점으로 지적되고 있습니다. Kimi K3는 AI 에이전트의 벤치마크 “AA-Briefcase”에서 Fable 5에 이어 2위의 성적을 달성했지만, 실행 비용은 Opus 4.8보다 높고, 작업당 평균 1시간 가까이 소요됩니다 - GIGAZINE

파이어워크 AI에 따르면, Kimi K3와 같은 고성능 모델의 경우 출력 토큰의 90% 정도가 사고에 할당된다고 합니다. AI 에이전트로서 사용될 경우, 작업의 턴마다 모든 컨텍스트를 재읽어들이기 때문에 비용이 눈덩이처럼 불어납니다. 파이어워크 AI는 사고 내용 중 “문제 수행을 위한 피드백” 등에 유용한 부분을 유지하면서 불필요한 부분을 줄일 수 있도록 Kimi K3에 추가 학습을 실시하여 Ember-1을 구축했습니다. Ember-1과 Kimi K3를 포함한 각종 AI 모델의 성능을 의료 태스크 벤치마크 “Bedside Bench”에서 측정한 결과가 다음과 같습니다. X축이 작업당 비용, Y축이 점수를 나타내며, Ember-1이 Kimi K3와 동등한 점수를 낮은 비용으로 달성하고 있음을 알 수 있습니다. Kimi K3는 “GPT-5.6 Sol보다 저성능이지만 고비용”이라는 위치였지만, Ember-1은 “GPT-5.6 Sol보다 저성능하지만 저비용”이라는 위치로 이동했습니다.

X축을 작업별 처리 시간으로 변경하면 다음과 같습니다. Ember-1은 Kimi K3에 비해 처리 시간이 단축되었습니다.

파이어워크 AI가 임직원을 대상으로 Kimi K3를 Ember-1로 대체하는 테스트를 실시한 결과, 임직원들로부터 문제가 1건도 보고되지 않았습니다. 또한 고객 2사를 대상으로 실시한 A/B 테스트에서는 Ember-1가 Kimi K3와 동등한 성능으로 작업당 출력 토큰을 약 35% 감소시킬 수 있음이 확인되었습니다. Ember-1의 100만 토큰당 API 요금은 입력 3달러(약 470원)·캐시된 입력 0.3달러(약 47원)·출력 15달러(약 2350원)입니다. API에 대한 자세한 내용은 다음 링크에서 확인할 수 있습니다. Ember-1 API & Playground | 파이어워크 AI https://fireworks.ai/models/fireworks/ember-1

[원문 보기](https://gigazine.net/news/20260928-ember-1-fireworks/) | 출처: Gigazine