최근 채용 관리 시스템이나 스카우트 도구 영업 담당자로부터 “저희 AI는 최신 모델을 탑재하고 있습니다”라는 말을 듣는 일이 많아졌습니다. 솔직히 최신이라고 해도 무엇이 어떻게 최신인지 몰랐습니다.
그러던 중 저 역시困っていた 일이 있습니다. 생성형 AI를 이용해 채용 업무를 진행하면, Fable(현 시점의 Anthropic 최상위 모델)은 1시간 정도면 이용 한도에 도달하고, 그 하위 모델인 Opus5.1도 2시간 정도면 멈춰 버립니다. 작업 도중에 매번 중단해야 해서 솔직히 꽤 스트레스가 컸습니다.
얼마 전, Anthropic이 새로운 모델 'Opus 5.5'를 발표했습니다. 알아보니, 이 모델은 성능 면에서 상위 모델에 상당히 가까워졌을 뿐만 아니라 사용 한도 자체가 상향되었다고 합니다. 제가 느끼던 '도중에 멈춘다'는 불만에 직접 답하는 업데이트였던 셈입니다.
여기서 깨달은 점이 있습니다. 지금까지 저는 ‘성능이 높은 모델일수록 좋다’는 단순한 시각을 가지고 있었지만, 실제 업무에서 곤란했던 것은 성능이 아니라 얼마나 오랜 시간 끊기지 않고 계속 사용할 수 있는가 하는 점이었습니다. 서류 전형의 1차 확인처럼 한꺼번에 시간을 들여 계속 처리하는 작업일수록 이 제한에 걸리기 쉽다는 것을 알게 되었습니다.
이 이야기는 채용 도구를 고를 때에도 그대로 적용된다고 생각합니다. 벤더로부터 “최신 고성능 AI 탑재”라는 설명을 들었을 때, 성능의 높이보다 먼저 확인해야 할 것은 자사의 사용량에 비추어 그 계약 플랜으로 실무를 얼마나 감당할 수 있는지 아닐까요. 성능은 높지만 하루 도중에 상한에 도달해 사용할 수 없게 된다면 실무에서는 의미가 없습니다.
다음에 툴을 검토할 때는 "어떤 모델을 사용하고 있는가"보다 먼저 "하루에 어느 정도의 분량까지 실무에서 사용할 수 있는 설정인가"를 확인하려고 합니다. 성능 이름에 휘둘리기보다는 그 한마디를 묻는 편이 실무에 훨씬 도움이 될 것입니다.
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 6청크
원문 보기 | 출처: note.com