# GPU 대비 최대 30배 빠른 AI 실행을 위한 Cerebras의 “CS-4” 랙 스케일 솔루션 출시

> https://bookfactory.kr/c/news/10051
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-08-19T12:58:16.044Z

---

세레브라스가 랙스케일 솔루션 “CS-4”를 공개했습니다. AI 추론을 고속화하는 시스템을 개발 중인 세레브라스는 단순 GPU 시스템에 비해 최대 30배 빠른 추론 처리가 가능하다는 주장을 담고 있습니다. 제품 - 시스템 - 세레브라스 [https://www.cerebras.ai/cs4]

세레브라스 CS-4 소개: 가장 빠른 AI가 더욱 빨라진다 [https://www.cerebras.ai/blog/introducing-cerebras-cs-4]

CS-4는 1 시스템당 3개의 Wafer Scale Engine 3 Turbo(WSE-Turbo) 프로세서를 탑재하고 있으며, 각 웨이퍼는 전세대 최대 2배의 속도를 실현합니다. 이에 획기적으로 새로운 전원, 냉각, I/O 시스템이 더해져 웨이퍼당 성능을 더욱 끌어올리는 데 성공했다고 합니다.

WSE-Turbo를 탑재한 CS-4는 단순 GPU 시스템에 비해 최대 30배 빠른 추론을 실현합니다. 저지연 통신을 통해 CS-4는 10조 개 이상의 파라미터를 가진 모델로 매초 1,000개 이상의 토큰을 처리할 수 있다고 합니다. 세레브라스는 “GPU 시스템에서는 결코 이룰 수 없는 속도로 토큰을 생성한다”고 홍보했습니다.

세레브라스는 “AI 인프라 구조는 지금까지 양방향성과 총 처리량 중 하나를 선택하도록 강요받았습니다. CS-4는 이러한 상황을 변화시킵니다. CS-4는 기존 GPU 시스템보다 최대 30배 빠르게 토큰을 생성하는 동시에 CS-3에 비해 와트당 처리량을 최대 10배 향상시킵니다. 빠른 토큰은 느린 토큰보다 가치가 높기 때문에 CS-4는 제한된 전력 예산 내에서 더 가치 있는 토큰과 더 많은 토큰을 공급하여 데이터센터의 수익성을 크게 향상시킵니다. 사용자들은 더욱 응답성이 높은 경험을 누릴 수 있으며, 운영자는 더 많은 워크로드를 처리할 수 있는 능력을 얻을 수 있습니다”라고 밝혔습니다. 또한 CS-4는 구성 요소를 50% 줄이고 웨이퍼, 전력 변환, 액체 냉각, 고속 I/O, 제어 전자 장비를 컴팩트한 3D 패키지로 통합하여 제조 및 도입 기간을 단축했다고 합니다. 특히 연산 처리와 전원을 분리함으로써 제조 공정을 단순화하고 도입 시간을 며칠에서 몇 시간으로 단축했다고 합니다.

전력 효율 측면에서는 프로세서에서 단지 0.5mm 위치에 전원을 배치하여 개선을 도모하고 있다고 합니다. 이는 기존 GPU 보드에서 약 50mm에 비해 약 100배 가까운 거리이며, 이를 통해 전력 손실을 거의 0으로 만들고 공급 가능한 전력을 2배로 늘립니다.

세레브라스는 “CS-4는 도입 기간을 며칠에서 몇 시간으로 단축하고 하이퍼스케일 환경에서의 유지보수 및 향후 업그레이드를 단순화합니다. CS-4의 첫 번째 출하는 이번 분기에 시작되며 (2026년 9월 말까지) 예정되어 있습니다.”라고 밝혔습니다.

[원문 보기](https://gigazine.net/news/20260819-cerebras-cs-4/) | 출처: Gigazine