대규모 언어 모델(LLM) 및 이미지·영상 생성 AI를 고속으로 실행하려면 모델 전체를 고속 VRAM에 수용해야 합니다. 그러나 AI 수요에 따른 그래픽ボード 가격 고공행위로 인해 VRAM 용량 32GB의 NVIDIA GeForce RTX 5090는 100만 원을 초과하게 되었습니다. 한편, Intel製 GPU “Intel Arc Pro B70”를 탑재한 VRAM 용량 32GB의 ASRock製 그래픽ボード “Intel Arc Pro B70 Creator 32GB”는 30만 원 이하로 구매 가능합니다. 그런 Intel Arc Pro B70 Creator 32GB를 실제로 구매하여 LLM 및 영상 생성 AI 등을 실제로 실행해 보았습니다. ASRock > Intel Arc Pro B70 Creator 32GB https://www.asrock.com/Graphics-Card/Intel/Intel%20Arc%20Pro%20B70%20Creator%2032GB/index.jp.asp Intel® Arc™ Pro B70 Graphics https://www.intel.co.jp/content/www/jp/ja/products/sku/245797/intel-arc-pro-b70-graphics/specifications.html • 목차 ◆1: “Intel Arc Pro B70 Creator 32GB”는 어떤 그래픽ボードなのか ◆2: PC에 연결하여 설정 ◆3: Unsloth Desktop에서 Qwen3.8 27B 실행 ◆4: ComfyUI에서 이미지 생성 및 영상 생성 ◆5: 게임의 벤치마크 테스트도 실행 ◆6: 요약 ◆1: “Intel Arc Pro B70 Creator 32GB”는 어떤 그래픽ボードなのか NVIDIA의 공식 웹사이트에서는 NVIDIA GeForce RTX 5090의 가격은 39만 3800원과 されています。그러나, 기사 작성 시점에서는 가격이 고공행위하고 있으며, Amazon.co.jp에서 90만 원을 초과하는 것은 일상이며, 100만 원 이상의 제품도 존재합니다. 이는 Amazon.co.jp가 특별히 높다는 것과는 관련이 없으며, 최저 가격 정보를 검색할 수 있는 가격닷컴에서도 동일한 상황입니다. 아래는 2026년 9월 17일 시점의 Amazon.co.jp 스크린샷입니다.
한편 Intel Arc Pro B70 Creator 32GB는 Amazon.co.jp에서 세금 포함 29만 8054엔으로 구매 가능합니다. GIGAZINE 편집부에서 구매한 2026년 6월 시점의 가격은 세금 포함 22만 4800엔이어서 가격 상승은 있지만, 그럼에도 불구하고 NVIDIA GeForce RTX 5090의 3분 1 미만의 가격에 억제되고 있습니다. Amazon | ASRock Intel Arc Pro B70 탑재 Creator 32GB 비디오 카드 GDDR6 32GB 국내 정격 대리점 품 | ASRock | 그래픽보드 판매
Intel Arc Pro B70 Creator 32GB의 외관 및 탑재 포트 등은 다음 기사에 모아 놓았습니다. VRAM 32GB로 훌륭한 Intel 그래보 “Intel Arc Pro B70 Creator 32GB”를 구매했으니 개봉 의식, 외관 및 탑재 포트는 이렇습니다 - GIGAZINE
◆2: PC에 연결하여 설정하기 Intel Arc Pro B70 Creator 32GB의 전체 길이는 271mm입니다. 전원 포트가 외부 출력 포트의 반대쪽 면에 위치하며, 케이블에 부담이 가지 않도록 30mm의 간격을 두는 것이 권장되므로, 케이스에는 총 301mm의 수평 폭이 필요합니다. 참고로, 전체 길이가 331.9mm인 “GeForce RTX 5070 Ti GamingPro-S 16GB”와 나열하면 다음과 같습니다.
전원과 연결할 때는, 부속된 전원 케이블을 깊숙이 확실하게 꽂아 넣어야 합니다. 아래와 같이 간격이 남아있으면 위험합니다.
충분한 힘을 가해 간격이 사라질 때까지 꽂아 넣으십시오.
전원과 연결하면 메인보드의 PCIe 5.0 x16 슬롯에 장착하고 나사로 고정하면 OK입니다.
PC를 켜면 Intel의 드라이버 배포 페이지에 접속하여 드라이버 다운로드 및 설치를 실행합니다. 드라이버는 안정성을 중시하는 “Arc Pro 그래픽스”와 최신 환경에 빠르게 대응하는 “Arc 그래픽스”의 두 종류가 존재합니다. 이번에는 Arc 그래픽스를 설치했습니다.
설치한 드라이버의 버전은 “32.0.101.8991”입니다.
그래픽 카드 이외의 PC 구성은 다음과 같습니다. CPU는 “AMD Ryzen 5 7600X”, 메인보드는 “ASRock X670E Taichi Carrara”, RAM은 DDR5-5600 64GB, OS는 Windows 11 Pro입니다.
◆3: Unsloth Desktop으로 Qwen3.8 27B를 실행하여 LLM 실행 성능을 확인하기 위해 “Qwen3.8 27B”를 실행합니다. LLM 실행 앱은 수많은 존재하지만, 이번에는 PC 환경에 맞춰 자동으로 최적의 설정을 선택해주는 “Unsloth Desktop”을 채택했습니다. Unsloth Desktop의 버전은 “0.1.808-beta”이며, 내부에서 동작하는 llama.cpp의 버전은 “b11007”입니다.
Unsloth Desktop의 모델 관리 기능을 사용하여 Qwen3.8 27B를 다운로드합니다. 이번에는 Unsloth가 양자화한 “Qwen3.8-27B-GGUF” 중 4bit 양자화 버전인 “Qwen3.8-27B-UD-Q4_K_XL.gguf”와 8bit 양자화 버전인 “Qwen3.8-27B-UD-Q8_K_XL.gguf”를 다운로드했습니다.
4비트 양자화 버전의 “Qwen3.8-27B-UD-Q4_K_XL.gguf”를 실행한 결과, VRAM을 30.0GB를 사용했으며, RAM 상의 공유 GPU 메모리도 1.0GB를 사용했습니다.
디코딩 속도는 23.4 토크/초이며, 로컬 LLM으로서 실용적인 속도입니다. 이전 NVIDIA GeForce 5070 Ti를 사용하여 Hermes Agent에서 Qwen3.8 27B를 실행할 때는 “2비트 양자화 버전(IQ2_S)으로 겨우 20~30 토크/초”라는 상황이었으므로, Intel Arc Pro B70 Creator 32GB의 대용량 VRAM의 혜택이 잘 납니다.
8비트 양자화 버전의 “Qwen3.8-27B-UD-Q8_K_XL.gguf”를 실행한 경우, VRAM 사용량은 30.2GB이며, 공유 GPU 메모리 사용량은 1.5GB였습니다.
디코딩 속도는 15.9tok/s입니다. “눈으로 따라갈 수 있는 정도의 생성 속도”와 같이 실시간 대화 등의 용도에는 부적합하지만, “AI 에이전트를 항상 가동시켜 수신함에 도착한 이메일을 분석하게 한다”와 같은 실시간 처리가 불필요한 상황에서는 유용합니다. 일반적으로 8비트 양자화 버전은 비양자화 모델과 동등한 성능으로 평가되므로, “Qwen3.8-27B의 8비트 양자화 버전을 15.9tok/s로 실행한다”는 환경을 30만 원 미만의 그래픽 카드에서 구현할 수 있는 것은 상당히 유용합니다.
이제 ComfyUI에서 이미지 생성 및 영상 생성 실행 속도를 검증해 보겠습니다. 실행 환경은 “ComfyUI”를 채택했습니다. 데스크톱 버전 ComfyUI의 경우 인스턴스 생성 시 “Intel Arc”를 선택하는 것만으로 Intel 제조사의 GPU에 최적화된 환경을 구축할 수 있습니다.
먼저 ComfyUI 공식 워크플로우를 사용하여 이미지 생성 AI “Z-Image-Turbo”를 실행해 보겠습니다. 해상도는 “1024×1024 픽셀”, 단계 수는 “8”입니다.
생성 중 VRAM 사용량은 23.1GB입니다.
첫 번째 이미지는 36.23초에 생성 완료되었고, 두 번째 이후 이미지는 5.3초 전후로 생성되었습니다. 충분히 빠른 결과입니다.
생성 이미지의 예시는 다음과 같습니다. 인텔 GPU라고 해서 화질이 하락하는 일은 없었고, NVIDIA GPU와 동일 품질의 이미지를 생성할 수 있었습니다.
MiniMax H3 모델도 실행해 보겠습니다. ComfyUI 공식 워크플로우 설정을 그대로 사용했으며, diffusion 모델은 “minimax_h3_fl2va_pruned_int8_convrot.safetensors”, 음성 VAE는 “minimax_h3_audio_vae_fp32.safetensors”, 영상 VAE는 “minimax_h3_video_vae_fp16.safetensors”, 텍스트 인코더는 “qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors”, 고속화 LoRA는 “minimax_h3_fl2v_turbo_8step_v1.0_comfyui_bf16.safetensors”를 사용하고 있습니다. 생성 단계 수는 “8”이며, 영상 해상도는 “0.4메가픽셀”, 길이는 “5초”입니다.
생성 중 VRAM 사용량은 28.3GB였습니다. 공유 메모리의 0.2GB는 ComfyUI 시작 전에 사용하던 분입니다.
첫 번째 생성에 소요된 시간은 302.06초이며, 두 번째 생성은 351.14초입니다. VRAM 용량 16GB의 NVIDIA GeForce RTX 5070 Ti보다 생성 속도가 느립니다. 콘텐츠 생성 AI에서는 VRAM 용량뿐만 아니라 GPU의 연산 성능도 매우 중요합니다. 또한, 콘텐츠 생성 AI의 추론 시스템은 NVIDIA 제조 GPU에 최적화되어 있는 경우가 많으며, 같은 연산 성능의 GPU들끼리 비교했을 때 NVIDIA 제조 GPU에 유리하게 작용하는 경향이 있습니다. Z-Image-Turbo에서는 VRAM 용량의 많さが 생성 속도에 유리하게 작용하여 빠른 생성이 가능했지만, MiniMax H3의 경우에는 VRAM 용량 외에 다른 요소들의 영향이 훨씬 크게 작용하여 생성 속도가 느려진 것입니다. 이 때문에, MiniMax H3를 사용하여 영상을 생성하는 것이 주 목적이라면 NVIDIA 그래픽 카드를 선택하는 것이 좋습니다.
5:게임의 벤치마크 테스트도 실행합니다. 인텔 Arc Pro B70 크리에이터는 32GB 메모리를 탑재한 AI 전용 그래픽 카드라는 의미는 아니며, 게임도 쾌적하게 플레이할 수 있습니다. “파이널 판타지 XIV: 黄金의 레가시” 벤치마크 테스트를 실행한 결과, “1920x1080 최고 품질” 설정을 사용하여 1만 8434점을 기록하여 “매우 쾌적”하다고 평가되었습니다.
“3840×2160 최고 품질”에서의 점수는 9342로 평가는 “쾌적”했습니다.
◆6:요약 Intel Arc Pro B70 Creator 32GB를 실제로 사용해본 결과, 32GB라는 대용량 VRAM 덕분에 고성능의 로컬 LLM을 실용적인 속도로 실행할 수 있었습니다. 영상 생성은 빠르다고 할 수는 없지만 생성 자체는 가능합니다. “로컬에서 AI 에이전트를 항상 가동시키는” 것과 같은 용도에 매우 유용한 그래픽 카드였습니다. Intel Arc Pro B70 Creator 32GB는 2026년 9월 17일 시점에서는 Amazon.co.jp에서 29만 8054엔으로 구매할 수 있습니다. Amazon | ASRock Intel Arc Pro B70 탑재 Creator 32GB 비디오카드 GDDR6 32GB 국내 정품 미들웨어 | ASRock | 그래픽 카드 판매
Intel Arc Pro B70 Creator 32GB를 사용하여 AI 에이전트를 실행하는 리뷰 기사를 후일 공개 예정이니 기대해주세요!
원문 보기 | 출처: Gigazine