리소스백서

Backend.AI + Intel Gaudi 3:
벤치마크와 심층 통합

Backend.AI와 Intel Gaudi 3 AI 가속기 성능에 관한 종합 백서

Backend.AI + Intel Gaudi 3: 벤치마크와 심층 통합

Backend.AI와 Intel Gaudi 3가 소형 및 대형 언어모델 추론 워크로드에서 뛰어난 성능을 제공하는 상세한 벤치마크를 담은 종합 백서입니다. Backend.AI와 Intel Gaudi 3가 결합되었을 때 보여주는 성능과 최적화를 위한 다양한 방법들을 확인해보세요.

GPU 클라우드(NeoCloud)를 위한 Gaudi 3 인프라 운영

이 백서는 영문으로 제공됩니다.

Intel Gaudi 3는 5nm 공정 기반의 AI 가속기로, MME 8개와 TPC 64개, 128GB HBM2e 메모리와 3.7TB/s 메모리 대역폭을 갖추고 OAM과 PCIe 두 가지 폼팩터로 제공됩니다. Backend.AI는 카드 단위 가속기 할당, NUMA 인지 자원 스케줄링, 외부 스토리지 연동, 사용자별 쿼터 관리로 Gaudi 3 클러스터를 멀티테넌트 환경으로 운영합니다. 단일 카드 추론 세션과 멀티 노드 분산 학습 작업이 같은 스케줄러 위에서 배치되므로, 워크로드 규모가 달라져도 운영 방법이 달라지지 않습니다.

백서에는 Llama 3.1 8B와 70B 모델로 수행한 벤치마크가 담겨 있습니다. 소형·대형 모델 각각의 측정 결과와 함께 배포 권장 구성과 최적화 전략을 정리해, 워크로드 규모에 맞는 운영 기준을 제시합니다. 측정 조건과 모델별 상세 결과는 백서 전문에서 확인해보세요.

Backend.AI + Intel Gaudi 3: 벤치마크와 심층 통합

리소스 다운로드

아래 양식을 작성해 주세요.

관련 서비스

Backend.AI

Backend.AI는 자체 개발한 오케스트레이션 및 작업 스케줄러를 기반으로 하는 벤더 중립적 가속 워크로드 호스팅 플랫폼으로, 클라우드 또는 온프레미스(에어갭) 클러스터 위에서 실행됩니다.

서비스 살펴보기
Intel

성능, 확장성 및 효율성으로 genAI에 대한 선택권을 제공합니다. 나만의 방식으로 AI 워크로드를 처리하도록 구축된 새로운 고성능 옵션을 만나보십시오.

자세히 보기

도움이 필요하신가요?

내용을 작성해 주시면 곧 연락 드리겠습니다.

문의하기
lablup

본사 및 HPC 연구소

KR Office: 서울특별시 강남구 선릉로 577 CR타워 8층 US Office: 3003 N First st, Suite 221, San Jose, CA 95134

  • facebook
  • youtube
  • Linkedin
  • GitHub

© Lablup Inc. All rights reserved.

개인정보를 소중히 여깁니다

쿠키는 사이트 트래픽 분석, 방문자 이용 방식 파악, 서비스 개선에 사용됩니다. 사이트 기본 동작에 필요한 필수 쿠키는 항상 활성화됩니다. 자세히 보기

"모두 수락"을 클릭하면 분석 쿠키가 기기에 저장되는 것에 동의하게 됩니다. 필수 쿠키만 허용하시려면 "모두 거부"를, 직접 선택하시려면 "상세 설정"을 눌러주세요. 설정은 언제든지 변경할 수 있습니다.