RNGD meets Backend.AI:
주권 AI 시대를 위한 AI 추론 인프라
벤치마크로 알아본 추론 특화 가속기 RNGD와 Backend.AI 통합 구성
추론 전용 가속기는 같은 서빙 작업을 더 적은 전력으로 처리하도록 설계되어, 상시 운영되는 추론 서비스의 운영 비용을 낮춥니다. 국내에서 설계된 FuriosaAI의 추론 가속기 RNGD를 Backend.AI 단일 운영 체계에서 할당·서빙하는 통합 구성과, 동등 조건 벤치마크로 알아본 처리량·전력 효율 특성을 확인해보세요.
관련 서비스
Backend.AI는 자체 개발한 오케스트레이션 및 작업 스케줄러를 기반으로 하는 벤더 중립적 가속 워크로드 호스팅 플랫폼으로, 클라우드 또는 온프레미스(에어갭) 클러스터 위에서 실행됩니다.
서비스 살펴보기 →FuriosaAI는 데이터센터 추론용 AI 가속기를 설계하는 기업입니다. Tensor Contraction Processor 아키텍처 기반의 RNGD는 카드당 TDP 180W로 대규모 언어모델을 높은 전력 효율로 서빙하도록 설계되었습니다.
자세히 보기 →