핵심 내용

NVIDIA가 투자한 Upscale AI는 10월 8일 Token Fabric을 공개했다. NVIDIA Spectrum-X 기반 scale-out 네트워크와 자체 SkyFabriX scale-up 실리콘, SkyOS 운영체제, SkyCMD 관리·관측 도구를 묶어 서로 다른 GPU·XPU 공급자의 가속기를 한 데이터센터 안에서 연결하는 구조다. Upscale은 SkyFabriX 실리콘이 115.2Tbps의 처리용량을 지원한다고 발표했다. 이는 회사가 제시한 칩 설계·제품 사양으로 실제 고객 workload의 종단간 성능을 의미하지 않는다.

Reuters에 따르면 먼저 데이터센터 내 가속기 그룹을 연결하는 기능을 2026년 4분기에 제공하고, 전체 플랫폼은 2027년까지 단계적으로 출시할 계획이다. 회사가 발표한 이름과 아키텍처의 공개가 모든 구성요소의 정식 양산·대규모 배포 완료를 뜻하지는 않는다.

배경

고가의 AI 칩도 데이터를 기다리느라 유휴상태가 길어지면 실제 tokens/s와 비용 효율이 낮아진다. 멀티벤더 데이터센터에서는 각 칩 공급자가 요구하는 인터커넥트와 네트워크 소프트웨어가 달라 운영 부담이 커진다.

산업·시장에 미치는 영향

AI 인프라 경쟁이 개별 가속기 성능보다 rack 단위의 통신, 이종 칩 연결, 전력·네트워크 관리까지 포함하는 방향으로 이동할 수 있다. 개방형 표준을 통한 유연성은 매력적이지만 단일 공급자의 최적화된 fabric과 비교해 실제 대역폭·지연·집단통신 성능을 확인해야 한다.

실무에서 바로 활용할 수 있는 시사점

여러 GPU·XPU를 혼합하는 팀은 이론적 링크 속도가 아니라 all-reduce latency, 통신 혼잡, GPU idle 비율, 장애 후 복원, 운영 복잡도와 완료 토큰당 비용을 기준으로 네트워크를 평가할 필요가 있다. 제품 로드맵과 현재 구매 가능한 구성은 구분해야 한다.

출처

Upscale AI — Introducing Token Fabric

Reuters — Nvidia-backed Upscale AI launches platform