TL;DR
AI 공장은 가속기 성능만으로 결정되지 않고 네트워크, 랙, 냉각, 전력, 소프트웨어, 공급망을 결합한 전체 시스템의 토큰 처리량과 운영 비용으로 평가됩니다. NVLink Fusion은 맞춤형 XPU를 NVIDIA NVLink Scale-Up 인프라에 연결해 72개 XPU 영역에서 상용 Ethernet 기반 대안보다 XPU 간 전송 지연을 3배 낮추고 패킷 속도를 10배 높이는 구조를 제공합니다. NVLink-C2C는 XPU와 CPU 사이의 연결에서 PCIe보다 최대 6배 높은 에너지 효율을 내며, NVIDIA MGX와 DSX 기반 랙 설계는 XPU와 GPU 시스템이 냉각·전력·네트워크를 공유하도록 지원합니다. 그 결과 운영자는 최종 실리콘 조합을 늦게 확정하면서도 AI 공장 구축을 진행하고, NCCL·Dynamo·NIXL·Mission Control을 이용해 혼합 인프라를 하나의 시스템으로 관리할 수 있습니다.
섹션별 상세
- NVLink Fusion은 맞춤형 XPU를 NVIDIA의 Scale-Up 인프라에 연결해 semi-custom AI factory의 성능과 출시 속도를 높이고 구축 위험을 줄입니다. — 기사 도입부의 NVLink Fusion 설명 문단
- 6세대 NVLink는 72개 XPU 영역에서 XPU 간 전송 지연을 상용 Ethernet 기반 대안보다 3배 낮추고 패킷 속도를 10배 높입니다. — Unlock XPU Performance With Fast Scale-Up 섹션의 6세대 NVLink 성능 수치

- GB300 NVL72는 DeepSeek-V4-Pro 추론의 중간 Pareto 구간에서 B300보다 10배 넘는 GPU당 처리량을 보입니다. — 제공된 이미지 1의 그래프 ALT와 본문 중 NVIDIA AI Inference Performance Benchmarks 언급 출처
- NVLink-C2C는 PCIe 인터페이스보다 최대 6배 높은 에너지 효율로 XPU와 CPU를 연결합니다. — NVLink-C2C 설명 문단의 에너지 효율 수치
- XPU와 GPU 시스템은 NVLink Fusion을 통해 랙 공간, 네트워크, 냉각, 전력 공급, 관리 시스템을 공유할 수 있습니다. — Managing Risk With Infrastructure Standardization 섹션의 unified architecture 설명
- NVIDIA DSX와 Omniverse DSX AI Factory Blueprint는 AI 공장의 건물, 전력, 냉각, 컴퓨트, 네트워크를 배포 전에 함께 검증하도록 지원합니다. — Designed, Validated and Operated as a Factory 섹션의 DSX reference architecture 및 digital twin 설명
용어 해설
- Scale-Up 네트워킹(Scale-Up Networking)
- — 여러 XPU나 GPU를 하나의 고속 통신 영역으로 연결하는 네트워킹 방식입니다. 장치 간 데이터 전송 지연과 대역폭이 추론 처리량, GPU 활용률, 토큰당 비용에 직접 영향을 주므로 대규모 모델과 Agentic AI 인프라의 핵심 구성요소로 쓰입니다.
- XPU
- — GPU와 CPU를 포함해 특정 AI 연산에 맞게 설계된 맞춤형 프로세서를 가리키는 용어입니다. XPU 자체의 성능뿐 아니라 메모리 연결, Scale-Up 네트워크, 냉각, 전력, 소프트웨어를 함께 구축해야 실제 데이터센터 배포 성능을 확보할 수 있습니다.
- NVLink-C2C
- — XPU를 NVIDIA Vera CPU나 생태계의 다른 CPU와 연결하는 인터페이스입니다. 기사에서는 PCIe 인터페이스보다 최대 6배 높은 에너지 효율을 제공해 Agentic AI 시스템에서 제어 연산과 계산 연산 사이의 병목을 줄이는 기술로 제시됩니다.
- 랙 스케일 아키텍처(Rack-Scale Architecture)
- — 개별 가속기가 아니라 랙 단위로 컴퓨트 트레이, 스위치, 네트워크, 냉각, 전력, 관리 시스템을 통합하는 설계 방식입니다. 동일한 랙 규격과 운영 인프라를 여러 가속기 유형이 공유하면 실리콘 공급과 수요 변화에 맞춰 용량을 재구성하기 쉬워집니다.
- 디지털 트윈(Digital Twin)
- — 실제 시설과 기술 구성을 가상 환경에 재현해 배포 전에 동작을 검증하는 모델입니다. NVIDIA Omniverse DSX AI Factory Blueprint는 건물, 전력, 냉각, 컴퓨트, 네트워크를 함께 모델링해 대규모 AI 공장 구축 과정의 재작업 위험을 줄이는 데 사용됩니다.
기술
- NVLink Fusion
- Sixth-generation NVLink
- NVLink-C2C
- NVIDIA Vera CPUs
- NVIDIA MGX
- NVIDIA DSX reference architecture
- NVIDIA Omniverse DSX AI Factory Blueprint
- NCCL
- NVIDIA Dynamo
- NIXL
- NVIDIA Mission Control
- Co-Packaged Optics
- 800 VDC
활용 사례
- 맞춤형 XPU를 활용한 semi-custom AI factory 구축
- Trillion-parameter 모델 추론
- Mixture-of-Experts 모델 운영
- Agentic AI 추론과 서비스
- Training, post-training, reasoning, retrieval, serving을 위한 혼합 가속기 인프라
- 랙 단위 냉각·전력·네트워크를 공유하는 데이터센터 구축
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.