챕터별 상세
AI 하드웨어의 변화와 GPU의 부상
Transformer 아키텍처는 병렬 연산에 최적화된 구조를 가지고 있어 GPU의 성능을 극대화할 수 있다.
칩의 기본 구성 요소: 트랜지스터와 기능
CPU의 아키텍처적 특징
CPU는 직렬 처리에 최적화되어 있어 한 번에 하나씩 복잡한 논리를 처리하는 데 강점이 있다.
GPU의 아키텍처적 특징과 병렬 처리
VRAM(Video RAM)은 GPU 전용 메모리로, 일반 RAM보다 데이터 전송 속도가 훨씬 빠르다.
게임 산업에서 AI로의 기술 전이
BERT 모델은 약 1억 1천만 개의 파라미터를 가졌으나, 최신 모델들은 1조 개 이상의 파라미터를 보유하고 있다.
작업 유형별 하드웨어 선택 가이드
지연 시간(Latency)은 사용자가 요청을 보낸 후 응답을 받을 때까지 걸리는 시간을 의미한다.
용어 해설
- 그래픽 처리 장치(GPU)
- — 수천 개의 코어를 사용하여 여러 연산을 동시에 처리하는 병렬 아키텍처 기반의 하드웨어이다. 원래 그래픽 렌더링을 위해 설계되었으나, 대규모 행렬 연산이 필수적인 AI 모델의 학습과 추론에 최적화되어 현대 AI 인프라의 핵심 요소로 자리 잡았다.
- 중앙 처리 장치(CPU)
- — 컴퓨터의 두뇌 역할을 하며 복잡한 논리 구조와 순차적인 명령 처리에 최적화된 범용 프로세서이다. 다양한 작업을 유연하게 처리할 수 있지만, 단순 반복적인 대량의 수학 연산이 필요한 AI 작업에서는 GPU에 비해 효율성이 떨어진다.
- 병렬 처리(Parallel Processing)
- — 하나의 큰 문제를 여러 개의 작은 연산으로 나누어 동시에 처리하는 방식이다. GPU는 수많은 코어를 통해 이 방식을 극대화하며, 이를 통해 수십억 개의 파라미터를 가진 LLM의 연산 속도를 획기적으로 높인다.
- 메모리 대역폭(Memory Bandwidth)
- — 데이터가 메모리에서 프로세서로 전송되는 속도를 의미한다. LLM은 방대한 모델 가중치를 실시간으로 읽어와야 하므로, 높은 메모리 대역폭을 가진 GPU가 CPU 기반 시스템보다 훨씬 빠른 추론 성능을 제공한다.
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
