용어 해설
- 3D 비주얼 그라운딩(3D Visual Grounding)
- — 자연어 설명을 기반으로 3D 장면 내에서 특정 물체의 위치를 정확히 찾아내는 기술이다. 텍스트의 의미적 이해와 3D 공간의 기하학적 구조를 결합해야 하므로 로봇 공학 및 증강 현실 분야에서 핵심적인 역할을 한다.
- 제로샷 학습(Zero-Shot Learning)
- — 모델이 학습 과정에서 한 번도 본 적 없는 범주나 데이터에 대해 추가적인 학습 없이 추론을 수행하는 기법이다. 사전 학습된 거대 모델의 범용 지식을 활용하여 새로운 환경이나 물체에 즉각 대응할 수 있게 한다.
- RGB-D 스트림(RGB-D)
- — 일반적인 컬러 이미지(RGB)에 각 픽셀의 거리 정보인 깊이(Depth) 데이터가 결합된 영상 데이터 형식이다. 2D 이미지의 시각 정보와 3D 공간의 거리 정보를 동시에 제공하여 정밀한 3D 재구성을 가능하게 한다.
- 다중 뷰 기하학(Multi-view Geometry)
- — 서로 다른 위치에서 촬영된 여러 장의 2D 이미지들 사이의 기하학적 관계를 이용하여 3D 구조를 복원하는 수학적 원리이다. 카메라의 위치와 각도 파라미터를 통해 2D 픽셀을 3D 좌표로 변환하는 핵심 기반이 된다.
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.