본문으로 건너뛰기

NVIDIA Cosmos 3 및 Nemotron 3 Ultra 공개와 에이전트 생태계 동향

NVIDIA의 Cosmos 3와 Nemotron 3 Ultra 출시를 비롯해 에이전트 런타임과 로컬 AI 시스템으로 이동하는 최신 AI 기술 동향을 정리한다.

섹션별 상세

Cosmos 3는 언어, 이미지, 비디오, 오디오, 행동을 통합한 Mixture-of-Transformers 아키텍처를 채택하여 물리 AI를 위한 옴니모달 모델로 설계됐다.
Cosmos 3의 Mixture-of-Transformers 아키텍처 다이어그램.
DiagramCosmos 3가 언어, 이미지, 비디오, 오디오, 행동 데이터를 어떻게 처리하는지 보여준다. 오토리그레시브 추론기와 확산 생성기를 결합한 구조를 시각화하여 모델의 멀티모달 통합 방식을 설명한다.
Nemotron 3 Ultra는 550B 파라미터 규모의 오픈 웨이트 모델로, 에이전트 생산성, 코딩, 지식 작업 등에서 강력한 성능을 발휘하며 미국 내 오픈 모델 중 최상위권 성능을 기록했다.
NVIDIA Nemotron 3 Ultra의 비용 효율성 및 성능 비교 차트.
ChartNemotron 3 Ultra가 다른 모델 대비 비용 효율성 측면에서 우위에 있음을 보여주는 차트이다. 작업 완료 비용과 작업 완료율 간의 관계를 통해 모델의 경제적 경쟁력을 강조한다.
MiniMax M3와 Qwen3.7-Plus는 멀티모달 에이전트 모델로서 GUI/CLI 조작, 시각적 추론, 코딩 기능을 통합하여 에이전트 생태계의 확장을 주도한다.
기술 스택의 중심이 모델 호출에서 에이전트 런타임으로 이동함에 따라, Perplexity의 Search as Code나 Google의 Managed Agents와 같이 샌드박스 환경에서 코드를 실행하고 관리하는 방식이 표준으로 자리 잡았다.
NVIDIA의 RTX Spark는 Grace와 Blackwell 아키텍처를 기반으로 1 PFLOP FP4 성능을 제공하며, 로컬 AI 시스템이 클라우드와 경쟁하는 새로운 하드웨어 클래스를 제시한다.

기술

  • Cosmos 3
  • Nemotron 3 Ultra
  • RTX Spark
  • MiniMax M3
  • Qwen3.7-Plus
  • Perplexity
  • LangChain

활용 사례

  • 에이전트 런타임 구축
  • 로컬 AI 시스템 배포
  • 멀티모달 에이전트 개발
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 06. 02.수집 2026. 06. 02.출처 타입 RSS

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.