챕터별 상세
00:12
딥세이크의 새로운 대형 베이스 모델 출시 예고
딥세이크 직원이 중국 소셜 미디어를 통해 현재 웹 버전보다 훨씬 큰 규모의 새로운 베이스 모델 출시를 예고했습니다. 현재 API로 제공되는 v3.2 모델이 웹 버전보다 크며 이를 능가하는 차세대 모델이 파이프라인에 있음을 확인했습니다. 과거 01 수준의 추론 능력을 저비용으로 구현해 충격을 주었던 딥세이크가 다시 한번 시장 흔들기를 시도하고 있습니다. 다만 화웨이 Ascend 칩 기반 학습 실패 보고서가 나오면서 엔비디아 하드웨어 의존성 문제가 부각되었습니다.
DeepSeek은 중국의 AI 연구소로 효율적인 학습 기법을 통해 고성능 모델을 저비용으로 배포하는 것으로 유명합니다.
02:59
OpenAI 차세대 모델 Spud 훈련 완료 및 Sora 앱 종료
OpenAI가 코드명 Spud로 알려진 차세대 플래그십 모델의 초기 개발 및 핵심 훈련을 완료했습니다. 샘 알트만은 인프라 확장을 언급하며 이 사실을 간접적으로 확인했으며 현재는 사후 학습 및 안전성 평가 단계에 진입했습니다. 동시에 OpenAI는 컴퓨팅 자원을 차세대 모델에 집중하기 위해 Sora 모바일 앱 서비스를 종료하기로 결정했습니다. 이는 소비자용 앱 시장보다 핵심 모델 성능 우위를 확보하려는 전략적 선택으로 풀이됩니다.
Spud는 GPT-5.5 또는 GPT-6로 예상되는 OpenAI의 차세대 대규모 언어 모델의 내부 코드명입니다.
06:00
Claude 모바일 앱의 워크 툴 통합 업데이트
Anthropic이 Claude 모바일 앱에 Figma, Canva, Amplitude 등 외부 워크 툴 통합 기능을 출시했습니다. 이제 사용자는 데스크톱뿐만 아니라 모바일에서도 디자인 시안 확인, 슬라이드 제작, 데이터 대시보드 분석을 직접 수행할 수 있습니다. 이는 Claude를 단순한 챗봇이 아닌 통합 업무 플랫폼으로 진화시키려는 전략의 일환입니다. 모바일 환경에서의 도구 통합은 협업 효율성을 극대화하는 데 초점을 맞추고 있습니다.
Anthropic은 OpenAI 출신들이 설립한 AI 기업으로 안전성과 실무 활용성에 집중한 Claude 모델을 개발합니다.
07:17
AGI의 한계를 증명한 ARC-AGI-3 벤치마크
새로운 AI 벤치마크인 ARC-AGI-3 결과가 발표되었으며 인간은 100%를 기록한 반면 최신 AI 모델들은 1% 미만의 점수를 기록했습니다. 이 테스트는 모델이 이미 학습한 지식이 아니라 처음 보는 환경에서 규칙을 추론하고 가설을 세워 적응하는 능력을 측정합니다. AI 모델들은 익숙하지 않은 게임 환경에서 이전 학습 데이터를 혼동하거나 미래를 예측하지 못하는 한계를 보였습니다. 이는 현재의 대규모 연산 기반 모델들이 인간의 효율적인 학습 메커니즘을 따라가지 못하고 있음을 시사합니다.
ARC-AGI는 인공 일반 지능(AGI)에 얼마나 근접했는지 측정하기 위해 고안된 추론 중심의 벤치마크입니다.
언급된 리소스
AI 분석 전체 내용 보기
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
원문 발행 2026. 03. 26.수집 2026. 03. 26.출처 타입 YOUTUBE
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.