본문으로 건너뛰기
Matt Wolfe조회 1

이번 주 놓치지 말아야 할 주요 AI 뉴스 총정리

OpenAI의 자체 칩 Jalapeño 공개, 오픈소스 모델 사용량 급증, Apple M5 Ultra 발표 등 이번 주 핵심 AI 트렌드를 요약했다.

이 요약은 AI가 원문을 분석해 생성했습니다. 정확한 내용은 원문 기준으로 확인하세요.

TL;DR

이번 주 AI 업계는 하드웨어 혁신과 오픈소스 모델의 급격한 성장이 두드러진 한 주였다. OpenAI는 기존 가속기 대비 성능을 104배 높인 자체 추론 칩 Jalapeño를 공개했으며, Apple은 4.5배 향상된 GPU 성능을 갖춘 M5 Ultra 칩을 발표하며 로컬 AI 시대를 예고했다. 통계적으로도 오픈소스 모델의 토큰 사용량이 62%를 돌파하며 시장의 주도권이 폐쇄형 API에서 개방형 모델로 이동하고 있음이 확인됐다. 또한 Google과 Anthropic은 비디오 생성, 음성 인식, 워크플로우 자동화 등 실질적인 사용자 경험을 개선하는 수많은 업데이트를 쏟아내며 생태계 확장에 박차를 가했다.

챕터별 상세

00:16

OpenAI Jalapeño와 Nvidia의 인수설

OpenAI가 Nvidia 의존도를 낮추기 위해 개발 중인 자체 추론 칩 Jalapeño의 첫 성능 결과를 공개했다. 벤치마크 결과 Jalapeño는 기존 가속기 대비 오픈소스 모델 추론 성능이 최대 104배 향상된 것으로 나타났다. 한편 Nvidia가 오픈소스 AI 플랫폼인 Hugging Face를 129억 달러에 인수하기로 합의했다는 보고가 전해졌다. 이는 Nvidia가 폐쇄형 클라우드에서 벗어나 오픈소스 생태계의 인프라를 장악하려는 전략적 움직임으로 해석된다.
03:56

오픈소스 모델의 급격한 점유율 상승

Vercel의 AI Gateway 데이터에 따르면 모델 사용 비중에서 오픈소스 모델이 폐쇄형 모델을 압도하기 시작했다. 2024년 6월 28.4%였던 오픈소스 모델의 토큰 점유율은 8월 기준 62%까지 급증하며 시장의 판도를 뒤집었다. 요청 횟수 기준으로는 여전히 폐쇄형 모델이 62%로 우세하지만, 오픈소스 모델이 상호작용당 훨씬 더 많은 토큰을 처리하고 있음이 확인됐다. 이는 고성능 오픈소스 모델의 확산과 기업들의 채택 증가를 시사하는 중요한 지표이다.
05:21

Apple M5 Ultra와 로컬 AI 하드웨어

Apple은 로컬 AI 연산 성능을 획기적으로 끌어올린 M6 및 M5 Ultra 칩을 발표했다. M5 Ultra는 M3 Ultra 대비 최대 4.5배 높은 GPU 피크 연산 성능을 제공하며, 최대 512GB의 통합 메모리를 지원한다. 이를 통해 사용자는 클라우드 인프라에 의존하지 않고도 Qwen이나 GLM 같은 거대 모델을 자신의 기기에서 직접 구동할 수 있다. 고성능 하드웨어의 보급은 개인화된 AI 에이전트와 프라이버시 중심의 연산 환경을 가속화할 전망이다.
07:01

GLM-5.3-Flash와 Qwen3.8-Flash 출시

Zhipu AI의 GLM-5.3-Flash와 Alibaba의 Qwen3.8-Flash가 출시되어 비용 효율성의 새로운 기준을 제시했다. GLM-5.3-Flash는 DeepSwee 벤치마크에서 63.4점을 기록하며 Claude 3 Opus를 능가하는 성능을 보였으나 운영 비용은 훨씬 저렴하다. Qwen3.8-Flash 역시 125B 파라미터 규모로 강력한 성능을 입증하며 오픈소스 모델의 경쟁력을 높였다. 이러한 'Flash' 계열 모델들은 최상위권 지능을 유지하면서도 추론 비용을 획기적으로 낮추는 데 성공했다.
11:42

Google Gemini 생태계의 대대적 업데이트

Google은 Gemini Omni 1.1 Flash를 업데이트하며 비디오 생성 모델 분야에서 1위를 차지했다. 또한 기존 Whisper보다 정확도가 높다고 주장하는 Gemini 3.5 Transcribe 모델을 공개하여 음성 인식 시장에 도전장을 내밀었다. 검색 서비스에는 AI 모드를 추가하여 항공권 가격 추적과 호텔 예약을 인터페이스 내에서 직접 처리할 수 있게 했다. Gemini Notebook은 Google Play Books에서 구매한 전자책을 직접 연동하여 분석할 수 있는 기능을 추가하며 활용도를 넓혔다.
17:14

ChatGPT와 Claude의 기능 경쟁

OpenAI는 스프레드시트를 대시보드로 변환하는 'Sites' 기능을 출시하고, ChatGPT Work에서 웹사이트 자동 로그인을 지원하기 시작했다. 또한 GPT-5.6 Sol 모델의 가격을 향후 3개월간 20% 인하하며 가격 경쟁력을 확보했다. Anthropic은 Claude Cowork에 내장 브라우저를 탑재하고 웹 요약을 위한 Chrome 확장 프로그램을 정식 출시했다. Claude의 메모리 기능은 이제 채팅과 Cowork 세션 간에 동기화되어 사용자의 맥락을 더 정확하게 유지한다.
20:21

로컬 에이전트와 로봇 공학의 진보

Perplexity는 사용자 기기에서 Llama 3나 Qwen 모델을 직접 구동하는 로컬 우선 에이전트 'Portable Computer'를 발표했다. Skild AI는 단 하나의 영상 프롬프트만으로 로봇에게 새로운 동작을 학습시킬 수 있는 S1 파운데이션 모델을 공개했다. S1은 10분 분량의 작업 영상을 시청한 뒤 별도의 파인튜닝 없이 팬케이크 굽기나 커피 추출 동작을 재현하는 데 성공했다. 이는 AI가 디지털 정보를 넘어 물리적 세계의 복잡한 작업을 수행하는 능력이 비약적으로 발전했음을 보여준다.
23:11

TIME 100 AI 리스트와 업계 동향

Stability AI가 주요 엔터테인먼트 기업들로부터 대규모 투자를 유치하며 음악 및 영상 생성 AI 분야의 입지를 다졌다. 한편 TIME지가 발표한 'AI 분야에서 가장 영향력 있는 100인' 리스트가 업계의 논란을 불러일으켰다. Jensen Huang이나 Andrej Karpathy 같은 핵심 인물들이 제외된 반면, 기술적 기여도가 낮은 유명인들이 포함된 것에 대해 비판이 제기됐다. 이는 대중 매체가 바라보는 AI 영향력과 실제 기술 현장의 괴리를 보여주는 사례로 평가받는다.
text
A video of a robot wearing a hat that says "Future Tools" on it breakdances in front of a castle where a dragon flies overhead.

Skild AI의 S1 모델 테스트를 위해 사용된 로봇 동작 생성 프롬프트

용어 해설

추론(Inference)
학습을 마친 AI 모델이 새로운 입력 데이터에 대해 예측을 수행하거나 결과를 생성하는 단계이다. 실시간 서비스의 응답 속도와 비용을 결정하는 핵심 과정으로, 최근 전용 칩 개발을 통한 최적화 경쟁이 치열하다.
가중치 공개 모델(Open Weight Model)
모델의 핵심 지능을 결정하는 가중치를 대중에게 공개한 AI 모델이다. 사용자가 자신의 서버나 로컬 기기에서 직접 모델을 구동하고 수정할 수 있어, 폐쇄형 API 모델의 대안으로 급부상하고 있다.
토큰(Token)
AI 모델이 텍스트를 처리하는 기본 단위로, 단어나 문장 성분을 수치화한 것이다. 모델의 사용량과 비용을 측정하는 척도로 사용되며, 토큰 처리량이 많을수록 더 길고 복잡한 맥락을 이해할 수 있다.
비디오 램(VRAM)
그래픽 처리 장치(GPU)가 사용하는 전용 메모리로, AI 모델의 파라미터를 적재하는 공간이다. VRAM 용량이 클수록 더 크고 정교한 AI 모델을 로컬 환경에서 원활하게 구동할 수 있다.
파운데이션 모델(Foundation Model)
방대한 양의 데이터를 사전에 학습하여 다양한 하위 작업에 범용적으로 적용할 수 있는 거대 AI 모델이다. 텍스트뿐만 아니라 로봇 공학 등 다양한 도메인에서 지능의 기초가 되는 역할을 한다.
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 08. 29.수집 2026. 08. 29.출처 타입 YOUTUBE

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.