TL;DR
구글이 리더십 교체와 핵심 인력 이탈로 AI 경쟁에서 밀리고 있다는 비판을 받았으나, 최근 신규 모델과 창업자의 복귀를 통해 반격에 성공하는 모습이다. 이미지와 코딩 벤치마크에서는 한때 부진했으나, 비디오 분석 분야에서는 여전히 세계 1위의 성능을 유지하며 멀티모달 강자임을 입증했다. 특히 세르게이 브린이 직접 개발에 참여한 이후 출시된 Gemini 3.7 Flash는 에이전트 및 추론 벤치마크에서 경쟁사의 상위 모델들을 제치는 놀라운 가성비를 보여주었다. 결과적으로 구글은 일시적인 정체를 극복하고 다시 한번 AI 시장의 강력한 주도권 경쟁자로 부상하고 있다.
챕터별 상세
구글의 리더십 변화와 위기설
데미스 허사비스는 알파고를 만든 딥마인드의 창업자로, 그의 역할 변화는 구글 AI 전략의 큰 전환점으로 평가받는다.
이미지 생성 벤치마크의 부진
LMSYS Arena와 같은 벤치마크는 실제 사용자들의 블라인드 테스트 결과를 기반으로 모델의 순위를 매긴다.
비디오 분석 분야의 독보적 우위
멀티모달은 텍스트, 이미지, 비디오 등 다양한 형태의 데이터를 동시에 이해하고 처리하는 능력을 말한다.
수학 및 코딩 성능의 격차
SWE-bench는 AI가 실제 소프트웨어 코드의 버그를 수정하거나 기능을 구현하는 능력을 평가하는 엄격한 기준이다.
세르게이 브린의 복귀와 반격
파운더 모드(Founder Mode)는 창업자가 세세한 실무까지 직접 챙기며 빠른 의사결정을 내리는 경영 방식을 뜻한다.
Gemini 3.7 Flash의 놀라운 성과
Flash 모델은 크기가 작고 속도가 빠른 모델을 의미하며, 일반적으로 거대 모델보다 지능이 낮지만 3.7 버전에서 이 한계를 극복했다.
용어 해설
- 프런티어 모델(Frontier Model)
- — 현재 기술 수준에서 가장 뛰어난 성능과 범용성을 가진 최첨단 AI 모델을 의미한다. OpenAI의 GPT-4나 Anthropic의 Claude 3 계열이 대표적이며, 구글은 Gemini를 통해 이 시장에서 경쟁하고 있다.
- ARC-AGI 2 벤치마크(ARC-AGI 2)
- — 인간 수준의 일반 인공지능(AGI)에 근접했는지 측정하기 위해 설계된 추론 테스트다. AI가 학습 데이터에 없는 새로운 규칙을 얼마나 빠르게 파악하고 문제를 해결하는지 평가하며, 최근 Gemini 3.7 Flash가 이 지표에서 우수한 성적을 거뒀다.
- 에이전트 벤치마크(Agent Benchmark)
- — AI 모델이 단순히 텍스트를 생성하는 것을 넘어, 도구를 사용하거나 복잡한 워크플로우를 자율적으로 수행하는 능력을 측정한다. 구글의 최신 모델들은 이 벤치마크에서 경쟁사 상위 모델들을 제치며 실질적인 작업 수행 능력을 증명하고 있다.
- 아이소모픽 랩스(Isomorphic Labs)
- — 구글 딥마인드에서 분사한 AI 기반 신약 개발 전문 기업이다. 데미스 허사비스가 구글 딥마인드 CEO에서 의장으로 직함을 옮기며 이곳의 리더십에 더 집중하게 된 것이 구글 AI 전략 변화의 핵심 중 하나로 꼽힌다.
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.