Gemini 3.5와 Gemini Omni가 여는 에이전트 시대의 시작
Google이 2026년 5월 발표한 Gemini 3.5, Gemini Omni 모델과 이를 탑재한 하드웨어 및 서비스 업데이트를 정리한다.
Google의 ML/AI 시스템 발전을 기록하는 연구 플랫폼으로 nested learning paradigms, ML for ML 애플리케이션, brain-computer alignment 연구 등을 다룹니다.
Google이 2026년 5월 발표한 Gemini 3.5, Gemini Omni 모델과 이를 탑재한 하드웨어 및 서비스 업데이트를 정리한다.
구글이 영상 생성 및 편집에 특화된 Gemini Omni와 에이전트 작업 및 코딩 성능을 강화한 Gemini 3.5 Flash 모델을 발표했다.
구글과 워털루 대학이 협력하여 운영하는 Futures Lab에서 학생들이 AI와 사용자 경험을 결합한 혁신적인 교육 도구들을 개발하고 있다.
Google I/O 2026에서 Gemini 3.5 Flash 모델, 에이전트 개발 플랫폼 Antigravity, 그리고 AI 기반 검색 및 창작 도구들을 대거 공개했다.
Google Workspace가 음성 기반 작업, 이미지 생성 도구 'Google Pics', AI Inbox 업데이트, 개인 AI 에이전트 'Gemini Spark'를 새롭게 선보였다.
구글이 Cloud Next '26을 통해 Gemma 4 오픈 모델, 8세대 TPU, 에이전트 플랫폼 등 '에이전트 시대'를 위한 핵심 기술들을 발표했다.
구글 번역 출시 20주년을 맞아 Gemini 모델을 활용한 실시간 음성 대화와 AI 기반 발음 연습 도구 등 최신 업데이트를 발표했다.
구글이 AI 에이전트의 추론 속도와 대규모 모델 학습 효율을 극대화하기 위해 설계된 TPU 8i와 TPU 8t 칩을 새롭게 선보였다.
구글이 크롬 브라우저에 검색 결과와 웹페이지를 나란히 띄워 상호작용할 수 있는 'AI 모드'와 멀티모달 검색 기능을 도입했다.
Gemini 앱이 구글 포토와 사용자 취향을 연동하여 별도의 사진 업로드 없이도 사용자 본인과 가족이 포함된 개인화된 이미지를 생성하는 기능을 출시했다.
Google이 Chrome 브라우저에서 자주 사용하는 AI 프롬프트를 저장하고 한 번의 클릭으로 실행할 수 있는 'Skills' 기능을 출시했다.
Google이 Gemini API에 비용 최적화형 'Flex'와 고신뢰성 'Priority' 추론 티어를 추가하여 개발자의 워크로드 관리 유연성을 높였다.
Google Vids가 Veo 3.1과 Lyria 3를 도입하여 AI 영상 및 음악 생성, 맞춤형 아바타 기능을 모든 사용자에게 확대 제공한다.
구글이 브라질 정부와 협력하여 과거 위성 데이터를 6배 정밀하게 복원한 고해상도 지도를 공개하고 산림 보호를 지원한다.
구글이 Veo 3.1 Fast 대비 비용을 50% 이상 낮추면서도 동일한 속도를 제공하는 개발자용 비디오 생성 모델 Veo 3.1 Lite를 출시했다.
구글이 Gemini 3.1 Flash Live를 기반으로 음성과 카메라를 활용해 대화하는 Search Live 기능을 전 세계 200개국 이상에 출시했다.
구글 번역의 헤드폰 실시간 번역 기능이 iOS로 확대 출시되었으며 70개 이상의 언어와 화자의 톤을 유지하는 자연스러운 통역을 지원한다.
Google을 포함한 주요 AI 기업들이 오픈소스 보안 강화를 위해 1,250만 달러를 기부하고, AI 기반 자율 취약점 탐지 및 수정 도구를 생태계 전반에 확산한다.
구글이 호주 보건 단체와 협력하여 Population Health AI(PHAI)를 통해 농어촌 지역의 심장 건강 위험을 조기 식별하고 맞춤형 예방 의료 서비스를 제공한다.
구글이 SpreadsheetBench 벤치마크에서 70.48%의 성공률을 기록하며 전문가 수준의 시트 편집 능력을 갖춘 Gemini in Sheets 베타 기능을 발표했다.
구글의 오픈 소스 AI 모델 SpeciesNet이 2,500종 이상의 동물을 식별하며 전 세계 야생동물 모니터링 및 보존 연구의 효율성을 혁신하고 있다.
구글이 미국 내 모든 사용자에게 AI 모드 'Canvas'를 공개하며, 웹 정보와 지식 그래프를 결합해 맞춤형 도구 제작 및 코딩·창작을 지원하는 동적 작업 공간을 제공합니다.
구글이 Gemini 모델을 활용해 구글 번역에 상황별 톤 조절, 관용구 대안 제시, 상세 뉘앙스 설명 및 질의응답 기능을 추가했다.
Google은 Gemini 3의 에이전트 기능을 활용해 이미지 내 여러 객체를 동시에 식별하고 분석하는 Circle to Search의 대규모 업데이트를 발표했다.