Gemini 3.5 Flash에 내장된 컴퓨터 조작 기능으로 에이전트 자동화 확장
Gemini 3.5 Flash는 computer use를 메인 모델에 통합해 브라우저·데스크탑·모바일에서 직접 보고 조작하는 에이전트를 API로 제공하며 안전 장치를 선택적으로 제공한다.
Google DeepMind의 연구 발표 블로그로 game-playing AI, robotics, 과학적 발견 및 AlphaFold 개발에 중점을 둡니다.
Gemini 3.5 Flash는 computer use를 메인 모델에 통합해 브라우저·데스크탑·모바일에서 직접 보고 조작하는 에이전트를 API로 제공하며 안전 장치를 선택적으로 제공한다.
Google DeepMind와 영국 정부가 협력하여 주택 건축 허가 신청 처리 시간을 50% 단축하는 AI 계획 도구를 개발하고 있다.
Google이 70개 이상의 언어를 실시간으로 번역하고 화자의 억양을 보존하는 오디오 모델 Gemini 3.5 Live Translate를 공개했다.
Google DeepMind가 노트북 환경에서 구동 가능한 12B 규모의 멀티모달 모델 Gemma 4 12B를 공개했다.
Google DeepMind가 유럽의 초기 단계 로봇 스타트업 15곳을 선정하여 3개월간 기술 멘토링과 AI 모델 접근 권한을 제공하는 액셀러레이터 프로그램을 시작한다.
Google DeepMind가 아시아 태평양 지역의 기후 및 환경 문제 해결을 위해 'AI for the Planet' 액셀러레이터 프로그램을 시작한다.
Google DeepMind가 대한민국 과학기술정보통신부와 협력하여 서울에 AI 캠퍼스를 설립하고 AlphaFold 등 첨단 과학 모델을 통한 공동 연구와 인재 양성에 나섭니다.
구글이 70개 이상의 언어를 지원하며 오디오 태그를 통해 감정과 속도를 정밀하게 제어할 수 있는 고성능 음성 합성 모델 Gemini 3.1 Flash TTS를 발표했다.
구글 딥마인드가 추론 능력과 에이전트 워크플로우에 최적화된 Apache 2.0 라이선스의 고성능 오픈 모델 Gemma 4 제품군을 발표했다.
구글이 실시간 대화에 최적화된 고품질 오디오 모델 Gemini 3.1 Flash Live를 출시하여 지연 시간을 단축하고 복잡한 작업 수행 능력을 강화했다.
구글 딥마인드가 AI의 유해한 조작 능력을 정밀하게 측정하기 위해 1만 명 이상의 참가자를 대상으로 한 연구 결과와 평가 툴킷을 발표했다.
Google이 과학적 난제 해결과 공학적 실무를 위해 추론 능력을 극대화하고 주요 벤치마크에서 신기록을 경신한 Gemini 3 Deep Think의 대규모 업데이트를 발표했다.
Deep Think 기술이 적용된 Gemini 모델이 국제 수학 올림피아드(IMO)에서 금메달 수상자 수준의 성적을 거두며 고도의 논리적 추론 능력을 증명했다.
Google DeepMind가 이미지 기반 동영상 생성 기능인 'Ingredients to Video'를 강화한 Veo 3.1을 발표하며, 캐릭터 일관성 유지와 4K 업스케일링 및 세로형 모드 지원을 추가했다.
구글은 2025년 Gemini 3 출시와 에이전트 AI 시스템 구축, 과학 및 의료 분야 혁신, 차세대 TPU Ironwood를 통해 AI의 실용성과 지능을 한 단계 격상시켰다.
구글이 Gemini 3 Pro 수준의 추론 능력을 유지하면서도 속도와 비용 효율성을 극대화하여 실시간 에이전트 워크플로에 최적화된 Gemini 3 Flash 모델을 출시했다.
구글이 실시간 음성 에이전트와 통역 성능을 강화한 Gemini 2.5 Flash Native Audio 모델을 출시하여 복잡한 워크플로우 처리와 자연스러운 대화 기능을 대폭 개선했다.
유럽 연구진이 AlphaFold로 꿀벌의 면역 단백질 구조를 규명하여 멸종 위기 보존과 AI 기반 육종 프로그램을 추진한다.