본문으로 건너뛰기

관련 기사 바로가기

SKILL.state: 대화 기록 대신 구조화된 상태 관리로 에이전트 토큰 효율 개선.SoLongSucker 게임을 통한 AI 기만 실험: 제도화된 거짓말과 인간의 승리AndroTMem: 긴 호흡의 GUI 에이전트를 위한 상호작용 궤적 기반의 앵커드 메모리 연구르브론 제임스는 대통령이다: 소셜 엔지니어링을 통한 LLM 정렬 우회 분석구글 딥마인드, Kaggle Game Arena에 마피아 게임과 포커 벤치마크 추가저렴해지는 지능과 비싸지는 AI: Gemini 3 Flash와 GPT-5.2가 이끄는 2025년 시장 변화이번 주 주요 AI 뉴스: 구글 Gemini 3 Flash 출시와 OpenAI의 대규모 투자 유치 동향Google DeepMind 연구: Gemini의 안전성은 RL이 아닌 SFT에서 결정된다Webgrid Eval: Neuralink 커서 제어 작업을 활용한 LLM 비전 및 도구 사용 벤치마크UC Berkeley, 범용 텍스트 최적화 API 'optimize_anything' 출시IBM과 UC 버클리, IT-Bench와 MAST를 활용한 엔터프라이즈 에이전트 실패 원인 진단포켓에이전트 챌린지: 대규모 경쟁 및 롱 컨텍스트 학습 벤치마크OpenAI Prism과 Gemini 3 Flash의 에이전틱 비전 기능 공개Gemini 3 Flash: 속도를 위해 설계된 프론티어 지능Last Week in AI #229: Gemini 3 Flash, ChatGPT 앱 스토어, GPT-5.2-Codex 출시Gemini 3 Flash 분석과 Proto-AGI의 도래: 구글과 OpenAI 리더들의 미래 전망Gemini 3 Flash의 Agentic Vision: 이미지 분석을 위한 AI 에이전트 활용법Kaggle 게임 아레나: AI 체스 대결 (Gemini 3 Flash vs. Gemini 3 Pro)GRADE: 이미지 편집에서의 학문 지식 기반 추론 벤치마킹대화형 벤치마크: 능동적 정보 획득을 통한 모델 지능의 통합적 평가
← 피드로 돌아가기

Gemini-3-Flash

Language Models (대형 언어 모델)

26개 아티클

관심 태그 추가
TIMEHEADLINE