관련 기사 바로가기
에피소드 1,001: AI가 나에게 가르쳐준 교훈들구글 검색, AI 개요와 AI 모드 통합 테스트 시작사람들은 지금 AI를 실제로 어떻게 사용하고 있는가AI 경쟁의 거대한 판도 변화: 엔비디아 H200 중국 수출 허용과 구글의 AI 글래스엔터프라이즈 AI의 현주소: 도입 가속화와 실질적 성과 창출구글 크롬, 실시간 보안 강화를 위한 AI 에이전트 도입구글 크롬, AI 에이전트 보호를 위한 새로운 보안 도구 도입구글, 통합 AI 검색 인터페이스 테스트 중OpenAI의 '코드 레드' 선언과 애플의 AI 리더십 교체Gemini Robotics API를 활용한 'AGI 로봇' 프로젝트: LLM 기반의 의사결정 로봇 구현프론티어 AI 연구소들이 '무한 컨텍스트' 모델 개발에 소극적인 이유에 대한 고찰8개 모델 대상 퓨샷(Few-shot) 성능 테스트: 예시 추가가 성능을 저하시키는 사례 발견OpenClaw와 Ollama 연동 시 모델 성능 비교: Gemini Pro 3.1 vs Codex 5.3Aletheia: 과학 연구 검증 및 고성능 코드 최적화를 위한 오픈소스 AI 에이전트LLM-as-judge의 신뢰성 및 캘리브레이션 문제: 10개월간의 블라인드 동료 평가 실험 결과프랑수아 숄레의 ARC-AGI 벤치마크와 인간 수준 지능 측정의 한계구글, 로보틱스 소프트웨어 기업 '인트린직' 흡수하며 피지컬 AI 가속화프롬프트만으로 제작된 3D FPS 게임: 코딩 경험 없이 완성한 'Zombie Slayer'첸나이 해커톤에서 구축한 그래프 및 벡터 RAG 기반 여행 앱 'Xplorer'Bullshit Benchmark: 모델이 말도 안 되는 질문을 얼마나 잘 걸러내는가