1시간 분량 오디오를 단 2초 만에? IBM의 미친 성능 음성 AI 공개
IBM이 공개한 Granite Speech 4.1 모델의 3가지 변체(Base, Plus, NAR)를 통해 정확도, 화자 분리 기능, 초고속 추론 성능의 기술적 특징과 실무 적용 방법을 상세히 다룹니다.
Google Developer Expert(GDE)로서 최신 AI 모델과 프레임워크를 실제 코드로 구현하는 실무 중심의 튜토리얼
IBM이 공개한 Granite Speech 4.1 모델의 3가지 변체(Base, Plus, NAR)를 통해 정확도, 화자 분리 기능, 초고속 추론 성능의 기술적 특징과 실무 적용 방법을 상세히 다룹니다.
Claude Design 시스템에 적용된 6가지 에이전트 설계 패턴을 분석하여 실무적인 수직형 에이전트 앱 구축 방법론을 제시한다.
구글 딥마인드의 Logan Kilpatrick이 AI Studio의 새로운 빌드 기능, Gemini 모델 업데이트, 그리고 개발 패러다임을 바꾸는 에이전틱 엔지니어링의 비전을 공유한다.
AI 에이전트를 실제 서비스 환경에서 안정적으로 운영하기 위해 필요한 모델 제어, 프롬프트 관리, 가드레일, 예산 제한 등 7가지 필수 기술적 요건을 상세히 설명한다.
Claude 에이전트의 스킬 성능을 높이기 위해 스크립트 코드를 최적화하고 토큰 사용량을 줄이는 실전 기법을 웹 스크레이핑 사례를 통해 다룹니다.
개인용 에이전트 데모를 수만 명이 사용하는 상용 서비스로 확장할 때 필수적인 아키텍처 차이와 에이전트 하네스(Harness) 설계의 중요성을 다룹니다.
구글 랩스의 AI 디자인 도구 '스티치'의 대규모 업데이트를 통해 URL 기반 테마 복제, DESIGN.md를 활용한 디자인 시스템 관리, AI 에이전트와의 협업 과정을 상세히 다룹니다.
Qwen 3 기반의 MiroThinker 1.5는 30B 규모임에도 256K 컨텍스트와 400회 도구 호출을 지원하며 대형 모델급 에이전트 성능을 제공한다.
구글이 발표한 유니버설 커머스 프로토콜(UCP)은 AI 에이전트가 상품 검색, 장바구니 담기, 결제까지 표준화된 방식으로 수행할 수 있도록 돕는 오픈 표준이다.
OpenAI가 제안한 Open Responses 표준을 통해 오픈소스 LLM의 도구 호출, 추론 과정, 에이전트 워크플로를 표준화하고 실제 코드로 구현하는 방법을 다룹니다.
Qwen3-VL-Embedding과 Reranker를 활용하여 텍스트, 이미지, 비디오를 통합 검색하는 멀티모달 RAG 시스템 구축 방법과 Matryoshka 임베딩을 통한 성능 최적화 기법을 다룹니다.
Anthropic의 Claude Cowork 출시에 대응하여 오픈소스로 전환된 Eigent AI의 멀티 에이전트 아키텍처와 Camel AI 프레임워크의 실무 활용법을 상세히 분석한다.
Alibaba가 공개한 Qwen3-TTS 모델의 특징을 살펴보고 Voice Design과 Voice Cloning 기능을 코드로 실습하며 성능을 검증한다.
Ollama의 새로운 launch 기능을 통해 GLM-4.7-Flash 모델을 Claude Code와 연동하여 로컬 환경에서 코딩 에이전트를 구동하는 방법을 소개한다.
Moonshot AI가 공개한 1T 파라미터 MoE 모델 Kimi K2.5의 멀티모달 성능과 최대 100개의 서브 에이전트를 병렬로 실행하는 Agent Swarm 기술의 혁신성을 다룹니다.
Google Chrome이 도입한 WebMCP는 AI 에이전트가 스크래핑 대신 구조화된 API를 통해 웹사이트와 직접 소통하게 하여 비용 절감과 정확도 향상을 실현한다.
OpenAI가 혁신적인 오픈소스 에이전트 OpenClaw의 제작자 Peter Steinberger를 영입하며, 단순 챗봇을 넘어 실행력을 갖춘 개인용 AI 에이전트 개발에 박차를 가한다.