본문으로 건너뛰기

Ben's Bites: 장기 실행 에이전트의 부상과 GPT-5.2의 등장

GPT-5.2 모델의 자율 작업 성능 확인과 Claude Code의 MCP 검색 최적화, 그리고 에이전트 기술 확장을 위한 npx add-skill 도구 출시 소식을 다룹니다.

섹션별 상세

01
Cursor 팀은 에이전트를 약 일주일 동안 지속적으로 실행시켜 웹 브라우저를 바닥부터 구축하는 실험을 성공적으로 완료했다. 이 과정에서 GPT-5.2 모델이 Opus 4.5보다 장기적인 자율 작업 수행에 더 적합하다는 사실이 확인되었으며, 정교한 프롬프트 설계가 모델 성능만큼이나 중요하다는 점이 입증되었다.
02
OpenAI는 GPT-5.2-Codex 모델을 API를 통해 정식으로 제공하기 시작했다. 이 모델은 Droid, Cursor, Windsurf와 같은 주요 AI 코딩 어플리케이션에 즉시 통합되어 더 높은 수준의 코드 생성 및 리팩터링 기능을 제공한다.
03
Anthropic의 Claude Code는 MCP(Model Context Protocol) 서버에서 필요한 도구를 검색할 때 컨텍스트 창을 과도하게 점유하지 않도록 최적화되었다. 또한 사용자가 권한 요청을 승인하거나 거부할 때 탭 키를 사용하여 구체적인 실행 지침을 주석으로 추가할 수 있는 인터페이스 개선이 이루어졌다.
04
Vercel은 코딩 에이전트의 기능을 확장할 수 있는 `npx add-skill` 도구를 출시했다. 개발자는 이 명령어를 통해 Vercel Labs에서 제공하는 React 베스트 프랙티스 문서나 특정 GitHub 저장소의 기술 스택을 에이전트에게 즉시 학습시키고 적용할 수 있다.
bash
npx add-skill vercel-labs/agent-skills

npx add-skill [owner]/[repo]

npx add-skill [link]

코딩 에이전트에게 새로운 기술이나 지식 베이스를 추가하기 위한 CLI 명령어 예시

npx add-skill 명령어의 다양한 사용법을 보여주는 터미널 텍스트 이미지이다.
ScreenshotVercel에서 공개한 에이전트 기술 추가 도구의 실제 구문을 보여준다. 특정 저장소나 링크를 통해 에이전트에게 새로운 기능을 주입하는 방법을 시각적으로 전달하여 개발자의 이해를 돕는다.
05
Google은 Gemini 앱에 사용자의 Gmail, Photos, YouTube 시청 기록 등 개인 데이터를 깊게 통합하는 'Personal Intelligence' 기능을 도입했다. 현재 미국 사용자들을 대상으로 테스트 중이며, 이는 AI 비서가 사용자의 맥락을 더 정확히 이해하고 개인화된 답변을 제공하는 데 기여한다.

용어 해설

모델 컨텍스트 프로토콜(MCP)
AI 모델이 외부 도구, 데이터 소스 및 서비스와 안전하고 표준화된 방식으로 상호작용할 수 있도록 돕는 프로토콜이다. 이를 통해 개발자는 모델의 컨텍스트 창을 효율적으로 관리하면서도 필요한 도구를 동적으로 호출할 수 있다.
컨텍스트 창(Context Window)
LLM이 한 번의 추론 과정에서 동시에 처리하고 기억할 수 있는 텍스트 데이터의 최대량이다. 이 창이 가득 차면 이전 정보를 잊거나 성능이 저하되므로, 효율적인 데이터 검색과 주입 기술이 중요하다.
인공 일반 지능(AGI)
인간이 수행할 수 있는 모든 지적 작업을 동등하게 혹은 그 이상으로 수행할 수 있는 인공지능을 의미한다. 본문에서는 장기 실행 에이전트가 특정 기능을 자율적으로 완수하는 능력을 AGI의 기능적 정의로 본다.

기술

  • GPT-5.2
  • Claude Code
  • MCP
  • Gemini
  • Vercel
  • Cursor

활용 사례

  • 자율 웹 브라우저 구축
  • 개인 데이터 통합 AI 비서
  • 에이전트 기술 확장 및 배포
  • 자동화된 코드 리팩터링

언급된 리소스

AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 01. 15.수집 2026. 02. 21.출처 타입 RSS

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.