본문으로 건너뛰기

에이전트 확산이 바꾸는 데이터와 플랫폼의 기준

에이전트 운영의 핵심은 더 큰 모델이 아니라 최소 컨텍스트와 비용을 조율하는 전체 시스템입니다.

이 요약은 AI가 원문을 분석해 생성했습니다. 정확한 내용은 원문 기준으로 확인하세요.

TL;DR

Andi Gutmans는 현재 많은 자동화 작업에서 모델 자체보다 모델, harness, context, personalization을 결합한 전체 시스템이 더 중요한 병목이라고 말합니다. 목표는 가장 정교한 모델이나 최대 토큰 사용량이 아니라, 필요한 결과를 가장 낮은 비용으로 얻는 최소 컨텍스트와 적절한 모델 조합을 찾는 것입니다. 에이전트가 24시간 대규모로 실행되면 비용이 비선형적으로 늘어날 수 있으므로 평가, 검색, 보안, 거버넌스, 관측 가능성을 플랫폼에 포함해야 합니다. 또한 주말 프로토타입으로 설계 위험을 조기에 확인하고, 컴퓨터과학 기초와 agentic coding, 비즈니스 판단을 함께 익히는 방향이 중요하다고 말합니다.

섹션별 상세

01
현재 자동화 작업에서는 모델 성능만 높이는 접근보다 모델, harness, context, personalization을 함께 설계하는 시스템 관점이 중요합니다. 작업마다 필요한 모델 수준이 다르므로 Gemini 3.5 Flash처럼 저비용 모델로 충분한 경우와 Gemini Pro가 필요한 경우를 구분해야 합니다. 입력에서 실제 결과에 기여하는 컨텍스트만 남기고 불필요한 reasoning loop를 줄이면 토큰 처리량과 비용을 동시에 낮출 수 있습니다.
02
필요한 컨텍스트의 범위를 정하는 일은 데이터 카탈로그나 사람이 만든 ontology를 추가하는 것만으로 해결되지 않습니다. 모델과 지식을 함께 hill climbing하려면 여러 평가를 통해 어떤 정보가 결과를 실제로 개선하는지 확인하고, 필요에 따라 모델과 검색·enrichment 계층을 각각 수정해야 합니다. Gutmans는 검색이 중요한 상위 문제 중 하나라며 이 문제를 완전히 해결했다고 말하는 공급업체의 주장에는 신중해야 한다고 말합니다.
03
사람이 처리하는 업무에서는 하루 작업량과 비용을 어느 정도 예측할 수 있지만, 에이전트는 잠들지 않고 사람보다 빠르게 도구를 호출합니다. 한 직원이 50개 또는 100개의 에이전트를 맡거나 기업 내부에서 수백만 개의 에이전트가 실행되면 모델 호출, harness, 도구, 데이터 플랫폼 비용이 함께 증가해 비용 나선이 생길 수 있습니다. 따라서 에이전트별 사용량과 ROI를 추적하고, 결과 대비 토큰 수를 늘리는 ‘token maxing’이 아니라 차별화된 성과를 기준으로 투자 여부를 판단해야 합니다.
04
AI를 활용한 주말 프로토타입은 몇 달 동안 엔지니어 한 명을 배정하기 전에 아이디어의 구현 가능성과 설계 위험을 빠르게 확인하는 수단이 됩니다. 프로토타입이 production code를 대신하지는 않지만, 잘못된 경로를 수개월 뒤에 발견하는 대신 초기 단계에서 판단을 교정할 수 있습니다. Gutmans와 O’Connor는 실험 비용이 낮아진 만큼 더 자주 시도하고, 검증된 결과를 production 품질의 구현으로 넘기는 흐름이 필요하다고 봅니다.
05
플랫폼 팀은 개발자뿐 아니라 독립적인 작업 주체로서의 에이전트도 하나의 persona로 지원해야 합니다. 이를 위해 에이전트의 skills와 best practices, 보안과 거버넌스, 비용 관리, 가용성과 확장성, production 실행 경로를 제공하고 도구 호출과 결과를 관측할 수 있어야 합니다. Google의 MySQL에서 Spanner로 이어진 사례처럼 사람이 실수하기 쉬운 운영 책임을 인프라가 맡도록 만들면, 개발자와 에이전트 모두가 규모 확장에 필요한 안전장치를 활용할 수 있습니다.
06
앞으로의 컴퓨터과학 학습에는 수학, 시스템 아키텍처, 하드웨어를 포함한 전통적인 기초가 여전히 필요합니다. 여기에 agentic coding과 agentic outcomes를 실제로 이끌어가는 능력을 더해야 하며, 이는 에이전트를 활용해 개인의 영향 범위를 넓히는 기반이 됩니다. 높은 수준의 비즈니스 문제를 올바른 작업으로 바꾸는 판단력도 중요해져 기술 역량과 비즈니스 이해를 함께 갖춘 인재의 가치가 커집니다.

용어 해설

에이전트 규모 운영(Agent Scale)
사람이 직접 버튼을 누르는 소수의 업무 자동화를 넘어 수십~수백 개의 에이전트가 24시간 작업하는 운영 상태입니다. 처리량과 자율성이 커지는 만큼 비용, 보안, 관측 가능성, 확장성을 함께 관리해야 합니다.
컨텍스트 윈도(Context Window)
모델이 한 번의 요청에서 처리할 수 있는 입력 정보의 범위입니다. 에이전트 시스템에서는 모든 데이터를 넣기보다 결과에 실제로 영향을 주는 최소 컨텍스트만 검색해 전달해야 토큰 처리량과 비용을 줄일 수 있습니다.
평가(Evaluation)
모델이나 에이전트의 출력이 목표 결과에 얼마나 가까운지 측정하는 절차입니다. 컨텍스트의 어느 부분이 성능을 높이는지 확인하려면 다양한 입력과 실행 궤적을 기준으로 반복 평가해야 하며, 지식 구성만으로는 충분하지 않습니다.
에이전트 기반 코딩(Agentic Coding)
개발자가 직접 모든 코드를 작성하는 대신 에이전트에 높은 수준의 의도와 작업을 전달하고 구현 과정을 맡기는 방식입니다. 프로토타입 제작과 설계 위험 탐색을 앞당길 수 있지만, 결과를 판단하고 경로를 교정할 기술적 기초와 업무 감각이 필요합니다.
관측 가능성(Observability)
운영 중인 시스템의 상태와 동작 원인을 로그, 지표, 실행 경로 등으로 파악하는 능력입니다. 에이전트 환경에서는 호출한 도구, 사용한 컨텍스트, 비용, 결과, 실패 경로를 추적해야 안정성과 투자수익률을 관리할 수 있습니다.

기술

  • Gemini 3.5 Flash
  • Gemini Pro
  • DeepMind
  • Google
  • MySQL
  • Spanner
  • JIRA
  • Confluence
  • Stack Internal

활용 사례

  • 고객 지원 티켓 처리
  • 자율 네트워크 운영과 사전 유지보수
  • SRE 운영
  • 사기 탐지
  • 수요·업무 예측
  • AI 기반 프로토타입 제작
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 09. 03.수집 2026. 09. 03.출처 타입 RSS

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.