TL;DR
해당 스크린샷은 한 세션과 주간 집계의 비용·시간·토큰·캐시 사용 통계를 보여주는 대시보드 캡처이다. 총비용은 $92.14로 기록되어 있으며 API 지속시간은 1시간 17분 11초이고 wall 기준 지속시간은 1일 3시간 54분으로 분리되어 있다. 모델별로는 claude-fable-5가 입력 62.3k 토큰, 출력 233.1k 토큰, 캐시 읽기 43.2m, 캐시 쓰기 2.2m으로 가장 큰 사용과 $92.00의 비용 기여를 보였고 다른 두 모델은 상대적으로 적은 사용량을 기록했다. 화면 하단의 진행 바는 현재 세션과 주간 사용률 및 UTC 리셋 시각을 제공하여 할당량 관리와 비용 최적화 포인트 도출에 활용될 수 있다.
섹션별 상세


용어 해설
- Input/Output Tokens
- — 입력 토큰은 API에 전달된 텍스트가 토큰화된 단위이며 출력 토큰은 모델이 생성한 텍스트의 토큰 수이다. 요청 당 사용된 토큰 수는 비용 계산과 컨텍스트 윈도우 활용도를 직접적으로 결정하므로 사용량 최적화와 비용 추적에 핵심이 된다.
- Cache Read/Write
- — 캐시 읽기는 이전에 저장된 응답이나 데이터 조회로 비용·지연을 줄이는 동작이며 캐시 쓰기는 새 결과를 캐시에 저장하는 작업이다. 캐시의 읽기·쓰기 빈도는 운영 비용과 응답 일관성, 재현성에 영향을 미치므로 사용 패턴 분석이 필요하다.
- Wall Time
- — Wall Time은 프로세스가 실제 벽시계 기준으로 차지한 총 시간을 의미하며 API 지속시간과는 다를 수 있다. 배치 잡이나 대기 상태가 포함된 운영 환경에서는 Wall Time이 리소스 점유와 사용자 경험 측정에 더 직접적인 지표로 작용한다.
- Session Quota
- — 세션 할당량은 특정 세션이나 주 단위로 허용된 사용량 한도를 나타내며 진행률 바와 리셋 시각으로 관리 상태를 표시한다. 할당량 정보는 급증하는 사용에 따른 차단 방지와 비용 초과 예방을 위해 모니터링 대상이 된다.
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.