섹션별 상세
Anthropic(Claude 3.5), OpenAI(GPT-4o, o3-mini), Google(Gemini 2.5), DeepSeek, Mistral, Cohere 등 주요 6개 업체의 20개 이상 모델 가격 데이터를 내장하고 있다. --compare 옵션을 사용하면 입력한 프롬프트에 대해 모든 모델의 예상 비용을 표 형태로 한눈에 비교할 수 있다.
bash
llm-costs "Explain quantum computing" --compare입력한 프롬프트에 대해 지원되는 모든 모델의 비용을 표 형태로 비교하는 명령어
실제 API 호출을 하지 않고 로컬에서 비용을 추정하므로 API 키가 필요 없으며 데이터 유출 우려가 없다. npx를 통해 설치 없이 즉시 실행하거나 npm으로 전역 설치하여 사용할 수 있으며, 파일 입력(--file)이나 파이프(|) 연동도 지원한다.
OpenAI 모델의 경우 tiktoken 라이브러리를 사용하여 99% 이상의 정확도로 토큰을 계산하며, 기타 모델은 휴리스틱 알고리즘을 통해 ±5-15% 오차 범위 내에서 비용을 예측한다. --show-tokens 옵션으로 입력/출력 토큰 수와 각각의 비용을 상세히 확인할 수 있다.
bash
llm-costs "Your prompt" --model claude-opus-4-5 --show-tokens특정 모델을 지정하여 입력/출력 토큰 수와 상세 비용을 확인하는 예시
bash
llm-costs "hello" --model gpt-4o --output json스크립트 활용을 위해 결과를 JSON 형식으로 출력하는 방법
현재의 비용 비교 기능을 넘어, 향후 대량의 프롬프트를 처리하는 배치 프로세싱, 일일/월간 예산 투영, CI/CD 파이프라인에서 설정된 비용 초과 시 빌드를 실패시키는 Cost Guard 기능 등이 추가될 예정이다. 또한 MCP 서버와 VS Code 확장 프로그램 지원도 계획되어 있다.
yaml
name: Cost Check
on: [pull_request]
jobs:
cost-check:
runs-on: ubuntu-latest
steps:
- uses: actions/checkout@v3
- uses: followtayeeb/llm-costs-action@v1
with:
prompt-file: src/system-prompt.txt
model: claude-sonnet-4-5
max-cost: '1.00'GitHub Actions를 통해 PR 단계에서 프롬프트 비용을 자동으로 체크하는 설정
용어 해설
- 명령줄 인터페이스(CLI)
- — 터미널이나 명령 프롬프트를 통해 텍스트 명령어로 컴퓨터와 상호작용하는 방식이다. 그래픽 인터페이스(GUI) 없이도 빠르고 효율적으로 도구를 실행하거나 자동화 스크립트에 포함할 수 있어 개발자들에게 필수적이다.
- 토큰(Token)
- — 대형 언어 모델이 텍스트를 처리하는 최소 단위이다. 단어, 문장 부호, 또는 단어의 일부를 포함하며, 대부분의 LLM API 서비스는 이 토큰의 개수를 기준으로 비용을 청구하므로 정확한 계산이 중요하다.
- 틱토큰(tiktoken)
- — OpenAI에서 개발한 고성능 BPE(Byte Pair Encoding) 토크나이저 라이브러리이다. GPT-4와 같은 모델이 텍스트를 어떻게 토큰으로 분리하는지 정확히 시뮬레이션하여 비용을 정밀하게 예측하는 데 사용된다.
- 모델 컨텍스트 프로토콜(MCP)
- — AI 모델이 로컬 데이터 소스나 도구와 안전하고 표준화된 방식으로 상호작용할 수 있도록 돕는 개방형 프로토콜이다. 에이전트가 외부 도구를 더 쉽게 호출할 수 있는 환경을 제공한다.
기술
- Node.js
- TypeScript
- tiktoken
- GitHub Actions
활용 사례
- 모델 가성비 비교
- 프로덕션 비용 예측
- CI/CD 비용 감시
- 로컬 토큰 카운팅
언급된 리소스
AI 분석 전체 내용 보기
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
원문 발행 2026. 03. 09.수집 2026. 03. 09.출처 타입 RSS
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.