본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

AgnesAI-Labs/AgnesAI-Models

0 / 0

OpenAI SDK 형식으로 텍스트·이미지·비디오·agent workflow를 호출하는 Agnes AI 공식 API gateway와 모델 카탈로그

TL;DR

AgnesAI-Labs/AgnesAI-Models는 Agnes AI가 제공하는 공식 OpenAI 호환 API gateway와 model catalog로, 별도 SDK를 설치하기보다 기존 OpenAI client의 `base_url`을 바꿔 텍스트·이미지·비디오 모델을 호출하는 구조다. 텍스트와 vision-language 요청은 `/v1/chat/completions`, 이미지 생성과 편집은 `/v1/images/generations`, 비디오 생성은 `/v1/videos`에서 처리하며 비디오는 `video_id` polling이 필요하다. `agnes-2.5-flash`와 `agnes-2.0-flash`는 streaming, tool calling, 이미지 이해를 지원하고 이미지·비디오 전용 모델도 제공한다. Free / default plan의 공개 기준은 텍스트 20 actual RPM과 비디오 1 actual RPM이며, 모델 가용성·rate limits·pricing·quota는 변경될 수 있으므로 운영 전 공식 문서와 계정 권한을 확인해야 한다.

핵심 포인트

  • 이 레포지토리는 독립 실행형 도구가 아니라 Agnes AI의 공식 OpenAI 호환 API gateway와 model catalog이다. 텍스트·이미지·비디오·agent workflow를 하나의 API 형식으로 연결한다. OpenAI SDK를 이미 사용하는 애플리케이션이 멀티모달 모델을 추가할 때 적합하다.
  • 텍스트와 vision-language 모델은 `/v1/chat/completions`, 이미지 모델은 `/v1/images/generations`, 비디오 모델은 `/v1/videos`를 사용한다. 비디오는 생성 요청 뒤 반환된 `video_id`를 조회하는 비동기 방식이다. 모델별 endpoint와 파라미터 차이는 `MODEL_CATALOG.md`와 공식 문서에서 확인해야 한다.
  • Python에서는 `openai` 패키지의 `OpenAI` client에 Agnes API의 `base_url`만 지정해 streaming chat을 호출한다. `agnes-2.5-flash`는 tool calling과 이미지 입력을 지원하며 `512K` context와 `65.5K` maximum output reference가 제공된다. `agnes-2.0-flash`는 `256K` context와 `64K` max output reference를 사용한다.
  • Free / default plan은 텍스트 모델 20 actual RPM과 비디오 1 actual RPM을 기준으로 하며 요금제와 API key 권한에 따라 한도가 달라진다. `400`, `401`, `429`, `5xx` 오류별 점검과 exponential backoff 지침이 문서에 포함돼 있다. API key는 server-side 환경 변수에 보관해야 하므로 브라우저 직결이나 공개 저장소 커밋에는 부적합하다.

2.8k

Stars

127

Forks

+207

Trending

0

조회수

2.8k watchers66 open issues

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.