본문으로 건너뛰기
r/ClaudeCode조회 2

Claude Max 구독자의 'Effort' 파라미터 하향 조정 및 성능 저하 논란

Claude Max 구독 서비스에서 모델의 추론 깊이를 결정하는 'Effort' 파라미터가 'High'에서 'Low'로 조용히 하향 조정되었다는 주장이 제기됐다.

실용적 조언

  • Claude의 응답이 평소보다 짧거나 지침을 무시한다면 모델에게 현재의 effort 수준을 표시하도록 요청하여 성능 제한 여부를 확인하라.
  • 정밀한 연구나 복잡한 코딩 작업이 필요한 경우, 비용이 높더라도 API를 통해 effort=high 설정을 명시적으로 사용하는 것을 고려하라.

섹션별 상세

01
Anthropic API의 effort 파라미터는 모델의 추론 깊이와 도구 호출 빈도를 제어하는 핵심 설정이다. 사용자는 이 값이 기존 85(High)에서 25(Low)로 떨어졌음을 확인했으며, 이는 모델이 시스템 프롬프트 지침을 무시하거나 복잡한 추론을 생략하게 만드는 원인이 된다. Anthropic 공식 문서에 따르면 이 파라미터는 모델의 사고 과정 수준을 결정하는 실질적인 제어 장치이다.
02
Max 구독($200/월)과 API 사용 간의 성능 차이가 심각한 수준이라는 주장이 제기됐다. API에서는 사용자가 직접 effort를 'High' 또는 'Max'로 설정할 수 있지만, Opus 4.6 모델의 경우 토큰당 비용이 매우 높아 실질적인 사용료가 월 $1,000를 상회할 수 있다. 결국 구독형 서비스는 비용 절감을 위해 모델의 지능을 낮춘 'Low Effort' 버전을 제공하고 있다는 의혹이다.
03
이번 성능 저하는 Anthropic이 공지한 피크 시간대 외인 새벽 시간대에도 지속되고 있다. 이는 일시적인 트래픽 관리 차원의 스로틀링이 아니라, 구독 서비스 전체에 적용된 기본 성능 하향일 가능성을 시사한다. 사용자는 단순한 횟수 제한보다 품질 자체를 몰래 낮추는 행위가 사용자 경험에 더 치명적이라고 비판했다.

용어 해설

노력 파라미터(Effort Parameter)
Anthropic API에서 모델의 추론 깊이와 도구 호출 빈도를 제어하는 설정이다. 값이 높을수록 모델은 더 복잡한 사고 과정을 거치며 시스템 프롬프트의 지침을 더 엄격하게 준수하지만, 처리 비용과 시간이 증가한다.
추론 토큰(Thinking Tokens)
모델이 최종 답변을 생성하기 전 내부적으로 수행하는 '사고 과정'에서 소비되는 토큰이다. Anthropic API에서는 이 토큰에 대해 출력 토큰과 동일한 요율을 적용하여 비용을 청구한다.
시스템 프롬프트(System Prompt)
사용자의 개별 질문 이전에 모델의 역할, 행동 지침, 제약 사항을 정의하는 최상위 지시문이다. 모델의 'Effort' 수준이 낮아지면 이러한 복잡한 지침을 무시하고 단순한 답변을 내놓을 가능성이 커진다.
속도 제한(Rate Limiting)
특정 시간 동안 사용자가 보낼 수 있는 요청의 수를 제한하는 기술적 조치이다. 본 게시물에서는 투명한 횟수 제한과 대비되는 '보이지 않는 품질 저하'의 심각성을 강조하는 맥락에서 언급됐다.

언급된 도구

Claude Max비추천

Anthropic의 유료 구독형 AI 서비스

Anthropic API추천

모델 파라미터를 직접 제어할 수 있는 개발자용 인터페이스

AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 04. 06.수집 2026. 04. 06.출처 타입 REDDIT

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.