관련 기사 바로가기
Peter의 지속형 Claude Code 작업 그래프역할 기반 모델 운영 경험Fable 5 전후 비교 BridgeBench 재실행 결과Opus 5의 에포트 설정이 코드 작업에서 항상 '최대'가 아닌 이유와 성능 트레이드오프오픈 모델이 AI 지출의 대부분을 흡수할 것이라는 전망Fable 5로 완성한 브라우저 실시간 물리 기반 포트폴리오 애니메이션Kimi K3 수치 검토: 오픈 웨이트 모델이 최상위 폐쇄 모델에 근접했다는 주장Last Week in AI 247회 요약: Anthropic Opus 4.8과 Microsoft Scout 발표 및 투자·정책 동향Qwen 30b를 이용해 대용량 컨텍스트 작업을 오프로드하고 비용을 절감한 개인 실험더 나은 모델, 더 못한 도구들trl-token-reduction LLM API 토큰 절감 레이어SWE-Interact: 사용자 주도 다중 턴 소프트웨어 엔지니어링 평가환경Claude Sonnet 5의 신규 기능과 토크나이저 변경Singularity Gate 벤치마크 공개 및 Opus 4.8 성능 평가Opus 4.8 벤치마크 결과 공유: GPT-5.5와의 성능 비교Claude Opus 4.8 및 Sonnet 4.6 업데이트: 새로운 'Effort' 제어 기능 도입