관련 기사 바로가기
Epoch와 METR이 공개한 MirrorCode 벤치마크가 장기간 프로그래밍에서 AI 성능을 측정하다Claude Sonnet 5의 신규 기능과 토크나이저 변경Claude Code의 새로운 'claude agents' 명령어로 세션 관리 효율화Claude Code와 Opus 4.7을 활용한 자율 소설 생성 실험 결과Anthropic Opus 4.7의 정렬 실패와 벤치마크의 한계에 대한 비판Opus 4.7과 Verdent AI Manager를 활용한 자율 코딩 에이전트 구축 가이드Anthropic Opus 4.7 업데이트와 토큰 사용량 증가에 대한 논의Anthropic, Claude Opus 4.7 출시 임박 및 주요 성능 유출