관련 기사 바로가기
SWE-rebench V2: 대규모 다국어 소프트웨어 엔지니어링 작업 수집을 위한 언어 독립적 파이프라인Qwen3-Coder-Next 기술 보고서daVinci-Env: 대규모 오픈 소프트웨어 엔지니어링 환경 합성 프레임워크Augmented Coding Weekly #22: GPT-5.2 출시와 바이브 코딩의 미래LLM 에이전트의 코드 이해를 돕는 데이터 구조 프로토콜(DSP) 공개자연어 피드백을 통한 프롬프트 최적화: 프롬프트 러닝 가이드에이전트의 실제 컴퓨터 사용 능력 확대로 인해 기존 벤치마크의 실효성 상실MiniMax M2.5, Claude Opus급 코딩 성능을 20분의 1 가격으로 제공SWE-bench 분석 결과: 인간보다 비대한 LLM 생성 코드 패치Qwen3.5-35B-A3B 모델, SWE-bench Verified Hard에서 37.8% 해결률 달성