본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
LongCLI-Bench: 명령줄 인터페이스에서의 장기적 에이전트 프로그래밍을 위한 예비 벤치마크 및 연구
합성 태스크 스케일링을 통한 AI 과학자 구현
SWE-bench 분석 결과: 인간보다 비대한 LLM 생성 코드 패치
SWE-rebench V2: 대규모 다국어 소프트웨어 엔지니어링 작업 수집을 위한 언어 독립적 파이프라인
← 피드로 돌아가기
SWE-agent
Coding Agents (코딩 AI 에이전트)
약 5개 아티클
관련 태그:
GPT-5
SWE-Bench
Claude Code
OpenHands
Qwen
SWE-rebench V2
LlamaIndex
LongCLI-Bench