DeepSWE v1.1
DeepSWE v1.1
소프트웨어 엔지니어링 작업에서 AI 모델의 문제 해결 성능을 비교하는 벤치마크입니다. 기사에서는 Gemini 3.8 Flash가 Anthropic의 Fable 5를 포함한 다른 frontier model보다 높은 성과를 냈다고 전합니다.
DeepSWE v1.1
소프트웨어 엔지니어링 작업에서 AI 모델의 문제 해결 성능을 비교하는 벤치마크입니다. 기사에서는 Gemini 3.8 Flash가 Anthropic의 Fable 5를 포함한 다른 frontier model보다 높은 성과를 냈다고 전합니다.