Agentic scientific research
에이전트형 과학 연구
AI가 과학 연구 과제를 단순 질의응답이 아니라 도구 호출과 여러 단계의 추론으로 수행하는 평가 영역이다. 이 표에서는 Terminal-Bench-Science 0.1 점수로 연구 수행 능력을 비교한다.
에이전트형 과학 연구
AI가 과학 연구 과제를 단순 질의응답이 아니라 도구 호출과 여러 단계의 추론으로 수행하는 평가 영역이다. 이 표에서는 Terminal-Bench-Science 0.1 점수로 연구 수행 능력을 비교한다.