본문으로 건너뛰기

대화형 벤치마크: 능동적 정보 획득을 통한 모델 지능의 통합적 평가

기존의 정적 벤치마크는 모델이 주어진 정보에만 답하는 수동적 능력을 측정할 뿐, 실제 세상에서 필요한 능동적 정보 수집과 전략적 사고를 평가하지 못한다. 이 논문은 모델이 스스로 질문하고 예산을 관리하며 문제를 해결하는 '대화형 평가'를 도입하여, 기존 방식이 모델의 실제 능력을 최대 50%까지 과소평가하고 있음을 밝혀냈다.

용어 해설

대화형 증명(Interactive Proofs)
계산 복잡도 이론에서 유래한 개념으로, 검증자(Verifier)와 증명자(Prover)가 메시지를 주고받으며 명제의 타당성을 확인하는 과정이다. 이 아티클에서는 모델이 판사에게 질문을 던져 숨겨진 정답에 도달하는 능동적 추론 과정을 평가하는 핵심 메커니즘으로 사용된다.
가추적 추론(Abductive Reasoning)
불완전한 관찰 결과로부터 가장 그럴듯한 설명을 찾아내는 추론 방식이다. Situation Puzzle과 같은 문제에서 모델이 단편적인 정보를 조합해 논리적 결론을 도출하는 데 필수적인 능력으로, 단순 연역이나 귀납보다 고차원적인 지능을 요구한다.
마음 이론(Theory of Mind)
타인의 의도, 믿음, 욕구 등 정신 상태를 이해하고 예측하는 능력이다. 포커나 신뢰 게임과 같은 전략적 환경에서 상대방의 행동 패턴을 분석하고 자신의 전략을 수정하는 데 핵심적인 역할을 하며, 모델의 사회적 지능을 측정하는 척도가 된다.
K번 시도 중 성공률(pass@k)
모델이 독립적으로 생성한 k개의 샘플 중 최소 하나가 정답일 확률을 측정하는 정적 평가 지표다. 이 논문에서는 이 방식이 모델의 실시간 오류 수정 능력을 반영하지 못해 실제 잠재력을 과소평가할 수 있음을 지적하며 대화형 평가와 대조한다.
죄수의 딜레마(Prisoner's Dilemma)
개인의 이익과 공동의 이익이 충돌할 때 협력과 배신 사이에서 선택하는 게임 이론의 고전적 모델이다. 신뢰 게임(Trust Game)의 기반이 되며, 모델이 반복되는 상호작용 속에서 장기적인 이득을 위해 어떻게 적응하고 신뢰를 구축하는지 평가하는 데 쓰인다.
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 03. 05.수집 2026. 03. 07.출처 타입 PAPER

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.