본문으로 건너뛰기

QUACK: 다중 모달 사회 추론 에이전트의 의사소통 지식 grounding 질문, 이해 및 검증

현대 LLM/VLM 에이전트의 대화는 관측 정보와 행동에 근거해야 한다. 기존 연구는 주로 최종 게임 결과에 의존하거나 텍스트 기반 평가에 머물며 발화의 grounding을 자동으로 점검하지 못한다. QUACK은 엔진 로그로 재구성된 ground-truth 트래젝토리리를 바탕으로 발화의 주장들을 검증하고, 공간적 환각, 근거 없는 고발, 속임수 붕괴, 언어-행동 불일치 같은 grounding 실패를 자동으로 측정한다.

용어 해설

실제 궤적(Ground-truth Trajectory)
에이전트가 실제로 관측하고 이동한 경로를 시간축으로 재구성한 재현 가능한 기록으로, 발화의 주장과 행동의 일치 여부를 평가하는 기준이 된다.
발화 검증 파이프라인(Statement Verification Pipeline)
오픈된 엔진 로그에서 재구성된 ground-truth trajectory의 각 발화 주장을 구성 요소로 분해하고, 이들 주장을 ground-truth와 대조하여 진위 여부를 자동으로 확인하는 체계이다.
공간적 환각(Spatial Hallucination)
에이전트가 실제로 존재하지 않는 위치나 시점을 발화에 포함하는 현상으로, 부분 관찰 환경에서의 위치 추정 오류를 반영한다.
근거 없는 고발(Unsupported Accusation)
발화에서 특정 플레이어를 의심한다고 진술하되, 자신의 관측이나 ground-truth로 뒷받침되지 않는 경우를 가리킨다.
기망 붕괴(Deception Collapse)
Duck이 쉽게 거짓을 만들어 알리려는 전략이 사전에 판단 가능한 수준의 거짓으로 드러나는 현상으로 분석된다.
언어-행동 불일치(Language-Action Inconsistency)
발화로 진술된 활동이나 경로가 실제 로그의 행동과 충돌하는 현상으로, 알리기 위한 서술과 실제 행동 간의 불일치를 포착한다.
비전-언어 모델(Vision-Language Model)
이미지-텍스트를 연계하는 다중모달 모델로, 본 연구의 에이전트에 사용되는 핵심 기술이다.
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 05. 26.수집 2026. 05. 28.출처 타입 PAPER

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.