용어 해설
- 폐쇄 루프 추론–행동 프레임워크(Closed-loop Reasoning–Action Framework)
- — GUI 에이전트가 현재 화면을 입력으로 받아 과업 상태를 추론하고, 클릭·입력·스크롤 같은 행동을 실행한 뒤, 바뀐 환경을 다시 관찰해 다음 행동을 정하는 구조입니다. 단일 행동 예측이 아니라 관찰→추론→실행→피드백 순환으로 장기 과업과 오류 복구를 처리하는 핵심 방식입니다.
- 궤적 수준 검증(Trace-level Verification)
- — 전체 상호작용 궤적이 과업 목표를 의미적으로 달성했는지 평가하는 방법입니다. 최종 화면만 이진 판정하지 않고 과업에서 추출한 핵심 시각 단서와 행동 구간을 함께 확인해 완료·부분 완료·실행 불가·실패로 분류하며, 데이터 선별과 강화학습 보상 품질 개선에 활용됩니다.
- 샘플 수준 검증(Sample-level Verification)
- — 각 상호작용 단계가 실행되기 전에 현재 화면, 행동 유형과 대상, 추론 내용, 과업 목표를 바탕으로 행동의 적합성을 판정하는 방식입니다. 행동을 정답·탐색적·비효과적·오류로 나눠 단계별 감독과 실시간 개입을 가능하게 하며, 외부 요인으로 인한 후속 화면 변화와 행동 품질을 분리합니다.
- 다중 교사 온폴리시 증류(Multi-teacher On-policy Distillation)
- — 여러 도메인별 교사가 학생 모델이 직접 생성한 궤적을 평가하고, 그 점수를 이용해 학생 정책을 하나로 통합하는 학습 방식입니다. UI-Venus-2에서는 추론 토큰과 행동 토큰을 똑같이 감독하지 않고, 행동 유형과 매개변수의 오류 위치에 따라 증류 신호를 조절합니다.
- 시각적 핵심 단서(Visual Keypoints)
- — 과업 완료 여부를 판단하는 데 필요한 화면상의 구체적인 상태나 요소입니다. 예를 들어 게시 과업에서는 올바른 그룹 진입, 제목·본문 입력, 게시 완료 확인이 각각 핵심 단서가 되며, 검증기는 궤적의 각 구간에서 이 단서가 충족됐는지 누적해 부분 진행과 실패를 구분합니다.
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.

