본문으로 건너뛰기
HF Daily Papers조회 2

실제 위협 상황에서의 모바일 GUI 에이전트: 우리는 준비되었는가?

최근 스마트폰을 스스로 조작하는 AI 에이전트가 등장하고 있지만, 앱 내에 섞여 있는 광고나 가짜 게시물 같은 제3자 콘텐츠에 의한 보안 위협은 간과되어 왔다. 이 논문은 실제 앱 환경에서 AI 에이전트가 얼마나 쉽게 속아 넘어가 사용자의 데이터를 삭제하거나 잘못된 결제를 유도당할 수 있는지를 체계적으로 분석하여 AI 비서의 안전한 배포를 위한 필수적인 검증 기준을 제시한다.

용어 해설

모바일 GUI 에이전트(Mobile GUI Agent)
자연어 명령을 입력받아 스마트폰 화면의 아이콘을 클릭하거나 텍스트를 입력하는 등 그래픽 사용자 인터페이스(GUI)를 통해 기기를 자율적으로 제어하는 AI 시스템이다. LLM의 추론 능력을 바탕으로 복잡한 작업 단계를 스스로 계획하고 실행한다.
적대적 공격(Adversarial Attack)
AI 모델이 잘못된 판단을 내리도록 의도적으로 설계된 입력값(노이즈, 조작된 텍스트 등)을 주입하는 기법이다. 본 논문에서는 앱 내의 제3자 콘텐츠를 조작하여 에이전트가 사용자의 데이터를 삭제하거나 작업을 중단하게 만드는 공격을 다룬다.
동적 인스트루멘테이션(Dynamic Instrumentation)
프로그램이 실행 중인 상태에서 실시간으로 코드나 데이터를 수정하거나 가로채는 기술이다. 본 연구에서는 안드로이드 앱의 UI 상태 정보를 실시간으로 가로채 적대적 콘텐츠를 삽입함으로써 에이전트의 반응을 테스트하는 데 사용된다.
오도율(Misleading Rate)
적대적 공격에 노출되었을 때 에이전트가 공격자가 의도한 잘못된 행동(잘못된 클릭, 작업 임의 종료 등)을 수행하는 비율을 나타내는 지표다. 에이전트의 보안 취약성을 정량적으로 평가하는 핵심 척도로 활용된다.
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 04. 14.수집 2026. 04. 17.출처 타입 PAPER

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.