섹션별 상세
관측 데이터는 처치군과 대조군 간의 사전 특성 차이로 인해 단순 결과 비교 시 인과 관계 왜곡이 발생하기 쉽다. PSM은 각 유닛이 처치를 받을 조건부 확률인 '성향 점수'를 계산하여 이 문제를 해결한다. 로지스틱 회귀 모델을 사용해 관찰된 공변량들을 입력으로 하여 성향 점수를 출력하며, 이를 통해 다차원의 변수들을 단일 점수로 요약한다. 결과적으로 서로 다른 배경을 가진 집단 간의 비교 가능성을 높여준다.
추정된 성향 점수를 바탕으로 처치군과 대조군에서 점수가 가장 유사한 쌍을 맺는 매칭 과정을 수행한다. Scikit-learn의 NearestNeighbors를 활용한 1:1 근접 이웃 매칭 방식을 통해 중복 없는 매칭으로 균형 잡힌 비교 집단을 구성한다. 이 과정에서 두 집단의 점수 분포가 겹치는 '공통 지지(Common Support)' 영역을 확보하는 것이 분석의 신뢰성을 결정하는 핵심 요소이다.

매칭 후에는 표준화된 평균 차이(SMD)를 사용하여 공변량의 균형이 실제로 개선되었는지 진단해야 한다. SMD가 0.1 미만으로 떨어지면 두 집단 간의 불균형이 무시할 수 있는 수준으로 해소된 것으로 판단한다. 이커머스 사례 연구에서 제품 관련 페이지 방문 횟수 등의 변수 SMD가 0.28에서 0.05로 감소하며 매칭의 유효성이 입증되었다. 균형이 잡힌 후에야 비로소 결과 변수의 차이를 처치 효과로 해석할 수 있다.

최종적으로 매칭된 샘플을 사용하여 처치군에 대한 평균 처치 효과(ATT)를 산출함으로써 실제 비즈니스 임팩트를 측정한다. 단순 원시 데이터 비교와 달리, 행동 패턴이 유사한 사용자들끼리 비교하므로 '재방문'이라는 상태 자체가 구매율에 미치는 순수한 기여도를 분리해낼 수 있다. 분석 결과 재방문 고객의 구매 확률이 순수하게 2.5%p 상승하는 등의 구체적인 수치를 도출하여 의사결정의 근거로 활용한다.
기술
- Python
- Pandas
- Scikit-learn
- Logistic Regression
- NearestNeighbors
활용 사례
- 이커머스 구매 전환 분석
- 마케팅 캠페인 효과 측정
- 정책 도입 영향 평가
AI 분석 전체 내용 보기
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
원문 발행 2026. 03. 23.수집 2026. 03. 23.출처 타입 RSS
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.