본문으로 건너뛰기

코사인 유사도가 대조 학습에서 벡터의 방향성을 측정하는 원리.

코사인 유사도는 벡터의 크기를 정규화하여 방향성만을 측정함으로써 대조 학습에서 데이터 간의 패턴 유사도를 효과적으로 학습하게 한다.

이 요약은 AI가 원문을 분석해 생성했습니다. 정확한 내용은 원문 기준으로 확인하세요.

TL;DR

코사인 유사도는 벡터의 크기를 배제하고 방향성만을 측정하여 데이터 간의 유사성을 판단하는 지표이다. 내적을 각 벡터의 크기로 나누어 정규화함으로써 모든 유사도 점수를 일정한 범위 내로 제한한다. 이러한 방식은 대조 학습에서 앵커와 후보군 간의 관계를 확률 분포로 변환하는 데 핵심적인 역할을 한다. 결과적으로 모델은 데이터의 절대적 크기가 아닌 패턴의 일치 여부에 집중하여 학습을 수행한다.

챕터별 상세

00:00

코사인 유사도의 개념과 수식

코사인 유사도는 두 벡터 사이의 각도를 측정하여 유사성을 판단하는 지표이다. 벡터의 내적을 각 벡터의 크기로 나누어 정규화함으로써 벡터의 길이를 배제하고 방향성만을 고려한다. 이 연산을 통해 모든 유사도 점수는 일정한 범위 내로 제한되며, 두 벡터가 같은 방향을 가리킬수록 높은 유사도 값을 가진다.

벡터의 크기를 정규화하여 방향성만 남기는 과정이 핵심이다.

01:00

대조 학습에서의 활용

대조 학습에서는 앵커 벡터와 나머지 후보 벡터들 간의 코사인 유사도를 계산하여 관계를 파악한다. 계산된 유사도 점수들은 확률 분포로 변환되어 모델 학습의 기준이 된다. 앵커와 유사한 데이터는 가깝게, 그렇지 않은 데이터는 멀게 배치하는 방식으로 데이터의 패턴을 학습한다.

유사도 점수를 확률 분포로 변환하여 학습 가능한 손실 함수로 활용한다.

용어 해설

코사인 유사도(Cosine Similarity)
두 벡터 사이의 각도를 측정하여 유사성을 판단하는 지표이다. 벡터의 크기를 무시하고 방향성만을 고려하므로, 데이터의 절대적 크기가 아닌 패턴의 유사성을 파악하는 데 효과적이다.
대조 학습(Contrastive Learning)
데이터 간의 유사한 쌍은 가깝게, 다른 쌍은 멀게 학습시키는 기법이다. 주로 임베딩 공간에서 데이터의 특징을 효과적으로 학습하기 위해 사용된다.
내적(Dot Product)
두 벡터의 대응하는 성분끼리 곱한 후 모두 더한 값이다. 벡터 간의 유사도나 투영을 계산하는 핵심 연산으로, 코사인 유사도 계산의 분자에 사용된다.
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 08. 23.수집 2026. 08. 23.출처 타입 YOUTUBE

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.