본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
DINO 임베딩과 CLIP 재순위를 이용해 항공사진에서 RC기체를 찾아냈다.
LLM 행동 학습을 위한 모듈형 데이터셋 시스템 'Dino' 공개
LoST: 3D 형상을 위한 의미론적 수준별 토큰화
유니버설 노멀 임베딩: 인코더와 생성 모델을 잇는 공통 가우시안 잠재 공간
모든 레이어가 평등한 것은 아니다: 개인화된 이미지 생성을 위한 적응형 LoRA 랭크
SING: 분류 모델의 영공간 기하학을 통한 시맨틱 불변성 분석
메타의 DINO: 컴퓨터 비전의 ChatGPT 모먼트를 꿈꾸다
딥러닝 모델 학습의 안정성을 높이는 EMA(지수 이동 평균) 완벽 이해
메타의 DINO: 라벨 없이 스스로 학습하는 비전 모델의 원리
구성적 일반화를 위해 시각 임베딩 모델에 필요한 선형 및 직교 표현 연구
지역성 주의 집중 비전 트랜스포머 (Locality-Attending Vision Transformer)
시각 언어 모델(VLM)이 시각 정보를 무시하는 이유와 해결책
← 피드로 돌아가기
DINO
Vision Models (비전 모델)
약 19개 아티클
관련 태그:
CLIP
Meta
EMA
GPT
LoRA
LoST
Meta AI
Qualcomm
ResNet
Safety