본문으로 건너뛰기

관련 기사 바로가기

DiagramBank: 검색 증강 생성을 위한 논문 메타데이터 포함 대규모 다이어그램 디자인 예시 데이터셋CC3M 데이터셋을 활용한 CLIP 모델 바닥부터 학습하기HALO-Loss: 신경망의 과잉 확신과 환각 문제를 해결하는 새로운 손실 함수 오픈소스 공개LoRA 가중치 기저를 이용한 시각적 유추 공간 확장 (LoRWeB)AI 비전 기술의 진화: CNN에서 멀티모달 VLM까지Claude와 Vibe Coding으로 구축한 시각적 탐색 플랫폼 endlss.co 개발기Stable Diffusion 컬러링 페이지 생성을 위한 CLIP 및 DINOv2 기반 자동 품질 분류기 구축비둘기 퇴치를 위해 YOLO와 CLIP을 활용한 AI 도구 제작 (Chromebook 구동)HybridScorer: CUDA 기반 대량 이미지 선별 및 정렬 도구유니버설 노멀 임베딩: 인코더와 생성 모델을 잇는 공통 가우시안 잠재 공간HiMu: 긴 비디오 질의응답을 위한 계층적 멀티모달 프레임 선택 기술DreamPartGen: 협력적 잠재 디노이징을 통한 의미론적 기반의 부품 단위 3D 생성EffectErase: 고품질 효과 제거를 위한 비디오 객체 제거 및 삽입 통합 학습HeBA: 강건한 시각-언어 모델을 위한 이기종 보틀넥 어댑터ViT-AdaLA: 선형 어텐션을 활용한 비전 트랜스포머 적응 프레임워크RIKEN AIP, ICLR 2026에서 34편의 논문 채택 성과 발표SING: 분류 모델의 영공간 기하학을 통한 시맨틱 불변성 분석자율 주행을 위한 멀티모달 자기지도 학습 기반 효율적 2D LiDAR 장면 이해제로샷 이상 탐지를 위한 상호 필터링 기반 브릿지 특징 매칭 및 교차 모달 정렬CLIP (Contrastive Language-Image Pre-training) 완벽 가이드: 원리부터 코드 구현까지
← 피드로 돌아가기

CLIP

Embeddings (임베딩 모델)

58개 아티클

관심 태그 추가
TIMEHEADLINE