관련 기사 바로가기
비주얼 이상 탐지를 위한 파운데이션 모델의 최신 연구 트렌드 분석범용 인-컨텍스트 분류기로서의 대형 멀티모달 모델절반의 진실이 유사도 기반 검색을 무너뜨린다InfoNCE는 가우시안 분포를 유도한다구성적 일반화를 위해 시각 임베딩 모델에 필요한 선형 및 직교 표현 연구지역성 주의 집중 비전 트랜스포머 (Locality-Attending Vision Transformer)Penguin-VL: LLM 기반 비전 인코더를 활용한 시각 언어 모델의 효율성 한계 탐색FVG-PT: 시각-언어 모델을 위한 적응형 전경 뷰 가이드 프롬프트 튜닝시각 언어 모델(VLM)이 시각 정보를 무시하는 이유와 해결책Anima Style Explorer 최종 버전 출시: 20,000명 이상의 아티스트 스타일 탐색 도구LoRA 데이터셋 준비를 위한 오픈소스 툴킷 'Klippbok' 공개자연어로 전체 이미지 라이브러리를 검색할 수 있는 오픈소스 앱, Makimus-AI 출시