본문으로 건너뛰기

관련 기사 바로가기

SAM2 기반 로컬 동영상 분할 도구 SAMannotSAM-MT: 실시간 인터랙티브 다중 타깃 비디오 분할Auto Dataset Builder: 자연어 명령으로 무인 YOLO 주석 데이터셋 생성모션, 기하학 및 시맨틱 적응을 갖춘 Segment Anything(SAMOSA): 복잡한 비선형 시각 객체 추적4K 76 FPS를 지원하는 로컬 자연어 기반 비디오 블러링 및 익명화 도구Segment Anything 모델의 진화: SAM 1, SAM 2에서 SAM 3까지의 기술 분석기하학적 일관성을 위한 양적 비디오 월드 모델 평가AuralSAM2: 피라미드형 오디오-비주얼 특징 프롬프트링으로 SAM2를 활성화BBQ-to-Image: 대규모 텍스트-이미지 모델에서의 수치적 바운딩 박스 및 색상 제어SimToolReal: 제로샷 다지 로봇 도구 조작을 위한 객체 중심 정책EffectErase: 고품질 효과 제거를 위한 비디오 객체 제거 및 삽입 통합 학습Kinema4D: 시공간적 엠보디드 시뮬레이션을 위한 기구학적 4D 월드 모델링노코드 컴퓨터 비전 API 개발 가이드: Roboflow Workflows 활용법동적 환경에서의 일반화 가능한 로봇 조작을 향하여EmbodMocap: 에이전트를 위한 야생 환경의 4D 인간-장면 재구성Kiwi-Edit: 지시어와 참조 가이드를 통한 다재다능한 비디오 편집ShotVerse: 텍스트 기반 멀티샷 비디오 생성을 위한 시네마틱 카메라 제어 기술의 발전RealWonder: 실시간 물리 동작 조건부 비디오 생성Holi-Spatial: 비디오 스트림을 통합적 3D 공간 지능으로 진화시키기의료 영상 분할 연구에서 ROI가 없는 빈 슬라이스를 제외해도 괜찮을까요?
← 피드로 돌아가기

SAM2

Vision Models (비전 모델)

27개 아티클

관심 태그 추가
TIMEHEADLINE