본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
SAM-MT: 실시간 인터랙티브 다중 타깃 비디오 분할
Auto Dataset Builder: 자연어 명령으로 무인 YOLO 주석 데이터셋 생성
모션, 기하학 및 시맨틱 적응을 갖춘 Segment Anything(SAMOSA): 복잡한 비선형 시각 객체 추적
Segment Anything 모델의 진화: SAM 1, SAM 2에서 SAM 3까지의 기술 분석
기하학적 일관성을 위한 양적 비디오 월드 모델 평가
AuralSAM2: 피라미드형 오디오-비주얼 특징 프롬프트링으로 SAM2를 활성화
BBQ-to-Image: 대규모 텍스트-이미지 모델에서의 수치적 바운딩 박스 및 색상 제어
SimToolReal: 제로샷 다지 로봇 도구 조작을 위한 객체 중심 정책
4K 76 FPS를 지원하는 로컬 자연어 기반 비디오 블러링 및 익명화 도구
EffectErase: 고품질 효과 제거를 위한 비디오 객체 제거 및 삽입 통합 학습
Kinema4D: 시공간적 엠보디드 시뮬레이션을 위한 기구학적 4D 월드 모델링
노코드 컴퓨터 비전 API 개발 가이드: Roboflow Workflows 활용법
동적 환경에서의 일반화 가능한 로봇 조작을 향하여
EmbodMocap: 에이전트를 위한 야생 환경의 4D 인간-장면 재구성
Kiwi-Edit: 지시어와 참조 가이드를 통한 다재다능한 비디오 편집
ShotVerse: 텍스트 기반 멀티샷 비디오 생성을 위한 시네마틱 카메라 제어 기술의 발전
RealWonder: 실시간 물리 동작 조건부 비디오 생성
Holi-Spatial: 비디오 스트림을 통합적 3D 공간 지능으로 진화시키기
의료 영상 분할 연구에서 ROI가 없는 빈 슬라이스를 제외해도 괜찮을까요?
RotoAI: SAM2와 Grounding DINO를 활용한 오픈소스 프롬프트 기반 비디오 세그멘테이션 도구
← 피드로 돌아가기
SAM2
Vision Models (비전 모델)
약 26개 아티클
관련 태그:
YOLO
Wan 2.1
Grounding DINO
CLIP
Roboflow
Sim-to-Real
Medical-SAM2
Qwen
Qwen3-VL
SAM 3