Natively-AI-assistant/natively-cluely-ai-assistant
TypeScript1 / 0
로컬 실행과 BYOK를 지원해 실시간 전사, 로컬 RAG, 스텔스 오버레이로 인터뷰와 미팅을 보조하는 무료 개인용 데스크톱 애플리케이션이다.
TL;DR
Natively는 데스크톱에서 실시간 전사, 화면 OCR, 로컬 RAG를 결합해 인터뷰와 회의를 보조하도록 설계된 무료 개인용 소스 공개 애플리케이션이다. 내부 설계는 Rust 기반 제로카피 오디오 캡처로 낮은 지연을 확보하고 시스템 오디오와 마이크를 분리해 전사 품질을 높이며, SQLite+sqlite-vec로 과거 회의를 로컬 인덱싱해 컨텍스트를 제공한다. BYOK와 Ollama 연동으로 클라우드 의존도를 낮추고 데이터가 기기를 벗어나지 않도록 하며 대시보드에서 세션 관리와 내보내기를 지원한다. 다만 Linux 지원이 아직 제한적이고 초기 설정에 API 키 입력이나 로컬 모델 설치 과정이 필요하며 내장된 모의면접 모드는 제공되지 않는다.
핵심 포인트
- 완전한 로컬 실행 옵션을 지원해 API 키와 전사 데이터가 사용자의 기기를 벗어나지 않도록 설계되었다. 이로 인해 상용 클라우드 중심 대안들이 수반하는 중앙집중형 데이터 저장과 비교해 프라이버시 노출 리스크가 감소한다. 로컬 Ollama 연동으로 네트워크 없이도 기능을 활용할 수 있다.
- 제로카피 Rust 오디오 모듈과 듀얼 채널 전송 구조로 실시간 지연을 500ms 미만으로 유지하는 것을 목표로 설계되었다. 이 구조는 전사 파이프라인의 핵심 병목인 오디오 복사와 V8 가비지 컬렉션 비용을 제거해 낮은 지연과 안정적인 동작을 확보한다. 경쟁 제품의 웹 오디오 방식과 비교해 현저히 낮은 엔드투엔드 지연을 달성한다는 점을 내세운다.
- 로컬 RAG, 대시보드 기반 히스토리 관리, 스킬 기반 커스텀 페르소나를 결합해 단순 오버레이 이상의 상태 기반 지능형 어시스턴트를 구현했다. 회의 문맥을 지속적으로 유지하고 페르소나에 맞춘 템플릿을 적용해 응답 형식을 제어한다. 또한 스크린샷 OCR과 코드 실행 검증을 통해 인터뷰 과정에서 실용적인 피드백을 제공한다.
- 실시간 전사 파이프라인을 제공한다. Rust 기반의 제로카피 오디오 캡처와 하드웨어 가속된 Whisper 온디바이스 모델을 사용해 회의 음성을 낮은 지연으로 텍스트화한다. 이 과정은 시스템 오디오와 마이크를 분리 처리하는 듀얼 채널 구조로 잡음과 발화 혼선을 줄인다.
벤치마크
| 벤치마크 | 지표 | 값 | 비교 |
|---|---|---|---|
| Real-time latency | latency | <500ms | vs Cluely: 5–90s lag reported in README |
| User base | users | 9,000+ users | — |
| Daily active users | DAU | 700+ DAU | — |
| Data breach history | breaches | 0 data breaches | Cluely: 83,000 users breached (README claim) |
이미지 분석


1.9k
STARS
433
FORKS
+207
TRENDING
1
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.