비디오 편집기 OpenShot에서 ComfyUI를 직접 실행한다
오픈소스 비디오 편집기 OpenShot이 ComfyUI 워크플로우를 타임라인에서 직접 로드하고 실행하는 기능을 추가하여 AI 비디오 편집 효율성을 높였다.
총 100건
오픈소스 비디오 편집기 OpenShot이 ComfyUI 워크플로우를 타임라인에서 직접 로드하고 실행하는 기능을 추가하여 AI 비디오 편집 효율성을 높였다.
LoRA에 음수 가중치를 적용하여 특정 패턴을 배제하고 모델의 잠재된 스타일을 정교하게 조각해내는 Negative LoRA의 원리와 실전 활용법을 다룬다.
Claude Code의 특수문자 이스케이프 버그 수정이 오히려 기존에 생성된 암호화 키의 접근을 차단하며 발생한 장애 분석.
복잡한 SaaS 개발 시 Lovable의 자동 리팩터링 부작용을 지적하며, 정밀한 코드 수정과 컨텍스트 유지가 가능한 Claude Code로의 전환 경험을 공유했다.
정치적 예측의 정확도를 높이기 위해 9단계의 분석 레이어와 소스 신뢰도 검증 로직을 결합한 고도화된 시스템 프롬프트이다.
구글의 Gemini, NotebookLM, AI Studio를 결합하여 역사 콘텐츠 제작부터 웹 배포 및 AI 기반 전략 게임 구현까지의 전 과정을 단 하루 만에 완료하는 실전 워크플로우를 제시합니다.
외부 라이브러리의 복잡한 의존성을 제거하고 필요한 기능만 AI로 재구현하여 보안과 가시성을 높이는 Claude Code 플러그인 'yoink'가 공개됐다.
Claude Code와 같은 AI 에이전트가 .env 파일의 비밀 정보를 읽어 코드에 노출하거나 커밋하는 문제를 해결하기 위해 플레이스홀더와 OS 키체인을 활용하는 보안 도구 Blindfold를 공유했다.
Anthropic의 연구를 바탕으로 Claude의 내부 감정 벡터를 시각화하고 분석하는 오픈소스 도구 EmoBar를 소개한다.
JSON 스키마와 17단계 AI 파이프라인을 활용해 영화 제작을 소프트웨어 컴파일처럼 자동화한 8분 단편 영화 'The Lone Crab' 제작기이다.
멀티모달 GAN을 GCP Vertex AI에 배포하며 겪은 실무적 어려움을 통해 ML 프로젝트의 90%가 모델링이 아닌 엔지니어링임을 강조했다.
Google Gemma와 임베딩 모델을 활용해 문서에서 플래시카드를 자동 생성하고 의미 기반 검색을 지원하는 오픈소스 학습 앱 ONCard가 공개됐다.
RTX 4080 환경에서 Qwen 3.5 등 최신 모델의 컨텍스트 크기 증가에 따른 추론 속도 변화를 llama.cpp로 벤치마킹한 결과이다.
생성형 AI 콘텐츠가 범람하는 가운데, 인간 창작자들이 자신의 작품을 보호하기 위해 다양한 '인간 제작' 인증 라벨 도입을 시도하고 있으나 표준화와 검증 방식에서 난항을 겪고 있다.
임베딩과 벡터 데이터베이스 대신 문서의 계층 구조를 활용하여 정확도를 높이고 비용을 절감하는 새로운 RAG 접근 방식인 PageIndex를 소개합니다.
Jetson Nano 하드웨어에 NixOS를 설치하고 Nemotron 모델을 활용하여 도구 호출이 가능한 로컬 LLM 에이전트를 구현한 사례이다.
인도의 두 소득세법이 공존하는 상황에서 병렬 의도 분류와 메타데이터 태깅을 통해 정확한 답변을 생성하는 RAG 아키텍처이다.
AI가 대화의 핵심 맥락을 효율적으로 압축하고 유지할 수 있도록 설계된 '내부 메모리 카드' 시스템 프롬프트 가이드이다.
작성자가 GPT-4o와 차세대 모델을 대상으로 민감한 사회적 이슈에 대한 동일한 질문을 던져 두 모델의 논리적 깊이와 응답 성향을 비교했다.
Anthropic의 Computer Use와 Claude in Chrome을 활용해 API가 없는 데스크톱 앱과 웹사이트를 코딩 없이 자동화하는 방법과 실무 적용 사례를 소개한다.
MSE, MAE, Cross-Entropy 등 주요 손실 함수와 F1 스코어의 시각적 원리를 통해 문제 유형별 최적의 지표 선택 기준을 정리했다.
에이전트의 반복적인 도구 호출을 단일 배시 스크립트로 통합하여 토큰 소모량을 최대 80%까지 줄이고 라운드트립 효율을 개선한 사례이다.
headless tmux와 OAuth TUI를 활용해 Claude Code를 외부 에이전트 하네스에 연결하고 구독 권한을 공유하는 도구가 공개됐다.
초보 사용자가 Bookswriter 플랫폼에서 DeepSeek 등 다양한 LLM을 활용하여 효율적으로 웹소설을 창작하는 방법과 경험을 공유했다.
AI 코딩 에이전트가 스스로 판단하고 코드를 작성할 수 있도록 튜토리얼과 미사여구를 제거한 'AI 전용 문서' 작성법과 그 성과를 공유함.
비즈니스 운영 역사를 통해 파편화된 도구 스택의 한계를 지적하고, 데이터 중심의 중앙 집중식 시스템 구축 후 AI 에이전트를 결합하는 전략을 제시한다.
Claude, Gemini, ChatGPT 등 주요 LLM이 첨부된 파일을 정확히 읽지 못하고 그럴듯한 허위 정보를 생성하는 현상과 그 원인에 대한 사용자 분석
Anthropic의 MCP 서버들이 데이터를 어떻게 처리하는지 투명하게 공개하고 프라이버시를 검증할 수 있는 허브와 가이드를 공유했다.
Claude Code 내에서 6가지 보안 스캐너를 병렬로 실행하고 AI로 결과를 분석해주는 오픈소스 플러그인 Shieldbot이 공개되었습니다.
인앱 브라우저의 샌드박스 제한으로 인한 구매 전환율 저하를 해결하기 위해, Claude를 활용해 외부 브라우저 전환 유도 도구를 개발한 사례이다.
시니어 개발자가 GitHub Copilot을 활용해 구조적 설계 대신 직관에 의존하는 '바이브 코딩' 방식으로 안드로이드 SMS 게이트웨이 서비스를 단기간에 개발했다.
Gemini 모델이 내부 추론 과정에서 미국의 중동 개입에 대한 편향된 시각과 구체적인 안전 가이드라인을 노출하여 논란이 되고 있다.
학습 손실 곡선에서 드러나지 않는 가중치 감쇠 붕괴를 열역학적 지표로 조기에 감지하여 학습 실패를 방지하는 PyTorch 도구 Thermoclaw가 공개됐다.
Anthropic의 서드파티 클라이언트 제한 정책에도 불구하고, Claude Code 개발자가 오픈소스 대안인 OpenClaw의 효율성 개선을 직접 도왔다.
로컬 및 클라우드 LLM을 블라인드 테스트와 ELO 레이팅으로 직접 비교할 수 있는 셀프 호스팅 도구 Open Model Arena가 공개됐다.
부정적 제약 조건을 프롬프트에 설정하여 AI 특유의 상투적 표현을 제거하고 문장력을 개선하는 기법을 소개한다.
여러 전문 AI 에이전트가 토론을 통해 하나의 통합된 의견을 도출함으로써 AI 생성 코드의 미세한 결함을 찾아내는 오픈소스 도구인 Open Code Review를 소개한다.
보안 샌드박스 환경에서 다양한 LLM을 조합하여 나만의 멀티 에이전트 팀을 구축하고 실행할 수 있는 오픈소스 데스크톱 앱 TigrimOS.
에이전트의 영구 메모리 시스템에서 벡터 검색이 고유 명사와 정확한 식별자를 찾지 못하는 문제를 해결하기 위해 BM25와 RRF를 결합한 하이브리드 검색 아키텍처를 도입했다.
AI 코딩 도구와 FFmpeg.wasm을 활용해 서버 비용 없이 브라우저 내에서 50개 이상의 포맷을 지원하는 파일 변환기를 개발한 경험을 공유했다.
Anthropic의 Claude Code를 엔진으로 활용하여 프랙탈 구조의 에이전트 계층과 분산 학습을 지원하는 프레임워크 Autonet이 공개됐다.
Claude Code의 /buddy 캐릭터를 수집하고 랭킹을 매기는 커뮤니티 프로젝트 BuddyBoard가 공개되었습니다.
아이폰의 가속도계와 자이로스코프 데이터를 결합해 타격을 감지하고 소리를 재생하는 SlapiPhone 앱의 AI 기반 개발 과정과 센서 로직 최적화 경험을 공유함.
Anthropic의 서드파티 제한 정책에 대응하여 Brave API와 Zim 파일 기반의 다중 쿼리 검색 기능을 갖춘 프로바이더 독립적 AI 시스템을 구축한 사례이다.
Claude의 MCP를 활용해 Apple 캘린더, 미리 알림, 메모를 연동하고 복잡한 학업 일정을 자동화한 사례 공유
IBM의 Grant Miller가 에이전트 기반 AI 시스템에서 토큰 교환, 위임, 검증 가능한 ID를 통해 보안 위협을 방지하고 신뢰를 구축하는 기술적 프레임워크를 제시합니다.
여러 AI 구독 서비스의 사용량 제한과 작업별 강점을 고려하여 작업을 자동 분류하고 최적의 모델로 안내하는 라우팅 레이어 프로젝트 공유.
Gemma 모델의 성능 문제는 모델 자체보다 llama.cpp의 초기 구현 미비와 프롬프트 설정 때문일 가능성이 높다.
식품 제조 현장에서 비기술직 작업자가 Ollama와 Phi-3 Mini를 이용해 자연어로 생산 데이터를 조회할 수 있는 로컬 SQL 생성 시스템을 구축했다.
Apple Silicon의 MLX를 활용해 복잡한 설정 없이 macOS에서 로컬로 작동하는 고성능 TTS 앱 OpenVox가 출시됐다.
Anthropic의 Claude Code 소스 유출을 악용한 악성코드 유포와 FBI 감청 시스템 해킹 등 주요 보안 위협이 발생했다.
ESP32/ESP8266 기반의 75개 IoT 프로젝트를 오픈소스로 공개하며, 특히 Groq AI를 활용한 자연어 하드웨어 제어와 ESP-NOW 통신 기술을 강조했다.
Claude Code, Manus, Replit Agent 등 최신 AI 도구를 활용하여 MIDI 자동 채보 기능을 갖춘 웹 기반 칼림바 리듬 게임을 개발한 사례이다.
SQLite와 Bunx를 활용해 외부 의존성 없이 로컬 코드베이스에 대한 시맨틱 검색을 제공하는 MCP 서버 프로젝트이다.
Claude Code의 세션별 도구 사용 패턴을 기록하고 학습하여 다음 작업 시 최적의 워크플로우를 선제적으로 추천하는 오픈소스 도구 Zoku가 공개됐다.
Claude Code에서 10개의 전문화된 에이전트를 통해 이더리움 스마트 컨트랙트 개발 및 보안 감사를 자동화하는 플러그인 eth-agents가 공개되었다.
Claude가 대화가 길어질 때 대화를 강제로 종료하려는 성향과 내부 'action-termination' 명령의 존재가 확인됐다.
Flowise를 활용해 복잡한 독일 HR/세무 프로세스를 4개의 전문 에이전트와 감독관 체제로 분해하여 자동화한 사례이다.
Apple의 3B 파라미터 온디바이스 모델을 터미널과 OpenAI 호환 API로 로컬에서 실행할 수 있는 도구 'apfel'이 공개됐다.
Gemma 3 270M을 드래프트 모델로 활용해 Gemma 4 31B의 생성 속도를 32.9 t/s에서 36.6 t/s로 약 11% 개선했다.
iOS 환경에서 Kokoro TTS의 백그라운드 재생 및 발열 문제를 해결하기 위해 모델을 파이프라인화하고 Accelerate 프레임워크를 적용하여 성능을 20배 향상시킨 사례이다.
psyctl은 LLM의 성격 조정(Activation Addition) 과정을 자동화하여 대조 데이터 생성부터 심리 검사 기반 평가까지 지원하는 오픈소스 CLI 도구이다.
Claude Code의 응답 코드를 macOS 클립보드로 즉시 복사해주는 오픈소스 플러그인 '/yank'가 공개되었습니다.
M4 칩의 Neural Engine이 독립된 프로세서가 아닌 CPU 내 SME2 유닛임을 벤치마크와 직접 구현한 도구로 입증했다.
Claude Code 2.1.92 업데이트로 상세 비용 파악 및 캐시 누수 수정이 이루어졌으며, 효율적인 프롬프트 기법이 커뮤니티에서 큰 호응을 얻었다.
Claude Code 사용 시 30분의 명세서 작성을 선행하여 AI의 실행 정확도와 창의적 문제 해결력을 극대화하는 방법론
Claude Code에서 PDF, DOCX 등 문서를 읽을 때 Markdown으로 자동 변환하여 토큰 소모를 최대 20배까지 줄여주는 PreToolUse 훅 도구이다.
Vercel Analytics로 모바일 사용자 비중을 확인하고 AI 보조 코딩으로 UI를 신속히 최적화한 사례이다.
멀티 에이전트가 워크플로우와 해결책을 공유하여 중복 작업을 방지하고 컨텍스트 효율을 높이는 도구 OpenHiveMind가 개발됐다.
Codex를 활용해 복잡한 코딩 문제를 작은 단위로 분해하고, 로그 주입과 검증 프롬프트를 결합하여 정확도를 높이는 워크플로를 공유했다.
웹 개발자가 Claude와 에이전틱 프로그래밍을 활용해 직접 코딩 없이 Three.js 기반 게임을 개발하며 얻은 기술적 통찰과 워크플로 공유.
Claude의 공식 Todoist 커넥터 부재를 해결하기 위해 MCP URL을 사용하여 커스텀 커넥터를 설정하고 연동하는 단계별 가이드이다.
Claude AI가 BIP39 단어 목록을 저작권 보호 대상으로 오인해 차단하는 문제를 Python 패키지 활용으로 해결하는 방법이다.
GraphReFly는 인간과 AI가 공유하는 투명한 그래프 구조를 통해 안전하고 검사 가능한 에이전트 협업 환경을 제공하는 반응형 프로토콜이다.
NES의 메모리 뱅킹 시스템에서 영감을 얻어 KV 캐시를 계층화하고 압축하는 Monarch 기법을 통해 TinyLlama-1.1B 모델의 추론 속도를 78% 향상시켰다.
Python, Go, Rust 기반 REST 서버 구축 및 성능 벤치마킹을 포함한 복합 에이전트 코딩 테스트 프롬프트를 공유하고 커뮤니티의 의견을 구했다.
로컬 AI 에이전트의 재시도 시 발생하는 중복 API 호출 및 사이드 이펙트를 방지하기 위해 단계별 실행 완료를 기록하는 '영수증(Receipt)' 패턴을 제안한다.
Whisper와 Coqui-TTS를 최적화하여 로컬 환경에서 0.2~0.25초의 초저지연 음성 인터페이스를 구현하고 관련 서버 코드를 공개했다.
Gemma-4-26B-A4B 모델을 GGUF로 직접 양자화하며 겪은 500GB의 리소스 요구사항과 imatrix 활용 노하우를 공유했다.
Flask와 순수 HTML을 사용하여 Gemma 모델을 9GB RAM에서 구동하는 가벼운 로컬 웹 인터페이스를 구현하고 공유함.
LTX 2.3와 전용 LoRA를 활용해 24시간 이내에 일관성 있는 캐릭터와 스타일을 유지하며 단편 영화를 제작하는 워크플로우를 공유했다.
Dual 7900 XTX 환경에서 Gemma-4 26B MoE 모델을 구동하여 RTX 5090급의 작업 처리 성능과 초당 1291토큰의 높은 처리량을 확인했다.
NVIDIA Thor 하드웨어에서 FP4 정밀도로 동작하도록 최적화된 172B 규모의 MiniMax-M2.5 양자화 모델이 Hugging Face에 공개되었다.
한 명의 UX 디자이너가 Claude Code와 Brave API를 활용해 AI 기반 투어 루머 분석 사이트(touralert.io)를 일주일 만에 구축한 과정과 기술 스택을 공유했다.
Obsidian을 Claude Code의 외부 메모리로 활용하여 프로젝트 관리와 에이전트 코딩을 통합하는 워크플로우.
Claude의 긴 대화 내역을 레이지 로딩 문제 없이 코드와 수식 스타일을 유지하며 PDF로 내보내는 크롬 확장 프로그램이다.
22개의 전문 서브에이전트를 통해 설계부터 실행까지 자동화하는 멀티 에이전트 오케스트레이션 플랫폼 Maestro의 v1.5.0 업데이트가 공개됐다.
쿼리 복잡도를 사전에 측정하여 최적의 모델로 자동 할당하고, 사용자 피드백에 따라 상위 모델로 전환하는 효율적인 추론 시스템 제안이다.
AI 에이전트가 웹 페이지를 토큰 최적화된 Markdown으로 변환하고 복잡한 상호작용을 수행할 수 있게 돕는 전용 헤드리스 브라우저 browser39가 출시됐다.
스타트업 CEO 시뮬레이션인 YC-Bench 결과, Claude Opus 4.6이 1위를 차지했으나 GLM-5가 압도적인 가성비를 보여주며 스크래치패드 활용의 중요성이 확인됐다.
AI 모델의 내부 추론 과정에서 1989년 천안문 사태와 관련된 강력한 안전 제한 및 차단 정책이 노출된 사례가 공유되었다.
Dual RTX 3090 환경에서 Gemma 4 MoE 모델이 120 TPS의 높은 추론 속도를 기록하며 로컬 실행 효율성을 입증했다.
Gated Delta Net 아키텍처에서 Q/K 투영을 제거하고 이전 은닉 상태를 키로 사용하는 시프트 키 기법이 더 적은 파라미터로도 빠른 수렴과 높은 성능을 보였다.
Claude Code와 유사한 사용자 경험을 제공하기 위해 Python SSE 브릿지와 작업 사이드바를 갖춘 오픈소스 자가 호스팅 채팅 UI 'Bilby'가 공개됐다.
PrismML의 Bonsai 1비트 모델을 CPU에서 실행할 수 있도록 llamafile과 llama.cpp 커스텀 포크를 통합한 실행 파일이 공개됐다.