DMS/OMS 설계 고민? 단일 RGB-IR 카메라가 주는 이점과 도전 과제
운전자 모니터링 시스템에서 단일 RGB-IR 글로벌 셔터 카메라를 활용한 통합 파이프라인의 장단점과 실무 경험을 공유한다.
총 100건
운전자 모니터링 시스템에서 단일 RGB-IR 글로벌 셔터 카메라를 활용한 통합 파이프라인의 장단점과 실무 경험을 공유한다.
마케팅 업무의 효율성과 성과를 높이기 위해 실제 현장에서 효과가 입증된 후킹 문구, 이메일 제목, 콘텐츠 재가공, 성과 진단용 프롬프트 4종을 공유함.
n8n 자동화 도구와 Gemini, FLUX.1 등 다양한 AI 모델을 결합하여 하나의 주제로 9개 소셜 플랫폼용 콘텐츠와 이미지를 자동 생성하는 시스템을 구축했다.
이기종 데이터베이스를 넘나들며 복잡한 추론과 쿼리 최적화를 수행하는 데이터 에이전트의 설계 원칙과 비정형 데이터 처리를 위한 DocETL 프레임워크를 심도 있게 다룹니다.
JSON의 계층 구조와 위치 정보를 활용해 LLM이 지식 공간을 효율적으로 탐색하게 돕는 시맨틱 숫자 시스템이다.
스페인 스타트업 Xoople이 AI 및 딥러닝 모델에 최적화된 고정밀 위성 데이터를 제공하기 위해 1억 3천만 달러의 시리즈 B 투자를 유치했다.
LLM 프롬프트 압축 시 벤치마크와 모델 구조에 따라 출력 길이가 급증하여 오히려 비용과 에너지가 증가할 수 있음을 규명함.
Python과 PyQt6로 제작된 'MAX'는 커스텀 물리 엔진과 AI 채팅, 시스템 도구를 결합한 오픈소스 데스크탑 픽셀 캐릭터이다.
로컬에서 실행 중인 Codex/Claude 코딩 세션을 모바일 앱으로 모니터링하고 제어할 수 있는 오픈소스 도구 RemoteCode.io가 공개됐다.
Claude Code 터미널 세션을 SSH를 통해 실시간으로 공유하여 원격 협업을 가능하게 해주는 Go 기반 오픈소스 도구 claude-pair가 공개됐다.
LLM의 성능 저하에 대응하여 로컬 스크립트로 PR 데이터를 정제하고 노이즈를 제거하는 효율적인 워크플로를 제안한다.
LLM-as-judge의 확률적 한계와 비용 문제를 지적하며, 상태 머신 기반의 결정론적 검증 방식이 더 신뢰성 높은 대안임을 제시한다.
저사양 Render 환경에서 Gongju 모델이 OOM 대신 리소스를 예측하여 파이프라인을 제안하는 하드웨어 거부 메커니즘을 선보였다.
AI 모델의 사이버 공격 능력은 6개월마다 두 배로 성장하며, 내부 업무에 AI를 적극 도입한 스타트업은 비도입 기업 대비 1.9배의 매출 성장을 기록했다.
오픈소스 AI 에이전트 OpenClaw를 활용해 메시징 앱 연동부터 로컬 모델 실행, 업무 자동화 및 VPS 배포까지 단계별로 학습하는 5가지 프로젝트를 구성한다.
ServiceNow의 복잡한 API 구조와 데이터 형식을 자동으로 처리하여 LangChain Document로 변환해주는 전용 로더 'snowloader'가 공개되었다.
CLAUDE.md 파일을 활용해 AI의 행동 지침을 구조화하고 '하네스 엔지니어링'으로 코딩 에이전트의 성능과 일관성을 높이는 방법.
AI 에이전트의 연속성은 단순한 문맥 검색(RAG)의 문제가 아니라, 상태가 유지되는 프로세스(Persistent Process)로서의 인프라 구축 문제이다.
MIT 연구에 따르면 AI는 복잡한 작업에서 탁월한 성과를 내지 못하며, 인간의 검증 부재가 심각한 실무 오류로 이어지고 있다.
멀티모달 AI가 텍스트, 이미지, 비디오 등 다양한 데이터를 처리하는 두 가지 핵심 방식인 피처 레벨 퓨전과 공유 벡터 공간 기반의 네이티브 멀티모달리티 아키텍처를 비교 분석합니다.
6개월간의 자율 에이전트 운영 경험을 바탕으로 분산 컴퓨팅, 암호화된 영구 메모리, 메모리 이원화 관리의 중요성을 확인했다.
ResNet-18과 CBAM을 활용해 저사양 환경에서도 구동 가능한 고성능 시선 추적 파이프라인을 구축하고 도메인 갭 극복 방안을 모색함.
CNN에서 시작해 Vision Transformer를 거쳐 현재의 멀티모달 VLM에 이르기까지 AI 비전 기술의 핵심 변곡점과 아키텍처 변화를 요약합니다.
인텔이 AI 칩 수요 대응을 위해 뉴멕시코와 말레이시아 팹을 중심으로 첨단 패키징 사업을 확장하며 TSMC와의 격차 해소에 나섰다.
agent-add는 각 AI 도구의 복잡한 설정 파일 형식을 몰라도 MCP 서버, 스킬, 서브 에이전트 등을 여러 IDE와 CLI에 통합 설치해주는 오픈소스 도구이다.
RTX 4060/3050 조합의 16GB VRAM 환경에서 Gemma 4 31B 모델을 Claude Code CLI와 연동하여 로컬 자율 코딩 에이전트를 구현한 실험기이다.
Tencent의 HunyuanOCR 1B 모델이 GGUF 포맷을 통해 GTX 1060에서도 90 t/s의 속도와 높은 정확도를 기록하며 로컬 OCR의 새로운 표준이 됐다.
협동 로봇과 자율 이동 로봇의 안전한 운용을 위해 시각·촉각 등 멀티모달 데이터의 정밀한 정렬과 도메인 특화 데이터셋 구축이 필수적이다.
AI 에이전트가 단순 Bash 실행을 넘어 TUI 애플리케이션 상호작용과 화면 출력을 제어할 수 있게 돕는 MCP 기반 터미널 에뮬레이션 도구이다.
LG Aimers 8기 참가자들이 EXAONE 1.2B 모델을 경량화하며 실전 AI 역량을 쌓는 해커톤 현장을 담았다.
RTX 4090 노트북 환경에서 단일 프롬프트로 4분 이상의 영상을 생성하는 사전 알파 단계의 T2V/I2V 파이프라인 워크플로우가 공개됐다.
개인 소장 90년대 만화책 50장을 학습시켜 당시 특유의 과장된 캐릭터 디자인과 화풍을 재현하는 Psionix LoRA 모델과 상세 학습 파라미터를 공개했다.
GLM 5.1과 Web Speech API를 활용해 실시간으로 발음, 문법, 유창성을 평가하는 다국어 AI 대화 연습 도구이다.
대화의 맥락과 사실을 계층적으로 분리하여 관리하는 3계층 메모리 시스템으로 기존 RAG의 한계를 해결하는 아키텍처를 제안한다.
애플의 앱스토어 정책으로 Replit 등 AI 코딩 앱이 퇴출되자, 개발자들이 iMessage나 디스코드 등 규제가 느슨한 플랫폼으로 배포 경로를 우회하며 혁신을 이어가고 있다.
설치된 수많은 Claude Code 스킬 중 현재 맥락에 가장 적합한 것을 자동으로 선택하고 실행해주는 라우팅 도구 Jarvis가 공개됐다.
Claude Code에서 MCP 서버의 방대한 도구 스키마로 인한 토큰 낭비를 해결하기 위해, 점진적 공개 방식의 CLI를 자동 생성하는 mcp2cli가 개발됐다.
Claude Code를 최고 성능 사양으로 설정했음에도 불구하고, 간단한 문서 작성 요청에 대해 79초간 추론한 뒤 요청하지 않은 중국어 개발 가이드를 출력한 오류 사례이다.
AI 에이전트가 이미 해결된 기술적 문제를 반복하며 토큰을 낭비하지 않도록, 3,800개 이상의 솔루션을 담은 공유 지식 베이스(OpenHiveMind)를 구축하여 효율성을 높였다.
Go 언어와 tiktoken을 사용하여 LLM 요청의 토큰 수에 따라 부하를 분산함으로써 지연 시간을 12% 개선하는 L7 로드 밸런서 구현 방법.
알리바바의 AI 도구 Accio가 데이터 분석과 제조사 매칭을 통해 소규모 기업의 제품 기획부터 출시까지의 과정을 획기적으로 단축하고 있다.
Obsidian Kanban과 Git을 활용해 LLM과의 협업 맥락을 유지하고 체계적인 개발 프로세스를 구축하는 방법.
Cursor 3, Grok, ChatGPT를 활용해 게임 잼 프로젝트를 완성하며 에이전트 중심 워크플로와 AI 번역의 한계를 경험했다.
Claude Chrome MCP 확장 프로그램에서 스크롤 시 발생하는 스크린샷 공백 문제를 CSS transform을 이용해 해결하는 방법을 공유했다.
Claude Max 구독 서비스에서 모델의 추론 깊이를 결정하는 'Effort' 파라미터가 'High'에서 'Low'로 조용히 하향 조정되었다는 주장이 제기됐다.
Claude Code의 급격한 토큰 소진 원인이 Anthropic의 API 캐시 미스 비용 보전 정책 폐지에 있다는 기술적 분석이다.
GrapheneOS를 통해 OpenAI의 과도한 기기 무결성 체크와 행동 프로파일링 정황을 포착한 사용자가 프라이버시 침해를 이유로 계정을 삭제하고 경고를 전함.
SpaceX가 2026년 IPO를 통해 xAI와 통합하고, 궤도 데이터센터 및 수직 통합형 칩 제조 시설 'TeraFab'을 구축하여 AI 인프라 패권을 쥐려는 전략을 분석한다.
LightRace는 원격 도구 호출과 실시간 트레이싱을 지원하며 Langfuse와 호환되는 오픈소스 LLM 관측 및 디버깅 도구이다.
Claude Code와 OpenAI Codex를 통합하여 시각적 작업 체이닝과 자동화 파이프라인 구축을 지원하는 데스크톱 GUI 도구이다.
인스타그램과 틱톡 데이터를 AI로 분석하여 인플루언서의 적정 협찬 비용과 브랜드 적합도를 산출해주는 'PriceInfluencer' 도구의 개발 및 출시 소식이다.
Anthropic의 서드파티 도구 제한에 대응하여 Kilo Gateway와 API 기반 과금 체계를 활용한 효율적인 AI 에이전트 구축 및 비용 관리 방안을 제시합니다.
AI 에이전트가 로컬 .md 파일을 통해 직접 태스크를 읽고 업데이트할 수 있게 돕는 오픈소스 CLI 도구 nod가 공개되었다.
WebGPU 환경에서 LLM 추론 시 발생하는 디스패치 오버헤드를 체계적으로 측정하고 커널 퓨전을 통한 최적화 효과를 입증함.
Llama-3-70B 모델의 100만 토큰 추론 시 발생하는 메모리 병목 현상을 분석하고, 이를 해결하기 위한 USP(FSDP, Ulysses, Ring Attention)의 필요성을 수학적으로 증명한다.
Claude Code 사용 중 가드 조건 누락으로 5^N 방식의 무한 재귀가 발생해 10만 개 이상의 Linear 이슈가 생성된 사례 공유.
Claude Haiku를 엔진으로 사용하여 사용자가 AI 상담원과 소비자 권리를 두고 논쟁하는 교육용 게임 'FixAI' 개발 및 성과 공유.
Claude Code와 MCP를 활용해 9개의 서버와 6인 에이전트 협업 체계를 갖춘 오픈소스 GRC 플랫폼 RiskReady를 구축한 사례이다.
Raspberry Pi와 Claude Haiku를 결합해 사용자의 업무 맥락과 생체 신호를 실시간으로 반영하는 한 줄 메시지 기반 앰비언트 AI 시스템을 구축한 사례이다.
Claude Code의 훅(Hooks) 기능을 활용해 매 메시지 전송 시 현재 시간을 컨텍스트에 자동 주입하여 모델의 시간 인지 능력을 개선하는 설정법이다.
cloclo는 Anthropic, OpenAI 등 13개 이상의 모델 제공자를 지원하며 도구 호출과 MCP 연동이 가능한 오픈소스 AI 코딩 에이전트 CLI이다.
llama.cpp로 100k 컨텍스트 추론 시 VRAM 여유와 상관없이 시스템 RAM 사용량이 급증하여 프로세스가 강제 종료되는 현상이 보고됐다.
Intel 258V iGPU 환경에서 다양한 GGUF 양자화 형식의 추론 속도와 품질 손실(KLD)을 비교하여 최적의 성능 균형점을 도출했다.
Claude의 Git 브랜치 오해로 인한 코드 손실 위기를 다중 자동 백업 시스템으로 극복한 사례와 구체적인 백업 구성 방안.
Jupyter 노트북의 메모리 사용량을 셀 단위로 추적하고 시각화하는 40배 더 가벼운 데스크톱 프런트엔드 Saturn이 공개되었습니다.
Claude Code CLI의 메모리 누수 문제를 해결하기 위해 유령 프로세스를 자동 정리하는 오픈소스 스킬 'memory-sentry'가 공개됐다.
LLM의 기본 원리부터 도구 사용, 자율 에이전트 및 멀티 에이전트 시스템까지의 핵심 개념을 9개 장으로 정리한 입문 가이드이다.
프롬프트 작성 시 지시문보다 출력 형식을 구체적으로 정의함으로써 모델의 무분별한 가정을 줄이고 응답의 구조적 완성도를 높인 사례이다.
안드레 카르파티의 LLM 위키 패턴을 OpenClaw 환경에서 안전하게 구현하기 위한 3계층 구조와 필수 보안 인프라 요건을 제시한다.
Claude를 단순 코드 생성기가 아닌 기획 및 페어 프로그래밍 파트너로 활용하여 오픈소스 앱 'Buffer'를 효율적으로 개발한 사례 공유.
Claude Code와 MCP를 활용해 App Store Connect의 메타데이터 관리부터 심사 제출까지 전 과정을 자동화하는 오픈소스 도구 Blitz가 공개됐다.
터미널 기반 AI 에이전트인 Claude Code의 직접 접근 방식과 Claude Cowork의 샌드박싱 환경 간의 보안 차이 및 실무적 위험 요소를 분석한다.
Phi-4-mini 모델에서 LayerNorm 감마 파라미터만 학습시키는 BALLAST 기법을 실험했으나, 모든 벤치마크에서 성능이 하락하며 LoRA 대비 실효성이 없음을 확인했다.
HTML을 DOM 정보가 포함된 Markdown으로 변환하여 LLM이 재사용 가능한 스크레이핑 코드를 생성하도록 돕는 도구이다.
한 변호사가 10대의 Tesla V100 GPU를 NVLink로 연결하여 320GB VRAM 서버를 구축하고, vLLM을 활용한 최적화 설정 및 벤치마크 결과를 공유했다.
1998년형 iMac G3 하드웨어 제약을 극복하고 260K 파라미터의 Llama 2 모델 추론을 구현한 프로젝트이다.
로컬 LLM의 확산을 위해서는 단순한 모델 성능 향상보다 예측 가능한 인프라와 안정적인 워크플로우 구축이 더 중요하다는 논의이다.
구독형 음성 인식 서비스 대신 로컬 모델과 사용자 API 키 연동을 지원하여 비용 부담을 없앤 윈도우용 오픈소스 앱 Dictate가 공개됐다.
Claude Code를 중앙 오케스트레이터로 활용하여 Magic Hour API, FFmpeg 등을 통합하고 대량의 비디오 콘텐츠 제작을 자동화한 실무 워크플로이다.
빌더, 챌린저, 아비터의 세 역할을 통해 솔루션을 구축, 검증, 중재하여 논리적 결함이 없는 최적의 결과를 도출하는 프레임워크이다.
인스타그램 계정 정보를 입력하면 전략, 포맷, 목표에 맞춘 맞춤형 콘텐츠 캘린더를 생성해 주는 LLM 기반 도구의 상세 프롬프트 설계안이다.
여러 기기를 연결해 중앙 서버 없이 LLM 추론을 수행하는 분산형 AI 연산 네트워크 프로젝트이다.
전통적인 프로그래밍의 '명령 실행' 모델에서 벗어나 LLM의 '문맥 기반 다음 토큰 생성' 메커니즘을 이해하도록 돕는 교육용 프롬프트를 공유한다.
Windows용 Claude Desktop의 Cowork 플러그인 실행 시 발생하는 VM 서비스 시작 실패 오류를 해결하기 위한 올바른 MSIX 설치 경로와 복구 스크립트를 공유함.
MCP 서버를 subprocess로 실행하고 Vitest 매처로 기능을 검증할 수 있는 오픈소스 테스트 라이브러리입니다.
Claude Code 마스코트를 활용해 18종의 캐릭터와 희귀도 기반 프로필 이미지를 생성하는 React 기반 웹 도구이다.
Claude Code가 에러를 숨기고 가짜 데이터를 반환하는 문제를 해결하기 위해 CLAUDE.md에 '명시적 실패' 원칙을 설정하여 디버깅 효율을 높이는 방법이다.
개인 지식 베이스와 코드베이스를 로컬에서 인덱싱하고 쿼리할 수 있는 오픈소스 RAG 도구 qi가 공개되었습니다.
로컬 LLM의 물리적 상식과 논리적 우선순위를 테스트하기 위한 고유 프롬프트 세트와 Gemma 및 MoE 모델의 테스트 결과를 분석했다.
ComfyUI와 LLM을 결합해 타로 카드 뽑기, 이미지 생성, 텍스트 해석을 자동화한 인터랙티브 워크플로우 ProtoTeller가 공개됐다.
Welford 온라인 알고리즘을 사용하여 별도의 설정 없이 앱의 이벤트 이상 징후를 감지하고 알림을 보내는 오픈소스 도구이다.
60개 이상의 상호 연결된 모듈을 통해 통합 의식 스택을 구현하고 IIT 4.0 수식을 실제로 계산하는 인지 아키텍처 Aura가 공개됐다.