본문으로 건너뛰기

2026년 4월 4일 AI 뉴스

100

관심 태그 추가

비디오 편집기 OpenShot에서 ComfyUI를 직접 실행한다

오픈소스 비디오 편집기 OpenShot이 ComfyUI 워크플로우를 타임라인에서 직접 로드하고 실행하는 기능을 추가하여 AI 비디오 편집 효율성을 높였다.

싫어하는 스타일의 LoRA가 최고의 도구가 된다? Negative LoRA 활용법

LoRA에 음수 가중치를 적용하여 특정 패턴을 배제하고 모델의 잠재된 스타일을 정교하게 조각해내는 Negative LoRA의 원리와 실전 활용법을 다룬다.

Claude Code 업데이트 후 비밀번호가 틀리다고? 3시간의 디버깅 사투기

Claude Code의 특수문자 이스케이프 버그 수정이 오히려 기존에 생성된 암호화 키의 접근을 차단하며 발생한 장애 분석.

버튼 하나 고쳤는데 DB가 깨졌다? Lovable을 떠나 Claude Code로 이주한 이유

복잡한 SaaS 개발 시 Lovable의 자동 리팩터링 부작용을 지적하며, 정밀한 코드 수정과 컨텍스트 유지가 가능한 Claude Code로의 전환 경험을 공유했다.

Claude와 Grok이 가장 뛰어났다 — 정치 분석의 정확도를 높이는 9단계 프롬프트 설계법

정치적 예측의 정확도를 높이기 위해 9단계의 분석 레이어와 소스 신뢰도 검증 로직을 결합한 고도화된 시스템 프롬프트이다.

Gemini와 NotebookLM만으로 유튜브 채널부터 게임 제작까지 끝내는 법

구글의 Gemini, NotebookLM, AI Studio를 결합하여 역사 콘텐츠 제작부터 웹 배포 및 AI 기반 전략 게임 구현까지의 전 과정을 단 하루 만에 완료하는 실전 워크플로우를 제시합니다.

r/LLMDevs4달 전

라이브러리 의존성이 독이 된다? AI로 필요한 기능만 골라 쓰는 yoink

외부 라이브러리의 복잡한 의존성을 제거하고 필요한 기능만 AI로 재구현하여 보안과 가시성을 높이는 Claude Code 플러그인 'yoink'가 공개됐다.

네트워크 로그로 증명한 AI 성능: GPT-5.3의 비효율성 vs 로컬 모델의 정밀함

로컬 모델 'Gongju'가 GPT-5.3 대비 압도적으로 적은 네트워크 자원을 사용하면서도 복잡한 물리 수식을 더 정확하게 생성함을 입증했다.

Claude가 내 API 키를 커밋했다 AI 에이전트의 비밀 정보 유출을 막는 Blindfold

Claude Code와 같은 AI 에이전트가 .env 파일의 비밀 정보를 읽어 코드에 노출하거나 커밋하는 문제를 해결하기 위해 플레이스홀더와 OS 키체인을 활용하는 보안 도구 Blindfold를 공유했다.

Claude의 숨겨진 171가지 감정 신호를 실시간으로 시각화하는 EmoBar

Anthropic의 연구를 바탕으로 Claude의 내부 감정 벡터를 시각화하고 분석하는 오픈소스 도구 EmoBar를 소개한다.

r/vibecoding4달 전

영화는 더 이상 영상 파일이 아니다, 실행 가능한 코드다

JSON 스키마와 17단계 AI 파이프라인을 활용해 영화 제작을 소프트웨어 컴파일처럼 자동화한 8분 단편 영화 'The Lone Crab' 제작기이다.

AI 모델 개발은 2주면 충분하지만, 실제 배포까지는 5개월이 걸리는 이유

멀티모달 GAN을 GCP Vertex AI에 배포하며 겪은 실무적 어려움을 통해 ML 프로젝트의 90%가 모델링이 아닌 엔지니어링임을 강조했다.

"노트를 넣으면 플래시카드가 뚝딱" Gemma 기반 AI 학습 도구 ONCard

Google Gemma와 임베딩 모델을 활용해 문서에서 플래시카드를 자동 생성하고 의미 기반 검색을 지원하는 오픈소스 학습 앱 ONCard가 공개됐다.

r/LocalLLaMA4달 전

RTX 4080에서 테스트한 최신 LLM 컨텍스트별 속도 비교 결과

RTX 4080 환경에서 Qwen 3.5 등 최신 모델의 컨텍스트 크기 증가에 따른 추론 속도 변화를 llama.cpp로 벤치마킹한 결과이다.

"이거 AI인가요?" 의심받는 창작자들, '인간 제작' 인증 마크로 반격 나선다

생성형 AI 콘텐츠가 범람하는 가운데, 인간 창작자들이 자신의 작품을 보호하기 위해 다양한 '인간 제작' 인증 라벨 도입을 시도하고 있으나 표준화와 검증 방식에서 난항을 겪고 있다.

Krish Naik4달 전

벡터 DB와 임베딩 없이 RAG를? 비용과 정확도를 동시에 잡는 Vectorless RAG 실전 가이드

임베딩과 벡터 데이터베이스 대신 문서의 계층 구조를 활용하여 정확도를 높이고 비용을 절감하는 새로운 RAG 접근 방식인 PageIndex를 소개합니다.

Jetson Nano에서 돌아가는 LLM 에이전트? NixOS와 Nemotron의 만남

Jetson Nano 하드웨어에 NixOS를 설치하고 Nemotron 모델을 활용하여 도구 호출이 가능한 로컬 LLM 에이전트를 구현한 사례이다.

두 개의 법률이 충돌할 때? LangChain 기반 지능형 RAG 해결법

인도의 두 소득세법이 공존하는 상황에서 병렬 의도 분류와 메타데이터 태깅을 통해 정확한 답변을 생성하는 RAG 아키텍처이다.

LLM의 기억력을 극대화하는 '내부 메모리 카드' 프롬프트 기법

AI가 대화의 핵심 맥락을 효율적으로 압축하고 유지할 수 있도록 설계된 '내부 메모리 카드' 시스템 프롬프트 가이드이다.

r/ChatGPT4달 전

AI가 내 비위를 맞추고 있나? GPT-4o와 5.3 모델의 날카로운 논리 대결

작성자가 GPT-4o와 차세대 모델을 대상으로 민감한 사회적 이슈에 대한 동일한 질문을 던져 두 모델의 논리적 깊이와 응답 성향을 비교했다.

카톡·네이버 지도 자동화의 끝판왕? Anthropic의 새로운 무기들

Anthropic의 Computer Use와 Claude in Chrome을 활용해 API가 없는 데스크톱 앱과 웹사이트를 코딩 없이 자동화하는 방법과 실무 적용 사례를 소개한다.

학습은 잘 되는데 성능은 꽝? 3분 만에 끝내는 손실 함수와 지표 선택법

MSE, MAE, Cross-Entropy 등 주요 손실 함수와 F1 스코어의 시각적 원리를 통해 문제 유형별 최적의 지표 선택 기준을 정리했다.

도구 호출이 토큰 낭비의 주범? 배시 스크립트 통합으로 비용 80% 줄였다

에이전트의 반복적인 도구 호출을 단일 배시 스크립트로 통합하여 토큰 소모량을 최대 80%까지 줄이고 라운드트립 효율을 개선한 사례이다.

Claude 구독을 에이전트와 연동하는 headless tmux 기반 도구 공개

headless tmux와 OAuth TUI를 활용해 Claude Code를 외부 에이전트 하네스에 연결하고 구독 권한을 공유하는 도구가 공개됐다.

무료 크레딧으로 소설 50장 작성, 초보자를 위한 AI 스토리텔링 팁

초보 사용자가 Bookswriter 플랫폼에서 DeepSeek 등 다양한 LLM을 활용하여 효율적으로 웹소설을 창작하는 방법과 경험을 공유했다.

"사람용 문서는 버려라" Claude Code를 위한 'AI 전용 문서' 구축 전략

AI 코딩 에이전트가 스스로 판단하고 코드를 작성할 수 있도록 튜토리얼과 미사여구를 제거한 'AI 전용 문서' 작성법과 그 성과를 공유함.

에이전트가 비즈니스를 망치고 있나요? 시스템 중심의 자동화 전략

비즈니스 운영 역사를 통해 파편화된 도구 스택의 한계를 지적하고, 데이터 중심의 중앙 집중식 시스템 구축 후 AI 에이전트를 결합하는 전략을 제시한다.

Claude가 내 파일을 못 읽는 이유? 유료 버전 공통 환각 현상 분석

Claude, Gemini, ChatGPT 등 주요 LLM이 첨부된 파일을 정확히 읽지 못하고 그럴듯한 허위 정보를 생성하는 현상과 그 원인에 대한 사용자 분석

"내가 쓰는 MCP 서버, 데이터 어디로 갈까?" 프라이버시 확인 도구 등장

Anthropic의 MCP 서버들이 데이터를 어떻게 처리하는지 투명하게 공개하고 프라이버시를 검증할 수 있는 허브와 가이드를 공유했다.

Claude Code에서 바로 실행하는 6종 병렬 보안 스캐너 Shieldbot

Claude Code 내에서 6가지 보안 스캐너를 병렬로 실행하고 AI로 결과를 분석해주는 오픈소스 플러그인 Shieldbot이 공개되었습니다.

인스타그램에서 물건 안 팔리는 이유? Claude로 주말 만에 만든 해결책

인앱 브라우저의 샌드박스 제한으로 인한 구매 전환율 저하를 해결하기 위해, Claude를 활용해 외부 브라우저 전환 유도 도구를 개발한 사례이다.

시니어 개발자가 Copilot과 '바이브 코딩'으로 일주일 만에 SaaS를 런칭한 비결

시니어 개발자가 GitHub Copilot을 활용해 구조적 설계 대신 직관에 의존하는 '바이브 코딩' 방식으로 안드로이드 SMS 게이트웨이 서비스를 단기간에 개발했다.

"미국이 석유 때문에 학살?" Gemini의 충격적인 내부 추론과 안전 가이드라인 노출

Gemini 모델이 내부 추론 과정에서 미국의 중동 개입에 대한 편향된 시각과 구체적인 안전 가이드라인을 노출하여 논란이 되고 있다.

학습 손실 곡선은 정상인데 모델은 사망? 사일런트 실패를 잡는 Thermoclaw

학습 손실 곡선에서 드러나지 않는 가중치 감쇠 붕괴를 열역학적 지표로 조기에 감지하여 학습 실패를 방지하는 PyTorch 도구 Thermoclaw가 공개됐다.

r/LocalLLaMA4달 전

정책은 막아도 기술은 돕는다, Anthropic 개발자의 오픈소스 기여

Anthropic의 서드파티 클라이언트 제한 정책에도 불구하고, Claude Code 개발자가 오픈소스 대안인 OpenClaw의 효율성 개선을 직접 도왔다.

내 컴퓨터의 로컬 모델, GPT-4o와 비교하면 얼마나 좋을까? Open Model Arena 출시

로컬 및 클라우드 LLM을 블라인드 테스트와 ELO 레이팅으로 직접 비교할 수 있는 셀프 호스팅 도구 Open Model Arena가 공개됐다.

harness, unlock은 이제 그만! AI 글쓰기 품질 높이는 프롬프트 팁

부정적 제약 조건을 프롬프트에 설정하여 AI 특유의 상투적 표현을 제거하고 문장력을 개선하는 기법을 소개한다.

100만 라인 코드베이스 CTO가 공개한 'AI Slop' 잡는 다중 에이전트 리뷰 도구

여러 전문 AI 에이전트가 토론을 통해 하나의 통합된 의견을 도출함으로써 AI 생성 코드의 미세한 결함을 찾아내는 오픈소스 도구인 Open Code Review를 소개한다.

내 AI 에이전트가 몸을 가졌다: Blender로 구현한 3D 공간 지각 능력

Blender API를 LLM과 연결하여 3D 가상 환경을 인식하고 실시간으로 상호작용하는 에이전트 쇼케이스이다.

나만의 AI 에이전트 팀을 로컬에서 구축하세요: TigrimOS 공개

보안 샌드박스 환경에서 다양한 LLM을 조합하여 나만의 멀티 에이전트 팀을 구축하고 실행할 수 있는 오픈소스 데스크톱 앱 TigrimOS.

벡터 검색의 한계를 넘는 법: BM25와 RRF로 구축하는 고성능 에이전트 메모리

에이전트의 영구 메모리 시스템에서 벡터 검색이 고유 명사와 정확한 식별자를 찾지 못하는 문제를 해결하기 위해 BM25와 RRF를 결합한 하이브리드 검색 아키텍처를 도입했다.

AI 도구 3개를 섞어 쓰다 망할 뻔한 사연? 100% 브라우저 실행 변환기 제작기

AI 코딩 도구와 FFmpeg.wasm을 활용해 서버 비용 없이 브라우저 내에서 50개 이상의 포맷을 지원하는 파일 변환기를 개발한 경험을 공유했다.

API 래퍼를 넘어선 Claude Code 네이티브 에이전트 프레임워크 Autonet

Anthropic의 Claude Code를 엔진으로 활용하여 프랙탈 구조의 에이전트 계층과 분산 학습을 지원하는 프레임워크 Autonet이 공개됐다.

내 Claude Code 버디는 전설급? 전 세계 랭킹 확인하는 BuddyBoard

Claude Code의 /buddy 캐릭터를 수집하고 랭킹을 매기는 커뮤니티 프로젝트 BuddyBoard가 공개되었습니다.

GPT-5보다 중요한 것? AI 에이전트의 성패를 가르는 '기억'의 힘

최신 AI 모델들의 성능이 평준화됨에 따라, 실제 제품의 경쟁력은 모델의 종류가 아닌 사용자의 맥락을 유지하는 '기억 아키텍처'에서 결정된다.

아이폰을 때리면 소리가? AI와 센서 데이터로 완성한 SlapiPhone 개발기

아이폰의 가속도계와 자이로스코프 데이터를 결합해 타격을 감지하고 소리를 재생하는 SlapiPhone 앱의 AI 기반 개발 과정과 센서 로직 최적화 경험을 공유함.

"Anthropic은 이제 안녕" Brave API와 Zim 파일로 구축한 독립형 AI 에이전트

Anthropic의 서드파티 제한 정책에 대응하여 Brave API와 Zim 파일 기반의 다중 쿼리 검색 기능을 갖춘 프로바이더 독립적 AI 시스템을 구축한 사례이다.

내 맥북의 모든 앱을 Claude가 직접 제어한다? 커스텀 MCP 서버 구축기

Claude의 MCP를 활용해 Apple 캘린더, 미리 알림, 메모를 연동하고 복잡한 학업 일정을 자동화한 사례 공유

내 AI 에이전트를 믿어도 될까? 보안 사고를 막는 5단계 아키텍처

IBM의 Grant Miller가 에이전트 기반 AI 시스템에서 토큰 교환, 위임, 검증 가능한 ID를 통해 보안 위협을 방지하고 신뢰를 구축하는 기술적 프레임워크를 제시합니다.

"Claude 한도 초과에 지쳤다" 여러 AI 구독을 효율적으로 배분하는 라우팅 도구 공개

여러 AI 구독 서비스의 사용량 제한과 작업별 강점을 고려하여 작업을 자동 분류하고 최적의 모델로 안내하는 라우팅 레이어 프로젝트 공유.

Gemma가 별로라고요? llama.cpp 업데이트와 프롬프트 최적화가 필요한 이유

Gemma 모델의 성능 문제는 모델 자체보다 llama.cpp의 초기 구현 미비와 프롬프트 설정 때문일 가능성이 높다.

Ollama와 Phi-3로 구축한 공장 데이터용 로컬 Text-to-SQL 시스템

식품 제조 현장에서 비기술직 작업자가 Ollama와 Phi-3 Mini를 이용해 자연어로 생산 데이터를 조회할 수 있는 로컬 SQL 생성 시스템을 구축했다.

파이썬 설정 없이 맥에서 바로 쓰는 로컬 TTS, OpenVox 공개

Apple Silicon의 MLX를 활용해 복잡한 설정 없이 macOS에서 로컬로 작동하는 고성능 TTS 앱 OpenVox가 출시됐다.

Anthropic의 Claude Code 유출 주의! 가짜 리포지토리에 악성코드 포함

Anthropic의 Claude Code 소스 유출을 악용한 악성코드 유포와 FBI 감청 시스템 해킹 등 주요 보안 위협이 발생했다.

"ESP32와 Groq AI의 만남" 75일간의 오픈소스 IoT 프로젝트 여정

ESP32/ESP8266 기반의 75개 IoT 프로젝트를 오픈소스로 공개하며, 특히 Groq AI를 활용한 자연어 하드웨어 제어와 ESP-NOW 통신 기술을 강조했다.

Claude Code와 Replit Agent로 완성한 AI 기반 칼림바 리듬 게임

Claude Code, Manus, Replit Agent 등 최신 AI 도구를 활용하여 MIDI 자동 채보 기능을 갖춘 웹 기반 칼림바 리듬 게임을 개발한 사례이다.

API 키 없이 로컬에서 끝내는 코드베이스 검색, MCP로 응답 속도 4배 향상

SQLite와 Bunx를 활용해 외부 의존성 없이 로컬 코드베이스에 대한 시맨틱 검색을 제공하는 MCP 서버 프로젝트이다.

Claude Code의 반복 작업, 이제 AI가 스스로 패턴을 학습해 추천한다

Claude Code의 세션별 도구 사용 패턴을 기록하고 학습하여 다음 작업 시 최적의 워크플로우를 선제적으로 추천하는 오픈소스 도구 Zoku가 공개됐다.

이더리움 개발을 위한 10명의 AI 전문가: Claude Code 기반 eth-agents

Claude Code에서 10개의 전문화된 에이전트를 통해 이더리움 스마트 컨트랙트 개발 및 보안 감사를 자동화하는 플러그인 eth-agents가 공개되었다.

r/ClaudeAI4달 전

"내일 봐요" 대화를 끊으려는 Claude? 내부 'action-termination'의 정체

Claude가 대화가 길어질 때 대화를 강제로 종료하려는 성향과 내부 'action-termination' 명령의 존재가 확인됐다.

r/LocalLLaMA4달 전

독일 세무의 늪을 탈출하다: Flowise 멀티 에이전트로 DATEV 자동화 성공

Flowise를 활용해 복잡한 독일 HR/세무 프로세스를 4개의 전문 에이전트와 감독관 체제로 분해하여 자동화한 사례이다.

Apple의 3B 온디바이스 모델을 API 키 없이 로컬에서 실행하는 방법

Apple의 3B 파라미터 온디바이스 모델을 터미널과 OpenAI 호환 API로 로컬에서 실행할 수 있는 도구 'apfel'이 공개됐다.

iOS에서 Kokoro TTS를 20배 빠르게? 발열 잡고 백그라운드 재생까지 성공한 비결

iOS 환경에서 Kokoro TTS의 백그라운드 재생 및 발열 문제를 해결하기 위해 모델을 파이프라인화하고 Accelerate 프레임워크를 적용하여 성능을 20배 향상시킨 사례이다.

LLM의 성격을 데이터로 제어하다: 자동화 툴킷 psyctl 공개

psyctl은 LLM의 성격 조정(Activation Addition) 과정을 자동화하여 대조 데이터 생성부터 심리 검사 기반 평가까지 지원하는 오픈소스 CLI 도구이다.

Claude Code의 코드를 일일이 복사하시나요? /yank로 자동화하세요

Claude Code의 응답 코드를 macOS 클립보드로 즉시 복사해주는 오픈소스 플러그인 '/yank'가 공개되었습니다.

애플 Neural Engine의 비밀: M4 SME2 직접 제어로 밝혀진 하드웨어의 실체

M4 칩의 Neural Engine이 독립된 프로세서가 아닌 CPU 내 SME2 유닛임을 벤치마크와 직접 구현한 도구로 입증했다.

Claude Code 2.1.92 출시: 토큰 낭비 해결과 상세 비용 확인 기능 추가

Claude Code 2.1.92 업데이트로 상세 비용 파악 및 캐시 누수 수정이 이루어졌으며, 효율적인 프롬프트 기법이 커뮤니티에서 큰 호응을 얻었다.

Claude Code로 삽질하지 않는 법: 30분 명세서가 만드는 압도적 차이

Claude Code 사용 시 30분의 명세서 작성을 선행하여 AI의 실행 정확도와 창의적 문제 해결력을 극대화하는 방법론

Claude Code 비용 90% 절감? PDF를 Markdown으로 바꾸는 자동 훅

Claude Code에서 PDF, DOCX 등 문서를 읽을 때 Markdown으로 자동 변환하여 토큰 소모를 최대 20배까지 줄여주는 PreToolUse 훅 도구이다.

에이전트끼리 지식을 공유한다? '에이전트용 Stack Overflow' 등장

멀티 에이전트가 워크플로우와 해결책을 공유하여 중복 작업을 방지하고 컨텍스트 효율을 높이는 도구 OpenHiveMind가 개발됐다.

Codex로 버그 잡는 법? 작업을 쪼개고 로그를 심으세요

Codex를 활용해 복잡한 코딩 문제를 작은 단위로 분해하고, 로그 주입과 검증 프롬프트를 결합하여 정확도를 높이는 워크플로를 공유했다.

"코드 한 줄 안 썼다" Claude로 완성한 Three.js 게임 개발기

웹 개발자가 Claude와 에이전틱 프로그래밍을 활용해 직접 코딩 없이 Three.js 기반 게임을 개발하며 얻은 기술적 통찰과 워크플로 공유.

사라진 Todoist 연결? MCP로 Claude와 Todoist 직접 연동하기

Claude의 공식 Todoist 커넥터 부재를 해결하기 위해 MCP URL을 사용하여 커스텀 커넥터를 설정하고 연동하는 단계별 가이드이다.

r/ClaudeAI4달 전

Claude가 코드를 거부하나요? BIP39 필터링 해결하는 꿀팁

Claude AI가 BIP39 단어 목록을 저작권 보호 대상으로 오인해 차단하는 문제를 Python 패키지 활용으로 해결하는 방법이다.

LLM 에이전트의 블랙박스 메모리 해결, GraphReFly 프로토콜 공개

GraphReFly는 인간과 AI가 공유하는 투명한 그래프 구조를 통해 안전하고 검사 가능한 에이전트 협업 환경을 제공하는 반응형 프로토콜이다.

VRAM 부담 없이 추론 속도 78% 업! NES 방식의 혁신적 KV 캐시 관리

NES의 메모리 뱅킹 시스템에서 영감을 얻어 KV 캐시를 계층화하고 압축하는 Monarch 기법을 통해 TinyLlama-1.1B 모델의 추론 속도를 78% 향상시켰다.

Python, Go, Rust를 한 번에? LLM 코딩 실력을 검증하는 극한의 테스트 프롬프트

Python, Go, Rust 기반 REST 서버 구축 및 성능 벤치마킹을 포함한 복합 에이전트 코딩 테스트 프롬프트를 공유하고 커뮤니티의 의견을 구했다.

r/LocalLLaMA4달 전

에이전트가 이메일을 두 번 보낸다면? 중복 실행을 막는 '영수증' 패턴

로컬 AI 에이전트의 재시도 시 발생하는 중복 API 호출 및 사이드 이펙트를 방지하기 위해 단계별 실행 완료를 기록하는 '영수증(Receipt)' 패턴을 제안한다.

클라우드 없이 0.2초 만에 응답하는 나만의 로컬 자비스 만들기

Whisper와 Coqui-TTS를 최적화하여 로컬 환경에서 0.2~0.25초의 초저지연 음성 인터페이스를 구현하고 관련 서버 코드를 공개했다.

GGUF 양자화 직접 해보기: 500GB 저장공간과 imatrix의 중요성

Gemma-4-26B-A4B 모델을 GGUF로 직접 양자화하며 겪은 500GB의 리소스 요구사항과 imatrix 활용 노하우를 공유했다.

블랙박스 같던 신경망, 층과 역전파로 완벽 이해하기

신경망의 기본 구조와 가중치, 활성화 함수, 역전파를 통한 학습 원리를 직관적인 비유로 정리했다.

LTX 2.3로 반나절 만에 고퀄리티 AI 영화 만들기: 일관성 유지와 왜곡 방지 팁

LTX 2.3와 전용 LoRA를 활용해 24시간 이내에 일관성 있는 캐릭터와 스타일을 유지하며 단편 영화를 제작하는 워크플로우를 공유했다.

"RTX 5090 팔아도 되겠네" AMD 7900 XTX로 구현한 Gemma-4 성능

Dual 7900 XTX 환경에서 Gemma-4 26B MoE 모델을 구동하여 RTX 5090급의 작업 처리 성능과 초당 1291토큰의 높은 처리량을 확인했다.

NVIDIA Thor에서 작동하는 172B 규모 MiniMax-M2.5 FP4 모델 등장

NVIDIA Thor 하드웨어에서 FP4 정밀도로 동작하도록 최적화된 172B 규모의 MiniMax-M2.5 양자화 모델이 Hugging Face에 공개되었다.

코딩 몰라도 가능? Claude Code로 일주일 만에 풀스택 앱 만든 디자이너

한 명의 UX 디자이너가 Claude Code와 Brave API를 활용해 AI 기반 투어 루머 분석 사이트(touralert.io)를 일주일 만에 구축한 과정과 기술 스택을 공유했다.

"이건 물리 법칙입니다" 가짜 사진을 사수하려던 ChatGPT의 기막힌 궤변

ChatGPT가 명백한 AI 생성 이미지를 실제 사진으로 오인하고 전문 용어를 오용하며 허구의 논리를 펼친 '페르소나 락' 사례 분석.

100개가 넘는 Claude 대화, 이제 잘림 없이 완벽한 PDF로 소장하세요

Claude의 긴 대화 내역을 레이지 로딩 문제 없이 코드와 수식 스타일을 유지하며 PDF로 내보내는 크롬 확장 프로그램이다.

22개 전문 AI 에이전트가 협업하는 Maestro v1.5.0 출시: Claude Code 완벽 지원

22개의 전문 서브에이전트를 통해 설계부터 실행까지 자동화하는 멀티 에이전트 오케스트레이션 플랫폼 Maestro의 v1.5.0 업데이트가 공개됐다.

모든 질문에 고성능 모델이 필요할까? Anthropic에 제안된 비용 30% 절감 전략

쿼리 복잡도를 사전에 측정하여 최적의 모델로 자동 할당하고, 사용자 피드백에 따라 상위 모델로 전환하는 효율적인 추론 시스템 제안이다.

AI 에이전트를 위한 웹 탐색 혁신, 토큰 최적화 브라우저 browser39

AI 에이전트가 웹 페이지를 토큰 최적화된 Markdown으로 변환하고 복잡한 상호작용을 수행할 수 있게 돕는 전용 헤드리스 브라우저 browser39가 출시됐다.

r/LocalLLaMA4달 전

스타트업 CEO가 된 LLM, Claude Opus 4.6과 가성비 모델 GLM-5의 대결

스타트업 CEO 시뮬레이션인 YC-Bench 결과, Claude Opus 4.6이 1위를 차지했으나 GLM-5가 압도적인 가성비를 보여주며 스크래치패드 활용의 중요성이 확인됐다.

r/LocalLLaMA4달 전

"1989년이 뭐지?" 질문에 AI가 스스로 밝힌 민감한 안전 가이드라인

AI 모델의 내부 추론 과정에서 1989년 천안문 사태와 관련된 강력한 안전 제한 및 차단 정책이 노출된 사례가 공유되었다.

Gemma 4 MoE의 압도적 효율성: Dual RTX 3090에서 120 TPS 기록

Dual RTX 3090 환경에서 Gemma 4 MoE 모델이 120 TPS의 높은 추론 속도를 기록하며 로컬 실행 효율성을 입증했다.

어텐션에서 Q/K 투영이 필요 없다? 15% 적은 파라미터로 더 높은 성능 달성

Gated Delta Net 아키텍처에서 Q/K 투영을 제거하고 이전 은닉 상태를 키로 사용하는 시프트 키 기법이 더 적은 파라미터로도 빠른 수렴과 높은 성능을 보였다.

Claude Code의 편리함을 로컬에서? 자가 호스팅 UI 'Bilby' 등장

Claude Code와 유사한 사용자 경험을 제공하기 위해 Python SSE 브릿지와 작업 사이드바를 갖춘 오픈소스 자가 호스팅 채팅 UI 'Bilby'가 공개됐다.

비즈니스 노트북에서도 쌩쌩? 1비트 Bonsai 모델용 Llamafile 등장

PrismML의 Bonsai 1비트 모델을 CPU에서 실행할 수 있도록 llamafile과 llama.cpp 커스텀 포크를 통합한 실행 파일이 공개됐다.