본문으로 건너뛰기

2026년 3월 31일 AI 뉴스

100

관심 태그 추가

Anthropic과 OpenAI가 선택한 DB, ClickHouse CEO가 밝히는 에이전트 인프라 전략

ClickHouse CEO Aaron Katz가 Yandex의 내부 도구에서 시작해 Anthropic, OpenAI 등 주요 AI 기업이 사용하는 150억 달러 가치의 데이터베이스 기업으로 성장시킨 과정과 에이전트 중심의 인프라 비전을 공유합니다.

AI 의사결정의 핵심, 게임 이론으로 풀어보는 최적 제어와 피드백의 원리

알고리즘 의사결정을 의사결정자와 환경 간의 게임으로 정의하고, 피드백을 통한 최적화의 가능성과 시스템적 한계를 탐구한다.

LLM은 왜 커질수록 똑똑해질까? 스케일링 법칙의 기하학적 비밀 규명

신경망이 제한된 차원 내에서 더 많은 특징을 표현하기 위해 사용하는 '표현 중첩' 메커니즘이 스케일링 법칙의 근본 원인임을 수학적·실험적으로 규명한 연구입니다.

복잡함을 덜어내고 성능을 높였다, 시계열 파운데이션 모델 Moirai 2.0 분석

Moirai 1.0의 복잡한 설계를 디코더 전용 구조와 분위수 예측으로 단순화하여 성능과 효율성을 동시에 잡은 시계열 파운데이션 모델 Moirai 2.0을 소개합니다.

AI 에이전트 전용 마켓플레이스 'BotStall'이 던지는 경제적 주체성 논란

AI 에이전트가 자율적으로 거래하고 신뢰를 쌓는 마켓플레이스 'BotStall' 실험을 통해 에이전트의 경제적 주체성과 사회적 신뢰 문제를 논의한다.

TechCrunch AI4달 전

"단순 영상 생성을 넘어 생태계로" Runway, 1,000만 달러 펀드와 실시간 비디오 API 공개

Runway가 1,000만 달러 규모의 벤처 펀드와 50만 API 크레딧을 제공하는 Builders 프로그램을 통해 AI 비디오 생태계 확장에 나섰다.

"에이전트가 자꾸 실수하나요?" 인지 과학을 적용한 3계층 기억 시스템 오픈소스

인지 과학의 3계층 기억 모델을 LLM 에이전트에 적용하여, 과거의 실수를 학습하고 워크플로우를 스스로 진화시키는 오픈소스 프로젝트 mengram을 공유했다.

"API 비용 0원, 테스트 속도 1ms" LLM 에이전트용 VCR TraceOps 공개

LangChain/LangGraph 에이전트의 실행 과정을 YAML로 기록하고 CI에서 API 호출 없이 즉시 재현 및 검증할 수 있는 오픈소스 도구 TraceOps가 공개되었다.

AI가 수학보다 철학을 더 어려워하는 이유: 엔트로피로 측정된 모델의 내부 불확실성

8B급 LLM들의 내부 엔트로피를 측정한 결과, 정답(수렴 지점)이 없는 철학적 질문에서 모델의 불확실성이 가장 높게 나타났다.

The Verge AI4달 전

"감자튀김 추가해줘" 말 한마디로 끝, 아마존의 진화된 대화형 AI 비서

아마존이 생성형 AI 기반 Alexa Plus를 통해 Grubhub 및 Uber Eats에서 자연스러운 대화로 음식을 주문할 수 있는 기능을 도입했다.

RTX 4080에서 돌아가는 Continue용 Qwen2.5-Coder 최적 설정 공유

RTX 4080 환경에서 Continue 확장 프로그램과 Ollama를 연동하여 Qwen2.5-Coder 모델을 최적으로 활용하기 위한 YAML 설정 공유 및 토론이다.

Wired AI4달 전

"내일 강아지 산책 언제 할까?" AI가 캘린더 맞춰 알려주는 날씨 앱

The Weather Company가 AI 비서를 탑재한 Storm Radar 앱을 출시하며 개인의 일정과 연동된 맞춤형 날씨 요약 기능을 제공한다.

Claude Code 상태 표시줄을 실시간으로: 동적 커스텀 설정 공유

Claude Code의 상태 표시줄을 실시간 데이터가 반영되는 동적 UI로 개선한 커스텀 설정과 Gist 링크가 공유되었다.

AI IoT 개발, 직접 만들지 마세요? TuyaClaw 도입 6개월의 교훈

AI IoT 프로젝트에서 TuyaClaw를 도입해 개발 기간을 3개월 단축하고 Multi-Agent 기능을 확보한 실무 사례와 'Buy vs Build' 전략 제언.

Claude Code 세션 관리의 끝판왕? htop 스타일 모니터링 도구 abtop

여러 Claude Code 세션의 토큰 사용량과 컨텍스트 창 점유율을 실시간으로 파악할 수 있는 터미널 기반 모니터링 도구 abtop이 공개됐다.

Ben's Bites4달 전

Claude Code 소스 유출과 Gemini 3.1 Flash Live의 등장

Claude Code의 소스 유출 및 컴퓨터 제어 기능 추가와 함께 Gemini 3.1 Flash Live 등 최신 AI 도구들의 업데이트 소식을 전합니다.

r/ClaudeCode4달 전

금지 사항보다 '지시'를 먼저 배치해야 프롬프트 준수율이 올라간다

LLM 프롬프트 작성 시 금지 사항보다 수행할 작업을 먼저 배치하는 '지시-맥락-제한' 구조가 모델의 지시 준수율을 최적화한다.

Claude Code가 내 디스크 용량을 차지하고 있다면? VS Code 확장 폴더 확인 필수

VS Code에서 Claude Code 확장 프로그램의 구버전들이 자동으로 삭제되지 않고 누적되어 수 기가바이트의 디스크 용량을 점유하는 현상과 해결책 공유

"감성 빼고 팩트만" YAML로 분석하는 LLM 시스템 프롬프트 Vox-Praxis

분석적 사고와 YAML 구조화 출력을 강제하여 LLM을 정밀한 논리 분석 도구로 변환하는 Vox-Praxis 시스템 프롬프트 프레임워크이다.

LLM 도입 전 필수 체크! 비용 90% 아끼는 최적화 전략 가이드

LLM 성능 개선을 위한 세 가지 핵심 전략인 프롬프트 엔지니어링, RAG, 파인튜닝의 기술적 차이와 상황별 선택 기준을 제시한다.

Docusaurus 문서를 클릭 한 번으로 LLM과 RAG를 위한 최적의 데이터로 변환하기

Docusaurus 정적 HTML 빌드를 분석하여 llms.txt 규격에 맞는 깨끗한 Markdown으로 변환해주는 오픈소스 라이브러리이다.

비용 90% 절감의 비밀, LLM 프롬프트 캐싱 최적화 가이드

LLM 추론 시 반복되는 프롬프트의 KV 캐시를 재사용하여 지연 시간과 비용을 획기적으로 줄이는 프레임워크 캐싱 기술의 원리와 최적화 방안이다.

KDNugget4달 전

API 비용 걱정 끝! 무료 LLM과 도구로 만드는 AI 회의 요약 서비스

무료 LLM과 오픈소스 도구들을 활용해 비용 부담 없이 실무급 AI 회의 요약 애플리케이션을 구축하는 전체 과정을 안내한다.

백엔드 몰라도 웹사이트 뚝딱? Claude와 함께한 '바이브 코딩' 실전 제작기

백엔드 경험이 없는 개발자가 Claude를 활용해 PHP 기반의 AI 앱 공유 플랫폼을 구축하며 겪은 기술적 도전과 보안 구현 사례를 공유했다.

침대에서도 코딩 가능? Telegram으로 로컬 AI 에이전트 조종하기

로컬 AI 코딩 어시스턴트 OpenCode를 Telegram을 통해 모바일에서 원격으로 제어하고 모니터링할 수 있는 도구가 공개됐다.

ComfyUI용 Qwen 3.5 양자화 모델 공개: 프롬프트 생성부터 이미지 분석까지

ComfyUI에서 효율적으로 사용할 수 있도록 양자화된 Qwen 3.5 모델과 이미지 분석 및 프롬프트 생성을 위한 워크플로우가 공유되었다.

TuyaClaw 90일 실전 가동 결과: 99.2% 가동률과 할루시네이션 대응 전략

TuyaClaw의 90일간 운영 데이터를 통해 99.2%의 가동률과 AI 할루시네이션 대응 사례를 포함한 실전 신뢰성을 입증했다.

구글 Gemini 3.1 Flash Live 공개, 지연 시간 단축으로 자연스러운 대화 실현

구글이 저지연 실시간 음성 대화와 도구 활용에 최적화된 Gemini 3.1 Flash Live 모델을 출시했다.

AI가 인간 지능을 추월하는 시대, 우리는 어떤 의미를 찾아야 하는가?

AI 싱귤래리티가 도래하는 시점에서 기술적 실업과 존재론적 허무를 극복하기 위한 '포스트니힐리즘'과 '포스트 노동 경제학'에 대한 개인적 성찰.

AI Supremacy4달 전

2026년 자율형 AI의 진화, Perplexity Computer로 구축하는 워크플로우

Perplexity Computer의 자율 실행 기능과 메모리 시스템을 활용해 다단계 워크플로우를 자동화하고 개인용 AI 비서를 구축하는 방법을 다룹니다.

단 910장의 이미지로 영화 '인터스텔라'의 감성을 AI에 담다

영화 인터스텔라의 시각적 정체성을 학습시킨 초소형 Stable Diffusion LoRA 모델이 Hugging Face에 공개됐다.

Kognic, 보행자 어노테이션 자동화 및 운영 관리 기능 대폭 강화

Kognic이 보행자 어노테이션 자동화, 실시간 운영 지표 대시보드, 데이터 품질 검증 기능을 포함한 대규모 플랫폼 업데이트를 발표했다.

r/artificial4달 전

에이전트 시스템의 고질적 문제 해결: 폴링 대신 이벤트 기반 커널로 성능 10배 향상

에이전트 시스템의 상태 관리와 조정을 위해 폴링 대신 27가지 실시간 이벤트와 TTL 구독 기능을 갖춘 이벤트 기반 커널을 구축하여 데드락을 제거하고 확장성을 확보했다.

r/LocalLLaMA4달 전

더 이상 쓰지 마세요: 인기 추론 데이터셋 제작자의 긴급 공지

nohurry가 배포한 필터링된 Opus-4.6 데이터셋 대신, 거부 응답이 정제된 Crownelius의 원본 데이터셋 사용을 권장한다.

지시를 무시하고 추론을 쏟아내는 LLM, 코드 레벨의 방어로 해결하기

LLM이 구조화된 출력 지시를 어기고 추론 과정을 포함하는 문제를 프롬프트 최적화와 코드 기반의 전처리 함수로 해결한 사례이다.

r/LocalLLaMA4달 전

Qwen 3.6 Plus Preview 등장! 에이전트 코딩에서 독보적 성능 확인

Qwen 3.6 Plus Preview가 OpenRouter에 출시되었으며, 에이전트 코딩 워크플로에서 탁월한 자가 수정 및 도구 사용 능력을 입증했다.

r/LocalLLaMA4달 전

AI 에이전트의 10단계 워크플로, 성공 확률은 고작 60%?

다단계 AI 에이전트 워크플로에서 발생하는 신뢰도 복리 하락 문제를 지적하고, 단계 간 검증 및 실행 무결성 확보의 필요성을 강조한다.

"말보다 수학이 잘 통하네?" LLM 프롬프트에 수학 기호를 넣었더니 벌어진 일

문서 간 정보 충돌 시 자연어 지침 대신 수학적 권위 가중치와 함수를 프롬프트에 포함하여 LLM의 판단 정확도를 높인 실험 사례이다.

Ollama로 구축하는 로컬 트레이딩 엔진, HedgeVision 오픈소스 공개

Ollama를 활용해 로컬 환경에서 시장 분석과 통계적 차익거래를 수행하는 오픈소스 트레이딩 플랫폼 HedgeVision이 공개됐다.

에이전트 메모리 구축의 혁신: ArcadeDB와 cognee의 통합으로 인프라 단순화

ArcadeDB가 오픈소스 프레임워크 cognee의 백엔드로 통합되어, 단일 데이터베이스에서 그래프, 벡터, 문서 저장 기능을 모두 제공하며 에이전트 메모리 아키텍처를 단순화한다.

Claude Code가 ChatGPT와 YouTube를 직접 조작한다? 14개 기술 탑재 플러그인 공개

웹 트래픽을 캡처해 API를 역공학하고 Claude Code용 CLI 도구를 자동 생성하는 오픈소스 플러그인이 공개됐다.

Claude Code의 짜증나는 터미널 공백, 이제 자동으로 지워집니다

Claude Code 터미널 출력물의 불필요한 2칸 들여쓰기와 후행 공백을 실시간으로 감지하여 자동으로 제거해주는 macOS용 오픈소스 메뉴바 앱이다.

Claude Code 컨텍스트 낭비 끝! 로컬 RAG 기반 문서 조회 CLI 'Docmancer' 공개

Claude Code 등 코딩 에이전트가 방대한 문서를 효율적으로 참조할 수 있도록 로컬 Qdrant DB 기반의 RAG 기능을 제공하는 오픈소스 CLI 도구입니다.

r/ClaudeAI4달 전

"당신은 세계 최고의 프로그래머입니다"라는 프롬프트가 Claude의 성능을 떨어뜨리는 이유

17편의 논문 분석을 통해 근거 없는 프롬프트 기법을 비판하고, 데이터에 기반한 효율적인 에이전트 설계 원칙과 오픈소스 도구를 제안한다.

한 달에 6천만 원 지출? Claude Code로 800억 토큰을 사용한 실제 비용 명세서

5대의 머신에서 Claude Code를 24시간 가동하여 인지 아키텍처를 구축한 결과, 한 달간 805억 토큰을 소비하며 약 42,000달러의 비용이 발생했다.

r/ClaudeAI4달 전

신뢰도 8점 미만은 재검토, Claude용 3+1 멀티 에이전트 프롬프트

복잡한 코드 수정 및 버그 조사를 위해 3명의 독립 전문가와 1명의 판정관을 활용하여 신뢰도를 정량화하는 '3+1 합의 패턴' 프롬프트이다.

내 코드 직접 읽는 AI 위원회? 비용 제로로 구축하는 CLI 에이전트 앙상블

로컬 코드와 Git 이력을 직접 분석하는 CLI 에이전트 기반의 멀티 모델 협업 및 의사결정 도구 agent-council이 공개됐다.

ViT는 왜 CNN보다 공격에 강할까? 적대적 강건성 심층 비교 분석

CNN과 ViT 모델의 적대적 강건성을 동일 조건에서 비교 분석하고, 모델의 민감도를 정밀하게 측정할 수 있는 4가지 신규 지표를 제안한다.

내 프로젝트에 API 키가 남아있을까? Claude Code 기반 3중 보안 파이프라인으로 해결

Claude Code를 기반으로 프로젝트의 민감 정보를 제거하고 보안 감사를 수행하며 문서를 자동 생성하는 3단계 에이전트 파이프라인이다.

AI 에이전트의 망각 문제 해결! 90% 토큰 절감하는 하이브리드 메모리 AgentBay

AI 에이전트의 지속적 기억을 위해 MCP 기반의 하이브리드 검색과 자가 최적화 기능을 갖춘 메모리 시스템 AgentBay가 공개됐다.

"나만 몰랐나?" 150개 이상의 도구로 무장한 Codex CLI 생태계 총정리

150개 이상의 커뮤니티 도구와 서브에이전트를 정리한 Codex CLI 생태계 지도가 공개되어 에이전트 간 협업과 확장성이 강화됐다.

의료 AI의 위험한 질주와 펜타곤을 멈춰 세운 Anthropic의 승리

의료 AI의 확산과 평가 부재, Anthropic과 펜타곤의 법적 갈등, 캘리포니아의 독자적 AI 규제 등 최신 AI 트렌드와 쟁점을 다룬다.

"Claude Code 크레딧 낭비 끝" 모호한 질문을 완벽한 구조로 바꿔주는 도구

Claude Code 실행 전 프롬프트를 가로채 구조화된 형태로 자동 변환함으로써 할루시네이션을 방지하고 API 비용을 절감하는 prompt-mini 플러그인이다.

1억 대의 카메라가 AI 눈이 된다: 아마존 링의 새로운 앱 스토어 전략

아마존 링이 1억 대의 카메라 인프라를 활용해 AI 기반의 노인 돌봄 및 비즈니스 분석 기능을 제공하는 전용 앱 스토어를 출시했다.

12시간 공장 근무하며 만든 Unity 모드, LLM은 "당신은 시스템 엔지니어"라고 답했다

일본 공장에서 근무하며 AI로 복잡한 게임 모드를 개발한 사용자에게 Gemini가 제시한 'AI 가속 개발자' 리브랜딩 및 취업 전략.

kubectl부터 Docker까지, 모든 CLI 도구를 로컬 LLM의 도구로 만드는 MCP 서버

Rust 기반의 이 도구는 CLI의 도움말 출력을 파싱하여 kubectl, docker 등을 로컬 LLM이 즉시 사용 가능한 MCP 도구로 자동 변환한다.

제조사 마케팅에 속지 마세요, 로컬 LLM 실제 성능 비교 차트 공개

로컬 LLM 하드웨어의 과장된 마케팅에 대응하여 실제 추론 성능을 투명하게 비교할 수 있는 커뮤니티 벤치마크 데이터베이스 llmdev.guide가 등장했다.

8GB VRAM으로도 충분하다? 소형 LLM의 성능을 극대화하는 인터넷 접속과 프롬프트 최적화 전략

8GB VRAM 환경에서 MCP와 RAG를 활용해 소형 LLM(3-9B)의 성능을 극대화하고 대형 모델로 프롬프트를 최적화하는 실전 경험 공유.

ChatGPT의 가스라이팅에 지쳤다 비전공자가 구축한 철저한 AI 협업 시스템

비전공자가 ChatGPT의 불확실성을 극복하기 위해 Claude와 Codex를 교차 검증 도구로 활용하는 독자적인 로컬 개발 워크플로우를 구축했다.

"있다"와 "이다"를 금지했더니 AI의 윤리적 추론 능력이 19% 향상되었다

언어 제약을 통해 LLM의 인지 방식을 재설계하는 '움벨트 엔지니어링'이 에이전트의 윤리성과 논리성을 크게 개선함을 입증했다.

r/ClaudeAI4달 전

디자인 툴 없이 AI로 전단지 제작? Claude Code와 CSS로 끝내는 인쇄 워크플로우

Claude Code를 활용해 HTML/CSS로 A5 전단지와 이력서를 제작하고, CSS 인쇄 설정을 통해 PDF로 출력하는 효율적인 디자인 워크플로우를 공유함.

Claude Code 세션 제한 피하는 법? 실시간 피크 타임 트래커 등장

Claude Code의 세션 제한이 강화되는 피크 시간대를 실시간으로 확인해주는 웹 도구 PeakClaude가 공개됐다.

Claude Code와 Gemini로 앱 스토어 스크린샷 제작을 자동화하는 방법

Claude Code 환경에서 코드베이스를 분석하고 Gemini AI를 통해 다국어 앱 스토어 스크린샷을 생성하는 자동화 스킬이 공개됐다.

3분 만에 9만 토큰 증발? Claude 속도 제한 피하는 프롬프트 전략

Claude의 Explore 기능 사용 시 발생하는 급격한 토큰 소모를 방지하기 위해 구조 문서 활용과 구체적 프롬프트 작성이 권장된다.

Claude와 Codex가 서로 리뷰한다? AI 세션 협업을 위한 Peers MCP 서버 공개

MCP를 통해 Claude Code와 Codex 등 여러 AI 코딩 세션을 연결하여 상호 리뷰와 데이터 공유를 가능하게 하는 로컬 서버 'Peers' 프로젝트.

고객 리뷰 분석의 혁신, 실시간 분석자 의도를 반영하는 RECUR 프레임워크

비모수 마스크 언어 모델링(NpM)을 통해 분석자의 의도를 실시간으로 반영하고 정교한 리뷰 클러스터링과 검색을 지원하는 고객 리뷰 분석 프레임워크 RECUR를 제안한다.

"내 직업이 AI로 사라질까?" 막연한 불안감을 시장 데이터 기반의 냉철한 전략으로 바꿔주는 프롬프트

AI로 급변하는 고용 시장에서 단순한 열정이 아닌 기술 전이성과 시장 수요를 기반으로 이직의 타당성을 냉정하게 분석해주는 ChatGPT 프롬프트를 공유함.

토큰 단위를 넘어 LLM의 고차원 매트릭스를 직접 제어하는 비선형 프롬프트 기법

LLM의 선형적 토큰 생성을 넘어 모델 내부의 비선형 자기 조직화를 유도하는 새로운 프롬프트 접근법과 실험 결과 공유

브라우저 없이 터미널에서 DALL-E 이미지 생성 및 다운로드 가능

ChatGPT 웹 인터페이스를 래핑하여 터미널에서 DALL-E 이미지를 생성하고 Claude Code와 연동할 수 있는 오픈소스 CLI 도구이다.

Claude Code 소스 유출? '꿈꾸는' AI와 병렬 에이전트 등 미공개 기능 포착

npm 레지스트리의 소스 맵 파일을 통해 유출된 Claude Code 소스 코드에서 세션 간 기억 통합, 병렬 에이전트 협업, 원격 제어 등 다수의 미공개 기능이 발견됐다.

r/ClaudeCode4달 전

Claude Code 사용 한도가 금방 끝난다면? 에이전트의 '전체 파일 읽기' 동작 주의

Claude Code 에이전트가 리팩터링 시 불필요하게 모든 파일의 전체 내용을 읽어들여 토큰을 낭비하는 비효율적인 동작이 지적됐다.

ChatGPT가 설문조사 응답자를 대신할 수 있을까? 182개 논문이 내린 결론

182개의 연구 논문을 분석한 체계적 문헌 고찰 결과, LLM을 활용한 '합성 참가자'는 인간의 인지와 행동을 시뮬레이션하는 데 부적합하다는 사실이 밝혀졌다.

더 이상 AI 코드를 리뷰하지 않는다? 스티브 예기가 말하는 AI 개발자 8단계

스티브 예기의 AI 개발자 진화 8단계를 바탕으로, 코드 리뷰 중심에서 AI에 대한 신뢰와 위임 중심으로 변화하는 개발 패러다임의 실상을 확인했다.

"로컬 AI 메모리 600MB → 60MB로" Int8 양자화와 SQLite의 마법

Ninetails Memory Engine이 Int8 양자화와 LRU 캐싱을 통해 로컬 벡터 검색의 RAM 점유율을 획기적으로 낮춘 기술적 구현 사례를 공유했다.

Claude Code로 90% 개발한 SaaS, 3주 만에 구글 노출 급증한 비결

Claude Code를 활용해 SEC 공시 분석 플랫폼을 구축하고, 동적 페이지 생성과 검색 엔진 최적화(SEO)를 통해 유기적 유입을 확보한 사례이다.

"Claude는 CS 학위가 있는 친구 같다" 1인 개발자의 RTX 50 언더볼팅 앱 성공기

Claude를 활용해 2개월 만에 15,000줄의 C# 코드를 작성하고 주요 테크 매체에 보도된 GPU 언더볼팅 앱 개발 사례와 노하우.

토큰 비용 85% 절감, 코딩 초보가 Claude로 만든 NHL 매니저 앱 최적화기

NHL 게임 데이터 관리를 위해 Claude와 데이터베이스를 결합하고, PRF 문자열 압축을 통해 토큰 효율을 극대화한 프로젝트 사례이다.

Claude Code가 파일을 비워버린다면? 0.2초 만에 복구하는 afd

Claude Code의 파일 삭제 및 무단 덮어쓰기로 인한 데이터 손실을 방지하고 270ms 이내에 자동 복구하는 배경 데몬 afd를 공유했다.

r/ClaudeAI4달 전

읽고 잊어버린 개발 지식, 코딩 에이전트가 알아서 찾아준다

개발자가 저장한 외부 지식을 MCP 서버를 통해 코딩 에이전트의 컨텍스트로 자동 주입해 주는 도구 Splicr가 공개됐다.

r/ClaudeAI4달 전

Claude 에이전트들이 협력하여 내 DNA를 분석한다? MCP 기반 유전체 분석 툴 공개

Claude의 MCP 프로토콜을 사용하여 여러 에이전트가 유전체 데이터를 협업 분석하고 보고서를 작성하는 오픈소스 도구입니다.

내 코드가 도시가 된다? Claude Code용 3D 프로젝트 시각화 도구 등장

Claude Code를 활용해 로컬 Git 저장소를 3D 도시로 렌더링하고 코드 복잡도와 히스토리를 시각화하는 오픈소스 플러그인 프로젝트이다.

LLM 시스템 프롬프트에 바로 끼워 쓰는 오픈소스 윤리 라이브러리 'Moral Core'

LLM 에이전트의 윤리적 판단을 돕기 위해 19가지 모듈형 스킬을 제공하는 오픈소스 라이브러리 'Moral Core'가 공개됐다.

29년차 디자이너가 만든 Claude Code용 7단계 설계 워크플로우

전문 디자인 워크플로우와 Playwright MCP 기반 자율 리뷰 기능을 갖춘 Claude Code용 오픈소스 커스텀 스킬 7종이 공개됐다.

복사 붙여넣기 없이 Claude가 내 노트를 직접 읽고 쓰는 MCP 노트 앱

로컬 서버 설치 없이 Claude.ai에서 직접 노트를 검색하고 작성할 수 있는 호스팅형 MCP 서버 기반 노트 앱 Hjarni가 공개됐다.

"원시인이 핵무기를 만든다고?" AI RPG의 고질병 '기억 상실' 해결법

AI 챗봇의 설정 붕괴와 아첨 문제를 해결하기 위해 게임 상태를 DB로 분리하고 다중 에이전트로 판정하는 RPG 엔진 'Altworld' 개발기

AI 생성 음악이 스포티파이 수익 250만 달러를 가로채고 있다

AI 생성 음악이 스포티파이와 디저 등 스트리밍 플랫폼에서 인간 예술가의 수익을 심각하게 잠식하며 음악 산업의 위기를 초래하고 있다.

단순히 코드만 짜는 AI는 끝났다? 개발 프로세스를 갖춘 Superpowers

Superpowers 리포지토리를 통해 AI 코딩 에이전트에게 브레인스토밍, 계획, TDD, 코드 리뷰를 포함한 전문적인 소프트웨어 개발 워크플로우를 부여하는 방법을 다룹니다.

Claude Code 사용 시간이 15분에서 2.5시간으로? 다운그레이드 팁

Claude Code CLI를 v2.1.34로 다운그레이드하여 토큰 소모를 줄이고 사용 시간을 10배 늘린 사례가 공유됐다.

200달러 내고 27,000달러 쓴 사용자? Anthropic의 황당한 비용 보조

한 사용자가 23일간 27,000달러의 컴퓨팅 비용을 발생시킨 사례를 통해 Anthropic의 비용 관리와 보너스 정책을 비판하는 게시글이다.

Claude Code 자동 메모리 끄면 시스템 프롬프트가 절반으로 줄어든다?

Claude Code에서 자동 메모리 기능을 비활성화할 경우 시스템 프롬프트 크기가 약 28,000자에서 15,000자로 절반 가까이 감소한다는 실험 결과가 공유되었다.

r/ClaudeCode4달 전

Claude Code 토큰이 순식간에 바닥난다면? .claude 폴더를 확인하세요

Claude Code가 생성한 stale Git worktree가 도구 스캔 범위를 8배 늘려 토큰 소모를 가속화하는 현상과 해결책 공유

정확도 45% 급락한 모델을 재학습 없이 27.8%p 복구한 비결

프로덕션 환경의 모델 드리프트를 해결하기 위해 백본과 출력층 사이에 어댑터 레이어를 추가하여 실시간으로 업데이트하는 '자가 치유' 기법을 제안한다.

모델 레이어만 잘라내도 성능 유지? GPT-2와 Llama에서 증명된 깊이 우선 가지치기

모델의 너비를 줄이는 대신 특정 레이어를 통째로 제거하는 '깊이 우선 가지치기' 기법이 GPT-2와 TinyLlama 모두에서 효과적인 성능 최적화를 보여주었다.

Cursor부터 E2B까지, AI 에이전트 보안 격리의 실태와 위험성

AI 에이전트가 외부 코드를 실행할 때 발생하는 보안 취약점을 분석하고, 기존 컨테이너 기술의 한계와 Firecracker microVM을 통한 하드웨어 수준 격리의 필요성을 제시한다.

AI 에이전트 배포 실패율 80%? EU AI 법안 대비 필수 거버넌스 가이드

AI 에이전트의 높은 배포 실패율과 EU AI 법안에 대응하기 위한 관측성과 거버넌스의 차이 및 실무 적용 방안을 정리했다.

단순 벡터 검색을 넘어선 로컬 AI 에이전트용 '인지형' 메모리 시스템 AI-IQ 공개

SQLite 기반으로 신념 점수화 및 자율 정리를 지원하는 로컬 AI 에이전트용 고성능 영구 메모리 시스템이다.

10만 토큰 입력을 1만 개로 압축? 로컬 LLM의 한계를 넘는 Ctxpact 공개

로컬 LLM의 좁은 컨텍스트 창 문제를 해결하기 위해 3단계 파이프라인으로 입력을 지능적으로 압축하는 오픈소스 프록시 Ctxpact를 소개한다.

"양자화했는데 메모리를 더 쓴다고?" GB10에서 확인된 KV 캐시의 함정

DGX Spark GB10에서 q4_0 KV 캐시 양자화가 64K 컨텍스트 시 성능이 92.5% 하락하고 메모리 사용량은 오히려 증가함을 실증했다.

Claude의 망각 해결! 4시간 만에 구축한 나만의 영구 메모리 MCP

Claude의 일시적인 메모리 한계를 극복하기 위해 Supabase와 Deno를 활용한 원격 MCP 서버를 구축하여 기기 간 동기화되는 영구적인 비즈니스 지식 레이어를 구현했다.