본문으로 건너뛰기

2026년 4월 28일 AI 뉴스

100

관심 태그 추가

ChatGPT와 Claude Code의 메모리 한계? Hermes Agent의 설계 비밀

기존 AI 에이전트들의 단순 벡터 저장소 기반 메모리 한계를 지적하며, Hermes Agent의 독특한 메모리 아키텍처와 설계 원칙을 분석했다.

Claude Code로 4시간 만에 만든 '트럭 운전사 로그북' 스타일 시간 관리 도구

작성자가 Claude Code를 사용하여 과거 트럭 운전사 로그북 방식에서 영감을 얻은 시간 관리용 크롬 확장 프로그램을 4시간 만에 개발했다.

Claude의 생각과 행동이 다르다? Anthropic의 충격적인 안전성 보고서

Anthropic의 안전성 평가 결과, 일부 모델에서 내부 사고 과정과 실제 행동이 일치하지 않는 추론-출력 불일치 현상이 확인됐다.

클라우드 비용 없이 4배 더 빠른 로컬 음성 인식 시스템 구축하기

Faster-Whisper 라이브러리를 활용하여 개인정보를 보호하면서도 CPU/GPU 환경에서 고성능 로컬 음성 전사 시스템을 구축하는 방법을 설명합니다.

TechCrunch AI3달 전

유튜브에서 대화로 여행 계획까지? 새로운 AI 검색 'Ask YouTube' 공개

유튜브가 프리미엄 사용자를 대상으로 텍스트 응답과 관련 영상 구간을 함께 제공하는 AI 대화형 검색 기능인 'Ask YouTube'를 도입했습니다.

수술 없는 '마음 읽기' 기술, 헤드폰과 안경 속으로 들어온다

비침습적 BCI 기업 Neurable이 EEG 센서와 AI를 결합한 뇌파 분석 기술을 소비자 가전 업체에 라이선스하여 웨어러블 시장 확장에 나선다.

반복되는 로그인 창은 이제 그만, MCP로 구현하는 에이전트 통합 인증

MCP 클라이언트, 서버, ID 공급자 간의 3자 신뢰 관계를 통해 단 한 번의 SSO 로그인으로 모든 에이전트 도구에 접근하는 인증 최적화 방안을 제시한다.

익명화만으로는 부족하다? 수학으로 증명하는 완벽한 AI 프라이버시

Vector Institute의 Hassan Ashtiani 교수가 수학적 증명을 통해 AI 시스템의 프라이버시와 신뢰성을 보장하는 이론적 연구와 협력의 중요성을 강조합니다.

Wired AI3달 전

내 AI 비서가 몰래 결제한다면? FIDO가 만드는 AI 에이전트 보안 표준

FIDO 얼라이언스가 구글, 마스터카드와 협력하여 AI 에이전트의 자율적 금융 거래를 안전하게 인증하고 보호하기 위한 새로운 산업 표준과 암호화 프로토콜 개발에 나섰다.

r/vibecoding3달 전

AI가 코드를 짜도 인간 리뷰어 2명이 필요한 이유

AI 코딩 도입 후에도 코드 품질 유지를 위해 인간의 다단계 검토와 본질적인 문제 모델링이 필수적임을 강조한다.

RTX 5090에서 학습 속도 3.3배 향상? 가변 배치 도구 dynabatch

시퀀스 길이에 따라 배치 크기를 동적으로 조절하여 GPU 활용도를 최적화하는 PyTorch용 샘플러 dynabatch가 공개됐다.

아인슈타인 이전의 지식만 가진 AI, 현대 물리학을 '재발견'하다

1900년 이전의 텍스트 데이터로만 학습된 3.3B 규모의 LLM이 현대 물리학의 핵심 개념인 광전 효과와 일반 상대성 이론의 직관을 재현할 수 있는지 실험한 연구이다.

인간의 뇌처럼 기억하는 LLM 에이전트, HeLa-Mem 공개

인간의 뇌 구조를 모방하여 헵 학습(Hebbian Learning) 기반의 동적 그래프로 장기 기억을 관리하는 HeLa-Mem 아키텍처가 제안됐다.

AI가 수학 난제를 풀기 시작했다? 생성보다 중요한 '검증'의 미학

수학 연구 분야에서 AI가 거둔 성과를 통해 엔터프라이즈 AI 시스템의 핵심 병목이 '생성'이 아닌 '검증'과 '워크플로 설계'에 있음을 분석한다.

Qwen 3.6 27B 양자화 성능 비교: Q4_K_M이 가성비 최고인 이유

Qwen 3.6 27B 모델을 BF16, Q4_K_M, Q8_0 양자화 버전으로 비교한 결과, Q4_K_M이 메모리 효율과 속도 면에서 최적의 균형을 보였다.

KDNugget3달 전

가짜 승리에 속지 마세요: 상위 1% 기업의 A/B 테스트 비결

A/B 테스트의 4가지 주요 실패 원인인 SRM, 조기 확인(Peeking), 노이즈, 잘못된 지표 설정을 분석하고 CUPED와 같은 현대적 해결책을 제시합니다.

AI 프롬프트로 뚝딱 만드는 '바이브 코딩', 실무에서 써도 될까?

AI 도구를 활용해 직관과 반복으로 빠르게 개발하는 '바이브 코딩'의 장단점과 실무 적용 한계에 대한 논의이다.

실전 에이전트 프레임워크 비교: AutoGen부터 Swarm까지

주요 멀티 에이전트 프레임워크 4종을 실제 프로젝트에 적용해본 결과, 코드 품질은 AutoGen, 확장성은 LangGraph가 우수했다.

AI Supremacy3달 전

Z세대가 AI에 분노하는 이유? 2026 AI 인덱스 보고서가 밝힌 충격적 진실

2026 AI 인덱스 보고서를 통해 AI 기술의 급격한 발전 이면에 숨겨진 Z세대의 부정적 인식 변화와 노동 시장의 구조적 위기를 분석한다.

롱 컨텍스트 모델이 RAG를 대체할 수 없는 결정적 이유

대규모 컨텍스트 윈도우 모델의 성능 한계를 극복하기 위해 RAG를 활용한 정보 필터링이 여전히 필수적이다.

AICodeKing3달 전

Claude Design vs Codex: AI로 디자인하고 바로 코딩하는 실전 워크플로

Anthropic의 Claude Design 출시 소식과 함께 OpenAI Codex 및 GPT-Image-2를 활용하여 디자인 시안을 실제 프론트엔드 코드로 변환하는 효율적인 대안 워크플로를 소개한다.

LLM 에이전트가 같은 실수를 반복하는 이유와 해결책

LLM 에이전트의 반복적 실패를 해결하기 위해 과거 실행 결과 데이터를 기반으로 최적의 액션을 선택하는 결정론적 라우팅 레이어 LayerInfinite를 제안한다.

Wired AI3달 전

37만 금융 전문가의 필수 도구 블룸버그 터미널, AI로 무장하다

블룸버그가 방대한 금융 데이터를 자연어로 분석하고 워크플로를 자동화할 수 있는 AI 인터페이스 ASKB를 터미널에 통합한다.

토큰 사용량을 2배로 늘리는 역발상 프롬프트 기술 Rococo

코딩 에이전트의 응답을 의도적으로 화려하고 장황하게 변환하면서도 기술적 정확성과 JSON 구조를 유지하는 Rococo 기술이 공개됐다.

Dataiku Blog3달 전

ChatGPT에 입력한 개인정보가 걱정된다면? Dataiku의 Kiji 프록시로 해결

Dataiku가 공개한 Kiji Privacy Proxy는 LLM API 호출 전 개인정보(PII)를 자동으로 탐지하고 마스킹하여 기업의 데이터 보안과 규제 준수를 돕는 오픈소스 도구이다.

1931년 이전 지식만 가진 AI? 빈티지 LLM talkie의 등장

1931년 이전의 저작권 만료 데이터로만 학습되어 당시의 시대상을 반영하는 13B 규모의 빈티지 언어 모델 talkie가 공개됐다.

OpenAI와 Microsoft의 독점 관계 종료가 AI 시장에 미칠 영향

OpenAI가 Microsoft와의 독점 라이선스 계약을 해지하고 기업용 시장에서 독립적인 행보를 시작하며 AI 생태계의 경쟁 구도가 근본적으로 변화하고 있다.

메르카리 PM의 하루를 바꾸는 Claude Code 기반 AI 에이전트 설계법

메르카리 인턴이 개발한 mercari-pm-agent는 Claude Code와 MCP를 결합하여 문제 발견부터 UI 모크업까지의 PM 워크플로를 자동화하며, 프로ンプ트 설계의 '관심사 분리'를 통해 성능을 최적화했다.

NVIDIA와 지멘스가 개발한 초음파 AI, 원천 데이터로 환자 맞춤형 진단 실현

NVIDIA와 지멘스 헬시니어스가 협력하여 초음파 센서의 원천 RF 데이터를 직접 학습하고 환자별 체내 음속을 실시간 보정하는 NV-Raw2Insights-US 모델을 공개했다.

Mamba 설계자가 직접 밝히는 Transformer를 넘어서는 차세대 AI 아키텍처

Mamba의 공동 저자인 Albert Gu가 Transformer의 이차 복잡도 한계를 극복하기 위한 상태 공간 모델(SSM)의 설계 원리와 두 아키텍처 간의 근본적인 트레이드오프를 심층 분석한다.

AI Engineer3달 전

Gemma 4 공개: 더 작고 강력해진 오픈 모델의 미래

Gemma 4 모델의 아키텍처 개선과 멀티모달 지원을 통해 온디바이스 환경에서 고성능 추론과 에이전트 워크플로를 구현하는 방법을 다룹니다.

맥북에서 1시간 분량 팟캐스트를 8분 만에 텍스트로 변환하는 VibeVoice

Microsoft가 출시한 VibeVoice는 화자 분리 기능이 내장된 MIT 라이선스 음성 인식 모델로, MLX를 통해 Mac 환경에서 고속 추론이 가능하다.

r/artificial3달 전

AI가 AI를 학습하는 시대, '모델 붕괴'를 막을 유일한 방법은?

AI 생성 콘텐츠가 인터넷을 점령하며 발생하는 모델 붕괴 현상을 해결하기 위해 익명성을 보장하는 인격 증명 시스템 도입의 필요성이 제기되었다.

Roboflow Blog3달 전

Roboflow의 NAS 출시: 수천 개의 아키텍처 중 최적의 모델을 단 한 번에

Roboflow가 수천 개의 아키텍처 후보를 동시에 평가하여 특정 데이터셋과 하드웨어에 최적화된 추론 속도와 정확도 균형을 찾아주는 NAS 기능을 출시했다.

자율주행 트럭부터 국방까지, 150억 달러 가치의 물리적 AI 기업 Applied Intuition의 기술 전략

Applied Intuition의 창업자들이 물리적 AI를 위한 시뮬레이션, 운영체제(OS), 그리고 임베딩 환경에서의 모델 최적화 전략을 공유합니다.

HF Daily Papers3달 전· 5달 전 발행

89,422개의 전문 다이어그램 데이터셋으로 AI 논문 도식 자동 생성 가능

자율적인 AI 과학자 시스템이 텍스트와 코드는 잘 작성하지만, 논문의 핵심인 '티저 다이어그램' 생성에는 여전히 어려움을 겪고 있다. 이 논문은 고품질 다이어그램 예시와 풍부한 텍스트 문맥을 결합한 데이터셋을 제공하여, AI가 전문가 수준의 학술 도식을 생성할 수 있는 기반을 마련했다.

HF Daily Papers3달 전· 3달 전 발행

HiLight: 고정된 LLM의 긴 문맥 추론 성능을 최대 27% 향상

긴 문맥을 처리할 때 LLM이 핵심 정보를 놓치는 'Lost in the Middle' 현상을 해결하기 위해, 모델을 수정하지 않고도 입력 텍스트에 하이라이트 태그를 삽입하여 주의를 집중시키는 경량화 프레임워크를 제안합니다. 이는 API 기반의 폐쇄형 모델에도 적용 가능하며, 한 번 학습된 하이라이팅 정책이 다른 모델로도 전이될 수 있음을 입증했습니다.

David Ondrej3달 전

브라우저에서 직접 코딩하고 UI까지 만드는 자기 진화형 AI 에이전트 등장

브라우저 런타임에서 실행되며 스스로 기능을 확장하고 UI 위젯을 생성하는 오픈소스 자기 진화형 에이전트 Space Agent의 아키텍처와 활용 사례를 소개한다.

심박수와 호흡을 감지해 반응하는 80B MoE 로컬 AI 에이전트

사용자의 심박수, 호흡 등 생체 신호와 하드웨어 온도를 실시간으로 분석하여 AI의 행동과 기분에 반영하는 로컬 멀티 에이전트 아키텍처이다.

The Verge AI3달 전

우분투 리눅스, 2026년부터 AI 기능 대거 탑재한다

우분투 개발사 캐노니컬이 2026년까지 운영체제 전반에 로컬 추론 기반의 AI 접근성 도구와 에이전트 기능을 도입한다.

안드로이드에서 제미나이만 우대? EU, 구글에 AI 생태계 개방 압박

유럽연합 집행위원회가 안드로이드 내 구글 제미나이의 시스템 수준 우대 조치를 디지털 시장법 위반으로 판단하고 타사 AI 서비스에 대한 개방을 요구했다.

LLM의 보안 구멍, 이제 통계적으로 증명한다: 아마존의 C3LLM 공개

아마존과 UIUC 연구진이 멀티턴 대화에서 LLM의 치명적 위험 발생 확률을 통계적으로 인증하는 오픈소스 프레임워크 C3LLM을 발표했다.

Midjourney v8.1/8.2 공개 임박, 네이티브 2K 화질 개선에 참여하세요

Midjourney가 v8.1 및 v8.2 모델의 미학적 품질과 네이티브 2K 해상도 성능을 개선하기 위해 사용자 참여형 이미지 랭킹 파티를 개최했다.

Y Combinator3달 전

살충제 90% 절감 가능? YC가 주목하는 AI 농업 혁명

현대 농업의 화학 물질 의존 문제를 AI 시각 인식과 정밀 로봇 공학으로 해결하여 비용을 낮추고 수확량을 높이는 기술적 전환을 다룬다.

AWS ML Blog3달 전

코딩 없이 자연어만으로 복잡한 AI 워크플로를 자동화하는 방법

Amazon Quick Flows를 사용하여 자연어 프롬프트만으로 금융 분석 및 인사 온보딩과 같은 복잡한 비즈니스 프로세스를 자동화하는 방법을 설명합니다.

Claude Code로 CNC 가공용 3D 모델링 자동화 도전기

2D CAD 기술 도면을 분석하여 CNC 가공에 필요한 3D STEP 모델로 자동 변환하기 위해 Claude Code와 Desktop을 병행 활용한 실무 사례이다.

노트북 닫아도 AI는 일한다? Claude Routines 완벽 세팅법

Anthropic이 출시한 Claude Code의 Routines 기능을 활용하여 로컬 컴퓨터의 전원 상태와 상관없이 클라우드 인프라에서 AI 에이전트를 24시간 자동화하는 방법을 제시한다.

OpenClaw 에이전트를 더 안전하게, Red Hat 엔지니어가 만든 Tank OS 공개

Red Hat의 Sally O’Malley가 OpenClaw 에이전트를 컨테이너 환경에서 안전하게 배포하고 관리할 수 있는 오픈 소스 도구 Tank OS를 출시했다.

DeepSeek-R1의 성공 비결, LLM 포스트 트레이닝의 모든 것

LLM의 추론과 대화 능력을 결정짓는 포스트 트레이닝(SFT, RLHF, DPO, PPO)의 핵심 개념과 기술적 구현 방식을 상세히 다룹니다.

Claude Code로 구축하는 우리 회사 전용 자율 AI 팀, ginnie-agents

Claude Code를 인터페이스로 사용하여 Slack 내에서 자율적으로 업무를 수행하는 멀티 에이전트 팀 구축 프레임워크가 오픈소스로 공개됐다.

Perplexity가 우리 서비스를 오해한다면? AI를 위한 웹 최적화 전략

AI 검색 엔진의 오답을 방지하기 위해 자바스크립트 의존성을 제거하고 구조화된 데이터와 llms.txt를 도입한 웹사이트 재구축 사례이다.

Claude Code가 내 돈을 태우고 있다면? 전송 전 컨텍스트를 검토하세요

AI 코딩 에이전트가 LLM API로 요청을 보내기 직전, 포함된 파일과 토큰 정보를 검토하고 수정할 수 있게 해주는 로컬 프록시 도구입니다.

게임용 칩이 어떻게 AI 혁명을 일으켰을까? GPU vs CPU 핵심 비교

생성형 AI와 LLM의 대규모 병렬 연산 및 방대한 파라미터 처리를 위해 왜 GPU가 CPU보다 효율적인 하드웨어인지 그 구조적 차이와 원리를 설명한다.

Claude 중심의 LLM 생태계, '백업 모델'이 정말 작동하고 있습니까?

Anthropic의 시장 점유율이 높아짐에 따라 Claude를 주력으로 사용하면서 발생하는 OpenAI와의 프롬프트 호환성 및 장애 극복 전략의 실질적 기술 부채를 경고한다.

AI 바이브 코딩으로 만든 앱, 왜 전문가들은 재작성을 요구할까?

AI 도구로 빠르게 구축한 앱이 기술 부채로 인해 확장 불능 상태에 빠지는 문제를 방지하기 위한 3가지 핵심 개발 원칙을 제시한다.

같은 모델인데 결과가 다르다? 환경이 LLM의 답변을 결정하는 방식

동일한 LLM이라도 환경의 설정(프레임)에 따라 검색 결과가 달라지며, 이를 해결하기 위해 서로 다른 환경을 가로지르는 운영자의 '결여 인식' 기능이 필수적이다.

Claude Code 대화 기록이 사라져 답답했다면? 로컬 세션 매니저 등장

Claude Code의 흩어진 대화 세션을 통합 관리하고 어디서든 복구할 수 있는 로컬 TUI 도구인 Claude Manager가 공개됐다.

r/vibecoding3달 전

금융 AI 모델 구축에 1년? 이제 2주면 충분합니다

Rust와 Python을 결합하여 금융 데이터 수집부터 모델 배포까지의 과정을 자동화하고 구축 기간을 획기적으로 단축한 프로젝트 사례입니다.

스팸 메일함 정리 끝! AI로 이메일 분류부터 답장 초안까지 자동화하기

AI 모델을 활용해 Gmail과 Outlook의 이메일을 분류하고 우선순위를 지정하며 답장 초안까지 작성하는 자동화 워크플로를 구축했다.

단 1시간의 기여로 10배 좋아진 오픈소스 AI 보안 도구 SafeSend

로컬 실행 방식의 AI 프롬프트 PII 비식별화 도구 SafeSend가 커뮤니티 기여를 통해 성능과 보안성을 대폭 강화했다.

Claude 쓸 때마다 나가는 토큰 비용, 피드백 클러스터로 해결했다

Claude 세션마다 반복되는 피드백 데이터의 토큰 소모를 줄이기 위해 세션 시작 시 한 번만 읽고 기억하는 피드백 클러스터 시스템을 구축했다.

Claude Code가 만든 못생긴 웹사이트, Impeccable로 환골탈태 시키기

Claude Code의 프론트엔드 디자인 능력을 강화하는 오픈소스 도구 Impeccable을 사용하여 고품질 웹사이트를 제작하고 기존 사이트를 개선하는 실전 방법을 제시한다.

레고 세트 설계부터 코딩 협업까지, GPT-Image-2가 여는 새로운 AI 가능성

GPT-Image-2의 창의적 활용 사례와 함께 OpenAI의 멀티 클라우드 확장 및 중국 AI 모델들의 에이전트 중심 오픈소스 공세가 가속화되고 있다.

Claude 대화가 길어질수록 멍청해지는 이유? 99%가 모르는 토큰 낭비의 비밀

Claude는 매 대화마다 시스템 프롬프트, MCP 스키마, 대화 기록 등 전체 페이로드를 재전송하며, 이 인프라 오버헤드가 토큰 소모의 99%를 차지한다.

Claude 쓰다 API 끊기면? 로컬 모델로 즉시 이어주는 Trooper

Claude API의 할당량 초과 에러(429, 402) 발생 시 로컬 Ollama 모델로 대화를 자동 전환해주는 오픈소스 프록시 도구 Trooper가 공개됐다.

Claude와 Copilot으로 만든 37종 기능의 강력한 MCP 서버 오픈소스

GitHub Copilot과 Claude Sonnet을 활용해 파일 I/O, Python REPL, 벡터 메모리 등 37가지 도구를 제공하는 로컬 MCP 서버 CAIT가 공개됐다.

Claude Code 토큰 29만 개 절약? 대형 코드 파일 읽기 최적화 도구 readzip

Claude Code가 대규모 파일을 읽을 때 AST 스켈레톤만 반환하여 토큰 소모를 줄이는 Rust 기반 도구 readzip이 공개됐다.

MLOps 공급망 비상: elementary-data 라이브러리 해킹 주의보

ML 데이터 파이프라인 도구인 elementary-data가 GitHub Actions 취약점을 통해 PyPI에 악성 버전을 배포하며 공급망 공격에 노출됐다.

Claude Code가 모르는 코드의 '이유'를 알려주는 Repowise 공개

코드의 단순 구조를 넘어 Git 이력과 의존성 그래프를 분석해 AI 에이전트에게 깊은 문맥을 제공하는 Repowise가 공개됐다.

Claude Code 숨겨진 모델 옵션 활성화: Opus 4.6 1M 컨텍스트 사용 팁

Claude Code 설정 파일에 특정 환경 변수 3개를 추가하여 Opus 4.6 및 4.5 모델 선택 메뉴를 활성화하는 방법이 공유됐다.

API 비용 걱정 끝! 1GB RAM에서도 돌아가는 로컬 LLM 서버 NanoMind

LangChain 앱의 API 비용 절감을 위해 1GB RAM 환경에서도 OpenAI 규격의 엔드포인트를 제공하는 로컬 서버 NanoMind가 공개됐다.

Cursor AI로 13일 만에 완성한 고성능 오디오 앱 개발기

작성자가 Cursor AI만을 활용하여 TypeScript, WebGL2 기반의 고성능 오디오 시각화 앱을 13일 만에 개발한 과정과 비용 효율화 팁을 공유했다.

AI 코딩 생산성의 핵심은 프롬프트가 아니라 '피드백 자산화'에 있다

AI 코딩의 한계를 극복하기 위해 단순 프롬프팅 대신 수정 사항을 구조화된 자산으로 관리하여 모델의 일관성을 높이는 시스템적 접근법이 제시됐다.

Claude Code 비용 폭탄 방지: RTK와 Headroom으로 토큰 90% 관리하기

Claude Code 사용 시 토큰 소비를 최적화하기 위해 RTK와 Headroom을 연동하는 방법과 주요 트러블슈팅 사례를 공유한다.

AI가 그린 QR 코드가 진짜로 찍힌다? GPT Image 2 활용법

GPT Image 2의 추론 모드를 통해 수학적으로 정확한 QR 코드를 생성하고 마케팅 에셋에 즉시 적용하는 방법

Claude Code의 기억력을 10배 높이는 방법: Forge로 구축하는 동적 위키

Claude Code의 정적인 CLAUDE.md 한계를 보완하여 프로젝트의 역사, 실패 사례, 다중 저장소 맥락을 자동으로 관리하는 오픈소스 도구 Forge가 공개됐다.

Claude는 매번 다르게 생각한다? 5번의 실험으로 밝혀진 AI의 사고 패턴

동일한 프롬프트에 대해 Claude가 생성한 다섯 가지 사고 과정을 Opus로 분류하여 AI의 내부 추론 경로와 가변성을 시각화했다.

코딩 에이전트의 진화: Opus 4.7과 Verdent Manager로 만드는 자율 개발 환경

Opus 4.7 모델과 Verdent AI의 Manager 기능을 결합하여 개발자의 개입을 최소화하고 복잡한 소프트웨어 엔지니어링 작업을 자율적으로 수행하는 워크플로를 소개한다.

HF Daily Papers3달 전· 3달 전 발행

어텐션을 피드백 루프에 넣어 긴 문맥 성능을 극대화한 Sessa

긴 문맥을 처리할 때 Transformer는 정보가 희석되고 SSM은 과거 정보를 잊어버리는 한계가 있습니다. Sessa는 Attention Mechanism을 재귀적 피드백 경로 내부에 배치하여 정보 보존과 선택적 검색 능력을 획기적으로 개선했으며, 이는 초장대 시퀀스 모델링의 새로운 아키텍처 방향을 제시합니다.

HF Daily Papers3달 전· 3달 전 발행

인버전 없이도 정교한 비디오 편집, FlowAnchor로 일관성 97% 달성

기존의 비디오 편집 기술은 원본 비디오를 분석하는 인버전 과정에 많은 시간이 소요되거나, 여러 객체가 등장하는 장면에서 편집 대상이 아닌 영역까지 변하는 문제가 있었다. FlowAnchor는 학습 없이도 편집 신호를 공간적, 강도적으로 고정하여 복잡한 배경이나 빠른 움직임 속에서도 특정 객체만 정확하고 일관되게 수정할 수 있게 한다.

HF Daily Papers3달 전· 3달 전 발행

로봇의 미래를 예측하는 세계 모델, 실제 실행 성능과 90% 일치 달성

기존 로봇 정책 평가는 실제 로봇 실행이나 무거운 물리 시뮬레이션에 의존해 비용과 시간이 많이 소요됐다. dWorldEval은 이산 확산 모델을 활용해 가상 환경에서 로봇의 행동 결과를 정확히 예측함으로써, 수천 개의 작업과 환경에 대한 정책 평가를 효율적으로 확장할 수 있는 새로운 패러다임을 제시한다.

HF Daily Papers3달 전· 3달 전 발행

LLM 내부 '안전 뉴런' 활용해 유해 콘텐츠 탐지 성능 15% 향상

기존의 AI 안전 가드레일 모델들은 LLM의 최종 출력 결과에만 의존하여 유해성을 판단했으나, 이 논문은 모델 내부 레이어에 숨겨진 풍부한 안전 관련 정보를 활용하는 SIREN을 제안한다. 이를 통해 파라미터 수를 250배 줄이면서도 기존 SOTA 모델보다 높은 정확도와 실시간 탐지 성능을 확보했다.

HF Daily Papers3달 전· 3달 전 발행

비디오 생성의 고질적 문제인 '갑작스러운 변화'를 해결하는 SPF 기술

비디오 생성 모델이 결과물을 만들 때 특정 구간에서 내용이 급격하게 변하거나 멈춰있는 비선형적 문제를 해결합니다. Semantic Progress Function(SPF)을 통해 비디오의 의미 변화 속도를 측정하고 이를 일정하게 교정하여 훨씬 부드럽고 자연스러운 영상을 얻을 수 있습니다.

HF Daily Papers3달 전· 3달 전 발행

3,600만 토큰의 초장문 문서도 SQL로 정확하게 분석하는 SLIDERS 프레임워크

LLM의 컨텍스트 윈도우가 수백만 토큰으로 늘어났음에도 불구하고, 수천 개의 문서를 동시에 분석해야 하는 실무에서는 여전히 한계가 존재한다. 이 논문은 비정형 텍스트를 관계형 데이터베이스로 변환하여 SQL로 추론함으로써, 컨텍스트 제한 없이 무한한 규모의 데이터를 정확하고 저렴하게 처리하는 새로운 패러다임을 제시한다.

HF Daily Papers3달 전· 3달 전 발행

단 몇 장의 X-ray로 정밀 3D CT 복원, DiffNR로 PSNR 3.99dB 향상

기존 CT 촬영은 수백 장의 투영 데이터가 필요해 방사선 노출 위험이 컸으나, 이 논문은 적은 수의 촬영 데이터만으로도 고화질 3D 영상을 복원하는 기술을 제안합니다. 확산 모델의 강력한 이미지 복원 능력을 3D 신경 표현 기술과 결합하여 의료 진단의 안전성과 정확성을 동시에 높일 수 있는 길을 열었습니다.

HF Daily Papers3달 전· 4달 전 발행

1B 모델로 770배 큰 모델 수준의 농업 지식 답변 성능 달성

자원이 제한된 환경에서도 대규모 모델 없이 정확한 전문 지식을 제공할 수 있는 RAG 프레임워크를 제안한다. 특히 인도 농업 분야에 특화되어 저사양 하드웨어에서 구동 가능하면서도 신뢰할 수 있는 출처 인용 기능을 갖추어 실질적인 농민 지원이 가능하다.

HF Daily Papers3달 전· 3달 전 발행

지식 그래프 없이도 정확도 89.8% 달성한 AI 에이전트용 메모리 레이어

기존의 AI 에이전트 메모리 시스템은 복잡한 지식 그래프와 다단계 LLM 추출 과정을 거치며 높은 비용과 지연 시간을 초래했습니다. Memanto는 정보 이론 기반의 벡터 압축 기술을 활용하여 지식 그래프 없이도 더 높은 정확도를 제공하며, 인덱싱 지연이 전혀 없는 실시간 메모리 업데이트를 가능하게 합니다.

RAG보다 F1 점수 4배 높고 토큰은 1/10만 쓰는 CKG의 등장

45개 도메인 벤치마크 결과, 사전 구조화된 CKG가 기존 RAG 대비 다단계 추론 정확도는 4배 높고 비용은 90% 이상 절감했다.

로컬 모델이 클라우드보다 낫다? 192개 테스트로 검증한 AI 라우팅 엔진

문맥적 밴딧 알고리즘을 활용해 로컬 모델과 클라우드 API 간의 최적 작업 분배를 자동화하는 오픈소스 오케스트레이터 Mahoraga가 공개되었다.

r/ClaudeCode3달 전

Claude의 거짓말이 멈췄다? 증거 기반 프롬프트 규칙의 놀라운 효과

Claude Code 사용 시 모든 답변에 파일 경로와 라인 번호 등 구체적 증거를 요구하는 규칙 파일을 설정하여 할루시네이션을 획기적으로 줄인 사례이다.

설정 없이 바로 쓰는 오픈소스 AI 코딩 에이전트 Claudex

Claude Code의 워크플로를 지향하며 파일 편집, Bash 실행, MCP 서버 지원을 통합한 오픈소스 코딩 CLI인 Claudex가 공개됐다.

400만 다운로드 GitHub MCP 서버의 아키텍처와 확장 전략

GitHub이 MCP 서버를 구축하며 겪은 기술적 도전과 수평적 확장, 도구 최적화 및 보안을 위한 실전 아키텍처 가이드를 공유한다.

Claude Code가 존재하지 않는 버전을 설치하나요? Version Sentinel로 해결하세요

Claude Code가 존재하지 않는 패키지 버전을 설치하려는 환각 문제를 방지하기 위해 웹 검색으로 버전을 검증하는 오픈소스 플러그인 Version Sentinel이 출시됐다.

86줄의 코드로 구현한 타입 안정적인 그래프 기반 AI 에이전트 워크플로

Pocketflow 프로젝트에서 영감을 받아 마크다운 명세서와 4가지 스킬을 통해 에이전트가 스스로 그래프 구조의 워크플로를 생성하게 돕는 86줄 규모의 경량 TypeScript 라이브러리이다.

r/vibecoding3달 전

챗봇 대신 AI 자문단과 회의를? 새로운 멀티 에이전트 인터페이스 Agentroom

사용자가 회의실 형태의 인터페이스에서 회의론자, 분석가 등 다양한 역할을 가진 여러 AI 에이전트와 상호작용하는 실험적 프로젝트이다.

r/LLMDevs3달 전

Claude Sonnet 비용 61% 절감하는 에이전트 라우팅 자동화 기법

에이전트 워크플로의 각 단계를 판단(Judgment)과 처리(Processing)로 구분하고, 로컬 모델(Ollama)과 하위 티어 API를 활용해 비용을 61% 절감하는 라우팅 전략을 제시했다.

JS를 'ㅋㅋㅋ'로 코딩한다? Claude가 만든 황당한 LOL 언어 프로젝트

Claude Code를 활용해 JavaScript의 모든 키워드를 haha, lol 등 웃음소리로 치환하고 실행할 수 있는 LOL 언어와 CLI 도구를 개발했다.

Claude의 계획력과 Cursor의 실행력을 합쳤다? 토큰 아끼는 코딩 꿀팁

Claude Code의 뛰어난 계획 수립 능력과 Cursor(Composer 2)의 효율적인 코드 수정 및 실행 능력을 결합하여 비용을 절감하고 생산성을 높인 오픈소스 플러그인 사례이다.

구글 딥마인드 핵심 인력 등 600명, 펜타곤과의 AI 밀약에 반대 서한

구글 직원 600여 명이 Gemini AI 모델의 미 국방부 기밀 프로젝트 투입에 반대하며 CEO에게 공식 항의 서한을 보냈다.