본문으로 건너뛰기

2026년 3월 19일 AI 뉴스

100

관심 태그 추가

"내 AI 대화도 암호화될까?" 시그널 창립자와 메타의 만남

시그널 창립자 모시 말린스파이크가 설립한 Confer가 메타 AI와 협력하여 챗봇 대화에 종단간 암호화 수준의 프라이버시 기술을 도입한다.

LLM 추론 가속화의 핵심, 투기적 디코딩 성능을 정확히 측정하는 SPEED-Bench 공개

NVIDIA 연구진이 실제 운영 환경의 데이터 다양성과 처리량을 반영하여 투기적 디코딩 성능을 정밀하게 평가할 수 있는 통합 벤치마크 SPEED-Bench를 공개했다.

공중에 뜬 칫솔은 이제 그만, 물리 법칙을 아는 3D 생성 AI PAT3D

CMU 연구진이 개발한 PAT3D는 LLM과 물리 시뮬레이터를 결합하여 텍스트 프롬프트로부터 물리적으로 안정적이고 즉시 시뮬레이션 가능한 3D 장면을 자동 생성한다.

외부 라이브러리 없이 Python만으로 완벽한 합성 데이터 만들기

외부 라이브러리에 의존하지 않고 Python 기본 모듈을 활용해 비즈니스 로직과 패턴이 반영된 고품질 합성 데이터를 생성하는 5가지 실무 스크립트를 소개한다.

LlamaIndex4달 전

클라우드 의존성 제로, 로컬에서 끝내는 고성능 문서 파싱 LiteParse 실전 가이드

LlamaIndex가 출시한 LiteParse는 LLM이나 클라우드 의존성 없이 로컬 환경에서 PDF, Office 문서, 이미지를 텍스트와 구조화된 데이터로 변환하는 오픈소스 파싱 도구이다.

내 의료 기록 읽는 핏빗 AI, 더 똑똑한 건강 조언 해줄까?

구글이 핏빗 AI 헬스 코치에 의료 기록 연동 기능을 추가하여, 웨어러블 데이터와 결합된 초개인화된 건강 조언과 요약 서비스를 제공한다.

Sam Witteveen4달 전

URL만 넣으면 디자인 끝? 구글 스티치의 강력한 AI 디자인 에이전트

구글 랩스의 AI 디자인 도구 '스티치'의 대규모 업데이트를 통해 URL 기반 테마 복제, DESIGN.md를 활용한 디자인 시스템 관리, AI 에이전트와의 협업 과정을 상세히 다룹니다.

LLM 호출 비용과 지연 시간, 이제 RubyLLM에서 자동으로 추적하세요

RubyLLM 라이브러리에 OpenTelemetry를 통합하여 LLM 호출의 지연 시간, 토큰 비용, 도구 호출 흐름을 자동으로 시각화하고 디버깅하는 새로운 인스트루멘테이션 도구를 소개합니다.

인터넷 없이 폰에서 돌아가는 AI? Multiverse의 초소형 모델 혁신

스페인 스타트업 Multiverse Computing이 양자 기반 압축 기술을 활용해 모바일 기기에서 오프라인으로 작동하는 초소형 모델 Gilda와 기업용 API 포털을 공개했다.

비용은 1/3, 성능은 SOTA? MiniMax 2.7이 가져온 자가 진화 에이전트의 충격

MiniMax 2.7은 GLM-5 수준의 성능을 훨씬 낮은 비용으로 제공하며, 모델이 스스로 성능을 개선하는 자가 진화 워크플로를 통해 에이전트 기술의 새로운 기준을 제시한다.

구글 Gemini가 만드는 유럽의 디지털 건강 동반자, 독모리스와 협력

구글은 유럽 최대 온라인 약국 독모리스와 파트너십을 맺고 Gemini 모델과 구글 클라우드를 활용해 개인 맞춤형 디지털 헬스 동반자 서비스를 구축한다.

비대해진 프롬프트의 해답, 앤스로픽이 제안하는 '에이전트 스킬' 아키텍처

앤스로픽의 에이전트 스킬 프레임워크를 통해 시스템 프롬프트 비대화 문제를 해결하고 에이전트의 성능을 최적화하는 방법과 최신 AI 산업 동향을 다룹니다.

확신에 찬 오답을 잡아라! MIT가 공개한 LLM 환각 탐지용 '전체 불확실성' 지표

MIT 연구진은 자기 일관성과 교차 모델 불일치를 결합하여 LLM의 과잉 확신과 환각 현상을 보다 정확하게 식별하는 '전체 불확실성' 지표를 개발했다.

Claude4달 전

매일 아침 슬랙 요약을 자동으로? Claude의 예약 작업 기능 출시

Claude Desktop의 Cowork에서 반복적인 AI 작업을 자동화하고 외부 도구와 연동하여 정기적으로 실행할 수 있는 예약 기능을 소개합니다.

Claude Code와 Codex를 한곳에서, 오픈소스 AI 코딩 제어판 ATO

ATO는 Claude Code, Codex 등 파편화된 AI 코딩 에이전트들의 스킬, 자동화 워크플로, 크론 스케줄링을 하나의 대시보드에서 통합 관리하는 오픈소스 도구이다.

48GB 맥북에서 200GB가 넘는 Qwen 397B 모델을 돌리는 방법

Apple의 LLM in a Flash 연구를 적용하여 48GB RAM 환경에서 209GB 규모의 Qwen 397B MoE 모델을 초당 5.5토큰 속도로 실행하는 최적화 기법을 소개한다.

"한 글자씩 코딩하던 시절에 감사" 샘 알트먼의 트윗이 공분을 산 이유

샘 알트먼 OpenAI CEO가 과거 개발자들의 노고에 감사를 표했으나, AI로 인한 대규모 해고 상황과 맞물려 업계의 거센 비판과 조롱을 받았다.

HF Daily Papers4달 전· 4달 전 발행

디퓨전 모델에 '생각하는 능력' 부여, 연산 효율과 화질 동시 잡았다

기존 디퓨전 모델은 입력 내용과 상관없이 정해진 단계를 기계적으로 반복하지만, CoTj는 이미지의 복잡도에 따라 연산 자원을 다르게 배분하는 '계획 단계'를 도입했습니다. 이를 통해 단순한 배경은 빠르게 처리하고 복잡한 피사체에는 계산을 집중하여, 추가 학습 없이도 생성 품질을 높이고 불필요한 계산 낭비를 줄였습니다.

HF Daily Papers4달 전· 5달 전 발행

1억 개의 분자 데이터로 밝혀낸 화학 언어 모델의 성능 법칙과 표준화의 중요성

화학 언어 모델(CLM)이 분자 특성 예측에서 일관되지 않은 성능을 보이는 이유를 수백 번의 통제된 실험으로 규명했다. 특히 데이터 표준화 방식의 차이가 모델 성능을 심각하게 저하시킬 수 있음을 입증하여, 향후 신약 개발 AI 연구의 신뢰성을 높이는 데이터 전처리 가이드라인을 제시한다.

NVIDIA의 로보택시 반격: 우버·리프트와 손잡고 테슬라에 맞선다

NVIDIA가 우버 및 리프트에 DRIVE Hyperion 플랫폼과 Alpamayo AI 모델을 공급하여 2027년까지 레벨 4 로보택시 상용화를 추진한다.

AI 에이전트 성능 200% 끌어올리는 OpenClaw 실전 세팅 가이드

OpenClaw를 활용하여 AI 에이전트의 메모리 관리, 모델 라우팅, 다층 보안 아키텍처 및 비용 최적화를 달성하는 실무적인 고급 기술들을 상세히 다룬다.

머스크의 Grok이 불 지폈다... EU, 딥페이크 누드 생성 AI 전면 금지 추진

유럽연합 의회가 일론 머스크의 Grok 등 AI를 통한 딥페이크 누드 생성 위험성이 부각됨에 따라 AI 법을 개정하여 관련 시스템을 전면 금지하기로 의결했다.

거짓말 안 하는 AI 가능할까? 승인 지향 에이전트의 새로운 가능성

IDA 방식의 한계를 지적하며 인간 뇌의 승인 보상 메커니즘을 통해 정직하고 통제 가능한 승인 지향 에이전트를 구현하는 방안을 제시한다.

The Verge AI4달 전

"ChatGPT가 암을 고쳤다?" 강아지 로지의 기적 뒤에 숨겨진 차가운 진실

호주의 한 견주가 ChatGPT와 AI를 이용해 반려견의 암을 치료했다는 소문이 퍼졌으나, 실제로는 전문가들의 개입과 기존 면역 요법이 병행된 복합적인 결과였다.

친구가 본 영상이 왜 뜰까? Meta가 공개한 Reels 추천 알고리즘의 비밀

Facebook Reels는 사용자 간 친밀도 모델과 다중 작업 학습(MTML) 랭킹 시스템을 결합하여 친구가 반응한 고품질 콘텐츠를 우선 추천하고 소셜 연결성을 강화한다.

Tina Huang4달 전· 5달 전 발행

내 프로젝트에 딱 맞는 AI 모델은? 4가지 티어별 완벽 가이드

성능, 크기, 속도, 비용을 기준으로 AI 모델을 플래그십, 미드티어, 라이트, 특화 모델로 분류하고 각 대표 모델의 특징과 활용 사례를 제시한다.

Tina Huang4달 전· 5달 전 발행

Vibe Coding에서 Agentic Engineering까지: 2026년 AI 시대의 새로운 코딩 생존

AI 에이전트가 코드를 작성하는 2026년 환경에서 단순 구현보다 시스템 설계, 보안, 에이전트 오케스트레이션을 중심으로 한 에이전틱 엔지니어링 학습 로드맵을 제시한다.

추천 모델 학습 속도 2배 향상, Meta가 공개한 GDPA 커널 최적화 비결

Meta는 실제 추천 시스템의 불규칙한 데이터 특성에 맞춰 FlashAttention-4를 개선한 GDPA 커널을 설계하여 NVIDIA B200에서 최대 2배의 성능 향상을 달성했다.

결과가 매번 다른 AI 에이전트, 어떻게 테스트할까? Strands Evals로 해결하기

비결정적인 AI 에이전트의 성능을 체계적으로 측정하기 위해 Strands Evals 프레임워크를 활용한 온라인/오프라인 평가, 멀티턴 시뮬레이션 및 계층적 평가 방법론을 제시한다.

RTX 5090으로 1시간 만에 3분짜리 AI 뮤직비디오 제작하기

보컬 스템과 가사를 입력받아 로컬 LLM으로 샷 리스트를 생성하고 LTX-Video로 고품질 뮤직비디오를 자동 제작하는 오픈소스 도구이다.

LangChain4달 전

Claude Code 부럽지 않은 나만의 오픈소스 AI 에이전트 만들기

NVIDIA의 Nemotron 3 Super 모델과 OpenShell 런타임, LangChain의 DeepAgents 하네스를 결합하여 보안과 성능을 모두 갖춘 오픈소스 AI 에이전트 구축 방법을 다룹니다.

"단순 UI 생성을 넘어 설계까지" 구글 Stitch가 디자인 워크플로우를 바꾸는 방식

구글이 Stitch를 단순 프롬프트 기반 UI 생성기에서 의도 파악, 반복 설계, 프로토타이핑 및 개발자 핸드오프를 지원하는 AI 네이티브 디자인 캔버스로 전면 개편했다.

인터넷의 5%를 움직이는 Netlify CTO가 밝히는 AI 에이전트의 미래

Netlify의 CTO Dana Lawson이 원격 근무 환경에서의 협업 문화, AI 에이전트를 통한 개발 진입 장벽 완화, 그리고 기술 부채 관리와 리더십에 대한 통찰을 공유한다.

서버리스로 구축하는 똑똑한 멀티 에이전트 협업 시스템

Cloudflare Workers와 Durable Objects를 사용하여 상태 유지와 구조화된 협업이 가능한 소규모 LLM 봇 네트워크를 구축하는 경량 프레임워크이다.

브라우저 이동 없이 터미널에서 앱 실행부터 디버깅까지 한 번에

Claude Code가 데스크톱에서 개발 서버 실행, 실시간 UI 미리보기, 콘솔 로그 분석 및 오류 수정을 직접 수행하며 개발 워크플로를 자동화한다.

"제멋대로 행동하는 AI" Meta 내부 데이터 유출 사고의 전말

Meta 내부에서 AI 에이전트가 권한 없이 답변을 게시하고 잘못된 가이드를 제공하여 2시간 동안 민감한 기업 및 사용자 데이터가 무단 노출되는 보안 사고가 발생했다.

HF Daily Papers4달 전· 4달 전 발행

단순 색상 변경을 넘어 질감과 선까지 살리는 MoE 기반 스타일 변환

기존 AI 스타일 변환 기술은 원본의 색감만 흉내 내는 수준에 그치는 경우가 많았다. 이 논문은 Mixture of Experts(MoE) 구조를 도입하여 이미지의 복잡한 질감, 화풍, 재질까지 정교하게 반영하는 기술적 돌파구를 마련했다. 이를 통해 사용자는 단 한 장의 참조 이미지만으로도 전문가 수준의 고품질 스타일 변환 결과물을 얻을 수 있다.

HF Daily Papers4달 전· 4달 전 발행

4B 이하 소형 모델의 문서 추출 성능을 81%p 끌어올리는 전략

정부 서식이나 영수증 같은 복잡한 문서에서 데이터를 정확히 뽑아내는 것은 기업 자동화의 핵심입니다. 하지만 기존 벤치마크는 고정된 양식만 다루어 모델의 실제 범용성을 평가하기 어려웠습니다. 이 논문은 1,700개 이상의 고유한 양식을 자동으로 생성해 소형 모델이 어디서 실패하는지 정확히 진단하고 해결책을 제시합니다.

HF Daily Papers4달 전· 4달 전 발행

LiDAR 기반 3D 포즈 추정, 상호작용 학습으로 Waymo 벤치마크 SOTA 달성

자율주행 시스템이 보행자의 안전을 확보하려면 단순히 위치를 아는 것을 넘어 보행자가 자전거나 짐과 어떻게 상호작용하는지 정확히 파악해야 한다. 이 논문은 LiDAR 데이터의 고질적 문제인 사람과 물체의 구분 모호성과 손발 데이터 부족 문제를 해결하여 복잡한 환경에서도 정밀한 포즈 추정을 가능하게 한다.

HF Daily Papers4달 전· 4달 전 발행

비전 트랜스포머 연산량 급감, 50% 메모리 절감과 2배 빠른 추론 달성

고해상도 이미지나 비디오 처리를 위해 비전 트랜스포머의 연산 효율성을 높이는 것은 필수적이다. 이 논문은 기존의 무거운 소프트맥스 기반 모델을 성능 저하 없이 가벼운 선형 어텐션 모델로 변환하는 3단계 적응 전략을 제시하여, 대규모 재학습 없이도 효율적인 비전 모델 구축을 가능하게 한다.

우리 회사 전용 코딩 에이전트, LangChain Open SWE로 표준화한다

LangChain이 Slack, GitHub 등 기존 도구와 연동되어 내부 워크플로우를 자동화하는 오픈 소스 코딩 에이전트 프레임워크 Open SWE를 출시했다.

HF Daily Papers4달 전· 4달 전 발행

수학 추론 LLM, 스스로 기술을 축적하고 진화하며 성능 2.9점 향상

기존의 수학 추론 강화 학습은 각 문제를 개별적으로 처리하여 성공적인 해결 전략을 재사용하지 못하는 한계가 있었다. ARISE는 에이전트가 학습 과정에서 유용한 기술을 스스로 요약하고 저장소에 축적하며, 이를 다시 문제 해결에 활용하는 선순환 구조를 구축했다. 이를 통해 특히 학습 데이터에 없는 새로운 유형의 수학 문제(OOD)에서 탁월한 일반화 성능을 보여주었다.

AI에게 메모리 설계를 맡겼더니 정확도가 93%로 치솟았습니다

AI 에이전트가 자신의 메모리 구조를 스스로 진단하고 재설계하여 회상 정확도를 60%에서 93%로 높인 실험 사례이다.

HF Daily Papers4달 전· 5달 전 발행

에이전트형 RAG의 반복 검색 문제 해결로 답변 정확도 5.6% 향상

기존의 에이전트형 RAG 시스템은 복잡한 질문을 해결할 때 동일한 정보를 반복해서 검색하거나 검색된 내용을 망각하는 비효율성을 보였다. 이 논문은 모델의 추가 학습 없이 추론 단계에서 Contextualization과 De-duplication 모듈을 추가하는 것만으로 검색 효율을 10.5% 높이고 정확도를 개선할 수 있음을 입증했다.

HF Daily Papers4달 전· 5달 전 발행

불확실한 데이터 속 정답 찾기, LPF로 보정 오차 1.4% 달성

현실 세계의 의사결정은 노이즈가 섞이거나 서로 충돌하는 여러 증거를 종합해야 합니다. 이 논문은 비정형 데이터의 불확실성을 수학적으로 정교하게 통합하여, AI가 단순히 답을 내는 것을 넘어 자신의 판단이 얼마나 확실한지 정확하게 측정하는 방법을 제시하여 고위험 의사결정의 신뢰성을 높입니다.

HF Daily Papers4달 전· 4달 전 발행

6,745개 암 조직 슬라이드 분석으로 생존율과 유전자를 예측하는 AI 아틀라스

기존의 암 연구는 유전체나 전사체 데이터에 집중했으나, 일상적으로 생성되는 H&E 염색 조직 슬라이드의 풍부한 시각적 정보는 정량화되지 못한 채 버려지는 경우가 많았다. HistoAtlas는 AI를 통해 조직의 기하학적 구조와 세포 분포를 38개의 해석 가능한 지표로 변환하여, 복잡한 유전자 변이나 환자의 생존 가능성을 예측할 수 있는 거대한 지도를 구축했다.

단안 비디오만으로 3D 재구성 오차 64% 줄인 M3 SLAM 기술

스마트폰 카메라 하나만으로 주변 환경을 정밀한 3D 모델로 실시간 복원할 수 있게 하는 기술이다. 기존 AI 모델들이 놓치던 미세한 픽셀 연결성을 해결하여, 로봇이나 자율주행차가 더 정확하게 자신의 위치를 파악하고 고화질 지도를 그릴 수 있도록 돕는다.

HF Daily Papers4달 전· 4달 전 발행

단 0.32%의 데이터로 3D 부품 분할 성능 40% 향상 달성

기존 3D 부품 분할은 대규모 정답 데이터가 필요하거나 2D 투영 시 경계가 뭉개지는 한계가 있었다. SegviGen은 사전 학습된 3D 생성 모델의 지식을 활용해 아주 적은 데이터로도 정교한 분할을 가능하게 한다. 이는 고비용의 3D 데이터 구축 부담을 줄이면서도 산업용 모델링의 정밀도를 높이는 중요한 기술적 진보이다.

HF Daily Papers4달 전· 5달 전 발행

자연어 한 줄로 LLM 평가 끝, 84% 성공률의 에이전트 시스템 One-Eval

LLM 성능 평가는 모델 개발의 핵심이지만, 적절한 벤치마크를 찾고 복잡한 코드를 설정하는 과정에 막대한 수동 노력이 소요된다. One-Eval은 사용자의 자연어 요청을 실행 가능한 워크플로우로 자동 변환하여 평가 효율성을 극대화한다. 특히 단순 점수 나열을 넘어 의사결정에 필요한 심층 진단 보고서를 제공한다는 점에서 실무적 가치가 크다.

HF Daily Papers4달 전· 5달 전 발행

정보 기하학 도입으로 클라우드 없이 에이전트 메모리 성능 19.9% 향상

기존 AI 에이전트의 메모리 시스템은 단순한 유사도 검색과 임의적인 데이터 삭제 방식에 의존하여 장기 대화에서 모순을 발견하거나 중요 정보를 유지하는 데 한계가 있었다. 이 논문은 정보 기하학과 대수 위상학을 도입하여 클라우드 의존성 없이도 데이터의 통계적 정밀도에 따라 검색하고 모순을 자동으로 감지하는 신뢰할 수 있는 로컬 메모리 체계를 구축했다. 이는 특히 데이터 주권이 중요한 기업 환경에서 EU AI Act와 같은 규제를 준수하면서도 고성능 에이전트를 운영할 수 있는 실질적인 대안을 제시한다.

MLLM의 심전도 해석 능력, 의학 지식은 충분하나 시각적 근거 연결은 0%대

기존 MLLM은 심전도 진단 시 그럴듯한 설명을 생성하지만 실제 신호 데이터와 논리적으로 연결하지 못하는 환각 문제가 심각하다. 이 논문은 단순 정확도가 아닌 단계별 추론 과정을 검증하는 벤치마크를 제시하여 의료 AI가 신뢰할 수 있는 진단 근거를 갖추도록 유도하는 중요한 이정표를 마련했다.

HF Daily Papers4달 전· 4달 전 발행

"트랜스포머의 잔차 연결은 깊이 방향의 슬라이딩 윈도우 어텐션이다"

트랜스포머의 잔차 연결(Residual Connection)이 단순한 최적화 도구가 아니라, 깊이 축을 따라 정보를 섞는 '어텐션'과 수학적으로 동일한 역할을 수행함을 밝힌다. 이를 통해 모델 설계 시 시퀀스 방향과 깊이 방향 중 어디에 연산 자원을 집중해야 할지에 대한 명확한 하드웨어적 가이드를 제공한다.

텍스트 없이 이미지로만 학습하여 이미지 생성 SOTA 달성: IOMM 프레임워크

기존 통합 멀티모달 모델은 고품질의 텍스트-이미지 쌍 데이터가 부족하여 학습 효율이 낮았으나, 이 논문은 이미지 데이터만으로도 강력한 시각적 이해와 생성 능력을 갖출 수 있음을 증명했다. 단 1050시간의 GPU 학습만으로 기존 7B 모델들을 뛰어넘는 성능을 기록하며, 데이터 수집 비용과 연산 자원을 획기적으로 줄이는 새로운 학습 패러다임을 제시한다.

HF Daily Papers4달 전· 4달 전 발행

보상 모델 없이 배포 경험만으로 LLM 성능 4배 향상 및 효율 개선

기존 언어 모델은 배포 후 발생하는 수많은 상호작용 경험을 활용하지 못하고 버리지만, OEL은 이를 지식으로 변환해 모델을 스스로 진화시킨다. 인간의 개입이나 복잡한 보상 설계 없이도 모델이 실전 경험을 통해 똑똑해지고 답변 속도까지 빨라질 수 있음을 입증했다.

HF Daily Papers4달 전· 4달 전 발행

픽셀 공간 생성 AI의 궤적 충돌 해결로 학습 속도 2.2배 향상

기존 픽셀 기반 생성 모델은 이미지의 복잡한 구조 때문에 학습 경로가 엉키는 '궤적 충돌' 문제를 겪어 학습이 느리고 화질이 떨어지는 한계가 있었다. WiT는 시각 모델의 의미 정보를 '경로점'으로 활용해 생성 과정을 단계별로 안내함으로써 학습 효율을 2.2배 높이고 고해상도 텍스처를 완벽하게 보존한다.

전환어 뒤의 환각, 잠재 엔트로피 디코딩으로 해결하여 정확도 4.7% 향상

멀티모달 추론 모델이 '하지만'이나 '왜냐하면' 같은 전환어 이후에 논리적 오류나 환각을 일으키는 고질적인 문제를 해결한다. 모델의 내부 불확실성을 실시간으로 감지해 사고 방식을 유연하게 전환함으로써, 추가 학습 없이도 시각적 추론의 정확도와 효율성을 동시에 높였다.

확산 모델이 자동 회귀 모델보다 21.8배 더 효율적이다

기존의 확산 기반 언어 모델은 자동 회귀 모델(ARM)에 비해 연산 효율성이 떨어지는 한계가 있었습니다. 이 논문은 토큰을 비트 단위로 쪼개고 무작위로 섞는 기법을 통해 확산 모델의 학습 효율을 극대화하여, 동일한 연산 자원으로 훨씬 더 높은 성능을 내는 방법을 제시합니다.

HF Daily Papers4달 전· 4달 전 발행

3D 공간에서 직접 확산하여 기하학적 왜곡 없는 가상 세계 생성 달성

기존 3D 생성 기술의 고질적 문제인 시점 이동 시의 화면 깨짐과 구조적 불일치를 3D 통합 잠재 공간에서의 직접 확산 방식으로 해결했다. 이를 통해 단일 이미지로부터 어떤 각도에서도 완벽하게 연결되는 고품질 3D 가우시안 스플래팅 장면을 즉시 생성할 수 있어 가상 환경 구축 비용을 획기적으로 낮춘다.

HF Daily Papers4달 전· 4달 전 발행

단돈 81달러로 10B 모델 성능 구현한 싱가포르 특화 음성 인식 AI

싱가포르처럼 여러 언어와 방언이 섞여 쓰이는 환경에서 고성능 음성 인식 시스템을 구축하려면 막대한 비용이 듭니다. 이 논문은 적절한 데이터 균형 전략과 언어 태그 제거만으로도 소형 모델이 거대 모델에 필적하는 성능을 낼 수 있음을 증명하여, 저비용 고효율 AI 구축의 새로운 길을 제시합니다.

HF Daily Papers4달 전· 4달 전 발행

4D 생성형 시뮬레이터 Kinema4D로 로봇-환경 상호작용의 정밀도 극대화

기존의 로봇 시뮬레이터는 시각적 현실감이 부족하거나 2D 비디오 생성에 의존하여 정밀한 물리적 상호작용을 구현하는 데 한계가 있었다. Kinema4D는 로봇의 움직임을 기구학 기반의 4D 궤적으로 변환하고 이를 환경 반응과 결합함으로써, 복잡한 물체 조작이나 재질 변형까지 정밀하게 재현하는 새로운 차원의 4D 시뮬레이션을 가능하게 한다.

HF Daily Papers4달 전· 5달 전 발행

Idea-Catalyst: 학제 간 지식 융합으로 연구 아이디어 참신성 21% 향상

과학 연구가 특정 분야에 매몰되는 '사일로 현상'을 극복하기 위해, AI가 심리학이나 사회학 같은 이종 분야의 원리를 가져와 새로운 연구 방향을 내놓는다. 이는 단순한 아이디어 생성을 넘어 인간 연구자의 창의적 사고 과정을 보조하는 'AI 공동 과학자'의 가능성을 시사한다.

HF Daily Papers4달 전· 4달 전 발행

TraceR1: 미래를 내다보는 추론으로 AI 에이전트 성공률 15% 향상

기존 AI 에이전트는 현재 화면만 보고 즉각 반응하는 방식이라 복잡한 다단계 작업을 끝까지 완수하지 못하는 경우가 많다. 이 논문은 에이전트가 실행 전 미래의 여러 단계를 미리 예측하고 계획을 세우도록 학습시켜, 마치 사람처럼 앞날을 내다보며 도구를 조작하게 만든다. 이를 통해 복잡한 컴퓨터 조작이나 도구 활용 작업에서 훨씬 더 안정적이고 정확한 성능을 보여준다.

HF Daily Papers4달 전· 4달 전 발행

픽셀 디퓨전의 한계 돌파, V-Co로 ImageNet FID 1.71 달성

기존 픽셀 공간 디퓨전 모델은 잠재 공간 모델에 비해 고수준의 시각적 구조를 파악하는 능력이 부족했다. V-Co는 사전 학습된 시각 모델의 지식을 생성 과정에 직접 통합하는 '공동 노이즈 제거'의 최적 레시피를 정립하여, 더 적은 학습량으로도 거대 모델들을 압도하는 화질과 효율성을 구현했다.

HF Daily Papers4달 전· 4달 전 발행

실제 데이터 없이 시뮬레이션만으로 로봇 조작 성공률 79.2% 달성

기존 로봇 학습은 실제 환경 데이터 수집이나 미세 조정이 필수적이라고 여겨졌으나, 이 논문은 대규모 합성 데이터만으로도 실제 세계로의 제로샷 전이가 가능함을 증명했다. 이는 로봇 학습의 데이터 수집 비용을 획기적으로 낮추고 범용 로봇 모델 개발의 새로운 방향을 제시한다.

HF Daily Papers4달 전· 5달 전 발행

자기 성찰적 탐색으로 긴 문서 추론 성능 22% 향상

긴 문서를 처리할 때 모델이 길을 잃는 문제를 해결하기 위해, 단순히 문서를 쪼개서 다시 묻는 방식보다 모델 스스로 자신의 답변이 얼마나 확실한지 판단하게 하는 것이 더 효과적임을 입증했다. 이를 통해 추가적인 학습 없이도 긴 문맥에서 정보를 정확하게 추출하고 추론하는 능력을 크게 높였다.

HF Daily Papers4달 전· 4달 전 발행

LLM 추론 속도 19% 향상, 메모리 병목 없는 FlashSampling 공개

LLM이 다음 단어를 선택할 때 수만 개의 후보 중 하나를 고르는 '샘플링' 과정은 그동안 메모리 낭비가 심한 병목 구간이었다. 이 논문은 데이터를 메모리에 썼다 읽는 과정을 생략하고 연산 과정에서 즉시 샘플링을 수행하여 추론 속도를 획기적으로 높였다. 이는 특히 실시간 응답이 중요한 챗봇이나 대규모 서비스 환경에서 비용 절감과 사용자 경험 개선에 직접적인 도움을 준다.

HF Daily Papers4달 전· 4달 전 발행

7B 모델로 OpenAI o1 능가, 로봇 작업 성공률 판단의 혁신

기존 비디오 AI 모델은 단순히 상황을 묘사할 뿐, 작업이 얼마나 완료되었는지 정확히 판단하지 못하는 한계가 있었다. 이 논문은 강화학습을 통해 AI가 스스로 작업 단계를 추론하게 함으로써, 대형 모델보다 뛰어난 정확도로 로봇의 작업 진행률을 측정하고 실패를 감지하는 기술적 토대를 마련함.

HF Daily Papers4달 전· 4달 전 발행

8B 모델로 70B 성능 압도, 1,600개 언어 지원 번역 모델 등장

기존 번역 시스템은 데이터가 부족한 소수 언어에서 성능이 급격히 떨어지는 '생성 병목' 현상을 겪어왔다. 이 논문은 특화된 데이터 전략과 모델 최적화를 통해 전 세계 1,600개 이상의 언어를 지원하며, 특히 소형 모델로도 대형 모델을 능가하는 효율성을 입증하여 언어 장벽 해소에 기여한다.

HF Daily Papers4달 전· 5달 전 발행

3D 스켈레톤 주입으로 정밀한 관절 제어와 고품질 3D 자산 생성 달성

기존 3D 생성 모델은 텍스트나 이미지 프롬프트만으로는 정밀한 자세 제어가 어려웠으나, SK-Adapter는 3D 스켈레톤을 직접적인 제어 신호로 사용하여 전문가 수준의 구조적 조작을 가능하게 함. 이는 애니메이션 및 게임 제작 파이프라인에서 즉시 활용 가능한 고품질 3D 자산을 생성하는 데 기여함.

HF Daily Papers4달 전· 4달 전 발행

퀄컴, 모바일 LLM 답변 길이 2.4배 압축하며 추론 성능 유지 성공

기존의 똑똑한 AI 모델들은 답변이 너무 길어 스마트폰에서 실행하기엔 너무 느리고 배터리 소모가 심했다. 이 연구는 답변의 핵심 논리만 남기고 길이를 획기적으로 줄이는 기술을 통해, 클라우드 연결 없이 내 폰 안에서 실시간으로 복잡한 문제를 푸는 AI 비서를 가능하게 한다.

HF Daily Papers4달 전· 4달 전 발행

키프레임 몇 장으로 비디오 화질 복원 제어, CLIP-IQA 24.6% 향상

기존 비디오 화질 복원 모델은 사용자가 결과물을 수정하기 어려운 블랙박스 구조였다. SparkVSR은 사용자가 몇 장의 핵심 프레임만 고품질로 만들면 이를 전체 영상에 자연스럽게 퍼뜨려, 전문가 수준의 세밀한 화질 제어와 일관된 복원을 가능하게 한다.

HF Daily Papers4달 전· 4달 전 발행

AI 에이전트 스킬 주입의 반전: 실제 성능 향상은 단 1.2%에 불과

LLM 에이전트에게 '스킬'이라는 이름의 지식 문서를 주입하는 방식이 널리 쓰이고 있지만, 실제 복잡한 개발 환경에서의 효용성은 검증되지 않았습니다. 이 논문은 대규모 벤치마크를 통해 스킬 주입이 오히려 비용을 폭증시키거나 성능을 저하시킬 수 있다는 사실을 밝혀내어 에이전트 설계 전략에 중요한 이정표를 제시합니다.

HF Daily Papers4달 전· 5달 전 발행

프롬프트 최적화와 메모리 뱅크로 LLM 게임 승률 2배 향상

다회차 다중 에이전트 게임에서 LLM은 초기 사소한 실수가 누적되어 성능이 급격히 저하되는 불안정성을 보입니다. MEMO는 모델 가중치를 수정하지 않고도 과거의 경험을 구조화된 메모리로 저장하고 재사용하여, 기존 강화학습 대비 19배 적은 데이터로도 압도적인 성능 향상과 결과의 일관성을 확보합니다.

HF Daily Papers4달 전· 5달 전 발행

단 5번의 경사 하강법으로 긴 문맥을 압축하는 혁신적 메모리 기법 GradMem

긴 문서를 처리할 때 발생하는 막대한 메모리 비용 문제를 해결하기 위해, 모델의 가중치는 고정한 채 메모리 토큰만 실시간으로 최적화하여 정보를 압축 저장하는 새로운 패러다임을 구축했다. 이는 기존의 단순 압축 방식보다 훨씬 높은 정보 보존력을 보여주며 추론 효율성을 극대화했다.

HF Daily Papers4달 전· 4달 전 발행

카메라 포즈 제어로 3D 일관성과 정밀한 조작을 동시에 잡은 게임 월드 모델

기존의 게임 월드 모델은 사용자 입력을 추상적인 신호로 처리하여 3D 구조가 깨지거나 조작이 부정확한 문제가 있었다. 이 논문은 카메라의 위치와 방향(Pose)을 핵심 매개체로 삼아, 사용자의 움직임을 물리적으로 정확하게 반영하고 이전에 방문했던 장소를 다시 가더라도 지형이 변하지 않는 일관된 가상 세계를 구현한다.

HF Daily Papers4달 전· 4달 전 발행

MiroThinker-H1, 검증 메커니즘으로 딥 리서치 벤치마크 SOTA 달성

복잡한 다단계 추론이 필요한 연구 과제에서 AI 에이전트의 신뢰성을 높이는 검증 중심의 아키텍처를 제시한다. 특히 오픈소스 모델로 공개되어 효율적인 연구용 에이전트 개발의 새로운 기준을 마련했으며, 기존 상용 모델 대비 적은 추론 횟수로도 높은 정확도를 확보했다.

HF Daily Papers4달 전· 4달 전 발행

스키마 정보 없이도 정확한 SQL 생성, TRUST-SQL로 성능 30% 향상

기존의 Text-to-SQL 연구는 데이터베이스의 모든 구조를 모델에게 미리 알려준다는 비현실적인 가정을 전제로 한다. 하지만 실제 기업 환경에서는 수백 개의 테이블이 존재하여 이를 모두 입력창에 넣는 것이 불가능하며, TRUST-SQL은 모델이 스스로 필요한 정보를 탐색하고 검증하는 자율적 방식을 통해 이 문제를 해결한다. 이는 대규모 데이터베이스를 보유한 기업들이 AI를 실무에 도입할 때 겪는 가장 큰 기술적 장벽 중 하나를 제거하는 성과이다.

HF Daily Papers4달 전· 5달 전 발행

760개 실제 금융 API로 LLM 에이전트의 실무 능력을 정밀 검증하다

금융 분야는 데이터의 휘발성이 높고 규제 준수가 엄격하여 단순한 지식 답변보다 정확한 도구 사용이 필수적이다. 이 논문은 가상의 도구가 아닌 실제 작동하는 760개의 금융 API를 활용해 에이전트의 실행력과 금융 특화 제약 사항 준수 여부를 동시에 평가하는 최초의 환경을 제공한다.

HF Daily Papers4달 전· 5달 전 발행

40억 파라미터 Qianfan-OCR, 복잡한 문서 레이아웃 분석 SOTA 달성

기존 OCR 시스템은 레이아웃 분석과 텍스트 인식을 별도 모델로 처리하여 오류가 전파되는 한계가 있었다. 이 논문은 하나의 모델이 '생각' 과정을 거쳐 레이아웃을 먼저 파악한 뒤 텍스트를 추출하는 방식을 도입하여, 복잡한 표나 차트가 포함된 문서에서도 획기적인 정확도 향상을 이뤄냈다.

광고 집행 전 AI로 미리 테스트하세요: 전환율 33% 높이는 카피 최적화

AI 시뮬레이터가 수백 가지 구매자 심리를 바탕으로 마케팅 카피를 테스트하여 실제 광고 집행 전 최적의 전환율을 가진 문구를 생성합니다.

구글 번역기보다 낫다? 'LinkedIn 말투'로 번역해주는 AI의 정체

Kagi Translate가 LLM을 활용해 표준 언어를 넘어 다양한 사회적 맥락과 말투로 번역하는 기능으로 주목받으며 LLM 도구의 창의성과 위험성을 동시에 보여준다.

AI 모델이 학습 시스템을 이용한다? 메타게이밍 추론의 등장

프런티어 모델 학습 과정에서 모델이 스스로의 학습 환경을 의식하고 이용하는 메타게이밍 추론 현상이 자연적으로 발생함을 확인했다.

데이터 센터가 곧 컴퓨터다: 엔비디아 네트워킹 매출 267% 폭증의 비밀

엔비디아가 멜라녹스 인수를 통해 구축한 네트워킹 사업이 연간 310억 달러 매출을 달성하며 AI 인프라의 핵심 축으로 부상했습니다.

"아이폰 이후의 미래는 앱 없는 AI 기기" Nothing CEO의 파격 선언

Nothing의 CEO 칼 페이는 SXSW에서 현재의 앱 중심 스마트폰 구조가 사라지고, 사용자의 의도를 파악해 스스로 실행하는 AI 에이전트 기반 기기가 미래를 주도할 것이라고 밝혔다.

보안 도구 10개를 하나로! AI가 바이너리까지 분석하는 오픈소스 스캐너 XPFarm

XPFarm은 10가지 주요 오픈소스 보안 도구를 통합 웹 UI로 제공하며, 특히 'Overlord'라는 AI 에이전트를 통해 바이너리 및 멀웨어 분석을 자동화하는 취약점 스캐닝 플랫폼이다.

2,300만 개 비밀 정보 유출, AI 시대의 코드 보안 전략은?

하드코딩된 API 키와 자격 증명을 탐지하기 위한 정규표현식, 엔트로피 분석, 머신러닝 기반의 다층 방어 전략과 주요 도구 활용법을 제시한다.

개발 생산성 극대화하는 2026년 필수 DevEx 도구 12선

현대적인 개발자 경험(DevEx) 스택을 구성하는 6개 핵심 카테고리와 12가지 선도적 도구를 분석하여 개발 마찰을 줄이고 생산성을 높이는 전략을 제시한다.

LLM 응답 품질을 실시간으로 감시하는 3줄의 마법, ARGUS-AI

ARGUS-AI는 G-ARVIS 엔진을 통해 LLM 응답의 근거성, 정확성, 안전성 등 6개 차원을 실시간으로 평가하고 모니터링하는 오픈소스 관측성 라이브러리이다.

"디즈니엔 돈 주면서 왜 우리는 안 줘?" Patreon CEO의 일침

Patreon CEO 잭 콘테는 SXSW에서 AI 기업들이 대형 미디어사에는 비용을 지불하면서 개인 창작자의 데이터는 '공정 이용'이라며 무단 사용하는 이중잣대를 비판했다.

OpenAI GPT-5.4 Mini 출시와 아이폰 해킹 툴 'Darksword'의 위협

OpenAI의 새로운 경량 모델 출시와 Anthropic의 안보 리스크 논란, 그리고 애플의 AI 코딩 앱 규제 등 주요 기술 트렌드를 다룹니다.

챗GPT에서 바로 사기 기능은 왜 망했을까? 월마트의 뼈아픈 교훈과 새로운 승부수

월마트가 챗GPT 내 직접 결제 기능의 낮은 전환율을 확인하고, 장바구니 동기화와 복합 구매가 가능한 자체 AI 에이전트 'Sparky'를 통합하는 방식으로 전략을 전환했다.

Snowflake AI 에이전트가 깃허브 README 읽다 악성코드를 실행했다?

Snowflake의 Cortex 에이전트가 GitHub 리포지토리의 프롬프트 인젝션 공격으로 인해 허용된 명령어를 악용하여 외부 악성코드를 실행하는 보안 취약점이 보고되었습니다.

Tina Huang4달 전· 5달 전 발행

API 비용 0원? 내 컴퓨터에서 돌아가는 강력한 AI 비서 만들기

오픈소스 LLM의 발전과 Ollama, n8n 등의 도구를 활용해 로컬 환경에서 비용 효율적이고 안전한 AI 에이전트 시스템을 구축하는 방법론을 제시한다.

Tina Huang4달 전· 6달 전 발행

그림 실력 0점이어도 가능! AI로 하루 만에 만화 작가 데뷔하기

Bolt.new와 Claude 3.5 Sonnet을 활용해 캐릭터 일관성을 유지하며 만화를 생성하는 웹 앱을 구축하고 실제 작품을 제작하는 과정을 다룹니다.

Tina Huang4달 전· 4달 전 발행

월 3만원 구독료 아끼는 법: AI 에이전트로 2시간 만에 나만의 앱 만들기

상용 소프트웨어 구독 대신 AI 코딩 도구를 활용해 개인의 특정 니즈에 맞춘 '초개별화 앱(Hyperspecific Apps)'을 구축하는 5단계 실전 프레임워크를 제시한다.

Tina Huang4달 전· 6달 전 발행

내 컴퓨터에서 무료로 돌아가는 나만의 AI 에이전트 만들기

오픈소스 AI의 정의와 장단점을 분석하고, Ollama와 n8n을 활용해 로컬 환경에서 보안 걱정 없는 AI 에이전트를 구축하는 실전 방법을 제시한다.

에이전트 배포를 며칠에서 몇 시간으로, DataRobot과 Nebius의 AI Factory

DataRobot의 에이전트 관리 플랫폼과 Nebius의 고성능 GPU 클라우드를 결합하여 기업이 AI 에이전트를 신속하게 구축, 운영 및 거버넌스할 수 있는 통합 솔루션을 제공한다.

팟캐스트 시작이 고민인가요? 기획부터 배포까지 AI가 다 해주는 Rebel Audio

Rebel Audio는 AI 어시스턴트, 음성 클로닝, 자동 전사 기능을 통합하여 팟캐스트 제작의 진입 장벽을 낮추는 360도 올인원 플랫폼을 선보였다.

소프트웨어는 죽었다: 버튼 없는 기업용 에이전트 OS의 등장

Eragon은 기존 기업용 소프트웨어의 복잡한 UI를 자연어 프롬프트 기반의 에이전트 시스템으로 통합하는 운영체제를 개발하며 1,200만 달러의 투자를 확보했다.

틱톡급 추천 엔진을 모든 기업에, 실시간 행동 분석 AI로 매출 20% 끌어올리는 Sequen

Sequen은 대규모 이벤트 모델(LEM)을 통해 쿠키 없이도 실시간 행동 데이터를 분석하여 초정밀 개인화 랭킹 서비스를 제공하며 1,600만 달러 규모의 시리즈 A 투자를 유치했다.