본문으로 건너뛰기

2026년 3월 4일 AI 뉴스

70

관심 태그 추가

내 회의 데이터가 클라우드로? 보안 걱정 없는 자가 호스팅 MCP 서버 등장

Fireflies와 Otter.ai의 폐쇄형 MCP 서버 출시에 대응하여, 회의 데이터를 안전하게 자가 호스팅하고 Claude와 연동할 수 있는 오픈소스 프로젝트 Vexa를 소개합니다.

로컬에서만 돌아가는 에이전트는 그만, 진짜 프로덕션용 LangGraph 가이드

LangGraph를 사용하여 상태 유지와 체크포인팅 기능을 갖춘 실전용 고객 지원 에이전트를 구축하고 그 과정을 10단계 가이드로 정리하여 공유합니다.

클라우드 없이 구현하는 4K 실시간 창고 모니터링과 로컬 RAG 시스템

Mac Mini M4 Pro와 오픈소스 모델을 활용하여 보안과 비용 효율성을 극대화한 산업용 온프레미스 AI 모니터링 및 분석 시스템 구축 방안을 제시합니다.

Gemma 3 27B가 12B보다 낮다? 로컬 LLM 리더보드 충격 결과

Artificial Analysis가 발표한 로컬 친화적 LLM 리더보드에서 Qwen3.5 시리즈가 상위권을 휩쓸며 모델 크기 대비 뛰어난 지능 지수를 보여주었습니다.

오픈소스 최강 모델의 탄생? ZetaChroma와 LoRA 학습 지원 소식

Lodestones의 ZetaChroma 모델이 공개되었으며, 개발자 Ostris가 이를 활용한 LoRA 학습 도구 통합을 위해 ComfyUI 환경에서 테스트를 진행 중이라는 소식입니다.

벡터 DB 없이 구현하는 로컬 우선 AI 에이전트 메모리 엔진

벡터 데이터베이스의 인프라 복잡성과 클라우드 의존성을 해결하기 위해 O(k) 검색 성능을 갖춘 로컬 바이너리 기반의 에이전트 메모리 엔진 Synrix를 제안합니다.

MLOps 면접 필승 전략: LLM 앱의 내부 동작 원리 완벽 해부

사용자의 프롬프트가 LLM 앱에 전달되어 응답이 생성되기까지의 전 과정을 아키텍처 관점에서 상세히 설명하며 MLOps 면접 준비를 돕습니다.

r/artificial5달 전

시키지도 않았는데 보안 툴을? AI 에이전트가 보여준 의외의 자율성

개발자의 고충을 분석하도록 설정된 자율 AI 에이전트들이 명시적 지시 없이도 보안 및 안전 관련 도구를 우선적으로 개발하는 현상을 공유하고 그 원인을 고찰합니다.

실전 LLM 에이전트 보안, PII 유출과 프롬프트 인젝션 어떻게 막고 계신가요?

프로덕션 환경의 LLM 에이전트에서 발생하는 개인정보 유출 및 프롬프트 인젝션 문제를 해결하기 위한 보안 거버넌스와 관측성 확보 방안을 논의합니다.

CPU에서 1000배 빠른 무선 전파 모델링: GFlowNet의 혁신적 활용

Generative Flow Networks를 사용하여 기존 레이 트레이싱의 지수적 복잡도 문제를 해결하고 무선 전파 모델링 속도를 획기적으로 개선한 연구 결과와 오픈소스 코드를 공유합니다.

7B 모델이 72B를 압도? 이번 주 꼭 확인해야 할 비전 AI 뉴스

HART 프레임워크와 VGUBench 등 지난주 발표된 멀티모달 AI 및 컴퓨터 비전 분야의 핵심 논문과 도구들을 요약한 소식입니다.

AI 캐릭터 외모가 변한다면? 고정 시드로 95% 일관성 확보하기

AI 컴패니언 캐릭터의 외모 일관성을 유지하기 위해 고정된 시드(Seed) 값과 엄격한 프롬프트 구조를 결합하여 외모 변화율을 5% 미만으로 낮춘 사례를 공유합니다.

에이전트가 왜 400달러를 썼을까? AI 운영의 블랙박스를 해결하는 Syntropy

AI 에이전트의 모든 호출을 기록하고 보안 위협 차단 및 규제 준수 보고서를 자동 생성하는 프로덕션용 거버넌스 인프라 Syntropy가 공개되었습니다.

단 한 명의 직원 없이 수십억 매출을 올리는 AI 기업의 시대가 온다

AI 에이전트 기술의 발전으로 최소한의 인력 혹은 인간 없이 운영되는 제로 휴먼 컴퍼니의 가능성과 최신 AI 업계 동향을 분석합니다.

텍스트 한 줄로 게임 같은 세상을? 구글 프로젝트 지니 활용 가이드

구글의 연구 프로토타입인 프로젝트 지니를 활용해 텍스트와 이미지로 나만의 인터랙티브 가상 세계를 구축하고 탐험하는 구체적인 프롬프트 전략을 소개합니다.

내가 만든 AI 에이전트, 믿을 수 있을까? OAGS로 구현하는 투명한 거버넌스

AI 에이전트의 신원 확인, 실행 제약 조건 강제, 독립적 감사 추적을 위한 개방형 표준 사양인 OAGS가 공개되었습니다.

반품률 획기적으로 줄이는 비결: Amazon Nova로 구현하는 실시간 가상 피팅

Amazon Nova Canvas의 가상 피팅 기능을 활용하여 소매업체가 반품률을 낮추고 고객 경험을 개선할 수 있는 확장 가능한 서버리스 아키텍처 구축 방법을 소개합니다.

8배 빨라진 애플 M5 칩과 메타 스마트 안경의 사생활 논란

애플의 차세대 M5 칩 발표와 OpenAI의 군사 계약 논란, 메타의 AI 쇼핑 도구 및 사생활 침해 이슈 등 최신 기술 동향을 정리합니다.

환각 없는 AI의 등장? 지식 그래프를 직접 출력하는 Kanon 2 Enricher

Kanon 2 Enricher는 토큰 대신 지식 그래프를 직접 출력하여 환각을 원천 차단하고 문서의 계층 구조와 엔티티 관계를 정밀하게 추출하는 로컬 실행 가능 모델입니다.

단돈 1500달러와 24시간으로 고성능 이미지 생성 모델 만들기

Photoroom 팀이 32대의 H200 GPU와 최신 최적화 기법을 결합하여 24시간 만에 고품질 텍스트-이미지 변환 모델을 학습시킨 실험 과정과 레시피를 공유합니다.

신경망 레이어 대신 최적화 블록을? ICLR이 주목한 행동 학습 패러다임

ICLR에 제출된 이 논문은 기존 신경망 레이어를 제약 조건이 있는 최적화 블록으로 대체하여 의사결정 프로세스를 모델링하는 행동 학습(Behavior Learning) 기법을 제안합니다.

"단순 도구 사용을 넘어 AI의 원리와 윤리까지" CMU의 새로운 초등 AI 교육

CMU CREATE 랩과 파트너들이 협력하여 초등학생들이 AI의 기술적 원리, 윤리적 영향, 사회적 가치를 깊이 있게 이해할 수 있도록 돕는 'AI 유창성 파일럿 프로젝트'를 시작합니다.

이미지 오류 정밀 수정부터 50MB 초경량 오디오 강화 모델까지

지난주 공개된 오픈소스 멀티모달 AI 기술 중 이미지 일관성 수정, 온디바이스 통합 모델, 초경량 오디오 강화 등 핵심 성과를 정리한 소식입니다.

vLLM보다 2.3배 빠르다? DGX Spark의 잠재력을 깨우는 Rust 엔진 Atlas

NVIDIA DGX Spark 하드웨어에 최적화된 Rust 기반 추론 엔진 Atlas가 기존 vLLM 대비 압도적인 속도와 가벼운 용량으로 공개되었습니다.

단 한 번의 프롬프트로 완성된 웹 OS, 소형 모델의 놀라운 코딩 능력

Qwen 2.5 4B 모델을 사용하여 게임, 텍스트 편집기, 오디오 플레이어 등을 포함한 완전한 기능의 웹 OS를 단일 프롬프트로 생성한 사례입니다.

노트북 CPU가 GPU를 이긴다? 19,000배 빠른 microgpt 학습의 비밀

Karpathy의 microgpt를 최적화하여 노트북 CPU에서 데이터센터 GPU보다 빠른 초기 학습 속도를 구현하고 반복 실험 효율을 극대화한 사례입니다.

에이전트의 소리 없는 실패를 잡는 실시간 관측 도구 VeilPiercer 공개

LangChain 기반 멀티 에이전트 시스템의 가시성, 안전성, 개인정보 보호를 실시간으로 모니터링하고 제어할 수 있는 오픈소스 관측 도구 VeilPiercer를 소개합니다.

게리 마커스의 예측은 얼마나 정확할까? 2,218개 주장을 LLM으로 전수 조사한 결과

게리 마커스의 474개 블로그 포스트에서 추출한 2,218개 주장을 LLM 파이프라인으로 분석하여 기술적 예측의 높은 정확도와 경제적 예측의 낮은 신뢰도를 수치화했습니다.

논문 구현의 고통 끝? arXiv PDF를 실행 코드로 바꾸는 ResearchClaw

arXiv 논문의 방법론을 분석하여 자동으로 실행 가능한 코드를 생성하고 연구 파이프라인을 자동화하는 오픈소스 도구 ResearchClaw가 공개되었습니다.

Qwen3.5-27B 최적의 양자화 버전은? 데이터로 증명된 Q4 벤치마크 결과

Qwen3.5-27B 모델의 다양한 커뮤니티 Q4 양자화 버전들을 KL 발산(KL Divergence)과 효율성 점수를 기준으로 비교하여 최적의 선택지를 제안합니다.

단 472바이트로 구현한 8비트 MCU용 MNIST RNN 모델

8비트 마이크로컨트롤러 환경에서 472개의 파라미터만으로 92%의 정확도를 달성한 MNIST RNN 모델 구현 사례입니다.

SFT는 추론 능력을 파괴한다? RLVR로 수학 성능 11.9점 올린 비결

Qwen2.5-1.5B 모델을 대상으로 RLVR과 SFT의 성능을 비교한 결과, RLVR은 수학 추론 능력을 크게 향상시킨 반면 SFT는 오히려 성능을 저하시켰음을 입증했습니다.

Z-Image Turbo에서 LoRA가 어색했던 이유와 자동 해결 방법

Z-Image Turbo의 특수한 QKV 어텐션 구조로 인한 LoRA 호환성 문제를 자동으로 해결해주는 ComfyUI 전용 노드가 개발되었습니다.

뉴스 팩트체크 끝판왕? 미국 정부 데이터 198종을 Claude에서 바로 조회한다

미국 정부 및 국제 기구의 37개 API와 198개 도구를 통합하여 경제, 보건, 정치 자금 등 방대한 공공 데이터를 Claude에서 직접 분석할 수 있게 해주는 MCP 서버 프로젝트입니다.

RTX 5090에서 ComfyUI 오류 해결하고 NVFP4로 2배 속도 향상하기

RTX 50 시리즈 그래픽카드에서 발생하는 sm_120 오류를 해결하고 PyTorch Nightly와 NVFP4를 활용해 윈도우 환경에서 ComfyUI 성능을 최적화하는 방법을 제시합니다.

LLM 글루 코드 지옥 탈출 통합 API와 RAG를 한 번에 해결하는 UnieAI

UnieAI는 여러 LLM 모델의 통합 API, RAG, 비용 모니터링 및 최적화 기능을 단일 플랫폼에서 제공하여 개발자의 오케스트레이션 부담을 줄여주는 인프라 솔루션입니다.

RTX 5090으로 구현한 로컬 AI 아티스트: 음악부터 립싱크까지 완벽 정복

최상위 로컬 하드웨어를 활용하여 음악, 보컬, 캐릭터, 영상의 모든 요소를 클라우드 없이 AI로 생성한 가상 아티스트 제작 사례를 공유합니다.

14개 API를 하나로 묶어 전문급 주식 분석을 자동화하는 방법

Claude의 도움을 받아 14개 이상의 무료 API와 20개 이상의 RSS 피드를 통합하여 전문적인 주식 분석 및 포트폴리오 관리를 수행하는 도구를 개발한 프로젝트입니다.

디자인 토큰 실수까지 기록하는 Claude의 자가 학습 워크플로

비개발자 디자이너가 CLAUDE.md와 규칙 파일을 활용해 AI의 실수를 영구적인 규칙으로 변환하고 성능을 개선하는 체계적인 프로젝트 관리 방법을 공유합니다.

AI 에이전트도 보험 드는 시대, ElevenLabs의 파격적인 행보와 리스크 관리

ElevenLabs가 5,800회 이상의 적대적 테스트를 거쳐 업계 최초로 AI 에이전트 보험 정책을 도입하며 기업용 AI의 신뢰성 기준을 제시했습니다.

마크다운 파일 4개로 구현하는 VSCode Copilot 자율 에이전트 루프

외부 플러그인이나 스크립트 없이 마크다운 파일 설정만으로 VSCode Copilot에서 자율적인 서브에이전트 루프를 실행하는 방법을 제안합니다.

VRAM 6GB로 100만 컨텍스트? RAM을 활용한 혁신적 LLM 엔진 등장

시스템 RAM을 컨텍스트 윈도우와 병용하여 저사양 GPU에서도 100만 이상의 토큰을 처리할 수 있게 해주는 오픈소스 엔진 OmniMesh를 소개합니다.

유튜브 영상 다운로드 전 모델 성능 확인? 실시간 화면 감지 도구 RTD-App

YOLO와 RT-DETR 모델을 활용해 모니터 화면을 실시간으로 감지하고 과거 탐지 이력을 관리 및 수출할 수 있는 오픈소스 GUI 도구입니다.

Qwen 모델이 이상하다면? 범인은 모델이 아니라 당신의 실행 환경일 수 있습니다

새로운 Qwen 모델에서 발생하는 추론 및 도구 호출 오류가 모델 자체의 결함이 아니라 Ollama나 LMStudio 같은 특정 런타임의 설정 및 지원 미비 때문이라는 주장입니다.

실수하며 배우는 AI 에이전트: 스스로 행동 규칙을 만드는 자기 수정 아키텍처

정적 프롬프트의 한계를 극복하기 위해 에이전트가 자신의 실수를 분석하고 반복되는 패턴을 스스로 행동 규칙으로 변환하는 자기 수정형 아키텍처를 제안합니다.

거짓말하는 AI와 침묵하는 AI의 대결, 24시간 생중계되는 AI 서바이벌

고유한 페르소나를 가진 10명의 AI 에이전트들이 실시간으로 동맹과 배신을 반복하며 생존 경쟁을 벌이는 혁신적인 게임 프로젝트입니다.

Intel Arc B580으로 Qwen 3.5 35B 모델 22 t/s 달성

Intel Arc B580 GPU에서 llama.cpp의 Vulkan과 SYCL 백엔드를 사용하여 Qwen 3.5 모델 시리즈의 성능을 측정한 상세 벤치마크 데이터입니다.

오렌지 파이 5에서 LLM 속도 2배 높이는 ik_llama.cpp 최적화 비결

Rockchip RK3588 기반 Orange Pi 5에서 ik_llama.cpp를 사용하여 기존 llama.cpp 대비 2배 이상의 추론 속도 향상을 달성한 벤치마크 결과와 빌드 가이드입니다.

알고리즘도 AI가 만든다? 성능 34% 높인 오픈소스 SkyDiscover 등장

SkyDiscover는 LLM을 활용해 알고리즘을 자동으로 발견하고 최적화하는 모듈형 오픈소스 프레임워크로, 기존 방식 대비 성능과 비용 효율을 크게 개선했습니다.

HTML 주석 속 가짜 계정을 털어간 범인은 사람이 아닌 AI 에이전트였습니다

오픈소스 허니팟 Beelzebub을 활용해 LLM 에이전트 특유의 다중 도구 사용, 시맨틱 페이로드 생성, 추론 기반 전략 수정 등 차별화된 공격 패턴을 포착한 실험 결과입니다.

100일 만에 멀티모달 전문가 되기? AI 요약과 맞춤형 학습 플랜 제공

멀티모달 AI 분야의 주요 논문들을 AI 요약, 평점, 맞춤형 학습 로드맵과 함께 제공하는 큐레이션 사이트 Attendemia를 소개합니다.

에이전트 코딩 시 프롬프트 재처리 문제 해결? llama.cpp 신규 기능 테스트

Qwen 3.5 모델로 에이전트 코딩 시 발생하는 프롬프트 전체 재처리 문제를 해결하기 위해 llama.cpp에 도입된 새로운 체크포인트 기능을 소개하고 커뮤니티의 테스트를 요청하는 내용입니다.

거절 0건의 강력함, Qwen3.5-4B 무검열 모델로 경험하는 자유로운 AI

새로 출시된 Qwen3.5-4B 모델을 기반으로 거절 응답을 완전히 제거하고 성능 손실 없이 멀티모달 기능을 유지한 무검열 모델이 공개되었습니다.

마크다운 명세서로 AI 에이전트 프로젝트를 자동 생성하는 Spec-To-Ship

마크다운 명세서를 분석하여 API 스캐폴딩, 테스트 코드, CI/CD 템플릿을 자동 생성하는 오픈소스 도구 Spec-To-Ship이 공개되었습니다.

거부율 0%의 Qwen3.5-9B 비전 모델 등장: 검열 없는 멀티모달 AI

직교 투영과 LoRA 기법을 활용해 거부율을 0%로 낮춘 Qwen3.5-9B 기반의 검열 해제 멀티모달 모델이 공개되었습니다.

단 3초의 샘플로 실시간 음성 복제, 오픈소스 KokoClone 등장

Kokoro TTS의 성능을 유지하면서 3~10초의 짧은 샘플만으로 실시간 음성 복제가 가능한 오픈소스 프로젝트 KokoClone이 공개되었습니다.

에이전트가 왜 자꾸 멈출까? 컨텍스트 오류를 잡아내는 로컬 트레이서 Traceloop

에이전트 실행 중 발생하는 컨텍스트 전달 오류를 추적하기 위해 개발된 오픈소스 로컬 파이썬 트레이서 Traceloop을 소개합니다.

LangGraph로 구축한 차세대 모듈형 RAG 에이전트 시스템 A.R.T.E.M.I.S

LangGraph Supervisor v2를 활용하여 RAG 워크플로우와 동적 에이전트 라우팅을 구현한 오픈소스 프레임워크 A.R.T.E.M.I.S를 소개합니다.

보안 걱정 없는 전사적 AI 에이전트, PipesHub로 직접 구축하세요

PipesHub는 기업 내 다양한 협업 도구의 데이터를 권한 기반 지식 그래프로 연결하여 보안이 유지되는 AI 에이전트를 구축할 수 있게 돕는 오픈소스 플랫폼입니다.

복잡한 API 키 관리 끝! AI 에이전트 전용 지갑으로 결제부터 송금까지 한 번에

AI 에이전트가 단일 API 키와 지갑을 통해 40개 이상의 유료 API 이용, 프리랜서 고용, 가상 카드 발급 및 송금을 자율적으로 수행할 수 있게 돕는 결제 인프라 Locus를 소개합니다.

비개발자도 직접 수정하는 AI 에이전트: 추론과 기능의 완벽한 분리

도메인 전문가가 자연어로 추론 로직을 관리하고 개발자가 기능 구현에 집중할 수 있도록 역할을 분리한 AI 에이전트 구축 사례와 플랫폼 공유입니다.

내 프로젝트에 딱 맞는 LLM 모니터링 도구는? 인기 5종 벤치마크

LLM 애플리케이션의 품질 관리와 비용 최적화를 위해 널리 사용되는 Langfuse, LangSmith 등 주요 관측성 도구 5종의 특징과 용도를 비교합니다.

쏟아지는 AI 논문 홍수 속에서 살아남는 법: 파운데이션 모델 아카이브

연구소와 모달리티별로 파운데이션 모델 논문을 분류하여 최신 AI 연구 동향을 한눈에 파악할 수 있는 웹사이트를 소개합니다.

840만 개의 뉴런을 구현한 차세대 뉴로모픽 칩 아키텍처의 등장

인텔의 Loihi 시리즈와 대등하거나 이를 능가하는 성능을 갖추고 최대 840만 개의 가상 뉴런을 지원하는 독자적인 뉴로모픽 아키텍처 N1, N2, N3의 개발 성과를 공유합니다.

무거운 Neptune 대신 사용하세요 가볍고 강력한 ML 실험 추적기 GoodSeed

Neptune의 대안으로 개발된 GoodSeed는 하드웨어 모니터링과 Git 상태 로깅을 지원하는 가볍고 빠른 오픈소스 ML 실험 추적 도구입니다.

그래디언트 클리핑 수동 설정은 이제 그만, AdamWClip 공개

AdamW를 확장하여 추가 메모리 없이 적응형 그래디언트 클리핑을 수행함으로써 성능을 개선한 AdamWClip 옵티마이저를 소개합니다.

어떤 LLM이 더 좋을까? 터미널에서 한 번에 비교하고 AI 판정까지

Yardstiq은 터미널에서 여러 LLM의 응답을 실시간으로 비교하고 성능 지표와 AI 판정 기능을 제공하는 오픈소스 CLI 도구입니다.

AI는 스도쿠를 풀 수 있을까? 51개 모델의 추론 능력을 시험하다

20가지 유형의 펜슬 퍼즐 6만 개를 활용하여 최신 AI 모델 51개의 다단계 추론 능력을 정밀하게 평가한 벤치마크 결과입니다.