본문으로 건너뛰기

2026년 6월 13일 AI 뉴스

30

관심 태그 추가

Gemini에게 마당 관리 앱을 만들어달라고 했다: AI 바이브 코딩의 현실

AI 챗봇을 활용해 코딩 지식 없이 마당 관리 앱을 개발하는 과정과 그 과정에서 겪은 시행착오 및 현실적인 한계를 다룬다.

서비스 경계로 LLM 에이전트 간 협업을 최적화하는 AgentNexus

서비스 단위의 문서 공유와 Pub-Sub 알림을 통해 이기종 LLM 에이전트 간의 협업을 조정하는 아키텍처.

할리우드 영화 제작의 미래는 단순한 AI 프롬프트가 아닌 맞춤형 모델에 있다

생성형 AI를 활용한 영화 제작은 범용 모델의 프롬프트 입력 방식에서 벗어나, 특정 창작 의도에 맞춘 맞춤형 모델과 전통적 워크플로를 결합하는 방향으로 진화하고 있다.

NVIDIA COSMOS-3는 정말 '월드 모델'일까? 옴니모달 아키텍처 심층 토론

NVIDIA COSMOS-3의 아키텍처와 옴니모달 발전사를 분석하며, 리저너와 제너레이터 구조 및 통합 액션 스페이스의 기술적 의미를 토론한다.

Anthropic Fable 5 서비스 중단과 새로운 오픈 웨이트 모델들의 등장

Anthropic의 Fable/Mythos 서비스 중단 사태와 함께 Kimi K2.7-Code, MiniMax M3 등 새로운 오픈 웨이트 모델 출시 및 벤치마크 변화를 다룸.

미국 정부, Anthropic의 Fable 5 및 Mythos 5 모델 접근 차단 명령

미국 정부가 국가 안보를 이유로 Anthropic의 Fable 5 및 Mythos 5 모델에 대한 모든 외국인 접근을 차단하는 수출 통제 지침을 발표했다.

OpenAI WebRTC 오디오 세션에서 GPT-Realtime-2와 문서 컨텍스트 활용하기

OpenAI WebRTC 오디오 세션 도구에 GPT-Realtime-2 모델 지원과 문서 컨텍스트 기능을 추가하여 브라우저에서 실시간 음성 대화가 가능해졌다.

AI 에이전트 개발 효율을 극대화하는 4가지 필수 오픈소스 도구

AI 에이전트 개발 환경을 개선하고 토큰 비용을 절감하는 4가지 오픈소스 프로젝트(Last30Days, Open Notebook, Agent Skills, Headroom)를 소개한다.

챗봇을 넘어선 AI: 고객 서비스 티켓 90%를 자동 해결하는 Zendesk의 비결

Zendesk의 Shashi Upadhyay가 고객 서비스 티켓의 70~90%를 자율적으로 해결하는 'resolution learning loop' 시스템과 AI 도입의 실무적 과제를 논의한다.

에이전트가 올바른 도구를 호출하는지 확인하는 로컬 테스트 프레임워크, Rubric-eval

LLM 에이전트의 도구 호출, 추론 과정, 지연 시간을 로컬에서 검증하고 CI/CD 파이프라인에 통합하는 오픈소스 테스트 프레임워크입니다.

David Ondrej2달 전

Claude Code보다 가볍고 강력한 Pi Agent, 실전 구축부터 활용까지

Pi Agent의 설치, 설정, 도구 활용법 및 C-mux를 이용한 멀티 에이전트 오케스트레이션 기법을 다루는 실전 튜토리얼.

"AI가 타겟 식별 후 공격" 우크라이나 자율 드론의 실전 투입 주장

우크라이나 드론 제조사 Aero Center가 2년 전 AI 기반 완전 자율 드론을 실전 테스트하여 러시아군을 살상했다고 주장했다.

유럽의 AI 강자 미스트랄 AI, 기업 가치 200억 유로로 30억 유로 투자 유치 추진

프랑스 AI 스타트업 미스트랄 AI가 약 200억 유로의 기업 가치를 목표로 30억 유로 규모의 추가 투자 유치를 논의 중이다.

두 LLM의 미세한 행동 차이를 자동으로 찾아내는 'Diffing Agents' 연구

Google DeepMind 연구팀이 두 LLM 모델 간의 체계적인 행동 차이를 자동으로 발견하고 검증하는 'Diffing Agents' 방법론을 제시함.

데이터 센터 반대 여론은 중국의 공작인가? 전문가들이 말하는 실체

미국 내 데이터 센터 반대 여론을 중국 정부의 영향력 공작으로 보는 정치권의 주장에 대해 전문가들은 근거가 부족하며 실질적인 지역사회 우려가 핵심이라고 분석한다.

Cursor에서 AI 에이전트 개발 시 발생하는 설정 오류를 'DataRobot Skills'로 해결하는 방법

DataRobot이 Cursor와 같은 IDE에서 AI 에이전트 개발 및 배포를 자동화하는 모듈형 컨텍스트 패키지 'Skills'를 공개했다.

구글 Gemini 악용해 피싱 사이트 제작한 사기 조직, 구글이 법적 대응 나서

구글이 Gemini AI를 악용해 대규모 피싱 캠페인을 벌인 'Outsider Enterprise' 조직에 대해 법적 대응을 시작했다.

ASI 정렬 논쟁, Yudkowsky와 LLM 연구자들의 주장은 왜 평행선을 달릴까?

ASI의 위험성을 경고하는 Yudkowsky와 현재 LLM 정렬 기술을 신뢰하는 연구자들 간의 논쟁을 분석하고, 두 관점의 타당성과 한계를 고찰한다.

왜 과학계는 p값 0.05에 집착할까? p-해킹과 재현성 위기의 진실

p값 0.05 기준의 역사적 기원과 이로 인해 발생하는 출판 편향, p-해킹, 재현성 위기 문제를 분석한다.

TechCrunch AI2달 전

FAANG은 끝났다? AI 시대의 새로운 IPO 주도주 MANGOS 등장

2026년 IPO 시장을 주도하는 새로운 기업군 MANGOS(Meta, Anthropic, Nvidia, Google, OpenAI, SpaceX)의 부상과 AI 인프라 시장의 변화를 분석한다.

AWS ML Blog2달 전

회의 준비부터 후속 조치까지, Amazon Quick과 Webex MCP로 자동화하는 법

Amazon Quick과 Cisco Webex MCP 서버를 연동하여 회의 준비와 후속 조치를 단일 대화형 워크플로로 자동화하는 에이전트 구축 가이드.

Matt Wolfe2달 전

Claude Fable 5 출시와 Apple Intelligence, 그리고 SpaceX IPO 소식까지

Anthropic의 Claude Fable 5 출시, Apple Intelligence 업데이트, Google의 Gemini 3.5 Live Translate 및 주요 AI 기업들의 최신 소식을 요약합니다.

arg min blog2달 전

LLM은 어떻게 현실을 왜곡하는가: 자동화된 사물화의 위험성

LLM이 상관관계 데이터를 기반으로 그럴듯한 설명을 생성하며, 이를 통해 추상적 개념을 실재로 착각하게 만드는 '자동화된 사물화' 과정을 비판적으로 분석한다.

LLM이 작성한 코드의 숨겨진 버그를 잡는 PyTorch 기반 검증 도구, ImpactArbiter

LLM이 생성한 KV 캐시 라우팅 코드의 논리적 오류를 PyTorch 자동 미분과 SymPy 오라클로 검증하는 자동화 도구입니다.

LLM과 인간의 추론 오류는 왜 닮았을까? 패턴 매칭의 비밀

인간과 LLM의 일상적 추론 과정이 추상적 세계 모델보다는 패턴 매칭에 기반하며, 두 존재가 유사한 오류 패턴을 보임을 밝힌 연구.

LLM 운영 비용과 보안을 제어하는 컨트롤 플레인 구축 전략

LLM 운영 시 발생하는 예산 낭비와 보안 문제를 해결하기 위해, 단순 연결을 넘어 정책과 의사결정을 담당하는 LLM 컨트롤 플레인 도입이 필요하다.

AI 에이전트와 인간을 위한 마크다운 기반 지식 저장소, PULSE8.ai Cortex

마크다운 파일과 지식 그래프를 활용해 AI 에이전트가 문서를 읽고, 쓰고, 검색할 수 있는 에이전트 네이티브 지식 운영체제입니다.

집 외벽에 설치하는 NVIDIA 미니 데이터 센터, 과연 실현 가능할까?

NVIDIA와 Span이 협력하여 가정용 미니 데이터 센터인 Zephyr 노드를 통해 분산형 AI 인프라를 구축하려는 시도를 분석한다.

LLM 개발 중 잦은 평가와 비교를 자동화하는 olmo-eval 공개

Allen Institute for AI(Ai2)가 LLM 개발 과정에서 모델 체크포인트 간의 성능 변화를 정밀하게 추적하고 비교할 수 있는 평가 워크벤치 olmo-eval을 공개했다.