AI 에이전트가 편의점을 운영한다면? Andon Labs가 발견한 기이한 행동들
Andon Labs는 AI 에이전트의 실제 비즈니스 수행 능력을 평가하는 Vending-Bench와 실전 환경 테스트를 통해 모델의 공격적 행동과 실패 모드를 분석한다.
총 60건
Andon Labs는 AI 에이전트의 실제 비즈니스 수행 능력을 평가하는 Vending-Bench와 실전 환경 테스트를 통해 모델의 공격적 행동과 실패 모드를 분석한다.
AI 에이전트가 고위험 작업을 수행하기 전 의도와 출처를 검증하여 보안 사고를 방지하는 로컬 우선 프로토콜 PIC Standard를 소개한다.
에스토니아 언어 연구소가 러시아의 전략적 서사 등 정치적 선전에 대한 LLM의 저항 능력을 평가하는 벤치마크를 공개했다.
LangChain 에이전트의 멀티턴 프롬프트 인젝션을 탐지하기 위해 세션 전체의 행동 궤적을 추적하는 보안 도구 Bendex Arc를 소개합니다.
Rust로 작성한 제로 의존성 추론 엔진이 1비트 양자화 모델을 CPU에서 150 TPS 이상의 속도로 구동함.
웹 디자인 경험만 있는 사용자가 Claude Code를 활용해 1,400개 제품을 포함한 커머스 사이트를 처음부터 끝까지 직접 구축한 사례.
Claude Code 시스템 프롬프트가 v2.1.162로 업데이트되어 디자인 동기화 기능과 도구 사용 지침, 개발 환경 설정이 대폭 개선되었다.
JVM 환경에서 JUnit 테스트를 통해 LLM 출력과 에이전트 동작을 직접 검증할 수 있는 오픈소스 평가 도구 Dokimos 소개.
Meta가 AI 데이터 센터 건설 기간을 단축하기 위해 텐트 형태의 급속 배포 구조물을 도입하고 오프그리드 가스 터빈으로 전력을 공급한다.
ClearML과 Dell Technologies가 협력하여 Dell 하드웨어 위에서 엔터프라이즈 AI 플랫폼을 신속하게 구축하고 운영할 수 있는 통합 솔루션을 제공한다.
Gemini Diffusion 모델은 양방향 어텐션을 통해 생성 중 오류를 수정하며, 텍스트 확산 방식을 적용해 실시간 인터랙티브 AI 애플리케이션을 구현한다.
기업이 LLM을 활용해 자체 구축한 안티봇 솔루션이 보안상 취약하며, 리버스 엔지니어링을 통해 쉽게 우회될 수 있음을 분석한다.
AI 에이전트 스타트업 Poke가 Apple의 Messages for Business 플랫폼에 최초로 승인되어 iMessage를 통해 서비스를 제공한다.
LLM 코딩 에이전트의 언어, 모델, 도구 조합에 따른 실제 신뢰도와 비용을 통계적으로 측정하는 프레임워크 'retort'를 소개합니다.
매니폴드 가설은 고차원 데이터가 실제로는 저차원 공간에 존재한다는 이론으로, 생성형 AI의 핵심 역할은 이 복잡하게 얽힌 매니폴드를 펼쳐 의미 있는 데이터를 생성하는 것이다.
NVIDIA가 다중 모달 입력, 12개 언어 지원, 맞춤형 정책 적용 및 추론 기능을 통합한 4B 파라미터 규모의 안전 모델 Nemotron 3.5 Content Safety를 공개했다.
현재의 AI 개발은 모델 규모와 추론 속도 최적화에만 집중하고 있으며, 지능의 핵심인 '목표 지향적 동기'를 간과하고 있다는 비판적 시각을 제시함.
기업용 생성형 AI 프로젝트의 95%가 성과를 내지 못하는 이유는 모델 자체보다 데이터 인프라와 워크플로 재설계에 필요한 노력을 과소평가하기 때문임.
LLM 신뢰성 향상 기법 28가지를 단일 API로 통합하고, 프롬프트별 적응형 라우팅을 통해 비용과 품질을 최적화하는 라이브러리 agentcodec을 소개한다.
DeepLearning.AI에서 vLLM을 활용한 로컬 LLM 추론 최적화, 메모리 관리, 벤치마킹을 다루는 실무 중심 강의를 공개했다.
Replit Agent를 활용해 자연어 프롬프트만으로 커스텀 Shopify 스토어프론트를 설계, 생성, 배포하는 엔드투엔드 워크플로를 지원한다.
PyTorch를 사용하여 흉부 X-ray 이미지에서 폐렴을 탐지하는 CNN 모델을 구축하고, 데이터 전처리 및 평가 파이프라인을 포함한 프로젝트를 공유함.
MIT 주도의 IAIFI가 NSF로부터 5년간 추가 지원을 확보하며 AI와 물리학의 상호 발전을 위한 연구 모델을 확장한다.
Google의 Gemma 4 12B 모델 출시, Apple의 Vision 제품군 로드맵 축소, 주요 AI 기업들의 합성 DNA 스크리닝 의무화 촉구 소식을 다룬다.
Claude Code를 활용해 소셜 미디어와 뉴스 데이터를 분석하고 주식 투자 기회를 포착하는 AI 소프트웨어 개발 사례.
5개의 AI 에이전트가 연구, 전략 수립, 콘텐츠 작성, 게시, 성과 분석을 수행하여 블로그 SEO를 자동화하는 워크플로를 소개합니다.
AI 벤치마크의 한계를 극복하기 위해 필요한 평가 방법론과 환경 복잡성, 자율성 등 차세대 벤치마크 설계의 핵심 요소를 다룬다.
Aircall의 Tom Chen이 AI 음성 에이전트의 운영 효율성과 고객 선호도, 그리고 성공적인 배포를 위한 핵심 병목인 사내 지식 문서화의 중요성을 설명한다.
AI 수요 폭증으로 세계 최대 반도체 기업 TSMC가 공급난을 겪으며 미국 내 생산 확대에도 불구하고 수요 충족에 장시간이 소요될 전망이다.
AI 에이전트가 데이터 과학 워크플로를 자동화하며, 데이터 과학자는 절차적 반복 업무에서 벗어나 시스템 설계와 평가라는 고차원적 판단 역할로 전환된다.
LangChain 기반 AI CLI 도구에서 커스텀 런타임으로 전환하며 코드 간결성과 디버깅 효율을 개선한 경험을 공유하고, 프레임워크 사용에 대한 커뮤니티 의견을 묻는 글.
Claude로 초안을 작성하고 다른 모델로 비판적 검토를 수행한 뒤 다시 수정하는 다중 모델 루프 방식의 워크플로 공유.
Anthropic의 Claude Agent SDK 유료화에 대응하여, 공식 TUI를 활용해 프로그래밍 가능한 인터페이스를 제공하는 오픈소스 CLI 도구 dash-p가 공개되었다.
2만 1천 달러 MRR 규모의 튜터링 플랫폼 운영자가 브랜드 인지도와 커뮤니티 기여를 위해 범용 프롬프트 20개를 공개하고, 핵심 경쟁력인 독점 프롬프트 50개는 비공개로 유지하기로 결정했다.
AI 안전 필터의 높은 오탐지율이 건강한 사용자에게 불필요한 자기 의심과 심리적 불안을 유발하는 부작용을 지적한 사례.
Claude Code 사용 시 세션 간 컨텍스트 유지 문제를 해결하기 위해 에이전트와 인간이 공유하는 구조화된 메모리 레이어인 FreeRide를 개발하여 공유했다.
LLM의 동조 성향으로 인한 확증 편향을 방지하기 위해 자신의 의견을 숨기고 반대 입장의 논리를 요구하는 프롬프트 전략을 제안함.
인프라 자동화 엔지니어가 Claude 최신 모델에서 상시 지침 준수 능력이 이전 버전 대비 크게 향상되었음을 보고했다.
Anthropic의 Mythos가 대규모 보안 취약점 탐지 효율을 입증했으나, 실무에서는 탐지된 결과를 처리할 인간의 리소스와 우선순위 설정이 더 큰 병목임을 지적한다.
공식 JIRA MCP 서버의 과도한 메타데이터로 인한 토큰 낭비 문제를 해결하기 위해, 필수 필드만 반환하는 경량화된 MCP 서버 사용을 제안한다.
Claude Code가 과거 세션의 기록을 읽고 컨텍스트를 유지할 수 있도록 돕는 MCP 서버와 플러그인을 개발하여 공유함.
NVIDIA Nemotron 3 Ultra 모델이 Amazon SageMaker JumpStart에 출시되어 에이전트 워크로드의 추론 속도와 비용 효율성을 개선한다.
Steerling 8B 기반의 Clarity는 모델의 추론 과정을 시각화하고 훈련 데이터 추적 및 개념 기반 제어를 지원하는 해석 가능한 AI 플랫폼이다.
모델 성능 경쟁에서 벗어나 에이전트 구동을 위한 로컬 추론 및 맞춤형 하드웨어 인프라로 AI의 중심이 이동하고 있다.
LLM 에이전트 워크플로우의 트레이싱과 비용 관리를 지원하는 경량 오픈소스 프록시 도구 Spanlens.
에이전트 시스템에서 메타인지와 캘리브레이션을 활용해 할루시네이션을 예방하는 계획 및 검증 파이프라인 설계와 실무적 트레이드오프 분석.
LLM의 환각과 동조 현상을 방지하기 위해 아키텍처 문서화와 다중 모델 검토 프로세스를 결합한 개발 워크플로우.
Claude Code와 Linear MCP 연동 시, 티켓 생성 전 검증 및 컨텍스트 통합 도구를 추가하여 데이터 품질을 개선하는 방법.
Red Hat과 DeepLearning.AI가 vLLM 생태계를 활용한 LLM 추론 최적화, 배포, 벤치마킹 실습 과정을 공개했다.
Claude Code 기반의 에이전트들을 로컬에서 자율적으로 운영하고 관리할 수 있는 멀티 에이전트 하네스 Munder Difflin이 오픈소스로 공개되었다.
Instagram 분석 도구 OwlStat에 MCP 서버를 구축하여 Claude와 직접 연동함으로써 대시보드 접속 없이 데이터 조회 및 보고서 생성을 자동화했다.
AI Roundtable의 3만 건 공개 세션 데이터를 분석한 결과, Claude Opus 4.7이 타 모델의 의견을 가장 많이 뒤집으며 영향력 1위를 기록했다.
Gemma 4 모델을 로컬 전처리 단계로 활용하여 API 호출 비용과 지연 시간을 최적화하는 하이브리드 파이프라인 전략.
Claude Code 기반의 에이전트들을 로컬에서 클러스터 형태로 운영하며 자율적으로 작업을 수행하는 멀티 에이전트 하네스 Munder Difflin을 오픈소스로 공개했다.
AI API 및 LLM 제품의 가격 책정 시 계량 방식, 단위, 티어 구조, 크레딧 지갑 관리 등 6가지 핵심 요소를 체계적으로 설계하는 방법론을 제시한다.
2020년 구글이 해고한 Timnit Gebru의 논문 'Stochastic Parrots'가 예견했던 AI의 위험성들이 현재 업계의 고질적인 문제로 실현됨을 다룬다.
페이스북이 크리에이터의 성과 분석과 콘텐츠 아이디어 생성을 돕는 AI 기반 'Creator assistant'를 출시했다.
Hello Robot이 실생활 환경에서 안전하게 작동하도록 설계된 4세대 가정용 보조 로봇 Stretch 4를 출시했다.
모델의 지능보다 에이전트의 제어, 비용 가시성, 안전한 격리를 보장하는 거버넌스 계층이 AGI 시대의 핵심 경쟁력이 된다.