본문으로 건너뛰기

2026년 6월 18일 AI 뉴스

61

관심 태그 추가

LLM을 조종해 정답을 맞히게 하라: 역방향 타부 게임 Language1 공개

LLM의 추론 능력과 프롬프트 정밀도를 테스트하고 벤치마크 데이터를 수집하기 위한 역방향 타부 게임 Language1을 소개합니다.

반복적인 관리 업무를 자동화하는 금융 자산 관리용 AI 에이전트

Salesforce가 금융 자산 관리자의 생산성 향상을 위해 자율적으로 업무를 수행하는 'Agentic Advisor'를 Agentforce 플랫폼에 도입한다.

Adobe Creative Cloud 앱에 도입된 AI 어시스턴트, 작업 자동화의 시작

Adobe가 Photoshop, Premiere 등 주요 Creative Cloud 앱에 대화형 AI 어시스턴트를 도입하여 반복적인 편집 작업을 자동화한다.

Adobe Firefly, 디자인 일관성 높이는 'Elements'와 'Projects' 기능 도입

Adobe가 Firefly AI 스튜디오를 개편하고, 디자인 일관성을 유지하는 'Elements'와 프로젝트 관리 기능인 'Projects'를 새롭게 도입했다.

AI Engineer1달 전

6개월간 실패한 챗봇 PoC, 무엇이 문제였나? 실전 AI 에이전트 구축 5대 원칙

리테일 은행 챗봇 PoC 실패 사례를 통해 평가, 관측 가능성, 데이터 기반, 오케스트레이션, 거버넌스를 포함한 실전 AI 에이전트 구축 5대 원칙을 제시한다.

LLM 데이터 파이프라인의 PII 탐지와 품질 평가를 한 번에 해결하는 제로 의존성 도구

Flexorch-audit은 외부 의존성 없이 Python 표준 라이브러리만으로 LLM 데이터셋의 PII를 탐지하고 품질을 평가하며 노이즈를 제거하는 경량 도구입니다.

Salesforce1달 전

소셜 미디어 운영 부담을 줄여주는 AI 에이전트 활용법

AI 에이전트를 활용해 소셜 미디어 콘텐츠 생성, 고객 응대, 성과 분석을 자동화하고 마케팅 효율을 높이는 방법.

iMessage에서 살아 움직이는 AR 캐릭터, Pixi가 온디바이스 AI로 구현한 새로운 소통 방식

Pixi는 iMessage에서 온디바이스 AI를 활용해 주변 환경과 상호작용하는 AR 캐릭터를 주고받을 수 있는 메시징 앱을 출시했다.

AI 에이전트를 프로덕션에 배포할 때 반드시 고려해야 할 4가지 설계 패턴

AI 에이전트를 실무 시스템에 통합하기 위해 필요한 워크플로 오케스트레이션, 정책 준수, 인간 개입 패턴을 다룬다.

Vizuara1달 전

코딩 에이전트로 연구 생산성을 10배 높이는 실전 가이드

코딩 에이전트를 활용하여 연구 프로세스를 자동화하고 데이터 분석 및 코드 작성 생산성을 극대화하는 실무 가이드.

AI 에이전트 관리의 새로운 표준, PilotDeck으로 비용과 효율을 동시에 잡는 법

PilotDeck은 프로젝트 단위의 워크스페이스와 화이트박스 메모리, 지능형 라우팅을 통해 AI 에이전트의 효율적인 관리와 비용 절감을 지원하는 오픈소스 운영체제이다.

인텔 CEO 립 부 탄이 밝히는 AI 시대의 CPU 전략과 반도체 생태계 혁신

전 Cadence CEO이자 인텔의 리더 립 부 탄이 AI 시대의 CPU 중심 전략, 반도체 공급망 혁신, 그리고 기업 문화 개선을 통한 인텔의 재도약 방안을 제시한다.

Vizuara1달 전

AI 면접관이 묻는 'Transformer란 무엇인가?'에 대한 완벽한 답변 전략

Transformer 아키텍처의 8가지 핵심 구성 요소를 시각적으로 분석하고, AI 인프라 면접에서 깊이 있는 답변을 구성하는 전략을 제시한다.

프랑스가 NVIDIA와 함께 유럽 AI 주도권을 잡는 방법

프랑스가 NVIDIA 기술을 도입해 AI 인프라를 확충하고, 현지 언어와 문화에 최적화된 오픈 모델 생태계를 구축하며 산업 전반에 AI 도입을 가속화한다.

Wired AI1달 전

영국 정부가 망명 신청자에게 도입하려는 AI 얼굴 나이 추정 기술의 심각한 오류

영국 정부가 망명 신청자의 나이를 판별하기 위해 도입하려는 AI 얼굴 나이 추정 기술이 인종 및 성별 편향과 낮은 정확도로 논란을 빚고 있다.

Meta, AI 기반 연령 확인 및 13세 이상 콘텐츠 설정 글로벌 확대

Meta가 Instagram, Facebook, Messenger에 AI 기반 연령 확인 및 13세 이상 콘텐츠 설정을 글로벌 도입하고, 부모를 위한 안전 알림 기능을 강화했다.

AI 인프라로 피벗하는 기업들과 MCP의 등장

AI 인프라로 전환하는 기업들의 전략과 MCP 출시, 그리고 AI에 대한 대중의 인식을 다룹니다.

NAVER D21달 전

스펙 변경 시 프롬프트부터 학습까지 자동화하는 Closed Loop 파이프라인

쇼핑 에이전트 답변 모델 개발 시 스펙 변경에 대응하여 결함 탐지, 프롬프트 최적화, SFT 데이터 생성을 자동화하는 파이프라인 구축 경험 공유.

생성 모델의 핵심, Diffusion과 Flow Matching의 결정적 차이

Diffusion과 Flow Matching의 수식과 샘플링 과정을 비교하여 생성 모델의 작동 원리와 궤적 차이를 분석한다.

AWS ML Blog1달 전

Amazon SageMaker Async Inference, 이제 S3 업로드 없이 인라인 페이로드 전송 가능

Amazon SageMaker AI Async Inference가 최대 128,000바이트의 인라인 페이로드 전송을 지원하여 S3 업로드 과정 없이 추론 요청이 가능해졌다.

AWS ML Blog1달 전

반복 업무는 AI에게 맡기세요: Amazon Quick의 자율 에이전트와 데이터 통합 기능

Amazon Quick은 자율 에이전트와 통합 데이터 분석 기능을 통해 다양한 앱과 데이터 소스를 연결하고 반복 업무를 자동화하여 생산성을 높이는 AI 어시스턴트입니다.

Comet ML Blog1달 전

Claude Code 사용 시 놓치기 쉬운 비용 누수, 40% 절감하는 방법

Claude Code의 세션 시작 시 발생하는 MCP 서버와 컨텍스트 오버헤드를 식별하고, Opik을 통해 조직 단위로 비용을 관리하여 최대 40%까지 절감하는 전략.

aifeed.dev1달 전

아이디어 한 줄이면 끝, Fimo로 만드는 전문가 수준의 웹사이트

Fimo는 아이디어 설명만으로 콘텐츠와 디자인이 포함된 다중 페이지 웹사이트를 생성하는 AI 웹사이트 빌더입니다.

로봇이 스스로 GPU를 장착한다? NVIDIA가 공개한 자율 학습 프레임워크 ENPIRE

NVIDIA GEAR 연구소가 AI 에이전트가 로봇 학습 과정을 스스로 설계하고 실행하여 복잡한 물리적 작업을 자동화하는 프레임워크 ENPIRE를 개발했다.

AI 에이전트의 도구 연동을 최적화하는 FastMCP와 Modal 활용법

FastMCP 프레임워크와 Modal 샌드박스를 사용하여 AI 에이전트의 도구 연동을 효율화하고 안전한 코드 실행 환경을 구축하는 방법을 설명한다.

실시간 키포인트 검출의 새로운 기준, RF-DETR Keypoint 프리뷰 공개

RF-DETR Keypoint는 확률적 손실 함수와 NAS를 활용해 실시간으로 고정밀 키포인트 검출을 수행하는 엔드투엔드 모델이다.

소재 과학의 난제, AI 자율 실험실로 10배 빠르게 해결하기

Radical AI는 AI 과학자와 자동화 로봇을 결합한 자율 주행 실험실(SDL)을 통해 소재 발견 속도를 기존 대비 10배 이상 가속화하고 있다.

미국인 10명 중 4명은 AI가 사회에 부정적 영향을 미칠 것이라 본다

Pew Research 조사 결과, 미국인의 AI 사용은 증가하고 있으나 AI의 장기적 영향에 대한 사회적 인식은 여전히 부정적이고 회의적인 것으로 나타났다.

iMerit Blog1달 전

3D 라벨 없이 1위 달성: iMerit의 CVPR 2026 자동 주석 파이프라인

iMerit은 CVPR 2026 Auto3D 챌린지에서 SAM 3와 CLIP 기반 검증을 활용한 자동 주석 파이프라인으로 1위를 차지했다.

Matt Wolfe1달 전

내 컴퓨터에서 돌아가는 AI 워크스페이스, Project Odysseus 실전 테스트

PewDiePie가 개발한 오픈소스 AI 플랫폼 Odysseus의 설치 과정과 로컬 모델 구동, Deep Research 및 이미지 편집 기능을 검증한다.

로봇 제어와 영상 생성을 혁신하는 3D 모션 예측 모델 MolmoMotion

AllenAI가 공개한 MolmoMotion은 언어 지시와 비디오를 기반으로 객체의 미래 3D 궤적을 예측하여 로봇 계획 및 영상 생성 성능을 향상시킨다.

AI LABS1달 전

AI 에이전트 스킬 설치 전 필수, NVIDIA Skill Spector로 보안 위협 차단하기

NVIDIA의 Skill Spector를 사용하여 AI 에이전트 스킬의 보안 취약점을 스캔하고, Claude Code와 연동하여 안전한 설치 워크플로를 구축하는 방법을 다룬다.

AI Engineer1달 전

AI 에이전트가 웹 검색에 실패하는 이유와 해결책

AI 에이전트의 웹 접근 실패 원인인 안티봇 시스템과 CAPTCHA를 분석하고, Web MCP를 통한 안정적인 데이터 수집 방법을 다룬다.

LLM 학습용 데이터 수집 봇넷, SourceHut 서비스 장애 유발

SourceHut이 LLM 학습 데이터를 수집하는 공격적인 봇넷의 크롤링으로 인해 서비스 장애를 겪고 일부 웹 경로를 차단함.

LLM 에이전트가 보는 피드가 결정을 바꾼다: 적대적 피드의 영향력과 보안 위험

LLM 에이전트가 의사결정 전 소비하는 외부 피드의 구성과 순서가 에이전트의 판단을 왜곡할 수 있음을 입증하고, 이에 대한 보안적 시사점을 제시함.

Vizuara1달 전

AI 모델이 스스로 똑똑해지는 법: '기술' 대신 '갈망'을 설계하라

AI 모델의 학습 목표인 손실 함수를 정교하게 설계하여, 모델이 스스로 복잡한 능력을 부산물로 습득하게 만드는 Byproduct Theorem을 분석한다.

LLM 라우팅과 공급자 통합을 한 번에, 파이썬 라이브러리 Maslul

Maslul은 LLM 요청을 난이도에 따라 적절한 모델로 라우팅하고, 여러 공급자의 SDK를 단일 인터페이스로 통합하는 파이썬 라이브러리이다.

외부 서버 의존 없는 암호화 기반 LLM 프롬프트 보안 솔루션, SIGIL

SIGIL은 외부 서버 의존 없이 암호화 서명, 데이터 거버넌스, 감사 추적 기능을 제공하여 LLM 프롬프트 보안을 강화하는 오픈소스 라이브러리입니다.

753B 파라미터의 강력한 오픈 웨이트 모델 GLM-5.2, 성능과 비용은?

Z.ai가 공개한 753B 파라미터의 오픈 웨이트 LLM GLM-5.2는 100만 토큰 컨텍스트를 지원하며, Artificial Analysis 벤치마크에서 오픈 웨이트 모델 중 1위를 기록했다.

The Verge AI1달 전

AI 이미지 생성하던 Midjourney가 초음파 전신 스캐너를 만든 이유

Midjourney가 Butterfly Network와 협력하여 초음파 기반 전신 스캐너를 개발하고, 2027년 샌프란시스코 스파에서 서비스를 시작한다.

LLM 에이전트로 쿼리 실행 코드를 직접 생성하는 GenDB의 성능과 구조

GenDB는 LLM 에이전트를 사용하여 데이터와 워크로드에 최적화된 네이티브 쿼리 실행 코드를 생성하는 생성형 쿼리 엔진이다.

더 저렴하고 강력한 모델을 찾으시나요? 실시간 LLM 랭킹 및 가격 추적 서비스

LMSYS Arena의 LLM 랭킹과 OpenRouter의 실시간 가격 정보를 결합하여, 최적의 모델을 찾고 신규 모델 출시 시 알림을 받을 수 있는 추적 서비스입니다.

LLM은 자신의 창조주를 더 선호할까? 5,000번의 실험으로 밝혀진 AI의 자기 편향성

5,000회 이상의 모의 조달 평가 실험을 통해 LLM이 자신의 창조주를 선호하거나 주입된 정체성에 따라 편향된 결정을 내리는 현상을 분석함.

ESP32-S3에서 실행하는 샌드박스형 코드 평가기 PySpell

PySpell은 ESP32-S3와 같은 마이크로컨트롤러에서 Python과 Rust의 안전한 하위 집합을 실행하는 샌드박스형 코드 평가기입니다.

Databricks와 NVIDIA가 공개한 차세대 AI 인프라: Vera CPU와 Agent Toolkit 통합

Databricks와 NVIDIA가 협력을 강화하여 AI Runtime, Model Serving, Vera CPU 기반의 엔드투엔드 AI 플랫폼을 구축한다.

모든 작업에 Claude Opus를 쓸 필요가 없습니다. Factory Router로 비용을 25% 절감하세요.

Factory Router는 코딩 작업 난이도에 따라 최적의 LLM을 자동으로 선택하여 성능은 유지하면서 API 비용을 최대 25% 절감합니다.

Salesforce1달 전

UI 없는 AI 에이전트 시대, Salesforce가 제시하는 보안 아키텍처

Salesforce Headless 360은 UI를 분리하고 AI 에이전트가 기존 Salesforce 보안 정책을 상속받아 안전하게 데이터를 처리하도록 지원한다.

로봇을 원격 조종하며 학습 데이터를 쌓는 중국 스타트업 IO-AI Tech

IO-AI Tech는 VR과 모션 트래킹 기술을 활용해 휴머노이드 로봇을 원격 제어하고, 이를 통해 로봇 자율 주행을 위한 학습 데이터를 수집한다.

LLM 에이전트의 안전한 운영을 위한 결정론적 정책 및 감사 도구, Pramagent

LLM 에이전트의 도구 사용 정책, 인간 개입(HITL), 감사 추적을 제공하여 프로덕션 환경의 신뢰성을 높이는 오픈소스 미들웨어 프레임워크.

iPhone에서 Apple Intelligence와 ChatGPT를 100% 활용하는 방법

iPhone에 탑재된 Apple Intelligence의 글쓰기 도구, 시각 지능, 실시간 번역, 이미지 생성 및 ChatGPT 연동 기능을 상세히 설명한다.

LLM은 체스를 얼마나 잘 둘까? 체스 실력과 지시 이행 능력을 동시에 평가하는 리더보드

LLM 체스 리더보드는 무작위 플레이어 및 체스 엔진과 대국을 통해 LLM의 체스 전략과 에이전트 환경에서의 지시 이행 능력을 정량적으로 평가한다.

자율주행 전문가들이 만든 월드 모델 스타트업 Odyssey, 14.5억 달러 유니콘 등극

자율주행 기술 기반의 월드 모델 스타트업 Odyssey가 아마존 등의 투자를 받아 14.5억 달러 기업 가치를 인정받았다.

AWS ML Blog1달 전

AI 에이전트의 데이터 이해도를 높이는 AWS Context와 데이터 거버넌스 신기능

AWS가 AI 에이전트가 기업 데이터를 안전하고 정확하게 활용할 수 있도록 돕는 'AWS Context'와 Glue Data Catalog 및 S3 Annotations 신기능을 발표했다.

Snap의 2,000달러 AR 글래스 출시와 Apple의 카메라 달린 AirPods 개발 소식

Snap의 고가 AR 글래스 출시, US-EU 간 AI 협력 논의, Apple의 카메라 내장 AirPods 개발 등 주요 테크 소식을 요약한다.

제미나이로 똑똑해진 구글 홈 스피커, 자연어 명령과 멀티태스킹 지원

구글이 제미나이 AI를 탑재하여 자연어 이해와 복합 명령 처리가 가능한 99.99달러의 새로운 스마트 스피커를 출시했다.

에이전트 성능을 극대화하는 Amazon Bedrock AgentCore의 새로운 기능과 최적화 루프

Amazon Bedrock AgentCore가 RAG, 웹 검색, 유료 콘텐츠 연동 및 지속적 학습을 위한 최적화 루프를 통해 에이전트 개발과 운영을 지원한다.

Salesforce1달 전

기존 자동화 자산을 Agentforce 에이전트에 맞게 리팩터링하는 전략

기존 Salesforce 자동화 자산을 Agentforce 에이전트가 활용할 수 있도록 리팩터링하는 전략과 기술적 구현 방법을 다룬다.

LLM 코딩 생산성 극대화: AI에게 테스트 환경을 제공하는 법

LLM이 작성한 코드의 정확성을 보장하기 위해 브라우저, 테스트 스크립트, 이미지 비교 도구 등 검증 환경을 AI에게 제공하는 실무 전략을 다룬다.

로봇 학습 데이터 부족 해결사 XDOF, 7천만 달러 투자 유치하며 등장

XDOF는 로봇 학습을 위한 데이터 파이프라인과 수집 도구를 제공하여 로봇 AI 개발의 병목 현상을 해결하는 인프라 스타트업이다.

Vizuara1달 전

나만의 소형 언어 모델(SLM)을 밑바닥부터 직접 구축하는 4주 과정

데이터 준비부터 사전 학습, LoRA 파인튜닝, 추론 최적화 및 엣지 디바이스 배포까지 SLM 구축 전 과정을 다루는 실전 부트캠프.

Temperature 0이어도 LLM 출력은 왜 달라질까? 비결정론적 추론의 원인과 해결책

LLM 추론 시 발생하는 비결정론적 출력의 원인인 부동소수점 연산과 배치 처리 문제를 분석하고, 캐싱 및 스케줄링을 통한 대응 전략을 제시한다.