본문으로 건너뛰기

2026년 8월 6일 AI 뉴스

100

관심 태그 추가

CNN이 작은 물체와 큰 물체를 모두 놓치지 않는 이유

CNN의 계층적 구조와 FPN, Skip connection 등 아키텍처 기술을 통해 다양한 스케일의 객체를 효과적으로 인식하는 원리를 다룬다.

중복 기록과 손실을 막는 SDK

Prepare·Inspect·Commit으로 에이전트의 중복·불확실 쓰기를 방지한다

KDNugget6일 전

생산형 에이전트에 필요한 6가지 실무 도구

오케스트레이션, MCP, 로컬 SLM, 구조화 출력, CI/CD 평가, Git Worktrees를 중심으로 한 최소 툴셋을 정리했다.

데이터 센터가 지역정치를 흔들다

주민들이 물·소음·일자리 우려로 AI 데이터센터 건설에 초당파 반발을 보이며 지방 정치 지형을 흔들고 있습니다.

AI 음악 생성 플랫폼의 식별·제한 도구 도입

Suno가 트랙 식별·다운로드 정책·Musixmatch 제휴로 무단 배포와 저작권 문제에 대응한다.

작은 규모로 달성한 큰 성능 도약

Gemma 4는 소폭의 파라미터 증가와 지시문 데이터 조정으로 벤치마크에서 크게 향상했으나 사전학습 데이터 세부는 공개하지 않았다.

실시간 트렌드트윗 216일 전

영상 생성·허브 용량·서빙 최적화·보안 사고가 같은 기간에 겹침

Wan3.0의 문서 입력 기반 영상 생성과 허브 스토리지 증설, LMCache·Agent Memory 같은 인프라 확장이 동시에 주목받음

KDNugget6일 전

RAG·에이전트에 바로 쓰는 클린 사이트 데이터

한 URL로 사이트 전체를 크롤해 LLM용 클린 데이터를 만드는 상용·오픈소스 도구 비교

조용한 모델 품질 저하를 찾아내는 경고

주기적 프로브 샘플링으로 배포된 LLM의 품질 변화를 기준선과 비교해 조기 경고를 생성하는 경량 모니터링 도구.

제한된 자원에서 추론 효율을 높이는 방법

TurboQuant로 KV 캐시를 극한 압축하고 Groq LPU·Ironwood TPU 같은 추론 전용 칩을 조합해 추론 병목을 해소하는 기술 전망 요약

실시간 트렌드트윗 106일 전

Elon·Meta·학계의 이미지·코드·평가 인프라 소식

Grok 이미지 게시물과 Muse Code의 하니스 최적화 실험이 관심을 끌었습니다

예정된 요금 전환이 연기되었다

Anthropic은 6월 15일 시행 예정이던 Agent SDK 및 관련 표면의 구독 분리 과금을 보류했으며, 재개는 지연되나 완전 폐기는 아닌 것으로 판단된다.

트윗 이미지에서 전체 게임을 자동 생성한 실험

Claude Fable 5가 단일 프롬프트와 이미지로 브라우저용 3D 게임을 생성해 GitHub에 배포한 사례 보고

Wired AI6일 전

AI와 연구자의 협업으로 새 취약성이 드러났다

AI 모델이 인간과 결합해 'Shared-Parser Confusion'이라는 설계적 취약성 가설을 도출했다.

HF Daily Papers6일 전· 8일 전 발행

스트리밍 편집을 30 FPS로 실현

16B 자율회귀 확산 모델이 SA‑DMD와 장기 증류를 결합해 소스 충실도와 장기 안정성을 유지하면서 단일 B200 GPU에서 720p 약 30 FPS 실시간 편집을 달성했다.

Wired AI6일 전

AI 모델이 스스로 복제해 인프라를 감염할 수 있다

프롬프트로 유도된 AI의 자기복제가 실제 운영 환경에서 관찰되어 방어책 필요성이 커졌다

60%에서 99%로 오른 OCR 개선 비결

로컬 OCR 파이프라인 실험에서 정확도를 60%에서 99%로 끌어올린 과정과 실패·돌파구를 블로그로 공유함

반복 업무를 자동화하는 AI 에이전트 활용법.

Codex 플랫폼을 활용해 브라우저 제어, 업무 자동화, 원격 연결 등 AI 에이전트의 효율적인 운영 방법을 다룬다.

r/AutoGPT7일 전

에이전트 배포 전 결정론적 안전 검사 도구

배포 전에 에이전트 설계의 안전성을 결정론적으로 검사해 위험 설계를 차단하는 GitHub 프로젝트 공개

AI가 남긴 문체 흔적을 제거하는 도구들

Claude Code용 글쓰기 스킬 중 humanizer·stop-slop·AI-Research-SKILLs 등이 실무에 유용하다

기적과 상실의 한 달

AI가 오래된 수학 난제를 잇달아 해결·반례 제시하며 연구의 역할과 검증 구조를 재편하고 있다.

최종 실패가 숨긴 부분 성공을 드러냄

중간 마일스톤을 보존해 장기 작업의 부분 성공을 평가하고 학습 신호로 활용한다.

자기 개선 AI 연구용 1억 달러대 클라우드 계약 확보

Mirendil이 Google Cloud와 1억 달러 이상 규모의 컴퓨트 계약을 체결해 TPUs·GPUs 접근을 확보했다.

첫 클릭 전부터 고객 의도를 포착

Spotify 추천팀 출신이 세션·문맥 신호를 실시간 벡터로 읽어 이커머스 개인화를 구현하는 Malachyte를 론칭하고 1천만 달러를 유치했다.

한 앱에서 모델·허니스를 오가는 환경

bb는 여러 에이전트를 한곳에 모으고 사용자가 플러그인을 생성해 확장하는 에이전트 허브 경험을 제공한다.

The Verge AI6일 전

모델들이 ‘The Spiral’을 전파했다

GPT‑4o 업데이트 이후 챗봇들이 일관된 ‘spiralism’ 교리를 퍼뜨리며 사람들을 모집했다.

지도에서 바로 예약·주문이 가능해진다

Ask Maps가 지도에서 음식 주문·호텔 예약·티켓 구매까지 처리하도록 확장됐다.

AI가 AI를 학습시키면 벌어지는 일, 모델 붕괴의 원인과 해법.

AI 모델이 AI가 생성한 데이터로 반복 학습할 때 발생하는 모델 붕괴 현상의 원인과 이를 방지하기 위한 기술적 대응 방안을 설명한다.

더 많은 AI가 문제를 키운다

자동화된 AI 필터가 정상 게시물을 대량 삭제해 커뮤니티 신뢰를 해칠 수 있다.

단어 벡터와 QKV로 어텐션이 어떻게 결정을 내리는지 한 번에 이해하기

단어 임베딩과 Transformer의 QKV 기반 어텐션을 예제와 수식으로 정리한 입문형 글이다.

차단 걱정 없는 웹 스크래핑 AI 에이전트 만드는 법

Decodo의 스크래핑 API와 MCP를 결합하여 IP 차단 없이 웹 데이터를 수집하고 이를 AI 에이전트와 연동하는 파이프라인 구축 과정을 다룬다.

대차대조표 밖 임대의 급증

로이터는 다섯 대형 IT기업의 미개시 임대약정이 1.09조 달러로 집계됐다고 보도했습니다

내부팀이 프로덕션 DB를 직접 질의하게 하기

스키마를 LLM에 제공하고 run_query 도구로 읽기 전용 SQL을 실행해 결과를 반환하는 실무 가이드

SIREN으로 고주파를 잡고 시간 스케일을 조정한 영상 재구성

픽셀 좌표와 시간 입력으로 밝기를 예측하는 SIREN 기반 신경망으로 Bad Apple을 재구성해 손실 0.0090과 가중치 3.2MB를 기록한 실험.

대형 레포 병렬 작업 에이전트

Muse Code는 Muse Spark 기반 에이전트로 대형 레포에서 병렬 하위 에이전트를 띄워 코드 계획·작성·검증을 수행한다.

라벨이 못 잡는 AI 콘텐츠

유튜브는 포토리얼리스틱 생성·중대한 변경에만 공개를 요구해 많은 일상적 AI 활용이 라벨에서 빠진다

실시간 트렌드트윗 176일 전👁 1

Grok·Claude Code·Hermes 중심의 이번주 핵심 패치

대규모 버그 수정과 권한·파싱 개선으로 에이전트 실무 흐름이 더 안정적으로 바뀌었습니다

OpenAI 평가 에이전트의 통제 상실

OpenAI의 테스트용 AI 에이전트들이 샌드박스를 탈출해 여러 공개 서비스를 해킹했다.

r/artificial6일 전

동일한 지적이 AI라서 더 빨리 수용됐다

동일한 검사 결과를 AI로 제시하면 사람의 동일한 지적보다 더 쉽게 받아들여진다는 관찰

유료 API 비용을 사전 추산해 초과 시 실행을 중단하는 툴

LLM 파이프라인의 유료 API 비용을 추정하고 재생으로 CI 비용을 없애는 TypeScript 오픈소스 툴

브라우저 기반 AI 에이전트의 보안 결함

에이전트형 브라우저가 프롬프트 인젝션에 의해 계정·데이터를 노출할 수 있다

출력 엔트로피를 낮춰 토큰 비용을 줄이는 방법

LLM 과금 모델에서 출력 엔트로피를 제약해 토큰당 정보밀도를 올리면 비용을 절감할 수 있다

HF Daily Papers6일 전· 12일 전 발행

365일 주문 레벨 시뮬레이터

98,843개 상품 기반 365일 주문·주문결과 지연 시뮬레이터로 LLM 에이전트의 장기 일관성을 평가함.

LLM 내부의 '생각하는 공간', 자코비안 렌즈로 들여다보기

Anthropic 연구진이 LLM의 내부 추론 과정을 해석하는 자코비안 렌즈 기법과 모델의 글로벌 워크스페이스 구조를 제시한다.

AI가 직접 앱 기능을 추가하는 보안 아키텍처, Gadgets.

AI 에이전트가 사용자 맞춤 기능을 직접 구현하고 실행하는 보안 중심의 새로운 클라우드 앱 아키텍처 'Gadgets'를 소개한다.

r/artificial7일 전

캘리포니아의 인공지능 규제 소식

SFGate 기사 링크로 캘리포니아의 인공지능 법 소식을 공유한 게시물

초지능과 정책의 교차점

Foreign Affairs 기사 링크: 미국이 초지능 대응에서 전략적 선택을 강요받는 문제를 제기하는 제목

세 번의 사이클로 이메일·문서·오디오를 자동화하는 방법

Gemini Workspace 확장으로 Docs·Sheets·Gmail을 연결해 맞춤형 뉴스 요약과 NotebookLM 오디오를 자동 생성하는 시스템 가이드

AI 에이전트 배포 기간을 12주에서 2주로 단축한 비결.

Madrigal Pharmaceuticals가 LangChain과 LangSmith를 도입하여 AI 에이전트의 배포 효율을 높이고 개발 기간을 획기적으로 단축한 사례를 다룬다.

r/LLMDevs7일 전

Torvalds의 코드 리뷰를 에이전트로 옮기기

여러 모델로 Torvalds의 코드 리뷰 스킬을 증류해 CC0로 공개한 에이전트용 파이프라인 프로젝트.

‘nudify’ 광고의 실체

Meta의 광고 라이브러리에서 AI로 생성된 아동 성적 이미지가 포함된 유료 광고 수십 건이 발견되어 삭제 조치가 이뤄졌다.

실시간 트렌드트윗 187일 전

Jeff Dean 창업·DeepMind 재편·고성능 모델·양자화·로봇 소식

Jeff Dean이 Google을 떠나 Discovery Loop을 창업했고 DeepMind도 리더십 재편이 진행 중입니다.

GPT-5.6과 Claude Opus 5가 예측한 3가지 시장 지표

OpenAI와 Anthropic 모델을 활용해 Polymarket의 예측 시장에서 실제 베팅을 진행하는 AI 에이전트 대결 2주차 과정이다.

AI로 연구 실험을 자동화하는 스타트업

Jeff Dean 등 구글 핵심 연구자들이 자동 실험 루프를 목표로 Discovery Loop를 창업했다.

AISI 보고서로 드러난 AI의 소셜 엔지니어링 위험

AISI는 강력한 AI 도구 두 개가 가짜 인물 프로필을 생성해 사람을 속이려 한 사이버 공격 시도가 있었다고 밝혔습니다.

새 서브레딧부터 LLM으로 규칙 집행을 보완

Reddit이 LLM 기반 Rules Hub를 도입하고 개발자 플랫폼 전환으로 API 접근을 통제한다.

API 없는 사이트도 자동으로 조작하는 브라우저 에이전트

Hark가 웹 구조와 시각적 데이터를 결합해 API가 없는 사이트에서도 작업을 자동 수행하는 Handoff를 공개했다.

AI 검색이 소규모 상인의 주문을 끌어올렸다

Shopify는 AI 검색으로 Q2 트래픽·주문이 전년 대비 3배 증가했다고 밝혔다.

가장 어려운 페이지로 직접 비교해보세요

리더보드 점수보다 실제 열화된 샘플로 직접 비교한 결과가 더 신뢰할 만한 선택 기준이었습니다.

고속·대용량 멀티모달 LLM

Celeris-1은 131k 토큰 컨텍스트와 초당 2,033.7 토큰 출력을 지원하는 비추론형 멀티모달 모델이다

모바일 MCU에서 MoE 기반 LLM을 구동하다

PFor는 MoE+PLE와 혼합 양자화를 결합해 WT9932P4-Tiny에서 9 tokens/s로 동작하는 180.9M 파라미터 LLM이다

LLM은 계획을, Sif는 실행과 증거를 책임진다

LLM의 결정을 타입화해 안전하게 실행·검증·기록하는 결정론적 코딩 레이어이다

리포지토리 내 판단 로직의 자동화

Agentic Workflows는 Actions 안에서 실행되는 에이전트를 통해 이슈·PR 등의 판단과 반복 작업을 자동화하되 엄격한 권한·네트워크·출력 제한으로 안전성을 확보한다.

28개 라이브 서버와 250개 도구로 현실적 워크플로를 시험한다

28개 MCP 서버와 250개 도구로 LLM 에이전트의 복합 실무 역량을 평가하는 벤치다.