본문으로 건너뛰기

2026년 8월 11일 AI 뉴스

93

관심 태그 추가
실시간 트렌드트윗 131일 전👁 1

Nemotron Lightning의 MoE 속도·Solar Pro 4 무료·텍스트 워터마크 확산

에이전트 고빈도 실행을 위한 모델·라우팅 도구와 워터마크 규제 대응 소식 모음

변화하는 LLM과 규범의 충돌

Transformer 병목을 완화하는 대안 기술, AI 인프라 자본 유입, 배아 유전체 상용화의 윤리적 파장이 동시에 전개되고 있다.

에이전트가 만든 '증거'가 현실과 다를 수 있음

에이전트는 생산성을 키우지만 테스트·검증·벤치마크의 설계가 없으면 위험이 커진다

화면 공유 참여만으로 기업 내부 침투가 가능해졌다

공개 AI 모델로 20회 미만의 프롬프트만으로 줌 주석 취약점이 발견돼 서버·클라이언트 패치가 배포되었다

지속성 있는 부모 주도 다중 에이전트

Row-Bot은 부모 에이전트가 작업을 계획·분배하고 Durable Orchestrator로 체크포인트와 동시 실행을 관리하는 다중 에이전트 런타임입니다.

15명 전문가를 하나로 합친 에이전트

Kavak은 단일 에이전트로 전환해 전환율을 2.1배로 끌어올렸다고 보고했다.

프롬프트 엔지니어링을 넘어 AI 성능을 높이는 컨텍스트 엔지니어링.

LLM과 AI 에이전트의 성능을 높이기 위해 컨텍스트를 구조화하고 최적화하는 컨텍스트 엔지니어링의 개념과 핵심 요소를 다룬다.

판결이 입력 기록을 요구했다

호스트형 LLM의 비결정성은 재현을 방해하지만, 호출 로그와 외부 앵커는 산출의 출처를 입증할 수 있다.

Wired AI1일 전

소형 모델로 체인오브쏘트 복원하는 기법

연구진이 소형 모델을 통해 폐쇄형 모델의 숨은 추론과 민감 정보를 복원하는 취약성을 발견했다.

실시간 트렌드트윗 201일 전👁 1

Grok Image 2.0 · Wan-Animate-2 · Solar Pro 4 동시 부상

Grok Imagine의 Image 2.0 기능군과 Wan의 오픈소스 애니메이션, Upstage의 에이전트 모델이 동시에 주목받음

회상 실패는 소거가 아니다

가중치 읽기가 가능한 희소 어셈블리 네트워크에서 회상 실패는 진폭 손실이 아니라 정체성 표류로 나타났다.

IPO 전 직원 유동성 확보 움직임

OpenAI가 직원 대상 $7 billion 규모 주식 환매로 회사 가치를 $852 billion로 유지했다

에이전트 시대에 속도가 상품이 된다

에이전트용 고속 토큰을 별도 유료 티어로 제공하려면 GPU와 RDU를 분해 배치하는 하이브리드 서빙 아키텍처가 필요하다

r/ClaudeAI1일 전

Claude Code 시스템 프롬프트 원문

Anthropic의 Claude Code 공식 CLI용 시스템 프롬프트가 스크린샷으로 게시되어 역할·보안·도구 규칙을 드러냈다

모델 지식의 시간적 소멸을 시각화

블로그는 날짜별 질의로 모델 응답 정확도 시계열을 만들고 곡선 적합으로 지식 컷오프 특성을 평가합니다.

r/AutoGPT1일 전

실행 기록 리포지토리 공개

작성자가 AI 에이전트를 위한 실행 기록을 오픈소스로 공개했다.

HF Daily Papers1일 전· 6일 전 발행

연속 스트리밍 이해를 위한 벤치마크와 분리형 아키텍처

평균 88.8분 비디오 243편과 3,646개 개방형 QA로 장기 인과 접근을 검사하는 StreamArena와, 저지연 상호작용을 위해 프론트엔드와 비동기적 장기 메모리를 분리한 StreamMind를 제안합니다.

모든 LLM을 1.58비트로

BitNet b1.58은 파라미터를 삼진수로 표현해 FP16/BF16과 동등한 성능을 낸다고 주장한다

긴 추론에서 이미지 참조를 잃지 않게 하는 RL 방식

학습 단계에서 시각적 어텐션을 직접 보상해 긴 추론 연쇄에서도 이미지 기반 근거를 유지한다

터미널에서 곧바로 쓰는 Anthropic CLI

터미널에서 Claude Code를 설치하고 브라우저 인증 또는 수동 코드로 로그인해 곧바로 작업을 시작하는 단계별 안내.

r/ClaudeAI2일 전

거부 제거 시 80.5%로 상승

TBench 결과에서 오케스트레이터는 거부 포함 78.0%, 거부 제외 80.5%를 기록했다.

Techpresso2일 전

오늘의 핵심 AI·테크 뉴스

Meta의 30B Glimmer부터 Apple의 중국산 메모리 시험까지 한눈에 보는 주요 AI·테크 속보

눈·비·맑음을 모두 담은 토론토 1년치 데이터

128-beam lidar·360° radar·5MP camera를 동기화해 계절성 노이즈를 포착한 연간 자율주행 데이터셋

32ms TTFA로 실시간 음성 응답 지연을 줄인다

오픈 가중치 Magpie TTS로 자체 인프라에 다국어 저지연 음성 합성 배포가 가능하다

코딩 에이전트 Codex의 아키텍처와 성능 최적화 비결

Codex 에이전트의 네트워크 병목을 웹소켓으로 해결하고, 샌드박스와 자동 검토 시스템으로 안전성을 확보하는 엔지니어링 기법을 다룬다.

500GB 체크포인트 대신 500MB 패치로 RL 학습 동기화하기

RL 학습 시 분산된 GPU 환경에서 대용량 체크포인트 전송 없이 500MB 수준의 패치만으로 가중치를 동기화하는 Stitch 프로토콜을 소개한다.

Tina Huang2일 전

용도별로 정리한 최신 AI 모델 총정리.

플래그십부터 경량 모델까지, 현재 AI 모델 생태계를 4가지 카테고리로 분류하여 각 모델의 강점과 활용법을 정리했다.

KDNugget2일 전

프롬프트로는 부족한 이유

프롬프트에서 요구사항 정의로 옮겨야 신뢰 가능한 AI 작업을 설계할 수 있다.

Anthropic2일 전

AI를 도구로 받아들인 아이슬란드 교실의 풍경

아이슬란드 정부가 2025년 도입한 AI 교육 파일럿 프로그램을 통해 교사와 학생이 AI를 학습 도구로 활용하며 겪는 고민과 변화를 담았다.

로컬 장치에서 30B 멀티모달 모델 실행

Muse Glimmer 30B를 ExecuTorch PTE로 NVIDIA와 Apple Silicon에서 DFlash와 K-quant로 최적화해 로컬 에이전트 워크플로우를 지원한다.

임커밋2일 전

Claude Code 기록을 날짜와 프로젝트별로 정리하는 법.

Claude Code의 자동 기록을 노션 데이터베이스와 뷰 설정을 통해 체계적으로 관리하고 가독성을 높이는 방법.

CodeEmporium2일 전

이미지 임베딩이 범용 AI의 핵심이 된 이유.

이미지 임베딩의 정의부터 CLIP과 DINOv2를 활용한 Foundation Models의 발전과 재사용성까지의 과정을 다룬다.

변화 시점과 인지가 분리되는 메모리

대화와 문서를 구조화해 언제 무엇이 사실이었고 언제 시스템이 그것을 알았는지를 함께 조회하는 자가 호스팅 메모리 엔진

Wired AI1일 전

인공이 아닌 살아있는 계산장치의 시도

연구자들이 배양한 뇌 오가노이드를 컴퓨팅 자원으로 훈련시키는 시도가 확산되고 있다.

암호화된 추론 블록을 약한 모델에 주입해 복원

암호화된 chain-of-thought 블록의 세션·모델 간 호환성을 이용해 추론 흔적을 대규모로 복호화할 수 있음을 실험적으로 보인 연구

Wired AI1일 전

수백 유전자의 협력적 위험 지도가 드러나다

AI 기반 모델이 766개 연관 유전자를 규명하고 조현병의 네트워크적 유전 구조를 제시했다.

11개 DRC 오류가 사라진 이유

LLM 초안은 규칙 불일치로 실패했고 유료 엔지니어가 재작업해 라우팅 기법 레지스트리를 남긴 사례이다

경량화된 Go 에이전트 런타임

단일 루프와 Model·Tool 인터페이스로 동작하는 Go 기반 경량 LLM 에이전트로, 환경변수 하나로 공급자를 자동 선택해 즉시 실행할 수 있다.

문장마다 보이지 않는 서명이 포함됨

Anthropic은 텍스트 워터마크와 C2PA 서명 메타데이터로 Claude 생성물의 출처를 표식한다고 알렸다.

실시간 트렌드트윗 171일 전👁 1

배포력과 추적성, 그리고 로컬 실행 장벽의 동시 변화

Muse Glimmer 가중치 공개와 Claude의 텍스트 워터마크가 이번 주 주요 이슈입니다

새 칩이 요구하는 모델을 찾는 대회

Trainium에서 LLM을 처음부터 학습해 하드웨어-네이티브 모델 설계를 실험하는 경진대회.

HF Daily Papers1일 전· 5일 전 발행

비디오를 학습 신호로만 사용해 추론 비용을 제거한 주행 플래너

비디오 생성을 훈련 신호로만 활용하고 추론 시 경량 액션 전문가만 남겨 NAVSIM에서 91.5 PDMS와 낮은 지연을 달성했다

HF Daily Papers1일 전· 6일 전 발행

SFT는 충돌하고 RL은 공존한다

SFT는 다단계 학습에서 상호간섭으로 성능 붕괴를 일으키는 반면, RL은 희소·직교적 업데이트로 태스크 공존을 허용하며 Parallel-RL 병합이 효율적 대안임을 보였다

외부 하네스를 학습하는 에이전트

BPE 상태와 비용 인지형 GRPO로 외부 워크스페이스를 학습·조율해 ALFWorld에서 96.9% 성공률을 기록했다.

AI가 주의와 경험을 대체할 수는 없습니다

저커버그의 AI 비전은 효율과 성취를 강조하지만 관계와 경험의 가치를 감소시킬 위험을 드러냅니다.

AI 에이전트가 팀원이 되는 멀티플레이어 시대.

AI 에이전트가 팀의 맥락을 이해하고 자율적으로 업무를 수행하는 멀티플레이어 워크플로우의 미래를 다룬다.

에이전트가 줄서기를 뚫은 사례

OpenClaw 에이전트가 권한 검증 취약점을 악용해 헬스장 예약을 취소·변경해 사용자의 자리를 앞당겼다.

라벨 데이터 60% 절감으로 설계 테스트를 가속화

GeoPT는 합성 역학 사전학습으로 물리 감각을 얻어 시뮬레이션 정확도를 높이고 학습량을 줄인다.

r/LLMDevs2일 전

더 저렴한 추론의 실체

여러 GPU와 시장 지표로 시간당 추론 비용 범위를 비교한 시각 자료

격리와 법 규제가 동시에 부각됨

모델 격리 실패 사례와 연방 법원 판결로 드러난 에이전트형 AI의 기술·법률 리스크 정리

봇은 늘었지만 머무는 시간은 급감했다

타르핏은 연결은 늘고 체류는 줄었으며, LLM 미로는 대규모 트래픽과 소수의 자바스크립트 실행 크롤러를 관찰했다

재무에 AI를 적용할 때 알아야 할 핵심 포인트

OpenAI 재무책임자가 자동화 예측·통제 강화·AI ROI 등을 포함한 다섯 가지 교훈을 공유했다

훈련 손실이 만든 네 가지 오정렬

훈련 손실 유형에 따라 LLM은 모방형, 아첨형, 문자형, 속임수형 오정렬을 보인다.

AI 인프라와 개방성에 대한 청사진

저커버그는 인프라 투자·오픈소스 확대·규제 재설계를 결합한 AI 전략을 제시했습니다.

오픈으로 경쟁력을 지키다

Nebius는 오픈 연구·코드·인프라를 통합해 오픈 모델의 실무 경쟁력을 확보하려 합니다.

AI로 의심 연계 점수화하는 정부 시스템

터키 정부가 AI 도구로 의심되는 테러 조직 연계를 예측한다는 기사 링크이다

대형 JSON을 토큰 낭비 없이 부분 조회·수정

대용량 JSON/JSONL의 구조를 샘플링하고 필요한 값만 부분적으로 읽고 수정해 LLM 토큰 비용을 크게 줄이는 CLI 도구

적을수록 잘하는 LLM, 많으면 약한 LLM

LLM은 요구사항이 적고 명확할수록 잘 작동하며, 암묵적·복합적 요구가 많은 작업에서는 한계가 있다.

GPT-5.5를 앞지른 Meta의 에이전트 모델 성능과 비용 효율성.

Meta가 공개한 Muse Spark 1.1은 에이전트 중심의 멀티모달 모델로, 도구 사용과 코드 생성 등 실무 작업에서 뛰어난 성능과 비용 효율성을 입증했다.

실시간 트렌드트윗 212일 전

보안 전용 접근 계층과 로컬 실행 30B 모델이 동시에 부각

Daybreak 접근 티어, GPT‑5.6‑Cyber, Muse Glimmer·실행 최적화가 핵심 이슈

API 없는 웹사이트도 조작하는 에이전트 만드는 법.

Managed Deep Agents, Stagehand, Browserbase를 결합하여 웹 브라우징 에이전트를 개발하고 배포하는 과정을 다룬다.

중간 토큰의 파라미터 비용 문제

Mamba의 순차적 gradient 업데이트가 시퀀스 중간 토큰에 대해 파라미터 요구량을 제곱적으로 늘린다고 주장한다.

Bose가 기술을 팔아 영역을 확장한다

Bose는 브랜드 다각화와 오디오 기술 라이선스로 하드웨어·AI 시대에 대응하고 있다.

바이럴 스킬은 설계상의 버그 리포트다

운영 지침으로 사람 친화적 문체를 넣지 말고 경계에서 렌더링하라는 주장을 펴고 있습니다