본문으로 건너뛰기

2026년 8월 13일 AI 뉴스

49

관심 태그 추가
AI EngineerNEW3시간 전

코딩 에이전트만 성공하는 이유, 지능과 전문성의 차이

LLM의 지능은 범용적이지만 전문성은 부족하다. 지속적 학습을 통해 경험을 압축하고 전문성을 쌓아야만 에이전트가 실질적인 업무를 수행할 수 있다.

AI EngineerNEW3시간 전

AI 연구자 5천 명 시대, AutoScientist가 바꿀 판도.

AutoScientist는 데이터와 모델을 자동 최적화하여 연구 장벽을 낮추고, 모델 크기 경쟁을 넘어선 새로운 AI 연구 패러다임을 제시한다.

TechCrunch AINEW3시간 전

AI 개방성의 조건을 가른 세 연구자

Hinton, Li, Ng가 AI 개방성과 통제의 균형을 두고 서로 다른 해법을 내놓았습니다.

Twitch, AI 학습 거부 토글 추가

Twitch가 Amazon 생성형 AI 학습에 채널 콘텐츠를 쓰지 못하게 하는 선택 설정을 추가했습니다.

r/LLMDevsNEW3시간 전

코사인 유사도보다 답변 의존도

최종 답변의 청크 의존도로 재정렬하자 임베딩 교체보다 정확도가 크게 변했습니다.

실시간 트렌드트윗 344시간 전

Grok 4.6 성능 경쟁, SL2T 접근성, 오픈 웨이트 실행 최적화

Grok 4.6 출시가 GDPVal-AA 1,753 ELO와 에이전틱 성능으로 확산되는 사이 SL2T·Qwen3.8·Keras 3가 실제 입력·실행·서빙 경로를 넓혔다.

Hacker News - LLMNEW4시간 전

LLM 문장을 그대로 올리지 말아야 하는 이유

LLM 텍스트는 다시 쓰고 검증하며 생성 조건까지 밝혀야 독자의 신뢰를 지킬 수 있습니다.

WRITERNEW4시간 전

Vanguard의 AI 준비는 브랜드에서 시작됐다

Vanguard 사례는 AI 도입보다 먼저 통합된 마케팅 인프라와 일관된 브랜드 정체성을 구축해야 한다는 점을 보여준다.

WRITERNEW4시간 전

마케팅 AI, CIO에게 이렇게 설득하세요

마케팅 AI 도입은 기능보다 거버넌스와 비용 근거로 설득해야 합니다.

Adam은 왜 저랭크 편향을 잃나

Adam의 좌표별 second moment가 회전 대칭을 깨뜨려 저랭크 복원을 방해하며, shared-scalar 방식에서는 성능이 회복됐다.

MindTopo, 행동 속 위상 추적을 시험하다

MindTopo는 멀티모달 모델이 정적 장면을 넘어 행동 과정의 연결·포괄·매듭 관계를 유지하는지 평가합니다.

TechpressoNEW4시간 전

Gemini, 월간 사용자 10억 명

Gemini가 월간 사용자 10억 명을 넘기고 Grok Bot과 AI 에이전트 경쟁이 본격화됐습니다.

Pinecone BlogNEW4시간 전

에이전트는 API를 매 작업마다 다시 고른다

에이전트가 API를 안정적으로 선택하고 복구하도록 오류·context·인증·도구 surface를 설계하는 원칙을 정리했습니다.

Claude Design과 Claude Code로 앱을 처음부터 끝까지 만드는 법.

Claude Design으로 디자인 시스템을 구축하고, 와이어프레임과 프로토타입을 거쳐 Claude Code로 실제 앱을 개발하는 5단계 워크플로우.

Ars Technica AINEW5시간 전

AI 학습이 책을 파괴하는 이유

책을 빠르게 AI 학습 데이터로 바꾸는 과정에서 실물 도서가 파괴될 수 있다는 우려와 그 대안을 다룬 글입니다.

Hacker News - LLMNEW5시간 전

내 GPU에 맞는 LLM 고르기

VRAM과 컨텍스트, 작업 유형을 맞춰 로컬 LLM의 실행 가능 모델과 속도를 계산하는 방법을 정리합니다.

에이전트의 신뢰성을 측정하는 τ-bench와 τ²-bench.

대화형 에이전트의 도구 사용, 정책 준수, 협업 능력을 다각도로 평가하는 벤치마크 τ-bench와 τ²-bench의 설계 원리와 분석 결과를 다룬다.

KDNuggetNEW6시간 전

노트북을 넘어선 포트폴리오

DoorDash 배달 시간 예측을 SQL부터 배포와 추천까지 연결하는 포트폴리오 구축법

Kili Technology BlogNEW6시간 전

NLP가 일상과 산업을 바꾸는 방식

Natural Language Processing과 Machine Learning의 작동 원리와 산업별 활용, 도입 한계를 정리한 글입니다.

흩어진 메모를 체계적인 위키로 바꾸는 LLM 자동화

음성 받아쓰기로 수집한 원시 데이터를 LLM 에이전트로 정제하고, 위키와 그래프 뷰로 시각화하여 개인 지식 베이스를 자동 구축하는 방법.

Qwen, SWE-bench 제출 속도 3배 높인 증류 전략.

오프라인 및 온라인 힌팅 전략을 결합하여 정답 데이터 없이도 엔터프라이즈 모델의 성능을 지속적으로 개선하는 방법론.

AI EngineerNEW3시간 전

에이전트 평가, 챗봇 시대의 방식이 실패하는 이유.

에이전트의 치명적 오류를 방지하는 하한선(Floor) 중심의 코드 기반 평가 전략과 실전 이슈 탐지법을 다룬다.

Incident Memory가 장애 대응 기억을 축적

유사 장애 검색과 LLM 해결책 생성을 사람의 승인 및 메모리 갱신과 연결한 Flask 애플리케이션입니다.

Lovable, 4억 달러 투자 유치

vibe-coding 스타트업 Lovable이 13.3 billion 달러 기업가치로 400 million 달러를 조달했다.

D’Addario의 AI 음악 부인, 결국 번복

D’Addario가 홍보 트랙 재생성에 Suno Studio를 사용했다고 인정하고 AI 사용 공개 절차를 강화하기로 했다.

AI EngineerNEW5시간 전

ICL이 복잡한 시스템을 제치고 지속 학습 리더보드 1위를 차지한 이유.

기존 벤치마크의 독립적 태스크 평가 방식을 비판하고, 모델의 실제 학습 개선도를 측정하는 Gain 메트릭과 지속 학습 벤치마크를 제안한다.

AI EngineerNEW5시간 전

GRPO가 긴 대화에서 헤매는 이유와 자기 증류로 해결하는 법

온폴리시 자기 증류(OPSD)를 사용하여 AI 모델이 스스로 힌트를 생성하고 학습함으로써, 기존 RLHF나 GRPO의 한계를 극복하고 지속적으로 성능을 개선하는 방법.

AI EngineerNEW5시간 전

장기 에이전트, 메모리 리콜 정책이 성능을 가르는 이유.

장기 실행 에이전트에서 메모리를 쓰기-관리-읽기 제어 루프로 설계하여 성능과 비용 효율성을 최적화하는 방법을 다룬다.

LLM이 개인 데이터를 학습해도 생성 능력이 붕괴하는 이유.

공개 데이터로 학습된 LLM이 개인화된 도메인 지식을 습득할 때 발생하는 성능 붕괴 문제를 해결하기 위해, 데이터가 아닌 연산(Compute)을 확장하여 모델의 깊이를 확보하는 연구 방향을 제시한다.

VideoVerse 인수금, 법정 공방으로

AI 클립 스타트업 VideoVerse의 250 million 달러 인수가 위조 문서와 미지급금 의혹으로 법정 공방에 휘말렸습니다.

Hacker News - LLMNEW5시간 전

에이전트 권한 남용, OWASP 3위

OWASP의 2026년 LLM 보안 순위에서 에이전트의 과도한 자율성이 3위로 뛰어오르며 권한 관리의 중요성이 커졌다.

Codex가 기업 업무를 실행 단계로 이끕니다

OpenAI의 두 연구는 기업 AI 활용이 질문 응답에서 도구 연결형 업무 실행으로 이동하며 조직별 격차가 커지고 있음을 수치로 보여줍니다.

r/artificialNEW6시간 전

병합된 PR만 성과로 인정

오픈소스 취약점을 찾아 패치하고 사람의 검토 뒤 병합까지 이룬 자율 AI 사례

Gemma 3 4B, 내장 그래픽도 실행

같은 Gemma 3 4B는 전용 GPU에서 더 빠르게 응답했지만 통합 그래픽 노트북에서도 일상 작업을 수행했다.

The Verge AINEW6시간 전

Pixel Watch 5, 건강 AI에 집중

Google Pixel Watch 5가 하드웨어보다 Gemini와 건강 추세 분석을 강화했습니다.

TechCrunch AINEW6시간 전

Pixel 카메라에 수어 번역

Google이 Gemini 기능과 Pixel Tag를 앞세운 Pixel 11 시리즈와 Pixel Watch 5를 공개했습니다.

Hacker News - LLMNEW6시간 전

Frontier LLM, 팩트체크 판정 63% 엇갈려

다섯 Frontier LLM은 실제 사실 주장 63%에서 서로 다른 판정을 내렸다

Wired AINEW6시간 전

Pixel 11 카메라, AI가 촬영을 대신한다

Pixel 11은 Gemini 기반 Magic Capture와 120X 줌, 4.5배 빨라진 Instant Night Sight로 스마트폰 촬영 방식을 확장합니다.