본문으로 건너뛰기

2026년 8월 2일 AI 뉴스

29

관심 태그 추가

코드 이해에 토큰 약 30% 절감

Language Server Protocol을 통해 에이전트가 컴파일러 API에서 구조화된 코드 정보를 받아 토큰과 실행 시간을 줄였다.

실시간 트렌드트윗 1310일 전

TTA 필요성 지적·LLM이 직접 코드·OS를 생성하는 사례 등장

fchollet의 TTA 소명, Opus 5의 5,500줄 코드 생성 시연, DeepSeek의 단일‑GPU 우세·Jailbreak 사례가 핵심

Kimi k3가 구현한 루프와 그래프 기반 에이전트 구조.

Kimi k3 모델의 내부 아키텍처를 분석하고 에이전트 시스템의 핵심인 하네스, 루프, 그래프 엔지니어링 기법을 살펴본다.

유사도만으로는 못 잡는 캐시 오탐을 검증기로 줄이기

파인튜닝된 검증기를 추가하면 동일 오류율에서 캐시 적중률을 올릴 수 있지만 지속적 재학습과 드리프트 관찰이 필요하다.

AI 에이전트가 자신 있게 거짓말하는 이유와 이를 막는 4가지 방법

AI 에이전트의 환각 현상을 줄이기 위해 데이터 접지, 도구 활용, 작업 범위 제한, 인간 개입이 필요하다.

Tom Mitchell의 학습 정의

Tom Mitchell의 E/T/P 틀과 확률적 관점으로 ML 개념을 간결히 정리한 입문 영상.

실시간 트렌드트윗 610일 전👁 2

동영상 업로드로 질의응답, 검색은 서비스로 분리, 실행 기반 자기개선

동영상 업로드로 질문하고, 검색은 별도 서비스로 호출하며, 모델이 후보를 실행해 스스로 개선하는 흐름이 주목받음

API 실패와 오래된 벡터를 견디는 엔지니어링 체크리스트

무료 인프라에서 안정적 RAG·에이전트 운영을 위한 결정론적 벡터 관리·동적 툴 등록·회로 차단기 패턴

'bank'가 강가인지 대출인지 구분하는 Attention의 계산법

Attention 메커니즘은 Query, Key, Value 벡터를 활용해 단어 간 문맥을 파악하고 가중치를 계산하여 문맥적 의미를 도출한다.

AI가 AI를 만드는 지능 폭발, 이미 시작된 기술적 특이점.

Sam Altman의 발언을 통해 AI가 스스로를 개선하며 기술 발전을 가속화하는 지능 폭발과 기술적 특이점의 의미를 분석한다.

16GB 머신에서 세션의 75%가 KV 캐시를 초과합니다

4265개 실제 세션 측정으로 툴 정의가 KV 캐시 병목을 만들고 q4_0 양자화가 일부 모델에서 심각한 품질 저하를 유발한다고 보고합니다.

외형 없이도 3D MOTA를 얻는 단순한 방법

3D 실린더 가설을 카메라별로 투영해 IoU로 점수화하는 병렬화 가능한 다중카메라 트래킹 구현체와 재현 레포 공개

r/LLMDevs11일 전

q4_0이 2K 이후 퍼플렉시티를 증가시킴

q8_0/q8_0이 이 실험에서 메모리·정확도·속도 균형의 최적 지점이었다

Qwen·Mistral·GGUF 모델의 로컬 실행 가능

OpenCode가 LM Studio의 OpenAI 호환 API 서버를 통해 Qwen, Mistral 및 GGUF로 적재된 모델의 로컬 추론을 가능하게 한다.

실시간 트렌드트윗 410일 전

로컬 대용량 메모리·절차적 세계 생성·반복업무 자동화가 동시에 주목받음

DeepSeek V4‑Flash의 GGUF 공개, Opus 5의 5500줄 JS 생성, ChatGPT의 'cron job' 활용이 주요 화제입니다.

모델 교체보다 입력 정리가 먼저다

출력 불만이 생기면 모델을 바꾸기보다 전달하는 컨텍스트의 최신 사실·예시·수정 이력을 정리하라

Claude와 실제로 연결되는 앱을 출처 기반으로 정리한 페이지

Connector Scout가 제공하는 Claude용 커넥터 현황 페이지 링크입니다.

실시간 트렌드트윗 810일 전

채팅에서 이미지와 앱을 바로 만들고 배포하는 흐름이 나왔다

Grok의 실시간 빌드·게시, 에이전트 평가 축, 저비용 인용이 주목을 모았다

Reddit·X 등에서 AI 반응을 집계

ai-census.com이 Reddit, Bluesky, X, Hacker News, GitHub에서 AI 모델에 대한 사용자 감성·태도를 집계한 데이터를 출처로 제시한 스크린샷을 공유했다.

어떤 모델이 더 인간처럼 쓰는가

인간 선호도를 포함한 오픈소스 벤치마크로 모델의 비인간적 문장 특성('슬롭')을 측정했고 기계적 점수와 인간 선호도가 충돌하는 사례가 관찰되었다

탭 전환으로 끊기는 기억을 자동으로 이어주는 방법

Claude는 탭마다 새 대화를 사용해 활성 컨텍스트를 외부에서 줄일 수 없으므로 세션 브리징과 브라우저 확장이 실용적 대안이다.

r/artificial11일 전

온라인 행동으로 보험료가 오른다는 주장 점검

보험사가 온라인 활동을 AI로 분석해 위험을 산출하고 보험료에 반영한다는 주장에 대한 팩트체크 링크 공유

실시간 트렌드트윗 511일 전👁 1

Grok 4.5·DeepSeek·AGENTS.md·CLIP 핵심 포인트

Grok 4.5의 Pareto 주장과 DeepSeek의 가격·성능 갱신, AGENTS.md 실험 결과, CLIP 단계 분해를 한눈에