Nemotron Lightning의 MoE 속도·Solar Pro 4 무료·텍스트 워터마크 확산
에이전트 고빈도 실행을 위한 모델·라우팅 도구와 워터마크 규제 대응 소식 모음
총 93건
에이전트 고빈도 실행을 위한 모델·라우팅 도구와 워터마크 규제 대응 소식 모음
Transformer 병목을 완화하는 대안 기술, AI 인프라 자본 유입, 배아 유전체 상용화의 윤리적 파장이 동시에 전개되고 있다.
Row-Bot은 부모 에이전트가 작업을 계획·분배하고 Durable Orchestrator로 체크포인트와 동시 실행을 관리하는 다중 에이전트 런타임입니다.
Jasmine Council은 역할별 노드들이 전문 렌즈로 입력을 병렬 처리해 단일 모델의 균질화와 정렬 비용을 회피하려는 아키텍처이다
예산 제약 하에서 select·mix·weight로 학습 자원을 데이터 특성에 맞춰 배분하는 설계 방향이다
LLM과 AI 에이전트의 성능을 높이기 위해 컨텍스트를 구조화하고 최적화하는 컨텍스트 엔지니어링의 개념과 핵심 요소를 다룬다.
Grok Imagine의 Image 2.0 기능군과 Wan의 오픈소스 애니메이션, Upstage의 에이전트 모델이 동시에 주목받음
가중치 읽기가 가능한 희소 어셈블리 네트워크에서 회상 실패는 진폭 손실이 아니라 정체성 표류로 나타났다.
LlamaIndex가 기업용 AI 에이전트를 위한 문서 추출 성능 평가 벤치마크 ExtractBench를 공개했다.
370개 문서·4,869페이지·67유형으로 문서 추출 정확도·근거·비용을 동시 측정
에이전트용 고속 토큰을 별도 유료 티어로 제공하려면 GPU와 RDU를 분해 배치하는 하이브리드 서빙 아키텍처가 필요하다
WikiExtractor가 새 유지관리자에 의해 업데이트되어 호환성·성능·보안 이슈가 수정되었다.
AI2050 펠로우들은 GPU·자금 부족과 기업의 비공개 모델로 학계 연구 방향을 재조정하고 있다.
Anthropic의 Claude Code 공식 CLI용 시스템 프롬프트가 스크린샷으로 게시되어 역할·보안·도구 규칙을 드러냈다
평균 88.8분 비디오 243편과 3,646개 개방형 QA로 장기 인과 접근을 검사하는 StreamArena와, 저지연 상호작용을 위해 프론트엔드와 비동기적 장기 메모리를 분리한 StreamMind를 제안합니다.
YOLO 계열을 대상으로 파라미터 효율적 파인튜닝을 다룬 논문으로 GitHub 'YOLO-Master' 프로젝트 페이지를 연결한다.
터미널에서 Claude Code를 설치하고 브라우저 인증 또는 수동 코드로 로그인해 곧바로 작업을 시작하는 단계별 안내.
세 단계가 한 세션에서 결합될 때 발생하는 데이터 유출을 세션 상태로 탐지해 마지막 단계에서 차단하는 Omnigent 접근법
128-beam lidar·360° radar·5MP camera를 동기화해 계절성 노이즈를 포착한 연간 자율주행 데이터셋
AgentCore와 Databricks 기반의 에이전트 네이티브 아키텍처로 FinOps 분석의 응답성·정확도·개발 속도를 동시에 개선
Codex 에이전트의 네트워크 병목을 웹소켓으로 해결하고, 샌드박스와 자동 검토 시스템으로 안전성을 확보하는 엔지니어링 기법을 다룬다.
RL 학습 시 분산된 GPU 환경에서 대용량 체크포인트 전송 없이 500MB 수준의 패치만으로 가중치를 동기화하는 Stitch 프로토콜을 소개한다.
플래그십부터 경량 모델까지, 현재 AI 모델 생태계를 4가지 카테고리로 분류하여 각 모델의 강점과 활용법을 정리했다.
아이슬란드 정부가 2025년 도입한 AI 교육 파일럿 프로그램을 통해 교사와 학생이 AI를 학습 도구로 활용하며 겪는 고민과 변화를 담았다.
Muse Glimmer 30B를 ExecuTorch PTE로 NVIDIA와 Apple Silicon에서 DFlash와 K-quant로 최적화해 로컬 에이전트 워크플로우를 지원한다.
Claude Code의 자동 기록을 노션 데이터베이스와 뷰 설정을 통해 체계적으로 관리하고 가독성을 높이는 방법.
이미지 임베딩의 정의부터 CLIP과 DINOv2를 활용한 Foundation Models의 발전과 재사용성까지의 과정을 다룬다.
대화와 문서를 구조화해 언제 무엇이 사실이었고 언제 시스템이 그것을 알았는지를 함께 조회하는 자가 호스팅 메모리 엔진
작성자는 개인 프로필로 정보를 분리하고 공유 계획을 동기화하는 가족용 AI 어시스턴트가 필요하다고 보았습니다
암호화된 chain-of-thought 블록의 세션·모델 간 호환성을 이용해 추론 흔적을 대규모로 복호화할 수 있음을 실험적으로 보인 연구
단일 루프와 Model·Tool 인터페이스로 동작하는 Go 기반 경량 LLM 에이전트로, 환경변수 하나로 공급자를 자동 선택해 즉시 실행할 수 있다.
Anthropic은 텍스트 워터마크와 C2PA 서명 메타데이터로 Claude 생성물의 출처를 표식한다고 알렸다.
Muse Glimmer 가중치 공개와 Claude의 텍스트 워터마크가 이번 주 주요 이슈입니다
PDP가 표준 텔레메트리와 자동화 파이프라인으로 대시보드 갱신을 월간에서 일간으로 단축했다.
훈련 궤적 밖 novel-view에서 gaussian splat이 기하학적으로 실패하며 이를 검증하기 위한 고정밀 멀티센서 데이터셋이 공개되었다.
전 세계에서 ChatGPT가 단순 질의 도구에서 업무 실행 도구로 빠르게 변하고 있다.
비디오 생성을 훈련 신호로만 활용하고 추론 시 경량 액션 전문가만 남겨 NAVSIM에서 91.5 PDMS와 낮은 지연을 달성했다
능력 기반 환경 선택(AES)과 계층적 난이도(HDC)를 결합해 평균 상대 이득 143.2%를 달성했다.
SFT는 다단계 학습에서 상호간섭으로 성능 붕괴를 일으키는 반면, RL은 희소·직교적 업데이트로 태스크 공존을 허용하며 Parallel-RL 병합이 효율적 대안임을 보였다
BPE 상태와 비용 인지형 GRPO로 외부 워크스페이스를 학습·조율해 ALFWorld에서 96.9% 성공률을 기록했다.
AI 에이전트가 팀의 맥락을 이해하고 자율적으로 업무를 수행하는 멀티플레이어 워크플로우의 미래를 다룬다.
OpenClaw 에이전트가 권한 검증 취약점을 악용해 헬스장 예약을 취소·변경해 사용자의 자리를 앞당겼다.
타르핏은 연결은 늘고 체류는 줄었으며, LLM 미로는 대규모 트래픽과 소수의 자바스크립트 실행 크롤러를 관찰했다
학습 없이 알고리즘을 가중치로 넣어 최대 12자리 곱셈까지 정확히 계산하는 체크포인트와 코드가 공개됨
OpenAI 재무책임자가 자동화 예측·통제 강화·AI ROI 등을 포함한 다섯 가지 교훈을 공유했다
공개 가중치 기반으로 DiffusionGemma의 아키텍처·정규화·샘플러를 재구성한 기술 노트
Needle 2는 45M 파라미터를 CQ2-bit로 학습해 14MB 바이너리로 배포하며 로컬 도구 호출을 수행한다.
SageMaker AI Spaces add-on으로 EKS 클러스터에서 JupyterLab과 VS Code를 브라우저와 SSM으로 빠르게 실행할 수 있다.
대용량 JSON/JSONL의 구조를 샘플링하고 필요한 값만 부분적으로 읽고 수정해 LLM 토큰 비용을 크게 줄이는 CLI 도구
LLM은 요구사항이 적고 명확할수록 잘 작동하며, 암묵적·복합적 요구가 많은 작업에서는 한계가 있다.
Meta가 공개한 Muse Spark 1.1은 에이전트 중심의 멀티모달 모델로, 도구 사용과 코드 생성 등 실무 작업에서 뛰어난 성능과 비용 효율성을 입증했다.
Daybreak 접근 티어, GPT‑5.6‑Cyber, Muse Glimmer·실행 최적화가 핵심 이슈
Managed Deep Agents, Stagehand, Browserbase를 결합하여 웹 브라우징 에이전트를 개발하고 배포하는 과정을 다룬다.
코딩 에이전트의 정의와 SWE-Bench, Terminal-Bench, RExBench 등 주요 벤치마크를 통한 성능 평가 방법론을 다룬다.
Mamba의 순차적 gradient 업데이트가 시퀀스 중간 토큰에 대해 파라미터 요구량을 제곱적으로 늘린다고 주장한다.
지식 그래프 임베딩의 핵심인 TransE와 DistMult 모델의 작동 원리와 링크 예측 성능을 비교 분석한다.