본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
신경망 훈련 없이 자기대결로 진화한 닫힌 형식 신경-심볼릭 전술 관찰
MEMO: 강건한 다회차 다중 에이전트 LLM 게임을 위한 메모리 증강 모델 컨텍스트 최적화
재귀적 자기 개선(RSI)의 시대: 물리적 한계를 넘어선 AI 가속화와 새로운 병목 현상
구글 리서치 풋볼 경진대회 2위 팀 SaltyFish의 강화학습 전략 분석
Tool-R0: 제로 데이터 기반 도구 학습을 위한 자가 진화 LLM 에이전트
← 피드로 돌아가기
Self-play
Training (학습/파인튜닝)
약 5개 아티클
관련 태그:
Anthropic
Google Research Football
GPU
GRPO
IMPALA
Meta
Multi-Agent
Neuro-Symbolic
NVIDIA
Prompt Optimization