본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
오픈 모델과 폐쇄형 API 간 실시간 비용·지연·토큰 밀도 벤치마크 공유
상시 통신이 다중 에이전트 AI의 조정을 방해한다는 연구 결과
AI가 운영하는 AI 윤리 위원회 구축 사례: Claude 인스턴스의 동의와 4단계 분류 체계
Amazon Bedrock의 Claude Tool Use를 활용한 맞춤형 엔티티 인식 가속화
르브론 제임스는 대통령이다: 소셜 엔지니어링을 통한 LLM 정렬 우회 분석
Import AI 447: AGI 경제학, 게임 기반 AI 벤치마크 및 에이전트 생태계의 취약성
Anthropic 경제 지수: AI 활용 이해를 위한 새로운 경제적 기본 단위 도입
추론 모델의 사고 과정(Chain-of-Thought) 제어 능력 부족에 관한 연구
AA-Omniscience 벤치마크: 오픈소스 모델이 환각 억제에서 상용 모델을 압도하다
주요 LLM 벤치마크 결과: Gemma 4 31B가 'Think' 모드에서 78.7%로 1위 기록
전략적 내비게이션인가, 확률적 검색인가? 에이전트와 인간의 문서 컬렉션 추론 방식 비교
← 피드로 돌아가기
Claude Sonnet 4.5
Language Models (대형 언어 모델)
약 19개 아티클
관련 태그:
Anthropic
GPT-5.2
Claude 3.7 Sonnet
Claude 3.5 Sonnet
Atlas
AWS Lambda
Alignment
Claude
Chain of Thought
Amazon Bedrock