관련 기사 바로가기
OctoMed: 최첨단 멀티모달 의료 추론을 위한 데이터 레시피DeepSeek 저자 Zihan Wang 인터뷰: MoE 아키텍처와 자가 학습 에이전트의 미래MobilityBench: 실세계 이동성 시나리오에서의 경로 계획 에이전트 평가를 위한 벤치마크CHIMERA: 일반화된 LLM 추론을 위한 콤팩트한 합성 데이터인간과 대형 언어 모델의 확률적 추론 차이 분석모델을 믿으세요: 분포 가이드 기반의 신뢰도 보정MOOSE-Star: 복잡성 장벽을 깨고 과학적 발견을 위한 다룰 수 있는 학습 구현하기추론 모델의 사고 과정(Chain-of-Thought) 제어 능력 부족에 관한 연구주요 AI 모델들의 코로나 백신 접종 선택에 대한 반응 비대칭성 실험Aurora: LLM의 내면 세계를 시각과 소리로 표현하는 자율 예술 시스템Qwen 3.5 4B 모델의 놀라운 추상화 능력: 대형 모델들을 압도하다소형 언어 모델(SLM)의 추론 능력 진화: 예진 최 교수와의 대담2025년 가장 영향력 있었던 AI 모델 출시 Top 52025년 AI 업계를 뒤흔든 10대 뉴스 결산LLM과 강화학습: AI 에이전트의 새로운 시대600달러 미니 PC에서 구동하는 Qwen3: 로컬 LLM 효율성의 급격한 발전GLM-5 모델의 추론(Reasoning) 모드가 ik_llama.cpp에서 작동하지 않는 문제구글의 새로운 논문: 추론 모델의 토큰 길이와 정확도의 음의 상관관계 발견오픈 웨이트 모델의 프리필(Prefill) 공격에 대한 대규모 실증 연구: 50개 모델 모두 취약성 노출자율적 로컬 기업을 위한 엔지니어링: 에이전틱 RAG 및 주권형 AI 인프라 기술 청사진