요약은 생성됐지만 현재 화면 버전과 데이터 형식이 맞지 않아 렌더링할 수 없습니다.
출처 · 인용 안내
원문 발행 2026. 02. 23.수집 2026. 02. 23.출처 타입 REDDIT
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
요약은 생성됐지만 현재 화면 버전과 데이터 형식이 맞지 않아 렌더링할 수 없습니다.
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
아직 관련 토론이 없습니다.
댓글을 작성하려면 로그인이 필요합니다.
MLP 서브레이어의 RMSNorm과 확장·압축 가중치 경로 상호작용이 Post-LayerNorm 환경에서 대형 모델 불안정을 유발할 가능성을 규명한 게시물이다.
정규화 연산을 GEMM과 어텐션 커널에 융합해 최대 90%의 정규화 지연 숨김과 FlashNormAttention으로 최대 35% 커널 속도 향상을 달성했다.
DeepLoop은 루프드 Transformer에서 반복 방문의 정렬 효과를 반영하여 α=(2N)^{1/2}, β=(8N)^{-1/2} 스케일링을 사용해 공유된 블록을 반복할 때의 학습 안정성을 확보한다.
Anthropic 실험을 근거로 의미 없는 데이터에서도 통계적 공분산을 통해 행동 특성이 전염되며, 잠재공간에 제로-컬(∇×V=0) 제약을 적용하면 표현 붕괴와 비의미적 전염을 줄일 수 있다.