본문으로 건너뛰기

관련 기사 바로가기

LLM 및 AI 기술 용어 정리를 위한 커뮤니티 주도 사전 프로젝트별도의 격리된 메모리 버퍼를 가진 Transformer 구조 제안BERTopic 이해하기: 원시 텍스트에서 해석 가능한 토픽 추출까지깊이의 한계: 대형 언어 모델의 잠재적 계획 발견 능력의 제약에 대하여AvatarPointillist: 자기회귀 4D 가우시안 아바타 생성 기술LLM의 '결합 간극(Binding Gap)': 의미론적 이해와 속성 연결의 불일치 문제ManCAR: 순차적 추천을 위한 적응형 테스트 시간 연산 기반의 매니폴드 제약 잠재 추론BBQ-to-Image: 대규모 텍스트-이미지 모델에서의 수치적 바운딩 박스 및 색상 제어HyTRec: 장기 행동 시퀀스 추천을 위한 하이브리드 시간 인지 어텐션 아키텍처GuppyLM: 물고기처럼 말하는 900만 파라미터 초소형 언어 모델Rta AI Labs, 레이어 공유 기술을 적용한 150M 초소형 모델 Nandi-Mini 공개O(N) 복잡도를 달성한 비-어텐션(Non-attention) LLM 아키텍처 (오픈 소스)Gemma 모델 성능 저하의 원인: llama.cpp 구현 지연과 해결책Monarch: NES 영감을 받은 트랜스포머용 메모리 페이징으로 추론 속도 78% 향상신경망의 기초: 30일 완성 머신러닝 가이드 1일차소프트맥스 어텐션의 한계를 극복한 새로운 Multiscreen 아키텍처 공개Mamba4 해설: Transformer를 대체할 시퀀스 모델링용 고속 아키텍처SALOMI: 초저비트 트랜스포머 양자화 및 추론 연구 저장소 공개276,000개의 Kubernetes YAML 파일로 학습된 트리 구조 인지형 BERT 모델스탠포드 CS 25 트랜스포머 과정 (누구나 참여 가능 | 내일 시작)
← 피드로 돌아가기

Transformer

Architecture (AI 아키텍처)

197개 아티클

관심 태그 추가
TIMEHEADLINE