본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
CUDA 기반 Eulerian Video Magnification 구현과 성능 최적화
MobileAgeNet: 모바일·엣지 환경을 목표로 설계된 경량 얼굴 연령 추정 모델과 배포 파이프라인
Triton 플러그인 확장으로 TLX와 커스텀 컴파일러 패스 기본 제공
PyTorch 2.13 출시: MPS용 FlexAttention, CuTeDSL 백엔드, 메모리 최적화 기능 추가
텐서 형태 검증과 파라미터·FLOPs·VRAM 추정이 가능한 시각적 모델 에디터 공개
H64LM: PyTorch로 처음부터 구현한 249M 파라미터 Transformer와 체크포인트 공개
자율 신경종양 진단용 ResNet50 기반 딥러닝 파이프라인과 실시간 배포 공개
Text-LLM-Training-from-scratch: PyTorch 원시 연산으로 구현한 텍스트 LLM 학습 파이프라인
TabFM·TimesFM을 Docker로 묶어 제로샷으로 실행하는 Zer0Fit 레포 공개 및 기본 벤치마크
PyTorch DataLoader 병목 진단 사례: num_workers=0으로 T4 GPU가 51% 유휴였고 세 줄 변경으로 학습 시간이 43% 단축된 실측 보고
TorchJD 진행 업데이트: 다중 손실 학습을 위한 방법 구현 및 PyTorch 에코시스템 합류
PyTorch 테스트 인프라 이해하기: 기여자를 위한 실용 가이드
ExecuTorch 해커톤이 Snapdragon 기반 Galaxy S25 Ultra에서 온디바이스 AI 데모와 우승작을 선보였다
Damped Resonance Alignment 테스트 79: 압력 다이얼 비교와 Qwen2.5-1.5B 스티어링 로그
Miles, RadixArk의 대규모 LLM RL 포스트트레이닝 프레임워크
Cross-Repository CI Relay 도입으로 PyTorch 아웃오브트리 백엔드의 확장 가능한 CI 통합
GradCAM 기반 타일 마스킹 증강법 ICD와 AICD: 상위·하위 살리언시 타일을 선택적으로 가리는 정의와 구현 공개
초보자용 깔끔한 PyTorch CNN (FashionMNIST 사례)
Picotron — GPU 특정 의존성을 제거한 경량 LLM 사전학습 프레임워크
Qwen3:4B 기반 경량 추론 모델을 RTX 5070에서 Unsloth로 Fine-tuning한 구현 사례
← 피드로 돌아가기
PyTorch
Libraries (AI 라이브러리)
약 212개 아티클
관련 태그:
Hugging Face
Flash Attention
Transformer
vLLM
Ray
ExecuTorch
PPO
CUDA
Meta
NVIDIA