본문으로 건너뛰기

관련 기사 바로가기

Apple silicon용 Lily, Qwen 추론 최적화GPU 세대에 따라 달라지는 LLM 양자화 포맷MiniMax-H3를 MLX로 Apple Silicon에서 실행Aura: 로컬 런타임 기반 개인 에이전트MLX로 Mac에서 오픈 언어모델을 로컬 파인튜닝 — 클라우드 GPU 불필요C# 추론 엔진 TensorSharp 업데이트: MLX 지원 및 vLLM 스타일 최적화PyTorch, Apple Silicon에서 GPU 가속 추론을 지원하는 ExecuTorch MLX Delegate 공개Phosphene: Apple Silicon Mac을 위한 무료 로컬 비디오 및 오디오 생성 도구GRPO를 활용한 소형 LLM의 64토큰 요약 성능 최적화 실험SuperGemma 4: 로컬 에이전트를 위한 검열 해제된 Gemma 2 26B 활용 가이드LayerNorm 감마 파라미터만 학습시키는 'BALLAST' 기법 실험: Phi-4-mini에서의 실패 사례와 분석Gemma Chat: Mac을 위한 로컬 오픈소스 AI 코딩 에이전트iPhone에서 MLX를 활용한 Gemma 4 실행 방법MLX와 GRPO를 활용한 Mac Mini 클러스터 기반 요약 모델 강화학습 실험iOS에서 MLX를 이용한 Llama 3.2 온디바이스 배포 경험 및 UX 트레이드오프 공유MacBook Pro M4 Pro 기반 MLX 모델 5종 벤치마크: MoE 아키텍처의 압도적 효율성 확인Zora: Apple Silicon에서 로컬로 실행되는 오픈소스 개인용 AI 비서OpenVox: macOS용 설정이 필요 없는 로컬 TTS 앱 출시Ollama나 LM Studio 없이 Gemma를 실행하는 가벼운 Flask 서버 및 프론트엔드 구현MacBook Pro M5 Max에서 GPT-OSS-120B 모델로 초당 60토큰 달성: 로컬 LLM의 질적 도약
← 피드로 돌아가기

MLX-LM

Libraries (AI 라이브러리)

58개 아티클

관심 태그 추가
TIMEHEADLINE