Daily OSS

즉시조치 대기

SSD 전문가 스트리밍으로 Mac에서 125B MoE 모델 구동 — SlotStream

2026-09-02 00:32 · GitHub Trending (topic:llm) · 원문 보기 ↗ #llm-inference#mac-local-ai#moe-optimization
  • 근거: Mac에서 125B MoE 모델을 SSD 스트리밍으로 구동하는 LLM 추론 최적화 도구 — AI/LLM 인프라 관심 분야에 직접 해당하며, Ollama 호환 API로 5분 내 시도 가능
  • 액션: Mac에서 bash install.sh 실행 후 Ollama 호환 엔드포인트로 Qwen3 125B 추론 속도/VRAM 사용량 측정 (MEASUREMENTS.md 참고)