tag: Mac-Local-Ai · 1건
- 근거: Mac에서 125B MoE 모델을 SSD 스트리밍으로 구동하는 LLM 추론 최적화 도구 — AI/LLM 인프라 관심 분야에 직접 해당하며, Ollama 호환 API로 5분 내 시도 가능
- 액션: Mac에서
bash install.sh실행 후 Ollama 호환 엔드포인트로 Qwen3 125B 추론 속도/VRAM 사용량 측정 (MEASUREMENTS.md 참고)
bash install.sh 실행 후 Ollama 호환 엔드포인트로 Qwen3 125B 추론 속도/VRAM 사용량 측정 (MEASUREMENTS.md 참고)