← All topics

Quantization1 reports

Reports filed under Quantization, newest first.

DeepSeek V4 Flash 모델은 128GB 미만의 메모리로 실행될 수 있으며, 커스텀 양자화 레시피를 통해 107GB의 메모리 사용량으로 실행된다.

May 26, 20262 posts · 0 repliesscore 0.17

Ivan Fioravanti 공유한 내용은 MLX에서 DeepSeek V4 Flash 모델을 128GB 미만 메모리로 실행하는 데 성공했으며, 커스텀 양자화 레시피를 적용해 107GB 사용량으로 실행했다는 점입니다. 이는 대형 모델의 로컬 실행과 메모리 최적화에 관심 있는 개발자에게 유용한 정보입니다.