llama.cpp 2

DeepSeek V4 로컬 실행 요건 정리 — Flash 128GB, Pro는 8장 노드

DeepSeek V4-Flash와 V4-Pro를 로컬에서 돌리기 위한 실제 요건을 vLLM 공식 레시피와 GGUF 실측치로 정리했습니다. 필요 메모리 92~169GB, Pro 체크포인트 893GB, API 오프피크 단가 비교까지 2026년 8월 기준으로 확인했습니다.DeepSeek V4 개요개인 하드웨어로 자가호스팅이 가능한 쪽은 V4-Flash뿐이고, V4-Pro는 8장 GPU 노드가 전제입니다. 근거는 두 가지입니다. V4-Flash-0731은 MI325X 256GB 단일 GPU(TP1)에서 공식 검증됐고 GGUF 8비트가 169GB면 로드됩니다. 반면 V4-Pro-0813은 Hugging Face 저장소 총량만 893GB에 safetensors 66샤드 구성이며, vLLM 공식 레시피가 요구하는 최..

로컬 LLM 2026.08.20

Qwen3.8 27B 로컬 실행 요건 총정리: 17GB의 진짜 의미

Qwen3.8 27B를 개인 PC와 맥에서 돌리려면 얼마가 필요한지 정리했습니다. 4비트 17~19GB의 정확한 해석, 배포처별 GGUF 용량 차이, 262K 컨텍스트 KV 캐시 16GB, 엔진별 속도 격차까지 2026년 8월 기준 자료로 대조했습니다.Qwen3.8 27B 핵심만 먼저 정리하면결론부터 말하면 이 모델의 공식 모델카드에는 VRAM 요구 수치가 단 한 줄도 없습니다. 로컬 실행 요건이라고 돌아다니는 숫자는 전부 Unsloth·Ollama·vLLM·SGLang 같은 배포·엔진 측 문서에서 나온 값이라, 인용할 때 출처와 조건을 함께 봐야 합니다. 가장 널리 인용되는 4비트 양자화 17~19GB는 그래픽카드 메모리만 뜻하지 않고 "RAM + VRAM 합계"를 가리킵니다. 이 한 단어 차이 때문에..

로컬 LLM 2026.08.17