2026/08/17 3

Qwen3.8 27B 로컬 실행 요건 총정리: 17GB의 진짜 의미

Qwen3.8 27B를 개인 PC와 맥에서 돌리려면 얼마가 필요한지 정리했습니다. 4비트 17~19GB의 정확한 해석, 배포처별 GGUF 용량 차이, 262K 컨텍스트 KV 캐시 16GB, 엔진별 속도 격차까지 2026년 8월 기준 자료로 대조했습니다.Qwen3.8 27B 핵심만 먼저 정리하면결론부터 말하면 이 모델의 공식 모델카드에는 VRAM 요구 수치가 단 한 줄도 없습니다. 로컬 실행 요건이라고 돌아다니는 숫자는 전부 Unsloth·Ollama·vLLM·SGLang 같은 배포·엔진 측 문서에서 나온 값이라, 인용할 때 출처와 조건을 함께 봐야 합니다. 가장 널리 인용되는 4비트 양자화 17~19GB는 그래픽카드 메모리만 뜻하지 않고 "RAM + VRAM 합계"를 가리킵니다. 이 한 단어 차이 때문에..

로컬 LLM 2026.08.17

로컬 LLM GPU 선택 기준 2026 총정리 (RTX 5090·DGX Spark)

로컬 LLM용 그래픽카드를 고를 때 VRAM 용량, 메모리 대역폭, 양자화 포맷 지원 중 무엇을 먼저 봐야 하는지 2026년 8월 기준 공식 사양과 독립 측정치로 정리했습니다. RTX 5090·RTX PRO 6000·DGX Spark·Mac Studio 실측 비교 포함.로컬 LLM GPU 핵심만 먼저 정리하면로컬 LLM용 그래픽카드 선택은 "VRAM 용량 → 메모리 대역폭 → 양자화 포맷 지원"이라는 3단 관문으로 정리됩니다. 첫 관문인 용량은 모델이 메모리에 통째로 올라가느냐를 결정합니다. 여기서 탈락하면 속도가 수십 배 떨어지니 다른 사양은 볼 필요도 없습니다. 두 번째 관문인 대역폭은 초당 몇 글자가 나오는지를 좌우하는데, 통합 메모리 제품이 여기서 크게 밀립니다. LMSYS 독립 측정에서 DGX ..

로컬 LLM 2026.08.17

Gemini 3.7 Flash 마이그레이션 총정리, 3.6 대비 무엇이 달라졌나

2026년 8월 13일 GA로 풀린 구글 신형 모델의 실제 단가·벤치마크·API 변경점을 공식 문서와 대조했습니다. 발표문의 '반값'과 '가장 똑똑한'이 어디까지 사실인지, 갈아탈 때 깨지는 설정은 무엇인지 정리합니다.Gemini 3.7 Flash 개요구글이 2026년 8월 13일 Gemini 3.7 Flash를 GA(정식 출시)로 공개했습니다. 모델 ID는 gemini-3.7-flash, 같은 날 Gemini API 릴리즈 노트에 정식 등재됐습니다. 눈에 띄는 건 직전 모델인 3.6 Flash가 2026년 7월 21일에 나왔다는 점입니다. 두 모델의 출시 간격이 불과 3주입니다.이 짧은 간격의 답은 구글이 직접 쓴 모델카드에 있습니다. DeepMind 모델카드는 3.7 Flash를 Gemini 3 제품..

AI 모델 2026.08.17