전체 글 49

Gemini 3.7 Flash 무엇이 달라졌나, 3.6과 비교 총정리

Gemini 3.7 Flash가 2026년 8월 13일 정식 출시됐다. 3.6 Flash 대비 속도·벤치마크 수치, 가격 변동, 마이그레이션 시 주의할 점을 데이터 기준으로 정리했다.Gemini3.7Flash, 무엇을 기준으로 비교해야 할까구글이 2026년 8월 13일 Gemini 3.7 Flash를 정식(GA) 공개했다. 직전 세대인 3.6 Flash가 나온 지 불과 3주 만이라, "뭐가 그새 달라졌나" 궁금한 독자가 많을 것이다. 결론부터 말하면 이번 업데이트는 완전히 새로운 모델이라기보다 속도와 코딩·자동화 작업 능력을 끌어올린 개선판에 가깝다. 일반 문서 작성이나 대화 품질에서 체감할 만한 차이를 발표문이 보장하는 것은 아니다.비교할 때 확인해야 할 기준은 크게 세 가지다. 첫째는 실제 처리 속도..

AI 모델 01:21:07

GLM-5.3 로컬 실행 요건과 대안 총정리 (2026.08 기준)

GLM-5.3은 2026년 8월 20일 기준 가중치가 공개되지 않아 로컬 실행이 불가능하다. GLM-5.2 기준 양자화별 메모리 요건과 API 비용을 비교해 실행 가능 여부를 판단한다.GLM 5.3 개요GLM-5.3을 지금 내 서버에서 돌릴 수는 없다. Z.ai가 2026년 8월 18일 공식 릴리즈 노트에 이 모델을 올렸지만, 같은 시점(2026-08-20) 기준으로 조직의 GitHub·Hugging Face 저장소에는 GLM-5.3 가중치가 존재하지 않는다. 모델 자체는 컨텍스트 1M 토큰, 최대 출력 128K 토큰, 텍스트 전용(비전 입력 미지원) 구조이며 추론(reasoning)이 필수로 걸려 있어 effort 레벨을 ·· 중 하나로 지정해야 한다. 이 글은 "로컬실행요건"이라는 개발자 관점 질문에..

로컬 LLM 01:04:31

DeepSeek V4 로컬 실행 요건 정리 — Flash 128GB, Pro는 8장 노드

DeepSeek V4-Flash와 V4-Pro를 로컬에서 돌리기 위한 실제 요건을 vLLM 공식 레시피와 GGUF 실측치로 정리했습니다. 필요 메모리 92~169GB, Pro 체크포인트 893GB, API 오프피크 단가 비교까지 2026년 8월 기준으로 확인했습니다.DeepSeek V4 개요개인 하드웨어로 자가호스팅이 가능한 쪽은 V4-Flash뿐이고, V4-Pro는 8장 GPU 노드가 전제입니다. 근거는 두 가지입니다. V4-Flash-0731은 MI325X 256GB 단일 GPU(TP1)에서 공식 검증됐고 GGUF 8비트가 169GB면 로드됩니다. 반면 V4-Pro-0813은 Hugging Face 저장소 총량만 893GB에 safetensors 66샤드 구성이며, vLLM 공식 레시피가 요구하는 최..

로컬 LLM 2026.08.20

Grok 4.6 달라진 점 총정리 — 초보자용 비교 가이드

2026년 8월 12일 공개된 Grok 4.6이 4.5에서 무엇이 달라졌는지, 컨텍스트·가격·속도·독립 측정치를 기준으로 비교했습니다. 발표문과 실측 사이 간극까지 정리합니다.Grok 4.6, 무엇을 기준으로 비교해야 할까Grok 4.6에서 실제로 달라진 것은 "한 번에 읽는 분량"이 아니라 "여러 단계짜리 일을 끝까지 붙잡는 능력"입니다. 2026년 8월 12일 공개된 xAI 공식 포스트를 보면 컨텍스트 창은 500,000토큰으로 4.5와 같고, 독립 측정기관 Artificial Analysis의 지능 지수는 56에서 61로 5점 올랐습니다(2026년 8월 20일 확인). 이 글은 그 변화를 컨텍스트·가격·속도·검증 가능성 네 축으로 비교했습니다. 파라미터 수나 내부 아키텍처는 공식 문서에 없어 다루지..

AI 모델 2026.08.20

오픈웨이트 LLM 로컬 실행 가능성 비교: 24GB VRAM 기준 순위표 읽는 법

오픈웨이트 LLM 순위 상위권 중 실제로 개인 PC에서 돌아가는 모델은 몇 개일까. Kimi K3 1.56TB부터 Qwen3.8-27B 18GB까지 파라미터·VRAM·라이선스를 2026년 8월 기준 수치로 비교했다.오픈소스 LLM 순위, 무엇을 기준으로 비교해야 할까오픈웨이트 모델 순위표를 보고 "1위 모델을 내 PC에 깔아보자"고 생각했다면 시작부터 어긋난 접근이다. 2026년 8월 18일 기준 Artificial Analysis Intelligence Index v4.1.1에서 오픈웨이트 1위인 Kimi K3는 Hugging Face 리포지토리 실물이 safetensors 96샤드 합계 약 1.56TB다. 샤드 하나가 16.6~17GB이니, 샤드 한 개조차 웬만한 그래픽카드 메모리를 가득 채운다. 순..

로컬 LLM 2026.08.19

Stripe OpenRouter 인수설, 개발자 게이트웨이 선택 기준 총정리

2026년 8월 18일 기준 Stripe의 OpenRouter 인수는 공식 발표가 없는 미확인 보도 단계입니다. 수수료 5.5%, BYOK 5%, Vercel·Cloudflare 게이트웨이 비교로 실제 판단 기준을 정리했습니다.Stripe OpenRouter 인수, 무엇을 기준으로 비교해야 할까가장 먼저 짚어야 할 사실이 있습니다. 2026년 8월 18일 기준 이 인수는 공식적으로 확인되지 않았습니다. Stripe 뉴스룸의 최신 항목은 2026년 7월 21일 Ramp 관련 스테이블코인 결제 발표이고, OpenRouter 블로그의 최신 항목은 2026년 8월 17일 Activity Dashboard 발표입니다. 양쪽 어디에도 인수 관련 게시물이 없습니다. Stripe는 과거 OpenChannel 인수를 뉴..

업계 동향 2026.08.18

GPT-5.6 Luna 80% 인하 vs Gemini 3.7 Flash 도입가 — 2026년 8월 AI API 단가 재계산 실무 가이드

2026년 7~8월 OpenAI GPT-5.6 Luna 80% 인하, Claude Sonnet 5 인상 철회, Gemini 3.7 Flash 기한부 도입가, DeepSeek 인상까지 성격이 다른 네 사건을 공식 가격표 기준으로 대조하고, 실제 청구액을 다시 계산하는 절차를 단계별로 정리했습니다.AI API 가격 인하 시작 전 확인할 것2026년 8월의 모델 단가 뉴스를 하나의 흐름으로 읽으면 예산 계획이 어긋납니다. 이 한 달에 겹친 사건은 성격이 네 가지로 갈립니다. 첫째, OpenAI는 2026년 7월 30일자로 GPT-5.6 Luna를 80%, Terra를 20% 인하했고 이것은 만료일이 없는 정가 변경입니다. 둘째, Anthropic은 2026년 9월 1일 예정이던 Claude Sonnet 5의 ..

가격·시장 2026.08.18

Qwen3.8 27B 로컬 실행 요건 총정리: 17GB의 진짜 의미

Qwen3.8 27B를 개인 PC와 맥에서 돌리려면 얼마가 필요한지 정리했습니다. 4비트 17~19GB의 정확한 해석, 배포처별 GGUF 용량 차이, 262K 컨텍스트 KV 캐시 16GB, 엔진별 속도 격차까지 2026년 8월 기준 자료로 대조했습니다.Qwen3.8 27B 핵심만 먼저 정리하면결론부터 말하면 이 모델의 공식 모델카드에는 VRAM 요구 수치가 단 한 줄도 없습니다. 로컬 실행 요건이라고 돌아다니는 숫자는 전부 Unsloth·Ollama·vLLM·SGLang 같은 배포·엔진 측 문서에서 나온 값이라, 인용할 때 출처와 조건을 함께 봐야 합니다. 가장 널리 인용되는 4비트 양자화 17~19GB는 그래픽카드 메모리만 뜻하지 않고 "RAM + VRAM 합계"를 가리킵니다. 이 한 단어 차이 때문에..

로컬 LLM 2026.08.17

로컬 LLM GPU 선택 기준 2026 총정리 (RTX 5090·DGX Spark)

로컬 LLM용 그래픽카드를 고를 때 VRAM 용량, 메모리 대역폭, 양자화 포맷 지원 중 무엇을 먼저 봐야 하는지 2026년 8월 기준 공식 사양과 독립 측정치로 정리했습니다. RTX 5090·RTX PRO 6000·DGX Spark·Mac Studio 실측 비교 포함.로컬 LLM GPU 핵심만 먼저 정리하면로컬 LLM용 그래픽카드 선택은 "VRAM 용량 → 메모리 대역폭 → 양자화 포맷 지원"이라는 3단 관문으로 정리됩니다. 첫 관문인 용량은 모델이 메모리에 통째로 올라가느냐를 결정합니다. 여기서 탈락하면 속도가 수십 배 떨어지니 다른 사양은 볼 필요도 없습니다. 두 번째 관문인 대역폭은 초당 몇 글자가 나오는지를 좌우하는데, 통합 메모리 제품이 여기서 크게 밀립니다. LMSYS 독립 측정에서 DGX ..

로컬 LLM 2026.08.17

Gemini 3.7 Flash 마이그레이션 총정리, 3.6 대비 무엇이 달라졌나

2026년 8월 13일 GA로 풀린 구글 신형 모델의 실제 단가·벤치마크·API 변경점을 공식 문서와 대조했습니다. 발표문의 '반값'과 '가장 똑똑한'이 어디까지 사실인지, 갈아탈 때 깨지는 설정은 무엇인지 정리합니다.Gemini 3.7 Flash 개요구글이 2026년 8월 13일 Gemini 3.7 Flash를 GA(정식 출시)로 공개했습니다. 모델 ID는 gemini-3.7-flash, 같은 날 Gemini API 릴리즈 노트에 정식 등재됐습니다. 눈에 띄는 건 직전 모델인 3.6 Flash가 2026년 7월 21일에 나왔다는 점입니다. 두 모델의 출시 간격이 불과 3주입니다.이 짧은 간격의 답은 구글이 직접 쓴 모델카드에 있습니다. DeepMind 모델카드는 3.7 Flash를 Gemini 3 제품..

AI 모델 2026.08.17