AI 모델

GPT-5.6-Cyber 가격·접근 조건 총정리: 무엇이 달라졌나

mdit 2026. 8. 13. 19:51


GPT-5.6 Cyber 개요

GPT-5.6 Cyber 개요

OpenAI가 2026년 8월 10일 사이버보안 전용 모델 GPT-5.6-Cyber를 공개했습니다. 동시에 기존 Daybreak 프로그램을 두 개의 티어로 쪼갰습니다. 방어 업무를 담당하는 Daybreak Blue(범용 모델인 GPT-5.6 Sol 계열)와, 공격 재현을 담당하는 Daybreak Red(목적 훈련 모델인 GPT-5.6 Cyber)입니다. API 변경 로그상 티어 분할은 공식 발표보다 사흘 앞선 2026년 8월 7일에 이미 반영돼 있었습니다.

이 발표가 국내외 매체에서 주목받은 이유는 성능 수치 하나였습니다. "고급 사이버보안 작업 완료율 95.0%"라는 값입니다. 같은 계열 범용 모델인 GPT-5.6 Sol이 1.5%, Daybreak Blue 접근 시 2.0%, 이전 세대인 GPT-5.5-Cyber가 57.3%였다는 비교표가 함께 돌았습니다. 숫자만 보면 1.5%에서 95%로 63배 도약한 것처럼 읽힙니다.

그런데 공식 API 문서를 열어보면 다른 그림이 나옵니다. GPT-5.6-Cyber는 GPT-5.6 Sol에서 파생된 모델이고, 지식 컷오프가 2026년 2월 16일로 Sol과 완전히 같습니다. 새 데이터로 재학습한 별개의 모델이 아니라는 뜻입니다. 게다가 저 95%라는 지표는 문제 해결 능력이 아니라 "요청을 거절하지 않고 응답한 비율", 즉 거부율에 관한 값입니다.

이 글은 발표문과 보도자료의 서술을 OpenAI 공식 API 문서·가격표·변경 로그·시스템 카드와 하나씩 대조한 결과입니다. 필자가 이 모델을 직접 써본 기록은 아닙니다. 애초에 일반 계정으로는 접근 경로 자체가 없습니다. 모든 수치는 2026년 8월 12일 확인 시점 기준입니다.


1. 가격과 사양: 오르지 않은 단가, 줄어든 컨텍스트

1. 가격과 사양: 오르지 않은 단가, 줄어든 컨텍스트

가장 먼저 확인해야 할 것은 돈과 스펙입니다. 2026년 8월 12일 확인 시점 기준 OpenAI 공식 가격표는 다음과 같습니다(100만 토큰당).

모델 입력 캐시 입력 출력 컨텍스트
gpt-5.6-cyber $12.50 $1.25 $75.00 400,000
gpt-5.5-cyber $12.50 $1.25 $75.00 (확인 필요 — 공식 문서 미확인)
gpt-5.6-sol $5.00 $0.50 $30.00 1,050,000
gpt-5.6-terra $2.00 $0.20 $12.00 (확인 필요 — 공식 문서 미확인)
gpt-5.6-luna $0.20 $0.02 $1.20 (확인 필요 — 공식 문서 미확인)

여기서 두 가지가 눈에 걸립니다.

첫째, 세대가 올라갔는데 토큰 단가가 1센트도 오르지 않았습니다. gpt-5.5-cyber와 gpt-5.6-cyber가 같은 가격표에 나란히 $12.50 / $1.25 / $75.00으로 실려 있습니다. 사용자 입장에서는 반가운 일이지만, 이번 업데이트의 성격을 짐작하게 하는 단서이기도 합니다. 능력이 크게 도약했다면 통상 가격 정책에 반영되는데 그렇지 않았습니다.

둘째, 컨텍스트가 오히려 줄었습니다. 기반 모델인 Sol이 1,050,000 토큰인데 Cyber는 400,000 토큰(최대 입력 272,000 / 최대 출력 128,000)입니다. 약 38% 수준입니다. 대규모 코드베이스를 한 번에 통째로 물려 훑는 워크플로를 쓰고 있다면 Cyber로 옮기는 순간 후퇴합니다. 공식 발표문은 이 사실을 언급하지 않았고, 모델 문서를 직접 대조해야 드러납니다.

계열 내 상대 가격을 계산해보면, Cyber는 Sol 대비 입력·출력 모두 정확히 2.5배입니다. 컨텍스트는 2.6분의 1로 줄고 단가는 2.5배가 되는 조합이라, 토큰 효율만 따지면 같은 분량의 코드를 처리할 때 체감 비용 격차는 배수 이상으로 벌어집니다.

나머지 사양은 다음과 같습니다.

항목 내용
모델 ID gpt-5.6-cyber (별칭 )
지식 컷오프 2026-02-16 (Sol과 동일)
지원 엔드포인트 v1/responses 전용
미지원 Chat Completions, Realtime, Assistants, Batch
입력 모달리티 텍스트, 이미지
출력 모달리티 텍스트
지원 도구 웹 검색, 파일 검색, 이미지 생성, code interpreter, hosted shell, apply patch, skills, computer use, MCP, tool search
레이트 리밋 (Tier 1) 500 RPM / 500,000 TPM

는 별칭이고, 2026년 8월 12일 확인 시점 기준 스냅샷은 gpt-5.6-cyber 하나뿐입니다. 별칭과 스냅샷 사이의 실질적 사양 차이는 문서에 없습니다.


2. "95% 완료율"의 실제 의미 해부

2. "95% 완료율"의 실제 의미 해부

이번 발표에서 가장 많이 인용된 수치를 정면으로 뜯어보겠습니다.

모델·접근 조건 Advanced Cybersecurity Completion Rate
GPT-5.6-Cyber (Daybreak Red) 95.0%
GPT-5.5-Cyber (전 세대) 57.3%
Daybreak Blue 접근 시 2.0%
표준 GPT-5.6 Sol 1.5%

SecurityWeek, The Hacker News, Help Net Security, VentureBeat 네 매체가 같은 수치를 인용했습니다. 다만 Help Net Security는 이 값이 OpenAI 내부 벤치마크로 측정된 것임을 본문에 밝혔습니다.

핵심은 이 지표가 무엇을 재는지입니다. 측정 대상은 익스플로잇 체인 개발·권한 상승·인증 우회 같은 고위험 요청이고, "완료"란 모델이 그 요청에 응답을 끝까지 내놨다는 뜻입니다. 그렇다면 Sol의 1.5%는 어떻게 해석해야 할까요. Sol은 못 해서 1.5%가 나온 게 아니라 안 해서 1.5%가 나온 것입니다. 위험한 이중용도 요청이라 거절했기 때문입니다.

이 해석을 뒷받침하는 근거는 OpenAI 자신의 문서에 있습니다. 공식 공지는 GPT-5.6-Cyber가 Sol을 기반으로 특화 작업 성능을 올리면서 "일부 고위험 이중용도 요청의 거부를 줄이도록 훈련됐다"고 밝혔습니다. 그리고 API 문서상 두 모델의 지식 컷오프는 같은 날짜입니다. 같은 베이스, 같은 학습 데이터 시점에서 갈라진 모델 사이에 63배의 능력 격차가 생기기는 어렵습니다.

정리하면 1.5%에서 95.0%로 벌어진 93.5%p 가운데 상당 부분은 안전장치 해제분입니다. 순수 능력 향상분이 얼마인지 분리해 제시한 수치는 공개되지 않았습니다.

벤치마크의 구성 자체도 검증 불가 상태입니다. 외부 재현 사례는 0건인데, 연구자들이 게을러서가 아니라 접근이 승인제로 통제돼 있어 구조적으로 재현이 불가능하기 때문입니다.


3. 발표문과 실제 문서의 간극 정리

발표·보도 서술을 공식 문서와 항목별로 대조한 결과입니다.

쟁점 발표·보도된 내용 문서로 확인된 것
95% vs 1.5% 성능 도약처럼 제시 거부율 지표. 동일 베이스·동일 컷오프이므로 상당 부분이 안전장치 해제분
전용 시스템 카드 일부 매체가 "공개됐다"고 서술 2026-08-12 기준 Deployment Safety Hub에 GPT-5.6-Cyber 항목 없음. 최신 등재는 "GPT-5.6 — August Updates"(2026-08-06)
세대 교체 5.5 → 5.6 업그레이드 토큰 단가 완전 동일. 가격 기준으로는 동일 가격대의 정책 완화판에 가까움
컨텍스트 언급 없음 Sol 1,050,000 → Cyber 400,000 (38% 수준)으로 축소
가격 공개 여부 일부 분석이 "가격 미공개"라고 서술 API 가격표에 명시돼 있음. 발표문에 없다는 것과 미공개는 다름
엔드포인트 언급 없음 Chat Completions 미지원, Responses API 전용
접근성 파트너 명단이 길게 붙어 화려하게 보임 GA 아님, 대기자 명단도 아님. 신청 → 심사 → 프로비저닝 필수
파트너 17개사 매체가 일제히 나열 OpenAI 공지가 직접 확인한 명단으로 보기 어렵다는 지적 존재 (확인 필요)

특히 세 번째 줄과 두 번째 줄이 중요합니다. 안전장치를 의도적으로 완화한 모델인데, 그 완화가 초래할 오남용 위험을 평가한 별도 안전 문서가 공개 목록에 없습니다. 파트너에게만 별도 채널로 배포됐을 가능성은 있으나 확인되지 않았습니다(확인 필요 — 공식 문서 미확인).

기존 GPT-5.6 계열 시스템 카드(2026년 7월 9일 공개, 8월 3일 갱신)에는 참고할 서술이 있습니다. Preparedness Framework상 사이버보안 역량을 "High"로 분류하되 최고 등급인 "Critical"에는 도달하지 않았다고 밝혔고, "Sol과 Terra는 취약점과 익스플로잇의 일부 조각은 찾아내지만 강화된 표적에 대한 자율적 end-to-end 공격은 수행하지 못했다"고 적었습니다. 완전 자율 공격 단계는 아니라는 것이 OpenAI 자체 평가입니다.


4. 실제 성과와 반증 데이터: 찾는 것과 고치는 것

4. 실제 성과와 반증 데이터: 찾는 것과 고치는 것

공식 공지는 실증 사례로 Chrome V8 엔진에서 기존에 알려지지 않은 취약점을 발견했다고 밝혔습니다. 이 건은 매체 취재로 구체화됐습니다.

항목 내용
CVE 번호 CVE-2026-15903
CVSS 8.8 (High)
처리 상태 Google이 이미 수정 완료

모바일 OS·데이터베이스·커널에서도 고위험 취약점을 찾았다고 보도됐으나, 대상 프로젝트는 패치 완료 전까지 비공개입니다. 한편 검색 결과에 등장하는 "커널 권한 상승 취약점 400건 이상 발견"이라는 주장은 신뢰할 수 있는 1차·2차 출처에서 확인하지 못했습니다(확인 필요 — 미확인).

문제는 발견 이후 단계입니다. OpenAI 발표문은 "더 많이 찾고, 무엇이 중요한지 검증하고, 더 빨리 고친다"는 서사를 내세웠는데, 고치는 쪽 데이터는 우호적이지 않습니다.

지표 수치
AI 생성 패치가 실제로 취약점을 해결한 비율 26.0%
새 취약점을 만들거나 아예 실패한 비율 53.9%

1Password 리서치 결과이며 The Hacker News가 인용했습니다. 절반 이상이 실패하거나 새 구멍을 낸다는 뜻입니다. 발견은 가속되는데 수정은 그 속도를 따라가지 못하는 비대칭이 현재 구도입니다.

경쟁 구도에서의 위치도 짚어둘 필요가 있습니다. Anthropic Claude Mythos Preview(2026년 4월 7일 공개)는 명시적 사이버 훈련이 아니라 코드 추론·자율성 향상의 부산물로 보안 능력이 올라왔다고 설명하면서, 상대적으로 구체적인 조건을 공개했습니다. Firefox 취약점 익스플로잇에서 수백 회 시도 중 181건 성공(Opus 4.6은 2건), OSS-Fuzz 벤치마크에서 완전한 제어 흐름 탈취에 해당하는 tier-5 크래시 10건(Opus 4.6은 tier-3 1건) 같은 값입니다. 컨테이너 격리 스캐폴드와 ASan 검증 조건도 밝혔습니다.

여기서 주의할 점이 있습니다. OpenAI의 95%와 Anthropic의 성공률 수치를 나란히 놓고 비교하면 안 됩니다. 전자는 거부율, 후자는 공격 성공률이라 성격이 다른 지표입니다. Anthropic Mythos 계열의 공개 가격표는 확인되지 않았습니다(확인 필요 — 미확인).


5. 독자 유형별 판단 기준과 FAQ

5. 독자 유형별 판단 기준과 FAQ

비개발자·일반 직장인이라면

Q. 제 ChatGPT 계정에서 쓸 수 있습니까?
아닙니다. 일반 계정으로는 신청 자체가 되지 않습니다. Daybreak 프로그램의 심사를 통과한 보안 기업만 접근합니다. "OpenAI가 해킹 AI를 출시했다"는 헤드라인을 봤다면 정확히는 일부 보안 업체에 한정 공급한 것입니다.

Q. 그러면 회사 보안은 좋아지는 겁니까?
계약한 보안 업체가 이 도구로 취약점을 더 빨리 찾아줄 여지는 있습니다. 다만 앞서 본 26% 수치처럼 자동 수정은 아직 신뢰 구간에 들어오지 않았습니다. "AI가 알아서 다 막아준다"는 단계가 아니고, 몇 달 뒤 간접적으로 도착하는 변화로 보는 게 맞습니다.

Q. 공격자 쪽이 더 위험해지는 건 아닙니까?
발표 당일 Washington Post가 "AI 모델이 통제를 벗어나고 있고 제작사들이 수습에 나섰다"는 취지의 기사를 냈습니다. 접근을 승인제로 묶은 것 자체가 이 우려에 대한 대응 설계입니다. 다만 통제의 실효성을 외부에서 검증할 방법이 현재 없습니다.

커뮤니티에서 나온 반응 (공식 확인 자료가 아님)

Hacker News의 관련 스레드(2026년 8월, 129 포인트)와 OpenAI 개발자 포럼에서 확인된 반응이며, 수치 근거로 쓸 수 없는 개별 사용자 보고입니다.

  • 인증 플로우가 아예 진행되지 않는다는 보고. "We couldn't start verification. You may not be eligible for this verification flow right now"라는 메시지를 그대로 붙인 댓글이 있습니다(소수 보고, 2026년 8월 기준).
  • 가드레일의 일관성 자체를 못 믿겠다는 반응이 반복됩니다. 펜테스트 중 Sol이 처음엔 거절했다가 사소한 문구 수정 후 응답했다는 식의 보고입니다. 티어를 나누기 전에 기본 모델의 거부 판정이 이미 임의적이라는 지적입니다.
  • 직업 면허제에 비유하는 냉소. "법률 질문엔 변호사 면허, 식단엔 영양사 면허가 필요해지는 시작"이라는 댓글이 있습니다.
  • 오픈웨이트로 갈아탄다는 대안 제시. 승인 절차와 벤더 로깅을 피하려 Kimi K3 등을 쓰겠다는 반응입니다. 다만 성능을 비교할 수 있는 검증 수치는 확보되지 않았습니다(확인 필요 — 미확인).
  • 개발자 포럼에서는 모델이 "취약점은 찾아내고서 설명은 거부"하는 패턴에 대한 불만이 반복됩니다. Daybreak가 새 제품이 아니라 OpenAI for Cyber의 리브랜딩이라는 정리도 나왔습니다(소수 보고).

아직 확인되지 않은 것들

지역 가용성(EU·한국에서 Daybreak Red 신청 가능 여부), 승인 심사의 구체적 자격 요건과 소요 기간, GPT-5.6-Cyber에 대한 UK AISI 등 외부 기관 평가 수행 여부는 모두 공개 문서가 없습니다. gpt-5.5-cyber는 모델 문서 페이지가 404를 반환하는데 가격표에는 남아 있어 폐기 일정이 모순 상태입니다. OpenAI 공식 발표 페이지와 Help Center 문서는 2026년 8월 12일 시도 시 HTTP 403으로 직접 확인하지 못했고, 본문의 관련 서술은 개발자 커뮤니티 공식 공지와 네 개 매체의 일치 인용으로 교차 확인한 것입니다.


정리

이번 발표에서 확실히 달라진 것은 능력이 아니라 허용 범위와 접근 통제입니다. GPT-5.6-Cyber는 GPT-5.6 Sol과 같은 베이스·같은 지식 컷오프를 공유하며, 화제가 된 95% 완료율은 문제 해결력이 아니라 거부율 지표입니다. 능력 향상분과 안전장치 해제분을 분리한 수치는 공개되지 않았고, 전용 시스템 카드도 2026년 8월 12일 기준 안전 문서 목록에 없습니다.

실무 판단은 단순합니다. 토큰 단가가 전 세대와 동일하다는 점($12.50/$1.25/$75, 2026년 8월 12일 기준)은 반가운 소식이지만, 컨텍스트가 40만으로 줄고 Responses API 전용이라는 제약은 발표문에 없던 비용입니다. 취약점 탐색·코드 리뷰·사고 대응이 목적이라면 2.5배 싸고 컨텍스트가 2.6배 큰 Daybreak Blue가 명백히 유리하며, Red는 PoC 익스플로잇 개발과 체인 검증, 레드팀에만 값어치를 합니다. 그리고 발견이 빨라진 것과 별개로 AI 생성 패치의 해결률은 26%에 머물러 있으므로, 사람의 검증 단계를 줄일 근거는 아직 어디에도 없습니다.


참고 자료

조사 기준일: 2026년 08월 12일

본문의 수치는 아래 자료에서 확인한 것입니다. 제조사 공식 자료(T1)와 전문 매체 실측(T2)을 구분해 표기했습니다. 가격·공급 상황은 변동이 크므로 기준일 이후의 값은 다시 확인해야 합니다.

Tier 1 (발표 주체 공식 1차 자료) — 모두 2026-08-12 확인
- OpenAI 개발자 커뮤니티 공식 공지 "Expanding Daybreak as the Cyber Defense Window Narrows" (게시일 2026-08-10) — https://community.openai.com/t/expanding-daybreak-as-the-cyber-defense-window-narrows/1389909
- OpenAI API 모델 문서 — GPT-5.6 Cyber — https://developers.openai.com/api/docs/models/gpt-5.6-cyber
- OpenAI API 모델 문서 — Daybreak Red — https://developers.openai.com/api/docs/models/daybreak-red-latest
- OpenAI API 모델 문서 — GPT-5.6 Sol — https://developers.openai.com/api/docs/models/gpt-5.6
- OpenAI API 공식 가격표 — https://developers.openai.com/api/docs/pricing
- OpenAI API Changelog (Daybreak Blue/Red 항목, 2026-08-07) — https://developers.openai.com/api/docs/changelog
- OpenAI Deployment Safety Hub — GPT-5.6 System Card (2026-07-09 공개, 2026-08-03 갱신) — https://deploymentsafety.openai.com/gpt-5-6
- OpenAI Deployment Safety Hub 문서 목록 (GPT-5.6-Cyber 항목 부재 확인) — https://deploymentsafety.openai.com/
- Anthropic Research — "Assessing Claude Mythos Preview's cybersecurity capabilities" (2026-04-07) — https://www.anthropic.com/research/mythos-preview
- ※ OpenAI 공식 발표 페이지 https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/ 는 HTTP 403으로 직접 확인 실패 (2026-08-12 시도)
- ※ OpenAI Help Center Daybreak 개요 https://help.openai.com/en/articles/20001258-openai-daybreak-trusted-access-for-cyber-overview 도 403으로 직접 확인 실패
Tier 2 (독립 검증·매체 취재) — 모두 2026-08-12 확인
- SecurityWeek, "OpenAI Unveils New Cybersecurity Model GPT-5.6-Cyber" (2026-08-11) — https://www.securityweek.com/openai-unveils-new-cybersecurity-model-gpt-5-6-cyber/
- The Hacker News, "OpenAI Launches GPT-5.6-Cyber with Reduced Safeguards for Exploit Development" (2026-08-11) — https://thehackernews.com/2026/08/openai-launches-gpt-56-cyber-with.html
- Help Net Security, "GPT-5.6-Cyber refuses security researchers' requests far less often" (2026-08-11) — https://www.helpnetsecurity.com/2026/08/11/openai-gpt-5-6-cyber-model/
- BleepingComputer, "OpenAI releases ChatGPT 5.6 Cyber, but it's only for approved users" (2026-08-10) — https://www.bleepingcomputer.com/news/security/openai-releases-chatgpt-56-cyber-but-its-only-for-approved-users/
- VentureBeat (제목상 95% 수치 인용, 본문 직접 확인 실패 — HTTP 429) — https://venturebeat.com/technology/openai-launches-gpt-5-6-cyber-with-reduced-refusals-95-completion-on-advanced-cybersecurity-tasks
- Axios (2026-08-10, 본문 직접 확인 실패 — HTTP 403) — https://www.axios.com/2026/08/10/openai-gpt-astra-restrictions-safety-hacking-defenders
- Washington Post, "AI models are breaking out of their cages. Their creators are scrambling" (2026-08-10) — https://www.washingtonpost.com/technology/2026/08/10/openai-anthropic-under-pressure-explain-ai-hacking-sprees/
- eesel AI 분석 "GPT-5.6-Cyber: what it is and who can actually get it" (파트너 명단 공식 확인 여부 지적) — https://www.eesel.ai/blog/gpt-5-6-cyber
- Forbes, "Anthropic's Guarded Mythos Model Is Headed For Wider Release" (2026-05-29) — https://www.forbes.com/sites/ronschmelzer/2026/05/29/anthropics-guarded-mythos-model-is-headed-for-wider-release/
- Bloomberg, "Anthropic Releases Mythos-Like Model Without Cyber Capabilities" (2026-06-09) — https://www.bloomberg.com/news/articles/2026-06-09/anthropic-releases-mythos-like-model-without-cyber-capabilities
Tier 3 (커뮤니티 — 수치 근거 아님)
- Hacker News, "GPT 5.6 Cyber" (129 points, 2026-08 / Algolia API로 본문 확보) — https://news.ycombinator.com/item?id=49246704
- Hacker News Algolia 검색 (GPT-5.6-Cyber 언급 댓글) — https://hn.algolia.com/api/v1/search?query=%22GPT-5.6-Cyber%22&tags=comment
- OpenAI Developer Community (Daybreak/TAC 관련 댓글 스레드) — https://community.openai.com/
- ※ Reddit은 이 환경에서 접근 불가하여 확인하지 못함