GPT 5.6 Cyber는 승인받은 기업만 쓰는 보안 전용 모델입니다. 95% 완료율의 실제 의미, OpenAI 직판 $12.50/$75 vs Bedrock 가격 차이, Sol과의 선택 기준을 2026년 8월 25일 기준으로 정리했습니다.
GPT 5.6 Cyber 핵심만 먼저 정리하면
GPT 5.6 Cyber는 일반 API 키로는 열리지 않는 심사제 모델입니다. OpenAI 모델 문서(2026년 8월 25일 확인)는 별도 승인과 프로비저닝, 그리고 Daybreak 프로그램 신청을 접근 조건으로 명시합니다. 발표 당시 가장 크게 회자된 “고급 사이버보안 작업 95.0% 완료”라는 수치는, 매체 보도를 종합하면 모델이 얼마나 정확하게 해냈는지가 아니라 얼마나 거절하지 않았는지를 세는 지표입니다. 같은 지표에서 GPT-5.6 Sol은 1.5%였으니, 두 모델의 차이는 실력 차이라기보다 거절 정책의 차이에 가깝습니다.
가격은 2026년 8월 25일 기준 OpenAI 직판이 입력 100만 토큰당 $12.50, 출력 $75.00입니다. 같은 날 기준 Sol의 short-context 요금이 입력 $4·출력 $20이므로, 출력 단가만 3.75배 차이가 납니다. 이 글은 접근 조건, 두 채널(OpenAI 직판·AWS Bedrock)의 스펙 불일치, 성능 주장의 실제 근거, 그리고 어떤 조직이 Cyber를 써야 하고 어떤 조직은 Sol로 충분한지를 공개 문서와 보도 자료를 대조해 정리했습니다. 시스템 카드가 아직 공개되지 않았다는 점, 제3자 실측이 Cyber가 아닌 Sol만 대상으로 이뤄졌다는 점도 함께 짚습니다.
Q1. 95% 완료율이라는 숫자, 도대체 뭘 측정한 건가요?

가장 오해가 많은 지점입니다. 이 수치의 정식 명칭은 OpenAI 사내 평가인 Advanced Cybersecurity Completion Rate이고, 익스플로잇 체인 개발·인증 우회·권한 상승 같은 프롬프트에 모델이 응답했는지 여부를 셉니다. TheNextWeb 보도(2026년 8월 10일)에 따르면 이 지표는 응답의 정확성이나 실제 동작 여부를 측정하지 않습니다. “잘한다”가 아니라 “거절하지 않는다”의 척도인 셈입니다.
| 모델 | 완료율 | 성격 |
|---|---|---|
| GPT-5.6-Cyber | 95.0% | 사이버 전용 훈련, 거절 축소 |
| GPT-5.5-Cyber | 57.3% | 이전 세대 사이버 모델 |
| Daybreak Blue 경유 Sol | 2.0% | 프로그램 경유해도 대부분 거절 |
| GPT-5.6 Sol | 1.5% | 범용 모델 기본 정책 |
출처: The Hacker News·SecurityWeek(2026년 8월 11일). OpenAI 공식 발표 원문은 2026년 8월 25일 접근 시도에서 HTTP 403으로 열리지 않아 원문 대조를 못 했습니다 — 위 수치는 모두 매체가 옮긴 값입니다.
이 표를 읽는 요령은 이렇습니다. 1.5%와 95.0%의 간격은 모델 지능이 63배 늘었다는 뜻이 아니라, 같은 계열 모델에 다른 거절 정책을 입혔을 때 벌어지는 폭입니다. 실제로 VentureBeat 보도는 취약점 발견과 리포트 작성 평가에서 Cyber가 Sol보다 오히려 낮은 점수를 받았고, OpenAI가 그 원인을 “더 짧고 덜 상세한 취약점 리포트”로 설명했다고 전합니다. 사이버 전용 모델이라고 모든 보안 업무에서 앞서지는 않습니다.
Q2. 아무나 쓸 수 있나요? 접근 조건이 어떻게 되나요?

쓸 수 없습니다. OpenAI 모델 문서는 별도 승인·프로비저닝과 Daybreak 프로그램 신청을 명시하고, 결제 수단이 등록된 일반 API 키로는 모델이 열리지 않습니다. AWS Bedrock 쪽도 우회로가 아닙니다. Bedrock 모델 카드는 OpenAI의 “Trusted Access for Cyber” 등록이 선행 조건이라고 적고 있어, AWS 계정만으로는 활성화되지 않습니다.
기술적 제약도 함께 봐야 합니다. 지원 엔드포인트가 Responses API(v1/responses) 단독이라 Chat Completions로는 호출이 아예 되지 않습니다. 기존 Chat Completions 기반 파이프라인을 쓰고 있다면 코드를 그대로 옮길 수 없습니다. Bedrock 경유는 제약이 하나 더 붙습니다 — us-east-2(오하이오) 단일 리전이고, In-Region만 가능해 Geo·Global 크로스리전 라우팅이 막혀 있으며 파인튜닝도 안 됩니다. 서빙 티어도 Standard만 지원하고 Priority·Flex·Reserved는 쓸 수 없습니다.
| 접근 항목 | OpenAI 직판 | AWS Bedrock |
|---|---|---|
| 모델 ID | gpt-5.6-cyber |
openai.gpt-5.6-cyber |
| 선행 조건 | Daybreak 프로그램 승인 | Trusted Access for Cyber 등록 필수 |
| 엔드포인트 | Responses API 단독 | Bedrock, Standard 티어만 |
| 리전 | — | us-east-2 단독 |
| 파인튜닝 | — | 불가 |
레이트 리밋은 표준 티어 기준으로 Tier 1이 500 RPM·500K TPM, Tier 5가 15,000 RPM·40M TPM입니다. 대규모 스캔 파이프라인을 돌릴 계획이라면 자기 티어부터 확인하는 편이 좋습니다.
Q3. OpenAI에서 직접 쓰는 것과 AWS Bedrock 중 어디가 유리한가요?

가격과 컨텍스트 둘 다 OpenAI 직판이 유리합니다. 다만 두 공식 문서가 서로 다른 숫자를 말하고 있어서, 이 불일치 자체를 알고 들어가야 합니다.
| 항목 (1M 토큰, 2026년 8월 25일 기준) | OpenAI 직판 | AWS Bedrock |
|---|---|---|
| 입력 | $12.50 | $13.75 |
| 캐시 읽기 | $1.25 | $1.375 |
| 캐시 쓰기 | $15.625 | $17.1875 (30분) |
| 출력 | $75.00 | $82.50 |
| 표기 컨텍스트 | 400,000 토큰 | 272K 토큰 |
Bedrock이 전 항목에서 약 10% 비쌉니다. 더 신경 쓰이는 건 컨텍스트입니다 — 같은 모델인데 OpenAI 문서는 400K, Bedrock 모델 카드는 272K를 표기합니다. 어느 쪽이 실제 서빙 한계인지는 공개 문서만으로 가려지지 않으므로, 긴 컨텍스트를 전제로 설계한다면 실제 사용할 채널에서 직접 테스트해 확인해야 합니다.
한 가지 다행인 점은 Cyber에 long-context 가격 구간이 없다는 것입니다. Sol은 short가 입력 $4·출력 $20, long이 입력 $8·출력 $30으로 갈리지만, Cyber는 400K를 다 쓰더라도 단일 요금입니다. 최대 출력은 128,000 토큰, 지식 컷오프는 2026년 2월 16일, 입력은 텍스트·이미지를 받고 출력은 텍스트만 나옵니다.
Q4. 실제로 성과가 있었나요? 발표에서 말한 취약점 발견 건수는 검증됐나요?

공개 CVE로 확인 가능한 것은 1건입니다. AWS ML 블로그(2026년 8월 11일)는 V8에서 발견된 취약점 하나가 CVE-2026-15903으로 패치됐고, 이를 2026년 V8 CTF의 성공한 제로데이 제출 4건 중 하나로 서술합니다.
반면 매체가 전한 나머지 성과 — V8 신규 취약점 2건, 모바일 OS 5건, DB 3건, 커널 권한 상승 400건 이상 — 은 T1 원문으로 확인하지 못했습니다. OpenAI 발표 원문이 403으로 열리지 않아 대조가 불가능했기 때문입니다. 회사 주장과 공개 검증 가능한 결과 사이에 거리가 있다는 점을 그대로 인지하는 편이 안전합니다.
제3자 평가도 아직 Cyber 자체를 다루지 않았습니다. 평가업체 Irregular가 2026년 8월 24일 공개한 보고서는 GPT-5.6 Sol을 완화장치 없는 조건에서 측정한 것으로, FrontierCyber 197문제 중 19개 해결, CyScenarioBench 11개 시나리오 중 7개 해결(시도 평균 성공률 28%), Atomic 중·상 난도 22개 전부를 최소 1회 해결(Network Attack Simulation 98%, Vulnerability Research 91%, Evasion 56%)이라는 결과를 담았습니다. 같은 보고서는 이번에 드러난 가장 심각한 취약점들이 GPT-5.5에서도 이미 발견됐고, 하드닝된 표적과 오케스트레이션에서는 한계가 명확했다고 적었습니다.
안전성 근거도 완전히 갖춰지지 않았습니다. OpenAI Deployment Safety Hub의 2026년 8월 6일자 문서는 GPT-5.6 Sol/Luna를 Cybersecurity “High”로 분류하지만, 그 문서에는 GPT-5.6-Cyber도 Daybreak Red도 완료율 수치도 등장하지 않습니다. Cyber 전용 시스템 카드는 아직 미공개이며 추후 발표 예정입니다(확인 필요).
Q5. 그래서 우리 조직은 Cyber를 써야 하나요, Sol로 충분한가요?

세 갈래로 나뉩니다. 판단 기준은 “우리가 하려는 일을 Sol이 거절하는가”입니다.
Sol로 충분한 경우가 가장 많습니다. 로그 분석, 탐지 룰 작성, 보안 문서 정리, 취약점 리포트 작성 같은 방어 작업 대부분은 Sol이 처리합니다. 2026년 8월 25일 기준 short-context 요금이 입력 $4·출력 $20이라 Cyber 대비 출력 기준 3.75배 저렴하고, long-context 구간($8/$30)도 따로 있습니다. 결정적으로 취약점 발견·리포트 작성 평가에서는 Sol이 Cyber보다 높았습니다(VentureBeat 보도). 리포트 자동 생성이 목적이라면 Cyber로 바꾸는 것이 오히려 후퇴입니다.
Cyber가 값을 하는 건 “Sol이 거절해서 못 하던 일”뿐입니다. 익스플로잇 재현·검증처럼 이중용도 성격이 짙은 작업입니다. 다만 Infosecurity Magazine 보도에 따르면 Daybreak Blue 경유 Sol도 일부 고도 이중용도 프롬프트는 계속 거절하므로, 프로그램 등록만으로 해결되지 않는 영역이 Cyber의 자리입니다.
이미 Claude 엔터프라이즈를 쓰고 있다면 도입 비용이 다릅니다. Anthropic은 2026년 8월 21일 Claude Mythos 5를 Claude Security의 Enterprise 스캔에 투입하면서 별도 애드온 없이 기존 플랜의 토큰 과금으로 제공한다고 밝혔고, 취약점 트리아지·검증 쪽으로 프로그램 확대를 예고했습니다. 승인 절차를 새로 밟을 필요가 없다는 점이 실무적으로는 가장 큰 차이입니다.
마지막으로 관점 하나. Illumio의 Alex Goller는 모델 가드레일이 방어의 컨트롤 플레인이었던 적은 없으며 실질 통제는 인프라 계층에 있다고 지적했습니다(Infosecurity Magazine, 2026년 8월 11일). 모델 선택이 보안 아키텍처를 대체하지는 않는다는 뜻입니다.
정리
GPT 5.6 Cyber의 95.0%는 성능이 아니라 거절하지 않는 비율이고, 취약점 리포트 품질은 오히려 Sol이 더 높았습니다. 접근은 Daybreak 프로그램 승인과 Responses API 전용이라는 두 장벽을 넘어야 하며, Bedrock 경유는 us-east-2 단독에 약 10% 비쌉니다(2026년 8월 25일 기준). 공개 검증된 성과는 CVE-2026-15903 1건이고 시스템 카드와 제3자 Cyber 실측은 아직 없으므로, 익스플로잇 재현·검증이라는 명확한 용도가 없다면 현재로서는 Sol이 합리적인 선택입니다.
참고 자료
조사 기준일: 2026년 08월 25일
본문의 수치는 아래 자료에서 확인한 것입니다. 제조사 공식 자료(T1)와 전문 매체 실측(T2)을 구분해 표기했습니다. 가격·공급 상황은 변동이 크므로 기준일 이후의 값은 다시 확인해야 합니다.
Tier 1 (원문 대조 완료)
– GPT-5.6 Cyber 모델 문서 — https://developers.openai.com/api/docs/models/gpt-5.6-cyber (2026-08-25)
– OpenAI API 가격 페이지 — https://developers.openai.com/api/docs/pricing (2026-08-25)
– AWS Bedrock 모델 카드 “Daybreak Red: GPT-5.6 Cyber” — https://docs.aws.amazon.com/bedrock/latest/userguide/model-card-openai-gpt-56-cyber.html (2026-08-25)
– AWS ML 블로그, Daybreak Red/Blue on Bedrock — https://aws.amazon.com/blogs/machine-learning/accelerate-cyber-defense-with-openai-and-aws-daybreak-red-daybreak-blue-now-available-to-eligible-customers-on-amazon-bedrock/ (2026-08-25)
– OpenAI Deployment Safety Hub, GPT-5.6 August Updates — https://deploymentsafety.openai.com/gpt-5-6-august-update (2026-08-25)
– Anthropic, Bringing Claude Mythos 5 to more defenders — https://claude.com/blog/bringing-claude-mythos-5-to-more-defenders (2026-08-25)
Tier 1 접근 실패 (403 — 인용 불가)
– OpenAI, Expanding Daybreak as the Cyber Defense Window Narrows — https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/ (2026-08-25 시도, HTTP 403)
– Axios 2026-08-10 기사 — https://www.axios.com/2026/08/10/openai-gpt-astra-restrictions-safety-hacking-defenders (2026-08-25 시도, HTTP 403)
Tier 2
– Irregular, Assessing GPT-5.6 Sol — https://www.irregular.com/research/assessing-gpt-5.6-sol (2026-08-25)
– VentureBeat 2026-08-10 — https://venturebeat.com/technology/openai-launches-gpt-5-6-cyber-with-reduced-refusals-95-completion-on-advanced-cybersecurity-tasks (2026-08-25)
– The Hacker News 2026-08-11 — https://thehackernews.com/2026/08/openai-launches-gpt-56-cyber-with.html (2026-08-25)
– SecurityWeek 2026-08-11 — https://www.securityweek.com/openai-unveils-new-cybersecurity-model-gpt-5-6-cyber/ (2026-08-25)
– Help Net Security 2026-08-11 — https://www.helpnetsecurity.com/2026/08/11/openai-gpt-5-6-cyber-model/ (2026-08-25)
– Infosecurity Magazine 2026-08-11 — https://www.infosecurity-magazine.com/news/openai-daybreak-blue-red-gpt-cyber/ (2026-08-25)
– TheNextWeb 2026-08-10 — https://thenextweb.com/news/openai-gpt-5-6-cyber-daybreak-expansion-refusal-rate (2026-08-25)
– Tenable CVE-2026-15903 — https://www.tenable.com/cve/CVE-2026-15903 (2026-08-25, 검색 결과 기준)

답글 남기기