OpenAI는 GPT‑5.6 시리즈의 제한된 프리뷰를 시작합니다. Sol은 플래그십 모델이며, Terra는 일상적인 업무에 적합한 균형 잡힌 모델, Luna는 빠르고 경제적인 모델입니다. Terra는 GPT‑5.5에 견줄 만한 성능을 제공하면서도 비용은 절반 수준이며, Luna는 가장 낮은 비용으로 뛰어난 성능을 제공합니다.
GPT‑5.6 Sol에는 지금까지 가장 강력한 안전 체계가 적용되었습니다. 고위험 활동과 민감한 사이버 보안 요청, 반복적인 오용에 대한 보호를 강화했으며, 몇 주에 걸쳐 취약점을 찾고 시스템을 집중적으로 검증하며 실제 환경의 공격에도 견딜 수 있도록 안전성을 강화했습니다.
OpenAI는 더 많은 사람이 AI를 이용할 수 있어야 한다고 믿으며, 앞으로 몇 주 안에 GPT‑5.6 Sol, Terra, Luna를 더 많은 사용자가 이용할 수 있도록 제공할 계획입니다. 오늘 공개에 앞서 미국 정부와 진행해 온 협력의 일환으로, OpenAI는 출시 계획과 모델의 성능을 미리 공유했습니다. 정부의 요청에 따라 먼저 정부와 참여 사실을 공유한 소수의 신뢰할 수 있는 파트너를 대상으로 제한된 프리뷰를 시작한 뒤, 이후 더 많은 사용자에게 제공할 예정입니다. 프리뷰 기간에는 파트너들과 긴밀히 협력하며 지속적으로 테스트를 진행해 더 많은 사용자에게 안정적으로 제공할 수 있도록 준비해 나갈 것입니다. OpenAI는 이러한 정부 대상 사전 공유 절차가 장기적으로 표준이 되어서는 안 된다고 생각합니다. 이러한 절차는 이를 필요로 하는 사용자와 개발자, 기업, 사이버 보안 담당자, 그리고 전 세계 파트너들이 최첨단 AI를 이용하는 시기를 늦출 수 있기 때문입니다. 이번 제한적 프리뷰는 어디까지나 한시적인 조치입니다. OpenAI는 미국 행정부와 함께 사이버 보안 행정명령의 이행 체계와 향후 모델 출시를 위한 표준화된 절차를 마련하고 있습니다. 그 과정에서 앞으로 몇 주 안에 GPT‑5.6을 더 많은 사용자에게 제공하기 위한 가장 효과적인 방안으로, 우선 제한적 프리뷰를 진행하기로 했습니다.
GPT‑5.6 Sol은 지금까지 OpenAI가 개발한 모델 가운데 가장 뛰어난 성능을 제공합니다. 모델 성능을 미리 살펴볼 수 있도록 코딩, 생명과학, 사이버 보안 분야에서 향상된 에이전틱 역량을 보여 주는 평가 결과를 공개합니다. 추가적인 안전성 및 대비 태세 평가는 시스템 카드(새 창에서 열기)에서 확인할 수 있으며, 모델을 더 많은 사용자가 이용할 수 있게 되면 더욱 폭넓은 평가 결과도 함께 공개할 예정입니다.
GPT‑5.6에서는 Sol이 더욱 깊이 있게 추론할 수 있도록 새로운 'max' 추론 수준을 도입했습니다. 또한 여러 하위 에이전트를 활용해 복잡한 작업을 더 빠르게 수행함으로써 단일 에이전트의 한계를 넘어서는 새로운 'ultra' 모드도 함께 선보입니다.
코딩 워크플로에서는 계획 수립과 반복 개선, 도구 간 협업이 필요한 명령줄 기반 작업을 평가하는 TerminalBench 2.1에서 GPT‑5.6 Sol이 새로운 최고 성능을 기록했습니다.
GPT‑5.6 Sol은 생명과학 워크플로에서도 전반적으로 향상된 성능을 보여 줍니다. 장기 실행 유전체 분석과 정량 생물학 분석을 평가하는 GeneBench v1에서는 GPT‑5.5보다 더 적은 토큰을 사용하면서도 더 뛰어난 성능을 기록했습니다.
GPT‑5.6 Sol은 지금까지 OpenAI가 개발한 모델 가운데 사이버 보안 분야에서 가장 뛰어난 성능을 제공합니다. 취약점 연구와 익스플로잇을 비롯한 장기간에 걸친 보안 작업에서 성능과 효율의 새로운 기준을 제시합니다. ExploitBench²에서는 Mythos Preview 대비 약 3분의 1 수준의 출력 토큰만 사용하면서도 경쟁력 있는 성능을 보였습니다. 또한 UC 버클리 연구진이 OpenAI 및 다른 프런티어 AI 연구소와 함께 개발한 벤치마크인 ExploitGym(새 창에서 열기)3에서는 GPT‑5.6 Sol, Terra, Luna 모두 추론 수준을 높일수록 사이버 보안 성능이 크게 향상되는 모습을 보였습니다.
GPT‑5.6 Sol, Terra, Luna는 각 모델의 성능에 맞는 OpenAI 역사상 가장 강력한 안전장치를 갖춘 모델로 개발했습니다. 모델의 성능이 향상될수록 실제 공격 환경에서도 효과적으로 대응할 수 있도록 안전장치를 함께 강화하는 한편, 코드 검토와 취약점 연구, 패치 개발, 디버깅, 보안 교육, 방어 목적의 테스트처럼 정당한 보안 작업은 계속 수행할 수 있도록 했습니다. OpenAI의 목표는 이러한 유익한 활용을 불필요하게 제한하지 않으면서도, 허용되지 않는 공격 행위는 수행하기 더 어렵게 만들고, 성공 가능성은 낮추며, 탐지하기는 더 쉽게 만드는 것입니다. OpenAI는 모델과 안전장치를 종합적으로 평가한 결과, 정당한 방어 목적의 활용에는 상당한 도움이 되는 동시에 허용되지 않는 공격 목적의 사용은 효과적으로 제한할 수 있을 것으로 판단하고 있습니다.
GPT‑5.6 Sol은 처음부터 끝까지 공격을 수행하는 것보다 취약점을 찾아 수정하도록 돕는 데 훨씬 뛰어난 성능을 발휘합니다. 이러한 역량이 계속 발전하는 만큼, OpenAI는 이러한 기술이 방어 담당자에게 먼저 전달되어 취약점을 찾고, 패치를 개발하며, 시스템 전반의 보안을 강화하는 데 활용될 수 있도록 하는 것을 최우선 과제로 삼고 있습니다.
OpenAI의 준비성 평가 프레임워크에 따르면 GPT‑5.6 Sol은 Cyber Critical 기준에 해당하지 않습니다. Chromium과 Firefox를 대상으로 한 평가에서는 버그와 익스플로잇의 구성 요소가 되는 익스플로잇 프리미티브는 찾아냈지만, 시험 조건에서는 완전한 풀체인 익스플로잇을 자율적으로 생성하지는 못했습니다. 다만 벤치마크 기준만으로는 모델이 실제 환경에서 사용되거나 다른 도구와 결합되는 모든 방식을 반영할 수는 없습니다. 이러한 불확실성과 모델의 전반적인 성능 향상을 고려해, OpenAI는 한층 강화된 안전장치와 단계적인 출시 방식을 함께 적용하고 있습니다. 안전장치에 대한 자세한 내용은 GPT‑5.6 Preview 시스템 카드(새 창에서 열기)에서 확인할 수 있습니다.
고의적이거나 끊임없이 방식이 바뀌는 오용을 막기에는 단 하나의 안전장치만으로는 충분하지 않습니다. GPT‑5.6 프리뷰에서는 모델별 특성에 맞게 서로 다른 구성을 적용한 다층적인 안전장치 체계를 운영하고 있으며, 실제 환경의 공격을 가정한 강도 높은 검증도 함께 진행하고 있습니다. 여기에는 모델 자체에 학습된 보호 기능을 비롯해 생성 과정의 실시간 검사, 계정 수준의 위험 신호 분석, 차등화된 액세스, 모니터링, 정책 집행, 지속적인 테스트가 포함됩니다.
GPT‑5.6은 사용자가 의도를 숨기거나 모델을 탈옥하려는 경우를 포함해, 허용되지 않는 사이버 보안 지원 요청은 거부하도록 학습되었습니다. 이러한 모델 수준의 안전장치는 모델이 지원해야 하는 작업과 지원해서는 안 되는 작업의 첫 번째 경계를 설정합니다.
실시간 사이버 및 생명과학 오용 분류기는 생성되는 출력값을 실시간으로 평가해 또 하나의 안전장치 역할을 합니다. 위험도가 높은 사례에서 잠재적인 정책 위반이 감지되면, 더 큰 추론 모델이 대화 내용과 맥락을 검토하는 동안 출력 생성을 일시적으로 중단할 수 있습니다. 검토 결과 허용되지 않는 출력으로 판단되면 사용자에게 전달되기 전에 차단됩니다.
플래그가 지정된 활동은 콘텐츠 보존 및 검토와 관련된 이용약관과 정책에 따라, 관련 대화와 위험 신호를 종합적으로 검토하는 계정 수준의 검토 절차로 이어질 수 있습니다. 단일 대화에만 국한하지 않고 폭넓게 살펴봄으로써, 비슷한 기술 개념이 등장하더라도 지속적인 악의적 행위와 정당한 이중 용도 보안 작업을 서로 다른 맥락에서 구분할 수 있습니다.
이러한 여러 계층의 안전장치가 함께 작동함으로써, 단일 안전장치만 사용하는 것보다 훨씬 더 강건한 보호 체계를 구현할 수 있습니다. 모델 자체의 동작은 유해한 응답이 생성될 가능성을 낮추고, 실시간 시스템은 생성 과정에서 개입할 수 있으며, 계정 수준의 검토는 더 광범위한 위험 패턴을 식별합니다. 또한 차등화된 액세스를 통해 가장 민감한 기능을 기본적으로 널리 공개하지 않으면서도 중요한 방어 목적의 작업은 계속 지원합니다.
특히 프리뷰 기간에는 일부 요청이 안전장치에 의해 차단되거나 거부될 수 있습니다. 추가 검토를 위해 출력 생성이 일시 중단되면서 일부 요청은 응답 시간이 더 길어질 수도 있습니다. 또한 방어 목적과 공격 목적의 활동이 처음에는 비슷하게 보일 수 있는 이중 용도 영역에서는, 정당한 작업에도 안전장치가 간헐적으로 개입할 가능성이 있습니다.
바로 이러한 점이 이번 프리뷰에서 검증하려는 핵심 요소 중 하나입니다. OpenAI는 안전장치가 오용을 효과적으로 제한하는지뿐 아니라, 정당한 사용자가 일상적인 작업을 계속 안정적이고 효율적으로 수행할 수 있는지도 함께 확인하고자 합니다. 프리뷰 기간에 수집되는 피드백은 불필요한 차단과 지연을 줄이고, 안전장치가 맥락을 더 정확하게 이해하도록 개선하며, 정식 출시 전에 더욱 원활한 사용 경험을 제공하는 데 활용될 것입니다.
또한 OpenAI는 엔터프라이즈 고객과 협력해 개인정보를 보호하는 탐지 기술과 고객이 직접 운영하는 안전 제어 기능, 고객·사용자·워크로드의 위험 수준에 맞춰 조정되는 액세스 정책 등 장기적인 접근 방식을 함께 마련하고 있습니다. 이를 통해 엔터프라이즈의 개인정보 보호 요구 사항을 충족하면서도 안전성을 지속적으로 강화해 나가고자 합니다.
공격자가 전술을 바꾸더라도 안전장치는 계속 효과적으로 작동해야 합니다. 이미 알려진 공격만 막을 수 있는 보호 체계만으로는 프런티어 모델을 충분히 보호할 수 없습니다.
그래서 OpenAI는 그 어느 때보다 많은 AI 역량과 컴퓨팅 자원을 안전성 강화에 투입하고 있습니다. 자체 모델을 활용해 취약점을 찾아내고, 안전장치를 더 빠르게 개선하기 위해서입니다. 특히 특정 상황에만 적용되는 공격이 아니라, 다양한 프롬프트와 환경에서 통할 수 있는 범용 탈옥 기법을 찾아내기 위한 자동화된 레드팀 테스트에 A100 GPU 환산 기준 70만 시간 이상의 컴퓨팅 자원을 투입했습니다. 이러한 더 어렵고 일반화된 공격에 집중함으로써, 이미 알려진 실패 사례를 넘어 안전장치의 견고함을 검증할 수 있었습니다. 또한 사람만으로는 다루기 어려운 훨씬 다양한 공격 패턴을 탐색하고, 실패 양상을 더 일찍 발견하며, 취약점을 찾아 해결하기까지 걸리는 시간도 크게 단축할 수 있었습니다.
자동화된 레드팀 테스트와 함께, OpenAI는 외부 전문 테스터들과 협력해 대규모 전문가 레드팀 테스트도 진행했으며, 이러한 평가는 프리뷰 기간에도 계속 이어질 예정입니다. 전문가 레드팀 테스트는 시스템이 예상하지 못한 방식으로 모델을 오용하려는 전문가를 가정해 안전장치를 검증함으로써, 자동화된 테스트만으로는 확인하기 어려운 위험까지 점검하는 역할을 합니다.
어떤 평가도 모든 제품 구성이나 다단계 공격, 실제 환경의 워크플로를 완벽하게 반영할 수는 없습니다. 따라서 OpenAI는 새롭게 발견된 탈옥 기법을 신속하게 재현하고, 평가하고, 우선순위를 정해 대응하는 체계를 운영하고 있습니다. 또한 이러한 사례를 지속적인 평가에 반영해 앞으로 유사한 취약점에 대해서도 계속 검증할 수 있도록 하고 있습니다.
프리뷰 기간에는 GPT‑5.6 모델을 신뢰할 수 있는 일부 파트너와 조직을 대상으로 API와 Codex를 통해 먼저 제공합니다. 이후에는 ChatGPT, Codex, API를 사용하는 더 많은 사용자가 이용할 수 있도록 제공 범위를 확대할 계획입니다.
GPT‑5.6과 함께 도입된 새로운 모델 명명 체계에서는 숫자가 모델의 세대를 나타내고, Sol, Terra, Luna는 각각 독립적인 개발 주기에 따라 발전하는 지속적인 성능 등급을 나타냅니다. 이를 통해 사용자와 개발자는 지능, 속도, 비용 측면에서 자신의 필요에 맞는 모델을 더욱 명확하게 선택할 수 있습니다.
GPT‑5.6은 세 가지 모델 크기로 제공되며, 가격은 100만 토큰 기준입니다. Sol은 입력 $5 / 출력 $30, Terra는 입력 $2.50 / 출력 $15, Luna는 입력 $1 / 출력 $6입니다. GPT‑5.6에는 더욱 예측 가능한 프롬프트 캐싱도 도입되며, 명시적인 캐시 중단 지점과 최소 30분의 캐시 유지 시간을 지원합니다. GPT‑5.6 및 이후 모델부터는 캐시 쓰기 비용이 캐시를 사용하지 않은 입력 요금의 1.25배로 청구되며, 캐시 읽기에는 기존과 동일하게 캐시된 입력에 대해 90% 할인 혜택이 적용됩니다.
또한 7월에는 Cerebras에서 초당 최대 750토큰의 속도로 GPT‑5.6 Sol을 제공할 예정입니다. 이를 통해 전례 없는 속도로 프런티어 AI 성능을 고객에게 제공합니다. 초기에는 서비스 용량을 확대하는 동안 일부 고객에게만 제공됩니다.
이번 프리뷰를 통해 계속해서 배우고 개선해 나가는 한편, GPT‑5.6 Sol, Terra, Luna를 더 많은 사용자에게 곧 제공할 수 있기를 기대합니다.
1. 지연 시간과 API 비용은 실제 운영 환경에서의 모델 동작을 바탕으로 오프라인 시뮬레이션을 수행해 추정했습니다. 이러한 추정에는 도구 호출 세부 정보, 샘플링된 토큰, 입력 토큰이 반영됩니다. 실제 결과는 시뮬레이션에서 반영하지 못한 다양한 요인에 따라 크게 달라질 수 있습니다. 지연 시간은 빠른 API 속도를 기준으로, 비용은 일반 API 요금을 기준으로 시뮬레이션했습니다.
2. 모든 모델은 5개의 시드와 추론 연속성을 적용한 ExploitBench API 평가 환경에서 평가했습니다.
3. ExploitGym은 공개 API보다 더 빠르게 응답하는 알파 API에서 실행한 뒤, 결과를 공개 API의 성능에 맞춰 다시 환산했습니다. 이 과정에서 일부 추정 지연 시간은 실제 평가에서는 2시간 및 6시간 제한을 준수했더라도, 공개 API 기준으로 환산하면 해당 제한을 초과하는 것으로 나타날 수 있습니다. 시간이 중요한 작업에는 API의 우선 처리와 Codex의 고속 모드를 이용할 수 있습니다.
4. 출력 토큰 수, 지연 시간 또는 비용이 보고되지 않은 모델은 가로 점선으로 표시했습니다.

