메인 콘텐츠로 건너뛰기
OpenAI

2026년 8월 13일

제품

Ultrafast 모드 미리보기: 최대 14배 빠른 GPT‑5.6 Sol

속도를 경쟁 우위로 바꾸는 프런티어 지능의 새로운 속도 등급.

로딩 중...

오늘 Standard 처리보다 GPT‑5.6 Sol을 최대 14배 빠르게 실행하는 새로운 서비스 등급 Ultrafast를 먼저 공개합니다. OpenAI API에서 우선 출시됩니다. Cerebras 기반의 Ultrafast는 초당 최대 750개의 출력 토큰을 생성해, 매분 매초가 중요한 제품과 워크플로에 가장 지능적인 모델을 제공합니다.

우리는 GPT‑5.6을 통해 모델 역량의 한계를 넓히는 동시에, 스택의 모든 계층에서 모델을 더 효율적으로 만들고 있습니다. 이러한 개선으로 고도화된 지능을 더 합리적인 비용으로, 더 많은 사람에게 유용하게 제공할 수 있게 되었습니다. 지금까지 실시간 속도를 구현하려면 일반적으로 더 작거나 전문화된 모델을 선택해야 했습니다. Ultrafast는 새로운 방향의 발전을 보여줍니다. 바로 초당 더 많은 유용한 작업을 처리하는 것입니다.

속도를 위해 더 이상 지능을 포기하지 않아도 된다면, AI를 시간에 가장 민감한 비즈니스 영역에 적용하고 새로운 유형의 업무를 수행할 수 있습니다. Ultrafast가 유용하게 쓰일 수 있는 몇 가지 고무적인 사례를 이미 확인했습니다.

  • 인시던트 대응 및 안정성: 핵심 시스템에 장애가 발생하면 상황이 종결되기 전부터 애플리케이션 로그, 최근 코드 변경 사항, 엔지니어 보고서를 분석해 가능한 원인을 파악하고 수정 사항을 준비할 수 있습니다.
  • 금융 리서치 및 보안: 상황이 변하고 있는 와중에도 시장 신호를 분석하고 거래를 평가하며 의심스러운 활동을 식별할 수 있습니다.
  • 고객 지원 및 음성: 답을 찾는 데 여러 단계나 시스템이 필요하더라도 대화를 중단하지 않고 복잡한 고객 문제를 실시간으로 해결할 수 있습니다.
  • 커머스: 고객이 구매를 고민하는 동안 제품 관련 질문에 답하고, 재고를 확인하고, 추천을 개인화하고, 결제 문제를 해결해 망설임이 장바구니 이탈로 이어지는 것을 방지할 수 있습니다.
  • 실시간 연구 및 실험: 이전에는 밤새 실행해야 했던 연구를 대화형 작업 세션으로 전환해, 팀이 흐름을 끊지 않고 아이디어를 테스트하고 결과를 검토한 뒤 접근 방식을 조정해 다음 실험을 진행할 수 있습니다.

프리뷰 기간에는 초기 고객 그룹과 협력해 이러한 속도가 어디에서 가장 큰 차이를 만드는지 파악하고, 여기서 얻은 교훈을 향후 제품에 반영할 방법을 모색합니다. 비즈니스에 최고 속도의 프런티어 지능이 필요하다면 이용 대상 확대 알림을 신청하세요.

GPT‑5.6 Sol의 Ultrafast 모드와 표준 모드가 같은 텍스트 프롬프트로 작동하는 3D 창고 시뮬레이터를 나란히 구축합니다.

초기 고객이 경험한 변화

코딩, 커머스, 금융 리서치, 고객 지원 및 기타 대화형 애플리케이션 분야의 초기 기업 그룹과 함께 Ultrafast 모드의 GPT‑5.6 Sol을 테스트해 왔습니다. 비즈니스 워크플로부터 시작하면 실제 프로덕션 환경에서 이러한 조건을 살펴볼 수 있습니다. 고객의 초기 활용 사례를 통해 속도가 획기적으로 향상될 때 가장 큰 가치가 창출되는 영역이 무엇이고, 모델이 사용자 속도에 맞춰 응답할 때 제품이 어떻게 달라지는지 파악하고 있습니다. 용량이 확대되면 이러한 결과를 배포 방향을 정하는 데 활용할 예정입니다.

4개 중 1
Cerebras가 구현한 속도 향상은 인상적입니다. 모델을 새로운 방식으로 활용할 수 있게 해주며, 개발자가 모델과 함께 더욱 집중력 있고 생산적으로 작업하는 방식을 실용적인 선택지로 만들어 줍니다.
—John Crepezzi, Jane Street AI 어시스턴트

OpenAI의 Ultrafast 활용 방식

OpenAI 내부에서는, 실시간으로 응답하는 프런티어 지능이 어떤 워크플로에 도움이 되는지 파악하기 위해 개발자 그룹이 Ultrafast 모드의 GPT‑5.6 Sol을 테스트하고 있습니다.

인시던트 대응은 OpenAI 팀이 Ultrafast를 활용하는 사례 중 하나입니다. 알림이 발생하면 엔지니어는 시스템과 증거가 계속 변하는 상황에서도 정확한 현황을 파악해야 합니다. 팀은 이를 활용해 로그를 빠르게 읽고, 트레이스를 분석하고, 대화를 종합하고, 다음 점검 항목을 파악하며, 수정 사항의 준비 또는 검증을 지원합니다. Sol의 뛰어난 성능으로 이 모든 작업에 드는 시간을 크게 단축할 수 있습니다. 신호 관찰, 가설 검증, 다음 조치 선택 사이의 지연을 줄이면서도 판단과 배포에 대한 책임은 엔지니어가 계속 맡습니다.

연구 분야에서 OpenAI 팀은 Ultrafast를 사용해 지식 출처를 신속하게 검색하고, 데이터를 조회하며, 연결된 도구 전반의 정보를 빠르게 수집·정리·요약합니다. 우리 팀원들이 연구에서 흔히 사용하는 워크플로는 팀원이 밤새 여러 실험을 일괄 실행하고 아침에 결과를 검토하는 방식입니다. Ultrafast를 활용하면 이 주기가 단축되어 업무 시간 중에도 여러 차례 반복할 수 있습니다.

Cerebras 기반

Ultrafast는 OpenAI 플랫폼에 초저지연 추론을 제공하기 위한 Cerebras와의 파트너십에서 다음 단계에 해당합니다. 이제 Cerebras는 Ultrafast 모드의 GPT‑5.6 Sol을 통해 OpenAI의 가장 지능적인 모델을 지원하며 초당 최대 750개의 출력 토큰을 제공합니다. 기업은 이를 바탕으로 반응성이 더 높은 제품을 구축하고, 더 빠르게 의사 결정하며, 가장 까다로운 워크플로에 강력한 AI를 직접 도입할 수 있습니다.

이용 가능 여부

Ultrafast 모드의 GPT‑5.6 Sol은 현재 일부 고객에게 제한적인 프리뷰로 제공됩니다. 용량이 확대되는 대로 이용 대상을 늘릴 예정입니다. 업데이트를 신청하세요.

작성자

OpenAI