メインコンテンツにスキップ
OpenAI

GPT‑6 Astra:仕事のための次世代の応答性能

企業に必要なあらゆる業務を遂行するために構築された、OpenAI の最高性能モデル。

白や色とりどりの星が点在する、濃紺の星空。
読み込んでいます...

先週、世界で最も高い応答性能とアラインメントを備えたモデル GPT‑6 Astra を発表しました。現在、ChatGPT Work、Codex、API で利用できます。Astra は、コンピューター操作、ブラウジング、専門業務、ソフトウェアエンジニアリング、サイバーセキュリティ、科学の各分野で最先端の性能を発揮します。チームは比類のない速度、精度、判断力で、特に難しい専門業務に取り組めます。

複雑な業務に最適な世界最高のモデル

多くの AI システムでは、価値を生み出す前に、企業がデータを準備し、ワークフローを再設計し、独自の連携機能を構築する必要があります。Astra はそれを変えます。ChatGPT Work と Codex では、コードを記述し、API のないアプリであっても、人が日常的に使う同じアプリを操作して作業できます。つまり企業は、大がかりな準備やエンジニアリング作業をせず、初日から既存のワークフローで AI を活用できます。

展開開始からわずか数日で、GPU の最適化、財務諸表の不整合の発見、ブランドらしさを高めたスライド資料の作成など、顧客による Astra の活用がすでに始まっています。

1/6
“GPT‑6 Astra をリリース初日から Devin のハーネスに統合しています。当社の社内テストベンチマークで最先端の性能を発揮しています。優れたコンピューター操作、文章力、コードベースの理解力により、導入直後からテストが改善されました。動画は格段に追いやすくなり、レポートも明瞭で簡潔になっています”
— Silas Alberti 氏、Cognition 研究担当 SVP

OpenAI では、提供開始の数週間前から Astra を社内展開していたため、コンピューター操作のような最先端機能が働き方をどう変えるかを直接確認できました。開発チームとマーケティングチームは Astra と Codex を使い、3 時間分のマルチカメラ映像からGPT‑6 Astra 開発者向けファーストインプレッション動画⁠(新しいウィンドウで開く)を制作しました。この動画はわずか 4 日で 55 万回以上再生されています。エンジニアリングチームは Astra を使い、テスト環境で Codex のセッションを遅くしていたメモリ割り当てのボトルネックを発見し、解消しました。アロケーターを切り替えたことで、ピークメモリ使用量が約 30% 増加する一方、ターンのレイテンシーを 25 分の 1 に短縮できました。

Astra は企業の文体、テンプレート、デザイン基準にもより忠実に従うため、最初の出力からチームが実用できる仕上がりに近づきます。

1 ドル当たりでより有用な成果

Astra は、1 ドル当たりでより有用な成果を顧客に提供する、極めて効率的なモデルへの OpenAI の取り組みを受け継いでいます。より少ないトークンと再試行でタスクを完了できるようトレーニングされているため、手戻りが減り、タスク当たりのコストも低下します。Astra により、OpenAI は Terminal Bench 4.0 や Artificial Analysis Intelligence Index など、専門業務とコーディングの評価における費用対効果のフロンティアの大半を占めています。料金は入力 100 万トークン当たり 10 ドル、出力 100 万トークン当たり 50 ドルからです。

1/4
“Astra は DeepSWE v1.1 で 74% という新記録を樹立しました。特に複雑で長期的なタスクにおいて、これまでのフロンティアモデルを上回る少ないステップ数と高いトークン効率で達成しました。このモデルが高品質な実務のソフトウェアエンジニアリングに明確な影響を与えることは間違いありません。”
— Serena Ge 氏、Datacurve 共同創業者兼 CEO

重要な業務のための安全性と制御の強化

AI に業務システムへのアクセスを許可するには、その動作を信頼できることが必要です。この点を踏まえ、Astra は人間の意図と認可をこれまで以上に忠実に守る、OpenAI 史上最もアラインメントの進んだモデルです。

トレーニング中、Astra を OpenAI の社内コンピューター操作安全性ベンチマーク⁠でテストしました。このベンチマークでは、機密情報の露出、ダッシュボードの過剰な共有、データの削除など、特に難しいビジネスシナリオに対してモデルを評価します。この評価で Astra が意図しない結果を生じさせた頻度は、GPT‑5.6 Sol より 89%、Claude Fable 5.1 より 74.7% 低くなりました。追加確認と自動レビューにより、GPT‑6 Astra と GPT‑5.6 Sol の性能はさらに向上しました。

組織は Astra をどの範囲まで展開するかも決定できます。新しいエンタープライズ管理者向け制御により、承認済みのウェブサイトやデスクトップアプリへのアクセス制限、アップロードとダウンロードの管理、閲覧履歴の制御が可能です。ChatGPT Work と Codex には、重要な操作の前に承認を必須にできる確認ポリシーや、安全でない可能性がある、または認可されていないツール呼び出しの自動レビューといった保護策も備わっています。これらの制御により、チームは限定的な構成から始め、徐々にアクセス範囲を広げられます。

アクセスをさらに拡充するため、Astra と同時に ChatGPT Desktop 向けの新しいエンタープライズプラグインも提供開始します。最新のブラウザー操作機能を活用した Oracle Analytics、Power BI(Microsoft Fabric のサービス)、Navan、Avalara のプラグインにより、使い慣れたエンタープライズアプリへ簡単にアクセスできます。

Astra⁠(新しいウィンドウで開く) は、OpenAI のサイバーセキュリティ能力の「Critical」しきい値⁠ に、OpenAI のPreparedness Framework⁠ で初めて到達したモデルでもあります。能力の向上に伴い、悪用とモデルによる不正操作の両方に対する 保護を強化しました⁠(新しいウィンドウで開く) 。具体的には、安全性とセキュリティの境界を尊重するよう Astra をトレーニングし、保護策を回避する試みへの耐性を高め、有害な応答を遮断する自動チェックを導入しています。

承認を受けた対象 API 顧客は、対応エンドポイントでゼロデータ保持を利用できます。

Astra を今すぐ利用

ChatGPT Work⁠(新しいウィンドウで開く) または Codex⁠(新しいウィンドウで開く) で GPT‑6 Astra をお試しください。API⁠(新しいウィンドウで開く) を通じて、自社の製品やワークフローに組み込むこともできます。

エンタープライズ管理者は、適用される料金表と契約に基づいて Astra を有効にできます。提供開始時点では、エンタープライズアクセスはデフォルトで無効です。