メインコンテンツにスキップ
OpenAI

GPT‑6 Astra:仕事のための次世代の応答性能

企業に必要なあらゆる仕事を遂行するために構築された、OpenAI 最高性能のモデル。

白や色とりどりの星が点在する、濃紺の星空。
読み込んでいます...

先週、世界で最も高い知能と整合性を備えたモデル GPT‑6 Astra を発表しました。現在、ChatGPT Work、Codex、API で利用できます。Astra は、コンピューター操作、ブラウジング、専門業務、ソフトウェアエンジニアリング、サイバーセキュリティ、科学の各分野で最先端の性能を発揮します。チームは比類ないスピード、精度、判断力で、極めて難しい専門業務に取り組めます。

複雑な業務に最適な世界最高のモデル

多くの AI システムでは、価値を生み出す前に、企業側でデータを準備し、ワークフローを再設計し、独自の連携機能を構築する必要があります。Astra はそれを変えます。ChatGPT Work と Codex では、コードを記述し、API がない場合でも、人々が日常的に使うものと同じアプリを操作して作業できます。そのため企業は、大がかりな準備やエンジニアリング作業なしで、初日から既存のワークフローに AI を導入できます。

展開開始からわずか数日で、GPU の最適化、財務諸表の不整合の発見、ブランドらしさを高めたスライド資料の作成など、顧客が Astra を活用する事例がすでに生まれています。

1/6
提供開始日に GPT‑6 Astra を Devin のハーネスへ統合します。当社の社内テストベンチマークでは、最先端の性能を発揮しています。優れたコンピューター操作、文章作成、コードベースの理解により、導入直後からテストが改善されました。動画は明らかに理解しやすくなり、レポートも明快で簡潔になっています
— Silas Alberti 氏、Cognition リサーチ担当 SVP

OpenAI では提供開始の数週間前から Astra を社内展開し、コンピューター操作のような最先端の能力が仕事の進め方をどう変えるかを実際に確認しました。開発者チームとマーケティングチームは Astra と Codex を使い、3 時間分のマルチカメラ映像からGPT‑6 Astra 開発者ファーストインプレッション動画(新しいウィンドウで開く)を制作しました。公開からわずか 4 日ですでに 55 万回以上再生されています。エンジニアリングチームは Astra を使い、テスト環境で Codex セッションを遅延させていたメモリ割り当てのボトルネックを特定し、解消しました。アロケーターを切り替えることで、ピーク時のメモリ使用量が約 30% 増える代わりに、ターンのレイテンシを 25 分の 1 に短縮できました。

Astra は企業の語調、テンプレート、デザイン基準にもより忠実に従うため、初回の成果物からチームが実用できる水準に近づきます。

1 ドル当たりで、より有用な成果

Astra は、顧客が 1 ドル当たりでより有用な成果を得られる、極めて効率的なモデルを提供するという OpenAI の取り組みをさらに推し進めます。より少ないトークンと再試行でタスクを完了できるようトレーニングされているため、手戻りが減り、タスク当たりのコストも下がります。Astra により OpenAI は、Terminal Bench 4.0 や Artificial Analysis Intelligence Index など、専門業務とコーディングの評価におけるコスト効率のフロンティアの大半を占めています。料金は、入力 100 万トークン当たり 10 ドル、出力 100 万トークン当たり 50 ドルからです。

1/4
Astra は DeepSWE v1.1 で 74% という新記録を樹立しました。特に複雑で長期的なタスクにおいて、従来のフロンティアモデルを上回る少ないステップ数と高いトークン効率で達成しています。このモデルが、高品質な実務のソフトウェアエンジニアリングに明確な影響を与えることは間違いありません。
— Serena Ge 氏、Datacurve 共同創業者 & CEO

重要な業務に、さらなる安全性と制御を

AI にビジネスシステムへのアクセスを許可するには、その動作を信頼できることが不可欠です。この点を踏まえ、Astra は人間の意図と認可にこれまで以上に忠実な、OpenAI 史上最も整合性の高いモデルです。

トレーニング中には、機密情報の漏えい、ダッシュボードの過剰な共有、データ削除など、極めて困難なビジネスシナリオでモデルを検証する社内コンピューター操作安全性ベンチマークで Astra をテストしました。この評価で Astra が意図しない結果を生じさせた頻度は、GPT‑5.6 Sol より 89%、Claude Fable 5.1 より 74.7% 低くなりました。追加確認と自動レビューにより、GPT‑6 Astra と GPT‑5.6 Sol の性能はさらに向上しました。

組織は Astra をどの範囲まで導入するかも決定できます。新しい企業向け管理機能では、承認済みのウェブサイトやデスクトップアプリへのアクセス制限、アップロードとダウンロードの管理、閲覧履歴の制御が可能です。ChatGPT Work と Codex には、影響の大きい操作の前に承認を必須にできる確認ポリシーや、安全でない、または未認可の可能性があるツール呼び出しの自動レビューといった安全対策も組み込まれています。これらの管理機能により、チームは制限付きの設定から始め、段階的にアクセス範囲を広げられます。

アクセスをさらに拡充するため、Astra と同時に ChatGPT Desktop 向けの新しい企業用プラグインも提供します。最新のブラウザー操作機能を活用した Oracle Analytics、Power BI(Microsoft Fabric のサービス)、Navan、Avalara のプラグインにより、使い慣れた企業アプリへ簡単にアクセスできます。

また、Astra(新しいウィンドウで開く) は、OpenAI の Preparedness Framework におけるサイバーセキュリティ能力の「Critical」しきい値に初めて到達したモデルです。能力の向上に伴い、悪用とモデルによる未認可操作の両方に対する保護を強化しました。Astra に安全性とセキュリティの境界を守るようトレーニングし、安全対策を回避する試みへの耐性を高め、有害な応答を阻止する自動チェックを導入しています。

承認を条件として、対象エンドポイントを利用する適格な API 顧客にゼロデータ保持を提供しています。

今すぐ Astra を使い始める

ChatGPT Work(新しいウィンドウで開く) または Codex(新しいウィンドウで開く) で GPT‑6 Astra をお試しください。API(新しいウィンドウで開く) を通じて、独自の製品やワークフローに組み込むこともできます。

企業管理者は、適用される料金表と契約に基づいて Astra を有効にできます。提供開始時点では、企業向けアクセスはデフォルトで無効です。