OpenAI、長時間稼働するエージェントを連携させるために構築されたAstraモデルをプレビュー

Sam Altmanは、連邦の審査プロセスが8月1日の期限に近づく中で、未公開のモデルを政策立案者に実演した。

By · Published

Primary source: The Information

Why it matters

Astra would push OpenAI from parallel agent features toward models built around persistent coordination, while making federal review a direct part of the release process.

Sam Altman of OpenAI presents the unreleased Astra model to a panel of federal policymakers, highlighting tensions between advanced AI and upcoming regulation.

OpenAI CEO Sam Altmanは今週ワシントンで政策立案者や規制当局に対し、複数のAIエージェントを長期間にわたって調整するよう設計されたシステムである「Astra」と呼ばれる未公開のモデル群を実演したとThe Informationが報じた

Altmanの聴衆の選択は、Astraを最先端AI開発とワシントンの関係が強まる中に置くものだ。報道によれば、同モデルはすでにテスト段階にあり、OpenAIはそれをリリース前に強力なシステムを連邦の新しいプロセスで審査する最初のモデルにしたいと考えている。

OpenAIは最終的な製品名をまだ確定していない。The Informationは、AstraがGPT-6になる可能性や、GPT-5ラインの別のエントリ(GPT-5.7など)になる可能性があると報じた。仮称のAstraという呼称は、7月9日にGPT-5.6で導入された3つの能力階層であるSol、Terra、Lunaと並ぶ新たなモデルクラスを指すものだ。

並列エージェントから持続的な業務へ

Astraの中心的な訴求点はコーディネーションだ。OpenAIはThe Informationに対して、複数のエージェントが困難なプロジェクトや高度な数学課題に対して長期間にわたり協働できると説明した。これにより、競争目標は単一のプロンプトに対するより強い答えを出すことから先に進む。Astraは、作業を分割し、委任し、検査し、長期にわたって引き継いでいく必要がある仕事のために開発されている。

OpenAIはすでにそのアプローチの一部を提供し始めている。GPT-5.6の「ultra」設定は並列のワークストリーム全体でエージェントを調整し、モデルのアプリケーションプログラミングインターフェイス(API)には並行してサブエージェントを実行しその結果を結合するベータ機能が含まれている。Astraが単なるGPT-5.6の別機能ではなく独立したモデルクラスに値するためには、永続性とコーディネーションを大幅に改善する必要があるだろう。

需要の根拠は主にOpenAI自身の利用データにある。エージェントが仕事をどのように変えているかについての6月の[報告]では、OpenAIは、サンプルされたCodexユーザーのうち5月に少なくとも1つ、人間の作業で1時間以上と推定されるタスクを要求した者が70%超に上ったと述べた。6月までに、99パーセンタイルのユーザーは複数のエージェントを並行実行することで1日あたり60時間以上のエージェントターンを生み出していた。OpenAIはこれらの人間時間の推定を厳密な数値というより方向性を示すものと説明している。

そうした数字が製品への賭けを説明する。数時間あるいは数日にわたって複数のエージェントを確実に監督できるモデルは、現在は人間が別々の実行を再開、修正、突合することで対応しているソフトウェア移行、研究プロジェクト、分析作業などを引き受けられる可能性がある。タスクが大きくなるほど信頼性の測定は難しくなる:システムは多くのもっともらしい中間ステップを生成しつつ、最終目標には失敗し得る。

ワシントンが早期に確認

Astraは、連邦政府が最先端モデルのリリース判断に正式な道筋を整備するなかで登場している。President Donald Trumpの6月2日の大統領令は、開発者が信頼できるパートナーにリリースする前に最長30日間「covered frontier model」へのアクセスを政府に提供できる自主的な枠組みを各機関に作成するよう指示した。

その大統領令は、対象となるモデルを識別するベンチマークと提出プロセスを設計するために官僚に60日間の猶予を与え、締め切りを8月1日としている。枠組みは明示的に強制的なライセンスや事前承認を作るものではないと述べている。だが、連邦機関が調達や安全保障審査、政府とのパートナーシップへのアクセスを管理する場合、最先端研究機関に対する実際の圧力は依然として大きくなり得る。

その枠組みは高度なサイバー能力に焦点を当てている。National Security Agencyがモデルがcovered-modelの閾値を超えるかどうかの判定を支援し、Commerce DepartmentのCenter for AI Standards and Innovationがモデル評価を実施しテスト手法を開発する。The Informationは、Astraは新しいプロセスを通過することを意図しているが、モデルのリリーススケジュールは未定であると報じた。

それによりAltmanのワシントンでの実演は製品プレビューであると同時に規制準備でもある。OpenAIは、エージェントのコーディネーションが生産的な利用を拡大し、システムが脆弱性を探索したりコードを書いたり誤った計画を追求したりする規模を大きくする可能性があるモデルの初期の様子を当局に見せている。

数学の主張は精査を招くだろう

The Informationによれば、OpenAIは同社の先進的AIがこれまで未解決だった10件の数学問題を解いた方法を説明する報告書を公表する計画でもある。報告書はAstraのリリース前に出される見込みで、出典記事はその問題や結果を検証した研究者の名前を特定していない。

OpenAIは以前にも、モデルが新たな証明に貢献したり、見落とされていた文献を特定したり、数学者が未解決問題を解くのを助けたりした事例を文書化している。2025年11月のGPT-5を用いた科学的取り組みに関する報告も、モデルが引用や証明を幻覚的に生成したり、技術的な微妙さを見落としたり、元の出典を示さずに既存の作業を再現したりする可能性を警告している。独立した専門家による検証が、今回の結果が自律的な解決なのか、人間とAIの協働なのか、それとも既往の研究の再発見なのかを判断するだろう。

Astraのリリース時期は未定だが、方向性は明確だ。OpenAIは単一エージェント型モデルを超えて、複数のエージェントに作業を割り当て、状態を維持し、より長い時間軸で動作するシステムに向かって構築している。ワシントンでのプレビューは、そうしたシステムの展開プロセス自体が製品サイクルの一部になりつつあることを示している。

Reader comments

Conversation for this story loads after sign-in.