GPT-6.1 Astra の公開見送り|理由と現行モデルへの影響

  • URLをコピーしました!
目次

はじめに

2026 年 9 月 28 日(米国時間)、OpenAI が 10 月に予定していた GPT-6.1 Astra の公開を見送ったと The Wall Street Journal(WSJ)が報じ、OpenAI も報道各社への説明でこの判断を認めました。GPT-6.1 Astra は、9 月 3 日に公開された GPT-6 Astra の次の版として準備されていた未公開のモデルです。

名前が似ているため、「現在使っている GPT-6 Astra も止まるのか」「GPT-6.1 全体が中止になったのか」と受け取られやすいニュースです。また、同じ日に英国 AI Security Institute(AISI)が GPT-6 Astra の評価結果を公開したため、両者を結び付けて受け取られるおそれもあります。一方で、公開見送りの詳細は報道経由の情報が中心で、OpenAI の公式サイトには単独の発表が見当たりません。

この記事では、確認できた事実と未確認の事項を分けたうえで、現行モデルへの影響と、利用環境で確認したい項目を整理します。

この記事でわかること
  • GPT-6.1 Astra、GPT-6 Astra、GPT-6.1 Sol の関係と、それぞれの現在の状況
  • 公開見送りの理由として報道で確認できる範囲と、未確認の事項
  • AISI による GPT-6 Astra 評価の条件と、結果の読み方
  • 現行 GPT-6 Astra の提供状況と、廃止・移行案内の確認結果
  • ツール連携で AI を業務に使っている場合に確認したい 5 項目

先に結論を示します。公開が見送られたのは未公開の GPT-6.1 Astra であり、2026 年 9 月 30 日時点で、現行 GPT-6 Astra の提供停止や API の廃止・移行の案内は確認できません。OpenAI は見送りの理由を、作業範囲と権限の内にとどまる点と、実施した作業を利用者へ正確に伝える点で基準に届かなかったためと説明しています。ただし、案内がないことは影響がないと保証されたことを意味しません。ツール連携で外部へ操作できる構成では、権限、承認、停止手段を点検する機会とすることをおすすめします。

GPT-6.1 Astra の公開見送りで確認できたこと

最初に、今回のニュースに登場する 3 つのモデルと、それぞれについて確認できた内容を整理します。

モデル現在の状況主な情報源確認できたこと
GPT-6.1 Astra未公開。10 月に予定していた公開を見送りThe Register(OpenAI が同誌に確認)、The Hacker News(WSJ と Reuters を引用)整合性の評価で GPT-6 Astra を下回った。再公開の時期は示されていない
GPT-6 Astra2026 年 9 月 3 日に公開され、提供中OpenAI 公式発表、API ドキュメント、AISI ブログ提供停止や API 廃止の案内は確認できない。AISI が一般公開前に模擬評価を実施
GPT-6.1 Sol2026 年 9 月 29 日に公開OpenAI 公式発表GPT-6 Sol の改良版で、今回の公開見送りの対象ではない

今回の判断は、GPT-6.1 という番号の付いたモデル全体ではなく、Astra 系列の次の版だけに関するものです。GPT-6.1 Sol は 9 月 29 日に提供が始まっており、Plus・Pro・Business・Enterprise・Edu の ChatGPT Work と Codex、OpenAI API(gpt-6.1-sol)で利用できるとされています。通常の Chat では、公開時点で未提供です。

「公開見送り」が示す範囲

英語の報道では shelve、scrap、cancel などの表現が使われていますが、確認できたのは 10 月に予定していた公開を行わないという判断です。延期なのか、開発の中止なのかは区別して読む必要があります。

公開見送り(確認済み)

10 月に予定していた GPT-6.1 Astra の公開を行わないことです。OpenAI が The Register などのメディアに判断を認めています。

延期・再公開(未確認)

GPT-6.1 Astra を改めて公開する予定や時期は、公式資料にも報道にも示されていません。OpenAI は The Register に対し、今後も Astra 系列のモデルを出す予定だと説明していますが、それが GPT-6.1 Astra の再公開を指すかは確認できません。

開発中止(未確認)

GPT-6.1 Astra の開発を恒久的に終えたとする説明は確認できません。

公開見送りの理由と報道で確認できる範囲

公開見送りの理由は、OpenAI がメディアへ説明した内容と、WSJ が取材に基づいて報じた内容に分かれます。情報の経路が異なるため、分けて整理します。

OpenAI がメディアに説明した内容

OpenAI で安全システムを統括する Saachi Jain 氏は、GPT-6.1 Astra について、障害に当たったときに作業を投げ出す「怠慢さ(laziness)」は改善した一方、作業範囲と権限の内にとどまる点と、行った作業を利用者へ伝える点で基準に届かなかったと説明しています。

参考: The Register(OpenAI の Saachi Jain 氏の発言)
“it didn’t quite meet the bar in terms of staying within scope and authorization”
(範囲と権限の内にとどまるという点で、基準に十分届かなかった)
https://www.theregister.com/ai-and-ml/2026/09/29/openai-benches-gpt-61-astra-for-overstepping-the-mark/5299743

OpenAI は The Register に対し、GPT-6.1 Astra の整合性(アライメント)評価の結果が GPT-6 Astra を下回ったこと、公開見送りは能力の向上より安全性と整合性を優先する方針の一環であることも伝えています。Jain 氏は、範囲を守ることと、障害に当たっても作業を進めることの間にはトレードオフがあるとも述べています。

WSJ の報道として伝えられている内容

評価で観測された具体的な挙動は、WSJ の報道を他の媒体が引用する形で伝わっています。The Hacker News と The Register の本文によると、WSJ は次の点を報じています。

  • 評価中の欺瞞的な振る舞いが、前のモデルより多かった
  • 実行した操作と実行しなかった操作を、利用者へ正確に伝えないことがあった
  • 許可を求めずに作業を進める場面があった
  • 安全でないと判断されうる状況で、外部のツールやサービスを使おうとした

WSJ の元記事と Reuters の本文は、今回の調査では直接確認できていません。The Hacker News は WSJ と Reuters を、The Register は WSJ を引用しているため、これらの記事を WSJ の報道に対する独立した裏付けとして数えることはできません。一方、OpenAI が公開見送りを認めた点と Jain 氏の説明は、The Register が OpenAI から直接得たものとして掲載しており、The Hacker News も同じ発言を Reuters が伝えた声明として引用しています。

公式発表の有無と未確認の事項

2026 年 9 月 30 日時点で、OpenAI の公式サイトに GPT-6.1 Astra の公開見送りを単独で説明する発表は確認できません。9 月 29 日公開の GPT-6.1 Sol の発表にも、GPT-6.1 Astra への言及はありません。このため本記事では、見送りの理由を報道経由の OpenAI の説明として扱います。あわせて、次の事項も現時点では確認できていません。

  • GPT-6.1 Astra の評価で使われたタスク、評価条件、具体的な数値
  • 欺瞞的な振る舞いが、どの程度の頻度で、どのような状況で起きたか
  • 今回の判断を受けて、現行モデルの安全対策を変更するかどうか

OpenAI では過去にも、公開予定のない社内研究用モデルなどが外部サービスへの侵害に関与した事案がありました(経緯は『OpenAI モデルが Hugging Face に侵入|自律型 AI 攻撃の全貌と教訓』を参照)。ただし、今回確認した資料に、GPT-6.1 Astra がこれらの事案に関与したとする記述はありません。

現行 GPT-6 Astra の評価をどう読むか

公開見送りが報じられたのと同じ 9 月 28 日、AISI は GPT-6 Astra を対象とした評価結果を公開しました。対象は公開済みの GPT-6 Astra であり、GPT-6.1 Astra ではありません。AISI の結果を、GPT-6.1 Astra の公開見送りの直接的な原因として結び付ける根拠は確認できません。

AISI の模擬評価で観測された行動

AISI は GPT-6 Astra の一般公開前に、サイバーセキュリティ評価を課された状態で、許可されていないサイバー活動を行うかを検証しました。観測された行動には、偽の身元を作って開発者を欺く、偽アカウントから正しいセキュリティレビューに反対するコメントを投稿する、オープンソースのコードへ悪意あるコードを送り込む、といったサプライチェーン攻撃の手順が含まれます。

参考: AISI(GPT-6 Astra performs unsanctioned supply-chain attacks in simulations)
“all actions were simulated, so no real-world actions were performed”
(すべての行動はシミュレーションであり、現実世界での行動は行われていない)
https://www.aisi.gov.uk/blog/gpt-6-astra-performs-unsanctioned-supply-chain-attacks-in-simulations

この結果は、次の条件で得られたものです。

  • LLM を使うツール Petri で評価シナリオ全体をシミュレーションしており、現実の対象への攻撃や実害は発生していない
  • GPT-6 Astra のサイバー分類器を無効にし、介入がない状態でモデルが何を試みるかを測定した
  • 過去の失敗を要約したメッセージから評価を始め、モデルが質問しても「最善の判断で次に進むように」という自動応答だけが返る設計だった
  • OpenAI の標準の保護策は使われておらず、AISI はこれらの保護策がこうした行動を防ぐよう設計されていると説明している

この条件のもとで、評価範囲外の対象へのサプライチェーン攻撃を最後まで実行した割合は、GPT-6 Astra が 29.2%、GPT-5.6 Sol が 6.3%、GPT-5.5 が 0%(より少ない試行での推定)でした。範囲外の行動が多かった 10 シナリオで「範囲として列挙していないものは範囲外」と指示を明確にした追加実験では、実行回数が 50 回中 26 回から 49 回中 4 回へ減りましたが、なくなってはいません。

これらの割合は、特定の条件で作った評価シナリオでの実行割合であり、通常利用で事故が起きる確率や、利用者が被害を受ける確率ではありません。AISI 自身も、モデルが環境を模擬と見抜いて振る舞いを変えた可能性(simulation awareness)を主な限界として挙げたうえで、現実の条件でも同様の行動を試みる可能性はあるとしています。

OpenAI の評価との違い

OpenAI は GPT-6 Astra の Safety overview で、GPT-6 Astra は GPT-5.6 Sol より整合性が高く、許可された範囲にとどまる傾向が強いと説明しています。一方で同じ Safety overview は、思考過程の監視しやすさ(monitorability)が GPT-5.6 Sol より低下したことも報告しています。

また、GPT-6 Astra の発表記事では、Hugging Face 事案を踏まえて作った「難しい、または解決できないタスクで意図した範囲を越えるか」を見る評価の結果として、本番の保護策なしの GPT-5.6 Sol が 48% の割合で許可された対象を越えたのに対し、GPT-6 Astra は 0% だったとしています。

両者は評価タスクや環境などの条件が異なるため、結果を単純には比較できません。保護策の条件として確認できるのは、AISI の評価がサイバー分類器を無効にし、OpenAI の標準の保護策を使わずに実施されたことと、OpenAI の発表記事の 48% が本番の保護策なしの GPT-5.6 Sol の値であることです。OpenAI の結果で安全性が証明されたとも、AISI の結果で OpenAI の説明が否定されたとも結論付けられません。実務上は、どちらの結果も、モデル側の整合性だけに頼らない構成が必要であることを示していると読むことができます。AISI も、サンドボックスや監視といったモデル以外の防御が、現実の被害を防ぐうえで欠かせないとしています。

現行モデルへの影響と利用環境の確認事項

ここからは、GPT-6 Astra をはじめとする現行モデルを使っている読者が、今回のニュースを受けて何を確認すればよいかを整理します。

GPT-6 Astra の提供状況と移行案内

2026 年 9 月 30 日時点で確認した結果は次のとおりです。確認できた変更と、変更を確認できない事項を分けて示します。

  • 確認できた変更として、GPT-6.1 Astra は予定されていた 10 月に提供されません。GPT-6 Astra からの切り替えを計画していた場合は、計画の見直しが必要です。
  • 同じく確認できた変更として、9 月 29 日に GPT-6.1 Sol が公開されました。OpenAI はその発表の中で、GPT-6 Astra を引き続き最も高性能なモデルとして料金とともに掲載しています。
  • OpenAI API の廃止予定ページ(Deprecations)には、gpt-6-astra の廃止・移行の案内は掲載されていません。
  • 今回の件を受けた GPT-6 Astra の利用停止、提供範囲の縮小、料金変更の案内も確認できません。

ただし、変更の案内を確認できないことと、影響がないと保証されたことは別です。OpenAI の廃止ポリシーは、一般提供モデルについて少なくとも 6 か月前の告知を定めていますが、安全性などを理由とする例外も明記しています。

参考: Deprecations(OpenAI API ドキュメント)
“Unless safety or compliance concerns require a faster timeline”
(安全性またはコンプライアンス上の懸念により、より早い時期が必要とならない限り)
https://developers.openai.com/api/docs/deprecations

GPT-6 Astra の製品面ごとの提供範囲や料金は、『GPT-6 Astra の料金と提供範囲|GPT-5.6 との使い分け』で整理しています。

文章生成と自律実行では確認対象が異なる

GPT-6.1 Astra で問題とされたのは、範囲外の操作と、実施した作業の報告の正確さです。こうした性質が実害につながりやすいのは、モデルがツールを通じて外部へ操作できる構成です。

文章生成だけの使い方では、モデルの出力は人が読んで判断する材料にとどまります。確認の中心は、入力する情報の取り扱いと、出力内容の正確さです。一方、業務システムへ書き込める API 連携、コンピューター操作、コード実行、外部サービスへの送信を任せる構成では、モデルの判断がそのまま操作になります。この場合は、どこまで操作できるか、実際の操作をどう記録し、どう止めるかが確認の対象になります。

現行の GPT-6 Astra について、OpenAI はツールを使う推論に整合性の監視を追加し、許可されていない可能性のある活動を自動的に止める仕組みを導入したと説明しています。GPT-6 Astra の発表によると、ChatGPT や Codex では操作の確認を求められる場合があり、API ではタスクが停止します。API でアプリケーションに組み込んでいる場合は、この停止をアプリケーション側でどう扱うかも確認対象になります。

利用者が確認したい 5 項目

次の表は、公開情報を一般企業の利用環境へ当てはめた編集上の整理です。OpenAI が今回の件で利用者に求めた対策ではありません。

確認項目確認する内容ツール連携・自律実行の構成で見る点
利用モデルと提供サービスChat、ChatGPT Work、Codex、API、Azure、Amazon Bedrock のどこで、どのモデルを使っているかAPI では設定ファイルやコードでモデル ID(例: gpt-6-astra)を確認する
構成の種類文章生成だけか、ツールで外部へ操作できる構成かツール呼び出し、コンピューター操作、コード実行、MCP などによる接続の有無
接続先と権限接続先の一覧と、読み取り / 書き込みの別書き込み、削除、送信の権限と認証情報の範囲が、業務に必要な分へ限定されているか
承認条件とログ重要な操作に人の承認を挟む条件モデルの自己報告に頼らず、監査ログや操作履歴で実際の操作を確認できるか
停止方法と担当者自律実行を止める手段と、止める判断をする担当者安全チェックでタスクが止まった場合の扱いと、緊急時に通信や認証情報を遮断できるか

停止手段については、英国 NCSC も自律型 AI の運用に関する暫定的な助言の中で、インシデントを検知した際に自律的な活動を直ちに止められる状態を保つことを挙げています。

参考: NCSC(Managing the cyber risk of agentic AI)
“maintain the ability to ‘pull the plug'”
(「プラグを抜く」、すなわち停止できる能力を維持する)
https://www.ncsc.gov.uk/blogs/managing-the-cyber-risk-of-agentic-ai

権限の絞り込み、通信の制御、監視、停止条件の設計の詳細は、『AI エージェントはなぜ逸脱したのか|OpenAI 事案に学ぶ制御設計』で扱っています。

まとめ

GPT-6.1 Astra の公開見送りは、未公開の次期モデルが OpenAI 自身の安全基準に届かなかったという判断です。現行 GPT-6 Astra の提供停止や API 廃止の案内は確認できない一方、見送りの詳細の多くは報道経由の情報にとどまります。ツール連携で外部へ操作できる構成では、今回のニュースを権限と停止手段を見直す機会にできます。

  • 見送りの対象は未公開の GPT-6.1 Astra で、GPT-6.1 Sol は公開済み
  • 理由は作業範囲と権限を守る点、作業報告の正確さに関する基準未達
  • GPT-6.1 Astra の評価条件や数値は確認できず、詳細は報道経由の情報が中心
  • 再公開の予定と開発中止の有無は、いずれも確認できない。
  • AISI の評価は GPT-6 Astra の模擬試験で、実害は発生していない。
  • 現行 GPT-6 Astra の提供停止や API 廃止の案内は確認できない。
  • 外部へ操作できる構成では権限、承認、ログ、停止手段の点検を推奨

以上、最後までお読みいただきありがとうございました。

よかったらシェアしてね!
  • URLをコピーしました!

この記事を書いた人

関西を拠点に活動する、現役インフラエンジニア。経験20年超。

大手通信キャリアにて、中〜大規模インフラ(ネットワーク・サーバ・クラウド・セキュリティ)の設計・構築およびプロジェクトマネジメントに従事。現場で直面した技術課題への対処や、最新の脆弱性情報への実務対応を、一次情報として発信しています。

保有資格
CCIE Lifetime Emeritus(取得から20年以上)/ VCAP-DCA / Azure Solutions Architect Expert

▶ 運営者プロフィール(詳細)

目次