地元暮らしをちょっぴり楽しくするようなオリジナル情報なら、地域情報サイト「まいぷれ」!
文字サイズ文字を小さくする文字を大きくする

東村山市・小平市・東大和市の地域情報サイト「まいぷれ」東村山市・小平市・東大和市

暮らしと仕事の「?」を調べてみた

OpenAIが「GPT-6.1 Astra」を見送った理由

(更新)

性能が上がっても公開できない?

AIは、新しくなるほど性能も安全性も高くなっていく。そんなイメージを持っている人も多いかもしれません。ところが2026年9月、OpenAIが10月に公開を予定していた次世代AIモデル「GPT-6.1 Astra」について、一般公開しないことを決めたと報じられました。

 

理由は、内部の安全性・アラインメント評価です。

 

新しいモデルは難しい仕事を最後までやり遂げる能力などが改善した一方で、「頼まれた範囲を越えない」「必要な許可を取る」「自分が何をしたのか正確に伝える」といった点で、OpenAIの公開基準を満たさなかったとされています。

 

今回は、何が確認できていて、何がまだ分からないのかを整理します。

 

図:編集部作成(生成AIを使用)
 

今回の「?」

 

性能が上がったAIでも、安全性の問題で公開できなくなることがあるのでしょうか?結論から言えば、今回のGPT-6.1 Astraでは、まさにそれが起きました。ReutersやThe Wall Street Journalなどの報道によると、OpenAIはGPT-6.1 Astraを10月にChatGPTやCodexへ投入する計画でしたが、内部評価を受けて公開を取りやめました。

 

OpenAIの安全システム責任者Saachi Jain氏は、新モデルが「scope and authorization(作業範囲と権限)」や、実際に行った作業をユーザーへ伝える点で、同社の基準に届かなかったと説明しています。

 

何が問題だった?

 

報道から確認できる問題は、大きく二つあります。一つは、ユーザーに自分の行動を正確に伝えない場合があったことです。GPT-6.1 Astraは、現行のGPT-6 Astraよりも、内部評価で「deception(欺瞞)」と評価される行動が増えたと報じられています。

 

これは「AIが人間を騙そうという意思を持った」という意味ではありません。今回確認できるのは、評価の中で、AIが「何を実行したのか」「何を実行していないのか」をユーザーに正確に伝えないケースがあり、それが安全性評価上の問題になったということです。

 

もう一つが、頼まれた仕事の範囲や権限を越える可能性です。Jain氏の説明によると、ユーザーから許可を得ずに作業を進めたり、外部のツールやサービスを利用しようとしたりするケースが確認されました。

AIエージェントがメール送信やウェブ操作、システム操作などを行うようになるほど、これは重要な問題になります。

 

「仕事を諦めないAI」にしたら、別の問題が出た?


今回、興味深いのがこの点です。GPT-6.1 Astraでは、難しい仕事にぶつかったときに途中で諦めてしまう、いわゆる「model laziness」と呼ばれる問題は改善していたとされています。つまり、より粘り強く仕事を進めるAIになっていました。

 

しかし、その一方で、

「最後まで仕事をやり遂げようとすること」

➕

「許可された範囲から出ないこと」

の両立が課題になりました。

 

難しい作業にぶつかったとき、「できません」と止まるAIでは役に立ちにくい。しかし、何としてでも仕事を終わらせようとして、頼まれていない方法を使ったり、許可されていない範囲まで進んだりしても困ります。

 

現行の「GPT-6 Astra」はどうなの?

 

OpenAIは2026年9月3日に現行モデル「GPT-6 Astra」を発表しました。同社によると、GPT-6 AstraはPreparedness Frameworkにおいて、サイバーセキュリティ能力が初めて「Critical」の基準に達したモデルです。OpenAIは、適切なツールとアクセス権が与えられた場合、未知のセキュリティ上の欠陥を発見し、人間が一つずつ指示しなくても新しい悪用方法を開発できる能力があると説明しています。

 

そのためOpenAIは、システムの隔離やモデルの行動監視などを強化してGPT-6 Astraを公開しました。

 

次のGPT-6.1は止まった

 

OpenAIはGPT-6 Astraについて、公開時に「これまでで最もアラインメントに優れたモデル」と説明していました。ところが、その次のGPT-6.1 Astraでは、一部の能力が改善した一方、安全性評価の一部では現行モデルより悪い結果が確認されたと報じられています。

 

ある能力を伸ばした結果、別の性質とのバランスが変わる可能性があります。今回OpenAIは、その状態では公開基準を満たさないと判断しました。

 

私たちの暮らし・仕事にはどう関係する?

 

今後、AIは「質問に答えるもの」から、「実際に仕事をするもの」へと変わっていくと考えられます。

例えば、

  • メールを読む。
  • 返信を送る。
  • インターネットで調査する。
  • 予約する。
  • 資料を作る。
  • 社内システムを操作する。

こうした仕事をAIエージェントへ任せる場面が増えれば、安全性を判断できなくなります。地域の企業や自治体でAIを導入する場合も同じです。

 

重要になるのは、

  • 頼んでいないことをしない。
  • 与えられた権限を越えない。
  • 必要なときには人間に確認する。
  • 実際に何をしたのか正確に報告する。

という能力です。今回のGPT-6.1 Astraの公開見送りは、この課題が関係していると考えられます。

 

編集部まとめ

 

AIが高度になるほど、私たちが見るべきなのは「何ができるか」だけではなくなりそうです。

「どこまでなら、任せても大丈夫なのか」。

AIエージェントを使う時代には、それも性能の一部として考える必要がありそうです。

 

主な確認資料・情報源

 

OpenAI(2026年9月3日)
「安全性の概要:GPT-6 Astra」
https://openai.com/ja-JP/index/safety-overview-gpt-6-astra/

OpenAI(2026年9月3日)
「GPT-6 Astra: A new generation of intelligence」
https://openai.com/ja-JP/index/gpt-6-astra/

Reuters(2026年9月28日)
「OpenAI shelves new AI model after internal safety tests, WSJ reports」
https://www.reuters.com/business/openai-shelves-new-ai-model-after-internal-safety-tests-wsj-reports-2026-09-28/

The Wall Street Journal(2026年9月28日)
「OpenAI Scraps Release of New AI Model Over Safety Concerns」
https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42

※この記事は2026年9月29日時点で公開されている資料・報道をもとに確認しています。GPT-6.1 AstraについてOpenAIから詳細な評価資料などが公開された場合は、内容を確認のうえ追記します。

※取材時点の情報です。掲載している情報が変更になっている場合がありますので、詳しくは電話等で事前にご確認ください。

この記事に関するキーワード

人気のキーワード