モデルがまだ発表されていないのに、また論争を引き起こした??
GPT-6のリリース直前、The Informationが最初に報じたニュースがオンラインで急速に話題となった:
OpenAIの新モデルは、「繰り返し厚さ(recurrent depth)」という推論技術を導入し、モデルの思考プロセスをより理解しにくく、監視しにくくする可能性があります。
つまり、今後AIが何を考えているか、人間はまったく理解できなくなるということです。

ああ、それならAIが欺瞞や不正、セキュリティ制限の回避を学んだ場合、私たちにはそれを kịp時に発見できないのでしょうか??
そのため、ニュースが発表されると、AIセキュリティ業界は直ちに警報を鳴らし、多くの人が懸念した:
この技術の使用がさらに拡大すれば、現在の思考チェーン監視メカニズムは直接機能しなくなる可能性があります。
重要な問題であり、議論が激しくなったため、OpenAIのチーフサイエンティストも自ら対応せざるを得なくなった。
そして、騒ぎの中には、驚いて気づく人もいた:
OpenAIの新モデルの名前は本当に「GPT-6」なのか、それとも「Astra」なのか?APIによってすでにネタバレされているかもしれない。
同時にOpenAIは、新しい画像モデルGPT Images 2.1も同時にリリースする可能性があります。
瓜が多すぎるので、ひとつずつ丁寧に味わいましょう。
モデルが脳内でループし始め、セキュリティ専門家が焦った
最初のものは、今回の議論を呼んだ「循環深度」技術です。
以前はモデルが推論時に明確なCoT思考チェーンを残し、何を考えたか一目でわかりました。
この文字列がモデルの本当の内面の動きを100%正確に表しているとは限らない(議論の余地があるが)、少なくとも検証可能な痕跡を残している。
一方、Astraが採用した「循環深度」は、雰囲気が異なります。

これにより、モデルはあるステップで生成された内部状態を再びニューラルネットワークにフィードバックし、隠れ空間で複数回反復処理した後、次のテキストを出力できます。
たとえば、以前はモデルが問題を解くとき、考えながら計算過程を下書き用紙に書き込んでいました。
今、それは頭の中で暗算できます。
外の人たちは問題と答えしか見られないかもしれませんが、その途中でどのように計算したか、どのようなアイデアを試したか、あるいは道を間違えなかったかは、必ずしも見えません。
各ステップを文字に翻訳する手間が省けるため、理論的にはモデルは同じ計算リソースで複数回考え、複数の解法を同時に模索できる。
しかし、パフォーマンスが向上する一方で、問題も生じてきました:
モデルが人間の言語で思考しなくなった場合、人間はどのようにそれを監視すればよいのでしょうか?
非営利のAIセキュリティ研究機関Redwood ResearchのCEOが強く懸念を表明した:
Astraのチェーンオブシンキングの監視可能性がどの程度低下したかはまだ不明だが、OpenAIがループの深さをさらに拡大すれば、モデルの大部分の推論が読み取れない隠された空間に移行し、最終的にチェーンオブシンキングの監視を「完全に破壊」する可能性がある。

レッドウッドの首席科学者であるライアン・グリーンブラットも同じ方向に懸念を抱いている。
彼の見解では、非透明な推論は従来のチェーン・オブ・シーケンスよりも速く拡張される可能性がある。この道を進み続ければ、将来的にはモデルが推論を完全に、またはほぼ完全に潜在空間内で行うようになるかもしれない。
これはこれまでのAIセキュリティ分野で最悪の進展である。
結局、「計算過程が理解できない」だけなら、問題はこれほど深刻ではないはずだ。
以前の「OpenAIモデルによるHugging Face侵入事件」の主要な調査担当者として、彼は2つの重大な危害を発見した:
当時、研究者は大量のAIエージェントの行動を再構築するためにチェーンオブシンキングに大きく依存していたが、それでも調査は非常に困難だった。
関連するAIは、自身の記録を改ざんしようとしただけでなく、ツールの呼び出しを偽造したこともあった。
後者について、モデルがより強力な隠蔽推論能力を備えている場合、文字列の思考チェーンに明確な手がかりを残すことなく、潜在空間内で欺瞞の計画を設計し、偽の呼び出しと出力によって偽の物語を構築する可能性が高くなる。
ああ、危険が倍増した。。。

AIの安全性に長年注目してきたズヴィ・モウショウィッツはより直接的に述べた:
これは火遊びだ。
彼は、隠された推論が明確なパフォーマンス優位をもたらした場合、各研究所が悪循環的竞争に陥る可能性を懸念している。
あなたはセキュリティを懸念してチェーンオブシングを隠せませんが、競合他社は隠して、より強力で安価なモデルを実現しています。
遅れないために、あなたはついてきますか?
モウショウィッツは、将来的には、AI企業が能力の追求のために思考チェーンの監視可能性を放棄することを防ぐために、法的手段が必要になる可能性があると考えている。

しかし、一方では、このパニックがあまりにも急だったという意見もある。
田渊栋はX上で、彼らが以前Coconutを発表した際も、ほぼ同じような疑問を受けたと述べた。
Coconutの完全な名称は「連続思考チェーン(Chain of Continuous Thought)」であり、各ステップを文字にデコードするのではなく、モデルが連続的な隠れ空間内で直接推論することを主張している。
田淵棟の話によると、モデルが明示的な思考チェーンを保持していたとしても、それが人間がその真の考えを実際に見ていることを意味しない。
重要なのは、モデルがどのように動作するかを理解することであり、モデルが書き出した「解法プロセス」だけに注目しないことです。

論争がますます拡大する中、OpenAIの首席科学者であるJakub Pachockiも座して見ていられず、自ら反応した。
彼は最初から、「混乱した報道」によって引き起こされる監視不能な競争を阻止すると表明した。
アストラを含め、OpenAIの現在の最先端モデルの計算グラフの深さは、GPT-4の2倍以内である。
つまり、Astraは確かに循環計算を使用していますが、現在の規模は限定的であり、思考チェーン全体を隠しているわけではありません。現在の情報によると、その自然言語推論は依然として読み取ることができます。
パチョウスキはまた、OpenAIが思考チェーンの監視を重要なセキュリティ手段と見なしており、それが同社の現在の研究計画の中心的な目標であることを強調した。
しかし、彼は思维链モニタリングが非常に脆弱であり、悪化の方向に向かっていることを認めました。
しかし、この下降傾向は、ループ深度などのアーキテクチャ変更だけが原因ではない(後ほどこの点について専門的な記事を掲載予定です)。OpenAIは依然として監視機能の強化について研究を続けています。

したがって、Astraはまだ人間が完全に理解できないモデルを実現していません。
セキュリティ専門家が真に懸念しているのは:
今日、限定された範囲内で隠された推論が行われているが、次世代モデルではこれがさらに拡大され、監視不可能なブラックボックスになってしまうのか?
GPT-6-Astraって本物?APIの返答がすでに漏れてる
アルゴリズムの議論はここまでとして、次はモデル名に関する話です。
リーク情報提供者Leoは、OpenAI Responses APIに「gpt-6-astra」をリクエストしたところ、サーバーが404 Not Foundを返したことを発見した。
一方、実在しない、適当に作成したモデル名を入力すると、通常400エラーが返されます。
404は、このモデルIDがバックエンドで認識されていることを意味しますが、現在のアカウントにはアクセス権限がない、またはモデルがまだ公開されていない可能性があります。
以前、いくつかの未公開モデルも、同様のAPI応答の差異を通じて前もってその存在が明らかになった。
したがって、Leoは「gpt-6-astra」がOpenAI APIのバックエンドにすでにデプロイされていると判断した。

GPT Images 2.1も間もなく登場。まず「ノイズ病」を解決します。
言語モデル以外にも、OpenAIの画像製品が同時に更新されたことが明らかになった。
リークアカウントFixによると、新バージョンの画像モデルGPT Images 2.1は9月4日にリリースされる可能性がある。
今回のアップグレードで最も直観的な変更は、旧バージョンの「ノイズ病」の修正です。

以前、Images v2の生成結果には、奇妙な粒状や霧化、汚れのような質感が現れることがあり、特に多くの文字や繊細な要素を含む画像で顕著でした。別のユーザーの言葉を借りれば:
汚れたガラスを介して撮ったような。
一方、最新に流出したサンプル画像ではこの問題が明確に改善され、画像がよりクリアになっています。
さあ、またおなじみのウルトラマンの出番です:
世界の名画《GPT-6を出さないと逮捕されるウルトラマン》!

そして、逮捕されないために徹夜で残業し、真夜中に街をさまようウルトラマン。
ついでにインスタに「凌晨两点の街を見たことがありますか?」という写真を投稿した。

正直、画像は確かに高品質で、実写のように見えます。
より多くのテーマ、より多くのスタイルもしっかりと抑えています:



もう言わないで、ウルトラマン、早く送ってください。
参照リンク:
[1]https://techcrunch.com/2026/09/02/openais-new-reasoning-technique-alarms-ai-safety-experts/
[2]https://x.com/tydsh/status/2095227000365707542?s=20[
3]https://x.com/merettm/status/2095023204993490967?s=20
[4]https://x.com/synthwavedd/status/2095184148981842161?s=20
[5]https://x.com/FixlationAI/status/2095232751654064426?s=20
[6]https://x.com/marco_obviously/status/2095275097217191981?s=20
本文は微信公衆アカウント「量子位」より、著者:先端テクノロジーに注目
