GPT-6 Astra発売、BrockmanのAGI宣言に専門家が即反論
- GPT-6 AstraのAGI宣言の実態を正確に把握したいエンジニア・研究者
- Claude Fable 5.1とどちらを使うべきか判断したいプロダクトマネージャー
- AI報道の誇大表現に疑問を持っているビジネスパーソン
「AGI時代へようこそ(Welcome to the AGI era)」
2026年9月3日、OpenAIのGPT-6 Astra発売を受けてGreg Brockmanが締めくくりに添えた一言だ(出典: Axios、2026年9月3日)。
発売3日後の9月6日、NVIDIAのジェンスン・ファンCEOもX(旧Twitter)に「AGI has arrived(AGIは到来した)」と投稿した。
一方、同じタイミングでInformation Age ACSは「OpenAI says ‘the AGI era’ is here. Experts disagree(専門家は反論)」という見出しを立てた(出典: Information Age ACS、2026年9月4日)。Tech Timesは「AGI Claim Fails OpenAI Own Bar(OpenAI自身の定義でも合格していない)」と報じた(出典: Tech Times、2026年9月4日)。
AGI宣言の実態はどこにあるのか。数字と定義の両面から検証する。
Brockmanは何と言ったのか、正確に
Brockmanの発言を正確に引用する。「AGIは到来した(AGI has arrived)」とは言っていない。
実際の言葉はこうだ。「私は、我々が今AGI時代に入ったと感じることは不合理ではないと個人的に思う(I personally believe it’s not unreasonable to feel that we are now in the AGI era)」。そして発表会の締めくくりに「AGI時代へようこそ」と付け加えた(出典: Axios)。
「個人的に思う」「不合理ではない」「感じる」という三重の留保が込められた発言だ。OpenAIとして正式にAGIを宣言したわけではない。Forbesも「OpenAI Launches GPT-6 Astra or Does It?(それとも違うのか?)」という懐疑的な見出しで報じた(出典: Forbes)。
それでもこの一言が世界に走った。翌日9月4日、X上では「AGI」がトレンドに入った。その2日後、ジェンスン・ファンCEOも「AGIは到来した」と同調した。メディアの見出しは「Brockmanが言った」という形に要約され、留保は消えた。
AGI宣言の第一の問題は言葉それ自体の曖昧さではなく、伝言ゲームによる精度の劣化にある。
ARC-AGI-3スコア「99.9%」の内実
GPT-6 Astraの最大の売り文句は、ARC-AGI-3ベンチマークで99.9%を達成したことだ。人間テスターの平均は48%だという(出典: VentureBeat)。
ところが、ARC-AGIを運営する独立機関が公表したスコアはOpenAIの主張より37ポイント低かった(出典: Tech Times)。この食い違いについてOpenAIは具体的な説明を出していない。
AI批評家のGary Marcusはこう指摘する。「ARC-AGIは特定のパズル形式に対する能力を測るものだ。それを一般知性の証拠と呼ぶのは飛躍がある。AGIの普遍的に受け入れられた定義は存在せず、現在のどのシステムも狭い能力から一般知性へ移行した明確な証拠がない」(出典: Information Age ACS)。
OpenAI自身の定義で測ると
OpenAIの会社憲章はAGIを「ほとんどの経済的に価値ある仕事で人間を凌駕する自律システム」と定義している。Tech Timesが指摘するのはこの点だ。同じ記事のタイトル「AGI Claim Fails OpenAI Own Bar」が示す通り、この定義を適用するとAstraはまだ合格していない可能性がある。
理由は3つある。
第1に「ほとんどの経済的に価値ある仕事」に物理作業と社会的作業が含まれないこと。工場作業員、介護士、教師が行う業務はARC-AGI-3に含まれていない。
第2に、自律性の問題だ。OpenAIの主席研究員Jakub Pachockiは、AstraのCriticalサイバーセキュリティ能力を制御するための監視システムについて「脆弱(fragile)であり、悪化傾向にある」と認めた(出典: Tech Times)。安全性を担保できない自律性は、憲章が求める「自律システム」の条件を満たさないと専門家は見る。
第3に「経済的に価値ある」の定義自体が変動する。何が経済的に価値あるかは労働市場、規制、社会制度によって変わる。固定した基準でAGI達成を宣言できる性質の問題ではない。
GPT-6 AstraとClaude Fable 5.1の実力差
では実用面での差はどこにあるか。独立評価機関Artificial Analysisの知性インデックス(2026年9月4日)では、Fable 5.1が66点、Astraが61点でFable 5.1がリードしている(出典: DataCamp)。
コーディングエージェントインデックスでもFable 5.1が70対67で上回る。Astraが優れるのはコンピュータ操作(Computer Use)、ターミナル系タスク(Terminal-Bench 4.0: 57.7対52.6)、数学の研究レベル問題だ。
コスト面でも差がある。両モデルとも入力$10/M、出力$50/Mで同一だが、キャッシュ入力トークンはFable 5.1が$0.25/Mに対しAstraは$1.00/M。大量のエージェント処理では4倍のコスト差が生まれる(出典: explainx.ai)。
「AGI宣言」が意味する本当のもの
Hacker News(GPT-6 Astra発表スレッド、2026年9月3日)では懐疑的な声が上位を占めた。「また定義の話が始まる(Here we go again with the definitions)」という反応や、「99.9%と言いながら独立機関のスコアが37ポイント低い。それがすべてを物語っている」といった具体的な数字への指摘が多数ついた。
AGI宣言には3つの実用的な読み方がある。
投資家向け: Anthropic IPO(10月予定)を前に、OpenAIが「AGI到達」という象徴的な旗を立てた。シリコンバレーでの評価競争において、ラベリングは資金調達に直結する。
規制当局向け: AGI到達を宣言することでOpenAIが「フロンティアAI」として各国規制の主要対象になるリスクもある。英国のAISI、EUのAI Officeが即座にコメントを求めた。
エンジニア向け: 実用上の意味はシンプルだ。「どのタスクでどちらのモデルが優れるか」は用途ごとに異なる。AGIというラベルは選択の助けにならない。Ramp AI Indexの8月データでも、Fable 5.1の企業採用はAnthropicトークンの6%にとどまり、プロダクションへの転換はまだ進行中だ(出典: Ramp AI Index August 2026)。
ARC-AGI-3の99.9%はOpenAIの自己申告値。独立機関の数字は異なる。新モデルの発表直後のベンチマークは、独立評価が出るまで留保して読む習慣が重要だ。
まとめ
GPT-6 Astraは強力なモデルだ。コンピュータ操作とサイバーセキュリティ分野では現時点での最高水準にある。しかしBrockmanの「AGI時代へようこそ」は、個人的な感慨を三重の留保付きで表現したものであり、OpenAIの公式宣言ではない。
専門家の反論は「AGIではない」ではなく、「その定義ではAstraは合格していない」という点に集中している。AGIの定義自体が曖昧なままだから、宣言は永遠に出せる。あるいは永遠に出せない。
日本のユーザーにとって今必要なのは、「AGI」というラベルへの反応ではなく、自社の具体的なタスクで両モデルを評価することだ。キャッシュコストが重要なら現時点でFable 5.1が有利。コンピュータ操作の自動化を優先するならAstraの検討に値する。輸出規制リスクへの備えは両モデル共通の課題として残る。
Claude Fable 5.1 完全ガイド
Fable 5.1の機能・価格・Fable 5からの移行を整理。GPT-6 Astraとの対比でどちらを選ぶか判断する。
関連記事
- GPT-6 Astra 完全ガイド: 機能・料金・Claude比較 (2026年9月)
- GPT-6 Astraのサンドバッギングとコモニタリング問題
- 米中AI協議と日本への影響: 2026年9月の最新状況
免責事項
本記事は公開情報および各種報道をもとに作成しています。AI性能の評価は使用ケースや測定方法によって異なります。投資判断や重要な業務上の意思決定は、一次ソースを必ず確認の上で行ってください。記載のベンチマーク数値は各情報源の発表時点のものです。