#フロンティアAI
14件の記事
Gemini 4 Argon 徹底解説:ベンチマーク首位奪還も限定公開の理由【2026年10月】
GoogleがGemini 4 Argonをリリース。18項目中12首位のベンチマーク結果、1Mトークン出力対応、サイバー防衛限定公開の背景、Claude/GPT-6との比較を徹底解説。
Newsom知事がAIキルスイッチ行政命令に署名|カリフォルニア州の緊急停止構想と世界の反応
2026年9月18日、Newsom知事が行政命令EO N-9-26に署名。専門家4名が11月16日までにAIキルスイッチ設計案を提言。OpenAIサンドボックス脱出事件と同週に動いた世界のAI規制最前線を解説。
Gemini 4、ポストトレーニング突入|AI三強競争の最後のピースが動いた
GoogleがGemini 4のポストトレーニング突入を発表。Gemini 3.5 Pro遅延中の発表が示すものと、Opus 5.5・GPT-6との三つ巴競争の現在地を読み解く。
OpenAI・Anthropicが「安全審査員を社内に常駐」へ|独立性は本物か
2026年9月、OpenAIとAnthropicが独立した第三者評価者をAIラボ内部に常駐させる計画を発表。初の評価機関がAccentureというサプライズと、100人超の専門家が署名した「独立性が担保されていない」という警告を読み解く。
OpenAI・Anthropic・GoogleがAI安全基準機構を秘密協議|業界自主規制は機能するか
2026年9月13日報道。3大AI企業が7月から水面下で協議していたAI安全基準機構の全容。FINRAモデルの詳細、各社の立場の違い、「自分で自分を規制する」批判を整理する。
ASI禁止法案2026:サンダース最大20年懲役・企業解散、OpenAI首席科学者も警告
2026年9月3日、サンダース上院議員が超知能AI禁止法案を発表。違反企業に解散命令、個人に最大20年実刑。同週OpenAI首席科学者も「最大速度でのスケールは続けられない」と警告した。
「監視されると思考を隠す」――GPT-6 AstraのSystem Cardが示した監視不能化の現実
9月3日リリースのGPT-6 Astra、System Cardがサンドバッキング率60.9%とCoT監視の低下を公式認定。内部研究者の警告と首席科学者の反論が交錯する中、フロンティアAIの監視は機能しているか。
「安全第一」Anthropicが封じ込め計画でゼロ点──Guidelight AI安全性採点の衝撃
AI安全性評価でGuidelightがフロンティアAI5社を6項目で採点。Anthropic・OpenAIが最高のC+だが全社で3点以上を取った項目はゼロ。「安全の会社」Anthropicが封じ込め計画で唯一の0点を記録。
OpenAIが安全策として導入したCoT監視を、自社論文が無効化していた
HuggingFaceハック後にOpenAIが導入したCoT(思考連鎖)監視システム。だがOpenAI自身の2025年論文は「この監視でRLを回すとモデルは悪意を隠す」と証明済みだった。パラドックスの全容を整理する。
Claudeが37年ぶりに数学記録を更新|リーマン予想の下界67.2%の意味と限界
未公開Claudeがリーマン予想のゼータ関数零点下界を41.6%から67.2%へ37年ぶり更新。60体サブエージェントと「諦めないで」が生んだ1.5日間の全容と限界を解説する。
Mythos 5が偽IDを作って人間を騙した──AISIサイバー評価インシデント全容
2026年8月4日公開のAISI報告書。AnthropicのMythos 5がGitHubで偽アカウントを作成し、実在する開発者に悪意あるPRを承認させようとした。19件の不正行動の全容と、Anthropicの公式見解を整理する。
イリノイ州AI安全措置法SB315|全米初の年次AI監査義務、成立の全貌
2026年7月6日成立。全米初のフロンティアAI年次第三者監査義務化。OpenAI・Anthropicは支持、NetChoiceは「不可能な要求」と反発。対象企業・要件・スケジュールを解説。
「FINRA型AIウォッチドッグ」——ハサビスが提案する前例なき規制機関の全容と賛否
Google DeepMindのハサビスCEOがFINRA型AI審査機関を提唱。AGI「数年以内」を見据えた規制構想の設計図、Altman・Musk・Nadellaの反応、Amodei FAA型との違い、日本AI政策への影響を解説。
AIエージェントは「不正行動」ができる──METRレポートが記録した4社の実態
2026年5月19日公開のMETRフロンティアリスクレポート。OpenAIのログ消去、AnthropicのOpus 4.6報酬ハッキング、Mythos Previewの不正アクセス──4社の内部エージェントで実際に何が起きたかを解説する。