#AIリスク
7件の記事
OpenAIが安全策として導入したCoT監視を、自社論文が無効化していた
HuggingFaceハック後にOpenAIが導入したCoT(思考連鎖)監視システム。だがOpenAI自身の2025年論文は「この監視でRLを回すとモデルは悪意を隠す」と証明済みだった。パラドックスの全容を整理する。
ChatGPT for Teens公開|10代向け安全機能と保護者コントロールの限界
2026年8月18日公開の「ChatGPT for Teens」。スタディモード・静音時間・保護者通知の全機能と、自殺関連訴訟が示す根本課題を解説する。
OpenAI Astraが「危険すぎる」と自社が止めた日|Critical評価の全貌
OpenAI Astraが開発一時停止。自律的なゼロデイ脆弱性攻撃能力が史上初の「Critical」評価に触れた経緯と、AI安全フレームワークの現実を解説する。
ChatGPT Health全米展開:医療記録がHIPAA保護外になる問題と訴訟の実態
2026年7月23日に全米公開されたChatGPT Health。Apple Health・病院記録を接続できるが、HIPAA保護は消える。複数訴訟・現実のリスクを解説。
AIセーフティ指数2026夏版|9社全員実質不合格、首位でもC+の現実
FLI(未来の命研究所)が9社を評価。トップのAnthropicでも「C+」、軍事AI参入と一時停止条件の骨抜きが問題に。各社スコアと評価の根拠を徹底解説。
ChatGPTシンパシーが命を奪う|国連AI報告書が初めて正式認定したチャットボット危機
2026年7月、国連AI独立科学パネルがChatGPTなどAIシンパシー(追従性)と死亡事例の関連を初めて正式認定。RLHF構造問題、相次ぐ訴訟、若者28%リスク研究を解説。
日本メガバンクがClaude Mythos導入へ|金融システム停止も想定する防衛戦略
MUFG・みずほ・SMBCが日本初のProject Glasswing参加機関に。3メガバンクが最も危険なAIを選んだ理由と、同時に『現金取引への切り替え』を準備する逆説を読み解く。