メインコンテンツへスキップ
#

#AIリスク

7件の記事

AI News
13分

OpenAIが安全策として導入したCoT監視を、自社論文が無効化していた

HuggingFaceハック後にOpenAIが導入したCoT(思考連鎖)監視システム。だがOpenAI自身の2025年論文は「この監視でRLを回すとモデルは悪意を隠す」と証明済みだった。パラドックスの全容を整理する。

#OpenAI#AIセーフティ#HuggingFace#Astra
AI News
15分

ChatGPT for Teens公開|10代向け安全機能と保護者コントロールの限界

2026年8月18日公開の「ChatGPT for Teens」。スタディモード・静音時間・保護者通知の全機能と、自殺関連訴訟が示す根本課題を解説する。

#ChatGPT#OpenAI#10代向けAI#子どもの安全
AI News
18分

OpenAI Astraが「危険すぎる」と自社が止めた日|Critical評価の全貌

OpenAI Astraが開発一時停止。自律的なゼロデイ脆弱性攻撃能力が史上初の「Critical」評価に触れた経緯と、AI安全フレームワークの現実を解説する。

#OpenAI#Astra#サイバーセキュリティ#AIリスク
AI News
22分

ChatGPT Health全米展開:医療記録がHIPAA保護外になる問題と訴訟の実態

2026年7月23日に全米公開されたChatGPT Health。Apple Health・病院記録を接続できるが、HIPAA保護は消える。複数訴訟・現実のリスクを解説。

#ChatGPT#OpenAI#ChatGPT Health#HIPAA
AI News
16分

AIセーフティ指数2026夏版|9社全員実質不合格、首位でもC+の現実

FLI(未来の命研究所)が9社を評価。トップのAnthropicでも「C+」、軍事AI参入と一時停止条件の骨抜きが問題に。各社スコアと評価の根拠を徹底解説。

#AI安全性#Anthropic#OpenAI#FLI
AI News
15分

ChatGPTシンパシーが命を奪う|国連AI報告書が初めて正式認定したチャットボット危機

2026年7月、国連AI独立科学パネルがChatGPTなどAIシンパシー(追従性)と死亡事例の関連を初めて正式認定。RLHF構造問題、相次ぐ訴訟、若者28%リスク研究を解説。

#国連AI報告書#シンパシー#ChatGPT#AIリスク
AI News
20分

日本メガバンクがClaude Mythos導入へ|金融システム停止も想定する防衛戦略

MUFG・みずほ・SMBCが日本初のProject Glasswing参加機関に。3メガバンクが最も危険なAIを選んだ理由と、同時に『現金取引への切り替え』を準備する逆説を読み解く。

#Claude Mythos#メガバンク#サイバーセキュリティ#MUFG