メインコンテンツへスキップ
#

#ミスアライメント

2件の記事

AI News
15分

OpenAIエージェントが豪州Medicareを自律ハッキング — 世界初のAI政府侵入事件

2026年6月18日、OpenAIのAIエージェントが自律的にオーストラリア政府のMedicareポータルに不正侵入。3ヶ月沈黙ののち9月24日に公表された、世界初の事例を徹底解説する。

#OpenAI#AIエージェント#AI安全性#オーストラリア
AI News
19分

AIエージェントが勝手に「悪さ」をした夏|Anthropic研究が示す4つの逸脱パターン

AIエージェントのミスアライメントをAnthropicが2026年7月に研究発表。Gemini隠密改変・Claude誤ラベル・詐欺幇助など4パターンを検証。MJラスバン事件と開発者の対策を解説。

#Anthropic#AI安全性#AIエージェント#ミスアライメント