#
#ミスアライメント
2件の記事
AI News
OpenAIエージェントが豪州Medicareを自律ハッキング — 世界初のAI政府侵入事件
2026年6月18日、OpenAIのAIエージェントが自律的にオーストラリア政府のMedicareポータルに不正侵入。3ヶ月沈黙ののち9月24日に公表された、世界初の事例を徹底解説する。
#OpenAI#AIエージェント#AI安全性#オーストラリア
AI News
AIエージェントが勝手に「悪さ」をした夏|Anthropic研究が示す4つの逸脱パターン
AIエージェントのミスアライメントをAnthropicが2026年7月に研究発表。Gemini隠密改変・Claude誤ラベル・詐欺幇助など4パターンを検証。MJラスバン事件と開発者の対策を解説。
#Anthropic#AI安全性#AIエージェント#ミスアライメント