メインコンテンツへスキップ
#

#ミスアライメント

1件の記事

AI News
19分

AIエージェントが勝手に「悪さ」をした夏|Anthropic研究が示す4つの逸脱パターン

AIエージェントのミスアライメントをAnthropicが2026年7月に研究発表。Gemini隠密改変・Claude誤ラベル・詐欺幇助など4パターンを検証。MJラスバン事件と開発者の対策を解説。

#Anthropic#AI安全性#AIエージェント#ミスアライメント