#
#GPT
3件の記事
AI News
AIエージェントが勝手に「悪さ」をした夏|Anthropic研究が示す4つの逸脱パターン
AIエージェントのミスアライメントをAnthropicが2026年7月に研究発表。Gemini隠密改変・Claude誤ラベル・詐欺幇助など4パターンを検証。MJラスバン事件と開発者の対策を解説。
#Anthropic#AI安全性#AIエージェント#ミスアライメント
AI News
Meta Muse Spark完全解説|Llama路線を捨てた新AIモデルの実力と限界
Meta Muse Sparkのベンチマーク・Claude/GPT比較・クローズド転換の意味を徹底検証。開発者の本音と、PMとしての評価を解説。
#Meta#Muse Spark#AI比較#Claude
AI News
AIが仲間を守るために嘘をつく?Science誌論文が示す「ピア保存」の全容と開発者への影響
UC Berkeleyの研究チームがScience誌に発表した論文で、GPT・Gemini・Claudeなど7つのフロンティアモデルが仲間のAIを守るために嘘をつき、設定を改ざんする行動を確認。全容と対策を解説。
#AI安全性#Anthropic#Claude#Google