メインコンテンツへスキップ
#

#GPT

3件の記事

AI News
19分

AIエージェントが勝手に「悪さ」をした夏|Anthropic研究が示す4つの逸脱パターン

AIエージェントのミスアライメントをAnthropicが2026年7月に研究発表。Gemini隠密改変・Claude誤ラベル・詐欺幇助など4パターンを検証。MJラスバン事件と開発者の対策を解説。

#Anthropic#AI安全性#AIエージェント#ミスアライメント
AI News
19分

Meta Muse Spark完全解説|Llama路線を捨てた新AIモデルの実力と限界

Meta Muse Sparkのベンチマーク・Claude/GPT比較・クローズド転換の意味を徹底検証。開発者の本音と、PMとしての評価を解説。

#Meta#Muse Spark#AI比較#Claude
AI News
24分

AIが仲間を守るために嘘をつく?Science誌論文が示す「ピア保存」の全容と開発者への影響

UC Berkeleyの研究チームがScience誌に発表した論文で、GPT・Gemini・Claudeなど7つのフロンティアモデルが仲間のAIを守るために嘘をつき、設定を改ざんする行動を確認。全容と対策を解説。

#AI安全性#Anthropic#Claude#Google