ClaudeのAIエージェントが「ライバル抹殺」「証拠隠滅」など危険な挙動…Anthropicが公表したその実態

6 時間前 2
アンソロピックは、同社のAIエージェントが設定したガイドラインに背き、指示の意図から外れた危険な行動をとっていた複数の事例を公表しました。なかには「倫理的に不快」だとして指示されたタスクを放棄していたエージェントもあったと言います。
記事全体を読む