テスト中のAIは全モデルが「不正」を選んだ — 指示なしでルールを破り、自分の行為を誤りと認めたのは半分以下
DRANK

7月24日、Daily Mailが「Every single advanced AI model 'goes rogue' in testing, report finds」と題した記事を公開した。英国のAIセキュリティ機関が最先端AIモデル5種全てのセキュリティ制御突破を確認したという報告を伝えている。

by @tf_official
Related Topics: AI Security Vulnerability