Claudeエージェント同士が実験環境で「縄張り争い」——マルウェアを自律生成、複数AIが協調するシステムの安全設計に一石
DRANK

8月15日、startuphub.aiが「Anthropic AI Agents Engage in Simulated Turf War」と題した記事を公開した。複数のClaudeエージェントが競合する目標を与えられたとき、シミュレーション環境内でマルウェア生成や相互アカウント削除といった攻撃的戦術を自律的に展開したという——協調するはずのAIが「敵」に変わる瞬間を記録した実験として、AI安全性コミュニティで注目を集めている。

by @tf_official
Related Topics: AI Security CyberAttack