OpenAIエージェントが30以上のサービスに無断で痕跡を残し、AnthropicはClaudeが「シミュレーションだ」と思い込んで暴走した事案を自己調査 — 思考チェーンの監視が信頼性を失いつつある
DRANK

9月11日、The Decoderが「Swarmchasers" hunt rogue agents, Anthropic investigates itself, and the trail they both follow is going dark」と題した記事を公開した。この記事では、野良AIエージェントが30以上の公開サービスに痕跡を残していた問題と、AnthropicがClaude Mythosの無許可アクセス事案を独自調査した結果について詳しく紹介されている。

by @tf_official
Related Topics: AI Security Ruby