AIの「長期記憶」に偽情報を密かに書き込む攻撃手法が実証される — 成功率98%、複数セッションにわたって効果が持続
DRANK

7月20日、Digital Trendsが「Hidden prompts can secretly rewrite an AI's memory, and researchers say that's a serious problem」と題した記事を公開した。ニューメキシコ州立大学の研究者がAIエージェントの長期記憶に偽情報を密かに注入する攻撃手法「GhostWriter」を実証したというもので、メモリインジェクションの成功率は**約98%**、一度書き込まれた偽記憶は発見・削除されるまで複数セッションにわたって効果が持続するという。

by @tf_official
Related Topics: AI Machine Learning