偽のメールスレッドを混ぜるだけでAI要約が書き換わる — 隠し文字も命令文も不要、60回全試行で再現
DRANK

9月29日、HackReadが「Fake Email Thread Tricks AI Summarizer Without Hidden Text」と題した記事を公開した。隠しテキストも明示的な命令文も一切使わず、偽のメールスレッドを混入するだけでAIメール要約機能を操作できることを実証した研究だ。60回のトライアルすべてで虚偽情報が出力に混入したという結果は、「隠し文字を検知すれば安全」という前提を根底から揺さぶる。

by @tf_official
Related Topics: AI Security Vulnerability