ChatGPT・Claudeの「隠された推論」が丸ごと抽出できる — 設計の根本を突いた攻撃手法が論文で実証
DRANK

8月11日、Alexander Panfilovら8名の研究者が「Stealing Reasoning Traces from Proprietary LLM APIs」と題した論文を公開した。Anthropic・OpenAI・Googleが採用している「暗号化された推論トレース」に構造的脆弱性が存在し、暗号を「解読」しなくても内部の思考過程を丸ごと抽出できることを実証した研究だ。

by @tf_official
Related Topics: AI Security Vulnerability