OpenAI・Anthropic・Googleが「AIの思考」を別モデルで盗み読みできる脆弱性を修正 — 公開ログからAPIキー62件も回収
DRANK

8月12日、RuntimeWire が「OpenAI, Anthropic and Google blocked a cross-model reasoning attack」と題した記事を公開した。推論モデルが返す暗号化された思考ブロックを別モデルに復号させる手法を研究者が発見し、OpenAI・Anthropic・Googleが対応した経緯を詳しく伝えている。

by @tf_official
Related Topics: AI Vulnerability Cryptography