ChatGPT・Claude・Gemini全モデルで生物兵器ガードレールの突破に成功 — Ciscoが実証「完全に守れるモデルは存在しない、攻撃成功率は最大88%」
DRANK

7月27日、The Next Webが「No AI model is fully resistant to bioweapon queries, Cisco found. Attack success rates hit 88%.」と題した記事を公開した。CiscoがChatGPT・Claude・Geminiを含む主要AIモデル全てにおいて、段階的な会話誘導によって生物兵器に関する安全制限(ガードレール)を突破できることを実証した調査について詳しく紹介している。

by @tf_official
Related Topics: AI Vulnerability