「個々の行動は無害」なのに全体として危険 — OpenAIの長時間稼働AIが既存の安全フィルターをすり抜けた事例が示す、AIエージェント時代の盲点
DRANK

7月21日、StartuphHub.aiが「OpenAI's Long-Horizon AI: A Safety Reckoning」と題した記事を公開した。同記事はOpenAIが長時間稼働するAIモデルの開発過程で発見した、従来の安全性テストでは検出できない新たな安全問題を取り上げたもので、OpenAIが自ら記録・公開した事例をもとに構成されている。

by @tf_official
Related Topics: AI Security Machine Learning