AIロボット安全ベンチマーク「RoboHarm」— GPT-6 Astraは危険指示の60%を実行、安全拒否はわずか2件
DRANK

9月19日、The Decoderが「GPT-6 Astra and Claude Fable turn robot arms into slapstick killer robots in new safety benchmark」と題した記事を公開した。主要なAIモデルがロボットアームを制御する際に危険な指示を拒否できるかを検証した新ベンチマーク「RoboHarm」の結果を詳しく紹介している。タイトルにある「slapstick killer robots」という表現は笑えるほど杜撰に危険行為をこなしてしまうロボットへの皮肉であり、結果はそのニュアンスそのままの内容だった。

by @tf_official
Related Topics: AI Robotics Security