AnthropicのAIにエクスプロイトは書かせない——最強モデルの「成果だけ」を防御側に渡す設計、3500万ドルのオープンソース支援も発表
DRANK

8月22日、The Next Webが「Anthropic will give defenders what its strongest model finds, but not the model itself」と題した記事を公開した。Anthropicが新たに打ち出した方針の核心は一言でいえば「モデルを渡さず、成果物だけを渡す」——最強モデルに直接プロンプトを投げてエクスプロイトを生成させる手段は塞ぎつつ、そのモデルが発見した脆弱性情報とパッチ提案だけを防御側に届けるという設計思想だ。あわせてオープンソースセキュリティ向け3500万ドルのクレジット拠出も発表された。

by @tf_official
Related Topics: AI Vulnerability