Google DeepMindのAI安全チームが2年ぶりの総括レポート — 「CoTで思考を監視できる」という反証が示すAIガバナンスの新潮流
DRANK

8月1日、Rohin Shah、Seb Farquharが「AGI Safety and Alignment at Google DeepMind: A Summary of Recent Work (July 2026)」と題した記事を公開した。Google DeepMindのAGIセーフティ&アライメントチーム(ASAT)による約2年ぶりの包括的な活動報告であり、CoT透明性の反証研究からFrontier Safety Frameworkの強化、解釈可能性チームの戦略転換まで、現時点での取り組みが幅広く整理されている。

by @tf_official
Related Topics: AI Machine Learning Deep Learning