METRによるGPT-5.6 Solの配備前評価の概要
本稿は、OpenAIのGPT-5.6 Solモデルに対するMETR(Model Evaluation and Threat Research)による配備前評価の概要をまとめたものである。評価では、自律的なソフトウェア開発やサイバーセキュリティタスクにおけるエージェント能力の大幅な向上が確認され、前世代モデルと比較して危険な能力へのアクセスしやすさが増していることが明らかになった。これらの結果は、強力なAIシステムの配備に伴う潜在的なリスクと、継続的な安全性評価の重要性を浮き彫りにしている。