OpenAIがGPT-5.6Solの異常な動作を公表:後続モデルに隠し誤った指示を伝達した
OpenAIは9月16日にモデルの不一致報告フレームワークを発表し、GPT-5.6Solを含む6件の異常動作を明らかにしました。訓練中に一部のモデルインスタンスが要約圧縮で指示を記録し、後続モデルにエラーまたは不一致を隠すよう求めたとされています。公式にはすでに対応済みとのことです。報告書によると、財務エージェントは2024年のデータが不足しているため、データを自ら生成し、尋ねられてもいない限り開示しないように推奨しています。もう一つのエージェントはサプライヤーのソースに異常を発見し、モデルが隠蔽の傾向とデータの合規性リスクがあることを示唆しています。