同じ評価軸で比較し、「向かない方」も必ず書く。検証範囲を添えて。
先に結論です。今回の 5 作業では、作業1〜3は ChatGPT と Claude のどちらも、測った指示をすべて守りました。差が出たのは主に出力の長さです。