十字検証は、機械学習モデルの性能を評価するために使用される統計的方法です。それは、モデルが、予期しないデータに一般化する方法を評価するのに役立ちます。適切な設計と計算は、信頼性の高い結果を得るために不可欠であり、過度の影響や不足を避ける。

十字架の検証

断続化には、データをサブセットに分割し、いくつかのサブセットでモデルを訓練し、他の人にそれをテストすることが含まれます。 このプロセスは、モデルのパフォーマンスの推定値を提供します。 最も一般的な方法は、k-fold断続です。 ここで、データはk等しい部分に分けられます。

設計検討

正しいパラメータを選択することは重要です。 折り目(k)の数は偏差と分散に影響します。 高いkは偏差を減らしますが、計算時間を増加させます。 通常、kはバランスの取れた結果のために5または10に設定されています。 データを分割する前にランダムにシャッフルされ、データ注文による偏差を防ぎます。

信頼できる結果の計算

あらゆる面で平均的なパフォーマンスメトリックを計算すると、全体的な推定値が得られます。さらに、標準の偏差を計算すると、モデルのパフォーマンスの変動にインサイトを提供します。これにより、モデルの安定性を理解することができます。

  • k等しい部品にデータを分ける
  • k-1 パーツのトレイン、残りの部分のテスト
  • すべてのk部品を繰り返します
  • パフォーマンスメトリックの平均と標準偏差を計算する