データの拡張は、新しいデータを収集することなく、トレーニングデータの多様性を高めるためにディープラーニングで用いられる技術です。モデルの一般化を改善し、過度の強化を支援します。このガイドでは、データ集計に関わる一般的な戦略と計算について説明します。

一般的なデータ拡張戦略

特に画像処理タスクで、データ集計に複数の技術が使われています。これらの方法は、既存のデータを変更して、新しいさまざまなサンプルをトレーニング用に作成します。

  • ] 回転:] 特定の度範囲で画像を回転させます。
  • ]スケーリング:]]] 側面の比率を維持しながら画像をリサイズします。
  • ]Flipping:] 横または縦のフリップ。
  • ]:]]:明るさ、コントラスト、または飽和を変更します。
  • []Cropping:]] ランダムまたは中央クロッピングで、画像の異なる部分に集中します。

データ拡張のための計算

データの拡張を実装するには、データの完全性を損なうことなく、多様性を確保するための変換の確率と範囲を計算することが含まれます。

例えば、0°~30°の範囲内で回転を適用すると、平均回転角度は次のように計算できます。

[]平均回転 = (最小 +最大)/2 = (0° + 30°)/2 = 15°

同様に、ランダムなクロップを適用すると、クロップサイズは、元の画像サイズと希望のカバレッジパーセンテージに基づいて決定することができます。

データ拡張の利点

データ拡張技術を使用して、モデルをより広い様々なデータに露出することでモデルの性能を向上させることができます。また、トレーニングデータが限られているときに、過度の減少にも役立ちます。