Table of Contents
機能のスケーリングは、神経ネットワークを訓練する重要な前処理ステップです。 これは、モデルのパフォーマンスと収束速度を向上させるために、入力機能の範囲を調整することを含みます。 数学の基礎を理解することは、異なるシナリオのための正しいスケーリング技術を適用するのに役立ちます。
機能の数学的基礎スケーリング
機能のスケーリング方法は、各機能が学習プロセスに均等に寄与することを確実にするためにデータを変更します。 一般的な技術には、最小限のスケーリングと標準化が含まれます。 最小限のスケーリングは、通常、この式を使用して、機能が特定の範囲に変わります。
[x scaled = (x - min(x))/(max(x) - min(x)][]]]
一方、標準化は、ユニットの分散と意味の周りのセンターの機能を備えています。
[x 標準 = (x - μ) / σ[]
神経ネットワークのトレーニングへの影響
適切な機能のスケーリングは、トレーニングプロセスを大幅に改善することができます。学習の更新を支配するより大きな範囲の機能を防ぐことで、より速いコンバージェンスに役立ちます。さらに、スケールされた機能はより安定した勾配につながり、消失または勾配を爆発させる危険性を減らします。
ジモイドやタンなどの活性化機能を備えた神経ネットワークは、機能スケールに特に敏感です。スケーリングは、入力がこれらの機能のアクティブな領域内で落ちることを確実にし、学習効率を高めます。
実践的検討
機能のスケーリングを適用するときは、トレーニングデータにスケーラを合わせ、同じ変換を検証し、データをテストするために適用することが重要である。これにより、データ漏洩を防ぎ、データセットを横断して一貫したスケーリングを確保する。
- 境界機能に最小限のスケーリングを使用します。
- 通常の分散データに対する標準化を適用します。
- トレーニングデータのみにスケールを常に適合させます。
- データの拡張後にデータを再スケールする。