اصول طبقه بندی تصویر ماهواره ای

طبقه بندی تصویر ماهواره ای یک وظیفه اصلی در سنجش از راه دور است که برچسب های پوشش زمین را – مانند جنگل، شهری، آب و کشاورزی – به هر پیکسل یا شی در یک تصویر ماهواره ای اختصاص می دهد. طبقه بندی دقیق از نظارت زیست محیطی، تجزیه و تحلیل توسعه شهری، واکنش های طبقه بندی سنتی به روش های آماری مبتنی بر پیکسل مانند حداکثر احتمال یا تصویر راهنمای عکس برداری از روش های یادگیری دقیق، نیاز به سرعت قابل توجهی دارد و سرعت های مختلف.

تصاویر ماهواره ای در چندین گروه طیفی ثبت شده اند - قابل مشاهده، نزدیک مادون قرمز، موج کوتاه مادون قرمز و حرارتی - هر کدام از ویژگی های مختلف مواد سطح را ثبت می کنند. Classifiers باید از این امضاهای طیفی استفاده کنند در حالی که حسابداری برای زمینه فضایی، اثرات جوی و تغییرات فصلی یادگیری ماشین آلات یادگیری الگوهای توصیفی را مستقیما از نمونه های آموزش برچسب شده یاد می گیرد، بنابراین نیاز به کاهش توانایی های دستی برای انطباق داده های محلی دارد.

الگوریتم های یادگیری ماشین کلید برای طبقه بندی تصویر ماهواره ای

پشتیبانی ماشین آلات

ماشین آلات پشتیبان (SVMs) مدل های یادگیری نظارت شده اند که کلاس های hyperLT را در یک فضای ویژگی بالا جدا می کنند، فضای ویژگی اغلب شامل مقادیر باند طیفی، شاخص های پوشش گیاهی یا اقدامات تنظیم بافتی جامع در SVM می تواند نمونه های S را شناسایی کند - نزدیک ترین به مرز تصمیم - و استفاده از آنها به حداکثر رساندن حاشیه بین کلاس های ترفند (معمولاً نیاز به تنظیم دقیق دارد، یا تنظیم دقیق از طریق داده های پردازش فاصله).

جنگل های تصادفی

جنگل تصادفی یک روش گروه ساخته شده از بسیاری از درختان تصمیم، هر کدام آموزش داده شده در یک زیرمجموعه از داده ها و یک زیرمجموعه تصادفی از ویژگی ها است، در طول طبقه بندی، هر رای درخت برای یک کلاس، و تصمیم اکثریت در مورد برش زمین بسته بندی شده است: این روش برش آب و هوا می تواند بیش از حد کاهش یابد، در مقایسه با یک درخت تصمیم گیری واحد و ارائه می دهد اهمیت ویژگی های ویژگی های ویژگی های ساخته شده است که به تفسیر دقیق و یا کاهش می دهد.

شبکه های عصبی عمیق (Convolutional Neuro networks)

شبکه های عصبی کانولو (CNNs) تبدیل به حالت استاندارد شده اند (FLTofart for Satellite image طبقه بندی شده اند، به ویژه هنگامی که چارچوب فضایی و الگوهای بافت حیاتی هستند، CNN به طور خودکار ویژگی های سلسله مراتبی را از ورودی های پیکسل خام یاد می گیرند - لبه ها، شکل ها و اشیاء - یک لایه های چند گانه و متحرک انتقال داده شده است.

نزدیک ترین همسایه ها

K-نزدیکترین Neighbors (KNN) یک یادگیرنده غیر پارامتری است، به عنوان مثال مبتنی بر نمونه که یک پیکسل را با رأی اکثریت در میان نمونه های آموزش K نزدیک ترین آن در معیارهای فاصله فضایی مانند Euclidean، منهتن، یا Mahalanobis برای محاسبه نزدیکی استفاده می شود، نیازی به آموزش صریح و دقیق نیست، و به خوبی آموزش داده های کاربردی مانند Kforcete، به عنوان مجموعه های ساده ای از داده های ساده است.

مزایای یادگیری ماشین در روش های سنتی

  • دقت بالا در مناظر پیچیده: روش های سنتی فرض توزیع Gaussian یا جدایی خطی خطی، در حالی که الگوریتم های یادگیری ماشین را جذب روابط غیر خطی، چند منظوره مشترک در تصاویر ماهواره ای واقعی جهان است.به عنوان مثال، جنگل تصادفی و سی ان ان به طور معمول یک accura کلی بیش از 90٪ در مجموعه داده های داده ها، حداکثر رساندن احتمال دارد تا 10٪ - 20٪.
  • خودکارسازی مهندسی ویژگی: مدل های یادگیری عمیق یادگیری ویژگی های فضایی و طیفی پایان به پایان، کاهش تلاش های دستی مورد نیاز برای طراحی شاخص های دستی یا فیلترهای بافت دست، این مانع برای غیرکارشناسان برای تولید نقشه های با کیفیت بالا را کاهش می دهد.
  • قابلیت سرعت بخشیدن به حجم داده های بزرگ: خط لوله یادگیری ماشین می تواند ترابیت داده های ماهواره را به طور موازی با استفاده از چارچوب های محاسباتی توزیع شده پردازش کند.این مقیاس پذیری برای تولید محصولات پوشش زمین جهانی در وضوح بالا ضروری است.
  • Adaptability و بهبود مستمر: مدل ها می توانند به عنوان داده های بررسی زمینه جدید در دسترس باشند، قادر به به به روز رسانی مداوم از نقشه های طبقه بندی، استراتژی های یادگیری فعال همچنین کاهش تلاش برچسب زدن با انتخاب دقیق ترین نمونه های آموزنده برای اشاره.

چالش ها و محدودیت ها

الزامات داده ها و برچسب زدن هزینه

تمام مدل های یادگیری ماشین تحت نظارت نیاز به حجم زیادی از داده های آموزش دقیق برچسب، برای تصاویر ماهواره ای، داده های حقیقت زمین به طور معمول از نظرسنجی های میدانی، تصاویر با وضوح بالاتر، یا نقشه های پوشش زمین موجود است که به دست آوردن چنین برچسب هایی برای مناطق جغرافیایی مختلف و مراحل شکاکولوژیکی گران و زمان گیر است. Weakly نظارت و خود نظارت بر روش های یادگیری بالا خود را توسعه داده شده برای کاهش این تنگنا، اما آنها تحقیقات مرزی فعال باقی می ماند.

مطالبات محاسباتی

شبکه های عصبی عمیق، به طور خاص، خواستار GPU های قدرتمند و حافظه بزرگ برای آموزش در کاشی های چند منظوره با وضوح بالا هستند. سرویس های مبتنی بر ابر مانند Google Earth Engine و Amazon SageMaker محاسبات مقیاس پذیر را ارائه می دهند، اما هزینه ها می توانند برای پروژه های بزرگ فشرده سازی، مدل سازی، هیدروژل، و معماری سبک (به عنوان مثال Mobile) قابل توجه باشد تا نیازهای محاسباتی را در سیستم عامل های لبه ماهواره ای یا سیستم عامل های لبه های پیشرفته کاهش دهد.

Overfit و Generalization

مدل های یادگیری ماشین می توانند برای آموزش داده ها بیش از حد مفید باشند، به ویژه هنگامی که مجموعه داده ها کوچک یا عدم تعادل هستند تکنیک های منظم سازی (dropout، زوال وزن، توقف زود هنگام) و آموزش متقابل، زمینه های فعال برای بهبود دامنه های زمانی و فضایی را به منطقه دیگر با ویژگی های مختلف پوشش زمین اغلب عملکرد را کاهش می دهد.

قابلیت پیش بینی مدل Interpretability

مدل های پیچیده مانند شبکه های عصبی عمیق به عنوان "جعبه های سیاه" عمل می کنند، و درک اینکه چرا یک پیکسل خاص به عنوان طبقه بندی شده است دشوار است، مثلاً جنگل به جای تصمیمات طبقه بندی درایو کوچک، ابزار توضیح (به عنوان مثال، SHAP، LIME، Grad-CAM) برای سنجش از راه دور سازگار شده است تا مشخص شود که کدام گروه های طیفی یا الگوهای طبقه بندی درایو فضایی به ویژه برای برنامه های مهم تنظیم کننده یا مدل استدلال شفاف هستند.

مسیر های آینده و روند نوظهور

ادغام طبقه بندی عمیق یادگیری و تصویر ماهواره ای به سرعت در حال تکامل است.(مکان های توجه و معماری ترانسفورماتور - که عمدتا برای پردازش زبان طبیعی توسعه یافته اند - برای جذب وابستگی های فضایی طولانی مدت در تصاویر ماهواره ای سازگار هستند، و استخراج DNA در برخی از وظایف سیستم های تقسیم بندی شده به طور مستقیم، به عنوان مثال نمونه های یادگیری چند منظوره (Ftringing) را بهبود می بخشد.

نتیجه گیری

الگوریتم های یادگیری ماشین طبقه بندی تصویر ماهواره ای را از یک کتابچه راهنمای، ورزش آماری به یک فرایند خودکار و با دقت بالا تبدیل کرده اند که قادر به انجام جریان های داده های عظیم است. Support vector Machines، Random Jungle، شبکه های عصبی عمیق و حتی روش های ساده تر مانند K نزدیک ترین Neighbors هر کدام نقاط قوت خاصی را برای برنامه های مختلف ارائه می دهند، با یادگیری عمیق در حال حاضر منجر به چالش های مداوم در داده ها، تفسیر هزینه های یادگیری و ابزارهای سازگار سازی زیست محیطی، و انعطاف پذیری دقیق تر از طریق پردازش اطلاعات، و ارائه می شود.