آؤٹ-وکوبلاری (OV) الفاظ قدرتی زبان کی تیاری (NLP) سسٹمز میں ایک اہم چیلنج ہوتے ہیں یہ الفاظ نظام کی تربیتی اعداد میں موجود نہیں ہیں، جس کی وجہ سے ترجمہ، جذباتی تجزیہ اور تقریر شناسی جیسے کاموں میں درستی کا باعث بن سکتے ہیں۔OV الفاظ کو بہتر بنانے کے لیے ضروری ہے۔

اووروی الفاظ کو ہاتھ لگانے کے قریب

این ایل پی سسٹمز میں OOV الفاظ کے مسئلے کو حل کرنے کے لیے کئی طریقے استعمال کیے جاتے ہیں۔ان قریبی مقصد یہ ہے کہ وہ انفصام الفاظ کے لیے پیش گوئی کریں یا ان کی نمائندگی کریں یا ان کی نمائندگی کریں یا نظام کی برآمد پر نامعلوم الفاظ کے اثرات کم کریں۔

عام طور پر سُر‌جِل

  • [5LT] زیر لفظ sympization: چھوٹی اکائیوں میں الفاظ توڑ کر چھوٹی اکائیوں جیسے ماورافل یا Salums کے ذریعے نظام کو پوشیدہ الفاظ کے حصوں کو تسلیم کرنے کی اجازت دیتا ہے۔
  • چکراکار-لیول ماڈلز: الفاظ کی بجائے حروف استعمال کرنا نظام کسی بھی لفظ، معروف یا نامعلوم کو عمل میں لانے کے قابل بناتا ہے۔
  • [Embeding Approximation: [1] Estiming Victor signal for OOV ایسے ہی معروف الفاظ پر مبنی ہے۔
  • Constructions: [LLT:1] [LLT] کے ارد گرد کے الفاظ کسی نامعلوم لفظ کے مفہوم یا کردار کو درست کرنے کے لیے استعمال کیے جاتے ہیں۔

ناانصافی اور مایوسی

ذیلی الفاظ اور حروف پر مبنی طریقوں سے نظام کی صلاحیت کو بہتر بنایا جائے اور آؤٹ-وکوبلری شرح کو کم کیا جائے۔لیکن ممکن ہے کہ وہ شمارندی پیچیدگی میں اضافہ کریں اور بعض اوقات کم تر نمائندگی کی طرف لے جائیں ۔ کنکرپٹ پاسداری بہتر سمجھ سکتی ہے مگر اطراف کے متن پر انحصار کر سکتی ہے اور اس کے ساتھ ساتھ ساتھ سخت جدوجہد کر سکتی ہے۔