Table of Contents

تطور التفاعل الصوتي في طلبات التنقل

وقد أعادت تكنولوجيا الاعتراف بالصوت تشكيلها أساساً، حيث تخطى المستعملون التطبيقات المتنقلة سمات جديدة ليصبحوا أداة أساسية للوصول إلى المعلومات، وبالنسبة لملايين الأشخاص ذوي الإعاقة، بمن فيهم الأشخاص ذوو الإعاقة البصرية، أو محدودية التنقل، أو التحديات المعرفية، فإن أوامر الصوت توفر مساراً مباشراً نحو الاستقلال في العالم الرقمي، وعندما يتم التنفيذ على النحو الصحيح، فإن التفاعلات الصوتية تتيح للمستخدمين أداء مهام معقدة، والوصلات الشبكية البحرية، والتواصل مع التطبيقات دون الاعتماد على البيئة المادية الحقيقية،

وتتجاوز حالة الاعتراف بالصوت الذي يركز على إمكانية الوصول إلى الشبكة نطاق الامتثال للوائح مثل قانون الأمريكيين ذوي الإعاقة أو المبادئ التوجيهية المتعلقة بالوصول إلى المحتوى الشبكي، وتظهر البحوث باستمرار أن سمات الوصول تعود بالفائدة على جميع المستخدمين، وليس فقط ذوي الإعاقات الدائمة، وأن أحد الوالدين الذي يحمل طفلا، أو سائقا يتبع اتجاهات الملاحة، أو طباخا ذا أيدي مغطى بالزرار، يستفيد من التفاعل الصوتي دون استخدام الجمهور في تصميم الصوت، يخلقان تطبيقات أخلاقية أوسع نطاقا.

فهم القدرة على الوصول

بالإضافة إلى ذلك، فإن الوصول إلى التطبيقات المتنقلة يشمل مجموعة واسعة من الاحتياجات، ويعالج التعرف الصوتي عدة مجالات رئيسية في آن واحد، وقد يعتمد المستخدمون ذوو العاهات البصرية اعتماداً كاملاً على قارئين للشاشات مثل جهاز الصوت أو جهاز التخاطب الآلي، ولكن أوامر الصوت يمكن أن تكمل أو تحل محل هذه الأدوات لبعض المهام، وقد يجد المستخدمون ذوو الإعاقة في السيارات، مثل أولئك الذين يعانون من مرض باركنسون، أو من الشلل الدماغي، أو من الإصابات المفاجئة البصرية.

وتقدر منظمة الصحة العالمية أن أكثر من بليون شخص في جميع أنحاء العالم يعانون من نوع من الإعاقة، مما يمثل قاعدة كبيرة للمستعملين لا يمكن للمطورين المتنقلين أن يتجاهلوا ذلك، ورغم ذلك، فإن العديد من التطبيقات لا يزال يعامل إمكانية الوصول كفكرة بعدية أو كإطار للتحقق من الامتثال بدلا من فلسفة التصميم، فإقرار الصوت، عند تنفيذه بعناية، يمكن أن يجسر الثغرات التي لا يمكن أن تعالجها التفاعلات التقليدية، ويتيح للمستعملين اختيار أفضل طريقة للتكيف مع الاحتياجات.

الاستحقاقات الأساسية للاعتراف بالصوت من أجل الوصول

وتمتد مزايا إدماج الاعتراف بالصوت عبر أبعاد القابلية للتداول والمشاركة والشمولية، ويساعد فهم هذه الفوائد المطورين على تبرير الاستثمار وتحديد الأولويات على نحو فعال.

تعزيز القدرة على العمل من خلال التفاعل الحر

أما الفائدة الأكثر إلحاحاً من الاعتراف بالصوت فهي القدرة على نقل التطبيقات دون اتصال مادي بالشاشة، وبالنسبة للمستعملين ذوي الوظائف اليدوية المحدودة، أو الخزائن، أو الشلل، فإن هذه القدرة تحول تطبيقاً من غير قابل للاستخدام بالكامل، كما أن التفاعل مع المستعملين في الحالات التي تكون فيها أيديهم مشغولة، مما يؤدي إلى إنتاج أكثر تنوعاً، وينبغي للمطورين تصميم أوامر صوتية لتكملة التفاعلات القائمة التي لا تبدلها.

دعم احتياجات المستعملين المتنوعين والمتطورين

فالإعاقة ليست ظروفا ثابتة، إذ يمكن للمستعمل الذي يعاني من فقدان الرؤية التدريجي أن يستخدم في البداية اللمسات مع التكبير، ولكن في نهاية المطاف يتطلب ملاحة صوتية كاملة، وبالمثل، قد يحتاج شخص ما يسترد من إصابة مؤقتة إلى دعم صوتي لعدة أسابيع قبل العودة إلى التفاعل القائم على اللمس، ويستوعب الاعتراف الصوت هذا الطيف من الاحتياجات دون أن يشترط على المستعملين تعلم التطبيقات الجديدة أو سير العمل، ويسعى نفس الأصوات إلى ما إذا كان لدى المستخدم رؤية محدودة، أو يفضل أن يخفف من المرونة.

تحسين مشاركة المستعملين والترضية

ويشعر التفاعل الصوتي بطابع طبيعي ومتحدث أكثر من الوصلات البينية التقليدية للمستعملين بالرسوم البيانية، مما يمكن أن يزيد من مشاركة المستخدمين وترضيتهم، وعندما يتمكن المستعملون من التحدث عن الأوامر بكلماتهم وتلقي تعليقاتهم على مراجعة الحسابات، يصبح التفاعل أكثر سهولة وأقل ميكانيكية، وهذا أمر له قيمة خاصة بالنسبة للتطبيقات التي يتاح للمستعملين في كثير من الأحيان طوال اليوم، مثل أجهزة التراسل، وأدوات الإنتاجية، أو منابر الرعاية الصحية.

الهيكل التقني لنظم الاعتراف بالصوت

ويتطلب تنفيذ الاعتراف بالصوت في تطبيق متنقل فهم عدة عناصر مترابطة، ويؤدي كل جزء من أجزاء الهيكل دورا حاسما في تحقيق تفاعلات صوتية دقيقة ومستجيبة وميسورة.

Speech-to-Text Engine

محرك الكلام إلى النص هو أساس أي نظام للتعرف على الصوت هذا المكون يحول إشارات الخطاب الصوتي إلى نص مكتوب يمكن أن يجهز الطلب ويتصرف فيه

وتُقدم المعالجة في الموقع خدمات أقل من حيث الكفاءة والعمل دون الربط الشبكي عبر الإنترنت، وهو أمر حاسم بالنسبة لتطبيقات الوصول التي يجب أن تعمل بشكل موثوق في جميع البيئات، غير أن نماذج الترفيع تكون عادةً ذات مفردات أصغر، وقد تكافح باستخدامات مكثفة أو مصطلحات محددة النطاق أو ضوضاء خلفية، وتوفر الخدمات القائمة على التكتل قدراً أكبر من الدقة والدعم اللغوي، ولكنها تُدخل في الغالب نظاماً ثابتاً للربط الشبكي.

القيادة والاعتراف المتعمد

النص السريع من محرك الكلام إلى النص لا يكفي لدفع سلوك التطبيق المجدي، يجب على جهاز التحكم تفسير النص المدون لتحديد نوايا المستخدمين، واستخراج البارامترات ذات الصلة، ورسم خرائط لها لإجراءات تطبيق محددة، وهذه الطبقة تُسد الفجوة بين اللغة البشرية الطبيعية ومنطق التطبيق المنظم، فأجهزة القيادة الفعالة تعالج الاختلافات في الصياغة، وتتحمل الأخطاء البسيطة في الوصف، وتُقدم مُنحى سميكة عندما يُستخدم

ويمكن للمطورين تنفيذ نظام للتحكم باستخدام النهج القائمة على القواعد، أو نماذج فهم اللغة الطبيعية، أو مزيج من كليهما، إذ تحدد النظم القائمة على القواعد أنماطاً واضحة وكلمات رئيسية تؤدي إلى اتخاذ إجراءات محددة، وتتيح سلوكاً يمكن التنبؤ به، وتسهل تشويه الأعضاء التناسلية للأدوية، وتستخدم النظم القائمة على القانون الوطني التعلم الآلي لفهم طائفة أوسع من أشكال التعبير والوسائط السياقية، ولكنها تتطلب بيانات تدريبية أكثر، ويمكن أن تسفر عن نتائج غير متوقعة في حالات الارتداد.

نظم التغذية والتأكيد

يجب أن توفر وصلات الصوت التي تركز على الوصول تعليقات واضحة ومباشرة للتأكد من أن الطلب قد فهم أمر المستخدم، ويمكن أن تتخذ هذه التعليقات أشكالا متعددة: أدوات مراجعة الحسابات مثل الشمط أو التأكيدات النطقية، ومؤشرات بصرية مثل عناصر الوصل المسلط الضوء، أو ردود الفعل الارتجاعية من خلال الاهتزاز بالجهاز، أو مزيجات التي تستوعب المستخدمين ذوي القدرات الحسية المختلفة، وينبغي أيضا أن يعالج نظام التغذية الارتباكة الأخطاء في الولايات، مع الفشل، مع تقديم اقتراحات.

وتخفض حلقة التغذية المرتدة المصممة جيداً إحباط المستخدمين وتبني الثقة في واجهة الصوت، ويعتمد المستعملون الذين يعانون من إعاقة بصرية اعتماداً كبيراً على التعليقات التي ترد في مراجعة الحسابات، بينما يفضل المستعملون الصم أو الذين يصعب سماعهم تأكيدات بصرية أو غير واضحة، ويضمن توفير قنوات متعددة للتغذية أن يظل التفاعل متاحاً للمستعملين ذوي القدرات المختلفة، وينبغي أيضاً أن ينظر المطورون في الحمل المعرفي لآليات المرتدة، مع تجنباً التأكيدات التي تبطئة التي تبطئة التي تبطئة التي تخففة على المؤثرات.

أفضل الممارسات لتطوير قدرات الوصول إلى الأصوات

ويتطلب بناء سمات للاعتراف بالصوت تخدم حقاً المستخدمين ذوي الإعاقة أكثر من التكامل التقني، وتسترشد المطورات التالية بأفضل الممارسات في إيجاد وصلات بينية غير ملائمة وموثوق بها وتحترم احتياجات المستعملين.

خطوط التصاميم حول اللغة الطبيعية

لا يجب على المستعملين أن يحفظوا عباراتهم بدقة لمراقبة الطلب، ويضعوا أوامر صوتية حول اللغة الطبيعية التي يستخدمها المستخدمون عندما يتحدثون إلى شخص آخر، بدلاً من أن يطلبوا مركباً صلباً مثل "موقع تحديد الهوية في 15 آذار/مارس" يقبلوا باختلافات مثل "جدول تعيين طبيب الأسنان في 15 آذار/مارس" أو "أحتاج لرؤية طبيب الأسنان في 15 آذار"

ويمكن للمطورين اكتشاف عمليات فرز طبيعية بدراسة تعليقات المستخدمين وإجراء اختبارات للقابلية للتداول مع مجموعات المستخدمين التمثيلية وتحليل النصوص من تفاعلات المستعملين، كما أن الاحتفاظ بنقطة انطلاق مرنة يتيح للنظام تحسين النظام بمرور الوقت مع إضافة صياغة جديدة تستند إلى أنماط الاستخدام في العالم الحقيقي، والنظر في توفير قيادة مساعدة تعطي المستعملين أمثلة على إجراءات الصوت المتاحة، ولكن تجنبا لاشتراط قيام المستعملين بدراسة هذه الأمثلة قبل أن يتمكنوا من التفاعل بنجاح.

توفير التغذية الفورية والمناسبة

وينبغي أن تحفز كل قيادة صوتية ردا واضحا يؤكد الإجراء الذي تم الاعتراف به وفهمه، وينبغي أن تضاهي التعليقات سياق القيادة وإلحاحها، ولكي تكون الإجراءات البسيطة مثل القذف أو اختيار بند، قد يكفي وصف موجز لمراجعة الحسابات أو بصري، وبالنسبة للإجراءات المدمرة مثل حذف المحتوى أو تقديم استمارة، يتطلب تأكيدا صريحا وتكرار وصف الفعل، حتى يتمكن المستعملون من التحقق من ذلك قبل المضي قدما.

إن كان النظام غير مؤكد بشأن القيادة، يجب أن يعترف بعدم اليقين بدلاً من التنفيذ الصامت لعمل غير صحيح، على سبيل المثال، قد يستجيب النظام بـ "أعتقد أنك قلت رسالة إلى أليكس" صحيح؟" هذا النهج يمنع الأخطاء بينما يحافظ على تدفق تفاعل سلس، وتوقيت أمور التغذية العكسية،

التمكين من العتاد والشخصية

ولا يتفاعل مستعملان مع الوصلات الصوتية بنفس الطريقة بالضبط، ويتيح توفير خيارات التكييف للمستخدمين تكييف تجربة الصوت مع احتياجاتهم وأفضلياتهم المحددة، وقد تشمل خيارات الحفظ تكييف حساسية محفز الصوت، وخلق اختصارات شخصية للقيادة في الإجراءات المتكررة، والاختيار بين مختلف صور الصوت أو اللهجات لمحرك الاعتراف بالخطابات، ووضع الأفضليات لأنواع التغذية ومستويات الارتداد.

إن التخصيص يتجاوز الظروف الفردية ليشمل التعلم من سلوك المستخدمين بمرور الوقت، والتفاعل الصوتي الذي يتكيف مع الصيغة النموذجية للمستعمل، والقيادات التي تستخدم في كثير من الأحيان، وأنماط التفاعل المفضلة تصبح أكثر كفاءة وتلبيتها مع الاستمرار في استخدامها، غير أنه يجب على المطورين أن يوازنوا بين شخصيتهم وخصوصيتهم، وأن يتحكموا في البيانات التي تخزن وكيفية استخدامها، وأن يسمحوا للمستعملين باستعراض تاريخ تفاعلهم أو تصديره أو حذفه في أي وقت.

إجراء اختبارات شاملة لاحتمال الاستخدام

ولا بد أن تفوت سمات التعرف على الصوت لدى المستعملين الذين لا يعانون من إعاقة مشاكل حرجة تؤثر على المستعملين ذوي الاحتياجات المتنوعة، وينبغي أن تشمل اختبارات الاستخدام الشاملة المشاركين الذين يعانون من مجموعة من الإعاقة، بما في ذلك العاهات البصرية، وإعاقات السيارات، وحالات الإعاقة السمعية، والاضطرابات في الكلام، وأن الاختبار مع مستخدمي التكنولوجيا المساعدة يتسم بأهمية خاصة، حيث يجب أن تتفاعل التفاعلات الصوتية بشكل سلس مع قارئي الشاشات، وضوابط التحويل، وغير ذلك من أدوات الوصول.

وينبغي أن يقيّم اختبار القابلية للتأثر ليس فقط معدلات إنجاز المهام بل أيضا التدابير الذاتية مثل رضا المستعملين، ومستويات الإحباط، والكفاءة المتصورة، وأن يرصد كيف يأمر المستخدمون بطبيعة الحال قبل أن يصادفوا أي مواد تدريبية، وأن يلاحظوا أين لا يفهم النظام الاختلافات المشتركة، وينبغي أن تجرى الاختبارات في بيئات واقعية تشمل الضجيج، وظروف الإضاءة المختلفة، وأن يتصدى مستخدمو الإشتاءات في الحياة اليومية.

التصدي لتحديات التنفيذ

ويطرح الاعتراف بالصوت من أجل الوصول تحديات فريدة يتعين على المطورين أن يبحروا لإيجاد وصلات بينية موثوقة ومحترمة وفعالة.

Accuracy and Environmental Variability

وتختلف دقة الاعتراف بالخطابات اختلافا كبيرا على أساس الظروف البيئية، وخصائص المستخدمين، وقدرات الأجهزة، ويمكن أن تؤدي الضوضاء الأساسية من حركة المرور، أو المحادثات، أو الأجهزة المنزلية إلى إفساد الإشارة السمعية وتؤدي إلى أخطاء في الاعتراف، وقد يكون المستخدمون ذوو الإعاقة في الكلام، بمن فيهم الذين يعانون من نقص في السلوك، أو التلقيح، أو من أنماط الفرز غير القياسية، غير مستوفين لنماذج الاعتراف التي تم تدريبها أساسا على الخطابات.

ولتخفيف هذه المسائل، ينبغي للمطورين أن ينفذوا عمليات قمع الضوضاء قبل التجهيز، وأن يقدموا عدة مكسبات للميكروفونات، وأن يدعموا التحول اليدوي للوسيلة اليدوية للهدوء مقابل البيئات المزعجة، وأن ينظروا في توفير التدريب الصوتي الخاص بالمستعملين الذي يكيف نماذج الاعتراف بأنماط التعبير الفردية، وأن يستكشفوا محركات الاعتراف المتخصصة التي يتم تدريبها على عينات الخطابات غير المألوفة، وأن الشفافية بشأن قيود الدقة تساعد على تحديد التوقعات الواقعية، وتتيح للمستعملين اختيار أساليب المدخلات البديلة عندما يكون الاعتراف الصوت غير قابل للتنبؤ.

الشواغل المتعلقة بالخصوصية وأمن البيانات

بيانات الصوت هي في جوهرها شخصية وحساسة، التسجيلات لا تلتقط محتوى الأوامر فحسب بل أيضاً نبرة المستخدم، و الحالة العاطفية، والمحادثات الخاصة التي تحدث في الخلفية، وتضعف البيانات الصوتية عن ثقة المستخدمين ويمكن أن تؤدي إلى المسؤولية القانونية بموجب أنظمة مثل اللائحة العامة لحماية البيانات أو قانون كاليفورنيا بشأن خصوصية المستهلك.

تنفيذ الاعتراف الصوتي باستخدام هياكل حفظ الخصوصية حيثما أمكن ذلك، فالعملية تأمر الجهاز بدلا من إرسال أجهزة خدمة صوتية إلى خواديم السحاب، لا سيما فيما يتعلق بالتطبيقات الحساسة مثل المصارف أو الرعاية الصحية أو الإنتاجية الشخصية، وعندما تكون عملية التجهيز السحابي ضرورية، تُغفل البيانات وتُشفر في العبور وفي الراحة، وتقدم كشفا واضحا عن البيانات التي يتم جمعها وكيفية استخدامها، وسمح للمستعملين باستعراض وحذف التسجيلات الصوتية، وعدم استخدام البيانات الصوتية لأغراض غير متصلة.

تقييدات الأجهزة وتجزؤها

وتختلف الأجهزة المتنقلة اختلافاً كبيراً في القدرة على التجهيز والذاكرة ونوعية الميكروفونات ونسخة نظام التشغيل، وقد تفتقر الأجهزة القديمة أو أجهزة الميزانية إلى التعجيل في المعدات اللازمة للاعتراف بالخطابات على مستوى مرتفع، مما يرغم على الاعتماد على معالجة السحاب أو على الأداء المتدهور، ويعني تجزؤ النظام التشغيلي أن أجهزة التعرف الصوتي قد تتصرف بشكل مختلف عبر النسخ، وقد تختفي بعض السمات الخاصة بإمكانية الوصول أو تتغير بعد تحديث النظام.

وينبغي للمطورين اختبار سمات الاعتراف بالصوت عبر مجموعة من الأجهزة التمثيلية، بما في ذلك النماذج القديمة والأجهزة المنخفضة المنسوجات، وتنفيذ تدهور متين يحافظ على القدرة الوظيفية الأساسية عندما تكون السمات المتقدمة غير متاحة، ورصد تقارير عن حوادث التحطم والخطأ التي تخص الأجهزة تحديداً سريعاً، والنظر في توفير مسارات تفاعلية بديلة، مثل الدخول إلى القيادة المستندة إلى نصوص، حتى عندما لا يكون الاعتراف بالصوت متاحاً بسبب القيود المفروضة على الأجهزة.

إرشادات التنفيذ الاستراتيجي

ويتطلب إدماج الاعتراف بالصوت كسمة من سمات تيسير الوصول التخطيط الاستراتيجي الذي يتوافق مع احتياجات المستعملين وأولويات الأعمال.

الأولوية للمستعملين الرئيسيين

وبدلاً من محاولة جعل كل رحلة من المعالم متاحة للصوت منذ البداية، تحديد أهم رحلات المستعملين التي تسبب صعوبة في استخدام المستخدمين ذوي الإعاقة، وتشمل المجالات ذات الأثر الكبير المشترك الملاحة بين الشاشات، والتشكيل، والبحث عن المحتوى، وخصائص الاتصال مثل إرسال الرسائل أو إجراء المكالمات.

وينبغي أن يُسترشد في تحديد الأولويات بمدخلات مباشرة من المستعملين ذوي الإعاقة، والخبراء الاستشاريين في مجال الوصول، والبيانات التحليلية التي تبين أماكن نضال المستعملين حالياً، وأن تعميماً تدريجياً يقدم دعماً صوتياً ممتازاً لمجموعة محدودة من الرحلات هو أكثر قيمة بكثير من تنفيذ شامل يعمل بشكل غير سليم في جميع الرحلات، وبعد كل مرحلة، جمع تعليقات المستعملين وتحسينها قبل الانتقال إلى المجموعة التالية من الملامح.

تصميم التفاعل المتعدد الوسائط

وينبغي أن يكون الاعتراف بالصوت أحد عناصر نظام التفاعل المتعدد الوسائط الذي يدعم أيضا اللمس، ومراقبة التحول، وتتبع العين، وغير ذلك من أساليب المدخلات، وينبغي أن يكون المستعملون قادرين على التحول بين الطرائق بطريقة متبادلة، أو بدء مهمة بالصوت وإكمالها باللمسة، أو استخدام الصوت لتصحيح خطأ يتم عن طريق طريقة أخرى للمدخلات، وهذه المرونة تستوعب المستعملين الذين تتغير احتياجاتهم على أساس السياق أو الإهمال أو الظروف البيئية.

كما يوفر التصميم المتعدد الوسائط القدرة على الصمود، إذا فشل الاعتراف الصوتي بسبب الضوضاء أو صعوبة الكلام المؤقت، يمكن للمستعمل أن يتراجع إلى طريقة أخرى للمدخلات دون فقدان السياق أو التقدم، وتجنباً لاشتراط المستخدمين اختيار طريقة واحدة للمدخلات في مجال النقل، بدلاً من ذلك، السماح لجميع الأساليب بأن تظل نشطة في آن واحد، والتفاوض بذكاء بشأن ما يمكن أن يُسهم به في الاستجابة على أساس الارتداد والثقة.

Measure Success through Accessibility Metrics

(ب) قياسات النجاح التي تعكس تحسينات حقيقية في إمكانية الوصول بدلاً من قياسات التقلبات، وتشمل القياسات المستعملة معدلات إنجاز المهام بالنسبة للمستخدمين ذوي الإعاقة، والوقت اللازم لإكمال الرحلات الرئيسية باستخدام الصوت مقابل اللمس، ومعدلات الخطأ، ومواعيد التعافي من التفاعلات الصوتية، وسجلات الرضا الذاتي من لوحات المستعملين التي يمكن الوصول إليها، ومقارنة هذه القياسات قياسات خط الأساس التي يتم اتخاذها قبل تنفيذ السمات الصوتية لتحديد الأثر كمياً.

وتساعد عمليات المراجعة المنتظمة لإمكانية الوصول، سواء كانت آلية أو يدوية، على تحديد حالات التراجع وفرص التحسين، وتقاسم التقدم مع المستعملين من خلال مذكرات الإفراج ومنتديات المجتمع المحلي، مع إظهار الالتزام بالتحسين المستمر، وتكسب جهود التوعية علناً، وتشجع سائر المطورين على إعطاء الأولوية للعمل المماثل.

الاتجاهات المستقبلية في إمكانية الوصول إلى الصوت

ويستمر مجال الاعتراف بالصوت في التقدم بسرعة، وينبغي للمطورين أن يستعدوا للقدرات الناشئة التي ستزيد من تعزيز إمكانية الوصول.

تقديم المساعدة في مجال إجراء الاختبارات والتصوير الاستباقي

وسيزيد من تعزيز التفاعلات الصوتية المستقبلية للمعلومات السياقية لتوقع احتياجات المستعملين وتقديم المساعدة الاستباقية، فعلى سبيل المثال، قد يكشف الطلب أن المستخدم يكافح بشكل معقد ويعرض قراءة الحقول المحمصة أو الكاملة عن طريق الصوت، ويمكن للوعي المستمر أن يقلل من عدد مستخدمي الأوامر الصريحين الذين يحتاجون إلى إصدارها، ويخفض الحمولة المعرفية، ويسرع التفاعلات.

ويجب أن تنفذ المساعدة الاستباقية بعناية لتجنب التدخل أو الاستهتار، وينبغي للمستعملين أن يحتفظوا بالمراقبة عن متى وكيف يقدم النظام المساعدة، وينبغي أن يكونوا قادرين على رفض الاقتراحات بسهولة، والشفافية بشأن البيانات السياقية التي يستخدمها النظام تسمح للمستعملين باتخاذ قرارات مستنيرة بشأن المبادلات الخاصة.

تحسين الدعم المقدم إلى أنماط خطابات وصفية

وتنتج عن البحوث التي أجريت على نماذج الاعتراف التي تم تدريبها على مختلف عينات الخطابات، بما في ذلك المستعملون ذوو الإعاقة في الكلام، نتائج واعدة، وتتعلم هذه النماذج معالجة النطق غير المستقر، والبطولة غير القانونية، والخصائص الفيزيائية غير المألوفة التي لا تفهمها النظم التقليدية، ومع نضج هذه التكنولوجيا، فإنها ستوسع بشكل كبير عدد المستخدمين الذين يمكنهم الاستفادة من الوصلات الصوتية.

ويمكن للمطورين أن يسهموا في هذا التقدم بالمشاركة في الشراكات البحثية، والإسهام بعينات صوتية مغفلة بموافقة مناسبة، والدعوة إلى ممارسات شاملة في مجال بيانات التدريب داخل منظماتهم، والهدف هو مستقبل يعمل فيه الاعتراف بالصوت على نحو جيد للجميع، وليس فقط بالنسبة للمتكلمين الذين لديهم أنماط نمطية للكلمات.

تجارب صوتية لا توصف

ويتفاعل المستعملون بشكل متزايد مع الأجهزة المتعددة طوال اليوم، وينبغي أن يتبعها الاعتراف الصوتي دون هوادة، ويبدأون قيادة صوتية على الهاتف ويستمرون على اللوحة، أو ينقلون السياق من متحدث ذكي إلى جهاز متنقل، ويخلقون تجربة متماسكة تقلل من الاحتكاك بالنسبة للمستخدمين ذوي الإعاقة، ويتطلب تحقيق هذا انعدام الحركة بروتوكولات قيادة موحدة، وملامح مستعملين مغلفة، ويولي اهتماما دقيقا للخصوصا لدى تحرك البيانات الصوتية.

خاتمة

وتتمتع تكنولوجيا الاعتراف بالصوت بإمكانية تحول إمكانية الوصول إلى التطبيقات المتنقلة، مما يتيح للمستعملين ذوي الإعاقة أداة قوية للتفاعل المستقل والفعال والمرضى، ويتطلب التنفيذ الناجح نهجاً شاملاً يجمع بين محركات الخطابات القوية، وأجهزة التوحيد الذكية، ونظم التغذية المرتدة المدروسة، وممارسات التصميم الشاملة، ويجب على المطورين أن يناقشوا التحديات المتعلقة بالدقة، والخصوصية، وقيود الأجهزة مع الحفاظ على تركيز مستعمل على الاحتياجات الحقيقية.

وتبرز أكثر سمات إمكانية الوصول إلى الصوت فعالية من التعاون المباشر مع المستعملين الذين يعانون من إعاقات، والاختبار المتكرر في بيئات واقعية، والالتزام الطويل الأجل بالتحسين، إذ يمكن للمطورين، من خلال معالجة إمكانية الوصول ليس كشرط للامتثال، بل كفرصة تصميم، أن يخلقوا تطبيقات تخدم قاعدة أوسع وأكثر تنوعا للمستعملين، مع دفع المجال كله نحو التفاعل الطبيعي والشامل بين الحواسيب البشرية، ومع استمرار تطور تكنولوجيا التعرف على الخطابات غدا، فإن أفضل الوسائل التي تستثمر في إمكانية الوصول إلى اليوم.