ממשקים מבוססי קול ושיחה עברו במהירות מחידוש להכרחי, לעצב מחדש את האופן שבו אנשים מתקשרים עם מערכות דיגיטליות.בין אם באמצעות רמקולים חכמים, עוזרים וירטואליים, או צ'אטים בשירות לקוחות, ממשקים אלה מבטיחים דרך טבעית, ללא ידיים כדי להשיג דברים לעשות.אבל אותן תכונות שהופכות אותם מושכים - מקיפים, דיאלוג, ואשליה של הבנה אנושית - גם מציגות אתגרים מורכבים, עיצוב יעיל, או עיצוב יעיל של אסטרטגיות יעילות של חשיבה, דורשות יעילה.

עלייתו של טבלאות קול ושיחות

אימוץ מכשירים המופעלים על ידי קול נעשה חומר נפץ.על פי דוחות בתעשייה, יותר מ-40% מהמבוגרים משתמשים כיום בחיפוש קולי יום, ובעלות רמקולים חכמה ממשיכה לטפס. Chatbots הפכו סטנדרטיים באתרי מסחר אלקטרוני, פורטלים בנקאיים ופלטפורמות בריאות.הכוח המניע מאחורי מגמה זו הוא ההבטחה של אינטראקציה ללא חיכוך - משתמשים יכולים פשוט לדבר או להקליד באופן טבעי, על הצורך ללמוד תפריטים מורכבים או פקודות.

עם זאת, המציאות לעתים קרובות נופלת קצר.משתמשים נתקלים באי הבנות, מחלימים מביכים משגיאות, וחוסר מודעות קונטקסט שגורם לשיחות להרגיש רובוטיות.כישלונות אלה מרתיעים את האמון ולהפחית את האימוץ.הנדסה של השימושיות מספקת את המסגרת השיטתית הדרושה כדי לזהות ולפתור בעיות כאלה לפני שהן הופכות למחסומים.על ידי יישום שיטות מוכחות - מחקר משתמשים, הסתברות יזום, הערכה היררטיבית, והיסטורית- מעצבת- מעצבת- מעצבת- מעצבת- מעצבת-עיצובית - מעצבת- מעצבת- מעצבת- מעצבת- מעצבת-מחשבה יכול לעצבן מערכות שיחה שיכולה להרגיש מועילות יותר מאשר להרגיש מועילות יותר מאשר מתסכלת.

מה זה שימוש בהנדסת ממשקי שיחה?

הנדסה שימושיות היא משמעת של תכנון והערכה של מוצרים כדי להבטיח שהם קלים ללמוד, יעיל לשימוש, נעים אינטראקציה עם. כאשר מיושם ממשקי קול ושיחה, זה הולך מעבר לממשק משתמש גרפי מסורתי (GUI) שיקולים. ב-GUI, המשתמש יכול לראות כפתורים, תוויות, משוב, משוב חזותית.

אזורי מפתח של מיקוד כוללים:

  • (ב) ⁇ :0) ⁇ : כיצד המערכת מנחה את המשתמש באמצעות שיחה, טיפול בהליכה, הפרעות ותקיפות.
  • (ב) ⁇ :0) מניעת פלא ושיקום: FLT:1 (עיצוב) אסטרטגיות של נפילה המפחיתות בלבול כאשר המערכת לא נכונה או לא מבינות.
  • (ב) [ה]:0] שימור: [הבא]: [ה] לזכור את האמירות הקודמות ואת העדפות המשתמשים כדי לשמור על אינטראקציות קוהרנטיות ורב-שלביות.
  • (ב) ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇ ⁇
  • (FLT:0) גישה: ההרחבה: (FLT:1) הבטחת הממשק עובדת עבור משתמשים עם דפוסי דיבור שונים, מבטאים, יכולות שמיעה ועומס קוגניטיבי.

ללא יכולת הנדסה, ממשקי שיחה סיכון להפוך גימיקים.עם זה, הם הופכים כלים חזקים אשר להפחית את החיכוך ולהגדיל את שביעות הרצון.

עקרונות שימושיות עבור קול ו Chat

בעוד שעתידנים רבים של שימושיות חלים, עקרונות מסוימים הם קריטיים במיוחד עבור שיחה UIs. אלה יכולים להיות מקובצים בחמישה תחומי ליבה: בהירות, משוב, עקביות, גמישות וטיפול בשגיאות.

קלרנס

בשיחה המדוברת או טקסטאלית, כל מילה חשובה.משתמשים לא צריכים לנחש מה המערכת מבינה או אילו אפשרויות זמינות.קליות מתחילה בשפה פשוטה, לאמבישה.הימנעות מרגנון, הומופונים, או ביטויים שניתן לפרש מספר דרכים.לדוגמה, צ'אט בנק צריך לומר "מאזן החשבון שלך הוא 1,200 דולר" במקום "יש לך 12 מאות על הסימון שלך."

קלרנס גם מרחיבה את הרמזים, במקום לשאול "מה היית רוצה לעשות?" – כלומר מערכת פתוחה מדי – מערכת מעוצבת היטב מספקת רמזים: "אתה יכול לומר 'מאזן צ'ק', 'כספים' או 'Pay a law' טכניקה זו, המכונה לעתים קרובות FLT:0promptingFLT:1, מקטין מדריכים קוגניטיביים ועומס המשתמש לקראת סיום מוצלח.

משוב

ממשקי שיחות חייבים לאשר שהם הבינו את קלט המשתמש.ללא רמזים חזותיים, משתמשים זקוקים לאודיטורים או הודעות טקסטיות. Feedback יכול להיות מיידי ("שמעתי 'התחל שעון במשך 10 דקות' האם זה נכון?") או לא משתמע, כגון טון או סמל חזותי על מסך.המפתח הוא כי המשתמש מעולם לא צריך לתהות אם המערכת קיבלה את הפיקוד שלהם.

Feedback משמש גם מנגנון מניעת טעויות.כאשר המערכת אינה בטוחה, כדאי לבקש הבהרה ולא לעשות הנחה שגויה.לדוגמה, אם משתמש אומר "לתקשר לאמא" ולמערכת יש שני אנשי קשר בשם "אמא", זה צריך להגיב, "מה אמא סמית' או אמא ג'ונסון?", זה מונע טעויות יקרות.

יציבות

משתמשים בונים מודלים נפשיים מאינטראקציות חוזרות ונשנות.אם עוזר קול תמיד מגיב עם "Sure, אני יכול לעזור עם זה" לפני שמתחילים משימה, דפוס זה הופך צפוי.קונסטינסיות בהתרגשות, זמן תגובה, וטיפול בשגיאות בונה אמון.מערכת שלפעמים משתמשת בשפה מזדמנת ("Yep, עשה") ופעמים רשמיות אחרות ("בקשתך מעובד").

עקביות גם חלה על מבנה הדיאלוג הכולל.אם בוט צ'אט מאפשר למשתמשים לומר "עזרה" בכל נקודה כדי לראות רשימה של פקודות, אותו שברחת בריחה חייבת לעבוד בכל ההקשר.התנהגות בלתי עקבית היא אחת התסכולים המובילים שדווחו במחקרים על שימושיות של ממשקי שיחה.

גמישות

אנשים לא מדברים באותה דרך בכל פעם.הם עשויים לומר "להתראות של 7 AM", "וייק אותי בשבעה" או "אני צריך אזעקה במשך 7 בבוקר" ממשק שיחה יעיל מתאים לריאציות ב- phrasing, נרדפות ואפילו שגיאות דקדוקיות.זה דורש הבנה טבעית מתוחכמת (NLU) מודלים ומדורגים גדולים של אימון נתונים.

גמישות פירושה גם לאפשר למשתמשים לתקן את עצמם או לשנות את דעתם באמצע הדיאלוג.לדוגמה, אם משתמש אומר "Book a Flight to Paris", ולאחר מכן מוסיף "למעשה, להפוך את לונדון", המערכת צריכה להתאים מבלי לחדש את האינטראקציה כולה.

טעות

שגיאות הן בלתי נמנעות בשיחות קוליות וטקסט. רעש רקע, מבטאים, שאילתות מעורפלות, וגלימות טכניות יכולות לגרום למערכת להבין בצורה לא נכונה.איך הממשק מטפל ברגעים אלה מגדיר את התפיסה הכוללת של המשתמש של איכות.

טיפול בשגיאות טוב עוקב אחרי כמה כללים:

  • [ה]הכרת הבעיה: [ה] לא תעמיד פנים שאתה מבין כשאתה לא.
  • [01:0] , מדרש: "וַיַּּהְּהָעָה אֲשֶׁר עַמֶּה אֲשֶׁר הוּא עַמֶּה אֱלֹהִים" (בתרגום חופשי: "ה')
  • [ה]ה': "לא מאשים את המשתמש: 'ה', אל תאשימו את המשתמש: 'ה', אל תמנעו ביטויים כמו 'אמרתם משהו לא נכון', במקום זאת, השתמשתי ב'לא הבנתי את זה'.
  • (ב) אם המערכת נכשלת שוב ושוב, העברה לסוכן אנושי או מספקת אלטרנטיבה ברורה (למשל, "יש לי בעיה.

אסטרטגיות עיצוב לחוויות קוליות-ראשיות

מעבר ליישום עקרונות בסיסיים, מעצבים חייבים לאמץ אסטרטגיות ספציפיות המותאמות למגבלות ולהזדמנויות הייחודיות של ממשקי קול וצ'אט.

השתמש בשפה טבעית, אבל מדריך את השיחה

אחת הטעויות הגדולות ביותר היא לחקות שיחה אנושית הדוקה מדי, יצירת ציפיות לא מציאותיות.משתמשים מתוסכלים במהירות כאשר chatbot משתמש בשפה מזדמנת אך לא יכול להתמודד עם שאלה פשוטה מעקב אחר כך, הגישה הטובה ביותר היא להשתמש בשפה טבעית וידידותית ועדיין מגבילים את האינטראקציה בתוך היכולות של המערכת.לדוגמה, בוט הזמנת מלון עשוי לומר, "אני יכול לעזור לך למצוא חדר."

לשבור את משימות מורכבות לצעדים פשוטים

ממשקי קול מתאימים למשימות ארוכות, מורכבות הדורשות קריאה או השוואת אפשרויות רבות.במקום, לשבור את המשימה לסדרה של צעדים קטנים, לוגיים, שכל אחת מהן אישרה לפני שהיא מתקדמת.לדוגמה, הזמנת טיסה צריכה קודם לבקש יעד, ואז מספר הנוסעים - תוך מתן אישור בין כל אחת. גישה זו מחייבת מפחיתה עומס קוגניטיבי ומפחיתה שגיאות.

שילוב מודעות Context

ממשקי שיחה גדולים זוכרים מה נאמר קודם לכן בפגישה, אם משתמש שואל "מה מזג האוויר בטוקיו?", ולאחר מכן עוקב אחר "ומחר?", המערכת צריכה להבין ש"מחר" מתייחס לטוקיו.

מודעות קונטקסט כוללת גם שילוב עם נתוני משתמשים כאשר ניתנת אישור, עוזר מוזיקה שמכיר את הז'אנרים האהובים עליכם מאינטראקציות קודמות יכול להתאים אישית הצעות מבלי שתצטרכו לחזור על העדפות.

עיצוב שגיאות מההתחל

במקום לקוות שמנוע NLU יהיה מושלם, נניח כי שגיאות יקרה ועיצוב סביבם.זה אומר בניית שכבות מרובות של נפילה: Re-prompting, המציעה משחות חלופיות, וכאתר אחרון, בחסד לצאת מהמשימה.זה גם פירושו בדיקות עם משתמשים אמיתיים על פני מבטאים וסביבות שונות כדי לגלות מצבי כישלונות מוקדם.

שימוש ב- Multimodal Feedback כאשר ניתן

ממשקי קול רבים פועלים כעת על מכשירים עם מסכים (טלפונים חכמים, תצוגות חכמות, לוחות נתונים של מכונית) בשילוב קול עם אלמנטים חזותיים - כגון הצגת רשימה של תוצאות התאמה או אינדיקטור התקדמות - באופן דרמטי משפר את יכולת השימושיות. משתמשים יכולים לשמוע את התגובה המדוברת ולראות אותה מאושרת בטקסט, צמצום האווירה.

אתגרים אפשריים

למרות ההתקדמות בעיבוד שפה טבעית, כמה אתגרים מתמידים הופכים את עיצוב UI שיחה קשה במיוחד.

מפקדים שאפתניים

שפה אנושית היא רבת לב: "לנגן כמה מוזיקה" יכול להיות כל ז'אנר, מקלאסי לפופ. "לתקשר למשרד" יכול להתייחס למספר משרדים ראשי או למשרד הבית של המשתמש.המערכת חייבת לשאול שאלות או להשתמש בהקשר (זמן של יום, היסטוריה של המשתמש) כדי לבצע ניחושים משכילים.ה האיזון בין להיות פרואקטיבית ועצבני הוא עדין גישה נפוצה לבקש אישור כאשר ביטחון נמוך, אך הוא יכול להיות משוחרר.

ניהול פרטיות ואבטחה

מכשירים מבוססי קול תמיד מקשיבים למילה מתעוררת, העלאת חששות הפרטיות. משתמשים חוששים מהקלטות מאוחסנים, ניתחו או דלפו.מדיניות פרטיות טרנסנדנד, הסכמה ועיבוד שכפול (במקום מבוסס ענן) יכול לעזור.עבור משימות רגישות כמו בנקאות או בריאות, הממשק חייב להשתמש באימות מאובטח - לעתים קרובות שילוב ביומטריות קוליות עם PIN - ללא חיכוך.

הבטחת נגישות לכל המשתמשים

ממשקי שיחה יש פוטנציאל להיות נגיש באופן מדהים עבור אנשים עם ליקויים חזותיים או מוגבלות מוטורית.עם זאת, הם יכולים גם להוציא משתמשים עם ליקויי דיבור, מבטאים חזקים, או ליקויים קוגניטיביים.מעצבים חייבים להבטיח שהמערכת תכיר בטווח רחב של דפוסי דיבור, לספק חלופות טקסט עבור כל אינטראקציות קוליות, ולאפשר למשתמשים לשלוט בקצב הדיאלוג.

שיטות בדיקה והערכה

הנדסה שימושיות דורשת בדיקה קפדנית. עבור ממשקי שיחה, שיטות מסורתיות יש להתאים כדי ללכוד את הזרם הייחודי של דיאלוג המדובר.

קוסם של בדיקות עוץ

בשלבים המוקדמים של העיצוב, אדם "מרוצה" מדמה את התגובות של המערכת בעוד משתמש אינטראקציה עם מה שהם מאמינים הוא מערכת אוטומטית לחלוטין.זה בלתי חוקי לבדיקת זרימת דיאלוג ואסטרטגיות של שיתוף פעולה שגיאות לפני כל קוד כתוב.זה מגלה כיצד משתמשים מבקשים באופן טבעי ביטוי והיכן הם מתבלבלים.

כיוונים קוגניטיביים

מעצבים עוברים דרך השיחה מנקודת מבטו של המשתמש, ושואלים בכל נקודה: "האם המשתמש יודע מה לומר הבא? האם הם רואים כיצד להתאושש משגיאה?", שיטה זו מועילה במיוחד לזיהוי תגובות חסרות או מערכות מעורפלות.

Live User Testing

משתמשים אמיתיים מקבלים משימות ספציפיות (למשל, להזמין פיצה גדולה פלפלוני) בעוד החוקרים צופים היכן הם מהססים, חוזרים על עצמם, או נוטשים את המשימה. mtrics כגון קצב הצלחה, זמן להשלמת, ומספר של חזרות עלות מודחקות משתמשים מספק הוכחה כמותית לבעיות של שימושיות.

ניתוח קידוד A / B Testing

ברגע שהממשק הוא פרוס, ניתוח יומני שיחות בפועל מגלה דפוסים של כישלון.מה כוונות לגרום ליתרונות החוזרים ביותר?איזה זעזועים מובילים לשגיאות? A/B בדיקות של סגנונות שונים או תגובות ממותרות שגיאות יכולות לייעל את הביצועים על זבוב.

כיוונים עתידיים

תחום של שימושיות שיחה מתפתח במהירות.כמה מגמות מצביעות על ממשקים יותר מוכשרים ואנושיים.

שיפור השפה הטבעית

ההתקדמות במודלים גדולים בשפה (LLMs) ולמידה עמוקה הופכת מערכות טוב יותר בהבנה ההקשר, סרקזם, ובקשות עקיפות.עם זאת, שיפורים NLU גולמיים חייבים להיות מחוברים עם הנדסת יכולת כדי להבטיח כי יכולות חדשות לא להגביר את הבלבול. לדוגמה, מערכת שיכולה לענות על שאלות פתוחות יכול להתחיל לתת תשובות מתועשות יתר, אשר מזיקים למעצבים יצטרכו כדי לאזן את האיזון.

אישיות

ממשקים עתידיים ייסנו פרופילים עמוקים של משתמשים בודדים – למידה לא רק העדפות אלא משימות טיפוסיות, סגנון תקשורת ואפילו מצב רגשי (באמצעות ניתוח טון) זה מעלה אתגרים של יכולת סביב שקיפות ושליטה: משתמשים חייבים להיות מסוגלים לראות, לערוך ולמחוק את הנתונים האישיים שלהם.הממשק צריך לבקש הסכמה באופן ברור ולא פולשני.

אינטראקציות מרובות-בינוניות ופרואקטיביות

במקום לחכות לפקודה, מערכות יזום עשויות להציע עזרה בהתבסס על ההקשר – "אני רואה שאתה רץ באיחור, האם אני צריך לבטל את הפגישה 9 AM שלך?", יש לתכנן תכונות כאלה בזהירות כדי להימנע מלהיות פולשנית.מחקר שימושי יצטרך להגדיר את הסף הנכון להפרעות ואת הנאות הנמוסימות המתאימות.

סטנדרט והירויים

בדיוק כפי שהאיריסטיים של בטהובן נילסן עיצבו את העיצוב של GUI, קבוצה דומה של היסטרים לממשקים שיחה מתפתחת.ארגונים כמו קבוצת נילסן נורמן פרסמו הנחיות למדידת אינטראקציה קולית (ראה:0) אינטראקציה: הנחיות שימושיות: הנחיות להנחיות ייצובFLT:1).

מסקנה

ממשקי שיתוף פעולה ושיחה מחזיקים בהבטחה עצומה להכנת טכנולוגיה נגישה יותר וחסרת מאמץ.אבל הבטחה זו יכולה רק להיות מושגת כאשר הנדסה שימושיות מוחלת כמשמעת הליבה, לא לאחר שהשקעה בבהירות, משוב, עקביות, גמישות וטעייה חזקה טיפול - ועל ידי בדיקות עם משתמשים אמיתיים לאורך כל תהליך העיצוב - ארגון יכול ליצור חוויות שיחה שאנשים באמת רוצים להשתמש בטכנולוגיה, להמשיך ולדמיין את עקרונות הזמן המושלם של יצירת קשר אמיתי, אבל לא יהיה מושלם של יכולת הדיבור שלנו, אלא גם על בסיס הזמן, אלא על בסיס הזמן, אשר הוא עדיין על בסיס הידע של יצירת עקרונות היכולת של יצירת קשר אמיתי של יצירת קשר אמיתי של יצירת קשר אמיתי של יצירת קשר אמיתי של יצירת קשר אמיתי של יצירת קשר עם מטרות אמנותי קשר אמיתי של יצירת קשר עם מטרות של יצירת קשר אמיתי של יצירת קשר עם מטרות של יצירת קשר אמיתי של יצירת קשר אמיתי של יצירת קשר עם מטרות של יצירת קשר אמיתי של עבודת מחשבתי עם מטרות עבודה, אשר הוא מבטיח, אשר הוא הנכון, אך ורק על בסיס אמיתי של יצירת קשר אמיתי של יצירת קשר עם מטרות עבודה, אשר הוא עדיין, אבל הוא מבטיח, אך ורק על בסיס טוב עם עקרונות עבודה, אשר הוא מבטיח, אשר הוא עדיין לא נכון של עבודת מחשבתי עם עקרונות עבודה, אשר הוא עדיין לא נכון של יצירת קשר אמיתי של