הגדרות מתקדמות של דיבור

במדריך הזה מפורטות הגדרות מתקדמות נוספות לתכונות של דיבור. כדי להפעיל או להשבית את ההגדרות המתקדמות האלה, עוברים אל הגדרות הסוכן > דיבור ותגובה קולית אינטראקטיבית > המרת דיבור לטקסט > הגדרות מתקדמות של דיבור.

ההגדרות האלה זמינות בהגדרות הסוכן (חלות על הסוכן כולו), בהגדרות התהליך (חלות על התהליך כולו ומבטלות את הגדרות הסוכן), בהגדרות הדף (חלות על הדף ומבטלות את הגדרות התהליך והסוכן) ובהגדרות ההשלמה (חלות על ההשלמה ומבטלות את הגדרות הדף, התהליך והסוכן). קבוצת משנה של ההגדרות האלה זמינה בכל רמה, בהתאם לרלוונטיות של ההגדרה לרמה. *כדי להגדיר את ההגדרות האלה ברמה נמוכה יותר, צריך קודם לסמן את התיבה הפעלת הגדרות מתקדמות של דיבור ברמת הסוכן (הגדרות הסוכן > דיבור ו-IVR > המרת דיבור לטקסט > הגדרות מתקדמות של דיבור)*.

ההגדרות המעודכנות ברמת הסוכן לא מועברות לרמת התהליך, הדף וההשלמה אם האפשרות התאמה אישית נבחרה ברמות הנמוכות האלה. אם האפשרות התאמה אישית כוללת כמה הגדרות ואתם רוצים לעדכן רק חלק מהן, יכול להיות שתצטרכו לעדכן גם הגדרות אחרות כדי שהן יהיו זהות להגדרות ברמת הסוכן.

הגדרת הזמינות לפי רמה

בטבלה הבאה אפשר לראות אילו הגדרות מתקדמות של דיבור זמינות בכל רמה:

שם ההגדרה סוכן Flow דף טיפול בהזמנות
בחירת מודל (המרת דיבור לטקסט)
רגישות לסיום הדיבור
רגישות מתקדמת לסיום הדיבור על סמך פסק זמן
הפעלת קביעת נקודות סיום חכמה
אין זמן קצוב לתפוגה של הדיבור
התפרצות לשיחה
אפשר לבטל את ההפעלה של מילוי חלקי
באקט לייצוא אודיו
DTMF

בחירת מודל (המרת דיבור לטקסט)

אפשר להגדיר את ההגדרה הזו ברמת הסוכן, התהליך והדף.

הגדרת מודל הדיבור שמשמש לזיהוי דיבור. ההגדרה הזו היא ספציפית לשפה, כך שאפשר לבחור מודלים שונים לשפות שונות. אפשר גם לסמן את התיבה Override request-level speech model (החלפת מודל דיבור ברמת הבקשה). אם תסמנו אותה, המודל שנבחר ישמש גם אם קריאה ל-API בזמן הריצה תציין מודל אחר.

במאמר בנושא מגבלות מופיע מידע על Dialogflow CX Phone Gateway. מידע נוסף זמין במאמר בנושא מודלים של דיבור.

רגישות לסיום הדיבור

אפשר להגדיר את ההגדרה הזו ברמת הסוכן, התהליך והדף.

קובעת את הרגישות לזיהוי סוף הדיבור בקלט אודיו של משתמש קצה. הערך נע בין 0 (רגישות נמוכה, פחות סביר שהדיבור יסתיים) לבין 100 (רגישות גבוהה, סביר יותר שהדיבור יסתיים).

רגישות מתקדמת לסיום הדיבור על סמך פסק זמן

אפשר להגדיר את ההגדרה הזו ברמת הסוכן ולהשבית אותה ברמת התהליך וברמת הדף.

אם ההגדרה הזו מופעלת, הערך של ההגדרה רגישות לסיום הדיבור משמש כמדד לקביעת פסק זמן יחסי של שקט באודיו, כדי לקבוע את סיום הדיבור. אם ההגדרה הזו מושבתת (ברירת המחדל), הערך של ההגדרה רגישות לסיום הדיבור משמש לקביעת סיום הדיבור על ידי מודל ה-ML שסופק על ידי Google Cloud Speech-to-Text.

ההגדרה End of speech sensitivity (רגישות לסיום הדיבור) תומכת כברירת מחדל רק במודל הדיבור phone_call של תג en-US השפה. ההגדרה Enable advanced timeout-based end of speech sensitivity (הפעלת רגישות מתקדמת לסיום הדיבור על סמך פסק זמן) מאפשרת להגדיר רגישות לסיום הדיבור לכל השפות ולכל מודלי הדיבור שנתמכים על ידי Dialogflow.

הפעלת קביעת נקודות סיום חכמה

אפשר להגדיר את ההגדרה הזו רק ברמת הסוכן.

אם ההגדרה הזו מופעלת, מערכת Dialogflow CX תנתח קלט של משתמשים חלקי כדי לקבוע את סוף הדיבור. לדוגמה, אם המשתמש אומר "I would like to" (אני רוצה) ועוצר, Dialogflow CX ימתין שהמשתמש ימשיך את המשפט.

התכונה הזו שימושית במיוחד לאיסוף פרמטרים מספריים, למשל אם המשתמש אומר '1234', עוצר ואז אומר '5678'. כדי להחיל את ההגדרה הזו על פרמטר ספציפי, צריך להגדיר הגדרת נקודות קצה חכמה בטופס של הפרמטר.

ההגדרה הזו זמינה רק לתג השפה en-US ומושבתת כברירת מחדל.

אין זמן קצוב לתפוגה של הדיבור

אפשר להגדיר את ההגדרה הזו ברמת הסוכן, התהליך והדף.

משך הזמן בשניות שבו Dialogflow CX יפסיק להמתין לקלט אודיו של משתמש קצה. ברירת המחדל היא 5 שניות, והערך המקסימלי הוא 60 שניות. במקרה של פסק זמן כזה, מערכת Dialogflow CX מפעילה אירוע ללא קלט.

התפרצות לשיחה

אפשר להגדיר את ההגדרה הזו ברמת הסוכן, התהליך וההשלמה.

כשההגדרה הזו מופעלת, משתמשי קצה יכולים להפסיק את האודיו של התשובה ב-Dialogflow CX. אם יש הפרעה, מערכת Dialogflow CX תפסיק לשלוח אודיו ותעבד את הקלט הבא של משתמש הקצה.

אם יש כמה הודעות בתור ההודעות, והודעה מסוימת הוכנסה לתור על ידי מילוי משויך לדף, לזרימה או לסוכן שהאפשרות 'הצטרפות לשיחה' מופעלת בהם, אז גם האפשרות 'הצטרפות לשיחה' תופעל בכל ההודעות הבאות בתור. במקרה כזה, השילוב יפסיק להשמיע אודיו לכל ההודעות בתור עם האפשרות 'התפרצות לשיחה' מופעלת.

אפשר לבטל את ההפעלה של מילוי חלקי

אפשר להגדיר את המאפיין הזה רק ברמת המימוש.

אפשר להפעיל את ההגדרה הזו אם תיבת הסימון הפעלת הגדרות מתקדמות של דיבור מסומנת בהגדרות הסוכן > דיבור ו-IVR ומילוי חלקי מופעלת ברמת מילוי הבקשה. ההגדרה הזו מאפשרת לבטל הפעלה של תגובה חלקית.

אם הודעה בתור ההודעות נוצרה על ידי מילוי בקשה שמאפשר ביטול, ההפעלה של ההודעה תבוטל אם תתווסף לתור הודעה אחרת. האפשרות הזו שימושית כשרוצים שההפעלה תתחיל עם הודעה ראשונית, אבל שההפעלה הזו תבוטל אם webhook פעיל ייצור הודעה אחרת לפני שההפעלה של ההודעה הראשונית תסתיים.

באקט לייצוא אודיו

אפשר להגדיר את ההגדרה הזו ברמת הנציג וברמת התהליך.

אם מסופקים נתונים, כל נתוני האודיו שמשויכים לבקשה יישמרו בקטגוריה של Cloud Storage:

האודיו נשמר בקשות רלוונטיות
קלט אודיו של משתמשי קצה DetectIntent, ‏ StreamingDetectIntent, ‏ AnalyzeContent, ‏ StreamingAnalyzeContent
אודיו של המרת טקסט לדיבור (TTS) שסונתז לתשובה AnalyzeContent, StreamingAnalyzeContent

מקצים את התפקיד Storage Object Creator לחשבונות השירות הבאים בפרויקט:

  • לחשבון השירות בפורמט one-click@df-cx-ALPHANUMERIC_VALUE-ALPHANUMERIC_VALUE.iam.gserviceaccount.com אם משתמשים בשילוב טלפוני מובנה של שותף.

  • לחשבון השירות בפורמט service-PROJECT_NUMBER@gcp-sa-dialogflow.iam.gserviceaccount.com אם משתמשים בשילוב של Dialogflow CX Phone Gateway. כדי למצוא את חשבון השירות הזה ב-IAM, מסמנים את האפשרות Include Google-provided role grants.

DTMF

מידע נוסף על התכונה הזו מופיע במסמכי התיעוד בנושא DTMF (איתות רב-תדר כפול).