- בית
- /
- מאמר
מיקום נתונים ב- Webex Contact Center מבטיח שהנתונים נשמרים רק בזיכרון במהלך החישוב ולעולם אינם מאוחסנים מחוץ לאזור המיועד להם. כל נתוני הלקוחות המתמידים (תצורה, יומנים וכו') נשארים באזור שצוין, ומעבדי משנה פועלים תחת בקרות חוזיות, טכניות וביקורת קפדניות. מדיה ונתונים רגישים לעולם אינם נשמרים לאחר עיבודם, ודרישות מיקום נתונים אזוריות ופרטיות נאכפות בקפדנות. ניהול ידע משתמש בעדכונים בזמן אמת כדי להבטיח דיוק תוכן, כאשר כל הטיפול בנתונים מותאם לתקני הרגולציה והאבטחה.
הגדרות עיקריות
כמה הגדרות מפתח במאמר זה כוללות:
- עיבוד נתונים: הפעולה של ביצוע פעולות חישוביות (כגון תמלול, הסקה או סינתזה) על נתוני לקוחות. לא מאוחסנים נתוני לקוחות במהלך העיבוד; הנתונים קיימים רק באופן זמני בזיכרון נדיף (RAM) והם נמחקים מיד לאחר השלמת העיבוד.
- מיקום ואחסון נתונים: מתייחס למקום שבו נתוני לקוחות מאוחסנים באופן קבוע ("במנוחה"). הדבר כולל תצורה, הגדרות ספציפיות לדייר ויומני רישום מאוחסנים.
- תושבות מדיה: מדיה (כגון זרמי שמע) נשארת במיקום המקור שלה זמן רב ככל האפשר ואינה מועברת או מאוחסנת באופן עקבי מחוץ לאזור, גם אם העיבוד מתרחש באזור גיאוגרפי אחר.
- מעבד משנה: ספק שירות צד שלישי העוסק בביצוע פונקציות ספציפיות (למשל, הסקת LLM, זיהוי דיבור) על נתוני הלקוח, תחת בקרות חוזיות וטכניות קפדניות.
עיבוד נתונים לעומת תושבות נתונים
עבור לקוחות הפועלים באזורים מוסדרים כגון סינגפור, אנו מבחינים בין המקום שבו הנתונים מאוחסנים (תושבות) לבין המקום שבו הנתונים מחושבים (עיבוד).
ריבונות נתונים אזורית
ריבונות נתונים אזורית מבטיחה שנתוני הלקוחות מנוהלים בהתאם לתקנות המקומיות, ומציינת היכן מאוחסנים הנתונים וכיצד הם מטופלים במהלך העיבוד. העקרונות הבאים חלים:
- נתונים במנוחה: כל נתוני הלקוחות המתמידים, כולל תצורה, הגדרות ספציפיות לדייר ויומני רישום מאוחסנים, מאוחסנים באזור סינגפור.
- נתונים במעבר: כדי למנף אשכולות GPU בעלי ביצועים גבוהים הדרושים עבור מודלי שפה גדולים (LLM) וזיהוי דיבור מתקדם (ASR), ייתכן שהנתונים יעובדו מחוץ לסינגפור. עם זאת, עיבוד פירושו חישוב בלבד: הנתונים מועברים באמצעות ערוצי TLS 1.2+ מוצפנים, קיימים רק בזיכרון RAM למשך העיבוד, ואינם מאוחסנים במיקום העיבוד.
המדיה נשארת מאוחסנת באזור המקור שלה זמן רב ככל האפשר. רק עיבוד ארעי מתרחש בחוץ, בהתבסס על דרישות ארגוניות ושירותיות.
עיבוד לוגיקת לוקליות
אנו לא מפעילים פרוקסי LLM מקומיים בכל גיאוגרפיה כדי להבטיח:
- שוויון אבטחה: עיבוד מרכזי מאפשר פריסה מיידית של תיקוני אבטחה ואכיפה של מעקות בטיחות לדוגמה.
- גמישות: הפצה גלובלית מונעת הפסקות חשמל על-ידי ניתוב מחדש של בקשות הסקה אם מרכז נתונים מקומי נתקל בבעיה.
תושבות נתונים עבור סוכני AI ב Webex Contact Center
מיקום הנתונים עבור רכיבי AI Agent משתנה בהתאם לאזור ולספק השירות. הטבלה הבאה מסכמת היכן הנתונים מעובדים ומאוחסנים עבור רכיבי AI מרכזיים באזורים שונים של סוכן AI:
|
אזור |
עיבוד נתונים (ASR / TTS / Core) |
עיבוד נתונים (LLM) |
מיקום נתונים (אחסון) |
|---|---|---|---|
|
produs1 (ארה"ב) |
AWS: N. וירג'יניה, נ. קליפורניה
STT/TTS של Azure: מזרח ארה"ב, מערב ארה"ב
Deepgram: N. וירג'יניה, N. קליפורניה
ElevenLabs: N. Virginia, N. California |
Azure Open AI: N. וירג'יניה, נ. קליפורניה
LLM Proxy: N. וירג'יניה, N. קליפורניה |
ארה"ב (Home DC) |
|
prodeu1 (בריטניה) |
AWS: לונדון, בריטניה
Azure STT/TTS: דרום בריטניה, צפון דרום אפריקה |
Azure Open AI: לונדון, בריטניה
פרוקסי LLM: לונדון, בריטניה |
בריטניה (Home DC) |
|
prodeu2 (האיחוד האירופי) |
AWS: Frankfurt, גרמניה
תכלת STT/TTS: צפון איחוד האמירויות הערביות, גרמניה מערב מרכז |
Azure Open AI: פרנקפורט, גרמניה
LLM Proxy: פרנקפורט, גרמניה |
האיחוד האירופי (Home DC) |
|
prodca1 (קנדה) |
AWS: מרכז קנדה
Azure STT/TTS: Global* |
Azure Open AI: גלובלי*
פרוקסי LLM: מרכז קנדה |
קנדה (Home DC) |
|
prodjp1 (יפן) |
AWS: Tokyo, יפן
Azure STT/TTS: Global* |
Azure Open AI: גלובלי*
LLM Proxy: טוקיו, יפן |
יפן (Home DC) |
|
prodanz1 (אוסטרליה) |
AWS: סידני, אוסטרליה
Azure STT/TTS: Global* |
Azure Open AI: גלובלי*
פרוקסי LLM: סידני, אוסטרליה 31 |
אוסטרליה (Home DC) |
|
prodsg1 (סינגפור) |
AWS: סינגפור
Azure STT/TTS: Global* |
Azure Open AI: גלובלי*
LLM Proxy: סידני, אוסטרליה |
סינגפור (Home DC) |
|
prodin1 (הודו) |
AWS: Mumbai, הודו
Azure STT/TTS: מרכז הודו |
Azure Open AI: מרכז הודו
LLM Proxy: מומבאי, הודו |
הודו (Home DC) |
*בקשות אלה יכולות להגיע לכל מרכז נתונים, ברחבי העולם, שבו מודלים אלה מתארחים. ניתן למצוא מידע נוסף אודות Azure Data Residency כאן.
תושבות נתונים עבור AI Assistant ב Webex Contact Center
מיקום הנתונים עבור רכיבי AI Assistant משתנה בהתאם לאזור ולספק השירות. הטבלה הבאה מסכמת היכן הנתונים מעובדים ומאוחסנים עבור רכיבי AI Assistanct מרכזיים באזורי AI שונים:
|
אזור |
AWS | Azure STT/TTS |
Voicea STT |
פרוקסי LLM (פנימי) | Azure Open AI |
|---|---|---|---|---|---|
|
produs1 (ארה"ב) |
נ. וירג'יניה, נ. קליפורניה | מזרח ארה"ב, מערב ארה"ב | הכללית** |
נ. וירג'יניה, נ. קליפורניה |
נ. וירג'יניה, נ. קליפורניה |
|
prodeu1 (בריטניה) |
לונדון, בריטניה
|
דרום בריטניה, צפון דרום אפריקה | הכללית** |
לונדון, בריטניה |
לונדון, בריטניה |
|
prodeu2 (האיחוד האירופי) |
Frankfurt, גרמניה |
צפון איחוד האמירויות הערביות, גרמניה מערב מרכז | הכללית** |
Frankfurt, גרמניה |
Frankfurt, גרמניה |
|
prodca1 (קנדה) |
מרכז קנדה | הכללית* | הכללית** |
מרכז קנדה |
הכללית* |
|
prodjp1 (יפן) |
טוקיו, יפן | הכללית* | הכללית** |
טוקיו, יפן |
הכללית* |
|
prodanz1 (אוסטרליה) |
סידני, אוסטרליה | הכללית* | הכללית** |
סידני, אוסטרליה |
הכללית* |
|
prodsg1 (סינגפור) |
סינגפור | הכללית* | הכללית** |
סידני, אוסטרליה |
הכללית* |
|
prodin1 (הודו) |
אסיה פסיפיק (מומבאי), הודו | מרכז הודו | לא ישים | סידני, אוסטרליה | סידני, אוסטרליה |
*בקשות אלה יכולות להגיע לכל מרכז נתונים, ברחבי העולם, שבו מודלים אלה מתארחים. ניתן למצוא מידע נוסף אודות Azure Data Residency כאן.
** Voicea מתגוררת באירופה-מערב1/בריסל/בלגיה ואירופה-מערב4/אמסטרדם/הולנד. Voicea מבצעת עיבוד נתונים בלבד. לא נשמרים נתונים באתרי הפריסה של Voicea.
עיבוד ארעי ואפס שימור
היבט בסיסי של ארכיטקטורת הבינה המלאכותית שלנו הוא המחויבות לעיבוד ארעי ואפס שמירת נתונים. הגישה שלנו נותנת עדיפות לפרטיות ואבטחת נתונים על ידי הבטחה שפרטי הלקוחות לעולם לא יאוחסנו או יישמרו במהלך פעולות AI.
- נראות ASR ו-TTS: במהלך תמלול בזמן אמת (ASR) או סינתזת דיבור (TTS), הנתונים קיימים רק בזיכרון הנדיף (RAM) של מנוע העיבוד ונמחקים מיד לאחר השימוש. נתונים אינם מאוחסנים או נשמרים לאחר העיבוד.
- בקרת גישה: לאף עובד אנושי (פנימי או מעבד משנה) אין גישה לזרמי שמע או טקסט גולמיים במהלך שלב ההסקה.
- ללא שימוש משני: אנו שומרים על מחסומים חוזיים וטכניים קפדניים כדי להבטיח שנתוני לקוחות - כולל הנחיות ושמע - לעולם לא ישמשו לאימונים, להכשרה מחדש או לשיפור מודלים בסיסיים בבעלות מעבדי משנה.
פיקוח על מעבדי משנה (ספקי Voicea ו- LLM)
אנו מבצעים הערכות סיכונים קפדניות של צד שלישי בכל מעבדי המשנה.
- הערכות סיכונים של צד שלישי: כל מעבדי המשנה עוברים הערכה קפדנית.
- הצפנה: נתונים הנשלחים למעבדי משנה מוצפנים במעבר, מעובדים רק בזיכרון RAM ולעולם אינם מאוחסנים.
- יכולת ביקורת: כל קריאות API למעבדי משנה נרשמות למטרות ביקורת (מטה-נתונים בלבד; מטענים רגישים אינם נכללים ביומני רישום).
- אחריות על אירועים: במקרה של תקרית נתונים במעבד משנה, [החברה שלך] שומרת על אחריות ראשית ומטפלת בכל ההודעות והתיקונים של הלקוחות בהתאם לנספח עיבוד הנתונים הסטנדרטי שלנו (DPA).
שמירת נתונים וניהול מחזור חיים
כדי להבטיח שקיפות, הטבלה הבאה מתארת בדיוק כמה זמן הנתונים מוחזקים במערכת האקולוגית שלנו:
|
סוג נתונים |
תקופת שמירה (בימים) |
מצב אחסון |
מטרה |
|---|---|---|---|
|
שמע/תמליל בזמן אמת |
0 |
לא מאוחסן |
נמחק מיד לאחר סיום ההפעלה. |
|
היסטוריית הפעלות של AI Agent |
X |
מאוחסן (SG) |
מספק הקשר לשיחות TURN מרובות. |
|
יומנים תפעוליים |
90 |
מאוחסן (SG) |
פתרון בעיות וניטור תקינות המערכת. |
|
מפתחות הצפנת דיירים |
ללא הגבלת זמן |
מאוחסן (KMS) |
מפתחות מנוהלים על-ידי לקוחות או מפתחות מערכת עבור נתונים במנוחה. |
ניהול ידע ודיוק תוכן
AI Assistant שלנו משתמש בארכיטקטורה של Retrieval-Augmented Generation (RAG). זה מבטיח שהבינה המלאכותית מספקת תשובות המבוססות על מסמכי "אמת קרקעית" ספציפיים ולא על אימון מודל פנימי.
- עדכוני URL/מסמך: כאשר מקור ידע מתעדכן, המערכת יוצרת אינדקס מחדש של התוכן ומחליפה גירסאות קודמות.
- השהיה: תוכן מעודכן משתקף בדרך כלל בתגובות הבינה המלאכותית תוך [X] דקות.
- טיפול במטמון: הפעלות פעילות משתמשות בהקשר הזמין בתחילת ההפעלה; עם זאת, כל ההפעלות הבאות נאלצות לבצע שאילתה על האינדקס העדכני ביותר, ומונעות שימוש חוזר בנתונים מעופשים או "הזויים".
מקרה קצה – אם תקנה אזורית ספציפית אוסרת על עיבוד כלשהו מחוץ לאזור, ייתכן שיידרשו בקרות נוספות או אפשרויות עיבוד מקומיות.
חשוב – "עיבוד" לעולם אינו מרמז על אחסון נתונים; כל אחסון נתונים מתמיד עומד בקפדנות בכללי התושבות האזוריים.
ElevenLabs ו-Deepgram משמשים כמעבדי משנה מבוססי האיחוד האירופי למשימות דיבור ותמלול מסוימות, תמיד תחת בקרות חוזיות וטכניות קפדניות, עם אפס שמירת נתונים לאחר עיבוד.
תרחיש לדוגמה
משתמש בסינגפור יוזם הפעלת תמלול. זרם השמע מעובד בזמן אמת על ידי רכזת LLM גלובלית באמצעות ערוצים מוצפנים, אך לא מאוחסן שמע או תמליל במהלך או לאחר עיבוד מחוץ לסינגפור. רק הקשר או יומני רישום מותרים (לעולם לא התוכן עצמו) נשמרים בהתאם לטבלה לעיל.