ממשק Google Chat API הוא שירות משותף, ולכן אנחנו מטילים עליו מכסות ומגבלות כדי לוודא שכל המשתמשים משתמשים בו בצורה הוגנת וכדי להגן על הביצועים הכוללים של Google Workspace.
אם תחרגו ממכסה, תקבלו קוד סטטוס 429: Too many requests HTTP בתשובה. יכול להיות שגם בדיקות נוספות של מגבלת הקצב בשרת העורפי של Chat יגרמו לתגובה שגיאה זהה. אם השגיאה הזו מתרחשת, צריך להשתמש באלגוריתם של השהיה מעריכית לפני ניסיון חוזר ולנסות שוב מאוחר יותר. כל עוד אתם לא חורגים מהמכסות לדקה שמפורטות בטבלאות הבאות, אין הגבלה על מספר הבקשות שאתם יכולים לשלוח ביום.
יכול להיות שסוגים שונים של מכסות יחולו על שיטות של Chat API: מכסות לכל פרויקט, לכל מרחב ולכל משתמש.
מכסות לכל פרויקט
מכסות לכל פרויקט מגבילות את קצב השאילתות לפרויקט בענן ב-Google Cloud, ולכן הן חלות על אפליקציית Chat אחת שקוראת לשיטות ספציפיות של Chat API עבור כל מכסה.
בטבלה הבאה מפורטות מגבלות השאילתות לכל פרויקט. אפשר לראות את המגבלות האלה גם בדף מכסות.
מכסה לכל פרויקט |
שיטות של Chat API |
מגבלה (לכל 60 שניות) |
|---|---|---|
כתיבות של הודעות בדקה |
|
3000 |
הודעות שנקראו לדקה |
|
3000 |
מספר הכתיבות בדקה של חברי מועדון |
|
300 |
קריאות בדקה של חברים במועדון |
|
3000 |
כתיבות במרחב לדקה |
|
60 |
קריאות של מקום בדקה |
|
3000 |
כתיבות של קבצים מצורפים לדקה |
|
600 |
קריאות של קבצים מצורפים בדקה |
|
3000 |
מספר פעולות כתיבה של תגובות באמוג'י לדקה |
|
600 |
מספר התגובות לדקה |
|
3000 |
CustomEmoji writes per minute |
|
600 |
מספר הקראות של סמלי אמוג'י מותאמים אישית בדקה |
|
3000 |
כתיבות לקטע בדקה |
|
600 |
קריאות של קטע בדקה |
|
3000 |
קריאות של נתוני הזמינות בדקה |
|
3000 |
מספר הכתיבות של נתוני הזמינות בדקה |
|
3000 |
מכסות לכל מרחב
מכסות לכל מרחב מגבילות את קצב השאילתות במרחב נתון, והן משותפות לכל אפליקציות Chat שפועלות במרחב הזה ומבצעות קריאות לשיטות Chat API שמופיעות בכל מכסה.
בטבלה הבאה מפורטות מגבלות השאילתות לכל מרחב:
מכסה לכל מרחב |
שיטות של Chat API |
מגבלה (לשנייה) |
|---|---|---|
קריאות לשנייה |
|
15 |
פעולות כתיבה לשנייה |
|
1 |
יצירת כתיבות של תגובות בשנייה |
|
5 |
מספר הפעמים שהודעה נכתבת בשנייה בזמן ייבוא נתונים ל-Google Chat |
|
10 |
מכסות לכל משתמש
מכסות לכל משתמש מגבילות את קצב השאילתות של משתמש ב-Google Chat. השאילתות מתייחסות לכל אפליקציות Chat שמבצעות קריאה לשיטה של Chat API בשם משתמש (באמצעות אימות משתמש).
בטבלה הבאה מפורטות מכסות השאילתות לכל משתמש:
מכסה לכל משתמש |
שיטות של Chat API |
מגבלה (לשנייה) |
|---|---|---|
כתיבות של סמלי אמוג'י מותאמים אישית בשנייה |
|
1 |
קריאות של סמלי אמוג'י מותאמים אישית בשנייה |
|
15 |
פעולות כתיבה לשנייה |
|
1 |
קריאות לשנייה |
|
15 |
מגבלות שימוש נוספות
תנועה גבוהה של בקשות ל-API שמטרגטת את אותו מרחב יכולה להפעיל מגבלות פנימיות נוספות שלא מוצגות בדף Quotas.
פתרון שגיאות שקשורות למכסת זמן
לגבי כל השגיאות שמבוססות על זמן (מקסימום N בקשות לכל X דקות), מומלץ שהקוד יזהה את החריגה וישתמש בנסיגה אקספוננציאלית קטומה כדי לוודא שהמכשירים לא יוצרים עומס מוגזם.
השהיה מעריכית לפני ניסיון חוזר היא אסטרטגיה סטנדרטית לטיפול בשגיאות באפליקציות רשת. אלגוריתם של השהיה מעריכית לפני ניסיון חוזר (exponential backoff) מבצע ניסיון חוזר של בקשות באמצעות הגדלה אקספוננציאלית של זמני ההמתנה בין הבקשות, עד למשך ההשהיה המקסימלי. אם הבקשות עדיין לא מצליחות, חשוב שההשהיות בין הבקשות יגדלו עם הזמן עד שהבקשה תצליח.
אלגוריתם לדוגמה
אלגוריתם של השהיה מעריכית לפני ניסיון חוזר (exponential backoff) מבצע ניסיון חוזר של בקשות באופן אקספוננציאלי, ומגדיל את זמן ההמתנה בין הניסיונות החוזרים עד למשך ההשהיה המקסימלי. לדוגמה:
- שולחים בקשה ל-Google Chat API.
- אם הבקשה נכשלת, צריך להמתין 1 +
random_number_milliseconds שניות ולנסות שוב את הבקשה. - אם הבקשה נכשלת, צריך להמתין 2 +
random_number_milliseconds שניות ולנסות שוב את הבקשה. - אם הבקשה נכשלת, צריך להמתין 4 +
random_number_milliseconds שניות ולנסות שוב את הבקשה. - וכך הלאה, עד
maximum_backoffפעמים. - ממשיכים להמתין ולנסות שוב עד שמגיעים למספר מקסימלי מסוים של ניסיונות חוזרים, אבל לא מגדילים את תקופת ההמתנה בין הניסיונות החוזרים.
where:
- זמן ההמתנה הוא
min(((2^n)+random_number_milliseconds), maximum_backoff), שבוnגדל ב-1 בכל איטרציה (בקשה). -
random_number_millisecondsהוא מספר אקראי של אלפיות השנייה שקטן מ-1,000 או שווה לו. כך אפשר להימנע ממקרים שבהם הרבה לקוחות מסונכרנים בגלל מצב מסוים וכולם מנסים לשלוח בקשות בו-זמנית. הערך שלrandom_number_millisecondsמחושב מחדש אחרי כל בקשה לניסיון חוזר. - בדרך כלל,
maximum_backoffהוא 32 או 64 שניות. הערך המתאים תלוי בתרחיש לדוגמה.
הלקוח יכול להמשיך לנסות שוב אחרי שהגיע לזמן maximum_backoff.
ניסיונות חוזרים אחרי הנקודה הזו לא צריכים להמשיך להגדיל את זמן ההשהיה לפני ניסיון חוזר. לדוגמה, אם לקוח משתמש בזמן maximum_backoff של 64 שניות, אחרי שהוא מגיע לערך הזה הוא יכול לנסות שוב כל 64 שניות. בשלב מסוים, צריך למנוע מהלקוחות לנסות שוב ללא הגבלה.
זמן ההמתנה בין ניסיונות חוזרים ומספר הניסיונות החוזרים תלויים בתרחיש לדוגמה ובתנאי הרשת.
בקשה להגדלת מכסה לפרויקט
יכול להיות שתרצו לבקש שינוי במכסות בהתאם לשימוש במשאבים בפרויקט. קריאות ל-API על ידי חשבון שירות נחשבות לשימוש בחשבון יחיד. הגשת בקשה להתאמת המכסה לא מבטיחה שהבקשה תאושר. יכול להיות שיחלפו יותר זמן עד לאישור בקשות להתאמת מכסה שיגרמו לעלייה משמעותית בערך המכסה.
המכסות לא זהות בכל הפרויקטים. ככל שהשימוש שלכם ב-Google Cloud יגדל עם הזמן, יכול להיות שתצטרכו להגדיל את ערכי המכסות. אם צפויה עלייה משמעותית בשימוש, אפשר לבקש התאמות של המכסות מראש בדף Quotas & System Limits (מכסות ומגבלות מערכת) במסוף Google Cloud.
מידע נוסף זמין במקורות המידע הבאים:
מכסות של שרתי MCP ב-Chat
שרת ה-MCP של הצ'אט משתמש במדד של הקצאת עלויות של שאילתות. בטבלאות הבאות מפורטת עלות השאילתה לכל שיטה של שרת Chat MCP לפי קטע:
מכסות של Chat MCP
יש שני סוגים של מכסות:
לדקה לכל פרויקט בענן: זו העלות של השאילתה לפרויקט ב-Google Cloud למשך דקה אחת.
לדקה לכל משתמש לכל פרויקט: זו העלות של שאילתה לפרויקט בענן ב-Google Cloud למשך דקה אחת שכל משתמש יכול להשתמש בה. המטרה של המגבלה הזו היא לעזור לכם לוודא שהשימוש יתחלק בצורה הוגנת בין המשתמשים.
בטבלה הבאה מפורטות המכסות האלה:
| סוג מכסת השימוש | עלות שאילתה |
|---|---|
| לדקה לכל פרויקט | 3,000 |
| לדקה לכל משתמש לכל פרויקט | 300 |
ערכות כלים של MCP ל-Chat
בטבלה הבאה מפורטות עלויות השאילתות לכל chatmcp.googleapis.comערכת כלים:
נקודת קצה |
כלי |
עלות שאילתה |
|---|---|---|
/mcp/v1 |
|
1 |
|
10 |
|
|
10 |
|
|
10 |
מידע נוסף זמין במאמר Chat MCP API Reference.