Limites de uso

A API Google Agenda tem cotas para garantir que ela seja usada de maneira justa por todos os usuários. Há três limitações importantes a serem consideradas ao usar a API Calendar:

  • Cotas de uso da API: aplicadas por projeto e por usuário. Para mais informações, consulte Tipos de cotas de uso da API Calendar.

  • Limites gerais de uso do Google Agenda: a API Google Agenda é um serviço compartilhado que tem limitações para proteger a performance geral do sistema do Google Workspace. Para mais informações, consulte Evitar limites de uso do Agenda

  • Limites operacionais: esses limites podem ser limitados a qualquer momento. Por exemplo, se você tentar gravar em uma única agenda em rápida sucessão.

Cotas da API Calendar

Dois tipos de cotas são aplicados:

  • Por minuto por projeto:é o número de solicitações que seu projeto do Google Cloud pode fazer em um minuto.

  • Por minuto por usuário por projeto:é o número de solicitações que um usuário específico pode fazer no seu projeto na nuvem. Esse limite tem como objetivo ajudar você a garantir uma distribuição justa do uso entre os usuários.

As cotas são calculadas por minuto usando uma janela deslizante. Um pico rápido de tráfego que exceda sua cota por minuto durante um minuto resultará na limitação de taxa durante a próxima janela para garantir que, em média, seu uso permaneça dentro das cotas.

A tabela a seguir detalha esses limites:

Tipo de limite de uso Limite
Por minuto por projeto 10.000 solicitações
Por minuto por usuário por projeto 600 solicitações

Limite diário de faturamento

Esse limite por dia por projeto define o número máximo de solicitações que seu projeto do Google Cloud pode usar em um período de 24 horas antes que as cobranças sejam aplicadas.

O uso abaixo desse limite não gera cobranças extras, e sua conta do Google Cloud não é faturada. Os detalhes completos do faturamento serão compartilhados mais tarde em 2026, com pelo menos 90 dias de antecedência antes que as mudanças entrem em vigor.

Não é possível solicitar um aumento nesse limite diário.

A tabela a seguir detalha o limite:

Tipo de limite Limite
Por dia por projeto 1.000.000 de solicitações

Para mais informações, consulte Modelo padronizado do Google Workspace para ferramentas de agente e APIs.

Resolver erros de cota com base no tempo

Para todos os erros com base no tempo (máximo de N solicitações por X minutos), recomendamos que seu código detecte a exceção e use uma espera exponencial truncada para garantir que seus dispositivos não gerem carga excessiva.

A espera exponencial é uma estratégia padrão de tratamento de erros para aplicativos de rede. Um algoritmo de espera exponencial repete solicitações usando tempos de espera exponencialmente crescentes entre as solicitações, até um tempo máximo de espera. Se as solicitações ainda não forem bem-sucedidas, é importante que os atrasos entre as solicitações aumentem com o tempo até que a solicitação seja bem-sucedida.

Exemplo de algoritmo

Um algoritmo de espera exponencial repete solicitações exponencialmente, aumentando o tempo de espera entre novas tentativas até um tempo máximo de espera. Exemplo:

  1. Faça uma solicitação para a API Google Agenda.
  2. Se a solicitação falhar, aguarde 1 + random_number_milliseconds e repita a solicitação.
  3. Se a solicitação falhar, aguarde 2 + random_number_milliseconds e repita a solicitação.
  4. Se a solicitação falhar, aguarde 4 + random_number_milliseconds e repita a solicitação.
  5. E assim por diante, até um tempo maximum_backoff.
  6. Continue aguardando e tentando novamente até um número máximo de novas tentativas, sem aumentar o tempo de espera entre elas.

em que:

  • O tempo de espera é min(((2^n)+random_number_milliseconds), maximum_backoff), com n incrementado em 1 para cada iteração (solicitação).
  • random_number_milliseconds é um número aleatório de milissegundos menor ou igual a 1.000. Isso ajuda a evitar casos em que muitos clientes são sincronizados por alguma situação e todos tentam novamente ao mesmo tempo, enviando solicitações em ondas sincronizadas. O valor de random_number_milliseconds é recalculado após cada nova tentativa de solicitação.
  • maximum_backoff costuma ser 32 ou 64 segundos. O valor adequado depende do caso de uso.

O cliente pode continuar tentando novamente depois de maximum_backoff. As novas tentativas após esse ponto não precisam continuar aumentando o tempo de espera. Por exemplo, se um cliente usar um tempo maximum_backoff de 64 segundos, depois de atingir este valor, o cliente poderá repetir a cada 64 segundos. Em algum momento, os clientes precisam ser impedidos de tentar novamente infinitas vezes.

O tempo de espera entre novas tentativas e o número de novas tentativas depende do seu caso de uso e das condições da rede.

Preços

Todo o uso padrão da API Google Agenda está disponível sem custo extra. O excesso dos limites de solicitação de cota está planejado para gerar cobranças na sua conta de faturamento do Google Cloud mais tarde em 2026. Para mais informações, consulte Modelo padronizado do Google Workspace para ferramentas e APIs de agente.

Solicitar aumento de cota

Dependendo do uso de recursos do seu projeto, talvez você queira solicitar um ajuste de cota. As chamadas de API por uma conta de serviço são consideradas como uso de uma única conta. Solicitar uma cota ajustada não garante a aprovação. As solicitações de ajuste de cota que aumentam significativamente o valor da cota podem levar mais tempo para serem aprovadas.

Nem todos os projetos têm as mesmas cotas. À medida que você usa o Google Cloud com o tempo, os valores de cota podem precisar aumentar. Caso espere um aumento de uso significativo, solicite o ajuste das cotas na página Cotas e limites do sistema no console do Google Cloud.

Para saber mais, leia os seguintes artigos:

Resolver problemas

Se uma das cotas for excedida, você será limitado por taxa e receberá um 403 usageLimits código de status ou um 429 usageLimits código de status em resposta às suas consultas.

Se isso acontecer, tente o seguinte:

  1. Siga todas as práticas recomendadas: use a espera exponencial exponencial, randomizar padrões de tráfego, e use notificações push.

  2. Se o projeto estiver crescendo e você tiver mais usuários, solicite um aumento de cota.

  3. Se você atingir os limites de cota por usuário, faça o seguinte:

    • Se você usa uma conta de serviço, aloque a carga para os usuários ou divida-a entre várias contas de serviço.

    • Embora seja possível solicitar um aumento na cota por usuário, em geral, não é recomendável aumentá-la acima do valor padrão, porque o aplicativo pode começar a atingir outros tipos de limites, por exemplo, limites gerais de uso do Agenda ou limites operacionais.

  4. Teste os limites de cota registrando um projeto de teste separado que tenha uma configuração semelhante ao projeto de produção. Para mais informações, consulte Testar o tratamento de limites de cota.

Randomizar padrões de tráfego

Os clientes do Agenda estão sujeitos a padrões de tráfego instáveis causados por vários clientes que realizam operações ao mesmo tempo. Por exemplo, uma prática ruim comum para um cliente do Agenda é realizar uma sincronização completa à meia-noite. Isso quase certamente levaria ao excesso da cota por minuto e resultaria em limitação de taxa e espera.

Para evitar isso, distribua o tráfego ao longo do dia sempre que possível. Se o cliente precisar fazer uma sincronização diária, peça para ele determinar um horário aleatório (diferente para cada cliente). Se você precisar realizar uma operação regularmente, varie o intervalo em +/- 25%. Isso vai distribuir o tráfego de maneira mais uniforme e proporcionar uma experiência do usuário muito melhor.

Usar notificações push

Um caso de uso comum é realizar uma ação sempre que algo muda na agenda do usuário. Um antipadrão aqui é consultar repetidamente todas as agendas de interesse. Isso vai usar rapidamente toda a sua cota. Por exemplo, se o aplicativo tiver 5.000 usuários e consultar a agenda de cada usuário uma vez por minuto, isso exigirá uma cota por minuto de pelo menos 5.000, mesmo antes de qualquer trabalho ser feito.

Os aplicativos do lado do servidor podem se registrar para receber notificações push, o que nos permite notificar você quando algo de interesse acontece. Elas exigem mais trabalho para serem configuradas, mas permitem um uso muito mais eficiente da sua cota e proporcionam uma melhor experiência do usuário. Especifique o eventType para o qual você quer receber notificações. Para mais informações, consulte Notificações push.

Alocação adequada com contas de serviço

Se o aplicativo estiver realizando solicitações usando delegação em todo o domínio, por padrão, a conta de serviço será cobrada em relação às cotas "por minuto por usuário por projeto", e não o usuário que você está representando. Isso significa que a conta de serviço provavelmente vai ficar sem cota e será limitada por taxa, mesmo que esteja operando em várias agendas de usuários.

Para evitar isso, use o parâmetro de URL quotaUser (ou o cabeçalho HTTP x-goog-quota-user) para indicar qual usuário é cobrado. Isso é usado apenas para cálculos de cota. Para mais informações, consulte Limitar solicitações por usuário.

Testar o tratamento de limites de cota

Para garantir que o aplicativo possa lidar normalmente com o alcance dos limites de cota na prática (por exemplo, por meio de novas tentativas com espera exponencial exponencial) e para minimizar possíveis interrupções para os usuários, recomendamos testar o cenário em um ambiente real.

Para testar sem interferência no uso real do aplicativo, recomendamos registrar um projeto de teste separado no console do Google Cloud e, em seguida, configurar a tela de consentimento do OAuth de maneira semelhante ao projeto de produção. Em seguida, defina limites de cota artificialmente baixos para esse projeto e observe o comportamento do aplicativo.

Cotas do servidor MCP do Agenda

O servidor MCP do Agenda usa uma métrica de alocação de custo de consulta. As tabelas a seguir detalham o custo da consulta para cada método do servidor MCP do Agenda por seção:

Cotas do MCP do Agenda

Dois tipos de cotas são aplicados:

  • Por minuto por projeto na nuvem: Este é o custo da consulta para seu projeto na nuvem do Google Cloud por um minuto.

  • Por minuto por usuário por projeto:é o custo da consulta para seu projeto na nuvem do Google Cloud por um minuto que um usuário específico pode usar.

A tabela a seguir detalha essas cotas:

Tipo de limite de uso Custo da consulta
Por minuto por projeto 10.000
Por minuto por usuário por projeto 600

Cotas do conjunto de ferramentas do MCP do Agenda

A tabela a seguir detalha o custo da consulta para cada conjunto de ferramentas calendarmcp.googleapis.com:

Endpoint Ferramenta Custo da consulta

/mcp/v1

create_event

1

delete_event

10

get_event

1

list_events

1

respond_to_event

1

search_events

1

update_event

1

suggest_time

1

list_calendars

1

Para mais informações, consulte a referência da API MCP do Agenda.