Como a API Google Docs é um serviço compartilhado, aplicamos cotas e limitações para garantir que ela seja usada de forma justa por todos os usuários e para proteger a integridade geral do sistema do Google Workspace.
Se você exceder uma cota, geralmente receberá uma
429: Too many requests
resposta de código de status HTTP. Se isso acontecer, use um
algoritmo de espera exponencial e tente novamente
mais tarde.
A tabela a seguir detalha os limites de solicitação:
| Cotas | |||||
|---|---|---|---|---|---|
| Solicitações de leitura |
|
||||
| Solicitações de gravação |
|
||||
Resolver erros de cota com base no tempo
Para todos os erros com base no tempo (máximo de N solicitações por X minutos), recomendamos que seu código detecte a exceção e use uma espera exponencial truncada para garantir que seus dispositivos não gerem carga excessiva.
A espera exponencial é uma estratégia padrão de tratamento de erros para aplicativos de rede. Um algoritmo de espera exponencial repete solicitações usando tempos de espera exponencialmente crescentes entre as solicitações, até um tempo máximo de espera. Se as solicitações ainda não forem bem-sucedidas, é importante que os atrasos entre as solicitações aumentem com o tempo até que a solicitação seja bem-sucedida.
Exemplo de algoritmo
Um algoritmo de espera exponencial repete solicitações exponencialmente, aumentando o tempo de espera entre novas tentativas até um tempo máximo de espera. Exemplo:
- Faça uma solicitação para a API Google Docs.
- Se a solicitação falhar, aguarde 1 +
random_number_millisecondse tente novamente a solicitação. - Se a solicitação falhar, aguarde 2 +
random_number_millisecondse tente novamente a solicitação. - Se a solicitação falhar, aguarde 4 +
random_number_millisecondse tente novamente a solicitação. - E assim por diante, até um tempo
maximum_backoff. - Continue aguardando e tentando novamente até um número máximo de novas tentativas, mas não aumente o período de espera entre elas.
em que:
- O tempo de espera é
min(((2^n)+random_number_milliseconds), maximum_backoff), comnincrementado em 1 para cada iteração (solicitação). random_number_millisecondsé um número aleatório de milissegundos menor ou igual a 1.000. Isso ajuda a evitar casos em que muitos clientes são sincronizados por alguma situação e todos tentam novamente ao mesmo tempo, enviando solicitações em ondas sincronizadas. O valor derandom_number_millisecondsé recalculado após cada nova tentativa.maximum_backoffcostuma ser 32 ou 64 segundos. O valor adequado depende do caso de uso.
O cliente pode continuar tentando novamente depois de maximum_backoff.
As novas tentativas após esse ponto não precisam continuar aumentando o tempo de espera. Por
exemplo, se um cliente usar um tempo maximum_backoff de 64 segundos, depois de atingir
este valor, o cliente poderá tentar novamente a cada 64 segundos. Em algum momento,
os clientes precisam ser impedidos de tentar novamente indefinidamente.
O tempo de espera entre novas tentativas e o número de novas tentativas depende do seu caso de uso e das condições da rede.
Preços
Todo o uso padrão da API Google Docs está disponível sem custo adicional. O excesso dos limites de solicitação de cota está planejado para gerar cobranças na sua conta de faturamento do Google Cloud no final de 2026. Para mais informações, consulte Modelo padronizado do Google Workspace para ferramentas e APIs de agentes.
Solicitar aumento de cota
Dependendo do uso de recursos do seu projeto, talvez você queira solicitar um ajuste de cota. As chamadas de API por uma conta de serviço são consideradas como o uso de uma única conta. Solicitar uma cota ajustada não garante a aprovação. As solicitações de ajuste de cota que aumentariam significativamente o valor da cota podem levar mais tempo para serem aprovadas.
Nem todos os projetos têm as mesmas cotas. À medida que você usa o Google Cloud com mais frequência, os valores de cota podem precisar aumentar. Caso espere um aumento de uso significativo, solicite o ajuste das cotas na página Cotas e limites do sistema no console do Google Cloud.
Para saber mais, consulte os seguintes recursos:
Cotas do servidor MCP do Documentos
O servidor MCP do Documentos usa métricas de solicitação de leitura e gravação. As tabelas a seguir detalham as cotas e o custo da consulta para cada método do servidor MCP do Documentos por seção:
Cotas do MCP do Documentos
Dois tipos de cotas são aplicados:
- Por minuto por projeto: é o número de solicitações que seu projeto do Google Cloud pode fazer em um minuto.
- Por minuto por usuário por projeto:é o número de solicitações que um usuário específico pode fazer no seu projeto na nuvem.
A tabela a seguir detalha essas cotas:
| Cotas | |||||
|---|---|---|---|---|---|
| Solicitações de leitura |
|
||||
| Solicitações de gravação |
|
||||
Cotas do conjunto de ferramentas do MCP do Documentos
A tabela a seguir detalha o custo da consulta para cada
docsmcp.googleapis.com conjunto de ferramentas:
| Endpoint | Ferramenta | Custo da consulta |
|---|---|---|
| /mcp/v1 | read_doc |
1 solicitação de leitura |
update_doc |
1 solicitação de gravação |
Para mais informações, consulte a referência da API MCP do Documentos.