La API de Google Ads aplica la limitación de frecuencia por consultas por segundo (QPS) en los IDs de cliente y los proyectos de Google Cloud de forma independiente. La API de Google Ads usa un bucket de tokens algoritmo para medir las solicitudes y determinar un límite de QPS adecuado, por lo que el límite exacto variará según la carga general del servidor en un momento determinado.
El objetivo de imponer límites de frecuencia es evitar que un usuario interrumpa el servicio para otros usuarios (ya sea de forma intencional o no) sobrecargando los servidores de la API de Google Ads con un gran volumen de solicitudes.
Las solicitudes que incumplan los límites de frecuencia se rechazarán con el error:
RESOURCE_TEMPORARILY_EXHAUSTED.
Puedes tomar el control de tu app y mitigar los límites de frecuencia reduciendo de forma activa la cantidad de solicitudes y limitando las QPS desde el cliente.
Existen varias formas de reducir las probabilidades de superar el límite de frecuencia. Familiarizarte con los conceptos de Enterprise Integration Patterns (EIP) como la mensajería, la reentrega y la limitación, puede ayudarte a compilar una app cliente más sólida.
Las siguientes prácticas recomendadas se ordenan por complejidad, con estrategias más simples en la parte superior y arquitecturas más sólidas, pero sofisticadas, después:
- Limitar las tareas simultáneas
- Agrupación de solicitudes en lotes
- Limitación y limitadores de frecuencia
- Agregar a la fila
Limitar las tareas simultáneas
Una de las causas principales de superar los límites de frecuencia es que la app cliente genera una cantidad excesiva de tareas paralelas. Si bien no limitamos la cantidad de solicitudes paralelas que puede tener una app cliente, esto puede superar el límite de solicitudes por segundo a nivel del proyecto de Google Cloud.
Se recomienda establecer un límite superior razonable para la cantidad total de tareas simultáneas que realizarán solicitudes (en todos los procesos y máquinas) y ajustarlo hacia arriba para optimizar tu capacidad de procesamiento sin superar el límite de frecuencia.
Además, puedes considerar limitar las QPS desde el cliente (consulta Limitación y limitadores de frecuencia).
Agrupación de solicitudes en lotes
Considera agrupar varias operaciones en una sola solicitud. Esto es más aplicable a las llamadas Mutate para varios servicios. Por ejemplo, si actualizas el estado de varias instancias de AdGroupAd, puedes llamar a MutateAdGroupAds una vez y pasar varias operations en lugar de llamar a MutateAdGroupAds una vez por cada AdGroupAd. Consulta nuestra
guía de operaciones por lotes para obtener algunos ejemplos adicionales.
Si bien la agrupación de solicitudes en lotes reduce la cantidad total de solicitudes y mitiga los límites de frecuencia en solicitudes por minuto, puede activar el límite de frecuencia de operaciones por minuto si realizas una gran cantidad de operaciones en una sola cuenta.
Limitación y limitadores de frecuencia
Además de limitar la cantidad total de subprocesos en tu aplicación, también puedes implementar limitadores de frecuencia en el cliente. Esto puede garantizar que todos los subprocesos de tus procesos o clústeres estén regidos por un límite de QPS específico desde el cliente.
Puedes consultar el limitador de frecuencia de Guava o implementar tu propio algoritmo basado en bucket de tokens para un entorno agrupado. Por ejemplo, puedes generar tokens y almacenarlos en un almacenamiento transaccional compartido, como una base de datos, y cada cliente tendría que adquirir y consumir un token antes de procesar la solicitud. Si se agotaran los tokens, el cliente tendría que esperar hasta que se genere el siguiente lote de tokens.
Agregar a la fila
Una cola de mensajes es la solución para la distribución de la carga de operaciones, al mismo tiempo que controla las tasas de solicitudes y de consumidores. Hay varias opciones de colas de mensajes disponibles (algunas de código abierto y otras patentadas), y muchas de ellas pueden funcionar con diferentes lenguajes.
Cuando usas colas de mensajes, puedes tener varios productores que envían mensajes a la cola y varios consumidores que procesan esos mensajes. Se pueden implementar limitaciones en el consumidor limitando la cantidad de consumidores simultáneos, o bien implementar limitadores de frecuencia o limitaciones para los productores o los consumidores.
Por ejemplo, si un consumidor de mensajes encuentra un error de límite de frecuencia, puede devolver la solicitud a la cola para que se vuelva a intentar. Al mismo tiempo, ese consumidor también puede notificar a todos los demás consumidores que pausen el procesamiento durante varios segundos para recuperarse del error.