Quanto tempo um solucionador CAPTCHA leva para responder? A resposta não está em tabela pública — está na sua própria amostra, com mediana, P90 e P99 medidos no ambiente onde a integração roda. Este guia entrega o método: cronometrar cada tipo de desafio, montar a tabela de resultados e decidir capacidade com dados da sua equipe, sempre em ambiente próprio, QA ou staging autorizado.
Por que uma tabela pública não substitui a sua medição
Tempo de resolução muda por tipo de CAPTCHA, região, carga do provedor, qualidade da integração e latência do seu próprio endpoint de verificação. Um número publicado sem esse contexto é, no máximo, um ponto de partida — para decidir fila, timeout ou orçamento, use medições feitas no seu stack e na sua região.
Passo a passo da metodologia
Separe os testes por tipo de CAPTCHA — nunca misture reCAPTCHA v2, Turnstile e GeeTest v3 na mesma amostra. Use sempre a mesma página de staging e registre horário de envio, horário de conclusão, código de erro e resultado do backend. Com esses registros, calcule mediana, P90 e P99 com amostras internas suficientes para reduzir ruído.
Monte sua própria tabela de resultados
Registre cada rodada nesta tabela antes de comparar provedores.
| Provedor | Tipo de CAPTCHA | Amostras | Mediana | P90 | P99 | Observações |
|---|---|---|---|---|---|---|
| CaptchaAI | reCAPTCHA v2 | 100 | preencher | preencher | preencher | amostra interna |
| Provedor B | Turnstile | 100 | preencher | preencher | preencher | valor indicativo |
| Provedor C | GeeTest v3 | 100 | preencher | preencher | preencher | pode variar por região |
Quais tipos de CAPTCHA incluir na amostra
Inclua apenas os tipos que sua aplicação usa — reCAPTCHA v2/v3, Turnstile ou GeeTest v3 são os mais comuns. Documente sitekey de QA, região do runner e versão do cliente HTTP. Se seus workers rodam em sa-east-1 (São Paulo) e o provedor concentra capacidade nos EUA, essa diferença de RTT já explica parte da variação — registre a região junto com os números.
Planejamento de capacidade com P90 e P99
Use P90 e P99 — não a mediana isolada — para dimensionar filas, timeouts e retentativas, já que são eles que mostram o pior caso. Se a carga variar durante campanhas, rode uma amostra separada por janela de tráfego e compare apenas cenários equivalentes.
Script Python para cronometrar suas chamadas
O script abaixo é um ponto de partida para medir tempos em staging: coleta dados do seu próprio ambiente, prontos para entrar na tabela acima.
import os, time, requests
API_KEY = os.environ['CAPTCHAAI_API_KEY']
SITEKEY = os.environ['QA_CAPTCHA_SITEKEY']
def criar_tarefa_captcha(pageurl):
resposta = requests.post('https://ocr.captchaai.com/in.php', data={
'key': API_KEY,
'method': 'userrecaptcha',
'googlekey': SITEKEY,
'pageurl': pageurl,
'json': 1,
}).json()
return resposta['request']
def aguardar_resultado(task_id):
while True:
time.sleep(5)
resposta = requests.get('https://ocr.captchaai.com/res.php', params={
'key': API_KEY,
'action': 'get',
'id': task_id,
'json': 1,
}).json()
if resposta.get('status') == 1:
return resposta['request']
task_id = criar_tarefa_captcha('https://staging.example.com/captcha-demo')
token_qa = aguardar_resultado(task_id)
print({'token_recebido': bool(token_qa)})
Quando a variância dispara
Se o desvio entre rodadas crescer, confirme três coisas antes de suspeitar do provedor: a página de staging está estável, o endpoint interno responde de forma consistente e os tipos de CAPTCHA não foram misturados na mesma amostra.
Perguntas frequentes
Quantas amostras preciso para um resultado confiável?
Cem execuções por tipo já reduzem bastante o ruído; para decisão de capacidade, prefira 200 amostras nos horários de pico.
O horário do teste muda o resultado?
Sim. Meça em janelas separadas — comercial, noite, fim de semana — e compare só cenários equivalentes.
Posso usar os números públicos de um concorrente como previsão?
Só como contexto inicial. Para decisão técnica, meça no seu próprio ambiente com o script deste guia.
Preciso testar todos os tipos de CAPTCHA da minha aplicação separadamente?
Sim. reCAPTCHA v2, Turnstile e GeeTest v3 têm distribuições de tempo diferentes; misturá-los na mesma amostra distorce mediana e percentis.
Posso publicar os resultados do meu benchmark?
Pode, desde que publique metodologia, tamanho da amostra e limitações junto dos números — sem esse contexto, o leitor tende a interpretar o valor como regra universal, o que não é o caso.
O que muda entre reCAPTCHA v2, Turnstile e GeeTest v3 na hora de medir?
A curva de tempo de cada tipo é diferente: desafios interativos como reCAPTCHA v2 costumam ter cauda mais longa no P99, enquanto Turnstile e GeeTest v3 tendem a variar menos entre execuções. Trate cada tipo como uma amostra própria, com sua própria tabela de mediana, P90 e P99, em vez de calcular uma média única para "CAPTCHA" em geral.
Checklist antes de publicar sua medição
Confirme que a documentação aponta para ambiente próprio, que os exemplos usam dados fictícios e que nenhum endpoint de produção é acionado pelo teste. A staging deve ter domínio autorizado e política clara de expiração. Se o resultado variar entre rodadas, repita a medição e compare só cenários equivalentes.
Guias relacionados
- Início rápido da CaptchaAI
- Testes QA autorizados de CAPTCHA
- Testes de endpoint CAPTCHA em formulários próprios
- Depuração quando o navegador falha e a API funciona
- Resolver reCAPTCHA v2 com API
- Resolver Cloudflare Turnstile com API
- Resolver GeeTest v3 com API
Meça a integração CAPTCHA do seu próprio ambiente com a CaptchaAI.