Comparisons

Como medir o tempo de resposta de solucionadores CAPTCHA em 2025

Quanto tempo um solucionador CAPTCHA leva para responder? A resposta não está em tabela pública — está na sua própria amostra, com mediana, P90 e P99 medidos no ambiente onde a integração roda. Este guia entrega o método: cronometrar cada tipo de desafio, montar a tabela de resultados e decidir capacidade com dados da sua equipe, sempre em ambiente próprio, QA ou staging autorizado.

Por que uma tabela pública não substitui a sua medição

Tempo de resolução muda por tipo de CAPTCHA, região, carga do provedor, qualidade da integração e latência do seu próprio endpoint de verificação. Um número publicado sem esse contexto é, no máximo, um ponto de partida — para decidir fila, timeout ou orçamento, use medições feitas no seu stack e na sua região.

Passo a passo da metodologia

Separe os testes por tipo de CAPTCHA — nunca misture reCAPTCHA v2, Turnstile e GeeTest v3 na mesma amostra. Use sempre a mesma página de staging e registre horário de envio, horário de conclusão, código de erro e resultado do backend. Com esses registros, calcule mediana, P90 e P99 com amostras internas suficientes para reduzir ruído.

Monte sua própria tabela de resultados

Registre cada rodada nesta tabela antes de comparar provedores.

Provedor Tipo de CAPTCHA Amostras Mediana P90 P99 Observações
CaptchaAI reCAPTCHA v2 100 preencher preencher preencher amostra interna
Provedor B Turnstile 100 preencher preencher preencher valor indicativo
Provedor C GeeTest v3 100 preencher preencher preencher pode variar por região

Quais tipos de CAPTCHA incluir na amostra

Inclua apenas os tipos que sua aplicação usa — reCAPTCHA v2/v3, Turnstile ou GeeTest v3 são os mais comuns. Documente sitekey de QA, região do runner e versão do cliente HTTP. Se seus workers rodam em sa-east-1 (São Paulo) e o provedor concentra capacidade nos EUA, essa diferença de RTT já explica parte da variação — registre a região junto com os números.

Planejamento de capacidade com P90 e P99

Use P90 e P99 — não a mediana isolada — para dimensionar filas, timeouts e retentativas, já que são eles que mostram o pior caso. Se a carga variar durante campanhas, rode uma amostra separada por janela de tráfego e compare apenas cenários equivalentes.

Script Python para cronometrar suas chamadas

O script abaixo é um ponto de partida para medir tempos em staging: coleta dados do seu próprio ambiente, prontos para entrar na tabela acima.

import os, time, requests

API_KEY = os.environ['CAPTCHAAI_API_KEY']
SITEKEY = os.environ['QA_CAPTCHA_SITEKEY']

def criar_tarefa_captcha(pageurl):
    resposta = requests.post('https://ocr.captchaai.com/in.php', data={
        'key': API_KEY,
        'method': 'userrecaptcha',
        'googlekey': SITEKEY,
        'pageurl': pageurl,
        'json': 1,
    }).json()
    return resposta['request']

def aguardar_resultado(task_id):
    while True:
        time.sleep(5)
        resposta = requests.get('https://ocr.captchaai.com/res.php', params={
            'key': API_KEY,
            'action': 'get',
            'id': task_id,
            'json': 1,
        }).json()
        if resposta.get('status') == 1:
            return resposta['request']

task_id = criar_tarefa_captcha('https://staging.example.com/captcha-demo')
token_qa = aguardar_resultado(task_id)
print({'token_recebido': bool(token_qa)})

Quando a variância dispara

Se o desvio entre rodadas crescer, confirme três coisas antes de suspeitar do provedor: a página de staging está estável, o endpoint interno responde de forma consistente e os tipos de CAPTCHA não foram misturados na mesma amostra.

Perguntas frequentes

Quantas amostras preciso para um resultado confiável?

Cem execuções por tipo já reduzem bastante o ruído; para decisão de capacidade, prefira 200 amostras nos horários de pico.

O horário do teste muda o resultado?

Sim. Meça em janelas separadas — comercial, noite, fim de semana — e compare só cenários equivalentes.

Posso usar os números públicos de um concorrente como previsão?

Só como contexto inicial. Para decisão técnica, meça no seu próprio ambiente com o script deste guia.

Preciso testar todos os tipos de CAPTCHA da minha aplicação separadamente?

Sim. reCAPTCHA v2, Turnstile e GeeTest v3 têm distribuições de tempo diferentes; misturá-los na mesma amostra distorce mediana e percentis.

Posso publicar os resultados do meu benchmark?

Pode, desde que publique metodologia, tamanho da amostra e limitações junto dos números — sem esse contexto, o leitor tende a interpretar o valor como regra universal, o que não é o caso.

O que muda entre reCAPTCHA v2, Turnstile e GeeTest v3 na hora de medir?

A curva de tempo de cada tipo é diferente: desafios interativos como reCAPTCHA v2 costumam ter cauda mais longa no P99, enquanto Turnstile e GeeTest v3 tendem a variar menos entre execuções. Trate cada tipo como uma amostra própria, com sua própria tabela de mediana, P90 e P99, em vez de calcular uma média única para "CAPTCHA" em geral.

Checklist antes de publicar sua medição

Confirme que a documentação aponta para ambiente próprio, que os exemplos usam dados fictícios e que nenhum endpoint de produção é acionado pelo teste. A staging deve ter domínio autorizado e política clara de expiração. Se o resultado variar entre rodadas, repita a medição e compare só cenários equivalentes.

Guias relacionados

Meça a integração CAPTCHA do seu próprio ambiente com a CaptchaAI.

Os comentários estão desativados para este artigo.