Entre 2022 e 2025, o número de candidaturas por vaga mais que dobrou: passou de cerca de 115 para 244. No mesmo período, e sobre a mesma vaga, o número de entrevistas subiu só 8,7%. Quase todo o volume novo foi absorvido por uma etapa só — a triagem —, e é essa etapa que este post trata como instrumento: o que um teste para processo seletivo precisa ter para separar de verdade, como pontuá-lo e o que a nota pode e não pode decidir.
- 2022 115 candidaturas por vaga. A conta de um recrutador: 146 candidaturas no ano inteiro. O currículo ainda era um documento caro de escrever.
- início de 2024 53% dos times dizem encontrar candidaturas escritas ou assistidas por IA. Ainda é exceção suficiente para ser notada.
- 2025 244 candidaturas por vaga e 746 por recrutador no ano — 5,1 vezes o volume por recrutador de 2022. O tempo médio para preencher uma vaga sobe para 56,7 dias.
- fim de 2025 · 2026 77% dos times dizem encontrar candidaturas geradas ou assistidas por IA e, em maio de 2026, 73% dos candidatos brasileiros dizem usar IA para adaptar o currículo à vaga. Escrever um currículo perfeito virou grátis.
Há uma leitura tranquilizadora desses dados — "é só volume, a gente filtra" — e uma leitura incômoda, que é a correta. A triagem sempre foi a etapa em que a empresa decide sobre a maioria das pessoas sem falar com nenhuma delas. Com 244 candidaturas e 22,7 entrevistas por vaga, pelo menos 221 pessoas por vaga são decididas sem conversa — 90,7% da lista. O "pelo menos" é literal: o benchmark conta entrevistas, não pessoas entrevistadas, e como um mesmo candidato costuma passar por duas ou três, o número real de gente que nunca falou com ninguém é maior que esse. A subtração direta é o cenário mais generoso possível para a triagem. O que mudou não foi a proporção: foi que o documento em que essas 221 decisões se apoiavam parou de ser escrito pela pessoa que se candidatou. (Este mesmo levantamento já apareceu aqui, com outro recorte — tamanho das equipes de recrutamento —, no post sobre como escrever uma descrição de cargo.)
Este post é sobre a etapa que ocupa esse lugar quando o currículo deixa de ocupá-lo: uma prova curta, específica da vaga, corrigida com peso e lida contra uma nota de corte declarada antes. Ele passa por sete decisões de projeto, cada uma com as duas saídas possíveis e o que cada saída custa; depois resolve uma folha de correção inteira, com as contas escritas; e termina mostrando a prova que reprova a melhor candidatura — o erro mais fácil de cometer em toda essa mecânica.
Detectar IA não é um instrumento de seleção
A primeira reação de quase todo time é tentar reconhecer o texto de máquina. É uma reação compreensível e é um beco. Os números de quem diz conseguir identificar não formam um critério: formam uma percepção, e as percepções publicadas em 2026 não conversam entre si:
| O que foi perguntado | Resposta | A quem, e por quem |
|---|---|---|
| Consegue perceber quando o candidato usou IA? | 24% quase sempre · 60% às vezes | 1.000+ profissionais de aquisição de talentos e gestores nos EUA, campo de 11 a 18 de junho de 2026 (ZipRecruiter) |
| Tem certeza se os currículos recebidos foram gerados ou editados por IA? | 39% dizem não ter | Gestores de contratação, recorte global de um estudo com 60 mil profissionais em 36 países; o tamanho desse subgrupo não é publicado (Michael Page) |
| Diz conseguir identificar quando o texto foi produzido por IA? | 74% — e 80% não gostam quando identificam | 625 gestores de contratação (CV Genius), re-reportado no Brasil em setembro de 2026; a data de campo não é publicada |
| Já desclassificou alguém depois de achar inconsistência ou distorção no currículo? | 58% | Cerca de 387 recrutadores brasileiros — metade de uma amostra de 774 pessoas, dividida meio a meio com profissionais empregados (Robert Half, divulgação de 25 de março de 2026) |
Arraste a tabela para o lado: a coluna que diz a base de cada número está à direita.
As quatro linhas são de estudos distintos, com públicos e recortes distintos, e estão na mesma tabela só para mostrar a dispersão. Não subtraia uma da outra: "74% dizem identificar" e "39% dizem não ter certeza" não são complementares — são perguntas diferentes, feitas a grupos diferentes, em momentos diferentes.
Repare no que a última linha realmente diz. Desclassificar por inconsistência não é desclassificar por uso de IA: inconsistência é uma data que não fecha, uma responsabilidade que a pessoa não sustenta quando perguntada. Isso é bom trabalho de triagem e sempre foi. O problema começa quando o critério vira o estilo do texto — e aí três coisas acontecem de uma vez. A prosa limpa demais de quem escreve bem cai junto; quem escreve mal na língua da vaga, mas faz o trabalho, é penalizado de novo; e o time passa a gastar a semana num julgamento que não produz nenhuma evidência sobre a competência que a vaga exige. Entre os 1.236 recrutadores e gestores ouvidos pela Greenhouse em quatro países — de um total de 4.136 respondentes, dos quais 2.900 eram candidatos —, 34% dizem passar até metade da semana filtrando candidaturas de baixa qualidade. É meia semana gasta numa tarefa que não é seleção — e é o tipo de trabalho que aparece quando a equipe ainda não decidiu o que é da máquina e o que é seu.
O dado que resolve a discussão é o de quem já reagiu. No levantamento da Willo, 31% dos times acrescentaram uma etapa prática ao processo e 14% adotaram algum detector de IA — mais que o dobro de um lado. E 10% dizem já ter substituído em boa parte o currículo por avaliações de habilidade e de cenário. A amostra é pequena e da própria fornecedora; o que sustenta o argumento não é a taxa exata, é a direção: pedir que a pessoa faça algo é mais barato e mais informativo do que tentar adivinhar quem escreveu o texto dela.
Há um argumento de fundo que vale dizer sem rodeio: uma prova bem feita não serve para pegar quem usou IA. Ela serve para tornar isso irrelevante. Se a pergunta depende do contexto da sua operação, da sua base de clientes, do seu produto — e se uma parte dela é corrigida por uma pessoa que sabe o que uma boa resposta faz —, o candidato pode usar a ferramenta que quiser: o que você está lendo é a decisão dele sobre um problema seu. Esse é o mesmo deslocamento que já tinha acontecido na entrevista, quando ela virou roteiro fixo com régua e scorecard em vez de conversa livre, e na descrição de cargo, quando ela passou a listar o que a pessoa vai fazer em vez de adjetivos sobre quem ela deve ser.
A prova não cria tempo: ela move o custo de lugar
Antes de montar qualquer coisa, é preciso ser honesto sobre a conta. Ela escala com o número de vagas que você vai abrir no ano, que é uma conta à parte — a do planejamento de quadro. Uma etapa de prova não é de graça e não é neutra — ela tira trabalho do seu time e coloca trabalho no candidato. Vale a pena fazer essa conta explícita uma vez, com números redondos, para uma vaga com 40 pessoas na lista curta:
Sem prova: 40 triagens por telefone
13,3 h do seu time 40 × 20 min
13,3 h dos candidatos o mesmo telefonema, do outro lado
Uma agenda de duas semanas para encaixar 40 ligações de 20 minutos, e nenhuma delas produz um artefato que outra pessoa possa reler depois.
Com prova: 40 provas de 35 minutos
4,0 h do seu time 40 × 6 min de correção das abertas
23,3 h dos candidatos 40 × 35 min
Cai 70% do lado de quem contrata e sobe 75% do lado de quem se candidata — e o que fica registrado é comparável entre as 40 pessoas.
Essa assimetria é a razão de quase todo desastre de prova de seleção. Quando o custo cai no seu lado e sobe no lado de fora, é fácil pedir demais: cinco horas de case, um projeto completo, uma semana de trabalho não remunerado. A regra que mantém a etapa defensável é simples e desconfortável — a prova não deve custar ao candidato muito mais do que já custava a ele a etapa que ela aposenta, e o excedente é exatamente o que você tem de conseguir justificar em voz alta. Nas contas acima, a etapa que saiu tomava 20 minutos de cada pessoa e a que entrou toma 35: 75% a mais do lado de fora, contra uma queda de 70% do lado de dentro. Esse excedente é pequeno e pagável. Um case de cinco horas no lugar dos mesmos 20 minutos seria um excedente de 1.400% — e aí não há discurso que sustente.
Essa é, aliás, a primeira das sete decisões.
As sete decisões que definem se a prova filtra
Cada bloco abaixo é uma bifurcação real, do tipo que se resolve em dez minutos de reunião e depois custa meses. À esquerda, a saída que parece mais natural; à direita, a que costuma ser melhor; embaixo, a regra que sobra quando o caso é específico demais para a tabela.
Decisão 1
Onde a prova entra na esteira
Somar
Manter tudo o que já existe e acrescentar a prova entre a triagem e a entrevista.
Custo: mais uma etapa no prazo. O tempo para preencher uma vaga já subiu 36,8% em três anos, para 56,7 dias em média.
Substituir
A prova ocupa o lugar de uma etapa existente — em geral a triagem telefônica ou a primeira entrevista de alinhamento.
Ganho: o prazo não cresce, e a comparação entre candidatos deixa de depender de quem atendeu o telefone naquele dia.
A regra: uma prova que não aposenta nada é um imposto sobre o candidato. Antes de criar a etapa, escreva o nome da etapa que sai.
Decisão 2
Quanto tempo você pede
O case grande
Um desafio de três a cinco horas, "para ver a pessoa trabalhando de verdade".
Custo: a desistência seletiva. Quem tem emprego, filho pequeno ou duas entrevistas na mesma semana some — e essas pessoas não são as piores da lista.
A prova curta
De 20 a 40 minutos, com uma única questão longa e algumas curtas.
Ganho: taxa de conclusão alta e um custo agregado que você consegue defender em voz alta para as 40 pessoas.
A regra: multiplique o tempo pedido pelo número de convites antes de decidir. Trinta minutos parecem nada até virarem 20 horas da vida de outras pessoas.
Decisão 3
Que tipo de pergunta entra
Só objetivas
Múltipla escolha, verdadeiro ou falso, um número — tudo corrigido pela máquina no instante do envio.
Custo: é exatamente o formato que uma IA responde melhor, e a maior parte mede consulta, não decisão.
Mistas
Objetivas para eliminar o que é fato, mais uma ou duas abertas, ancoradas num cenário da sua operação, corrigidas por gente.
Ganho: a parte que separa é a que exige julgamento sobre um contexto que só existe na sua empresa.
A regra: se a resposta certa pode ser encontrada, ela mede memória ou busca. Se ela precisa ser decidida, mede a competência. Uma prova só de objetivas é um questionário de conhecimento com outro nome. E o cenário da questão aberta precisa ser do nível da vaga que está escrito na faixa da vaga: pedir decisão de coordenação numa vaga júnior mede ansiedade, não competência.
Decisão 4
Quanto vale cada questão
Peso igual
Toda questão vale um ponto — é o padrão de qualquer formulário e ninguém discute.
Custo: a questão de marcar caixinha passa a valer o mesmo que a resposta escrita de quinze minutos. A prova mede a caixinha.
Peso declarado
O peso de cada questão é escrito antes de a prova sair, proporcional ao esforço e à importância do que ela mede.
Ganho: o peso é o divisor de todas as notas. Ele é a prova em si — o resto é redação.
A regra: escreva os pesos antes de escrever as questões, some-os e olhe a distribuição. Se as abertas não passarem de um terço do total, você montou um quiz.
Decisão 5
Onde fica a nota de corte — e sobre qual nota ela incide
Sobre a nota automática
A parte objetiva sai pronta no segundo em que o candidato envia; é tentador cortar ali e só ler as abertas de quem passou.
Custo: você elimina pessoas sem ler a única parte da prova que não podia ser respondida por outra pessoa. É o erro do fim deste post.
Sobre a nota final
O corte incide sobre o total, depois que as abertas foram corrigidas. Antes disso, o resultado não existe — não é "provisório", é inexistente.
Ganho: a nota que decide é a nota que a prova inteira produziu.
A regra: um corte só é legítimo se foi escrito antes de a primeira prova chegar. Corte escolhido depois de ver as notas não é critério, é justificativa.
Decisão 6
Prazo e número de tentativas
Cronômetro
A prova abre e conta o tempo; quem não terminar, perdeu.
Custo: você mede a estabilidade da internet e a sorte da tarde da pessoa junto com o resto — e a queixa é impossível de auditar.
Prazo com tentativa única
Uma data-limite (uma semana é um padrão razoável), um único início, e uma duração estimada dita com honestidade no enunciado.
Ganho: a pessoa escolhe a hora, e você continua com uma prova por pessoa. Reabrir vira um ato explícito, de alguém, registrado.
A regra: "expirada" não é um evento, é uma data que passou. Se o seu processo precisa marcar alguém como expirado para funcionar, ele vai errar todo candidato que enviar às 23h59.
Decisão 7
O que a nota decide sozinha
A nota move
Quem passa avança automaticamente; quem não passa é reprovado pelo sistema.
Custo: a primeira exceção legítima — e sempre há uma — vira um problema de suporte em vez de uma decisão de quem contrata.
A nota sinaliza
Passou ou não passou é uma marca na ficha. Mover a pessoa continua sendo um ato de uma pessoa.
Ganho: a nota vira informação para a entrevista seguinte em vez de um portão. E o time responde por quem avançou — inclusive nove meses depois, quando a conta de quem saiu cedo aparece na taxa de rotatividade.
A regra: automatize o cálculo, nunca o veredito. Essa é a mesma fronteira que vale para qualquer automação que age dentro do RH: a máquina prepara, a pessoa aprova.
Depois que a pessoa passa na prova
Quatro áreas, oito perguntas, noventa segundos
A prova de seleção termina no dia da contratação; o que decide se ela valeu a pena acontece nos doze meses seguintes. O diagnóstico gratuito da Spire mede as quatro áreas onde isso se perde — metas, desempenho, desenvolvimento e clima. Recrutamento não está entre elas, de propósito: são oito perguntas de múltipla escolha sobre o que vem depois da contratação. Para chegar à nota de cada uma delas, e à indicação do que atacar primeiro, é preciso se identificar antes — cargo, tamanho da empresa, nome e um e-mail profissional —, e a última tela traz o kit de OKR de noventa dias em PDF para baixar.
Fazer o diagnósticoA folha de correção, resolvida
Nada do que está acima significa muita coisa até você ver uma prova inteira somada. Esta é uma prova de seis questões para uma vaga de analista de suporte ao cliente — cinco pontos de parte objetiva, cinco de parte aberta, dez no total, com corte declarado em 70%. As duas candidaturas são ilustrativas e servem para mostrar um caso específico: o que acontece quando a melhor nota automática e a melhor prova não são a mesma pessoa.
| Questão | Tipo | Peso | Candidatura A | Candidatura B |
|---|---|---|---|---|
| 1. Qual dos quatro chamados abaixo você responde primeiro? | objetiva | 1 | 1 | 1 |
| 2. Quais informações precisam estar no chamado antes de escalar para engenharia? (marque todas) | objetiva | 2 | 2 | 0 |
| 3. O SLA é de 8 horas úteis, das 9h às 18h com uma hora de almoço. O chamado entrou às 16h30. Quantas horas úteis restam ao fim do dia? | objetiva | 1 | 1 | 1 |
| 4. Você pode combinar uma data de correção com o cliente antes de engenharia estimar? | objetiva | 1 | 1 | 1 |
| 5. Escreva a resposta que você enviaria ao cliente da questão 1, sabendo que a causa ainda é desconhecida. | aberta | 3 | 1 | 3 |
| 6. Em uma frase: o que você mudaria se o mesmo problema aparecesse pela terceira vez no mês? | aberta | 2 | 0,5 | 2 |
| Total | 10 | 6,5 | 8 | |
No celular a folha desliza na horizontal — as duas colunas de candidatura estão à direita da coluna Peso.
As duas notas que essa folha produz não são a mesma coisa, e a diferença entre elas é o assunto inteiro desta seção. A nota automática sai no instante do envio e só olha a parte objetiva. A nota final só existe quando a última questão aberta foi corrigida, e olha a prova toda:
Candidatura A
Candidatura B
A candidatura A gabaritou a parte que a máquina corrige e ficou em 65%. A candidatura B errou a questão que mais valia entre as objetivas e ficou em 80%. As duas ordens são opostas, e a folha não tem nenhum truque: a única coisa que produziu a inversão foram os pesos, que dizem que escrever a resposta ao cliente vale três vezes uma marcação e que pensar na recorrência vale duas.
Vale testar essa afirmação em vez de acreditar nela. Se as seis questões valessem um ponto cada — o padrão de qualquer formulário —, e mantendo exatamente as mesmas respostas, a prova diria o seguinte: A fica com 4,58 de 6, ou 76,4%; B fica com 5 de 6, ou 83,3%. As duas passam, a distância entre elas cai de 15 pontos percentuais para 6,9, e a candidatura que não soube escrever ao cliente entra na entrevista com carimbo de aprovada. O peso não é um detalhe de configuração: é o instrumento.
Uma questão pulada não é uma questão sem nota. Se a questão 6 fosse opcional e a candidatura A a deixasse em branco, ela vale zero — e a prova está completa. O contrário (tratar o branco como "ainda não corrigida") deixa a prova pendurada para sempre, esperando que alguém digite um zero que ninguém pediu. Vale para a planilha e vale para o sistema: em branco é uma resposta; sem correção é um estado.
A nota que muda sozinha
Existe um defeito nessa mecânica que quase ninguém antecipa, e ele não aparece na primeira prova: aparece na terceira semana, quando a vaga já tem candidaturas corrigidas e alguém percebe um erro de digitação no enunciado, ou decide que a questão 2 valia demais, ou apaga uma questão que não estava funcionando.
Pense no que acontece com a candidatura B se, depois de ela ter enviado, a questão 2 for excluída. Os pontos dela continuam registrados um a um — 0 na questão 2, 3 na questão 5, e assim por diante —, mas o total de pontos da prova deixa de ser 10 e passa a ser 8. A nota final de B, que era 8 de 10, vira 8 de 8 = 100%. Ninguém corrigiu nada, ninguém decidiu nada, e a nota subiu 20 pontos percentuais. No sentido contrário, aumentar o peso de uma questão que a pessoa errou derruba a nota dela — e o veredito pode virar de aprovado para reprovado sem que exista um instante em que alguém tenha decidido isso.
A saída não é proibir edições: uma prova serve a um funil inteiro, e travar as questões na primeira resposta recebida congela a prova para todos os candidatos seguintes por causa de um erro de acento. A saída é congelar a folha, não a prova. No momento em que a pessoa envia, grava-se a lista de questões como ela estava naquele instante — enunciado, tipo e peso de cada uma — e todas as notas daquela tentativa passam a ser calculadas contra essa cópia. A prova continua editável para quem vier depois; a folha entregue não muda mais.
E a nota de corte, essa sim, não deve ser congelada — nem aplicada retroativamente sem que alguém mande. São dois erros simétricos. Se o corte for lido ao vivo, mexer nele muda o veredito de gente que já recebeu resposta. Se o corte for congelado junto com a folha, você nunca mais consegue corrigir um corte mal calibrado. O comportamento correto é o do meio: a nota fica gravada, o veredito fica gravado, e mudar o corte não re-julga ninguém até alguém pedir explicitamente a reavaliação — de preferência sabendo antes quantas provas mudariam de resultado.
Esse padrão — o cálculo é automático, a mudança de veredito é um ato nomeado — é o mesmo que separa um indicador de acompanhamento de uma meta com dono em um painel de indicadores de RH, e é o que impede que a manutenção de rotina do instrumento reescreva decisões já comunicadas a pessoas.
Como a Spire faz
O módulo de recrutamento da Spire ganhou em 9 de setembro de 2026 uma biblioteca de avaliações reutilizáveis: a prova deixou de nascer presa a uma vaga e passou a ser um objeto próprio, que se associa a uma etapa de cada vaga em que for usada. O que existe hoje, campo a campo:
- Uma prova, várias vagas, uma associação por vaga
- A mesma avaliação pode ser associada a quantas vagas você quiser, e há uma única linha por par (prova, vaga) porque é a chave primária da associação que diz isso — não a tela. Um índice único, separado, impede o outro lado do problema: a mesma etapa não recebe duas provas. Editar a prova em um lugar alcança todas as vagas que a usam.
- Seis tipos de questão, em dois grupos
- Objetivas corrigidas na hora: escolha única, escolha múltipla, verdadeiro/falso e número. Abertas corrigidas por pessoa: linha e parágrafo. O limite é de 60 questões por prova e 12 opções por questão; o peso pode ser qualquer número maior que zero e até 1.000, e nasce em 1. A correção das objetivas compara o rótulo da alternativa, não a posição dela — reordenar as opções depois não re-corrige ninguém.
- Duas notas, e um veredito que espera
- A nota automática cobre só as questões objetivas e sai no envio. A nota final cobre a prova inteira. Enquanto houver uma questão aberta sem correção, a nota final e o aprovado/reprovado ficam nulos — não existe nota parcial exibida como se fosse final. Os dois percentuais são limitados a 0–100 na origem, então uma folha inconsistente nunca imprime "120%" ao lado de um corte.
- A folha congelada
- É exatamente o mecanismo da seção anterior: no envio, a lista de questões com peso e tipo é gravada dentro da tentativa, e toda nota dela é calculada contra essa cópia. Mudar o corte depois não re-julga ninguém: a própria edição já avisa quantas tentativas corrigidas ficariam com veredito diferente, e re-julgá-las é uma ação separada, que responde quantas foram de fato alteradas.
- O link do candidato
- A pessoa responde por um link com token, sem criar conta e sem senha. O banco guarda apenas o hash do token, e o par (prova, candidatura) é único: uma tentativa por pessoa, garantida no esquema. Reabrir é um ato explícito de quem administra a vaga, que apaga a folha anterior e emite um token novo; a trilha de auditoria guarda os horários antigos. O prazo padrão, quando nem a prova nem a etapa dizem outra coisa, é de sete dias.
- Sessão monitorada, se você ligar — e só metadado
- Há um modo de prova monitorada, desligado por padrão. A câmera e o microfone são lidos no navegador do candidato e a análise roda inteira ali: os quadros e o sinal do microfone vão para um worker dentro do próprio aparelho, que os descarta logo depois de cada inferência. O que trafega são apenas ocorrências de uma lista fechada de doze tipos (saiu de tela cheia, aba oculta, rosto ausente, voz detectada, permissão negada…), com duração e confiança. Nenhuma imagem, nenhum áudio e nenhum vídeo sai do dispositivo, chega até a Spire ou fica armazenado. As ocorrências não pontuam, não reprovam e não movem ninguém: são observações para uma pessoa ler. A configuração fica congelada por tentativa, então apertar a regra no meio do processo não muda o que foi combinado com quem já começou.
- Nada anda sozinho
- Aprovado é uma marca. Quem move o candidato de etapa é uma pessoa — inclusive quando o pedido vem do agente de IA, que nesse caso monta a ação e para num cartão de aprovação.
O módulo de recrutamento é opcional e depende de contratação e de o recurso estar ligado para o seu ambiente — não é algo que apareça para todo mundo por padrão. Se quiser o desenho da esteira em que essa prova se encaixa, ele está no post sobre funil de recrutamento; a visão geral da plataforma, com os outros módulos, está em o que é a Spire; e os critérios para comparar ferramentas, em como escolher uma plataforma de RH.
O que ainda não existe
Quatro limites que valem ser ditos antes que você descubra sozinho:
- Não há estatística por questão. O sistema soma pesos; ele não diz que a questão 3 foi acertada por 96% de todo mundo e portanto não separa ninguém. Essa análise, hoje, é sua — e é a mais valiosa depois da terceira vaga com a mesma prova.
- Não há correção às cegas. A correção começa na lista de candidaturas, que traz o nome ao lado do botão de corrigir — não existe modo anônimo. Se isso importa para você, a saída é procedimental: corrija todas as respostas antes de olhar qualquer outra coisa da candidatura.
- Não há cronômetro. O prazo é uma data e o início é único; o sistema registra a hora em que a pessoa começou e a hora em que enviou, mas não impõe nem calcula um tempo de prova. Diga a duração estimada no enunciado e trate-a como estimativa honesta, não como regra.
- Não há banco de questões por competência. A biblioteca guarda provas inteiras, não questões soltas etiquetadas por habilidade — montar uma prova nova ainda é escrever as questões dela. Quem quiser fazer o caminho inverso — partir da evidência observável para desenhar o que vem antes — encontra o método em montar uma trilha do fim para o começo.
Perguntas frequentes
O que é um teste para processo seletivo (ou teste de triagem)?
É uma avaliação curta, específica da vaga, aplicada antes das entrevistas longas, com o objetivo de decidir quem avança. Diferente de um teste de perfil comportamental, ela mede o que a pessoa faz diante de uma situação do trabalho — e, diferente de um case, cabe em dezenas de minutos e é corrigida com o mesmo critério para todo mundo.
Qual é uma boa nota de corte?
Não existe número universal: 70% é o valor que a maioria das ferramentas traz de fábrica, a Spire inclusive. O que torna o corte defensável é ele ter sido escrito antes de a primeira prova chegar e incidir sobre a nota final, com as questões abertas já corrigidas. Se, ao ver os resultados, o corte deixar passar gente demais ou de menos, mude-o de propósito, registre que mudou e aplique-o da próxima vaga em diante: quem já recebeu resposta não é re-julgado sem que alguém peça. O que não vale é escolher o corte depois de olhar a distribuição e apresentá-lo como se tivesse sido definido antes.
Como avaliar candidatos que usaram IA para responder?
Partindo do princípio de que todos usaram. Perguntas cuja resposta pode ser buscada medem consulta; perguntas que dependem do contexto da sua operação — os seus clientes, o seu produto, a sua política — exigem decisão, e é a decisão que você está contratando. Se a resposta escrita for boa e a pessoa não souber sustentá-la na entrevista seguinte, o problema aparece ali, que é onde ele deve aparecer. Para o time que vai escrever essas perguntas, o caminho prático de usar IA no próprio trabalho de RH está em cinco módulos.
Quantas questões deve ter a prova?
Menos do que a vontade pede. Uma prova de quatro a oito questões, com uma ou duas abertas que valham pelo menos metade do peso total, separa tão bem quanto uma de vinte e tem taxa de conclusão muito maior. Acima de dez questões você já está medindo a disposição da pessoa de preencher formulários.
A nota da prova serve para alguma coisa depois da contratação?
Serve como ponto de partida, não como previsão. O que a pessoa não resolveu na prova é material para o plano dos primeiros 90 dias e para o primeiro ciclo de avaliação de desempenho. O que ela não serve é para justificar uma nota de desempenho meses depois: são instrumentos diferentes, medindo momentos diferentes.
Prova elimina a entrevista?
Não, e nem deveria. Ela substitui a triagem que existia para decidir quem merece uma conversa — e devolve a essa conversa um material concreto para discutir, que é a resposta que a pessoa escreveu. O roteiro estruturado continua sendo o instrumento da etapa seguinte.
E se o candidato reclamar do tempo pedido?
Provavelmente ele tem razão. Faça a conta da seção sobre a troca de custos: multiplique o tempo da prova pelo número de convites, compare com o tempo que a etapa substituída custava ao seu time e veja de que lado a balança pendeu. Se pendeu muito, encurte — a taxa de conclusão é um indicador da sua vaga, não do mercado.
Sem ambiente de exemplo
O primeiro ciclo montado com as suas áreas na tela
A prova diz o que a pessoa resolveu e, principalmente, o que ela não resolveu — e é disso que se faz o plano dos primeiros 90 dias dela. A demonstração da Spire monta esse material ao vivo: um ciclo de objetivos criado na hora com as suas áreas e as suas pessoas, não com nomes inventados. A pauta completa dos vinte minutos está publicada na própria página, antes de você entrar. Quem lê o formulário do outro lado é uma pessoa, e ela volta em um dia útil já propondo horário.
Ver a pauta e agendarFontes
- Greenhouse, The Hire Standard — relatório de benchmarks, março de 2026. Base: 640 milhões de candidaturas em mais de 6.000 organizações norte-americanas, de 2022 a 2025. O mesmo relatório já tinha aberto, por outro ângulo, o post sobre descrição de cargo. De lá vêm 115 → 244 candidaturas por vaga (+111%), 146 → 746 candidaturas por recrutador ao ano (+411,8%), 56,7 dias para preencher (+36,8%), 22,7 entrevistas por vaga (+8,7%) e 12,3 horas de entrevista por contratação (+5,7%). Ressalva: são dados da própria plataforma, não uma amostra do mercado; e os dois absolutos publicados por recrutador dão 411,0%, contra os 411,8% do relatório — diferença de arredondamento das médias. O mesmo vale para o par vizinho: 115 → 244 dá 112,2% e o relatório publica 111%, porque o 115 é declarado como aproximação. É essa a ordem de precisão a esperar dessas comparações.
- ZipRecruiter, More Jobs, Higher Bar: The 2026 AI Employer Report. Mais de 1.000 profissionais de aquisição de talentos e gestores nos EUA, painel PureSpectrum, campo de 11 a 18 de junho de 2026. De lá vêm os 48% que dizem que a IA aumentou o volume por vaga e o par 24% / 60% sobre perceber uso de IA.
- Michael Page, Talent Trends 2026 (divulgação de maio de 2026). 60 mil profissionais em 36 países. Os 73% que usam IA para adaptar o currículo são o recorte brasileiro; os 39% de gestores sem certeza sobre a origem dos currículos são o recorte global. Os dois números não pertencem à mesma base e não devem ser lidos juntos. Não há período de campo publicado.
- Willo, Hiring Trends Report 2026 (22 de dezembro de 2025). Pouco mais de 100 profissionais ouvidos, mais leituras de 2,5 milhões de entrevistas na plataforma da própria empresa. De lá vêm 77% (contra 53% no início de 2024), 31% que acrescentaram etapa prática, 14% que adotaram detector e 10% que já substituíram boa parte do currículo por avaliações de habilidade. Ressalva forte: amostra pequena e fornecedora interessada no resultado — direção, não taxa.
- Greenhouse, AI in Hiring Report, de novembro de 2025 (divulgação do dia 19; a data de campo não é publicada, só a de divulgação). Ouviu 4.136 pessoas em quatro países — EUA, Reino Unido, Irlanda e Alemanha —, sendo 2.900 candidatos e 1.236 recrutadores e gestores. O mesmo relatório já tinha sido usado no post sobre descrição de cargo. De lá vêm os 34% de recrutadores que passam até metade da semana filtrando candidaturas de baixa qualidade.
- Robert Half Brasil, divulgação de 25 de março de 2026: 774 pessoas, divididas meio a meio entre recrutadores e profissionais empregados com formação superior — os 58% que já desclassificaram alguém por inconsistência no currículo são o recorte dos recrutadores, cerca de 387 pessoas, e não a amostra inteira. A metodologia está aberta no post sobre entrevista estruturada, que usou o mesmo estudo. E CV Genius, 625 gestores de contratação, sem data de campo publicada: 74% dizem identificar texto escrito por IA e 80% não gostam quando identificam. São dois estudos distintos, re-reportados juntos pela imprensa brasileira em 10 de setembro de 2026 — a data da reportagem não é a data de nenhum dos dois.
A prova que reprova a melhor candidatura
Volte à folha da candidatura B, que terminou em 80% e passou. Agora imagine uma única decisão diferente na configuração — a mais tentadora de todas, porque economiza trabalho de verdade: eliminar quem não alcança o corte já na nota automática, para só corrigir as abertas de quem passou.
A mesma candidatura B, com o corte aplicado à nota automática
Nota automática 60%
Corte 70%
Resultado eliminada antes da correção
As duas questões abertas — as que valiam metade da prova, as que só essa pessoa poderia responder do jeito que respondeu, as que ela acertou por inteiro — nunca são lidas por ninguém. A prova funcionou exatamente como foi configurada, e a melhor resposta do lote foi descartada por uma marcação múltipla errada que valia dois pontos.
Não é um caso extremo inventado para o argumento: é um desenho muito comum numa primeira versão feita com pressa, porque a nota automática é a que está pronta na hora e a correção manual é a que dá trabalho. Todo o resto deste post existe para tornar esse erro difícil de cometer — o peso declarado antes das questões, o corte escrito antes da primeira prova, a nota final que não existe enquanto faltar correção, a folha congelada no envio, o veredito que sinaliza em vez de mover.
Se você levar uma frase só, leve esta: a prova não é o conjunto de perguntas — é o conjunto de decisões sobre o que cada resposta vale. As perguntas você reescreve numa tarde. As decisões, depois que a primeira pessoa enviou, você já não pode mais mudar sem mexer no resultado de alguém.


