Negócios: RH · Aula N.rh.3

Coreografia: triagem sem viés

A coreografia que evita que a IA reproduza o viés histórico da empresa na triagem de currículo: critérios explícitos escritos antes de rodar a IA, nunca depois, e uma auditoria de calibração no resultado antes de qualquer candidato avançar de fase.

Exemplos para

Você pede pra IA "escolhe os três melhores fornecedores dessa lista, do jeito que sempre escolhemos por aqui", sem listar o que conta como melhor. Ela aprende com o padrão histórico de compra e repete a mesma preferência de sempre, inclusive as manias que ninguém tinha percebido, como sempre preterir fornecedor pequeno por parecer "menos confiável". O critério nunca foi escrito, só herdado, e agora está automatizado.

Putz, repara numa coisa incômoda no exemplo de RH ali em cima. Ninguém decidiu, por escrito, que universidade tradicional valia mais ponto. Ninguém decidiu que um nome específico deveria subir no ranking. Isso simplesmente aconteceu, porque a IA precisava de algum critério pra ranquear e, na ausência de um critério seu, ela usou o único que tinha à mão: o padrão do que "deu certo" antes. E se o que deu certo antes já vinha torto, o ranking bonito e numérico só deu uma roupa nova pro mesmo viés de sempre.

A ideia central desta aula. A coreografia certa nunca é "roda a IA e depois audita o resultado se der problema". É o contrário: primeiro você escreve, por extenso, os critérios que realmente importam pra vaga e o que nunca pode contar como critério (nome, gênero inferido, idade inferida, endereço, foto). Depois a IA aplica essa régua num volume de currículo que o seu olho nunca cobriria sozinho. E só depois disso vem a auditoria de calibração: olhar se a distribuição do corte bate com o pool que entrou, antes de qualquer candidato avançar de fase.

01O erro clássico: deixar a IA inferir o critério

Vamos entender por que isso acontece, porque não é malícia da ferramenta, é física de como ela funciona. Quando você não escreve o critério, a IA não fica sem critério nenhum, ela infere um a partir do padrão que já existe nos dados que tem: as contratações passadas, os currículos que "pareciam" bons, o que o gestor aprovou antes. O problema é que, se esse padrão histórico já carregava viés, a IA não corrige, ela aprende e amplifica.

Repare nos proxies discriminatórios mais comuns, porque eles se escondem em campos que parecem inofensivos. O nome carrega pista de gênero e de origem étnica, mesmo que ninguém tenha pedido isso como critério. O CEP ou endereço carrega pista de raça e de classe social, já que moradia ainda é profundamente segregada. A universidade e o ano de formatura carregam pista de classe e de idade, porque cursar uma faculdade tradicional em tempo integral é um privilégio que nem todo bom profissional teve. Nenhum desses três campos é, sozinho, um crime. O problema é usá-los sem perceber que estão pesando na nota final.

O caso mais citado do mundo real é o da Amazon, revelado pela Reuters em 2018: a empresa construiu uma ferramenta de triagem que aprendeu com dez anos de currículos recebidos, majoritariamente de homens, numa indústria historicamente dominada por homens. A ferramenta aprendeu a penalizar currículos que continham a palavra "mulheres" (como em "capitã do time de xadrez de mulheres") e a rebaixar formadas em faculdades só de mulheres. Ninguém programou isso de propósito. Foi o padrão histórico, refletido de volta com aparência de matemática neutra. A Amazon descartou a ferramenta antes de usá-la em produção, mas o caso virou o exemplo canônico do que acontece quando ninguém definiu o critério explícito antes.

02Passo 1: critérios explícitos, escritos, antes de abrir a IA

Aqui está o degrau que resolve o problema na raiz, e ele acontece ANTES de qualquer prompt. Antes de rodar qualquer triagem, você escreve, num documento simples, duas listas.

A primeira lista é o que conta de verdade: as competências mínimas reais da vaga, não a lista de desejo do gestor inflada com "seria bom se também soubesse". Pergunte: o que essa pessoa precisa saber fazer no primeiro mês pra entregar o trabalho? Isso é critério. "Formado numa faculdade específica" não é.

A segunda lista é o que nunca pode contar: nome, gênero inferido, idade inferida (incluindo o ano de formatura, que é proxy direto de idade), endereço, foto, e qualquer traço que não tenha relação direta com a entrega do cargo. Essa lista você entrega pra IA como restrição explícita: "ignore esses campos, mesmo que estejam no currículo".

1 Critério escrito antes 2 IA aplica volume grande 3 Calibração audita a distribuição 4 Decisão avança de fase passos 1 e 3 são seus, escritos e defensáveis nenhum candidato avança sem passar pelo passo 3

03Passo 2: a IA aplica os critérios num volume que seu olho não cobre

Com as duas listas na mão, agora sim entra a força da IA. Trezentos currículos, aplicando a mesma régua, sem cansar na linha duzentos e oitenta, sem dar mais atenção ao primeiro currículo do dia do que ao último. Isso é trabalho mecânico de verdade, e é aqui que a IA ganha de qualquer humano: aplicar um critério fixo, de forma consistente, num volume que ninguém teria paciência de repetir igual da linha um até a trezentos.

Repare na diferença de papel em relação ao passo anterior. No passo um, você decidiu o que importa. No passo dois, a IA só executa a régua que você desenhou, currículo por currículo, e te devolve o ranking com a justificativa amarrada ao critério explícito, não a um "parece um bom perfil" solto no ar.

04Passo 3: a auditoria de calibração antes de avançar qualquer candidato

Aqui está o passo que a maioria pula, e é exatamente o que evita o desastre do exemplo do começo. Depois que a IA aplicou o critério e gerou o corte, você olha a distribuição do resultado por grupo demográfico disponível, sempre que a lei e a política interna permitirem esse tipo de checagem agregada. A pergunta é simples: essa distribuição bate com o pool que entrou no funil, ou tem uma queda desproporcional nalgum grupo?

Uma heurística útil pra saber se um desvio merece investigação é a chamada regra dos quatro quintos, usada em análises de seleção nos Estados Unidos como sinal de alerta de impacto desigual: se a taxa de aprovação de um grupo cai abaixo de 80 por cento da taxa do grupo com melhor resultado, isso é sinal pra investigar o critério, não uma lei brasileira a seguir ao pé da letra, mas um termômetro emprestado que funciona bem como alarme. Se, no exemplo do começo, zero currículos de faculdade pública passaram da primeira fase, esse número sozinho já é o alarme tocando.

E aqui vem o ponto mais importante desta seção: quando a calibração acusa desvio, você investiga o critério, não descarta o candidato nem ignora o sinal torcendo pra que passe despercebido. Talvez o critério "universidade X" estivesse, sem querer, funcionando como proxy de classe. Talvez "anos de experiência" estivesse penalizando quem trocou de carreira mais tarde. A auditoria não te diz quem contratar, ela te diz onde o critério pode estar torto, e cabe a você corrigir o critério e rodar de novo, não simplesmente aceitar o resultado porque "a IA calculou".

05A regra de ouro desta coreografia

Fecha o raciocínio numa frase que vale grudar na cabeça: critério explícito antes, nunca deixar a IA "decidir o que importa" sozinha, auditoria de calibração sempre antes de avançar alguém de fase. A ordem não é sugestão, é o que separa uma triagem que escala o seu julgamento de uma que escala o seu viés histórico com roupa nova de matemática. A IA te dá alcance real, trezentos currículos lidos com a mesma régua. Mas a régua é sua, escrita antes, e a conferência de que ela foi aplicada de forma justa também é sua, sempre depois. Beleza?

Faça agora

Faça você

Pegue uma vaga real que você tem aberta agora, a sua tarefa real ou outra recente.

  1. Escreva a lista do que CONTA de verdade: as competências mínimas que essa pessoa precisa ter pra entregar o trabalho no primeiro mês. Corte da lista qualquer "seria bom se" que não é essencial.
  1. Escreva a lista do que NUNCA pode contar: nome, gênero inferido, idade inferida (inclusive ano de formatura), endereço, foto, e qualquer outro traço sem relação direta com a entrega do cargo.
  1. Rode a triagem com a IA usando SÓ essas duas listas como critério, pedindo explicitamente pra ela ignorar os campos da lista dois mesmo que apareçam no currículo.
  1. Depois do corte, olhe a distribuição do resultado pelos grupos que você consegue identificar de forma agregada (origem de universidade, região, faixa etária aproximada). Alguma queda parece desproporcional?
  1. Se algo saltar aos olhos, volte no critério da lista um antes de mexer em qualquer candidato. O critério é o que se investiga primeiro, sempre.

Você acabou de rodar a coreografia que transforma "a IA ranqueou" em "eu defini a régua, a IA aplicou, e eu conferi que ela foi justa".

Pratique

1. Qual é a diferença essencial entre definir critérios ANTES de rodar a IA e só auditar o resultado DEPOIS, se algo parecer estranho?

2. Num currículo, qual desses campos costuma funcionar como proxy discriminatório, mesmo que ninguém o tenha definido como critério de propósito?

3. A auditoria de calibração mostrou que um grupo teve uma queda de aprovação bem abaixo da regra dos quatro quintos em relação ao grupo com melhor resultado. O que fazer?

Para o quadro

Sobre o erro clássicona ausência de critério seu, a IA usa o único que tem à mão: o padrão do que deu certo antes.
Sobre a ordemcritério explícito e escrito antes de abrir a IA. É ele que existe para ser defendido depois.
Sobre o proxycampos inocentes carregam informação de idade e de classe, e pesam no ranking sem aparecer como critério.
O que você achou desta página?
Recomendaria esta página para alguém do seu time?