Análise da Invisible Work
Avaliação de desempenho escrita por IA: o texto deixou de provar que alguém pensou
A Disney orientou funcionários a usar IA na avaliação anual, e Clay e Figma criaram regras para sinalizar texto escrito por máquina. Dois estudos de 2025 mostram o que acontece quando escrever deixa de custar: o texto continua, e deixa de informar. Uma leitura da Invisible Work sobre o que sua empresa lê para decidir.
Invisible Work12 min de leitura
Parte 1 / Entenda os dados
A Disney não errou. O que mudou foi o que o texto prova
Em 28 de setembro de 2026, a Business Insider revelou que a Disney orientou funcionários a usar IA para preparar a avaliação anual: pedir ao chatbot que sugira metas e que ajude a resumir o que fizeram no ano. A discussão que se seguiu é se o texto sai melhor ou pior. A pergunta que costuma faltar é outra: o que uma avaliação escrita provava quando escrevê-la dava trabalho? [1] afirmação da fonte original
O documento interno, segundo a reportagem, trata a IA como “parceira de brainstorming” e desencoraja terceirizar por completo o pensamento da autoavaliação. Diz também que o funcionário continua responsável por estar alinhado com o gestor sobre as prioridades. [1] afirmação da fonte original A reportagem não afirma que o processo da Disney seja falho, e este texto também não. A Disney é o caso visível de uma prática que aparece em muitas empresas, e por isso serve de ponto de partida.
Dois especialistas ouvidos pela reportagem descrevem o risco de forma parecida. Chris Dellarocas, professor de negócios da Universidade de Boston, diz que, quando a avaliação de todo mundo é escrita por IA, todos soam bem, e fica mais difícil distinguir excelência real de elogio genérico. Elijah Wee, da Universidade de Washington, observa que metas geradas pela mesma instrução tendem a ser muito parecidas dentro de uma equipe. [1] afirmação da fonte original Os dois descrevem o sintoma. A questão aqui é o mecanismo.
Há um segundo movimento no mesmo fim de semana. Em 29 de setembro, a Business Insider contou que empresas como Clay, Figma e Dupe.com criaram regras de escrita com IA. No Clay, quem compartilha um documento responde por ele inteiro, e “desculpa, a IA escreveu isso” não é resposta aceitável a quem pergunta o que uma linha quis dizer. No Figma, o texto escrito com IA leva o aviso “written with AI” no topo. Na Dupe.com, um emoji de bife marca o texto colado de uma máquina. A justificativa do Clay é que um documento longo gerado a partir de uma instrução curta passa para quem lê o trabalho de dar sentido ao texto. [2] afirmação da fonte original
- Quem pediu
- Disney
- Orientação interna para preparar a avaliação anual com chatbot, segundo documento visto pela Business Insider em 28/09/2026. Não é um estudo, e a reportagem não mede se as avaliações pioraram.
- Quem reagiu
- 3 empresas
- Clay, Figma e Dupe.com descreveram em redes sociais regras próprias para sinalizar texto escrito com IA. É o que as próprias empresas relatam, sem auditoria, e um funcionário da Exa disse que lá o texto com IA é proibido.
- O que falta nas duas notícias
- Um mecanismo
- Ambas descrevem sintomas (todos soam bem, o leitor decifra mais). Nenhuma explica por que o texto perdeu o valor que tinha. Os estudos das partes 3 e 4 tentam medir isso.
Termos deste texto, em uma frase
Parte 2 / O que a avaliação escrita sempre foi
Um recibo de esforço, que ninguém chamava assim
Uma avaliação de desempenho escrita faz duas coisas ao mesmo tempo. Conta o que aconteceu no ano, e isso a IA resume bem. E prova algo que o gestor não consegue ver de fora: que a pessoa parou, lembrou, escolheu o que importa e organizou o raciocínio. A segunda função nunca foi escrita em manual nenhum, porque vinha de graça: escrever custava tempo, e esse tempo era o recibo.
A economia tem nome para isso. Em 1973, Michael Spence mostrou, no artigo “Job Market Signaling”, que duas partes podem contornar a falta de informação se uma delas emitir um sinal, e que o outro lado lê o sinal e atualiza o que acredita sobre o que não vê. [3] afirmação da fonte original A condição que a literatura repete é que o sinal só é confiável quando custa mais para quem tem menos do que diz ter. [3] afirmação da fonte original O exemplo clássico é o diploma, cujo valor vem em parte de ser mais difícil de obter para quem estuda com menos facilidade.
Aplicado ao texto, o argumento é direto, e é leitura da Invisible Work, não conclusão de nenhuma das reportagens. Uma avaliação que cita três decisões específicas, com data e consequência, era cara de escrever para quem não as tomou. Uma avaliação genérica era barata, e por isso o gestor desconfiava. A diferença de custo entre as duas fazia o texto informar. Com IA, as duas custam trinta segundos.
Antes: o custo separa
Escrever bem sobre o que se fez exigia ter feito e lembrar. Quem não fez gastava mais para disfarçar. O texto específico informava ao gestor algo que ele não via.
Agora: o custo é igual para todos
O chatbot produz texto específico, fluente e bem estruturado a partir de poucos dados, para quem fez muito e para quem fez pouco. O texto continua existindo, bem escrito, e a diferença entre as duas pessoas some dele.
Depois: o leitor para de confiar
O gestor percebe que o texto não distingue ninguém e deixa de usá-lo. Ele passa a decidir com o que ainda diferencia: o que observou, o que o histórico mostra. Quem não tem esse acesso (um gestor novo, uma equipe grande) decide às cegas.
Parte 3 / Quando escrever custa zero
Dois estudos mediram o que acontece, em um mercado de contratação
A previsão de Spence é antiga, e o que faltava era medi-la depois da IA. Dois estudos de 2025 fazem isso na mesma plataforma, a Freelancer.com, em que empregadores publicam tarefas pontuais (aqui, de programação) e freelancers respondem com uma proposta escrita e um preço. Os dois são versões de trabalho (preprints) publicadas no arXiv, e este texto não confirmou revisão por pares; a ressalva está na Parte 6.
O primeiro, de Anaïs Galdin (Dartmouth) e Jesse Silbert (Princeton), mede o quanto cada proposta é personalizada para a vaga. Antes dos modelos de linguagem, os empregadores pagavam por isso: um freelancer com proposta um desvio-padrão mais personalizada tinha a mesma chance de ser contratado que um com preço US$ 26 menor, numa amostra em que os preços iam de US$ 30 a US$ 250. Depois dos modelos de linguagem, esse valor cai muito, e a personalização deixa de prever se o trabalho será concluído com sucesso. [4] afirmação da fonte original
O segundo, de Jingyi Cui, Gabriel Dias e Justin Ye (Yale), aproveita que a plataforma lançou, em abril de 2023, uma ferramenta que gera a carta de apresentação com um clique. Depois do lançamento, 17% das cartas da amostra foram escritas com ela. A correlação entre personalização da carta e ser chamado para conversa caiu 51%, e a correlação com receber uma oferta caiu 79%. Os empregadores migraram para o que a IA não fabrica: a correlação entre ser chamado e a nota de avaliações de trabalhos anteriores subiu 5%. [5] afirmação da fonte original
- Quanto valia personalizar
- US$ 26
- Antes da IA, uma proposta um desvio-padrão mais personalizada equivalia, na chance de contratação, a um preço US$ 26 menor (preços de US$ 30 a US$ 250). Medido na Freelancer.com, em vagas de programação. Não é um prêmio salarial.
- Quanto a carta passou a prever
- −51%
- Queda relativa da correlação entre carta personalizada e ser chamado, depois da ferramenta de IA (−79% para receber oferta). Não é 51% menos chamadas: é a carta prevendo bem menos do que previa.
- O que ganhou peso
- +5%
- Aumento da correlação entre ser chamado e a nota de trabalhos anteriores. O pequeno aumento mostra o deslocamento do olhar do empregador para o histórico.
Os dois achados trazem nuances que a manchete esconderia. A ferramenta ajudou quem a usou: o uso elevou a chance de ser chamado em 3,56 pontos percentuais, em uma base de 7,02% de chamadas, mas o efeito foi significativo a 10% e não a 5%, e perdeu força depois de dois meses. A maior parte das cartas geradas foi enviada com pouca ou nenhuma edição, e quem editou mais teve mais chance de receber uma oferta: cada desvio-padrão a mais de tempo de edição se associou a 0,31 ponto percentual de chance a mais. [5] afirmação da fonte original A parte do trabalho que a IA não fez, rever e assumir o texto, foi a que continuou valendo.
Há também um número que não é medida. A equipe de Galdin e Silbert simulou um mercado em que escrever custa zero e o texto não informa nada. Nessa simulação, os 20% de freelancers de maior habilidade seriam contratados 19% menos vezes, e os 20% de menor habilidade, 14% mais vezes. [4] afirmação da fonte original É o resultado de um modelo, sob a hipótese de que o sinal desapareça por inteiro, não algo observado.
Parte 4 / Primeiros princípios
E se a premissa “escrever custa tempo” deixar de valer?
Toda prática de gestão carrega premissas que ninguém lembra de ter adotado. A avaliação escrita, a proposta de fornecedor, a justificativa de orçamento e a carta de candidato supõem que escrever custa tempo e que o tempo gasto revela algo. A pergunta de primeiros princípios é simples: o que acontece com o processo se essa premissa cai?
A resposta da teoria é que o sinal deixa de separar. Se qualquer um emite o mesmo sinal ao mesmo custo, o receptor não consegue deduzir nada e passa a ignorá-lo. É o que os dois estudos medem no mercado de contratação. Num mercado de freelancers, em que o empregador não conhece ninguém, ignorar o texto e olhar o histórico é uma saída. Dentro de uma empresa, a saída é diferente, e é aqui que a transferência exige cuidado: o gestor tem outras fontes (o que viu, as entregas, a opinião de colegas), e a avaliação é repetida todo ano. Isso torna o dano potencialmente menor em equipes pequenas e maior em equipes grandes, em que o gestor conhece pouco de cada um. Esta é uma hipótese nossa, não um resultado dos estudos.
O que resta caro, e portanto informativo, é justamente o que o estudo da Yale observa e o que o Clay escreveu na política: assumir o texto. Quem edita a carta recebe mais ofertas. Quem precisa explicar a linha que a IA escreveu, quando um colega pergunta o que ela quis dizer, demonstra que entendeu. O custo não sumiu. Mudou de lugar: saiu do ato de escrever e foi para o ato de responder pelo que está escrito. [2] afirmação da fonte original [5] afirmação da fonte original
O que este paralelo não prova
Parte 5 / O que fazer com isso
Uma auditoria de sinais em quatro perguntas, e a regra de mover o custo
Proibir o uso de IA não resolve, e é difícil de fazer cumprir: o estudo da Yale lembra que os detectores de texto atuais são imprecisos e que o empregador não consegue identificar, por conta própria, quem usou. [5] afirmação da fonte original Um método que dá para aplicar a cada documento que a empresa lê para decidir alguma coisa é este.
Liste onde uma decisão depende de um texto.
Avaliação de desempenho, seleção de candidatos, propostas de fornecedores, justificativas de investimento, relatórios de status. Comece pelos que alimentam decisões caras, como promoção, contratação e contrato.
Para cada um, escreva o que o esforço provava.
Conhecimento do assunto, dedicação, comprometimento, capacidade de priorizar. Se a resposta é “nada além de a pessoa ter me entregado algo”, o documento já era formalidade antes da IA, e vale decidir se ele ainda precisa existir.
Pergunte se o custo ainda existe.
Se um chatbot produz o documento em minutos a partir de poucos dados, o custo de escrever foi para perto de zero, e o documento sozinho já não separa quem fez de quem não fez.
Mova o custo para algo que a IA não faz por quem não sabe.
Quatro formas possíveis, todas hipóteses nossas a testar: uma conversa curta em que o autor explica a decisão mais difícil do texto (a regra do Clay, “o que você quis dizer com esta linha?”); um histórico verificável de entregas, que é o que os empregadores da amostra passaram a olhar; uma amostra pequena de trabalho feito na hora; e a declaração de que parte do texto foi escrita com IA, como faz o Figma, que torna visível o que antes era invisível.
O método tem um preço, e convém dizê-lo. Uma conversa de dez minutos por pessoa custa ao gestor mais tempo do que ler um texto, e é por isso que ela informa: o custo agora está do lado de quem decide. Por isso, a escolha de onde mover o custo deve seguir o quanto cada decisão custa se errar. Uma promoção ou um contrato grande justificam a conversa. Um relatório de rotina, não. Hipótese nossa, a testar em um processo antes de estender a todos.
Parte 6 / Limites
O que este texto não prova
A reportagem sobre a Disney descreve uma orientação interna vista pela Business Insider e não mede o resultado das avaliações. A reportagem sobre o Clay, o Figma e a Dupe.com relata o que as próprias empresas e seus executivos dizem em redes sociais, sem auditoria. Os dois estudos são de economistas e são versões de trabalho de novembro de 2025, sem revisão por pares confirmada por este texto. Usam dados de uma plataforma de freelancers de programação, em um período anterior a 2026. Medem correlação entre texto e resultado de contratação, e não esforço direto; o estudo da Yale encontra a queda da correlação e a atribui à IA com base em um desenho de comparação (diferença em diferenças), cujo efeito sobre chamadas é significativo a 10% e não a 5%. Os 19% e 14% da simulação não são medidas. A leitura do mecanismo de Spence vem do verbete da Wikipedia. Tudo o que o texto diz sobre avaliações internas de empresas, sobre gestores de equipes grandes e sobre as formas de mover o custo é hipótese da Invisible Work, e não há aqui dado sobre empresas brasileiras.
Parte 7 / Perguntas para levar adiante
O que o seu texto ainda prova?
Seis perguntas para quem decide promoções, contratações e contratos, ou responde por esses processos.
Sobre os documentos que a empresa lê
- Quais decisões caras dependem de um texto que alguém escreveu sobre si mesmo ou sobre a própria proposta?
- Se você misturasse, sem identificar, textos escritos por quem fez muito e por quem fez pouco, saberia separá-los?
- Quanto tempo gestores e a área de pessoas gastam lendo textos que, hoje, qualquer pessoa consegue produzir em minutos?
Sobre onde pôr o custo
- Em que ponto do processo a pessoa precisa explicar, de viva voz ou ao vivo, a decisão mais difícil do que escreveu?
- Que histórico verificável (entregas, resultados, referências) você já tem e ainda não usa na hora de decidir?
- Quem em sua empresa perde com a mudança: o gestor com pouco contato com cada pessoa, ou o profissional que ainda não tem histórico?