A IA apresenta às empresas oportunidades reais para melhorar a eficiência. Também traz novos desafios, razão pela qual as empresas procuram cada vez mais usar uma forma específica de IA contra a IA: os detetores de IA.

Existem razões legítimas para usar detetores de IA: proteger o tom de voz da marca, detetar fraudes, identificar plágio, obter uma boa relação qualidade-preço de prestadores de serviços e muito mais.

Mas os detetores de IA não são infalíveis e, para a maioria das empresas, os riscos de os usar superam os benefícios. Eis o que precisa de saber antes de usar um.

Como funcionam os detetores de IA?

Os detetores de IA são software especializado que analisa matematicamente padrões para estimar a probabilidade de o texto ter sido gerado por uma máquina. Os detetores populares incluem o GPTZero, Copyleaks, Originality.ai, Sapling, Turnitin e Grammarly AI Detector.

Aquilo que os detetores de IA procuram, em termos técnicos, resume-se a duas métricas:

  • Perplexidade mede o quão previsível é uma sequência de palavras. Uma menor previsibilidade significa menos probabilidade de envolvimento de IA, porque os modelos de IA são treinados para adivinhar e usar as palavras estatisticamente mais prováveis. Os seres humanos fazem escolhas de palavras mais variadas e excêntricas.
  • A intermitência mede a variação no comprimento e complexidade das frases. A escrita humana apresenta “disparos contínuos” com uma mistura de tipos de frases, enquanto a IA que procura probabilidades tende a escrever de uma forma regular, fluida e quase matemática. Um texto com baixo nível de intermitência indica fortemente o envolvimento de IA a um detetor.

Alguns detetores de IA também utilizam a análise estilométrica, avaliando a escolha de vocabulário e a gramática, procurando estruturas suspeitamente rígidas e formais.

Alguns modelos de IA estão a começar a usar marcas de água, o que envolve incorporar padrões invisíveis e detetáveis no texto gerado por IA no momento da criação. No entanto, como a maioria dos modelos não deixa atualmente qualquer rasto, ainda não se pode confiar nesta solução.

Os detetores de IA são fiáveis?

Os detetores de IA nunca são 100% fiáveis e, frequentemente, são significativamente menos fiáveis do que isso.

A precisão varia significativamente entre ferramentas, tipo de conteúdo e (criticamente) a forma exata como a IA foi utilizada para criar o conteúdo analisado, se é que chegou a ser utilizada.

Quando os detetores funcionam

Cole o resultado de IA inalterado (ou ‘bruto’) em qualquer detetor de IA e este detetá-lo-á. O resultado em bruto é fácil de identificar para o detetor porque o padrão estatisticamente provável que ele procura não foi quebrado.

Por exemplo, colámos texto gerado diretamente do Claude Sonnet 4,6 no Sapling. O Sapling tinha 99,5% de confiança de que este texto gerado por IA tinha sido, de facto, gerado por IA.

O Sapling sinaliza corretamente o parágrafo em bruto gerado por IA.

O Originality (outro detetor de IA de referência) sinalizou o mesmo parágrafo como IA com uma confiança ainda maior: 100%.

O Originality tem ainda mais a certeza de que o nosso texto de IA em bruto foi gerado por IA.

Os detetores também conseguem identificar escrita por IA quando o texto enviado não é 100% gerado por IA, embora de forma significativamente menos fiável, especialmente quando o texto é curto (menos de 300 palavras) e os padrões que os detetores procuram não têm tempo para se estabelecer.

Quando os detetores falham

Está bem documentado que os detetores de IA encontram falsos positivos: sinais de utilização de IA em textos inteiramente escritos por humanos. Um recente estudo de escrita académica revisto por pares(nova janela) avaliou a precisão global do Originality e do Turnitin na identificação de textos académicos gerados por IA em apenas 69% e 61%, respetivamente.

Um problema é que os humanos escrevem frequentemente de forma natural como a IA, particularmente se não forem falantes nativos do idioma, os quais (tal como os LLM) usam frases simples e altamente gramaticais. Um estudo de Stanford(nova janela) colocou sete detetores de IA populares a analisar redações do Test of English as a Foreign Language de estudantes chineses. A taxa média de falsos positivos foi de 61,22%.

Também é difícil para os detetores identificarem quando os seres humanos perturbam deliberadamente os padrões estatísticos que estes procuram. Os autores que recorrem à assistência da IA não precisam de fazer muito para quebrar esses padrões: reescrever algumas frases, variar a estrutura das frases ou utilizar palavras menos previsíveis.

Se isto parecer demasiado trabalho, podem fazê-lo através de uma das cada vez mais numerosas ferramentas de ‘humanização’ que inevitavelmente surgiram para contornar os detetores.

Podem também simplesmente limitar-se ao LLM da sua escolha e usar prompts mais inteligentes. Um estudo de 2025 com 12 detetores de IA(nova janela) concluiu que “um polimento mínimo com o GPT-4o pode levar a taxas de deteção que variam entre 10% e 75%, dependendo do detetor”.

Pedimos ao Claude Sonnet 4,6 para escrever um ensaio de 300 palavras sobre a precisão dos detetores de IA, e pedimos-lhe que escrevesse como um ser humano, com comprimentos de frase variados, opiniões diretas e escolhas de palavras inesperadas. O Sapling classificou o texto com apenas 12% de probabilidade de ter sido gerado por IA.

Captura de ecrã de uma ferramenta de deteção de IA que mostra uma passagem de texto de 360 tokens a explicar por que razão os detetores de IA não são fiáveis. Duas frases perto do fim estão realçadas a vermelho como sinalizadas: "Assim como qualquer prosa que priorize a precisão em detrimento da personalidade" e "Em termos simples: estas ferramentas conseguem detetar resultados de IA preguiçosos e não editados com uma confiança razoável. Tudo o resto é adivinhação disfarçada de dados." Abaixo do texto estão um botão verde "Verificar novamente", um menu suspenso "Experimentar uma amostra", um botão para carregar ficheiro "Escolher ficheiro" e um resultado onde se lê "Falso: 12,0%".
O Sapling não consegue identificar o texto do Claude escrito com prompts inteligentes.

O Originality analisou o mesmo texto e declarou que tinha 100% de confiança de que o texto era gerado por IA.

Captura de ecrã do Docs Editor do Originality.ai a digitalizar a mesma passagem sobre a falta de fiabilidade dos detetores de IA, com a maioria dos parágrafos realçada a vermelho/cor-de-rosa, indicando texto sinalizado. O painel de resultados à direita mostra um indicador onde se lê "100% de confiança de que é IA", uma nota que refere que isto reflete a confiança de que o texto é gerado por IA (e não que 100% do texto foi produzido por IA), uma mensagem para "Executar digitalização profunda" para obter explicações detalhadas e uma contagem de carateres de 1704 / 12000.
O Originality classifica o mesmo texto como 100% IA: o veredicto oposto, com igual confiança.

O Originality parece ser a ferramenta superior com base neste teste, mas é importante reconhecer que ambas as ferramentas demonstraram o mesmo nível de confiança na sua análise. Se escreveu o texto analisado, saberá qual o detetor que está correto. Se não o escreveu, nunca poderá ter a certeza.

Como os detetores de IA colocam os seus dados em perigo

O maior problema dos detetores de IA é um que muitas empresas ignoram completamente: os riscos que representam para a privacidade e segurança dos seus dados. Trata-se de riscos semelhantes aos apresentados pela IA em geral:

  • Riscos de conformidade: Os modelos de deteção herdam preconceitos dos dados de treino, criando potencial para resultados discriminatórios e violando as leis de igualdade de oportunidades. Muitos detetores são “caixas negras” e estruturas como a Lei da IA da UE(nova janela) e o NIST AI Risk Management Framework(nova janela) exigem que as organizações forneçam uma lógica clara para os resultados de IA.
  • Riscos de IP e de dados de treino: Muitos detetores de IA têm Termos de Serviço (ToS) que concedem ao fornecedor o direito de armazenar, analisar e usar os dados enviados para treinar futuros modelos. Isto pode significar que o seu fornecedor tem o direito legal de usar quaisquer roteiros de produtos, projeções financeiras e pesquisas proprietárias que tenha enviado, sem qualquer obrigação de garantir a sua privacidade ou de impedir que estes surjam nos resultados de um concorrente.
  • Riscos de segurança de dados: Os detetores de IA são vulneráveis a ciberataques, e o envio de conteúdo para um detetor de terceiros expande a sua superfície de ataque para incluir a do seu fornecedor. Se o seu fornecedor sofrer um incidente de segurança, os seus dados estarão expostos. Ferramentas gratuitas e não verificadas — exatamente o tipo de ferramentas que os funcionários podem ser tentados a usar — não lhe permitirão auditar as práticas de segurança de um fornecedor com antecedência.
  • Riscos de soberania de dados: Enviar um documento para um detetor pode significar a transferência de texto para servidores estrangeiros, privando-o potencialmente de proteções locais e expondo-o à vigilância governamental extraterritorial ao abrigo da lei CLOUD Act(nova janela).

Para a maioria das empresas, a questão não é se os detetores de IA funcionam: é se vale a pena correr os riscos de os utilizar. Se estiver a trabalhar com quaisquer dados sensíveis, originais ou confidenciais, a resposta é não.


FAQ sobre detetores de IA

Como funcionam os detetores de IA?

Os detetores de IA digitalizam texto à procura de padrões que foram treinados para associar a texto gerado por IA. Estes padrões surgem porque a IA gera texto prevendo algoritmicamente e utilizando a palavra seguinte mais provável.

O que procuram os detetores de IA?

Os principais indicadores de texto gerado por IA que os detetores procuram são baixos níveis de ‘perplexidade’ (escolhas de palavras imprevisíveis) e de ‘intermitência’ (variação no comprimento e estrutura das frases).

Alguns modelos de IA estão a começar a experimentar a aplicação de marcas de água, o que significa incorporar padrões invisíveis (mas detetáveis) no texto no momento da sua geração. No entanto, visto que apenas alguns modelos começaram a fazê-lo, as marcas de água ainda não fornecem um teste infalível para o texto gerado por IA.

Os detetores de IA funcionam?

A precisão depende do detetor utilizado, do tipo de texto a ser analisado e de como (se é que o foi) a IA foi usada para gerar o texto. Os detetores funcionam bem com resultados de IA em bruto e não editados. Em qualquer coisa mais complexa — conteúdo editado, escrita humana por falantes não nativos, resultados de IA ligeiramente parafraseados —, a precisão diminui significativamente.

Independentemente da precisão, o maior problema dos detetores de IA é a ameaça que a sua utilização pode representar para a segurança dos seus dados. O envio de conteúdo para um detetor de terceiros implica a sua transferência para servidores externos, expondo-o potencialmente a ciberataques, recolha de dados, vigilância extraterritorial e concessão de direitos legais sobre o seu conteúdo enviado ao fornecedor.

Para a maioria das empresas, especialmente as que trabalham com qualquer conteúdo sensível, original ou confidencial, os riscos para os dados associados à deteção de IA por terceiros superam os benefícios.