Estudo identifica padrões linguísticos que revelam textos gerados por IA
Pesquisa da Graphite aponta frases e vícios de linguagem recorrentes que distinguem conteúdos produzidos por modelos de IA de textos humanos.
Pontos principais
- A análise comparou textos de IA com um corpus de 10.000 artigos escritos por humanos antes do ChatGPT.
- Foram identificadas 13.000 frases que aparecem com frequência duas vezes maior em conteúdos de IA.
- O modelo Claude Opus 5.5 utiliza expressões como 'this matters' e 'why X matters' com alta recorrência.
- Modelos da OpenAI, como o Astra, frequentemente empregam construções de 'enquadramento corretivo'.
- Especialistas apontam que laboratórios de IA ainda enfrentam dificuldades para controlar esses vícios de linguagem.
Um estudo conduzido pela empresa de marketing Graphite revelou que modelos de inteligência artificial possuem padrões linguísticos distintos que facilitam a identificação de textos não humanos. Ao analisar um vasto corpus de artigos, pesquisadores identificaram 13.000 frases que aparecem pelo menos duas vezes mais em conteúdos gerados por máquinas do que em produções humanas. O modelo Claude Opus 5.5, por exemplo, apresenta uma preferência marcante por expressões como 'this matters', enquanto o modelo Astra, da OpenAI, utiliza frequentemente estruturas de enquadramento corretivo.
Segundo Greg Druck, chief AI officer da Graphite, a persistência desses vícios de linguagem ocorre devido à complexidade técnica dos modelos, o que dificulta o controle total por parte dos desenvolvedores. Embora laboratórios tenham ajustado certos hábitos, como o uso excessivo de travessões, novos padrões continuam a surgir a cada atualização. Essas descobertas destacam como a escrita de modelos de IA mantém marcas registradas que, apesar dos avanços, ainda denunciam a origem automatizada do conteúdo.
Cobertura da mídia
Comentários
Carregando comentários...
