Modelos de ponta ainda têm marcas registradas apesar de esforços para eliminá-las, revela estudo
Estudo da empresa de marketing Graphite identificou mais de 13.000 frases desproporcionalmente favorecidas por LLMs modernos, mostrando que, embora os modelos tenham abandonado velhos hábitos como o travessão, novos vícios de estilo continuam surgindo.
Um novo mapa das impressões digitais linguísticas da IA generativa
Mesmo com o desaparecimento de marcas clássicas da escrita de inteligência artificial, como o travessão e o verbo "delve", modelos de linguagem de ponta continuam recorrendo a hábitos linguísticos distintos e repetitivos. Um estudo realizado pela empresa de marketing Graphite analisou a prosa dos principais modelos de fronteira para identificar as frases e construções que diferenciam textos sintéticos da produção humana.
Para isolar esses padrões, a Graphite montou uma base de dados de controle com 10.000 artigos de autoria humana publicados antes do lançamento do ChatGPT. Em seguida, os pesquisadores instruíram diversos sistemas de IA de ponta a reescrever esses textos baseando-se unicamente em resumos, minimizando o viés herdado do texto original. Ao analisar os resultados emparelhados, a Graphite identificou cerca de 13.000 frases que apareceram pelo menos duas vezes mais frequentemente no texto gerado por máquina do que na linha de base humana — frequência adotada pela empresa como a definição de referência para uma "marca reveladora".
As descobertas destacam uma divergência na forma como diferentes famílias de modelos reproduzem a prosa humana ao longo do tempo. "Acontece que os modelos Claude estão, na verdade, se aproximando da distribuição de palavras humana ao longo do tempo", disse o diretor de IA da Graphite, Greg Druck, ao TechCrunch. "E, para os modelos GPT, ela está se distanciando."
Como o Opus 5.5 e o Astra se revelam na prosa
O estudo constatou que modelos individuais exibem assinaturas estilísticas nitidamente definidas. O Claude Opus 5.5, da Anthropic, por exemplo, recorre com frequência à palavra "dependable", utilizando-a 23 vezes mais do que redatores humanos. Embora o modelo tenha abandonado em grande parte a clássica antítese "não é X, é Y", ele a substituiu por outra fórmula de contraste, afirmando com frequência que determinado tema "é mais do que um X, é um Y". O Opus 5.5 também demonstra uma tendência esmagadora a enfatizar relevância: a expressão exata "this matters" apareceu 116 vezes mais frequentemente do que no grupo de controle humano, enquanto "why X matters" surgiu 92 vezes mais.
Em contrapartida, o modelo Astra, da OpenAI, apresenta um vocabulário completamente diferente. O Astra favorece fortemente a expressão "another dimension" e costuma atenuar afirmações com ressalvas especulativas, como "may provide" ou "can provide". Seu indício mais evidente é o que a Graphite classifica como "enquadramento corretivo" — construções que estruturam tópicos como "não apenas X" ou propõem alternativas "em vez de depender de X". A Graphite registrou esses padrões corretivos mais de 100 vezes mais frequentemente nos textos do Astra do que na escrita humana.
Os hábitos de pontuação também mudaram de forma drástica de maneira geral. Em resposta a críticas generalizadas sobre o uso excessivo de travessões, os laboratórios de ponta parecem ter ajustado seus modelos para se afastarem do sinal gráfico. O Opus 5.5 utilizou travessões 99% menos vezes do que seu predecessor, o Opus 5. O Astra empregou o sinal de pontuação 88% menos frequentemente do que a referência humana, enquanto o Gemini 3.1 Pro, do Google, praticamente eliminou o travessão de seus textos.
A dificuldade de eliminar marcas reveladoras em modelos gigantescos
Apesar das atualizações direcionadas para eliminar pistas estilísticas conhecidas, a Graphite descobriu que o volume total de vícios da IA permanece amplamente estável. Em vez de desaparecerem, os indícios simplesmente se alternam à medida que novas arquiteturas e conjuntos de dados de fine-tuning são implementados. "Não é que os vícios estejam diminuindo", afirmou Druck. "Eles estão conseguindo remover os mais conhecidos, mas outros surgem. E cada versão de modelo tem os seus próprios."
A persistência desses hábitos vai na contramão do posicionamento dos grandes laboratórios de IA, que vêm promovendo novos lançamentos como sendo mais fluentes e naturais. A Anthropic promoveu o Opus 5.5 destacando que os primeiros testadores acharam sua prosa mais clara e fácil de acompanhar, enquanto a OpenAI assumiu compromissos semelhantes com as versões Sol e Luna do GPT-6, prometendo menos jargões e menos escolhas estranhas de fraseado.
Druck sugeriu que eliminar por completo essas peculiaridades estilísticas pode estar além do alcance das técnicas atuais de treinamento. "Uma hipótese geral que tenho é que os laboratórios têm menos controle sobre algumas dessas coisas do que se imagina", observou Druck. "São modelos gigantescos, com bilhões de parâmetros. Eles têm um número finito de testes que podem realizar, e algumas coisas passam batidas."


