Patrones lingüísticos que revelan a la IA

A medida que los textos generados por modelos de lenguaje se multiplican, la capacidad de identificar su origen artificial se ha convertido en un desafío. Un estudio reciente de la firma de marketing Graphite analizó los hábitos de escritura de diversos modelos avanzados, detectando hasta 13.000 frases que aparecen con una frecuencia significativamente mayor en el contenido generado por máquinas que en el redactado por personas.

El análisis, que utilizó un grupo de control de 10.000 artículos escritos por humanos antes del auge de estas herramientas, reveló que cada versión de IA posee sus propias peculiaridades. Mientras que algunos modelos han logrado reducir el uso excesivo de ciertos signos de puntuación, como el guion largo, han surgido nuevos patrones que actúan como huellas digitales del software.

Las muletillas de Opus 5.5 y Astra

El comportamiento de los modelos varía notablemente. En el caso de Claude Opus 5.5, el estudio destaca una obsesión por enfatizar la relevancia de los temas. El modelo utiliza la frase «esto importa» 116 veces más que un redactor humano, mientras que la estructura «por qué X importa» aparece 92 veces más. A pesar de que en el lanzamiento de Opus 5.5, sus creadores aseguraron que el modelo se comunica de forma más natural, los datos sugieren que aún mantiene vicios de estilo marcados.

Por su parte, el modelo Astra de OpenAI presenta un conjunto distinto de delatores. Esta IA tiende a emplear «marcos correctivos», definiendo conceptos como «no simplemente X» o sugiriendo alternativas con «en lugar de confiar en X», construcciones que son más de 100 veces más comunes que en la escritura humana. Aunque empresas como OpenAI, al presentar las versiones GPT-6 de Sol y Luna, prometieron mayor claridad y menos jerga, los expertos advierten que el control sobre estos modelos gigantes es limitado debido a su complejidad, permitiendo que ciertos patrones se filtren constantemente en sus respuestas.