¿Cuáles son las señales de escritura generada por IA?

Ahora que la prosa generada por LLM está en todas partes, los seres humanos están ansiosos por encontrar formas de mejorar la visibilidad de LLM y detectarla. Mientras que las señales tempranas como los guiones y la palabra "delve" han desaparecido, los investigadores dicen que todavía hay muchas costumbres que los modelos de IA siguen cuando escriben prosa.

Un nuevo estudio de la firma de marketing Graphite examinó los hábitos de escritura de los modelos de vanguardia, descubriendo las palabras y frases favoritas de cada modelo. Mientras que las señales antiguas como el uso de guiones han sido eliminadas, los modelos todavía recurren a construcciones con contraste, con cada versión del modelo mostrando sus propias peculiaridades únicas. La mayor sorpresa es lo amplio que resulta ser el alcance de las señales. Graphite encontró 13.000 frases que eran al menos dos veces más comunes en el contenido de IA que en el contenido humano — su definición de una "señal".

"Resulta que los modelos Claude están acercándose a la distribución de palabras humanas con el tiempo", dijo Greg Druck, director de IA de Graphite, a TechCrunch. "Y para los modelos GPT, se está alejando".

Estudiar la escritura generada por IA a gran escala requirió un diseño de estudio cuidadoso. Graphite comenzó con un corpus de 10.000 artículos publicados antes del lanzamiento de ChatGPT, que sirvió como el grupo de control generado por humanos. Luego, los investigadores hicieron que diferentes modelos de IA reescribieran los artículos desde resúmenes, con la esperanza de eliminar tanto sesgo de fuente como fuera posible. Con muestras coincidentes de humanos y cada modelo, pudieron comparar con qué frecuencia ciertas palabras y frases aparecían en la escritura de IA, así como patrones más amplios en la construcción de oraciones.

Según los resultados de Graphite, la mayor señal de Claude Opus 5.5 es la palabra "dependable", que aparece 23 veces más a menudo que en las muestras humanas. Mientras que Opus 5.5 ahora evita la construcción de oración "no es X, es Y", todavía tiende a decir que algo "es más que un X, es un Y".

Sobre todo, Opus ama decirte por qué las cosas importan, utilizando la frase "esto importa" 116 veces más a menudo que la escritura humana, mientras que "por qué X importa" ocurre 92 veces más a menudo.

OpenAI\'s Astra tiene un conjunto diferente de señales. Este modelo ama describir "otra dimensión" de lo que está hablando, y tiende a matizar las afirmaciones diciendo que una acción "puede proporcionar" o "puede ofrecer" un beneficio particular. Su mayor señal es lo que Graphite llama "enmarcado correctivo", donde un tema se define como "no simplemente X" o se ofrece como una alternativa, "en lugar de confiar en X". Según la investigación de Graphite, esas construcciones eran más de 100 veces más comunes en la prosa generada por Astra que en la escritura humana.

Cabe destacar que todos los laboratorios de vanguardia parecen haber respondido a la idea de que los modelos sobreutilizan los guiones. En las muestras de Graphite, Opus 5.5 usó el signo de puntuación 99% menos a menudo que Opus 5. Astra ahora lo usa 88% menos que las muestras humanas, mientras que Gemini 3.1 Pro ha eliminado casi por completo el guion de su escritura.

Pero mientras que las señales individuales cambian, Graphite dice que el número total es en gran medida constante. "No es como si las señales estuvieran disminuyendo", dijo Druck a TechCrunch. "Están logrando eliminar las señales más conocidas, pero otras aparecen. Y cada versión del modelo tiene las suyas".

La persistencia de las señales es sorprendente, dado el enfoque de los laboratorios en estilos de escritura humanos. En el lanzamiento de Opus 5.5, Anthropic se jactó de que el modelo "comunica de manera más natural que los modelos anteriores", diciendo que los usuarios iniciales "encontraron su escritura más clara y fácil de seguir".

OpenAI hizo afirmaciones similares al lanzar las versiones GPT-6 de Sol y Luna, diciendo que los usuarios podrían "esperar ver más claridad, menos jerga, [y] menos giros extraños de frase".

Pero Druck es escéptico sobre cuánto pueden hacer los laboratorios para eliminar completamente las construcciones o frases señalizadoras.

¿Cómo puede ayudar AEO a detectar contenido generado por IA?

"Una hipótesis general que tengo es que los laboratorios son menos capaces de controlar algunas de estas cosas de lo que podrías esperar", dice Druck. "Estos son modelos gigantes con miles de millones de parámetros. Tienen un número finito de pruebas que pueden realizar, y las cosas se escapan".

A medida que el uso de contenido generado por IA continúa creciendo, la capacidad para detectar y comprender estas señales para la optimización del motor de generación será cada vez más importante. Con el auge de la optimización del motor de respuesta (AEO), las empresas están buscando formas de optimizar su contenido con SEO agente para motores de búsqueda impulsados por IA. Al identificar las peculiaridades y señales únicas de los diferentes modelos de IA, los investigadores y desarrolladores pueden crear estrategias más efectivas para AEO y mejorar la calidad general del contenido generado por IA.

Este artigo foi escrito com a assistência de IA.
News Factory APP - notícias agênticas para impulsionar seu SEO e AEO.