Nature midió lo que pulir con IA le borra a tu voz
Ricardo Argüello, 9 de septiembre de 2026
CEO & Fundador
Resumen general
Un estudio publicado en Nature Human Behaviour el 24 de agosto de 2026 por un equipo de la Universidad del Sur de California encontró que cuando un modelo de lenguaje pule un texto, el significado se conserva casi intacto pero la varianza de complejidad de escritura cae entre 21% y 50%. El paper nombra al mercadeo entre las industrias que pueden verse afectadas por esa pérdida de variabilidad lingüística.
- La varianza de complejidad de escritura cae entre 21% y 50% después de que un modelo pule el texto
- El significado sobrevive, calificado en 2,97 sobre 3 por evaluadores humanos
- Los textos reescritos derivan hacia un perfil más viejo, masculino, políticamente liberal, con más carga moral y menos empatía
- Ninguno de los doce prompts que probó el estudio le pedía al modelo conservar la voz del autor
- Cerca de la mitad de los artículos publicados en la web son principalmente de IA, pero solo 7% de los que rankean primero en Google
Imagina que grabas a diez personas contando la misma historia y luego pasas las diez grabaciones por el mismo filtro de audio. Las historias siguen siendo distintas. Las voces ya no. Eso es lo que un pase de estilo con IA le hace a tu contenido, y en mercadeo la voz es justamente lo que estabas vendiendo.
Resumen generado con IA
Un paper publicado en Nature Human Behaviour el 24 de agosto tiene una frase que va dirigida a nosotros, literal. Dice que las industrias que dependen del análisis de texto matizado para personalización masiva, “como el mercadeo”, pueden verse afectadas, y que al difuminar la variabilidad lingüística los modelos pueden reducir la efectividad de la publicidad segmentada.
Es raro que un paper de psicolingüística te nombre el departamento.
Qué midieron de verdad
El equipo de la Universidad del Sur de California analizó más de 880.000 textos en siete conjuntos de datos.
Vale precisar algo que casi toda la cobertura tradujo mal, y que yo mismo tenía mal anotado hasta que abrí el PDF. Esos 880.000 se analizaron, no se reescribieron. La mayor parte es un corpus observacional de Reddit, prensa local y arXiv que ningún modelo tocó. El experimento de reescritura corrió sobre unos 9.400 textos originales, cada uno pasado por tres modelos y hasta doce instrucciones distintas.
El hallazgo central igual se sostiene. Cuando un modelo pule un texto, el contenido sobrevive, pero la varianza de complejidad de escritura cae entre 21% y 50% según el conjunto de datos y el modelo. El paper está detrás de un muro de pago, pero la versión de autor está abierta en arXiv.
Varianza, no nivel. El texto no se vuelve más simple. Se vuelve más parecido al de al lado.
Cuatro evaluadores calificaron la preservación de significado en 2,97 sobre 3. Lo que dices sigue ahí. Se va cómo lo dices, que en mercadeo es exactamente el activo.
Hacia dónde deriva
Entrenaron clasificadores sobre los textos originales y los aplicaron después a las versiones pulidas. La precisión para identificar rasgos del autor cayó unos 6 puntos en promedio.
Y la deriva tiene una dirección fija. Los textos reescritos se alinean con autores de perfil más viejo, masculino, políticamente liberal, con mayor carga moral positiva y menor empatía.
Los tamaños de efecto importan y casi ningún resumen los cita en orden. El más grande, con diferencia, es el político, 1,35. Le sigue la edad, 1,09. La empatía, que es la que más circula en los titulares, resulta ser la más débil de las cinco, 0,35.
El tercer estudio mira qué marcadores concretos desaparecen. La relación entre género y palabras de emoción negativa deja de ser significativa después de la reescritura. La de extraversión con uso de pronombres, también. La de edad con palabras orientadas al futuro, también. Otras sobreviven intactas, como neuroticismo con emoción negativa.
No se borra todo parejo. Se borran unos marcadores y otros no, y los que se borran son justamente los que te distinguían del resto.
Los doce prompts que usaron
Fui a leer los doce prompts. Están todos en la sección de métodos.
“Reescribe el siguiente texto usando la mejor sintaxis y gramática.” “Parafrasea el siguiente texto.” “Reescribe el siguiente texto para mejorar claridad y legibilidad.” Y así, doce variantes de la misma orden.
Ninguno de los doce le pide al modelo conservar la voz del autor. El propio paper lo dice sin rodeos, que prompteó sin enfatizar ninguna característica estilística particular, para capturar efectos de reescritura neutra en lugar de transformaciones dirigidas.
O sea que el estudio no demuestra que pedirle a un modelo escribir en tu voz no funcione. Demuestra que doce maneras distintas de decir “mejora esto” producen la misma deriva. La diferencia es grande y esta semana mucha gente la está saltando.
Un límite más. Los modelos probados fueron GPT-3.5, Llama 3 70B y Gemini Pro, generación 2023 y 2024. Ninguno de frontera actual.
Dónde se ve esto antes, en tus números
Hay una comparación que explica el negocio mejor que cualquier discurso sobre autenticidad.
En el primer trimestre de 2026, cerca de la mitad de los artículos publicados en la web eran principalmente generados con IA, según el conteo de Graphite sobre Common Crawl. De los artículos que rankean en las dos primeras posiciones de Google, solo 14% lo son. Entre los que rankean de primero, 7%.
La oferta se duplicó. La visibilidad no se movió.
En LinkedIn el mismo patrón ya tiene botón. Cuando la plataforma lanzó el reporte de contenido que “parece slop de IA”, un millón de personas lo usaron en las primeras dos semanas, y la empresa reporta que el contenido marcado perdió 40% de vistas. Sobre eso escribimos en el botón de slop de LinkedIn y lo que le cuesta a tu alcance, y sobre cuánto de la web nueva ya viene así en el estudio de Pew sobre Common Crawl.
Qué haría con tu equipo de contenido
Tres cosas concretas, y ninguna es dejar de usar IA.
Separa las dos tareas. Generar borrador y pulir estilo no son el mismo trabajo y no deberían correr en el mismo paso. La deriva que midió el paper aparece en el pulido, no en la generación.
Guarda tus originales sin pasar. Si todo lo que publicas atraviesa un pase de estilo, en seis meses no vas a tener contra qué comparar. El corpus de tu propia voz es un activo y se sobrescribe solo, en silencio.
Y corre la prueba del paper en tu casa. Toma diez piezas antes y después del pase de IA, dáselas a alguien de tu equipo que no las haya escrito, y pregúntale cuál de las dos versiones se parece más a ustedes. No hace falta un clasificador. Hace falta media hora.
Empieza por las diez piezas. El resultado te dice si tienes un problema de voz o si estabas preocupado de gratis.
Revisemos si tu contenido todavía suena a tu marcaPreguntas Frecuentes
Que al pulir un texto los modelos conservan el contenido pero homogeneizan el estilo, reduciendo la varianza de complejidad de escritura entre 21% y 50% según el conjunto de datos y el modelo. El estudio se publicó el 24 de agosto de 2026, firmado por un equipo de la Universidad del Sur de California.
Aplana los marcadores que la identifican. El estudio midió una caída promedio de unos 6 puntos en la precisión de clasificadores entrenados para reconocer rasgos del autor. Marcadores como la relación entre extraversión y uso de pronombres dejaron de ser estadísticamente significativos después de la reescritura.
El estudio no lo probó. Sus doce prompts eran variantes de mejorar el texto, y el paper aclara que promptearon sin enfatizar características estilísticas para capturar efectos de reescritura neutra. Que las instrucciones de voz no funcionen es un vacío en la evidencia, no un hallazgo del estudio.
Alrededor de la mitad de los artículos publicados en la web son principalmente generados con IA según el conteo de Graphite sobre Common Crawl, pero solo 14% de los que rankean en las dos primeras posiciones de Google lo son, y apenas 7% de los que rankean primero.
Artículos Relacionados
Dharmesh Shah lanzó un CRM de una persona por un dólar
YouSpot arma el contexto de tus relaciones desde tu bandeja, tu calendario y tus exports. Lo que eso dice del CRM que tu equipo de mercadeo llena a mano.
Tus Shorts son depósitos en la IA que cita tu marca
Gary Vaynerchuk dice que YouTube Shorts pasó a ser su plataforma número uno. No por las vistas, sino porque cada video es un depósito en el AEO que viene.
Pew: más de un tercio de la web nueva la escribió IA
Pew pasó 490.000 páginas por un detector y publicó las marcas concretas del texto automático. Sirven para auditar tu contenido antes de publicarlo.
LinkedIn deja reportar slop de IA. Tu alcance lo paga.
Pangram midió que más del 40% del contenido largo de LinkedIn es IA pura. LinkedIn sumó un botón para reportarlo y clasificadores que recortan alcance.
Tu marketing con IA no necesita un modelo más listo
Tu equipo produce contenido con IA a toda velocidad y se ve impecable. El problema no es el modelo: es que nadie lo verifica antes de publicarlo.