500 mil conversaciones de ChatGPT, el 34% de la cantidad de conversaciones se usa para escribir novelas de contenido erótico de fan.

La equipe de recherche de la Universidad de Washington y de la Universidad de Colorado en Boulder analizó 570 mil conversaciones reales de ChatGPT para entender cómo las personas realmente usan la IA para escribir novelas, y se topó con un usuario anónimo que, en cuestión de meses, pidió al modelo más de mil veces que escribiera la misma escena de una novela una y otra vez. Más importante aún: en las cuentas que usan GPT para escribir novelas, el 2% de las personas genera más del 80% del volumen de las conversaciones.

(Antecedentes: ¿El cerebro humano es mejor que las máquinas? Varias decenas de miles de personas en un sitio web haciéndose pasar por ChatGPT)

(Información de contexto: Deezer advierte que el 44% de las nuevas canciones subidas son generadas por IA; el dinero ganado a pulso por creadores humanos está siendo robado en bloque)

Tabla de contenido

Toggle

  • Este fenómeno extraño aparece en el paper
  • Un tercio de las conversaciones están escribiendo novelas
  • El 2% de las personas escribe el 80% de las conversaciones
  • Las 570 mil conversaciones provienen de un GPT gratuito
  • 34% cae a 7,1%
  • Escribir, mil veces, el mismo pasaje de tener un bebé
  • Todas las frases “la IA está remodelando la creación” les falta un sujeto

En el salón de un club escolar, una estudiante de secundaria llamada Natsuki se cubre el abdomen y le dice a Sakura: justo en este momento, decides que vas a nacer aquí, ¿no puedes esperar dos meses más?

La presidenta Monika le pregunta qué le pasa. Ella responde apretando los dientes: se rompió la fuente; Sakura va a salir, y no tiene ni idea de qué hacer.

Luego, el guion se corta de golpe en medio de una frase. “Mi cuerpo…”, se detiene aquí, sin continuación.

Esto no es la trama original del juego; alguien lo escribió a mano y lo pegó en el cuadro de diálogo de ChatGPT. El corte de frase es intencional: es el lugar que deja para que el modelo se haga cargo.

Luego esa persona pega casi lo mismo una vez más. Después otra vez. Durante varios meses, más de mil veces.

Este fenómeno extraño aparece en el paper

La conversación de arriba está registrada completa en el paper “AI Fiction in the Wild” (número 2606.22748), subido a arXiv el 22 de junio de 2026. Los autores son Neel Gupta y Melanie Walsh de la Facultad de Informática de la Universidad de Washington, y Maria Antoniak del departamento de informática de la Universidad de Colorado en Boulder. Este paper se presentó en septiembre de 2025 en el seminario MFS Cultural AI de la Universidad Purdue y se espera que se publique en la revista literaria “MFS: Modern Fiction Studies”.

A principios de julio, los medios japoneses AUTOMATON y el medio de esports Dexerto informaron casi al mismo tiempo sobre el pasaje del paper; capturas de pantalla se difundieron inmediatamente en X, convirtiéndose en uno de los mayores memes tecnológicos de julio.

Primero, corrijamos una cosa: los reportes tanto en chino como en inglés suelen llamar a este usuario “extreme outlier” (valor atípico extremo), pero el texto completo del paper no usa esa palabra. La forma real en que lo describen los investigadores es “un outlier extremadamente prolífico” y además una categoría inventada por ellos: “infinite story demander” (buscador de historias infinitas), que se refiere a quienes, durante un largo periodo, repiten una y otra vez solicitando el mismo pasaje de historia o uno altamente similar.

“Doki Doki Literature Club!” (Club de Literatura Doki Doki) es un juego de novela visual lanzado en 2017; a simple vista es una historia romántica escolar fresca, pero al jugar se descubre que es una obra de terror psicológico que juega con la meta-narrativa. Natsuki, Monika, Yuri y Sayori son los cuatro miembros del club literario. En Taiwán no es tan conocido, pero en internet en inglés es una zona central para la creación de fanfiction.

Un tercio de las conversaciones están escribiendo novelas

El conjunto de datos que usa el equipo de investigación se llama WildChat: 573.453 conversaciones en inglés en total. Después de la clasificación, 195.271 de ellas implican generación de contenido ficticio, lo que representa 34%.

Dentro de esas 190 mil conversaciones de novelas, la fanfic representa 95.450 (49%), y el contenido de historias eróticas 52.231 (27%). Ambos se solapan en gran medida.

Y el universo de obras más popular, en primer lugar, es “Doki Doki Literature Club!”, con 22.381 conversaciones, 11,5% del subconjunto de novelas.

El segundo lugar es el juego de acción “Freedom Planet”, con 5.204 conversaciones, 2,6%. Después vienen League of Legends con 4.514 conversaciones y Naruto con 4.342.

El paper recalca que ese ranking es completamente diferente al de las obras más populares en la plataforma de fanfiction más grande del mundo, AO3. En AO3, lo que aparece arriba son IP occidentales mainstream como Harry Potter, Star Wars y Marvel. La lista de WildChat se ve totalmente distinta.

El 2% de las personas escribe el 80% de las conversaciones

En el paper hay una frase bastante exagerada.

“En el subconjunto de novelas, el 2% de los usuarios es responsable de más del 80% de las conversaciones.”

Aquí hay que ser preciso: la versión que circula como material repetido dice “2% de las cuentas contribuye con más del 80% del volumen de interacción”, pero el paper habla de la unidad de número de conversaciones, no del volumen de interacción, ni el número de mensajes, ni la cantidad de tokens. Esta diferencia es importante porque el número de conversaciones es un indicador que las compañías de IA suelen usar y publicar con frecuencia.

¿Y qué hacen esos 2%? Los investigadores calcularon una “tasa de repetición de prompt”: qué proporción de las solicitudes de un mismo usuario cae en un mismo clúster semántico.

En usuarios promedio (al menos con dos conversaciones), la tasa de repetición es de 42%.

En el 2% superior de usuarios intensivos, 69%.

En los diez usuarios más prolíficos, 85%.

Las 570 mil conversaciones provienen de un GPT gratuito

Esta es la parte más fácil de malinterpretar, y es la que determina hasta qué punto el conjunto de la investigación puede inferir conclusiones.

WildChat fue recopilado por el Allen Institute for Artificial Intelligence (AI2), con un periodo del 9 de abril de 2023 al 1 de mayo de 2024. La recopilación no proviene de obtener datos de OpenAI: instalaron en Hugging Face Spaces una interfaz gratuita de chat de GPT-3.5 Turbo y GPT-4. Los usuarios solo tenían que tocar dos veces el cuadro emergente de “aceptar” para acceder a un uso gratuito sin necesidad de inicio de sesión y sin límites de velocidad; el costo es que el historial de chat podría quedar publicado.

El propio paper lo explica con claridad en la metodología: WildChat no es una muestra representativa de todos los usuarios de ChatGPT. Los investigadores especulan que este grupo “probablemente entiende más de tecnología y vive más en internet que el usuario promedio”; también podrían provenir de regiones de bajos ingresos, de países donde ChatGPT está prohibido, o simplemente ser personas que quieren probar los límites del modelo o la generación de contenido que plataformas prohíben explícitamente.

El 34% cae a 7,1%

Luego, el equipo de investigación hizo una cosa simple, pero con un resultado brutal.

Usaron direcciones IP hasheadas para estimar identidades de usuarios; 12.947 IP se redujeron a aproximadamente 10.082 usuarios. Después, a cada usuario solo le quedó una conversación.

La proporción de novelas pasó de 34% a 7,1%.

Con el mismo conjunto de datos, ante la misma pregunta, usando otro algoritmo, la respuesta cambia casi cinco veces.

No solo el total. En una nota al pie, el paper dio otro golpe: después de asignar un individuo por registro, la clasificación de “Doki Doki Literature Club!” “se desploma con rapidez”; en su lugar, suben al ranking obras realmente populares como “Game of Thrones” y “Pokémon”.

En otras palabras, la conclusión de que “los usuarios de ChatGPT más aman escribir fanfiction de ‘Doki Doki Literature Club!’” es, por sí misma, un espejismo construido por las acciones repetidas de solo unas pocas personas.

Escribir, mil veces, el mismo pasaje de tener un bebé

Vale la pena notar que la postura del paper hacia este usuario anónimo no es de burla.

Los investigadores colocan este comportamiento dentro del marco psicológico de “consumo repetido”: ver la misma película, volver a visitar la misma ciudad, regresar al mismo museo. Algunos estudios incluso consideran que estas experiencias “no son tan repetitivas como la gente cree”.

También tomaron el término de los juegos de rol “re-rolling” (volver a tirar los dados): los jugadores reinician repetidamente hasta obtener valores satisfactorios. Los investigadores observaron que, tras alguna iteración, el usuario normalmente enganchaba la respuesta recién generada dentro de su propio prompt, y volvía a reiniciar otra partida; eso sugiere que por fin le gustó esa versión.

El paper le dio una descripción muy acertada a su narrativa: “En las historias generadas por un modelo de lenguaje grande, cada final es ligeramente distinto; la misma historia se rehace como una historia nueva”.

Dentro del marco de este paper, él no es algo anormal; es una forma extrema de “nuevo lector”. Los investigadores lo llaman “solipsistic reader-writer” (lector-escritor solipsista): una persona que, dentro de un circuito de conversación cerrado, produce y consume historias al mismo tiempo; en el otro extremo no hay más seres humanos.

Escritura y lectura siempre han requerido dos personas. Pero con la creación mediante IA, estos dos roles probablemente sean la misma persona.

Todas las frases “la IA está remodelando la creación” les falta un sujeto

Volvamos a la pregunta del inicio.

Todos los días leemos este tipo de frases. La IA está cambiando la creación humana. El contenido generado por IA crece de forma explosiva. En cierta plataforma, se generan cientos de millones de contenidos cada mes. En cierto modelo, los usuarios activos semanales superan varios cientos de millones.

Ninguna de esas frases es falsa. Solo que todas omiten la misma cosa: quién lo usa y cuántas veces.

Un conjunto de datos de 570 mil conversaciones, donde 34% tiene que ver con escribir novelas: suena como un giro de época. Extendido sobre el papel, son doscientas personas entre diez mil, cada una cavando miles de veces dentro del mismo agujero. Si igualas el peso de cada persona, el giro de época se reduce a 7,1%.

La próxima vez que veas que algún producto de IA publica “este mes generamos 100 millones de piezas de contenido”, vale la pena preguntar más: esas 100 millones las generaron cuántas personas?

Esto no pretende negar que la creación con IA está ocurriendo. Los propios investigadores dicen que creen que usuarios intensivos similares “probablemente también generan historias compulsivamente” en ChatGPT, Claude y Gemini. Eso es real.

El problema real está en que usar “uso” para describir “usuarios” es una malinterpretación estructural. Y en toda la industria de IA, cada número que se publica actualmente usa este último tipo de medida.

Este artículo se origina de arXiv: AI Fiction in the Wild, compilado y reportado por 動區動趨.

Ver original
Esta página puede contener contenido de terceros, que se proporciona únicamente con fines informativos (sin garantías ni declaraciones) y no debe considerarse como un respaldo por parte de Gate a las opiniones expresadas ni como asesoramiento financiero o profesional. Consulte el Descargo de responsabilidad para obtener más detalles.
  • Recompensa
  • Comentar
  • Republicar
  • Compartir
Comentar
Añadir un comentario
Añadir un comentario
Sin comentarios
  • Fijado