Un estudio reciente revela que los relatos cortos generados por ChatGPT son valorados más positivamente que los escritos por humanos, pero solo hasta que los lectores descubren su origen. En tres experimentos que involucraron a más de 2,500 participantes, no lograron diferenciar entre las historias creadas por máquinas y las de autores humanos.
En el primer experimento, 1,682 personas leyeron uno de seis relatos de aproximadamente 1,000 palabras. Tres de ellos fueron seleccionados de revistas literarias reconocidas, mientras que los otros tres fueron generados por ChatGPT 4.0 a partir de temas y estilos similares. Los participantes recibieron información variable respecto al autor de la historia, lo que afectó significativamente sus calificaciones.
Los resultados mostraron que las historias generadas por IA obtuvieron una puntuación media de 1.54 en calidad, comparado con 0.97 para las historias humanas. En términos de inmersión, la diferencia fue de 1.42 frente a 1.00. Las actitudes de los participantes hacia la IA también influenciaron sus evaluaciones; aquellos con una opinión favorable tendieron a puntuar más alto, mientras que los escépticos mostraron un efecto opuesto al conocer el origen de la historia.