Saber si un texto ha sido generado automáticamente por un sistema de inteligencia artificial, como un gran modelo del lenguaje, es un derecho que tenemos los ciudadanos con relación a recibir información veraz y transparente. Hay contextos, como el académico, el legal, el médico, o el de ciberseguridad, en los que es, además, crítico poder justificarlo. Actualmente disponemos de sistemas que permiten reconocer los textos de ciertos dominios y LLM con una buena fiabilidad, pero no son capaces de aportar evidencias de su decisión. Nuestro trabajo en el proyecto “ANONIMIZADO” consiste en estudiar qué rasgos lingüísticos específicos presentan los textos generados por los LLM para discriminar su autoría. Estos rasgos servirían tanto para identificar el tipo de autor: LLM, humano o mezcla de ambos, como para explicar la atribución de autoría.
Paper
The full text of this publication is not hosted on 44B due to licensing.
Read it at OpenAlex