OpenAI admite que los detectores de escritura de IA no funcionan
En una sección de las preguntas frecuentes titulada “¿Funcionan los detectores de IA?”, OpenAI escribe : “En resumen, no. Si bien algunos (incluido OpenAI) han lanzado herramientas que pretenden detectar contenido generado por IA, ninguna de ellas ha demostrado distinguir de manera confiable entre contenido generado por IA y contenido generado por humanos”.
En julio, cubrimos en profundidad por qué los detectores de escritura de IA como GPTZero no funcionan, y los expertos los llaman «principalmente aceite de serpiente». Estos detectores a menudo arrojan falsos positivos debido a que dependen de métricas de detección no probadas. En última instancia, no hay nada especial en el texto escrito por IA que siempre lo distinga del escrito por humanos, y los detectores pueden ser derrotados reformulándolos. Ese mismo mes, OpenAI descontinuó su AI Classifier, que era una herramienta experimental diseñada para detectar texto escrito por IA. Tenía una abismal tasa de precisión del 26 por ciento.
Las nuevas preguntas frecuentes de OpenAI también abordan otro gran error: que el propio ChatGPT puede saber si el texto está escrito por IA o no. OpenAI escribe: “Además, ChatGPT no tiene ‘conocimiento’ de qué contenido podría generarse mediante IA. A veces inventará respuestas a preguntas como «¿escribiste este [ensayo]?» o ‘¿podría haber sido escrito por AI?’ Estas respuestas son aleatorias y no tienen ningún fundamento real”.
En ese sentido, OpenAI también aborda la propensión de sus modelos de IA a confabular información falsa, que también hemos cubierto en detalle en Ars. «A veces, ChatGPT suena convincente, pero puede brindarle información incorrecta o engañosa (a menudo llamada ‘alucinación’ en la literatura)», escribe la compañía. «Incluso puede inventar cosas como citas o citas, así que no lo utilices como única fuente de investigación».
(En mayo, un abogado se metió en problemas por hacer precisamente eso , citando seis casos inexistentes que sacó de ChatGPT).
Aunque los detectores automatizados de IA no funcionan, eso no significa que un humano nunca pueda detectar la escritura de IA. Por ejemplo, un profesor familiarizado con el estilo de escritura típico de un estudiante puede darse cuenta cuando su estilo o capacidad cambia repentinamente. Además, algunos intentos descuidados de hacer pasar el trabajo generado por IA como escrito por humanos pueden dejar signos reveladores, como la frase » como modelo de lenguaje de IA «, que significa que alguien copió y pegó la salida de ChatGPT sin tener cuidado. Y recientemente, un artículo en la revista científica Nature mostró cómo los humanos notaron la frase “Regenerar respuesta” en un artículo científico, que es la etiqueta de un botón en ChatGPT.
Tal como está la tecnología hoy en día, es más seguro evitar por completo las herramientas automatizadas de detección de IA. «A partir de ahora, la escritura de IA es indetectable y es probable que lo siga siendo», dijo a Ars en julio el frecuente analista de IA y profesor de Wharton, Ethan Mollick. «Los detectores de IA tienen altas tasas de falsos positivos y, como resultado, no deberían usarse».
Deja una respuesta