¿Son fiables los detectores de IA?

preferimos explicarlo a prometer una cifra

Como señal, un detector de inteligencia artificial (IA) puede ayudarte a mirar un texto con más atención. Como prueba, no sirve. Ningún detector acierta siempre, tampoco el nuestro: puede señalar por error un texto escrito por una persona y puede dejar pasar un texto generado por IA. Quien más sufre el primer error es la persona acusada injustamente, así que aquí te contamos dónde falla un detector en lugar de anunciar una cifra. El resultado es una señal, no una prueba. La decisión siempre la toma una persona.

La escala de 0 a 100, en palabras

El detector de ScanForAI analiza textos en español y en inglés. Da una puntuación de 0 a 100 y la sitúa en uno de cuatro niveles. Entre paréntesis tienes el título que verás en cada nivel.

  • Bajo (“Parece escrito por una persona”): el texto parece escrito por una persona. No hace falta hacer nada.
  • Moderado (“Algunos rasgos propios de la IA”): el texto tiene algunos rasgos propios de la IA. Pasa a menudo en textos formales o muy editados; solo merece una segunda mirada si esos rasgos no deberían estar ahí.
  • Elevado (“Se inclina hacia la IA”): el texto se inclina hacia la IA. Es un motivo para preguntar, por ejemplo por los borradores, nunca un veredicto.
  • Alto (“Parece escrito con IA”): el texto parece escrito con IA. Aun así, no demuestra quién lo escribió ni cómo.

La puntuación indica cuánto se parece un texto a uno generado por IA y sin editar. No es la probabilidad de que lo haya escrito una IA, ni la parte del texto escrita con IA. La zona intermedia de la escala es de verdad incierta, y así lo decimos: ahí lo más sensato es no sacar conclusiones. Ninguna puntuación demuestra nada sobre una persona; habla del texto, no de quién lo escribió.

Ningún detector de IA acierta siempre, tampoco este. Un texto formal, técnico o escrito en un segundo idioma puede obtener una puntuación alta, y un texto generado por IA y editado puede obtener una puntuación baja. Usa el resultado como una señal más, nunca como la única base para decidir sobre una persona, y nunca para acusar a nadie.

Si tu texto está en inglés, te explicamos cómo usar el detector paso a paso en Detector de IA para textos en inglés.

Puede equivocarse en los dos sentidos

  • Señalar por error un texto escrito por una persona. Es el error que más daño hace, porque puede acabar en una acusación injusta. Se le llama “falso positivo”. Por eso un resultado nunca debe ser la única base para decidir sobre nadie.
  • Dejar pasar un texto generado por IA. Un texto generado por IA y después editado o reescrito puede parecer escrito por una persona. Una puntuación baja significa que el texto parece escrito por una persona, no que lo sea.

Dónde es más fácil que se equivoque

  • Escritura formal y cuidada. Las frases ordenadas y de longitud parecida, el vocabulario formal, la gramática sin fallos y una estructura de manual son normales en la escritura académica, y también aparecen en los textos generados por IA. Un texto formal puede obtener una puntuación más alta sin que se haya usado IA.
  • Un segundo idioma. Quien escribe en un idioma que ha aprendido suele escribir de forma más regular y más formal, y eso puede parecerse a un texto generado por IA. Les pasa a todos los detectores, y lo han documentado estudios independientes. En el detector de ScanForAI, la opción “El inglés no es mi primer idioma” reduce ese riesgo en los textos en inglés, pero no lo elimina. Lo explicamos en Segundo idioma, variedades del español y detectores de IA.
  • Textos generados por IA y editados. Una reescritura, una revisión a fondo o incluso unos pocos cambios quitan muchos de los rasgos que un detector puede ver, y las herramientas de IA más nuevas imitan cada vez mejor la escritura de una persona. Por eso una puntuación baja no certifica cómo se escribió un texto.
  • Textos cortos. En unas pocas frases no hay base suficiente para juzgar. Un texto demasiado corto no recibe puntuación, y cuanto más texto hay, más dice el resultado: unos cuantos párrafos completos dan una lectura más fiable que un párrafo suelto.
  • Textos que no encajan en ningún tipo. La escritura académica, la de un blog y la ficción tienen rasgos distintos. Con un texto en inglés, puedes indicar en el detector el tipo de texto (“Tipo de texto”), y si eliges el que corresponde, el resultado es más justo. Con textos que no se parecen a ninguno, como listas, poemas o mensajes muy breves, el resultado dice menos.

Por qué no publicamos una cifra de precisión

Cuando una herramienta promete una cifra de precisión casi perfecta, esa cifra se midió con los textos que eligió quien la publica. Dice poco de lo que pasará con el tuyo: un trabajo corregido varias veces, un texto muy formal o uno escrito en tu segundo idioma.

Un ejemplo: si una herramienta acierta casi siempre con textos generados por IA sin editar, eso no dice nada de un trabajo algo editado por alguien que escribe en su segundo idioma, y ese es justo el caso que importa. La precisión de un detector cambia mucho según el tipo de texto, su longitud y cuánto lo editó una persona, y una sola cifra lo esconde todo. Preferimos que cada resultado muestre sus motivos, para que puedas juzgarlo tú.

Lo que hacemos en lugar de dar una cifra

  • Mostramos los motivos. Cada resultado explica en palabras sencillas, en inglés, qué rasgos de la escritura pesaron más y marca las frases donde se concentran: así no te quedas solo con un número, sino con algo que puedes comprobar.
  • Decimos cuándo no lo sabemos. Si el texto es demasiado corto o está en un idioma que el detector no lee, te lo decimos en lugar de darte un número que no tendría sentido.
  • Hablamos de niveles, no de veredictos. La puntuación de 0 a 100 se divide en cuatro niveles, y en los intermedios lo más sensato es no sacar conclusiones.
  • Dejamos la decisión a una persona. El resultado sirve para empezar una conversación, no para cerrarla.

Para saber qué hacer con cada nivel, consulta Cómo leer el resultado.

Nunca uses un detector de IA, ni este ni ningún otro, como única base para acusar a alguien, poner una calificación o tomar una decisión sobre una persona.

Qué hacer con un resultado

  • Si eres estudiante. Guarda tus borradores, tus apuntes, tus fuentes y el historial de versiones: muestran mejor que cualquier puntuación cómo trabajaste. Si te acusan por un resultado y no es verdad, lee qué hacer si te acusan de usar IA.
  • Si eres docente. Toma el resultado como un motivo para preguntar, no como una respuesta. Mira qué partes están marcadas y por qué, pide los borradores y deja que quien escribió el texto explique cómo trabajó antes de decidir nada. Nunca pongas una calificación solo a partir de una puntuación. Te proponemos un proceso justo, paso a paso, en nuestra guía para hablar de una sospecha de uso de IA.
  • Si escribes o editas. Si alguien pone en duda tu texto por un resultado, pide ver el resultado completo, con sus motivos, y muestra tus borradores y tus fuentes. Si eres tú quien revisa textos ajenos, un resultado alto es un motivo para pedir borradores y fuentes, no para rechazar un trabajo. Si quieres valorar un texto solo con leerlo, lee cómo saber si un texto está escrito con IA.

¿Y los textos en español?

El detector de ScanForAI ya analiza textos en español: cada análisis es un análisis profundo y hacen falta al menos 100 palabras. Con nuestro detector o con cualquier otra herramienta, valen los mismos límites que explica esta página: puede equivocarse en los dos sentidos, puede señalar por error a quien escribe en español como segundo idioma y no demuestra quién escribió el texto.

Tienes todas nuestras guías en español en ScanForAI en español.

Dudas

Preguntas frecuentes

¿Son precisos los detectores de IA?

Ninguno acierta siempre, y nadie puede darte una sola cifra que valga para tu texto. Las cifras que se publican salen de las pruebas que hace cada herramienta. Estudios independientes muestran que todos los detectores, también los más conocidos, dejan pasar textos generados por IA que luego se reescribieron, y señalan por error algunos textos escritos por personas. La precisión cambia mucho según el tipo de texto, su longitud y cuánto lo editó una persona. Por eso aquí te contamos dónde falla un detector en lugar de anunciar una cifra.

¿Por qué ScanForAI no publica una cifra de precisión?

Porque esa cifra solo valdría para los textos con que se midió, y la leerías como si valiera para el tuyo. Si una herramienta acierta casi siempre con textos generados por IA sin editar, eso no dice nada de un trabajo algo editado por alguien que escribe en su segundo idioma, y ese es el caso que de verdad importa. En lugar de una cifra, cada resultado muestra sus motivos, para que puedas juzgarlo.

¿Por qué un detector señala por error un texto escrito por una persona?

Porque quien escribe con cuidado tiene hábitos que, por fuera, se parecen a los de un texto generado por IA: frases ordenadas y de longitud parecida, vocabulario formal, buena gramática o una estructura de manual. Quienes escriben en su segundo idioma lo sufren más, con cualquier detector. Por eso, sobre todo, un resultado debe abrir una conversación y nunca cerrarla.

¿Qué significa un resultado intermedio?

Que no está claro, y te lo decimos así en lugar de convertirlo en un veredicto. Un texto con un resultado intermedio suele mezclar algunos rasgos parecidos a los de un texto generado por IA con muchos rasgos propios de una persona. Lee la puntuación junto con las frases marcadas y los motivos: te muestran dónde se concentran esos rasgos para que los juzgues tú.

¿Cuál es el detector de IA más fiable?

No hay una respuesta que valga para todos los textos: las comparaciones entre detectores cambian según los textos con que se hacen. Lo que sí puedes pedirle a cualquier detector es que muestre sus motivos y que diga cuándo no lo sabe. Si dos detectores que funcionan de forma distinta marcan las mismas partes, eso dice más que la puntuación de uno solo; aun así, pueden equivocarse a la vez, y ninguna coincidencia sustituye a la conversación con quien escribió el texto. Una señal, no un veredicto.

¿ScanForAI detecta textos escritos en español?

Sí. El detector de ScanForAI analiza textos en español y en inglés. Con un texto en español, cada análisis es un análisis profundo y hacen falta al menos 100 palabras.

¿Tu texto está escrito en inglés? Revísalo gratis y sin cuenta.Ir al detector de textos en inglés →
La detección de IA no es 100 % precisa. Ningún detector, tampoco ScanForAI, puede demostrar si un texto lo escribió una persona o una IA. Cada resultado es una estimación a partir de rasgos de la escritura y puede equivocarse en los dos sentidos. Nunca lo uses como única base para decisiones académicas, disciplinarias, laborales u otras decisiones importantes sobre una persona, ni para acusar a nadie.