Detectar salida de humanizador de IA: ¿funcionan? | It's AI
Detectar salida de humanizador de IA: ¿funcionan?
¿Los humanizadores de IA engañan a los detectores? Cinco estudios dicen que no: techo del 30 %, RAID y por qué los detectores se adaptan.
Svetlana Shakhova05 mar 202612 min read
Cómo detectar la salida de un humanizador de IA: ¿funcionan realmente estas herramientas?
Seguramente ya ha visto anuncios de humanizadores. Prometen que el texto suene humano en un par de segundos. La propuesta es esta: pegue su texto de ChatGPT en una herramienta de humanización, pulse un botón y el texto pasa por humano. ¿Pero aguanta en la práctica?
Decidimos mirar lo que dice realmente la investigación. Tomamos cinco artículos revisados por pares de COLING 2025, NeurIPS 2025 y ACL 2024. Todos probaron herramientas de humanización de texto en condiciones controladas.
Versión breve: la mayoría de estas herramientas apenas hacen nada. Y unas pocas nos sorprendieron de verdad.
¿Quieres saber qué puntuación obtiene tu propio texto? Compruébalo aquí mismo.
caracteres (min 200): 0/500000
PDF, DOCX, TXT
Escaneo profundo de IA
descubra qué parte del texto parece generada por IA con nuestra segmentación a nivel de oración.
Verificación de plagio
detectar contenido plagiado comparando su texto con fuentes en línea.
Revisión gramatical
encontrar errores gramaticales y ortográficos en su texto.
4000palabras restantes
¿Puede un detector de IA detectar texto humanizado?
El estudio DAMAGE de COLING 2025 resultó el más útil. Los investigadores probaron 19 herramientas de humanización y parafraseo y las clasificaron en tres niveles según la calidad de la salida. En la práctica se ve así:
Nivel
Qué hacen
Resultado de detección
Nivel 1 (básico)
Cambios simples de sinónimos, ligera reordenación de palabras
Casi ningún cambio. Estos textos se detectan casi tan fácil como la salida de IA sin modificar.
Nivel 2 (intermedio)
Reestructuración de frases más sinónimos
Reduce ligeramente la detección, pero los detectores siguen captando la mayor parte.
Nivel 3 (avanzado)
Reescritura completa de frases con conciencia del contexto
Mejor calidad de salida, pero los sistemas entrenados siguen marcando una parte significativa del contenido de IA.
El patrón es el mismo en los tres niveles. Cambiar palabras por sinónimos no altera la estructura de las frases, y eso es lo que leen los detectores. Los debates sobre humanizadores académicos de IA confirman lo mismo: la parafraseo superficial no basta.
Detector de IA gratuito y humanizador: el techo del 30 % del que nadie habla
Investigadores (NeurIPS 2025) dieron una cifra clara que muestra la brecha entre las promesas de marketing y la realidad. La parafraseo básica —el método que usan los humanizadores de IA gratuitos— reduce la efectividad del detector un 30,27 % de media.
Dicho de otro modo: si comprobamos 100 textos escritos por IA pasados por un humanizador, 70 seguirán identificándose como IA. Además, la humanización automática introduce nuevos artefactos. Los humanizadores, sobre todo los gratuitos, degradan el texto intentando que suene humano.
Pero el mismo artículo plantea un segundo escenario. Cuando un humanizador ve exactamente cómo un detector puntúa el texto, la efectividad del detector cae un 87,88 %. El detector apenas puede distinguir IA de humano.
Esas cifras cercanas a la invisibilidad total son justo lo que muestran los anuncios de humanizadores. Pero ninguna herramienta comercial mira dentro del funcionamiento interno de otro sistema. Nadie fuera de GPTZero ve su modelo. Nadie fuera de ZeroGPT conoce sus algoritmos.
Buscar un «humanizador GPTZero» o «humanizador ZeroGPT» es confiar en software que promete eludir un sistema que nunca ha visto. Las probabilidades, para decirlo suavemente, son escasas.
Humanizador GPTZero, humanizador ZeroGPT: por qué los detectores siempre se adaptan
Un humanizador funciona exactamente hasta que un detector se reentrena con sus salidas. El estudio DAMAGE lo confirmó experimentalmente. En cuanto se añadieron textos humanizados al conjunto de entrenamiento, la precisión de detección se recuperó en los tres niveles de herramientas.
¿Por qué funciona? Los humanizadores no son creativos. Todos giran en torno a los mismos trucos: sinónimos, división de frases, ligera reordenación. Cada texto pasado por un humanizador se convierte en material nuevo para los detectores de IA. La defensa aprende. El ataque sigue siendo predecible.
La prueba RAID: cuando los trucos se vuelven en contra
Un hallazgo de RAID es genuinamente sorprendente. Algunos ataques facilitaron la detección, no la dificultaron.
"Various attacks differently affect MGT detection algorithms, with some attacks surprisingly improving detection."
— RAID Benchmark, ACL 2024
Piense en lo que eso significa. Usa una combinación de detector y humanizador, paga los servicios, invierte tiempo, obtiene su texto de IA, lo pasa por un humanizador y obtiene un texto que suena aún más a IA.
La herramienta no sabe qué sistema hay al otro lado. Opera a ciegas, así que el resultado apenas es predecible.
¿Debería usar un humanizador? Una respuesta práctica
Esto es lo que dice la investigación sobre sus probabilidades de pasar desapercibido:
Qué hace
Probabilidad aproximada de ser detectado
Por qué
Entregar ChatGPT sin modificar
Muy alta
Los detectores modernos captan casi todo el texto de IA sin modificar.
Pasarlo por un humanizador gratuito
Alta
Los cambios simples de sinónimos apenas alteran el panorama.
Probar un servicio de pago «avanzado»
Moderada
La parafraseo ayuda, pero de media reduce la detección solo ~30 %. Lejos de ser invisible.
La industria de la humanización le vende una solución a un problema que ella misma crea. Cuantas más personas pasan textos por estos servicios, más precisos se vuelven los detectores. Un modelo de negocio fascinante, si lo piensa.
Escribir usted mismo sigue siendo gratis. Y sigue funcionando mejor que cualquier otra cosa.
Ningún redactor de IA «indetectable» ha superado pruebas revisadas por pares. RAID sometió 11 tipos de ataque a 6 millones de muestras. Algunos ataques facilitaron la detección, no la dificultaron. Cada herramienta que hemos visto usa el mismo manual de sinónimos y reestructuración que los detectores entrenados ya reconocen.
Las herramientas existen y modifican su texto. Pero la afirmación de que la salida se vuelve invisible para los detectores no se sostiene. Los datos de NeurIPS 2025 muestran como máximo una reducción del 30 % en la detección. Eso sigue dejándole detectado 7 de cada 10 veces.
La humanización básica de la salida de ChatGPT reduce la detección aproximadamente un 30 %. El otro 70 % sigue marcándose. Para pasar de verdad, necesitaría acceso en tiempo real al modelo de puntuación del detector. Ningún humanizador comercial ofrece eso. La reescritura manual sigue siendo el único método fiable.
La precisión de GPTZero mejora con cada ciclo de reentrenamiento. El estudio DAMAGE mostró una recuperación completa de la detección en cuanto se añadieron muestras humanizadas al entrenamiento. El mismo principio aplica a ZeroGPT y otros detectores serios. La ventana de elusión sigue reduciéndose.