Ghost-2
Nuestro nuevo modelo de humanización, que reescribe el texto de IA para que se lea como escrito por una persona.
Ghost-2 de un vistazo.
Los números detrás del modelo. Qué es, qué hace y dónde corre.
- Familia del modelo
- Ghost
- Versión
- 2.0
- Tipo
- Humanización (texto a texto)
- Idiomas
- EN principal · 100+ compatibles
- Detectores cubiertos
- 10+ (GPTZero, Originality.ai, ZeroGPT, Turnitin, Quillbot, Grammarly, entre otros)
- Tasa media de aciertos
- 98.3%
- Lanzamiento
- Activo
- Versión anterior
- Ghost-1 · disponible vía API y ajustes del modelo
Probado donde de verdad importa.
Cada versión de Ghost pasa por la misma evaluación: tasa de aciertos (puntuada <30% IA) sobre un conjunto amplio y fijo de textos únicos en inglés, puntuados de forma independiente por seis detectores.
al lanzamiento (%)Ghost-1
hoy (%)Ghost-2 (%)Δ
Evaluado sobre textos en inglés sin duplicados, cada uno puntuado por seis detectores independientes. "Pasa" = el detector devuelve <30% de probabilidad de IA. *Turnitin se evaluó con una muestra más pequeña debido a su acceso restringido. Las cifras de lanzamiento de Ghost-1 provienen de su evaluación original; varios detectores se han actualizado desde entonces, lo que bajó las tasas actuales de Ghost-1. Δ compara Ghost-2 con Ghost-1 hoy, sobre el mismo conjunto de prueba.
Calidad del resultado
La indetectabilidad es solo la mitad de la evaluación. Cada versión se juzga también por la calidad de la escritura, y Ghost-2 mejoró en los tres frentes.
La calidad la puntúan LLMs de propósito general sobre el mismo conjunto de evaluación: cada reescritura se juzga por significado conservado, fluidez y estabilidad entre pasadas.
GPTZero · Originality.ai · Winston AI · ZeroGPT · Grammarly · QuillBot · Copyleaks
Significado · legibilidad · consistencia
Quedó #1 de 11 humanizadores en el AI Humanizer Benchmark de septiembre de 2026, evaluado con 7 detectores y una metodología pública fija.
Ver el leaderboard¿Por qué las tasas de aciertos de arriba son más altas que las puntuaciones del benchmark?
Los conjuntos de prueba son distintos. El benchmark puntúa cada herramienta con textos deliberadamente difíciles de humanizar, por lo que allí las puntuaciones son más bajas para todos. Las tasas de arriba se miden con textos típicos de uso cotidiano.
De Ghost-1 a Ghost-2.
Los detectores cambian todo el tiempo, así que un modelo congelado en el tiempo se va quedando obsoleto. Cada release de Ghost vuelve a correr el mismo benchmark, y el siguiente modelo ya está en marcha mientras el actual se lanza.
- próximoEn entrenamiento
El próximo Ghost
El entrenamiento no se detiene. La siguiente generación ya está en marcha frente a las versiones más nuevas de los detectores.
- v2.0Ahora
Ghost-2
Modelo de segunda generación, reentrenado de punta a punta frente a las versiones más recientes de los detectores. Tasa media de aciertos del 98.3% frente a seis detectores, por encima del 96.2% de Ghost-1. La calidad de escritura también mejoró: menos deriva de significado y resultados más estables en todos los estilos.
- v1.0Generación anterior
Ghost-1
Primer release estable. Tasa media de aciertos del 96.2% frente a seis detectores. Sigue disponible a través de la API y los ajustes del modelo.
- v0.9Ciclo anterior
Tono más fiel
Menos desvíos de significado en textos académicos y técnicos largos.
- v0.8Antes
Avance en Turnitin
Sumamos Turnitin al set de evaluación; los aciertos pasaron del 91 al 97%.
- v0.7Antes
Citas blindadas
Las referencias, notas al pie y citas en línea ya no se reescriben.
Así lo evaluamos.
La misma evaluación corre en cada release. Sin ajustes por detector, sin muestras escogidas a dedo.
- 01
Origen
Una muestra amplia de textos en inglés generados por IA: ensayos, documentación técnica, entradas de blog y prosa conversacional.
- 02
Humanizar
Ghost-2 reescribe cada texto con su configuración por defecto, sin ajustes por detector ni reintentos.
- 03
Detectar
Seis detectores puntúan los resultados de forma independiente. Durante la humanización nunca vemos las puntuaciones.
- 04
Medir la calidad
Los resultados también pasan por LLMs de propósito general que verifican que cada reescritura mantiene significado, estructura y fluidez.
- 05
Pasa / no pasa
Un texto pasa un detector si este devuelve menos del 30% de probabilidad de IA. La tasa media se promedia entre detectores, no entre textos.
Dos generaciones después, sigue siendo una sola cosa:sonar humano.
Ghost-2 es la segunda generación de Ghost, nuestro modelo propio de humanización. Como todo modelo Ghost, reescribe el texto generado por IA para que se lea como escrito por una persona, esquivando a todos los grandes detectores de IA y conservando intactos el significado, el tono y la fluidez.
Ahora es el modelo por defecto detrás de cada humanización en UndetectedGPT: la app web, la API y Ghost Writer. Ghost-1 sigue disponible para quien quiera mantener su configuración actual.
Hecho para burlar detectores
Ghost-2 no es un parafraseador genérico. Lo construimos a propósito para burlar a GPTZero, Originality.ai, ZeroGPT, Turnitin, Quillbot, Grammarly y más.
Cuida el significado y el tono
Ghost-2 reescribe cómo se dice algo, no lo que se dice. Mantiene tu significado, estructura, referencias y citas.
Mejora sin parar
Conforme cambian los detectores, Ghost-2 cambia con ellos. Evaluamos y actualizamos el modelo todo el tiempo para llevarles la delantera.
Activo en todo lo que enviamos.
Ghost-2 es el modelo por defecto para todos los usuarios de UndetectedGPT, en todas las superficies. Ghost-1 sigue disponible a través de la API y los ajustes del modelo en el humanizador.
Preguntas frecuentes
Ghost-2 es la segunda generación del modelo propio de humanización de UndetectedGPT. Reescribe el texto generado por IA para que burle a detectores como GPTZero, Originality.ai, ZeroGPT, Turnitin, Quillbot y Grammarly, sin tocar tu significado, tus referencias ni tus citas.
Sí. Ghost-2 es ahora el modelo por defecto en todas partes, pero Ghost-1 sigue disponible: los usuarios de la API pueden fijarlo con el parámetro de modelo, y los suscriptores pueden cambiar de modelo en los ajustes del humanizador. Las generaciones anteriores siguen en línea para que un nuevo release nunca rompa tu flujo de trabajo.
Ghost-2 se prueba contra los detectores de IA más exigentes del mercado: GPTZero, Originality.ai, ZeroGPT, Turnitin, Quillbot y Grammarly. Corre exactamente la misma evaluación que Ghost-1 y la pasa con una tasa media de aciertos del 98.3%, frente al 96.2% anterior. El resto de detectores suele ser parecido o más fácil de burlar.
No. Ghost-2 reescribe cómo se dice algo, no lo que se dice. Tu significado, tu estructura, tus referencias y tus citas se mantienen tal cual.
Los conjuntos de prueba son distintos. El benchmark puntúa cada herramienta con textos deliberadamente difíciles de humanizar, por lo que allí las puntuaciones son más bajas para todos. Las tasas de esta página se miden con textos típicos de uso cotidiano.
