Ghost Font: una fuente que los humanos pueden leer pero la IA no puede
Un proyecto llamado “Ghost Font” presenta texto animado que, en cualquier fotograma, parece ruido estático tipo televisión, pero se vuelve legible para el ojo humano mediante el movimiento, con el objetivo de ser legible para las personas pero difícil de decodificar para la IA. Los comentaristas señalan que los modelos de visión actuales ya pueden extraer tanto el mensaje principal como el de cebo mediante técnicas sencillas como flujo óptico, diferencias entre fotogramas y promediado temporal, por lo que esto parece más una ofuscación temporal que una defensa duradera. Muchos también destacan problemas de usabilidad y accesibilidad —algunas personas humanas no pueden leerlo en absoluto— y argumentan que estos trucos forman parte de un juego del gato y el ratón continuo, y probablemente imposible de ganar, entre pruebas tipo CAPTCHA y una IA cada vez más capaz.
¿Puede la IA realmente leer “Ghost Font”?
- Muchos comentaristas dicen que la afirmación “los humanos pueden leerlo pero la IA no puede” ya es falsa.
- Según se informa, los modelos de frontera (GPT 5.6, Claude, Gemini, Fable) decodifican el texto animado cuando se les da el video y no se les dan instrucciones especiales, a menudo mediante análisis de flujo óptico / basado en el movimiento.
- Varias personas comparten código o algoritmos que usan diferencias entre fotogramas, correlación de fase, flujo óptico, promediado temporal o artefactos de compresión de video para revelar el texto y luego aplicarle OCR.
- Sin embargo, los intentos tempranos o ingenuos a menudo solo captan el mensaje estático cebo (“WRITTEN IN GHOST FONT”), no el texto animado ingresado por el usuario, lo que genera confusión sobre qué significa “éxito”.
Confusión entre el cebo y el mensaje real
- La demo incorpora dos mensajes:
- Un cebo tenue, estático y de baja frecuencia visible en capturas de pantalla o con exposición prolongada.
- El texto real, definido por el movimiento, que solo aparece a través de cambios temporales.
- Muchos humanos y AIs ven inicialmente solo el cebo; los comentaristas describen esto como una gran falla de UX/comunicación de la demo.
¿Es realmente una “fuente”?
- Varios argumentan que no es una fuente sino un efecto de video/animación, ya que cada glifo se define a lo largo del tiempo en lugar de como una forma estática.
- Algunos señalan que un solo fotograma es, en la práctica, ruido, por lo que hablar de “fuente” en el sentido tradicional es engañoso.
Legibilidad humana y accesibilidad
- Algunos lectores lo encuentran “clarísimo”; otros apenas pueden leerlo o no pueden, citando astigmatismo, edad o características de la pantalla.
- Se hacen comparaciones con imágenes de Magic Eye e ilusiones de movimiento.
- Varios comentarios señalan graves problemas de accesibilidad, incluida la incompatibilidad con lectores de pantalla y posibles conflictos con normativas de discapacidad.
Utilidad, CAPTCHA y carrera armamentista
- Usos sugeridos: CAPTCHAs, anti-scraping, esteganografía, escritura “segura frente a la IA”.
- Muchos dudan de su viabilidad a largo plazo: una vez conocido el método de decodificación, los modelos o herramientas pueden automatizarlo, y el análisis temporal es sencillo.
- Algunos proponen aleatorizar los parámetros de movimiento/ruido por cliente para ralentizar el aprendizaje, pero otros ven esto como la clásica seguridad por oscuridad y parte de una carrera armamentista interminable entre IA y CAPTCHA.
Ideas relacionadas / alternativas de ofuscación
- Se menciona el truco de homógrafos, fuentes que alteran Unicode (“Noroboto”), PDFs con glifos remapeados, criptografía psicodélica/basada en qualia y esquemas basados en movimiento o ilusiones que privilegian ciertas percepciones humanas.