Pega un texto antes de mandarlo a una IA, publicarlo o usarlo en código, y la herramienta te enseña lo que no se ve: instrucciones escondidas con caracteres invisibles, palabras partidas para esquivar filtros, código que se lee distinto de como se ejecuta y letras falsas de otro alfabeto. Todo ocurre en tu navegador: el texto no se envía ni se guarda.
Un modelo de lenguaje recibe los caracteres, no lo que tú ves en pantalla. Si en un documento, un correo o un fichero de reglas (.cursorrules, AGENTS.md…) hay una frase escrita con caracteres invisibles, la IA puede leerla y obedecerla. Aquí se decodifica y se enseña tal cual.
Varios de estos caracteres tienen usos legítimos y no se tratan como sospechosos: el que une los emoji de una familia, el que convierte el corazón de texto en su versión emoji, las banderas de Escocia o Gales (que están hechas de etiquetas invisibles), el que usa el persa entre letras o las marcas de dirección de un texto en árabe o hebreo. Salen en la vista pero en gris, y se conservan al limpiar.
El texto limpio quita todo lo invisible sospechoso. Las letras de otro alfabeto no se cambian: no hay forma segura de saber si una «с» quería ser una «c» o es una palabra en ruso, así que se señalan y decides tú.