GPTClean-up

Free browser tool

Comprobar caracteres Unicode en textos de Llama

Inspecciona caracteres reales en textos de Llama y distingue los efectos del modelo, la interfaz y el proceso de exportación.

El texto que pegues se procesa localmente en tu navegador.
0 words · 0 characters
0 words · 0 characters
Opciones

Los caracteres de unión y los controles de dirección se conservan de forma predeterminada. Quitarlos puede alterar emojis y textos multilingües. Revisa el resultado. Máximo: 500.000 unidades UTF-16 por operación.

Procesamiento en el navegador. Sin cuenta ni subida de texto.¿Qué caracteres se eliminan?

Qué conviene revisar en este caso

El nombre de una familia de modelos no describe todas las aplicaciones que la utilizan. Una interfaz basada en Llama puede añadir plantillas o transformar el texto al copiarlo. Por eso la inspección trabaja sobre la cadena que pegas y evita conclusiones generales sobre el modelo.

Si comparas dos interfaces, conserva el mismo fragmento de prueba y anota cómo lo copiaste. Si el carácter aparece solo tras exportarlo, revisa esa etapa. Este procedimiento ayuda a reproducir el problema sin atribuir automáticamente cada diferencia a la generación del texto.

  • Anota la interfaz y el método de exportación.
  • Guarda un original que permita reproducir la comparación.

Un proceso de limpieza que puedes comprobar

Guarda una copia del original antes de modificarlo. Pega el fragmento afectado y consulta los códigos Unicode que aparecen en el informe. El recuento indica cuántas veces está presente un carácter; no mide la calidad del contenido ni identifica a su autor. Si conoces la línea problemática, empieza por ella y amplía la revisión solo cuando haga falta.

La configuración inicial elimina U+200B, U+FEFF, U+2060 y U+00AD, y convierte U+00A0 en un espacio normal. Activa otras opciones únicamente si responden a un problema concreto. Compara las versiones y prueba el resultado en el formulario, documento, editor de código o sistema de publicación donde vas a utilizarlo.

Conservar el significado y la escritura

Un carácter invisible no es necesariamente un error. Algunos unen las partes de un emoji; otros intervienen en la escritura de idiomas como el persa o ayudan a mostrar texto árabe junto a texto latino. Por eso se conservan de forma predeterminada los caracteres de unión, las marcas de dirección y los selectores de variación. Tampoco se borran indiscriminadamente tabulaciones, saltos de línea o acentos combinantes. Incluso los caracteres que elimina la limpieza inicial pueden tener una función legítima. Revisa nombres, citas, cifras y fragmentos en otros idiomas antes de aceptar el cambio.

Cómo interpretar el resultado

La herramienta examina caracteres y aplica las transformaciones seleccionadas. No determina si el texto procede de una persona o de una inteligencia artificial. Una marca de agua estadística afecta a patrones de selección de palabras y no equivale a un carácter Unicode oculto. Un informe sin hallazgos tampoco confirma que las afirmaciones sean correctas o que tengas permiso para reutilizarlas. Comprueba las fuentes y el contexto por separado.

Preguntas frecuentes

¿Se envía a un servidor el texto que pego?

Las funciones de texto trabajan localmente en tu navegador. No necesitan enviar el contenido pegado a un modelo de IA ni a un servicio de traducción. Consulta también la información de privacidad del sitio.

¿Debo borrar todos los caracteres detectados?

No. El informe describe caracteres, no errores. Decide según el uso del texto y revisa especialmente los emojis, las palabras en otros idiomas y la representación final.

Keep exploring

Related Tools and Guías