Guía de evidencia
Metadatos de imágenes con IA: qué revelan y qué no puede ocultar su eliminación
Aprende dónde se almacenan los metadatos de flujos de trabajo de IA, qué pueden incrustar ComfyUI y AUTOMATIC1111, en qué se diferencia C2PA y qué no puede cambiar la eliminación de metadatos.
Cuando una herramienta de imágenes con IA exporta un archivo, el resultado puede contener algo más que píxeles. Prompts, referencias a modelos, ajustes de sampler e incluso grafos de nodos pueden residir en contenedores de metadatos estructurados junto a los datos comprimidos de la imagen. Esos campos pueden ser útiles para reproducir un flujo de trabajo, pero también pueden revelar decisiones creativas que nunca estuvieron destinadas al destinatario.
No todas las imágenes generadas por IA contienen esos campos, y encontrarlos no demuestra cómo se creó una imagen. El enfoque correcto es inspeccionar el archivo, interpretar la evidencia de forma conservadora y comprender qué la eliminación de metadatos no puede cambiar.
Dónde se almacenan los metadatos de flujos de trabajo de IA
Las herramientas de generación no utilizan un formato de metadatos universal. Dependiendo de la aplicación, la versión, el tipo de exportación y la configuración del usuario, los datos de flujo de trabajo pueden aparecer en:
- Bloques de texto PNG, comúnmente entradas tEXt, zTXt o iTXt.
- Campos EXIF de comentario o de tipo descripción en algunas exportaciones JPEG.
- Bloques XMP que pueden acompañar archivos JPEG, PNG o WebP.
- Otras estructuras de metadatos compatibles utilizadas por un exportador en particular.
Estos contenedores están separados de los datos de píxeles comprimidos. Para archivos JPEG, PNG y WebP estáticos compatibles, el limpiador de la página principal elimina los contenedores de metadatos compatibles sin decodificar ni recodificar los datos de imagen comprimidos. Crea una nueva copia y vuelve a escanear la salida.
Familias de campos comunes
Las exportaciones de flujos de trabajo de IA pueden incluir:
- Un prompt positivo y un prompt negativo.
- Seed, sampler, cantidad de pasos, escala CFG o valores del scheduler.
- Referencias a checkpoint, modelo o hash de modelo.
- Referencias a LoRA y pesos.
- JSON de grafo de nodos o flujo de trabajo.
- Cadenas de versión de software y herramienta.
- Historial de edición escrito durante el posprocesamiento posterior.
Estos valores son evidencia de flujo de trabajo. No demuestran que un archivo fue generado por IA, no identifican a una persona, no establecen titularidad de derechos de autor ni validan autenticidad. Una imagen puede perder estos metadatos durante la exportación, la captura de pantalla, la optimización o el procesamiento de la plataforma. Un editor no basado en IA también puede crear campos de software, XMP e historial que se ven superficialmente similares.
ComfyUI
Las exportaciones PNG de ComfyUI pueden contener dos estructuras JSON considerables:
- Un objeto
promptque describe un grafo de nodos ejecutable. - Un objeto
workflowque preserva el grafo visual y el diseño de la interfaz.
Dependiendo del flujo de trabajo, estas estructuras pueden exponer tipos de nodos, referencias a modelos o LoRA, seeds, samplers, entradas de texto y conexiones del grafo. También pueden ser lo suficientemente grandes como para revelar mucho más que un campo de prompt breve.
El Visor de metadatos de imágenes tiene reglas de análisis locales dedicadas para el JSON de prompt y workflow de ComfyUI. Este comportamiento está cubierto por una exportación pública de ComfyUI con licencia incluida en el corpus de archivos reales confirmado, no solo por un fixture de cadena escrito a mano. La evidencia de pruebas pública describe el límite más amplio del corpus.
AUTOMATIC1111
AUTOMATIC1111, también conocido como Stable Diffusion WebUI, comúnmente escribe un bloque de texto plano estructurado llamado infotext en un campo de texto PNG llamado parameters. Dependiendo de la configuración y la versión, el bloque puede incluir:
- Prompts positivos y negativos.
- Pasos, sampler, escala CFG y seed.
- Nombre o hash del modelo.
- Tamaño y otros parámetros de generación.
El escáner utiliza reglas dedicadas para este formato en lugar de tratar el campo completo como un comentario opaco. La cobertura está respaldada por una exportación pública de AUTOMATIC1111 con licencia incluida en el corpus de archivos reales confirmado.
InvokeAI y el límite de evidencia
InvokeAI serializa la información de flujo de trabajo como JSON, y la estructura ha cambiado entre versiones. El escáner contiene reglas para metadatos de estilo InvokeAI actuales y anteriores, incluyendo campos documentados de prompt, seed, modelo, scheduler y pasos.
El nivel de evidencia se declara intencionalmente de forma diferente aquí. InvokeAI está cubierto por pruebas unitarias a nivel de formato basadas en campos de serialización documentados. El repositorio actualmente no contiene una imagen real confirmada exportada por InvokeAI. ComfyUI y AUTOMATIC1111 cuentan por tanto con evidencia de corpus de archivos reales, mientras que InvokeAI actualmente tiene evidencia de reglas de formato. Esa distinción importa al juzgar cuán ampliamente se ha ejercitado un parser.
XMP e historial de edición ordinario
XMP no es una señal específica de IA. Herramientas convencionales como Photoshop, Lightroom, GIMP y Affinity Photo pueden escribir nombres de software, cadenas de versión, descripciones Dublin Core, campos de derechos e historial de edición en XMP.
Un campo CreatorTool o una entrada xmpMM:History puede significar únicamente que alguien recortó, exportó o corrigió el color de un archivo. Lee el campo en contexto en lugar de convertir una cadena de software en una afirmación de atribución. El Visor de metadatos de imágenes agrupa los campos reconocidos para que puedas inspeccionar la evidencia original antes de decidir qué eliminar.
El Editor de metadatos de imágenes sigue un flujo de trabajo diferente. Recodifica una nueva imagen, descarta los contenedores de metadatos antiguos y escribe solo cinco campos Dublin Core XMP ingresados por el usuario: Title, Description, Creator, Copyright y Keywords. No es la ruta de eliminación sin pérdida de contenedores de la página principal.
C2PA y Content Credentials son una capa separada
Las Content Credentials de C2PA son datos de procedencia, no metadatos ordinarios de prompt. Una credencial puede incluir un manifiesto firmado criptográficamente que registra afirmaciones sobre la creación o edición, almacenado comúnmente a través de estructuras JUMBF. La especificación C2PA define ese sistema.
El escáner de navegador actual realiza una detección conservadora de marcadores C2PA/JUMBF. No valida criptográficamente un Manifest, no confirma al firmante ni obtiene un Manifest remoto. Si se encuentra un posible marcador, la eliminación se pausa para obtener consentimiento explícito. La salida puede informar que el marcador compatible fue eliminado, pero la conclusión de procedencia permanece sin verificar.
La presencia de un marcador, por tanto, no es prueba de una Content Credential válida, y la ausencia de un marcador no es una declaración sobre todos los sistemas de procedencia posibles.
Un flujo de trabajo seguro: inspeccionar, limpiar, verificar
- Inspecciona el original. Ábrelo en el Visor de metadatos de imágenes. Revisa los grupos de prompt, flujo de trabajo, software, derechos y procedencia antes de cambiar nada.
- Decide qué significa la evidencia. Un prompt o un grafo de nodos puede ser información sensible del flujo de trabajo. Una etiqueta XMP de software genérica puede registrar solo una edición normal.
- Limpia una nueva copia. Usa la herramienta de la página principal para archivos JPEG, PNG o WebP estáticos compatibles. Cada lote gratuito acepta hasta tres imágenes, con un límite de 15 MB por archivo y 30 MB en total. El plan gratuito incluye hasta diez imágenes por día, y el original nunca se sobrescribe.
- Gestiona la procedencia de forma deliberada. Si se detecta un posible marcador C2PA/JUMBF, lee el aviso de consecuencias antes de consentir la eliminación.
- Revisa el reescaneo de la salida. Confirma qué fue eliminado, preservado, no compatible o qué no pudo verificarse.
- Usa un lector independiente cuando sea necesario. La publicación sensible o la entrega a un cliente pueden justificar una segunda herramienta de metadatos y un segundo revisor.
La herramienta del navegador no envía bytes del archivo seleccionado, nombres de archivo, valores de metadatos ni hashes a una API de procesamiento. Puede haber analítica de página, pero GA4 se desactiva cuando se selecciona, arrastra o pega un archivo local.
Qué no puede hacer la eliminación de metadatos
La eliminación de contenedores es útil, pero tiene un límite preciso:
- Las marcas de agua a nivel de píxel y SynthID son parte de la señal de la imagen, no contenedores de metadatos ordinarios.
- Las cargas esteganográficas pueden estar ocultas en los valores de píxeles u otras estructuras no compatibles.
- Los clasificadores visuales y los hashes perceptuales operan sobre el contenido de la imagen.
- La inferencia del lado de la plataforma puede combinar patrones visuales, historial de la cuenta, contexto de carga u otros sistemas privados.
- Los hechos de derechos de autor y procedencia no desaparecen simplemente porque se haya eliminado un campo descriptivo.
Eliminar metadatos no hace que una imagen sea indetectable, no demuestra que no fue generada por IA ni garantiza que una plataforma no la etiquetará. La herramienta no debe utilizarse para tergiversar la autoría, la titularidad o la procedencia.
Lista de verificación antes de compartir
- [ ] Inspecciona el archivo en busca de prompts, prompts negativos, seeds, modelos, referencias a LoRA y grafos de flujo de trabajo.
- [ ] Distingue los campos directos de flujo de trabajo del software XMP ordinario o del historial de edición.
- [ ] Observa si la evidencia proviene de un archivo exportado real o solo de una regla de formato conocida.
- [ ] Revisa cualquier advertencia de C2PA/JUMBF antes de decidir si eliminar un marcador.
- [ ] Limpia una nueva copia e inspecciona el reescaneo de la salida.
- [ ] Recuerda que las marcas de agua en píxeles, los clasificadores, la coincidencia perceptual y la inferencia de la plataforma no se modifican.
- [ ] Conserva el original y evita usar la eliminación de metadatos para tergiversar el archivo.
La eliminación de metadatos es un paso de privacidad e higiene de la información. Borra texto incrustado y datos estructurados compatibles. No es un método para evadir la detección de IA ni una forma de borrar el historial de una imagen. Consulta más referencias basadas en evidencia en el centro de guías.