Gratis · sin cuenta

¿Qué esconde este PDF?

Un PDF no es la imagen de una página: es un contenedor con historia. Las ediciones suelen añadirse al final en vez de sobrescribirse, lo que significa que la versión anterior a la edición sigue a menudo dentro del archivo. Sube uno aquí y verás sus revisiones guardadas, los valores que llevaba una revisión anterior, el texto oculto o tapado y las huellas estructurales que deja una edición, las quisiera dejar alguien o no.

Análisis en vivo

Radiografiar un PDF

Comprobaciones gratuitas disponibles hoy

El análisis se ejecuta en un proceso aislado con un límite de tiempo estricto, de modo que un archivo hostil nunca puede alcanzar el resto del sistema. Cuenta con unos segundos.

§01 / QUÉ LEE
Estructura, no afirmaciones

Las partes del archivo que un lector nunca ve.

Revisiones guardadas

Actualizaciones incrementales

Cada revisión añadida que aún se puede recuperar dentro del archivo, con cuántos bytes sumó cada una y qué páginas tocó: el propio registro de ediciones del documento, escrito por el formato mismo.

Valores recuperados

Antes y después

Allí donde el texto de una revisión anterior sigue físicamente presente, el valor previo mostrado junto al actual, con la página en que aparece y cómo se reconstruyó.

Texto oculto y tapado

Contenido opcional

Texto representado de forma invisible, recortado fuera de la página o tapado por una figura dibujada encima, incluidas las capas de contenido opcional que se pueden desactivar y lo que ocultaban.

Patrón de construcción

Origen

Si las páginas son texto digital nativo, un escaneo con texto buscable, una captura puramente rasterizada o una mezcla, deducido de los píxeles y del árbol de páginas, nunca de la cadena Producer.

Cobertura de la firma

Integridad

Qué revisión sella realmente cada firma y si se añadieron bytes después del rango que cubre: la diferencia entre «firmado» y «firmado y luego modificado».

Una cronología de transformaciones

Relato

Los hechos que la evidencia sostiene, en orden, con aquello en lo que se basa cada uno: observaciones separadas de la interpretación, y explicaciones alternativas siempre sobre la mesa.

§02 / POR QUÉ FUNCIONA
La memoria propia del formato

Editar un PDF normalmente le añade cosas.

Cuando cambias un PDF y guardas, la mayoría del software no reescribe el documento. Añade al final: la nueva versión de cada objeto modificado va al final del archivo, seguida de una tabla de referencias cruzadas nueva que apunta a los objetos nuevos en lugar de a los viejos. Los objetos viejos siguen ahí. Simplemente ya no están referenciados.

Este diseño existe por buenas razones: hace que guardar sea rápido, y es lo que permite que una firma digital siga sellando exactamente los bytes que firmó mientras se acumulan anotaciones posteriores detrás. Pero tiene un efecto secundario en el que los examinadores de documentos llevan veinte años apoyándose: una edición añadida al final deja dentro del archivo el documento anterior a la edición.

Así, un PDF alterado después de emitirse conserva con frecuencia el importe original, la fecha original, el beneficiario original. Reconstruir la tabla de referencias cruzadas anterior y seguirla hasta los objetos a los que apuntaba es lo que significan los «valores recuperados» en esta página. Cuando funciona, es lo más cerca de una prueba que llega la ciencia forense documental: no una inferencia a partir de una fuente sospechosa, sino el texto previo, físicamente presente, en el archivo que te entregó el remitente.

Y cuando no funciona

Muchos flujos de trabajo reescriben el archivo por completo: imprimir a PDF, aplanar, pasarlo por un optimizador o exportarlo desde una herramienta que siempre escribe un documento nuevo. Eso destruye el historial añadido, y ningún análisis lo recupera. Un archivo con una sola revisión y sin estado anterior recuperable es de lo más corriente, y no prueba nada.

Por eso el resultado separa lo observado de lo que podría significar, mantiene visibles las explicaciones alternativas e informa de lo que no se pudo comprobar en vez de puntuarlo en silencio como limpio.

§03 / CÓMO LEERLO

Hasta dónde llega el resultado

No puede decirte que un documento sea auténtico. La estructura es una capa de cinco, y no dice nada sobre si la factura corresponde a un pedido real, si la empresa del membrete existe o si las cifras cuadran. Un PDF estructuralmente impecable puede ser una fabricación completa hecha de una sola pasada por alguien que nunca editó nada.

Tampoco puede decirte quién hizo un cambio ni por qué. Las revisiones no llevan identidad. Una edición posterior a la firma puede ser un fraude, o puede ser el destinatario añadiendo una anotación: la evidencia muestra qué le pasó a los bytes, y el juicio es tuyo.

Qué hacemos con lo que pegas

No se guarda nada. Las herramientas gratuitas conservan lo que introduces durante la petición y lo descartan con la respuesta: ningún informe almacenado, ningún archivo guardado, ningún registro de la URL, el mensaje o el nombre del archivo. Lo único que conservamos es un recuento anónimo para que el límite diario signifique algo, y es un número, no una identidad.

Todo lo que ves procede de un análisis determinista: registros públicos de dominios, intercambios DNS y TLS en vivo, análisis de encabezados y estructura del PDF. Los mismos motores responden igual tengas o no una cuenta.

§ MÁS HERRAMIENTAS GRATUITAS
No hace falta cuenta

Dos más que puedes usar ahora mismo.

Lecturas relacionadas

De Field Notes.

§ PREGUNTAS
Preguntas frecuentes

Las preguntas que de verdad nos hacen.

¿De verdad se puede ver lo que decía un PDF antes de editarlo?

A veces, sí. Los PDF suelen guardarse añadiendo los cambios en lugar de reescribir el archivo, así que los objetos de la versión anterior a menudo siguen físicamente dentro. Cuando eso ocurre, el texto anterior puede reconstruirse y mostrarse junto al valor actual. Cuando el archivo se reescribió por completo, no se puede, y la herramienta lo dice en lugar de adivinar.

¿Un PDF con varias revisiones significa que fue manipulado?

No. Las revisiones son completamente normales: firmar un documento añade una, rellenar un formulario añade una, anotar añade una. Lo que importa es qué cambió y si el cambio es coherente con la historia del documento. Un archivo de una sola revisión que dice tener años de modificaciones, o un contrato firmado con contenido añadido más allá de lo que cubre la firma, son las formas que merecen atención.

¿Qué es el texto oculto en un PDF?

Texto presente en el archivo pero invisible al leerlo: blanco sobre blanco, recortado fuera de la página, representado en modo invisible o tapado por una figura dibujada encima. Tiene causas inocentes, en especial la capa de texto invisible que añaden los escáneres para que un escaneo sea buscable. También tiene un uso deshonesto evidente, y por eso conviene verlo.

¿Es lo mismo que mirar los metadatos del PDF?

No, y la diferencia importa. Los metadatos son lo que el archivo afirma sobre sí mismo, y se editan con total facilidad. Esta herramienta lee la estructura: las tablas de referencias cruzadas, las generaciones de objetos y las revisiones añadidas que el propio formato crea. La estructura es mucho más difícil de falsificar porque es un efecto secundario de cómo se escribió el archivo, no un campo que alguien tecleó.

¿Por qué a veces el análisis dice que una comprobación fue limitada?

Porque la cobertura se informa con honestidad. Los archivos cifrados, las estructuras de objetos poco habituales y los documentos muy grandes pueden dejar una comprobación fuera de alcance dentro del tiempo acotado que permite la herramienta gratuita. La cobertura ausente se informa como ausente: nunca se convierte en silencio en un resultado limpio.

¿Guardan el PDF que subo?

No. El archivo se analiza en un proceso aislado y se descarta al enviar la respuesta. Nunca se almacena, nunca se archiva y nunca se usa para nada más.

La estructura es una capa de cinco.

Una cuenta gratuita ejecuta el análisis forense completo —metadatos, contenido, imágenes e inteligencia entre documentos— y conserva el informe.