Comprimir PDF

Recupera el espacio que un PDF desperdicia en sí mismo — sin subir el documento.

Nivel de compresión

Recupera el desperdicio estructural — no vuelve a comprimir las imágenes del documento, porque eso destruiría la capa de texto.

Escrito y mantenido por el equipo de KitYards Sobre KitYards Última revisión:

Comprimir PDF reconstruye tu documento desde dentro. Copia las páginas a un archivo limpio, lo que descarta todos los objetos que el antiguo seguía conteniendo pero ya no usaba, compacta los datos de referencias cruzadas en flujos de objetos comprimidos y —según el nivel que elijas— borra metadatos, aplana campos de formulario y elimina anotaciones. Obtienes el tamaño de antes, el de después y el porcentaje real. Todo se ejecuta en tu navegador mediante pdf-lib, así que el documento no se sube nunca, y cuando un archivo ya está ajustado la herramienta lo dice en lugar de devolverte algo más grande con una etiqueta que suena mejor.

Cómo comprimir un PDF

  1. 1 Añade el PDF que quieres reducir.
  2. 2 Elige un nivel: Ligera solo reconstruye, Equilibrada además borra metadatos, Fuerte además aplana formularios y quita anotaciones.
  3. 3 Pulsa Comprimir y observa cómo la barra de progreso recorre las páginas.
  4. 4 Comprueba las cifras de antes y después y descarga el resultado.

Cómo funciona la reconstrucción

pdf-lib analiza el archivo y se crea un documento nuevo y completamente vacío. Después, cada página se copia una a una, cediendo un fotograma entre página y página para que la barra de progreso avance y la pestaña siga respondiendo. Copiar una página arrastra solo lo que esa página referencia de verdad: su flujo de contenido, sus fuentes, sus imágenes y sus espacios de color. Todo lo que el archivo antiguo seguía conteniendo pero ya no apuntaba —una imagen borrada, una revisión superada, una fuente de un párrafo eliminado— simplemente no tiene de dónde colgarse y no hace el viaje.

A continuación, el documento nuevo se serializa con los flujos de objetos activados. Eso compacta la tabla de referencias cruzadas y todos los objetos que no son flujos dentro de flujos comprimidos, en lugar del texto plano que emite un escritor ingenuo; en un documento con muchos objetos pequeños eso ya supone un ahorro apreciable.

Los dos niveles superiores van más allá. Equilibrada limpia el diccionario de información del documento, lo que también elimina el paquete XMP que dejan algunos generadores. Fuerte primero aplana el formulario —pintando el valor actual de cada campo en la página para que la información sobreviva— y luego elimina las entradas de anotaciones, que es donde los formularios rellenos esconden una parte sorprendente de su peso. Por último, el resultado se compara con el original: si la reconstrucción no ha ahorrado nada, lo que se descarga es tu archivo original.

Cuándo ayuda

Un documento editado muchas veces

Los informes que han pasado por una docena de guardados llevan encima cada revisión intermedia. Reconstruir conserva solo la actual, y suele ser el mayor ahorro disponible.

Un formulario relleno

Los formularios interactivos guardan un flujo de apariencia por cada campo. En el nivel Fuerte se aplanan sobre la página y se descarta la estructura de widgets, lo que normalmente le quita un buen mordisco al tamaño.

Pasar por debajo del límite de un adjunto

La mayoría de servidores de correo se paran en 25 MB. Un documento que se queda justo por encima suele estarlo por desperdicio estructural, y una reconstrucción basta para colarlo sin tocar el contenido.

Limpiar metadatos antes de compartir

Equilibrada y Fuerte borran los campos de título, autor y palabras clave, que a menudo siguen guardando el nombre interno del archivo, el de una plantilla o el de quien creó el documento por primera vez.

De dónde sale el espacio desperdiciado en un PDF

Un PDF es, por diseño, un formato que solo añade. Cada vez que un documento se guarda, se edita, se firma o se anota, la nueva versión puede escribirse al final mientras los objetos antiguos siguen en el archivo, sin que nadie los referencie pero ocupando sitio. Súmale una tabla de referencias cruzadas sin comprimir, un paquete de metadatos XMP de varios kilobytes y los flujos de apariencia de un formulario relleno, y un documento que debería pesar 400 KB pasa cómodamente del megabyte. Reconstruirlo se deshace de todo eso, y hacerlo en tu navegador significa que el contrato o el historial médico que estás reduciendo no sale de tu dispositivo.

Lo que no puede hacer

Esto no es, deliberadamente, un recompresor de imágenes, y eso marca el techo:

  • No recodifica imágenes. Un documento escaneado es casi por completo datos de imagen, así que apenas se moverá. Reducirlo implica bajar la calidad de imagen, lo que destruye la capa de texto, y esa es una decisión tuya, no un valor por defecto oculto.
  • No hace subconjuntos de fuentes. Un documento que incrusta una familia tipográfica completa para tres caracteres se la queda entera. Un subsetting correcto necesita un motor de fuentes muy por encima de lo que corresponde a una herramienta de navegador.
  • Los PDF protegidos con contraseña se rechazan. pdf-lib no puede descifrar los flujos de contenido, así que un documento cifrado se reconstruiría en páginas en blanco o ilegibles. Quita antes la contraseña en tu lector de PDF.
  • Los archivos muy grandes dependen de la memoria de tu dispositivo: el documento entero se mantiene en RAM mientras se reconstruye.
  • Los marcadores, el índice y la estructura de accesibilidad del PDF etiquetado no se conservan. Si dependes de ellos, guarda el original.

Solución de problemas

Dice «ya estaba optimizado» y me ha devuelto mi archivo
La reconstrucción no salió más pequeña, así que se te devolvió el original en lugar de una copia peor. Tu archivo ya estaba escrito así, normalmente porque se exportó una sola vez y de forma limpia desde una herramienta moderna. No pasa nada.
Mi escaneo de 30 MB solo ha perdido 200 KB
Es lo esperable. Los escaneos son imágenes, y aquí las imágenes no se recomprimen. Para reducir uno, exporta las páginas con PDF a JPG a menor resolución y reconstrúyelas con Imagen a PDF — asumiendo que el resultado son fotos de páginas, sin capa de texto.
Los campos de formulario ya no se pueden editar
Es el nivel Fuerte haciendo lo que anuncia: los campos se aplanan y sus valores quedan permanentes. Usa Equilibrada o Ligera si necesitas que el formulario siga siendo interactivo.

Preguntas frecuentes

¿Cuánto se va a reducir mi archivo?

Depende por completo de qué esté desperdiciando espacio. Un documento editado y vuelto a guardar muchas veces, o uno con un formulario relleno, puede perder un tercio o más. Un archivo exportado una sola vez y de forma limpia desde una herramienta moderna puede no perder casi nada: no había nada que recuperar.

¿Por qué no ha pasado nada con mi documento escaneado?

Porque un escaneo es esencialmente un montón de JPEG, y esta herramienta no vuelve a comprimir imágenes. Las imágenes son el archivo, así que el ahorro estructural es un error de redondeo. Para reducir de verdad un escaneo hay que recodificar las imágenes, lo que destruye la capa de texto — un intercambio que esta herramienta no hace en silencio por ti.

¿Se pierde algo?

En Ligera, no: solo cambian los objetos sin referencia y el empaquetado. En Equilibrada se borran los metadatos del documento (título, autor, palabras clave). En Fuerte se aplanan los campos de formulario —sus valores se pintan en la página pero ya no se pueden editar— y se eliminan anotaciones y enlaces.

¿Se sube mi PDF?

No. pdf-lib se ejecuta en tu navegador. Abre la pestaña Red de las herramientas de desarrollo mientras comprimes, o desconéctate de internet después de cargar la página: la compresión se completa igual.

¿El texto seguirá siendo seleccionable?

Sí. Las páginas se copian como objetos en lugar de rasterizarse, así que el texto sigue siendo texto real, los vectores siguen siendo vectores y las imágenes conservan su codificación original en todos los niveles.

Otras herramientas recomendadas