Comprimir PDF sin perder calidad: la guía completa
Un PDF de 30 MB que no entra por email, un catálogo de 200 MB que tarda en abrir, un escaneado pesado que ocupa la mitad del Drive. La compresión sin pérdida de calidad visual es posible — y a menudo dramática (50-90% de reducción) — siempre que ataques al elemento correcto: las imágenes embebidas, no el texto.
Por qué los PDFs son grandes (y qué se puede comprimir)
Un PDF típicamente contiene:
- Texto vectorial: ~1 KB por página. No se puede comprimir más.
- Fuentes embebidas: 50-500 KB por fuente única. Se puede subset (incluir solo glifos usados).
- Imágenes raster: el verdadero culpable — pueden ser 1-50 MB cada una.
- Imágenes vectoriales: 1-100 KB cada una. Se pueden simplificar curvas.
- Metadatos: ~10 KB. Despreciable.
El 90% del tamaño de un PDF "pesado" suele ser imágenes raster sin comprimir o sobredimensionadas. Atacar ahí es donde están las grandes ganancias.
Método 1: Online sin instalar nada
Para conversiones puntuales, el camino más rápido es subir el PDF y descargarlo comprimido. KaijuConverter aplica un pipeline Ghostscript con preset balanceado (calidad 150 DPI, JPEG quality 85, font subsetting):
- Comprimir PDF online — pipeline server-side optimizado
- PDF a TXT — si solo necesitas el texto, prescinde del PDF entero
- PDF a JPG — convertir páginas a imagen comprimida individual
Reducciones típicas: 50-80% para PDFs con muchas imágenes, 10-30% para PDFs solo de texto (allí ya hay poco margen).
Método 2: Ghostscript con presets
El estándar industrial. Cuatro presets de calidad:
# Máxima compresión (pdf para email, calidad pantalla)
gs -sDEVICE=pdfwrite -dCompatibilityLevel=1.4 \
-dPDFSETTINGS=/screen \
-dNOPAUSE -dQUIET -dBATCH \
-sOutputFile=output-screen.pdf input.pdf
# Buena compresión, calidad ebook (resoluciones medias)
gs -sDEVICE=pdfwrite -dPDFSETTINGS=/ebook \
-dNOPAUSE -dQUIET -dBATCH \
-sOutputFile=output-ebook.pdf input.pdf
# Calidad presentación (300 DPI imágenes)
gs -sDEVICE=pdfwrite -dPDFSETTINGS=/printer \
-dNOPAUSE -dQUIET -dBATCH \
-sOutputFile=output-printer.pdf input.pdf
# Máxima calidad (apenas comprime — para archivado)
gs -sDEVICE=pdfwrite -dPDFSETTINGS=/prepress \
-dNOPAUSE -dQUIET -dBATCH \
-sOutputFile=output-prepress.pdf input.pdf
Tabla de referencia para PDFs típicos:
| Preset | Imágenes resampled a | JPEG quality | Reducción media |
|---|---|---|---|
| /screen | 72 DPI | 30% | 80-95% |
| /ebook | 150 DPI | 65% | 60-80% |
| /printer | 300 DPI | 80% | 30-50% |
| /prepress | 300 DPI | 90% | 0-15% |
Método 3: Ghostscript con ajustes finos
Cuando los presets no encajan exactamente:
gs -sDEVICE=pdfwrite -dCompatibilityLevel=1.4 \
-dDownsampleColorImages=true \
-dColorImageResolution=120 \
-dColorImageDownsampleType=/Bicubic \
-dDownsampleGrayImages=true \
-dGrayImageResolution=120 \
-dDownsampleMonoImages=true \
-dMonoImageResolution=300 \
-dColorImageFilter=/DCTEncode \
-dGrayImageFilter=/DCTEncode \
-dEncodeColorImages=true \
-dEncodeGrayImages=true \
-dCompressFonts=true \
-dSubsetFonts=true \
-dEmbedAllFonts=true \
-dDetectDuplicateImages=true \
-dCompressPages=true \
-dNOPAUSE -dQUIET -dBATCH \
-sOutputFile=output-custom.pdf input.pdf
Ajustes clave:
ColorImageResolution=120— resolución objetivo (120 DPI suele ser invisible para visionado en pantalla)DetectDuplicateImages=true— identifica imágenes idénticas usadas varias veces (logos en cada página) y guarda solo unaSubsetFonts=true— incluye solo los glifos realmente usados, no la fuente completa
Método 4: qpdf para optimización lossless
qpdf no recomprime imágenes — solo limpia y optimiza la estructura del PDF:
# Linealizar (web optimization) + comprimir streams
qpdf --linearize --object-streams=generate \
--compress-streams=y \
input.pdf output.pdf
# Eliminar páginas duplicadas y referencias rotas
qpdf --remove-unreferenced-resources=yes \
input.pdf output.pdf
Reducciones típicas con qpdf solo: 5-20%. Útil sobre todo para PDFs ya comprimidos donde Ghostscript no añade nada.
Workflow combinado: Ghostscript primero (compresión bruta), qpdf después (limpieza estructural).
Método 5: PDFs de escaneados — caso especial
Un PDF que es una colección de páginas escaneadas (cada página = 1 imagen de 5 MB) es el peor escenario. Solución: re-escanear con menor DPI, o re-procesar con OCR-mypdf que aplica compresión específica para escaneos:
# Compresión agresiva manteniendo legibilidad de OCR
ocrmypdf \
--optimize 3 \
--jpeg-quality 70 \
--png-quality 70 \
--output-type pdf \
scaneado-original.pdf scaneado-comprimido.pdf
Reducciones típicas: 70-90% sin pérdida de legibilidad ni del OCR.
Cuándo NO comprimir
- Documentos legales firmados digitalmente — la firma se invalida al modificar el PDF
- Documentos para imprenta offset profesional — necesitan PDF/X con calidad 300 DPI
- Archivos para revisión editorial — donde se va a editar capa a capa (usa el original)
- PDFs ya optimizados — si tu PDF ya pesa <100 KB/página, no hay margen real
Verificar reducción
# Tamaño antes y después
ls -lh input.pdf output.pdf
# Inspección detallada (Linux/macOS)
pdfinfo output.pdf
qpdf --check output.pdf
Visualiza ambos lado a lado en el visor PDF y compara páginas con texto fino y zonas de color para asegurar que la calidad es aceptable para tu caso.
Conversiones relacionadas
- PDF a JPG — extraer páginas como imágenes individuales
- PDF a PNG — para imágenes con texto fino
- JPG a PDF — recomprimir imágenes y volver a empaquetar
- PDF a DOCX — extraer a Word editable
- PDF a TXT — solo el texto, descarta lo demás
- PDF a HTML — convertir a web sin tamaño binario PDF