Extraer imágenes de un PDF

o suéltalo aquí
Elige primero un PDF.

Extrae las fotos sueltas que guarda un PDF, no capturas de sus páginas. Los flujos JPEG soportados quedan byte a byte exactos y las muestras crudas compatibles se convierten en PNG comprobados. Cada objeto de imagen queda contado en el recibo, incluido lo que el navegador no puede extraer con seguridad.

Cómo extraer imágenes de un PDF

  1. Elige un PDF

    Pulsa Elegir un PDF o suéltalo en la página. El archivo se abre y se escanea en esta pestaña del navegador.

  2. Revisa las fotos

    Los objetos de imagen coincidentes aparecen con su página, tamaño en píxeles, resolución colocada, códec, espacio de color y tamaño guardado. La lista empieza filtrada a imágenes grandes extraíbles; cambia los filtros de tamaño y disponibilidad para ver también objetos pequeños o rechazados.

  3. Elige la salida

    Conserva originales para copiar JPEG guardados byte a byte, o convierte fotos compatibles a PNG. Deselecciona lo que no necesites.

  4. Lee la comprobación y descarga

    Cada archivo de salida se vuelve a abrir y sus dimensiones se comprueban. Los bytes JPEG copiados se comparan con los guardados antes de que aparezca Descargar. Una imagen se descarga directo; varias llegan en un ZIP.

¿En qué se diferencia extraer de renderizar páginas?

Una página y las fotos que lleva son cosas distintas. Renderizar una página te da el texto, las líneas y el fondo junto a la fotografía. Esta herramienta va al revés y devuelve los objetos de imagen que dibuja la página, al tamaño en píxeles guardado en vez del tamaño colocado. Cuando quieres la página entera, usa PDF a JPG o PDF a imágenes.

Un JPEG guardado se saca del PDF sin cambios, y luego se vuelve a abrir y se comprueba contra el ancho y alto que registra el documento. Nada se decodifica y se recodifica, así que el archivo que guardas es el que llevaba el PDF. Las muestras crudas son otro caso: muestras grises y RGB de 8 bits se escriben como PNG y ese PNG se vuelve a abrir a las dimensiones registradas antes de contar.

Algunos objetos no se pueden entregar como foto independiente, y esos se quedan en pantalla con el motivo en vez de desaparecer del conteo. Una máscara de esténcil no tiene color propio. CCITT y JBIG2 necesitan un render reconstruido de página. Un JPEG con máscara de transparencia aparte no es una imagen completa por sí solo, una imagen que reasigna sus muestras podría cambiar de aspecto al convertir, y un JPEG 2000 que el navegador no vuelve a abrir no se puede verificar.

Extraer también es un diagnóstico. Si el motivo de estar aquí es el tamaño, Por qué mi PDF es tan grande informa qué imágenes cargan los bytes y en qué páginas están, y Comprimir PDF las recodifica en su sitio en vez de sacarlas.

Preguntas sobre extraer imágenes de un PDF

¿Es lo mismo que convertir páginas PDF en JPG?
No. PDF a imágenes fotografía cada página entera. Esta herramienta devuelve los objetos de imagen sueltos guardados dentro de la página, sin incluir el texto de alrededor.
¿Los JPEG cambian?
No cuando conservas originales. Un flujo JPEG soportado se copia byte a byte del PDF y se compara con la salida antes de descargar.
¿Por qué algunas imágenes salen como PNG?
PDF puede guardar muestras crudas que no son un archivo de imagen independiente. La herramienta convierte muestras grises y RGB de 8 bits soportadas a PNG, abre ese PNG y comprueba sus dimensiones.
¿Por qué se omite una imagen?
Las máscaras de esténcil no tienen color propio. CCITT, JBIG2, profundidades raras, reasignación de muestras y algunos espacios de color especialistas necesitan reconstrucción o conversión que la herramienta aún no puede probar. Se quedan visibles con el motivo del rechazo.
¿Qué pasa cuando una imagen se usa más de una vez?
La herramienta escribe ese objeto una vez y lo nombra por la primera página donde aparece. El recibo informa cuántos duplicados se dibujaron más de una vez.
¿El PDF sale de mi dispositivo?
No. Escaneo, extracción, comprobaciones y creación del ZIP ocurren en esta pestaña del navegador. PDF, miniaturas y fotos extraídas quedan fuera de la captura de datos de uso.
¿Cómo se nombran los archivos?
Un archivo como page-004-image-02.jpg es la segunda imagen única vista primero en la página 4. Página e imagen se rellenan con ceros para ordenar en orden de documento.
¿Qué demuestra el recibo?
Cuenta imágenes encontradas, extraídas y omitidas, nombra los códecs, informa archivos recodificados y duplicados, abre cada imagen de salida, comprueba sus dimensiones y compara bytes JPEG copiados con los guardados.
¿Por qué las pequeñas no salen en la lista?
La lista empieza con el filtro de tamaño en grandes de al menos 256 píxeles por lado y el de disponibilidad en extraíbles. Cambia cualquier filtro a todas para ver pequeñas, máscaras y rechazadas con sus motivos.
¿Qué pasa con las que deselecciono?
Quedan fuera de la salida y cuentan como no elegidas en el recibo. Deselecciona lo que no necesites; omitidas y rechazadas siguen listadas con sus motivos.

Las demás herramientas de pdfgym

Funcionan en una pestaña del navegador como esta, y ninguna necesita cuenta.

A dónde ir ahora