Une page PDF est un programme de dessin combinant texte, vecteurs, images, masques, transparence, annotations et transformations. Le rendu compose tout en un rectangle visible. L’extraction copie des objets image individuels et ne reproduit pas automatiquement la page autour. Ce sont deux tâches aux résultats différents.
Rendez pour obtenir la page visible
Utilisez la rastérisation pour un aperçu web, une vignette ou un système acceptant l’image de la page entière. PageRaster suit rognage et rotation PDF.js, peint séquentiellement et nomme selon la page source. Liens, formulaires interactifs, scripts, pièces jointes, calques, audio et texte sélectionnable disparaissent. Les apparences visibles d’annotations ou formulaires peuvent être peintes : contrôlez-les.
Extrayez pour obtenir une ressource originale
Si vous cherchez la photographie originale du PDF, utilisez un extracteur d’objets signalant masques, espaces colorimétriques, transformations et références répétées. PageRaster n’offre volontairement pas ce flux. Il ne fait pas d’OCR, ne reconstruit pas de document, ne supprime pas l’arrière-plan et ne récupère pas une source avant compression. Un recadrage rendu inclut échelle et composition et peut différer des pixels natifs.
Vérifiez les pixels téléchargés
Ouvrez chaque PNG ou JPEG dans l’application cible, confirmez numéro de page, largeur et hauteur mesurées, puis comparez texte, polices, couleurs, transparence et annotations au PDF de référence. Conservez le PDF comme source. Le raster est un instantané rendu par le navigateur, pas une preuve d’équivalence vectorielle, imprimée, archivistique, accessible, juridique ou sémantique.