Aller au contenu
Article

Extraire des pages d'un PDF

Sortir d'un PDF les feuillets voulus dans un fichier à part : ce qui distingue les deux modes de sortie, pourquoi les fichiers de l'archive conservent les numéros de page d'origine, et ce que fait la désactivation de la conservation de taille.

En bref : Pour extraire des pages d'un PDF, ouvrez extract-pages, cochez les feuillets voulus et choisissez le mode de sortie : un document, ou une archive avec un fichier par page. Les fichiers de l'archive portent le numéro de page de la source, le lien avec l'original ne se perd donc jamais.

Cluster

guide pas à pas

Étapes claires pour faire passer une tâche PDF de l’entrée à un résultat fiable.

13 articles

Outil principal

Extraire des pages en ligne

Ouvrez l'outil cité dans cet article et terminez l'opération dans la locale actuelle.

Ouvrir l'outil

Table des matières

Extraire des pages d'un PDF dans un fichier séparé

Un rapport de quatre-vingts feuillets contient les quatre dont vous avez besoin, celles du tableau de calcul. Un contrat contient une annexe, un manuel un chapitre. La demande se ressemble à chaque fois, mais l'outil dispose de deux modes de sortie et d'un réglage qui refait le format des pages sans le dire.

Extraire ou supprimer : une seule tâche vue de deux côtés

Le même résultat sort de deux outils, et choisir entre eux relève de l'arithmétique, pas du sens.

extract-pages construit un nouveau document à partir des pages cochées. remove-pages garde le document en tant que document et en jette le superflu.

La règle est courte : s'il en faut peu et qu'on en jetterait beaucoup, extrayez. Si c'est l'inverse, supprimez. Cocher quatre pages va plus vite que d'en cocher soixante-seize.

Il y a aussi une différence de fond. L'extraction produit toujours un fichier neuf, le bon choix quand ce qui en sort partira comme pièce jointe distincte. La suppression conserve le document source entier, et on la choisit quand le résultat doit rester le même papier, seulement plus court.

Deux modes de sortie

ModeCe qui se téléchargeQuand il sert
PDF uniqueUn fichier où les pages se suiventUn chapitre, une annexe ou un extrait en un seul document
Un fichier par pageUne archive ZIP contenant un PDF distinct par pageRépartir des feuillets signés ou des formulaires un par un

Le premier est celui par défaut. Le second renvoie une archive même lorsqu'une seule page est extraite : la décompression fait toujours partie du marché.

Le mode page par page se choisit pour un travail précis et non par précaution : envoyer à chaque signataire son propre feuillet, téléverser des pages une à une dans un système qui n'accepte que des fichiers d'une page, ou classer un lot de demandes numérisées dans des dossiers. Dans toute autre situation, un document unique est plus commode à ouvrir, à joindre et à vérifier.

Les noms de fichiers de l'archive conservent les numéros d'origine

Ce détail se rate facilement, et il règle le problème principal de l'extraction page par page : savoir ensuite ce qui venait d'où.

Les fichiers de l'archive portent le numéro de page du document source, et non leur rang dans la sélection. Extraire les pages 2, 5 et 6 donne une archive contenant `page_002.pdf`, `page_005.pdf` et `page_006.pdf`. Aucune renumérotation depuis un, aucun `part_1` ni `part_2`.

L'intérêt en est direct : les noms ne perdent jamais leur lien avec l'original. Un mois plus tard, devant `page_047.pdf` dans un dossier partagé, on peut encore dire quel feuillet de quel document c'était. Le numéro est complété à trois chiffres, les fichiers se trient donc correctement par nom jusqu'à 999 pages.

Comment extraire les feuillets voulus

1. Ouvrez extract-pages et chargez le document. 2. Cochez les pages dans la grille d'aperçus ou tapez les numéros. 3. Choisissez le mode de sortie : un document, ou une archive de fichiers séparés. 4. Laissez activée la conservation de la taille de page si vous n'êtes pas sûr. 5. Lancez le traitement et téléchargez le résultat. 6. Ouvrez le résultat et vérifiez que vous avez attrapé les bons feuillets : le numéro imprimé sur une page et son rang dans le fichier coïncident rarement.

L'ordre des pages est toujours celui du document

Les coches de la grille ne retiennent pas l'ordre des clics, et le champ de texte ne fixe aucun ordre. La sélection est triée par ordre croissant avant l'envoi : `5,2,4` veut donc dire la même chose que `2,4,5`.

C'est une répartition des rôles et non un oubli. L'extraction choisit des pages ; les réorganiser revient à organize-pdf, où l'ordre se fixe en faisant glisser les vignettes.

Si la tâche consiste à la fois à choisir et à réordonner, faites-le en deux temps : extrayez d'abord ce qu'il vous faut, puis mettez-le dans l'ordre.

Ce que fait la désactivation de la conservation de taille

L'interrupteur de taille de page est activé par défaut, et avec lui chaque page voyage telle quelle vers le nouveau fichier, avec sa largeur, sa hauteur et son orientation.

Désactivé, il ramène toutes les pages extraites à un format unique. Ce format ne vient ni d'un réglage ni de la page la plus fréquente : il vient de la première page de la sélection. Les autres y sont insérées en entier, proportions gardées et centrées, rien n'est donc étiré et des marges apparaissent autour.

Vérifié sur un document dont la troisième page est à l'italienne et les autres à la française. Sélectionner les pages 3, 1 et 2 avec l'interrupteur désactivé a donné trois pages à l'italienne : la première de la sélection a imposé le format à toutes.

D'où la règle : quand on uniformise un document à une seule taille, surveillez quelle page vient en tête de la sélection. Se tromper ne casse aucun contenu, mais bascule le résultat entier sur le côté.

L'interrupteur se laisse activé presque toujours. Le désactiver se justifie quand le résultat part à l'impression ou vers un système qui refuse les documents aux formats mélangés.

Ce qui voyage avec les pages

Les pages extraites ne sont pas redessinées : le texte reste du texte, les liens restent des liens et la qualité des images ne bouge pas. Seul ce à quoi ces pages se réfèrent passe dans le nouveau fichier, le poids sort donc à peu près proportionnel. Sur un document de 20 pages et 10 Ko, extraire les cinq premières a donné 3 Ko, et une seule page un peu plus d'un kilooctet.

La réserve concerne le mode page par page. Une police ou un logo employé sur toutes les pages atterrit dans chaque fichier de l'archive avec sa propre copie : la somme des tailles de toutes les parties peut donc dépasser nettement l'original.

Les propriétés du document sont reprises telles quelles depuis la source. Le titre et l'auteur d'une annexe extraite seront ceux du gros contrat dont elle sort. Si le fichier part à l'extérieur, cela mérite d'être corrigé via set-pdf-metadata.

Le sommaire suit avec ses numéros recalculés : les entrées pointant vers des pages extraites survivent et désignent leurs nouvelles positions, les autres sont écartées. Dans le mode page par page, chaque page voyage comme document propre, et il n'y reste plus de structure.

Limites et refus

Les numéros de page s'écrivent séparés par des virgules, les intervalles avec un tiret : `2,5,9-12`. L'analyse est stricte, et la moindre inexactitude arrête la tâche entière au lieu de l'exécuter à moitié. Un numéro au-delà de la fin du document, un intervalle inversé comme `10-3`, un zéro au début du compte : autant de refus avec explication.

La sélection totale est plafonnée à vingt mille pages. Le travail ordinaire n'y arrive jamais ; ce plafond existe contre des saisies comme `1-99999` répétées plusieurs fois.

Un document sous mot de passe d'ouverture ne peut pas être traité : levez la protection avec unlock-pdf et revenez. Un mot de passe qui limite seulement l'impression ou la copie ne gêne pas.

Un dernier mot sur le choix de l'outil. Si le document doit être coupé en parts selon son volume plutôt que délesté de feuillets choisis, c'est split-pdf. Si ce qui est extrait doit ensuite rejoindre autre chose, c'est merge-pdf.

FAQ

L'extraction construit un nouveau document à partir des pages cochées ; la suppression conserve le document source et en jette le superflu. Choisissez par l'arithmétique : s'il en faut peu et qu'on en jetterait beaucoup, l'extraction demande moins de coches.
Du numéro de page du document source : les pages 2, 5 et 6 donnent page_002.pdf, page_005.pdf et page_006.pdf. La numérotation ne repart pas de un, chaque partie garde donc un lien visible avec l'original.
Non. La sélection est triée par ordre croissant avant l'envoi, donc 5,2,4 revient au même que 2,4,5. Réordonner revient à organize-pdf, où l'ordre se fixe en faisant glisser les vignettes.
Elle ramène toutes les pages extraites à un format unique, et ce format vient de la première page de la sélection. Si une page à l'italienne vient en tête, tout passe à l'italienne : surveillez par quoi la sélection commence.
Les fichiers ne servent qu'à l'opération choisie et sont supprimés automatiquement une fois le traitement terminé. Nous n'utilisons pas les documents envoyés pour entraîner des modèles d'IA.

Plus de ce cluster

Outils associés

← Tous les outils Modifier

Que faire ensuite

Si vous avez besoin d'une étape pratique ou d'un repère sur le service après la lecture, ouvrez ces pages.

Tous les outils

Catalogue d'outils PDF pour fusionner, compresser, diviser, convertir, pivoter, protéger et déverrouiller vos fichiers PDF en ligne.

FAQ

Réponses aux questions fréquentes sur iHatePDF : faut-il s'inscrire, comment les fichiers sont traités, où consulter les limites et la sécurité du téléversement de documents.

Contact

Contactez iHatePDF pour toute question sur les erreurs de traitement, le choix d'un outil, la sécurité, les demandes commerciales et les suggestions de nouvelles fonctionnalités.