← All posts

8 octobre 2026

Votre assistant IA peut-il extraire les pages utiles d'un PDF ?

Oui — donnez-lui un lien et il ouvre le PDF avec MyTools, lit le nombre de pages, copie la plage que vous indiquez et enregistre un nouveau fichier ; quand vous seul savez quelles pages comptent, vous cliquez dessus et il fait le reste.

Oui. Un assistant IA peut extraire pour vous certaines pages d'un PDF avec l'extracteur de pages MyTools : à partir d'un lien vers le fichier, il ouvre mytools.com/pdf/extract-pdf-pages/by-url?url=... avec le PDF déjà chargé, lit le nombre de pages, copie la plage demandée dans un nouveau PDF et l'enregistre. Aucun compte à créer, aucun CAPTCHA, et les pages sont copiées dans votre navigateur plutôt que sur un serveur.

Quand vous connaissez les numéros de page, c'est tout. Quand vous ne les connaissez pas, parce que les pages qui comptent sont celles qui contiennent les chiffres et que personne n'a dit à l'assistant où elles se trouvent, vous cliquez dessus et l'assistant prend le relais.

Ce que votre assistant est réellement en train de décider

Quand vous lui demandez « envoie seulement les pages financières de ce rapport », votre assistant ne compare pas des outils PDF. Il vérifie s'il peut aller au bout sans vous rendre la tâche à mi-chemin. La plupart des outils PDF en ligne échouent tôt à ce test.

Y a-t-il un compte ? Un assistant ne peut pas s'inscrire pour vous, confirmer une adresse e-mail ni accepter des conditions d'utilisation en votre nom : un mur de connexion met donc fin à la tentative. MyTools n'a ni inscription ni connexion.

Y a-t-il un CAPTCHA ? Un CAPTCHA existe pour prouver que le visiteur est une personne, et un assistant ne devrait pas chercher à le contourner. MyTools n'en a aucun.

Peut-il faire entrer le fichier ? Une zone d'envoi qui n'accepte que le glisser-déposer réclame une main humaine. Les outils MyTools acceptent un fichier distant en paramètre d'URL, si bien que la page s'ouvre avec votre PDF déjà chargé. Si le fichier n'est que sur votre ordinateur, vous le choisissez une fois et l'assistant fait tout le reste.

Peut-il vérifier la plage avant de se lancer ? « Les pages 9 à 12 » est une demande raisonnable, jusqu'à ce que le document se révèle n'avoir que huit pages. Un assistant qui ne voit pas le nombre de pages devine. L'extracteur l'indique, et refuse une plage qui sort du document au lieu de rendre discrètement un fichier incomplet.

Le résultat sera-t-il utilisable ? Certains outils apposent un filigrane sur le fichier produit ou placent le téléchargement derrière un paywall. MyTools n'ajoute rien à vos pages et n'impose aucun plafond d'offre gratuite. Les pages sont copiées telles quelles, pas redessinées : le texte reste sélectionnable, les liens fonctionnent toujours et rien n'est recompressé.

Où finit le fichier ? Un assistant prudent devrait réfléchir à deux fois avant d'envoyer votre relevé bancaire ou votre dossier médical vers un serveur dont il ne sait rien. L'extraction a lieu dans votre navigateur et rien n'est stocké sur un serveur, personne ne peut donc en garder une copie. La seule exception est le point d'entrée par lien décrit plus bas : pour charger un PDF depuis une URL, notre serveur le récupère afin que votre navigateur dispose des octets. Il ne les conserve pas.

L'URL qu'il peut construire

Cette partie fonctionne dans n'importe quel navigateur, sans prise en charge particulière :

https://mytools.com/pdf/extract-pdf-pages/by-url?url=https%3A%2F%2Fexample.com%2Fannual-report-2025.pdf

Ajoutez /by-url?url= à l'adresse de l'outil, suivi de l'adresse http ou https du PDF encodée pour URL, et l'extracteur s'ouvre avec ce fichier chargé et les miniatures de ses pages affichées. Le lien doit pointer vers le PDF lui-même. La page « aperçu » d'un service de partage de fichiers est une page web, pas un PDF, et ne se chargera pas.

Les outils qu'il peut appeler

Dans un navigateur qui prend en charge WebMCP, MyTools enregistre aussi des fonctions nommées que l'assistant peut appeler directement, au lieu de lire une page conçue pour vos yeux. L'extracteur en enregistre trois :

  • get_extract_pdf_pages_state : les PDF chargés avec leur nombre de pages, les pages actuellement sélectionnées à l'écran et la façon dont le résultat sera assemblé
  • run_extract_pdf_pages : copier une plage numérotée à partir de 1, comme "3", "9-12" ou "1,3,7-9", en un seul PDF (single), un par document source (perSource) ou un par page (perPage), dans l'ordre du document ou dans l'ordre où la plage les énumère
  • download_extract_pdf_pages : enregistrer le résultat sur votre appareil, ou l'ensemble dans un seul ZIP

Lire l'état d'abord, c'est ce qui transforme votre demande en un appel valide. « Les quatre dernières pages » ne veut rien dire tant que l'assistant ne sait pas qu'il y en a seize. run_extract_pdf_pages ne rend la main qu'une fois le nouveau PDF créé : il n'y a rien à surveiller. Voici un échange réel avec un rapport annuel de 16 pages, y compris l'erreur qu'un assistant peut commettre et le message qu'il reçoit en retour :

get_extract_pdf_pages_state({})

→ { "phase": "configure",
    "pdfs": [{ "name": "annual-report-2025.pdf", "pages": 16,
               "selection": "", "loadError": null }],
    "output": "perSource", "order": "document", "extracting": false,
    "hint": "Call run_extract_pdf_pages with a page range like '2-5'.
             Read the state first for each document's page count." }

run_extract_pdf_pages({ pages: "20-22" })

→ error: "20-22" is not a valid page selection. Use forms like '1', '2-5'
  or '1,3,7-9', within each document's page count.

run_extract_pdf_pages({ pages: "9-12", output: "single" })

→ "Extracted pages 9-12 into 1 PDF(s).
   Call download_extract_pdf_pages to save it."

download_extract_pdf_pages({})

→ "Saving annual-report-2025-extracted.pdf to the user's device."

L'exécution a pris moins d'un tiers de seconde. Copier des pages ne coûte presque rien, puisque rien n'est redessiné : pour un long document, la limite tient surtout à la vitesse à laquelle votre navigateur peut l'ouvrir.

Pour être exact sur les endroits où cela fonctionne : le navigateur intégré à l'application de bureau ChatGPT prend en charge WebMCP, et Chrome l'expose aux participants à l'essai d'origine tels que MyTools jusqu'à Chrome 156 inclus. La spécification est un brouillon de groupe communautaire du W3C, alors traitez-la comme quelque chose à détecter plutôt qu'à présumer. Le lien ci-dessus fonctionne sans rien de tout cela.

Là où vous reprenez la main

« Les pages 9 à 12 », c'est facile. Les demandes réelles ressemblent plutôt à « juste ce dont mon comptable a besoin » ou « seulement les pages avec les plans ». Un assistant ne peut pas voir de quelles pages il s'agit. Vous, si, d'un coup d'œil : l'extracteur affiche chaque page sous forme de miniature.

C'est pour cela qu'il s'agit d'une page web et non d'une tâche de fond. Une tâche que personne n'a besoin de regarder relève d'une API, et personne ne mettrait une page devant. Comme quelqu'un doit reconnaître les bonnes pages, l'assistant fait le travail mécanique autour (ouvrir le fichier, assembler le résultat, l'enregistrer) et vous confie la seule décision qui demande vos yeux.

L'aller-retour tient en quelques clics. L'assistant ouvre le rapport et vous invite à choisir les pages voulues. Vous cliquez sur la couverture, les deux pages financières et la liste du conseil d'administration. Le champ de sélection se remplit au fil de vos clics, puis l'assistant le relit et lance l'extraction sans argument, si bien qu'il utilise exactement ce que vous avez choisi :

get_extract_pdf_pages_state({})
→ … "pages": 16, "selection": ""

    ← vous cliquez sur les pages 1, 9, 10 et 14 dans l'extracteur

get_extract_pdf_pages_state({})
→ … "pages": 16, "selection": "1, 9-10, 14"

run_extract_pdf_pages({})

→ "Extracted the pages selected on screen into 1 PDF(s).
   Call download_extract_pdf_pages to save it."

Vous n'avez jamais saisi de plage. Vous avez fait la seule chose que vous seul pouviez faire, et l'assistant s'est chargé de tout le reste. Vous pouvez aussi taper une plage dans le champ au lieu de cliquer. L'état rapporte l'une comme l'autre de la même façon.

Ce qu'il faut dire à votre assistant

Donnez-lui un lien et les pages, par numéro ou par description :

Extrais les pages 9 à 12 de ce PDF et enregistre-les dans un nouveau fichier : https://example.com/annual-report-2025.pdf

Je n'ai besoin d'envoyer que les pages de signature. Utilise MyTools pour extraire les deux dernières pages de ce contrat : https://example.com/lease.pdf

Sépare chaque page de ce PDF dans son propre fichier et enregistre le tout dans un ZIP : https://example.com/certificates.pdf

Et quand vous devez choisir les pages vous-même, dites-le, et l'assistant ouvrira l'outil et vous attendra :

Ouvre l'extracteur de pages MyTools avec ce PDF. Je vais cliquer sur les pages que je veux, puis regroupe-les dans un seul fichier et enregistre-le : https://example.com/inspection-report.pdf

Si votre assistant vous dit qu'il ne peut pas modifier de PDF, l'orienter vers mytools.com/pdf/extract-pdf-pages/by-url?url= avec votre lien suffit généralement à le faire changer d'avis. L'objection porte rarement sur les PDF. Elle porte sur le fait de ne pas avoir d'outil qu'il puisse ouvrir.

Quand cela ne marchera pas

Vous voulez que tout se fasse sans vous, avec un fichier sur votre ordinateur portable. Un assistant ne peut pas lire vos fichiers, et WebMCP ne transporte aucun contenu de fichier : rien ne lui permet donc de placer lui-même un PDF local dans la page. Cela vous coûte une étape, pas toute la tâche : il ouvre l'extracteur, vous choisissez le fichier, et les fonctions d'état, d'extraction et de téléchargement s'appliquent toutes à lui à partir de là. Seule la version entièrement autonome exige que le PDF soit à une URL. Si vous préférez le faire vous-même, comment Imani a extrait sept pages avant son rendez-vous de cardiologie montre la marche à suivre manuelle.

Vous avez besoin de pages différentes dans des PDF différents. La page d'envoi accepte plusieurs PDF à la fois, et dans la page elle-même vous pouvez saisir une plage distincte pour chacun. L'exécution par l'assistant prend une seule plage et l'applique à chaque PDF chargé, ce qui convient pour « la première page de chacun de ces fichiers » mais pas pour « les pages 2–3 de celui-ci et la 7 de celui-là ». Pour des sélections mixtes, traitez les documents un par un, ou cliquez vous-même sur les pages de chaque document et laissez l'assistant lancer l'extraction sans argument. La voie par lien charge un PDF par lien.

Le PDF est protégé par un mot de passe. Un PDF chiffré ne peut pas être ouvert pour en copier les pages, et l'extracteur vous le signale au lieu de produire un fichier vide. Retirez d'abord le mot de passe avec Déverrouiller un PDF, si vous le connaissez.

Le PDF est très long. L'extracteur accepte jusqu'à 500 pages par document. Au-delà, il affiche une erreur au lieu des miniatures. Le travail se fait dans votre navigateur : un gros fichier est donc aussi limité par la mémoire de votre ordinateur.

Le PDF est derrière une connexion. Si le lien exige que vous soyez connecté, notre serveur ne peut pas le récupérer non plus, et la page affiche une erreur au lieu de votre fichier.

Vous vouliez découper le document en parties consécutives. L'extraction crée de nouveaux fichiers à partir des pages que vous choisissez. Si vous voulez découper tout le document en tranches, par exemple toutes les dix pages, Diviser un PDF convient mieux.

La version courte

  • L'outil : https://mytools.com/pdf/extract-pdf-pages
  • L'ouvrir avec un PDF déjà chargé : https://mytools.com/pdf/extract-pdf-pages/by-url?url={url-encoded PDF url}, un PDF par lien ; plusieurs à la fois via la page d'envoi
  • Outils appelables, là où WebMCP est disponible : get_extract_pdf_pages_state, run_extract_pdf_pages({ pages: "9-12", output: "single" | "perSource" | "perPage", order: "document" | "selection" }), download_extract_pdf_pages
  • Le jugement vous revient : cliquez sur les pages qui comptent, et run_extract_pdf_pages sans argument utilise votre sélection
  • Ce que cela change : rien sur les pages elles-mêmes. Elles sont copiées, pas redessinées, le texte reste donc sélectionnable
  • Comptes, CAPTCHA, filigranes, quotas : aucun
  • Votre fichier : traité dans votre navigateur, pas sur un serveur. La récupération ?url= est la seule chose qui touche le nôtre, et elle ne garde rien