👤 Pro — sans publicitéPro
// PDF → .docx

PDF en Word

Récupérez le texte d'un PDF dans un document Word modifiable que vous pouvez retravailler. Tout se passe dans votre navigateur — votre fichier ne quitte jamais votre appareil.

Gratuit — utilisation illimitée.

Ce que vous obtenez (et ce que vous n'obtenez pas)

Cet outil extrait le texte d'un PDF et le place dans un document Word modifiable. Quand le PDF est un fichier numérique normal, il lit directement le vrai texte, ce qui donne une grande précision. Quand le PDF est un scan (une simple image), il lit les pages par OCR à la place. Dans les deux cas, vous obtenez des mots modifiables, pas un clone au pixel près de la mise en page d'origine — les polices, les colonnes et le positionnement exact sont simplifiés. C'est idéal pour réutiliser le contenu d'un document ; reproduire la mise en page à l'identique demande un logiciel spécialisé et payant. Tout se passe dans votre navigateur — votre PDF n'est jamais téléversé.

Mon PDF est-il téléversé quelque part ?

Non. L'extraction du texte comme l'OCR se déroulent dans votre navigateur. Votre document — et tout ce qu'il contient de confidentiel — ne quitte jamais votre appareil.

Pourquoi la mise en page n'est-elle pas identique au PDF ?

Le PDF et le Word stockent les pages de façon très différente. Reconstruire fidèlement chaque police, colonne et encadré nécessite un moteur commercial très lourd. Cet outil se concentre sur l'extraction propre et modifiable du texte, ce qui couvre la plupart des besoins réels, plutôt que de viser une copie visuelle parfaite.

Fonctionne-t-il sur des PDF scannés ?

Oui. Si une page ne contient aucun texte numérique, l'outil la lit automatiquement par OCR (le même moteur que notre outil Image en texte). L'OCR n'est jamais parfait, relisez donc le résultat — mais cela vous évite de tout retaper.

La première page scannée a été lente — pourquoi ?

Le moteur OCR télécharge un modèle de lecture (environ 15 à 25 Mo) une seule fois, la première fois qu'il est nécessaire, puis il est mis en cache. Les PDF numériques n'ont pas besoin d'OCR et sont quasi instantanés.

Quelles langues l'OCR peut-il lire ?

L'OCR intégré lit l'anglais. Les PDF numériques (non scannés) conservent quelle que soit la langue qu'ils contiennent, puisque leur vrai texte est utilisé directement.

Peut-il ouvrir un PDF protégé par mot de passe ?

Non — retirez d'abord le mot de passe dans votre lecteur PDF, puis convertissez le fichier déverrouillé.

Retransformer un PDF finalisé en quelque chose que vous pouvez modifier

Un PDF est conçu pour être définitif — parfait pour l'envoi et l'impression, frustrant dès l'instant où vous devez changer une seule ligne. Peut-être que le document d'origine a disparu depuis longtemps, qu'un collègue n'a que le PDF, ou que vous voulez réutiliser quelques paragraphes dans autre chose. Le retaper à la main est lent et source d'erreurs. Cet outil en extrait le texte et le dépose dans un document Word que vous pouvez modifier comme n'importe quel autre, pour corriger une faute de frappe, mettre à jour un chiffre, traduire une section ou reprendre le contenu — sans partir d'une page blanche.

PDF numériques contre scans

Il existe deux sortes de PDF, et l'outil les traite différemment. Un PDF numérique — exporté depuis Word, un navigateur ou un logiciel de comptabilité — contient encore le vrai texte, donc l'outil le lit directement et la précision est élevée. Un PDF scanné n'est en réalité qu'une photo d'une page, sans aucun texte à l'intérieur ; là, l'outil se rabat sur l'OCR, en reconnaissant les lettres à partir de l'image. Il décide automatiquement page par page, si bien qu'un document qui mélange les deux — une lettre tapée avec une page de signature scannée — est traité de façon judicieuse.

Du texte modifiable, pas une photocopie de la mise en page

Il est utile de savoir ce que vous obtenez : les mots, prêts à être modifiés, plutôt qu'une reconstruction au pixel près des polices, colonnes et cadres. Reproduire exactement une mise en page complexe, c'est ce que facturent les convertisseurs commerciaux les plus lourds ; cet outil se concentre délibérément sur l'extraction propre du contenu, ce dont la plupart des gens ont réellement besoin. Une fois le texte dans Word, réappliquer des titres, un tableau ou votre charte graphique prend deux minutes et vous donne un document qui est vraiment le vôtre à travailler, plutôt qu'un document contre lequel vous devez lutter.

Tirer le meilleur de l'OCR

Quand une page doit être lue par OCR, quelques éléments aident. Le lecteur intégré traite l'anglais ; plus le scan est net et droit, mieux il se comporte, si bien qu'un scan propre à 300 dpi bat une photo de téléphone prise à la hâte et de travers. L'OCR n'est jamais infaillible — attendez-vous à quelques lettres erronées de temps en temps, en particulier avec des polices inhabituelles, une impression pâle ou de l'écriture manuscrite — relisez donc rapidement le résultat. Malgré cela, corriger une poignée de caractères est bien plus rapide que retaper toute une page, ce qui est précisément l'intérêt.

Privé par conception

L'extraction de texte et l'OCR s'exécutent tous deux entièrement dans votre navigateur, si bien que le document ne quitte jamais votre appareil — rien n'est téléversé, journalisé ou stocké. Cela compte pour les contrats, les courriers RH, les relevés financiers et tout ce que vous ne voudriez pas voir traîner sur le serveur de quelqu'un d'autre. La seule chose que vous devrez peut-être faire d'abord est de retirer un mot de passe, car un PDF protégé doit être déverrouillé avant que son texte puisse être lu. Gardez votre PDF original comme copie de référence, et traitez le fichier Word comme votre brouillon de travail.

Convertburda — conversions universelles