La solution rapide : joindre les lignes coupées et conserver les paragraphes
Ouvrir Supprimer les sauts de ligne, collez le passage copié et laissez cochée l’option Conserver les paragraphes séparés par des lignes vides. Utilisez un espace comme séparateur. Lancez l’outil, relisez le résultat et recopiez-le dans votre document. Un saut de ligne simple devient un espace ; une ligne vide reste une fin de paragraphe.
Utilisez « Joindre toutes les lignes » uniquement si vous voulez vraiment une seule ligne continue, par exemple une courte description ou une liste que vous convertissez en texte séparé par des virgules. Cette option supprime aussi les limites de paragraphe. « Supprimer uniquement les lignes vides » fait l’inverse : chaque ligne non vide reste séparée et les lignes vides entre elles sont supprimées.
Conservez une copie intacte avant de nettoyer un long passage. L’outil utilise les sauts de ligne présents dans votre texte collé, et non la mise en page d’origine du PDF. Si chaque paragraphe ne comporte qu’un seul saut de ligne, l’option de conservation des paragraphes ne peut pas savoir quels sauts étaient voulus. Séparez d’abord ces paragraphes manuellement.
Pourquoi un texte copié depuis un PDF a des retours à la ligne gênants
Une page PDF est mise en page pour la lecture ou l’impression. La copie peut renvoyer des lignes courtes qui suivent la mise en page plutôt qu’un texte continu. Vous voyez une phrase s’interrompre à mi-ligne, puis les mots suivants commencer à la ligne suivante. Une fois collés dans un éditeur, ces sauts peuvent subsister même s’il reste de la place pour une ligne plus longue.
Distinguez un saut de ligne enregistré du retour à la ligne automatique. Le retour à la ligne automatique change lorsque vous redimensionnez l’éditeur ; un saut enregistré maintient le mot suivant sur une nouvelle ligne. Si l’élargissement de la fenêtre corrige l’affichage, il n’y a peut-être aucun caractère indésirable à supprimer. Nettoyer un paragraphe correctement mis en forme peut créer des modifications inutiles.
Copiez d’abord une petite section. Vérifiez si les titres, les pieds de page et les colonnes apparaissent dans le bon ordre. Si le texte de deux colonnes est entremêlé, joindre les lignes ne rétablira pas l’ordre de lecture voulu. Extrayez ou copiez chaque colonne séparément avant de tenter un nettoyage des espaces.
Un exemple pratique à essayer sans envoyer de PDF
L’exemple intégré commence par « Keep an original » sur une ligne, puis « copy before editing. » sur la suivante. Une ligne vide suit, puis « Review the result » et « against the source. » apparaissent sur deux autres lignes. Avec le réglage de paragraphe par défaut, le résultat donne deux paragraphes : « Keep an original copy before editing. » et « Review the result against the source. »
Passez à « Joindre toutes les lignes » et le même exemple devient « Keep an original copy before editing. Review the result against the source. » Les mots restent les mêmes, mais la limite de paragraphe disparaît. Choisissez plutôt « Virgule et espace » et les quatre lignes non vides deviennent quatre entrées séparées par des virgules. C’est utile pour des listes, mais ce n’est pas un paragraphe naturel.
Cet exemple montre la règle exacte, et non une compréhension automatique du texte. Les lignes vides marquent les débuts de paragraphe. Un titre placé directement au-dessus d’un paragraphe sans ligne vide sera joint à ce paragraphe ; ajoutez donc une ligne vide après le titre si vous voulez le conserver.
Supprimez les espaces en trop dans une étape séparée
Après avoir joint les lignes, ouvrez Supprimer les espaces superflus si le texte contient encore des espaces ou des tabulations répétés. Son mode par défaut réduit les espaces horizontaux et rogne les bords des lignes tout en conservant les sauts de ligne. Il peut nettoyer « Keep an original » sans transformer deux paragraphes en un seul.
« Ne rogner que les bords des lignes » est une option plus douce si vous voulez supprimer les espaces en début et en fin de texte tout en conservant l’espacement à l’intérieur de chaque ligne. « Une seule ligne » remplace tous les espaces blancs de la saisie par des espaces ordinaires. Utilisez ce réglage pour un petit champ qui ne doit contenir aucun saut de ligne, et non pour un article avec des titres et des listes.
Les espaces insécables peuvent ressembler à des espaces ordinaires, même lorsqu’ils se comportent différemment. L’outil d’espacement normalise les espaces courants, y compris les espaces insécables, dans ses modes de réduction. Il ne supprime pas tous les caractères Unicode invisibles. Si deux mots refusent toujours de se séparer ou de se joindre comme prévu, examinez cet endroit précis plutôt que de traiter à plusieurs reprises tout le document.
Vérifiez les traits d’union, les listes et les tableaux avant de copier le résultat
Un mot coupé sur deux lignes peut contenir un trait d’union, mais un trait d’union peut aussi faire partie d’un mot composé. L’outil conserve les traits d’union au lieu de deviner. Si « infor- » termine une ligne et « mation » commence la suivante, les joindre avec un espace donne « infor- mation ». Corrigez ce cas manuellement après l’avoir comparé à la source.
Conservez des lignes distinctes pour les étapes numérotées, les adresses et les listes à puces. Réunir « 1. Préparez le fichier » et « 2. Vérifiez la taille » en une seule ligne nuit à la lisibilité. Traitez le texte courant séparément de la liste, ou utilisez Supprimer les lignes vides uniquement si la liste comporte des lignes vides indésirables entre les éléments.
Un tableau demande plus de précautions. Les tabulations et les espaces répétés peuvent séparer des colonnes ; les réduire peut détruire cette structure. Conservez le tableau d’origine, extrayez-le avec un outil adapté aux tableaux ou modifiez-le dans un tableur. Ces outils de texte collé ne modifient pas un classeur Excel et ne reconstruisent pas un tableau PDF.
Commencez par l’extraction si vous n’avez pas encore de texte exploitable
Si vous pouvez sélectionner le texte du PDF, copiez le passage concerné ou utilisez PDF en texte et vérifiez le contenu extrait. Lancez ensuite le suppresseur de retours à la ligne. L’extraction de texte et le nettoyage des paragraphes résolvent des problèmes différents : extraire donne des caractères, tandis que le nettoyage modifie les séparateurs déjà présents.
Si la page est un scan sans texte sélectionnable, elle doit passer par une reconnaissance optique de caractères avant que ce flux de travail puisse aider. Pour une capture d’écran ou une image, Image en texte peut produire un premier brouillon. Vérifiez attentivement les noms, les chiffres et la ponctuation, car un outil d’espacement ne peut pas corriger les erreurs de reconnaissance.
Si votre source est du HTML et non un PDF, utilisez Convertisseur HTML en texte d’abord. Il supprime le balisage et conserve la structure de base des paragraphes et des listes. Coller du HTML brut dans le suppresseur de retours à la ligne conserve les balises, car cet outil traite la saisie comme du texte.
Vérifiez le sens et enregistrez une copie propre
Comparez les phrases d’ouverture et de conclusion avec la source, puis examinez chaque titre, liste et nombre. Vérifiez que la jonction des lignes n’a pas fusionné des sections sans rapport. Pour les longs passages, comparez la version originale et la version nettoyée avec l’ Vérificateur de différences pour voir où les séparateurs ont changé.
Copiez le résultat ou téléchargez-le sous forme de fichier texte UTF-8. Utilisez un nom de fichier clair et gardez l’original à portée de main jusqu’à la fin de votre relecture. Les outils de sauts de ligne et d’espaces travaillent sur le texte collé dans votre navigateur, sans envoyer ce texte pour traitement. Ils ne conservent aucun historique de votre passage.
Pour une tâche distincte, Extracteur d’adresses e-mail peut extraire les adresses e-mail courantes de vos propres notes de texte et les placer une par ligne. Cela ne fait pas partie du nettoyage des paragraphes et ne vérifie pas l’existence d’une boîte de réception. Utilisez-le pour organiser des adresses déjà présentes dans une source que vous êtes autorisé à traiter.
Quand le nettoyage n’est pas la bonne étape suivante
Ne nettoyez pas automatiquement l’indentation du code source, des enregistrements à largeur fixe ou de la poésie. Les espaces peuvent avoir un sens. La même prudence s’applique à une citation dont la structure des lignes d’origine compte : conservez la mise en page source ou expliquez les modifications exigées par le format de destination.
Si le texte extrait contient des mots manquants, des en-têtes répétés sur chaque page ou un ordre de colonnes incorrect, corrigez d’abord l’extraction. Supprimer les sauts de ligne peut donner une apparence plus fluide à une extraction défectueuse, sans corriger les erreurs sous-jacentes. Un paragraphe lisible ne prouve pas qu’il correspond au PDF.
La méthode la plus sûre est simple : extraire un petit échantillon, repérer les vrais débuts de paragraphe, ne joindre que les sauts indésirables, nettoyer les espaces et comparer le résultat. Une fois l’échantillon satisfaisant, appliquez les mêmes réglages au reste et vérifiez les endroits où la mise en page change.
Sources
Questions fréquentes
Puis-je supprimer les sauts de ligne sans perdre les paragraphes ?
Oui, lorsque les paragraphes du texte collé sont séparés par des lignes vides. Lorsque vous joignez des paragraphes séparés par des lignes vides, les sauts simples sont conservés et ces limites aussi. Si la source n’utilise que des sauts simples, repérez d’abord les paragraphes voulus.
Cela corrige-t-il les mots coupés par des traits d’union ?
Non. Les traits d’union sont conservés, car ils peuvent faire partie de mots composés. Vérifiez manuellement les mots coupés en les comparant à l’original.
Cet outil modifie-t-il ou envoie-t-il mon PDF ?
Non. Supprimer les sauts de ligne traite le texte collé dans votre navigateur. Extrayez d’abord le texte du PDF si nécessaire.
Pourquoi le texte semble-t-il encore cassé après le nettoyage ?
La source peut contenir des colonnes entremêlées, des caractères manquants ou des erreurs d’OCR. Corrigez ces problèmes avant de joindre les lignes ; le nettoyage des espaces ne peut pas restaurer un contenu manquant ou dans le désordre.