Retirez caractères spéciaux, emoji, symboles, chiffres, accents et déchets invisibles dans un seul outil privé du navigateur — sans abîmer les écritures non latines.
Préréglages
Spéciaux et symboles
Lettres et chiffres
Invisibles et de contrôle
Guillemets et Unicode
Vos propres règles
L'ordre de traitement est fixe : normaliser → invisibles → contrôle → guillemets → accents → emoji → classes de caractères → règles personnalisées → ASCII → nettoyage.
Pourquoi cet outil est différent
Suppression des accents qui comprend les écritures — le hindi, l'arabe, l'hébreu et le thaï conservent leurs marques au lieu d'être abîmés
Les emoji sont retirés en groupes complets, ainsi les familles, drapeaux et tons de peau ne laissent aucun résidu invisible
Les symboles et la ponctuation sont des interrupteurs séparés plutôt qu'un vague ensemble de « caractères spéciaux »
Conservez ou retirez vos propres caractères, pour qu'un tiret ou un underscore puisse survivre à un nettoyage
Les quatre formes de normalisation Unicode expliquées simplement
Traitement privé dans le navigateur en 16 langues
Comment retirer les caractères spéciaux
Retirer les caractères spéciaux supprime la ponctuation et les symboles ensemble, en conservant lettres, chiffres et espaces. Si vous ne voulez qu'un seul des deux, utilisez plutôt les interrupteurs séparés Retirer la ponctuation et Retirer les symboles.
Retirer les caractères non alphanumériques
Retirer les non-alphanumériques ne conserve que les lettres et les chiffres de n'importe quelle langue. Désactivez Conserver les espaces pour tout regrouper en une seule chaîne continue, pratique pour les identifiants et codes.
Retirer les chiffres du texte
Retirer les chiffres supprime les chiffres dans toutes les écritures, y compris les chiffres arabo-indiens et devanagari, pas seulement de 0 à 9.
Retirer les lettres du texte
Retirer les lettres supprime les lettres de toutes les écritures, en laissant chiffres, ponctuation et espaces. Combinez-le avec Retirer la ponctuation pour extraire des chiffres propres d'un texte désordonné.
Retirer les emoji du texte
Retirer les emoji supprime chaque emoji comme une unité complète. Un emoji de famille, un drapeau de pays ou une main qui salue avec un ton de peau est un seul groupe, donc rien d'invisible ne reste pour abîmer votre texte plus tard.
Retirer les symboles du texte
Retirer les symboles cible les caractères mathématiques, monétaires et de signe, comme plus, égal, dollar et euro. La ponctuation comme les virgules et les points reste, sauf si vous retirez aussi la ponctuation.
Retirer les accents du texte
Retirer les accents transforme café en cafe et Ελλάδα en Ελλαδα. Le devanagari, l'arabe, l'hébreu, le thaï et le cyrillique sont délibérément ignorés, car dans ces écritures les marques font partie de la lettre plutôt que d'être une décoration.
Convertir les guillemets typographiques
Guillemets typographiques → droits remplace les guillemets courbes et les apostrophes par des versions simples, ce qu'attendent le code, les fichiers CSV et les anciens systèmes. Guillemets droits → typographiques fait l'inverse pour la publication. Tirets et points de suspension → ASCII aplatit aussi les tirets courts, les tirets longs et les points de suspension à caractère unique.
Retirer les caractères invisibles
Le mode sûr retire les espaces de largeur nulle et les marques d'ordre des octets. Le mode agressif retire aussi les joints, dont certains textes arabes et indiens ont besoin, donc n'y recourez que si vous savez que votre texte n'en a pas besoin. Retirer les marques de direction supprime les remplacements bidirectionnels et les traits d'union conditionnels.
Normaliser le texte Unicode
NFC combine lettres et marques en caractères uniques et constitue le choix le plus sûr pour le stockage et la recherche. NFD les sépare. NFKC et NFKD vont plus loin et fusionnent les caractères similaires, de sorte que les polices fantaisie, ligatures et chiffres encerclés deviennent du texte simple.
Retirer les caractères de contrôle
Retirer les caractères de contrôle supprime les octets nuls et autres codes de contrôle invisibles qui cassent les bases de données et les exports. Conserver tabulations et sauts de ligne est activé par défaut afin que votre mise en page survive.
Certains problèmes texte ne concernent pas combien d'espaces vous avez — ils concernent quels caractères ont survécu au collage. Microsoft Word insère guillemets courbes cassant JSON. Outils design exportent tirets cadratin et caractères ellipsis que éditeurs texte brut gèrent mal. Emoji s'affichent en carrés sur systèmes legacy. Sortie OCR disperse signes section et tirets conditionnels dans phrases autrement lisibles. Zero-width joiners de collage RTL cassent index recherche silencieusement.
Le Text Character Cleaner WriteWithin cible classes caractères, normalisation Unicode et règles garder/retirer custom — tout dans navigateur, sans upload. Utilisez quand Whitespace Cleaner a déjà corrigé espacement mais symboles, emoji ou codes contrôle invisibles causent encore problèmes.
Ce que cet outil retire et garde
Special, non-alphanumérique, chiffres et lettres
Remove special characters efface ponctuation et symboles ensemble tout en gardant lettres, chiffres et espaces. Pour contrôle plus fin, basculez Remove punctuation et Remove symbols séparément — virgules et points sont ponctuation ; plus, égal et signes monétaires sont symboles.
Remove non-alphanumeric (keep letters and numbers only) retire tout le reste de tout script. Désactivez Keep spaces pour condenser résultat en une chaîne sans rupture — pratique pour IDs, slugs et clés correspondance. Remove numbers supprime chiffres dans tout système numéral, pas seulement 0–9. Remove letters retire lettres de tout script, laissant chiffres et ponctuation si ces options restent off.
Clusters emoji et symboles
Remove emojis supprime chaque emoji comme unité complète. Emoji famille, drapeaux pays et modificateurs teint peau incluent zero-width joiners en interne ; nettoyeur retire cluster entier pour qu'aucun invisible ne casse texte plus tard. Remove symbols cible caractères math, monétaire et signes comme plus, égal, dollar et euro tout en laissant ponctuation sauf si vous la retirez aussi.
Accents et comportement sensible script
Remove accents transforme café en cafe et Ελλάδα en Ελλαδα via décomposition comprenant quels scripts traitent marques comme décoration. Ignore volontairement Devanagari, arabe, hébreu, thaï et cyrillique, où marques font partie lettre — retrait aveugle corromprait sens. Cette approche sensible script est ce que outils génériques « remove diacritics » se trompent souvent.
Guillemets typographiques, tirets et ponctuation typographique
Smart quotes to straight remplace guillemets courbes et apostrophes par ASCII plain — ce que code, CSV et bases anciennes attendent. Straight quotes to smart fait inverse pour publication. Straighten dashes convertit tirets en, em et ellipsis un caractère en trait d'union ASCII et trois points.
Caractères invisibles et contrôle
Mode invisible safe retire zero-width spaces et byte-order marks. Mode agressif retire aussi joiners dont texte arabe et indien peut avoir besoin — utilisez seulement quand vous savez contenu non affecté. Remove direction marks efface overrides bidirectionnels et contrôles liés brouillant collage RTL/LTR mixte. Remove control characters supprime null bytes et autres codes invisibles cassant bases ; Keep tabs and line breaks reste on par défaut pour que layout survive.
Normalisation Unicode : NFC, NFD, NFKC, NFKD
NFC compose lettres et marques combinantes en caractères uniques — défaut le plus sûr stockage et recherche. NFD les sépare. NFKC et NFKD vont plus loin, pliant caractères compatibilité pour que polices fancy, ligatures et chiffres cerclés deviennent texte plain. Choisissez NFKC en important contenu user-generated dans systèmes ASCII stricts ; choisissez NFC pour stockage multilingue général sur WriteWithin.
Garder et retirer caractères custom
Keep characters liste symboles devant survivre nettoyage agressif — tirets, underscores, points pour noms fichiers. Remove characters liste points code ou littéraux exacts à retirer indépendamment autres bascules. Combinez Keep alnum only avec Keep characters -_. pour sortie filename-safe sans deviner classe symbole de chaque marque.
Le Whitespace Cleaner condense espaces répétés, remplace NBSP, convertit tabulations, corrige sauts ligne PDF et retire optionnellement lignes vides. Il ne retire pas emoji, classes ponctuation ni guillemets typographiques. Quand collage Word montre espacement « correct » mais échoue parseur JSON, problème est généralement guillemets courbes ou tirets cadratin — niveau caractère, pas espace.
Character Cleaner inclut Tidy spaces pour collapse léger après retrait symboles, mais pour travail espacement lourd — jointures PDF, normalisation NBSP, aperçu show-invisible — utilisez Whitespace Cleaner d'abord. Chaîne typique : Whitespace Cleaner → Character Cleaner → Line Tools pour dédoublonnage liste.
Ajoutez Keep characters -_. si underscores ou points doivent rester.
Activez ASCII only quand système fichiers destination l'exige.
Activez Tidy spaces pour condenser écarts laissés après retrait symboles.
Copiez et renommez fichiers ou créez champs slug dans CMS.
Erreurs courantes à éviter
Retirer accents sur texte arabe ou hindi — outil ignore scripts significatifs, mais mode invisible agressif peut encore nuire joiners ; préférez invisible safe sur collage multilingue.
Utiliser Remove special quand vous voulez seulement emoji — basculez Remove emojis seul pour garder ponctuation.
Attendre réparation ligne PDF ici — sauts ligne durs sont travail Whitespace Cleaner.
NFKC sur texte affichage que vous voulez joli — NFKC plie variantes stylistiques ; utilisez NFC pour copie orientée humain.
Oublier Keep tabs and line breaks — le désactiver aplatit logs structurés ; désactivez seulement quand vous avez vraiment besoin une ligne.
Bénéfices nettoyage caractères sensible script
Emoji retirés comme clusters entiers — pas restes joiner invisibles
Retrait accents respecte scripts où marques portent sens
Interrupteurs séparés symboles, ponctuation, chiffres et lettres
Quatre formes normalisation Unicode avec préréglages langage plain
Traitement privé navigateur pour brouillons sensibles et données clients
Cas d'usage réels
Payloads JSON et API : guillemets droits, pas caractères contrôle, normalisation NFC. Nettoyage SKU e-commerce : lettres et chiffres seulement, symboles off. Préparation posts sociaux pour SMS : emoji off, accents optionnels. Collage OCR et PDF : combinez Whitespace Cleaner, puis retirez signes section et symboles bizarres ici. Lots noms fichiers : préréglage ASCII safe avec keep characters custom pour points et tirets dans numéros version.
Questions courantes
Retirer accents cassera-t-il hindi, arabe ou thaï ? Non. Retrait accents cible marques décoration latin et grec. Marques Devanagari, arabe, hébreu, thaï et cyrillique restent intactes.
Différence entre symboles et special characters ? Symboles sont math, monétaire et signes comme + = $ €. Ponctuation est , . ! ? et guillemets. Remove special efface les deux ; vous pouvez aussi basculer chaque classe.
Retrait emoji laisse-t-il restes cassés ? Non. Clusters incluant teintes peau, drapeaux et familles retirent comme une unité.
Quelle forme Unicode utiliser ? NFC stockage général ; NFKC pliant lookalikes et caractères compatibilité pour systèmes stricts.
Retirer les accents va-t-il abîmer le texte hindi, arabe ou thaï ?
Non. La suppression des accents ne cible que le latin et le grec, où les marques sont décoratives. En devanagari, arabe, hébreu, thaï et cyrillique, les marques font partie de la lettre, donc elles restent intactes.
Quelle est la différence entre symboles et caractères spéciaux ?
Les symboles sont des caractères mathématiques, monétaires et de signe comme + = $ €. La ponctuation est constituée de marques comme , . ! ? et les guillemets. Retirer les caractères spéciaux supprime les deux à la fois, et vous pouvez aussi activer chacun séparément.
La suppression des emoji laisse-t-elle des résidus cassés ?
Non. Les emoji combinés, comme les familles, drapeaux et tons de peau, sont retirés en une seule unité, donc aucun joint de largeur nulle ni sélecteur de variation ne reste.
Quelle forme de normalisation Unicode dois-je utiliser ?
NFC est le choix sûr par défaut pour stocker et comparer du texte. NFD sépare les lettres de leurs marques. NFKC et NFKD fusionnent aussi les caractères similaires, transformant polices fantaisie, ligatures et chiffres encerclés en caractères simples.
Mon texte est-il envoyé ?
Non. Le nettoyage de caractères s'exécute entièrement dans votre navigateur. Le texte ne quitte jamais votre appareil.