Convertisseur d'encodage de fichier texte
Convertit les encodages pris en charge avec des avertissements explicites de remplacement.
Comment utiliser Convertisseur d'encodage de fichier texte
The Text file encoding converter reads a text file in UTF-8, Windows-1252, ISO-8859-1, UTF-16LE, UTF-16BE, Shift_JIS or GB18030 and writes it out as UTF-8, UTF-16LE or UTF-16BE. Invalid byte sequences stop the conversion unless you explicitly allow replacement. UTF-16 output starts with a byte order mark, and the preview shows the first 100,000 characters.
- Choisissez un fichier source. Si l'outil accepte plusieurs fichiers, classez-les dans l'ordre souhaité.
- Ajustez les paramètres de base, puis ouvrez le mode avancé pour les options d'export et de réglage fin. Vos paramètres personnalisés restent actifs une fois le panneau fermé.
- Lancez le convertisseur d'encodage de fichier texte, vérifiez le résultat, puis utilisez les commandes de copie ou de téléchargement disponibles.
Ce que cet outil prend en charge
Convertit les encodages pris en charge avec des avertissements explicites de remplacement.
- Encodage source
- utf-8 · windows-1252 · iso-8859-1 · utf-16le · utf-16be · shift_jis · gb18030
- Encodage cible
- utf-8 · utf-16le · utf-16be
- Autoriser le remplacement des séquences sources non valides
- Set this value for your task.
Limites et traitement
Jusqu'à 200 fichiers, 20 MB chacun et 100 MB au total. Les PDF sont limités à 500 pages, les planches contact à 100 pages et les arbres de signets à 1 000 entrées et 20 niveaux d'imbrication. Chaque opération applique des limites de sortie plus strictes.
Questions fréquentes
How do I convert a Windows-1252 file to UTF-8?
Upload the file, set Source encoding to windows-1252 and Target encoding to utf-8, then download converted.txt. Accented characters and symbols such as the euro sign are mapped to their UTF-8 equivalents.
What does Allow replacement of invalid source sequences do?
By default, bytes that are not valid in the chosen source encoding cause an error, so nothing is silently changed. With replacement on, those bytes become the Unicode replacement character and the conversion continues. Try another source encoding before using it.
Does the UTF-16 output include a byte order mark?
Yes. UTF-16LE and UTF-16BE output start with a byte order mark written in the matching byte order. UTF-8 output is written without one.
Où ma saisie est-elle traitée ?
Cette opération traite sa source dans votre navigateur. Le copier et le téléchargement sont des actions explicites ; la saisie source n'est enregistrée dans aucun compte ni historique.
Quelles sont les limites de saisie ?
Jusqu'à 200 fichiers, 20 MB chacun et 100 MB au total. Les PDF sont limités à 500 pages, les planches contact à 100 pages et les arbres de signets à 1 000 entrées et 20 niveaux d'imbrication. Chaque opération applique des limites de sortie plus strictes.