Convertissez du texte en binaire, hexadécimal, octal ou décimal et décodez-le en retour. Conscient de l'UTF-8, avec séparateurs configurables et remplissage zéro. S'exécute entièrement dans votre navigateur.
Convertissez du texte en binaire, hex, octal ou décimal — et inversement. Les deux panneaux sont éditables, donc vous pouvez encoder du texte ou coller une chaîne encodée pour la décoder. L'encodage est basé sur les octets UTF-8, ce qui signifie que les lettres accentuées, les caractères CJK et les emoji survivent à l'aller-retour.
Comment le texte devient des octets
Les caractères ne sont pas des octets
Un caractère est une idée abstraite ; un octet est huit bits de stockage. Transformer l'un en l'autre requiert un encodage. Cet outil utilise UTF-8, l'encodage derrière plus de 98 % du web. En UTF-8, la plage ASCII A-Z, a-z, 0-9 et la ponctuation courante prend exactement un octet, donc A est 01000001. Le latin accentué et le grec prennent deux octets, la plupart des caractères CJK en prennent trois, et les emoji en prennent quatre.
Pourquoi cela compte pour les allers-retours
Les anciens outils texte-vers-binaire appellent charCodeAt et tronquent à 8 bits. Cela fonctionne pour l'ASCII pur et corrompt silencieusement tout le reste, donc é revient comme un caractère différent ou comme un glyphe de remplacement. Comme ce convertisseur encode de vrais octets UTF-8, une chaîne contenant des caractères chinois et un emoji se décode exactement comme ce avec quoi vous avez commencé.
Choisir une base
Binaire montre le motif de bits brut, ce que vous voulez quand vous expliquez comment fonctionne l'encodage ou déboguez un protocole au niveau bit.
Hexadécimal est le défaut pratique. Deux chiffres hex par octet rend les frontières d'octet évidentes, c'est pourquoi chaque éditeur hex et dump réseau l'utilise.
Octal regroupe trois bits à la fois et apparaît surtout dans les permissions Unix et certaines séquences d'échappement C.
Décimal se lit le plus facilement à voix haute mais cache entièrement la structure des bits.
Séparateurs et remplissage
Le remplissage zéro donne à chaque octet la même largeur — huit caractères en binaire, deux en hex — donc la sortie peut être découpée de façon fiable même sans séparateur entre les valeurs. Si vous désactivez le remplissage, conservez un séparateur, sinon 1 et 10 se collent et le résultat ne peut pas être décodé sans ambiguïté. Au décodage, tout mélange d'espaces, virgules et sauts de ligne est accepté.
FAQ
Pourquoi mon caractère chinois forme-t-il trois groupes de huit bits ?
UTF-8 encode la plupart des caractères CJK en trois octets, et chaque octet devient un groupe de huit bits. C'est un comportement correct, pas une erreur.
Puis-je décoder un binaire sans séparateurs ?
Oui, tant qu'il a été rempli avec des zéros. Le décodeur revient au découpage à largeur fixe — huit caractères par octet en binaire, deux en hex — quand il ne trouve pas de séparateur.
Utilise-t-il ASCII ou UTF-8 ?
UTF-8. Pour la plage ASCII pure les deux sont identiques, donc un texte anglais ressemble au même de toute façon, mais UTF-8 gère aussi correctement tous les autres caractères.
Pourquoi obtient-il une erreur en décodant mon entrée ?
Chaque groupe doit être analysé en une valeur entre 0 et 255 dans la base sélectionnée. Une valeur de 256, une lettre parasite en mode binaire, ou la mauvaise base sélectionnée déclencheront tous l'erreur.
Est-ce la même chose que Base64 ?
Non. Base64 compacte trois octets en quatre caractères imprimables pour garder les données compactes. Cet outil rend chaque octet séparément dans une base numérique choisie, ce qui est beaucoup plus verbeux mais lisible par un humain.
Mon texte est-il envoyé quelque part ?
Non. L'encodage et le décodage utilisent tous deux les TextEncoder et TextDecoder intégrés au navigateur, entièrement sur votre machine.