Pourquoi l’hexadécimal est partout
L’hexadécimal (base 16) est la forme lisible habituelle des octets bruts. Chaque octet vaut deux chiffres hex (00–ff), si bien une courte chaîne reste compacte face au binaire tout en restant claire sur les frontières d’octet. Traces réseau, dumps mémoire, codes couleur, digests cryptographiques et signatures de fichiers parlent presque tous hex.
Encoder du texte en hex signifie : prendre les octets du texte sous un encodage de caractères (souvent UTF-8), puis imprimer chaque octet comme paire hex à deux chiffres. Décoder inverse ce mapping. Hex n’est pas du chiffrement ; c’est un alphabet transparent pour les octets. Quiconque a un décodeur récupère instantanément la séquence d’origine.
Encodez un échantillon avec texte vers hex, puis restaurez-le avec hex vers texte.
Sous-outils de cette famille
- Texte vers hex — encode chaque octet UTF-8 de votre texte en paires hex minuscules espacées, utile pour le débogage et les dumps filaires.
- Hex vers texte — accepte hex espacé ou continu et reconstruit du texte lisible lorsque les octets forment du texte valide selon les règles du décodeur.
Utilisez-les ensemble pour confirmer qu’un dump documenté correspond à une chaîne, ou pour remettre un fragment de capture collé en caractères lorsque la charge était du texte brut.
Espacement, casse et préfixes
Les implémentations diffèrent cosmétique :
- Casse.
4aet4Asont le même octet. Minuscules courantes dans les dumps ; majuscules dans beaucoup de RFC. - Espacement. Un espace tous les deux chiffres améliore la lecture (
48 65 6c 6c 6f). Hex continu (48656c6c6f) est également valide si la longueur est paire. - Préfixes. Les langages écrivent parfois
0x48ou\x48. Retirez les préfixes avant un décodeur hex pur sauf support documenté.
Les chaînes hex de longueur impaire sont invalides pour un décodage d’octets entiers : pas de demi-octet sans format nibble explicite.
Octets UTF-8 versus points de code Unicode
Distinction importante :
- Les dumps hex de texte sont en général des séquences d’octets UTF-8. Le signe euro
€fait trois octetse2 82 ac, pas une seule valeur d’unité de code. - Les points de code Unicode s’écrivent souvent
U+20AC. Ce n’est pas la même chaîne que le dump hex UTF-8.
La paire texte↔hex de Tool Plaza se concentre sur l’encodage d’octets du texte (UTF-8), comme dans les analyseurs de protocole et la sortie style xxd. Pour des listes de points de code, utilisez un flux Unicode.
Usages quotidiens
Déboguer les sérialiseurs. Quand JSON ou CSV paraît faux, hex révèle des caractères invisibles : c2 a0 (espace insécable UTF-8), ef bb bf (BOM UTF-8) ou des 00 nuls parasites.
Comparer digests et clés. Les digests SHA-256 et beaucoup de secrets d’API sont publiés en hex. Savoir comment le texte devient hex aide à repérer les décalages d’encodage (UTF-8 vs UTF-16, retours ligne tronqués).
Nombres magiques de fichiers. PNG commence par 89 50 4e 47 ; JPEG par ff d8 ff. Les vues hex rendent ces signatures évidentes même si l’extension ment.
Enseigner l’encodage. Les élèves peuvent convertir Hi → 48 69 et relier tables ASCII et octets sur le fil.
Hex versus Base64 versus binaire
| Représentation | Densité | Usage typique |
|---|---|---|
| Chiffres binaires | Plus basse | Enseignement des flags de bits |
| Hex | Moyenne | Dumps, digests, couleurs |
| Base64 | Plus haute | Embarquer des octets dans JSON/XML |
Mêmes octets, alphabets différents. Préférez hex quand des humains doivent lire les valeurs d’octet ; Base64 pour emballer dans des protocoles texte (voir le hub base64). Binaire quand les bits individuels comptent (binary). Codes ASCII décimaux (ascii) : troisième vue pédagogique pour 0–127.
Modes d’échec courants
- Décoder de l’hex qui représente en fait des octets compressés ou chiffrés et attendre de la prose lisible.
- Mélanger des hypothèses Latin-1 mono-octet avec du texte UTF-8 multi-octets.
- Copier de l’hex d’une UI qui insère
:(adresses MAC) ou-(certains GUID) sans normaliser. - Traiter hex comme moyen de cacher des mots de passe dans des configs—toujours du clair pour tout décodeur.
- Tronquer des digests « pour gagner de la place » en contexte sécurité.
Limites et environnement navigateur
Ces convertisseurs aident à inspecter et enseigner les encodages d’octets. Ils ne valident pas la structure sémantique d’un document et n’offrent pas de confidentialité. Pour le sensible, gardez le traitement local.
Résumé
L’hexadécimal est la lentille standard pour regarder les octets. Ce hub associe texte→hex et hex→texte pour produire des dumps et récupérer du texte quand les octets sont textuels. Attention aux caractères multi-octets UTF-8, gardez une longueur hex paire, normalisez les séparateurs, et choisissez hex, Base64 ou binaire selon clarté, densité ou visibilité des bits.