Perché l’esadecimale compare ovunque
L’esadecimale (base 16) è la forma leggibile abituale dei byte grezzi. Ogni byte sono due cifre hex (00–ff), così una stringa corta resta compatta rispetto al binario restando chiara sui confini di byte. Trace di rete, dump di memoria, codici colore, digest crittografici e firme di file parlano quasi tutti hex.
Codificare testo come hex significa: prendere i byte del testo sotto una codifica di caratteri (di solito UTF-8), poi stampare ogni byte come coppia hex a due cifre. Decodificare inverte quella mappatura. Hex non è cifratura; è un alfabeto trasparente per i byte. Chi ha un decoder recupera subito la sequenza originale.
Codificate un campione con da testo a hex, poi ripristinatelo con da hex a testo.
Subtool di questa famiglia
- Da testo a hex — codifica ogni byte UTF-8 del testo come coppie hex minuscole separate da spazi, utile per debug e dump stile rete.
- Da hex a testo — accetta hex spaziati o continui e ricostruisce testo leggibile quando i byte formano testo valido secondo le regole del decoder.
Usateli insieme per confermare che un dump documentato corrisponda a una stringa, o per trasformare un frammento di cattura incollato di nuovo in caratteri quando il payload era testo in chiaro.
Spaziatura, maiuscole/minuscole e prefissi
Le implementazioni differiscono nel cosmetico:
- Maiuscole.
4ae4Asono lo stesso byte. Minuscole comuni nei dump; maiuscole in molte RFC. - Spaziatura. Spazi ogni due cifre migliorano la lettura (
48 65 6c 6c 6f). Hex continuo (48656c6c6f) è altrettanto valido se la lunghezza è pari. - Prefissi. I linguaggi a volte scrivono
0x48o\x48. Rimuovete i prefissi prima di un decoder hex puro salvo supporto documentato.
Stringhe hex di lunghezza dispari sono invalide per decodifica a byte interi: non esiste mezzo byte senza un formato esplicito orientato ai nibble.
Byte UTF-8 versus code point Unicode
Distinzione importante:
- I dump hex di testo sono di solito sequenze di byte UTF-8. Il segno euro
€sono tre bytee2 82 ac, non un singolo valore di unità di codice. - I code point Unicode spesso si scrivono
U+20AC. Non è la stessa stringa del dump hex UTF-8.
La coppia testo↔hex di Tool Plaza si concentra sulla codifica a byte del testo (UTF-8), come negli analizzatori di protocollo e nell’output stile xxd. Per elenchi di code point usate un flusso Unicode.
Usi quotidiani
Debug dei serializzatori. Quando JSON o CSV sembra sbagliato, hex rivela caratteri invisibili: c2 a0 (spazio non divisibile UTF-8), ef bb bf (BOM UTF-8) o 00 null sparsi.
Confrontare digest e chiavi. I digest SHA-256 e molti secret API si pubblicano in hex. Sapere come il testo diventa hex aiuta a individuare mismatch di encoding (UTF-8 vs UTF-16, newline tagliate).
Magic number dei file. PNG inizia con 89 50 4e 47; JPEG con ff d8 ff. Le viste hex rendono ovvie quelle firme anche se l’estensione mente.
Insegnare la codifica. Gli studenti possono convertire Hi → 48 69 e collegare tabelle ASCII ai byte sul filo.
Hex versus Base64 versus binario
| Rappresentazione | Densità | Uso tipico |
|---|---|---|
| Cifre binarie | Più bassa | Didattica dei flag di bit |
| Hex | Media | Dump, digest, colori |
| Base64 | Più alta | Incorporare byte in JSON/XML |
Stessi byte, alfabeti diversi. Preferite hex quando gli umani devono occhieggiare i valori di byte; Base64 quando impacchettate in protocolli testuali (vedi hub base64). Binario quando contano i bit singoli (binary). Codici ASCII decimali (ascii) sono una terza vista didattica per 0–127.
Modalità di fallimento comuni
- Decodificare hex che in realtà rappresenta byte compressi o cifrati e aspettarsi prosa leggibile.
- Mischiare assunti Latin-1 a singolo byte con testo UTF-8 multibyte.
- Copiare hex da una UI che inserisce
:(indirizzi MAC) o-(alcuni GUID) senza normalizzare. - Trattare hex come modo per nascondere password nei config—resta plaintext per qualsiasi decoder.
- Truncare i digest «per risparmiare spazio» in contesti di sicurezza.
Limiti e ambiente browser
Questi convertitori aiutano a ispezionare e insegnare le codifiche a byte. Non convalidano la struttura semantica del documento e non forniscono riservatezza. Per materiale sensibile, tenete l’elaborazione in locale.
Sintesi
L’esadecimale è la lente standard per guardare i byte. Questo hub accoppia testo→hex e hex→testo così potete produrre dump e recuperare testo quando i byte sono testuali. Fate attenzione ai caratteri multibyte UTF-8, tenete la lunghezza hex pari, normalizzate i separatori e scegliete hex, Base64 o binario a seconda che servano chiarezza, densità o visibilità dei bit.