Pulizia Base64
Strumento gratuito di pulizia Base64 online che rimuove contenuti non validi come a capo, spazi bianchi e caratteri invisibili dalle stringhe Base64. Supporta tre opzioni indipendenti: rimuovi spazi bianchi, rimuovi caratteri speciali e riempi automaticamente il padding, generando Base64 rigorosamente conforme a RFC 4648.
Raccomandazioni correlate
Cos'è la pulizia di Base64?
La pulizia di Base64 è l'operazione di rimozione di tutti i caratteri non validi e ridondanti da una stringa Base64. L'obiettivo è generare Base64 puro rigorosamente conforme allo standard RFC 4648, facilitando la trasmissione, l'archiviazione e la decodifica tra sistemi diversi.
Perché pulire: il Base64 da fonti diverse contiene spesso caratteri non validi mescolati. ① A capo (\n, \r\n) — allegati email, campi di database, output di log; ② Spazi e tabulazioni — incolla manuale, copia da Excel; ③ UTF-8 BOM (EF BB BF) — file di testo salvati da Windows; ④ Simboli a larghezza intera, punteggiatura cinese — errori di copia e incolla. Tutto ciò provoca errori nel decodificatore.
Tre opzioni di pulizia: ① Rimuovi spazi bianchi (\s \n \r \t) — elabora a capo e spazi; ② Rimuovi caratteri speciali — conserva solo l'alfabeto Base64 A-Z a-z 0-9 + / = - _; ③ Riempi automaticamente il padding — rende la lunghezza del risultato un multiplo di 4. Le tre opzioni possono essere selezionate indipendentemente e combinate secondo necessità.
Usi tipici: ① Debug API — pulisci quando il Base64 restituito da interfacce di terze parti dà errore all'incolla; ② Importazione nel database — rimuovi spazi superflui durante la copia da Excel; ③ Pre-elaborazione prima della decodifica — evita che atob() lanci InvalidCharacterError; ④ Normalizzazione JWT / Data URL — gestisci differenze di trasmissione tra sistemi.
Casi d'uso
- Pre-elaborazione prima della decodifica: pulisci Base64 con a capo o spazi da interfacce di terze parti, JWT e log per renderlo direttamente decodificabile, evitando InvalidCharacterError.
- Riparazione incolla da Excel / email: rimuovi spazi superflui, tabulazioni e a capo mescolati durante la copia di Base64 da celle Excel o corpi email.
- Pulizia token JWT: normalizza su una sola riga la stringa a tre segmenti JWT (header.payload.signature) con a capo, rimuovendo spazi bianchi superflui.
- Elaborazione allegati MIME: pulisci il formato di a capo automatico ogni 76 caratteri nel Base64 degli allegati email, facilitando la decodifica successiva.
- Compatibilità URL Safe: conserva i caratteri - e _ in modo che il Base64 in JWT, percorsi URL e nomi file non venga cancellato per errore.
- Pre-elaborazione prima della pulizia batch: usalo insieme a base64-format / base64-padding, pulisci prima di formattare o completare.
Come utilizzare
- Incolla o inserisci la stringa Base64 con rumore (può contenere caratteri non validi come a capo, spazi, ecc.).
- Seleziona le opzioni di pulizia secondo necessità: rimuovi spazi bianchi, rimuovi caratteri speciali, riempi automaticamente il padding (le tre sono attive per impostazione predefinita).
- Visualizza l'output nel pannello destro: mostra in tempo reale il Base64 pulito, conteggio caratteri, caratteri rimossi e legalità della decodifica.
- Copia il risultato negli appunti o scaricalo come file .txt per l'elaborazione successiva.
Funzionalità
- Opzione rimuovi spazi bianchi: rimuove automaticamente \n, \r, \t e spazi, per scenari come allegati email e incolla da Excel.
- Opzione rimuovi caratteri speciali: conserva solo i 66 caratteri Base64 legali A-Z a-z 0-9 + / = - _.
- Riempimento automatico del padding: selezionabile per rendere la lunghezza del risultato un multiplo di 4, riparando errori di lunghezza.
- Tre opzioni indipendenti e combinabili: seleziona secondo necessità, rispondendo in modo flessibile a diverse situazioni di contaminazione.
- Conservazione caratteri URL Safe: non cancella - e _ per errore, evitando la perdita di caratteri in scenari JWT / URL.
- Verifica output in tempo reale: usa atob() del browser per rilevare se l'output è decodificabile, mostrando lo stato in tempo reale.
- Conteggio caratteri e avviso di rimozione: mostra in tempo reale caratteri di input/output, caratteri rimossi e stato di decodificabilità.
- Elaborazione locale nel browser: tutte le operazioni di pulizia vengono eseguite in locale, il Base64 originale non viene caricato su nessun server.
Best Practices
Pulisci prima, poi usa lo strumento di padding per riempire
La pulizia rimuove solo caratteri non validi e opzionalmente riempie il padding. Se il Base64 ha contemporaneamente a capo e mancanza di padding, si consiglia di selezionare prima tutte e tre le opzioni di pulizia, poi osservare se la lunghezza dell'output continua a non essere un multiplo di 4. Se persistono anomalie di padding, usa lo strumento di padding dedicato.
Elabora separatamente i tre segmenti del token JWT
JWT è un insieme di tre segmenti Base64URL (header.payload.signature) connessi da punti. Durante la pulizia, i tre segmenti devono rimuovere gli spazi bianchi, ma non inserire caratteri aggiuntivi tra i segmenti, altrimenti la verifica della firma fallirà. Si consiglia di separare per punti prima dell'incolla, pulire ogni segmento e poi concatenare.
Per input URL Safe non selezionare «rimuovi caratteri speciali»
Base64 URL Safe usa - e _ al posto di + e /. Questo strumento conserva per impostazione predefinita questi 4 caratteri, ma se configuri manualmente una whitelist di caratteri più rigorosa (consenti solo +/), l'input URL Safe verrà danneggiato. Se non sei sicuro dell'insieme di caratteri, disattiva «rimuovi caratteri speciali» e mantieni solo «rimuovi spazi bianchi».
Se continua a dare errore dopo la pulizia → verifica codifica e BOM
Se atob() continua a lanciare InvalidCharacterError dopo la pulizia, potrebbe essere per BOM UTF-8 (EF BB BF) o resti di ordine di byte UTF-16. L'opzione «rimuovi spazi bianchi» di questo strumento non si rivolge al BOM; si consiglia di decodificare nuovamente come UTF-8 con TextDecoder nella console del browser e poi pulire di nuovo.
Identificazione dell'origine del BOM: file txt salvati da Windows
Se il Base64 è stato ottenuto salvando come UTF-8 dal Blocco note di Windows, i primi 3 byte (EF BB BF) sono il BOM. Anche dopo aver pulito spazi e a capo, atob può continuare a non riconoscere. Soluzione: salva nuovamente come UTF-8 senza BOM con VS Code o PowerShell.
Mostra confronti prima e dopo la pulizia durante l'insegnamento e le dimostrazioni nella documentazione
La pulizia di Base64 è un problema comune nell'insegnamento. Si consiglia di allegare sia il Base64 prima che dopo la pulizia quando si scrive la documentazione, insieme a confronti del conteggio dei caratteri e dello stato di decodificabilità, per far comprendere intuitivamente ai lettori la funzione di ciascuna opzione.
Domande frequenti
La pulizia di Base64 modifica i byte originali?
No. La pulizia rimuove solo caratteri non validi (spazi bianchi, a capo, caratteri non Base64) e non modifica i caratteri validi intermedi. Se si rimuovono solo spazi bianchi e caratteri illegali, il contenuto dei byte prima e dopo la pulizia è completamente identico. Se si seleziona «riempi automaticamente il padding», vengono aggiunti solo = alla fine, senza influire sui byte originali.
Qual è la differenza tra le tre opzioni di pulizia?
Rimuovi spazi bianchi: rimuove \s \n \r \t (spazi, a capo, ritorni a capo, tabulazioni). Rimuovi caratteri speciali: conserva solo i 66 caratteri Base64 legali A-Z a-z 0-9 + / = - _. Riempi automaticamente il padding: aggiunge = alla fine per rendere la lunghezza un multiplo di 4. Le tre opzioni sono indipendenti e combinabili.
Perché atob() lancia InvalidCharacterError?
Cause comuni: ① Contiene caratteri cinesi, emoticon Unicode o altri caratteri non ASCII; ② Contiene a capo o spazi (caso comune nella copia da Excel, incolla da email); ③ Mescolanza di caratteri Base64URL (- / _); ④ La lunghezza non è un multiplo di 4. La pulizia di questo strumento risolve i primi 3 problemi; lo strumento di riempimento del padding risolve il quarto.
La pulizia rimuove il padding?
No. Il carattere = è un carattere Base64 legale e l'opzione «rimuovi caratteri speciali» di questo strumento conserva esplicitamente =. Se desideri rimuovere il padding, usa lo strumento di padding dedicato (base64-padding) passando alla modalità «rimuovi riempimento».
Come pulire se contiene a capo?
Selezionando «rimuovi spazi bianchi» per impostazione predefinita è sufficiente. Gli a capo (\n / \r\n), le tabulazioni e gli spazi verranno rimossi. Se hai bisogno di conservare gli a capo (formato allegati email MIME), disattiva l'opzione «rimuovi spazi bianchi».
Questo strumento può gestire UTF-8 BOM?
Il BOM (EF BB BF) è il carattere Unicode U+FEFF. L'opzione «rimuovi spazi bianchi» di questo strumento usa l'espressione regolare \s \n \r \t che non include U+FEFF, quindi il BOM può rimanere. Se incontri InvalidCharacterError causato da BOM, si consiglia di rimuovere prima il BOM con TextDecoder nel codice o nella console del browser.
I caratteri URL Safe e Base64 standard vengono convertiti tra loro?
No. L'opzione «rimuovi caratteri speciali» di questo strumento conserva i quattro caratteri + / - _, esegue solo rimozione del rumore senza conversione attiva. Se hai bisogno della conversione reciproca tra URL Safe e caratteri standard, usa lo strumento Base64URL dedicato (base64-url-safe).
Il mio contenuto viene caricato su qualche server?
No. Tutta la logica di pulizia viene eseguita localmente nel browser; la stringa Base64 originale non lascia il tuo dispositivo. Puoi usarla con tranquillità per elaborare dati sensibili (credenziali, chiavi, token).
Si possono pulire più segmenti di Base64 contemporaneamente?
Questo strumento ha un'interfaccia di pulizia per segmento singolo. Se hai bisogno di pulire più segmenti di Base64, si consiglia di chiamare ciclicamente la logica di questo strumento o usare lo strumento da riga di comando corrispondente (come il comando base64). Per codifica/decodifica batch, usa base64-batch-encode / base64-batch-decode.
Risoluzione dei problemi
atob continua a dare errore dopo la pulizia
Può essere un problema di lunghezza (non è multiplo di 4) o resti di BOM / codifica. Prima conferma che è selezionato «riempi automaticamente il padding»; se continua a dare errore, prova a decodificare nuovamente come UTF-8 con TextDecoder nella console del browser, rimuovi il BOM e pulisci di nuovo.
La lunghezza è cambiata dopo la pulizia, ma la decodifica continua a fallire
Può darsi che il contenuto originale non sia Base64 standard, ad esempio Base32 / Base58 / Base85. Conferma il formato di codifica dei dati originali e passa allo strumento corrispondente. Puoi anche provare a testare se la stringa originale può essere ricodificata con btoa prima di atob.
Rimangono pochissimi caratteri dopo la pulizia
È molto probabile che l'opzione «rimuovi caratteri speciali» sia troppo rigorosa e rimuova anche + / - _. Verifica se hai disattivato per errore la whitelist di caratteri; questo strumento conserva per impostazione predefinita i 66 caratteri Base64 legali. Se l'input è URL Safe, disattiva «rimuovi caratteri speciali».
Nessun output dopo l'incolla
Può darsi che l'input siano solo spazi bianchi (contiene solo spazi / a capo / tabulazioni); l'opzione «rimuovi spazi bianchi» di questo strumento rimuoverà tutto lasciando una stringa vuota. Verifica che l'input originale contenga almeno un carattere Base64 (A-Z a-z 0-9 + / =).
Glossario
- UTF-8 BOM
- Byte Order Mark. Prefisso di 3 byte (0xEF 0xBB 0xBF) che Windows aggiunge quando salva testo UTF-8, che fa sì che il decodificatore Base64 tratti il primo carattere come un byte illegale.
- URL Safe Base64
- Variante Base64 sicura per URL definita in RFC 4648 §5, che sostituisce + e / con - e _. L'opzione «rimuovi caratteri speciali» di questo strumento conserva questi 4 caratteri per evitare cancellazioni accidentali.
- A capo
- \r\n (Windows) e \n (Unix / macOS). Il Base64 MIME degli allegati email ha di solito un a capo ogni 76 caratteri, che deve essere rimosso durante la pulizia.
- Caratteri Base64 validi
- L'insieme di caratteri Base64 standard è A-Z, a-z, 0-9, +, /, = (padding), più - e _ della variante URL Safe, per un totale di 66 caratteri legali.
- InvalidCharacterError
- Errore di decodifica lanciato da atob() del browser. Si verifica quando una stringa Base64 contiene caratteri al di fuori della tabella dei caratteri validi (cinese, spazi bianchi, simboli speciali, ecc.).
Insieme di caratteri Base64 e regole di conservazione
Tabella dei caratteri legali che conserva l'opzione «rimuovi caratteri speciali» di questo strumento.
| Tipo di carattere | Caratteri | Regola di conservazione |
|---|---|---|
Lettere | A-Z, a-z | 52 caratteri, conservazione obbligatoria |
Numeri | 0-9 | 10 caratteri, conservazione obbligatoria |
Simboli Base64 standard | + / | 2 caratteri, conservazione obbligatoria |
Simboli URL Safe | - _ | 2 caratteri, conservazione obbligatoria in scenari URLSafe |
Padding | = | Riempimento finale, conservazione obbligatoria |
Spazi bianchi | spazi, \n, \r, \t | Rimuovi secondo opzione «rimuovi spazi bianchi» |
Altri | Caratteri cinesi / emoticon / BOM, ecc. | Rimuovi secondo opzione «rimuovi caratteri speciali» |
5 fonti comuni di contaminazione Base64
Comprendi come vengono mescolati contenuti non validi nelle stringhe Base64.
| Fonte di contaminazione | Contenuto mescolato | Opzione consigliata |
|---|---|---|
Allegati email | \r\n ogni 76 caratteri | Rimuovi spazi bianchi |
Incolla da Excel / database | Spazi prima/dopo / tabulazione | Rimuovi spazi bianchi |
File txt di Windows | UTF-8 BOM (EF BB BF) | Rimuovi caratteri speciali + rimuovi BOM manualmente |
URL / nomi file | Conflitto di caratteri + / | Conserva URLSafe (usa conversione base64-url-safe) |
Output di log / trace | Prefissi / suffissi di debug | Rimuovi caratteri speciali |
Confronto delle 3 opzioni di pulizia
Le tre opzioni sono indipendenti e combinabili, usale secondo necessità.
| Opzione | Comportamento | Scenario tipico |
|---|---|---|
Rimuovi spazi bianchi | Rimuove \s \n \r \t | Email / Excel / log |
Rimuovi caratteri speciali | Conserva solo l'alfabeto Base64 | Mescolanza di caratteri cinesi / emoticon / BOM |
Riempi automaticamente il padding | Aggiunge = alla fine fino a multiplo di 4 | Lunghezza non multipla di 4 |
Authoritative References
- Confronto sicuro testo
- Conversione binario
- Cifrario di Cesare
- Codice Morse
- Conversione Hex
- Video in Base64
- Da Base64 a Video
- Immagine in Base64
- Da Base64 a Immagine
- Testo in Base64
- Da Base64 a Testo
- Verificatore hash di file
- File in Base64
- Base64 in File
- Audio in Base64
- Base64 in Audio
- Crittografia e decrittografia AES
- Crittografia e decrittografia DES
- Encoder Decoder Base32
- Codifica e decodifica Base58
- Codifica Base64
- Decodifica Base64
- Confronta Base64
- Dividi Base64
- Unisci Base64 multi-linea
- Formattazione Base64
- Verifica Formato Base64
- Codifica Base64 in batch
- Decodifica Base64 Batch
- Pulizia Base64
- Gestione Padding Base64
- Statistiche Lunghezza Base64
- Da Base64 a Hex
- Convertitore Base64 DataURL
- Convertitore Base64-Hex
- Codifica Base85
- Generatore e verificatore HMAC
- Derivazione chiave PBKDF2
- Hash MD5
- Hash SHA-256
- Hash SHA1
- Hash SHA512
- Decodificatore, Verificatore e Generatore JWT
- Codifica e decodifica entità HTML
- Unicode Escape
- Codifica URL
- Base64 URL Safe
- MIME Base64
- Offuscamento Java
- Offuscamento JS
- Offuscamento PHP
- Offuscamento Python