Command Palette

Search for a command to run...

Visualizzatore CSV: Apri, cerca e ordina i file CSV senza un foglio di calcolo

Visualizzatore CSV: Apri, cerca e ordina i file CSV senza un foglio di calcolo

T
Toolz Team
|Jul 19, 2026|19 min letto

Parte della raccolta Strumenti per i dati

L'ultimo CSV che mi è costato un pomeriggio è stato un'esportazione di 40 MB da un negozio WooCommerce del cliente. Ho fatto doppio clic su di esso, Excel ha deciso che la colonna SKU era una data e 2024-11-3 era improvvisamente quello che era una volta 2024-11-3- tranne che era' t, era un codice prodotto Excel lo aveva riscritto utilmente Quando abbiamo notato, il file & quot; cleaned" era già stato reimportato e alcune centinaia di prodotti avevano SKU che non puntavano a nulla.

Questo è il problema con l'apertura di un CSV in un'applicazione per fogli di calcolo. Un foglio di calcolo non è uno spettatore, è un editore con opinioni. Coercisce i tipi, elimina gli zeri iniziali dai codici postali e i numeri di telefono, reinterpreta tutto ciò che assomiglia vagamente a una data e fa tutto questo prima di aver guardato una singola riga. A volte vuoi solo visitare il file - controllare i nomi delle colonne, confermare il conteggio delle righe, trovare il record che ha rotto l'importazione, e uscire.

io costruisco Toolz.dev e leggo altre persone's CSV esporta costantemente - Ripagamenti a strisce, dump di database, estratti di analisi, file di migrazione dei plugin Così ho costruito il Visualizzatore CSV Per essere l'opzione noiosa e onesta: analizza il file, ti mostra esattamente cosa c'è dentro e non cambia nulla. Nessuna coercizione di tipo, nessuna correzione automatica, nessun caricamento. Incolla il testo o rilascia il file e il rendering come una tabella che puoi cercare e ordinare.

tl; dr: Un visualizzatore CSV analizza il testo delimitato e lo renderizza come una tabella senza modificare o forzare i valori. la Visualizzatore CSV rileva automaticamente se il file utilizza virgole, punto e virgola, schede o pipe, maniglie RFC 4180 campi citati (virgole e newline all'interno delle celle, virgolette raddoppiate), ti avvisa delle righe cenciose e delle intestazioni duplicate ed esporta in CSV o JSON normalizzati. Tutto viene eseguito nel tuo browser: il file non viene mai caricato e i valori rimangono stringhe in modo che gli zeri iniziali sopravvivano.

Che cos'è un file CSV, davvero?

CSV sta per valori separati da virgole e quel nome è responsabile di un decennio di bug, perché due delle tre parole sono inaffidabili.

I valori non sono sempre separati da virgole I locali che usano una virgola come separatore decimale - la maggior parte dell'Europa continentale - esportano invece con il punto e virgola, perché 1,50;2,75 è inequivocabile e 1,50,2,75 non lo è. Excel in una località tedesca o francese lo fa per impostazione predefinita. Le esportazioni di analisi e database spesso utilizzano schede e le pipeline di registro utilizzano frequentemente le pipe. Ognuno di questi è ancora colloquialmente un "CSV;.

E i valori non sono sempre semplici. Nel momento in cui un valore contiene il delimitatore, il formato necessita di un portello di fuga e RFC 4180 ne fornisce uno: avvolgere il campo tra virgolette doppie. All'interno di quelle citazioni, il delimitatore è solo un personaggio. Un carattere di citazione stesso viene sfuggito raddoppiandolo. E un campo citato può contenere interruzioni di riga letterali, il che significa che un singolo record logico può estendersi su più righe fisiche nel file.

Quest'ultimo punto è dove muoiono i parser ingenui. Se il tuo codice lo è line.split(',')- e ho scritto quella riga, e anche tu - allora questo file lo distruggerà:

id,name,note
1,"Smith, John","He said ""hi""
on the second line"
2,Ada,plain

Tre colonne, due record. Un parser split-on-comma vede quattro campi nella seconda riga, si fa prendere dal panico sulle virgolette randagi e tratta la linea avvolta come un terzo record. Un parser appropriato cammina la stringa carattere per carattere, monitorando se è attualmente tra virgolette e produce esattamente cosa significa il file. Il visualizzatore CSV fa la seconda cosa.

Caratteristiche principali del visualizzatore CSV

Rilevamento automatico delimitatore

Incolla un file e lo strumento indovina il delimitatore prima che faccia qualsiasi altra cosa L'approccio ingenuo è contare i personaggi e scegliere quello più frequente, che fallisce immediatamente in prosa - a notes La colonna piena di frasi inglesi contiene molte più virgole di un file delimitato da un punto e virgola ha un punto e virgola.

Quindi i punteggi di rilevamento consistenza invece della frequenza. Prende le prime dieci righe non vuote, conta ogni delimitatore candidato (virgola, punto e virgola, tab, pipe) al di fuori delle sezioni citate e premia il candidato che produce lo stesso conteggio su ogni riga. Un vero delimitatore appare esattamente columns - 1 volte per riga, ogni riga Una virgola all'interno della prosa appare irregolarmente La coerenza vince, la frequenza rompe solo i legami Se indovina ancora sbagliato - e lo farà, sui file con una colonna - puoi sovrascriverla dal menu a discesa.

RFC 4180 Analisi dei campi citati

Il parser è una macchina a stati a livello di carattere, non una regex e non una divisione. Traccia un booleano: siamo all'interno di un campo citato? Citazioni interne, delimitatori e nuove righe sono caratteri ordinari e un doppio "" emette un'unica citazione letterale. Al di fuori delle virgolette, un delimitatore termina il campo e una nuova riga termina il record. I terminali di riga CRF, LF e CR CR sono tutti accettati, perché le esportazioni di Windows, le esportazioni Unix e le vecchie esportazioni di Mac esistono e finiscono tutte nella stessa casella di posta.

Questa è la differenza tra uno spettatore che ti mostra Smith, John in una cella e una che ti mostra "Smith e John" in due.

Cerca in ogni colonna

La casella di ricerca filtra le righe con una corrispondenza della sottostringa insensibile al caso contro ogni cella della riga Non è fuzzy, non è un linguaggio di query e questo è intenzionale: quando stai cercando il record che ha interrotto un'importazione, hai un ID ordine o un indirizzo email e desideri immediatamente la riga che lo contiene.

La ricerca viene eseguita sui dati analizzati in memoria, quindi è istantaneo su file di qualsiasi dimensione che il tuo browser può contenere e si compone con l'ordinamento: Filtra prima, ordina il risultato, esporta ciò che è rimasto.

Ordinamento di colonne sensibili alle numeri

Fare clic su un'intestazione di colonna per ordinarla Questo suona banale e non lo è, perché CSV non ha tipi - ogni valore arriva come una stringa, e l'ordinamento delle stringhe mette 100 prima 9 e 2024-3-1 prima 2024-11-1.

L'ordinamento ispeziona i valori: se ogni cella non vuota nel confronto analizza come un numero (con migliaia di separatori spogliati), si confronta numericamente. Altrimenti si ricade su un confronto di stringhe attenti alle impostazioni locali con la collazione numerica, quindi item2 Ordina prima item10. Le celle vuote affondano sempre in basso, in entrambe le direzioni, perché uno spazio vuoto non è un valore piccolo: ne manca uno e seppellire i dati mancanti nella parte superiore di uno strumento discendente è il modo in cui non riesci a notarlo.

Avvisi sulla qualità dei dati

Due problemi strutturali vengono segnalati prima di andare oltre.

righe irregolari. Se una riga ha più o meno campi dell'intestazione, qualcosa non va a monte: un delimitatore non citato all'interno di un valore, un'esportazione troncata, una newline vagante. Il visualizzatore si associa a righe corte e tronca quelle lunghe in modo che la tabella esegua il rendering, quindi ti dice esattamente quante righe sono state interessate. Quel conteggio è il numero che controllo per primo, perché un file con tre righe irregolari su diecimila ha un bug di dati che a COPY In Postgres emerrà alle 3 del mattino.

Duplica nomi di colonne. Chiamate due colonne id si sovrascriveranno silenziosamente a vicenda in quasi tutti i consumatori downstream: i panda li rinomineranno, una conversione JSON manterrà solo l'ultima e un'importazione SQL sarà errata Lo spettatore li nomina nel banner di avviso in modo da poter correggere l'intestazione prima che sia importante.

Esporta CSV e JSON

Il pannello di esportazione riserializza tutto ciò che è attualmente sullo schermo: filtrato, ordinato, qualunque cosa tu abbia fatto. L'esportazione CSV applica la corretta quotazione RFC 4180 all'uscita, il che lo rende un modo decente per normalizzare un file arrivato con quotazioni incoerenti. L'esportazione JSON converte la tabella in una serie di oggetti codificati dalla riga di intestazione, che è ciò che desideri quando stai alimentando uno script o un'API.

Una scelta deliberata: I valori esportati rimangono stringhe. "01234" non diventa 1234. Una colonna CSV piena di cifre potrebbe essere una quantità, o potrebbe essere un codice postale, un numero di conto, un numero di telefono o una SKU - e non c'è modo di distinguere dai dati. Coercire ai numeri butta via gli zeri iniziali in modo permanente, che è il bug esatto che ha dato inizio a questo articolo Se vuoi i numeri, lanciali esplicitamente dall'altra parte, dove sai cosa significa la colonna.

Funziona interamente nel tuo browser

Il file viene letto con il FileReader API e analizzati in JavaScript. Non viene caricato nulla, nessuna query di ricerca viene registrata, nessun dato tocca un server. Questa non è una promessa politica, è un fatto architettonico che puoi verificare aprendo la scheda di rete DevTools mentre usi lo strumento, o tirando il tuo Wi-Fi e guardandolo continuare a funzionare.

che conta più di quanto sembri. La maggior parte dei file CSV che vale la pena guardare contengono qualcosa che non incolleresti nel sito Web di uno sconosciuto: e-mail dei clienti, cifre sulle buste paga, cronologie degli ordini, un'esportazione da un database di produzione. Se lavori con GDPR, HIPAA o un NDA cliente, "L'ho incollato in un convertitore online" non è una frase che vuoi dire ad alta voce. Ho scritto di più su quel modello di minaccia in Perché gli strumenti lato client battono i convertitori cloud.

Come utilizzare il visualizzatore CSV

Passaggio 1: carica il file

Due modi in Incolla il testo CSV direttamente nella casella di input: ottimo per uno snippet da un registro, un messaggio Slack o una risposta API che desideri osservare Oppure fai clic Carica file e scegli un .csv, .tsv, o .txt file dalla tua macchina. il file viene letto localmente; il pulsante di caricamento è un file chi salta, non un caricamento.

Se stai incollando da un foglio di calcolo, tieni presente che la maggior parte delle applicazioni di fogli di calcolo inserisce il testo separato da tabulazioni negli appunti, non le virgole. Imposta il delimitatore su TAB, oppure lascialo in automatico e lascia che il rilevamento lo gestisca.

Passaggio 2: controlla le impostazioni di analisi

Tre impostazioni e le impostazioni predefinite sono corrette per la maggior parte del tempo.

delimitatore è automatico per impostazione predefinita. Sostituiscilo se il tuo file ha una colonna o se il rilevamento indovina errato su un piccolo campione.

La prima riga è l'intestazione è acceso Disattiva per i file senza intestazione - le colonne diventano Column 1, Column 2, e così via, e nessuna riga viene consumata.

Taglia gli spazi bianchi è acceso, che spoglia gli spazi che portano e trascinano da ogni cellula. Questo di solito è quello che vuoi, dal momento che , Dopo che un delimitatore è estremamente comune nei CSV scritti a mano. Disattivalo se i tuoi dati hanno spazi iniziali significativi, come campi a larghezza fissa che sono stati scaricati in CSV.

Passaggio 3: leggi la tabella

urto Guarda come tabella e ottieni la griglia analizzata più una linea di statistiche: quante righe sono visibili su quante totali, quante colonne, quale delimitatore è stato utilizzato e quante colonne sono completamente numeriche. Quel conteggio numerico è un controllo di integrità veloce: se una colonna che prevedi sia numerica non viene conteggiata, qualche riga contiene un non numero e di solito è la riga che interromperà la tua importazione.

Cerca righe di filtri. facendo clic su un ordinamento di intestazione. I due compongono.

Passaggio 4: esporta o vai avanti

Copia la tabella visibile come JSON, scaricala come CSV o scaricala come JSON. Filtri e ordinamento vengono applicati all'esportazione, quindi "ricerca refunded, Ordina per data, Scarica CSV" ti dà esattamente quel sottoinsieme.

Come si confronta con altri modi per aprire un CSV?

avvicinare costringe i tuoi dati Gestisce i campi citati Funziona offline Invia dati ovunque bene per
Visualizzatore CSV (Toolz.dev) no Sì (RFC 4180) certo no Ispezione, ricerca, controllo della sanità mentale, conversione in JSON
Excel / Fogli Google Sì - date, zeri iniziali, notazione scientifica certo Excel Sì, fogli no Caricamenti di fogli su Google Modifica, formule, grafici
Un editor di testo no No, lo analizzi nella tua testa certo no Piccoli file, controllo dei finali di riga
csvkit / xsv / duckdb CLI no certo certo no File enormi, script, join, aggregazione
panda read_csv Sì, per impostazione predefinita (dtype=str per fermarlo) certo certo no Pipeline di analisi, trasformazione
La maggior parte dei siti "visualizzatore CSV online" varia di solito no Sì - caricato sul loro server Niente a cui tieni

Il riepilogo onesto: per i file superiori a poche centinaia di megabyte, usa DuckDB o xsv- un browser analizza l'intero file in memoria in un unico passaggio e non c'è modo di aggirare questo Per qualsiasi cosa è necessario modificare con le formule, utilizzare un foglio di calcolo e accettare la coercizione, o importare come testo Per tutto il resto - il quotidiano & quot; ciò che è in realtà in questo file, e perché ha fatto riga 4,201 break" - un visualizzatore che non cambia nulla è lo strumento giusto.

Casi d'uso comuni

Debug di un'importazione non riuscita

Un'importazione CSV fallisce con & quot;attese 8 colonne, prese 9 sulla riga 4201" Apri il file nel visualizzatore, controlla l'avviso di riga irregolare, quindi cerca un valore che sai essere su quel record Nove volte su dieci troverai una virgola non quotata all'interno di un indirizzo o un nome di società - Acme, Inc. scritto senza citazioni. Ora sai se correggere l'esportazione o pre-elaborare il file.

Revisione di un database di esportazione prima che vada ovunque

Prima che i dati di un cliente lascino il tuo laptop, vuoi sapere cosa c'è dentro. nomi di colonne, conteggio delle righe, se il email La colonna è completamente popolata, se esistono ID duplicati. La riga delle statistiche e i conteggi unici riempiti/unici rispondono a tutto questo in circa dieci secondi, senza che il file raggiunga mai un server.

Conversione di CSV in JSON per un'API o uno script

Hai un foglio di calcolo di record e ne hai bisogno come JSON per seminare un database, alimentare un endpoint REST o creare un file di fixture. Incolla, analizza, esporta JSON. Se hai bisogno del viaggio inverso, il CSV a JSON e JSON a CSV Gli strumenti gestiscono la conversione dedicata con più opzioni e ho esaminato il problema di andata e ritorno in dettaglio nel Guida alla conversione da JSON a CSV.

Controllo di un'esportazione europea che si è aperta come un'unica colonna

Un client invia un'esportazione da un'installazione di Excel tedesca e ogni riga è una stringa lunga Imposta il delimitatore su Semicolon e scatta in colonne. Ciò richiede quattro secondi e vale la pena conoscerlo, perché il reflex & quot; il file è corrotto" è sbagliato: il file va bene, il tuo parser' l'ipotesi non lo era.

Analisi di controllo o esportazioni di piattaforme pubblicitarie

GA4, Google Ads e Meta export arrivano come CSV con righe di metadati sopra l'intestazione vera e propria Spegni & quot; La prima riga è header", guarda la forma e vedrai esattamente su quale riga si trova l'intestazione reale, quindi elimina le righe spazzatura dalla casella di incolla e rianalizza.

Deep Dive tecnico: le regole di analisi che contano davvero

RFC 4180 è una descrizione, non uno standard che nessuno imponga. È stato pubblicato nel 2005 per documentare ciò che le implementazioni CSV hanno già fatto, e rileva esplicitamente che molti differiscono. Trattalo come la sana linea di base, non come una garanzia su un file che ti è stato inviato.

Regole di citazione. Un campo può essere avvolto in virgolette doppie. Citazioni interne, delimitatori, citazioni CR, LF e raddoppiate (""") sono letterali Una citazione che appare nel mezzo di un campo non citato è ambigua: lo spettatore considera la citazione significativa solo quando la citazione è il primo carattere del campo, che è il modo in cui si comporta la maggior parte dei parser reali e che consente valori come 6" nails sopravvivere.

Finali di linea. CRLF è ciò che dice le specifiche. LF è ciò che produce Unix. Un CR nudo è ciò che il software Mac molto vecchio prodotto e ciò che alcuni sistemi embedded producono ancora. Il parser accetta tutti e tre, comprese le finali miste all'interno di un file, perché i finali misti si verificano assolutamente quando i file vengono modificati su due macchine.

la nata. I file UTF-8 scritti da Excel iniziano con un segno di ordine di byte, EF BB BF. Se il tuo primo nome di colonna è simile id Ma un confronto di stringhe contro "id" Fallisce, quella distinta di nascita invisibile sta cavalcando sul davanti. Questo è il singolo bug di ricerca dell'intestazione più comune "perché la ricerca dell'intestazione non è riuscita nella gestione del CSV.

nuove linee finali. Un file che termina con una nuova riga non ha un record vuoto extra: la nuova riga termina l'ultimo record. L'opzione viewer's salta le righe vuote lo rende un non-problema in entrambi i casi.

tipo di inferenza. C'è' t qualsiasi CSV non ha tipi Ogni valore nel file è una stringa, e qualsiasi tipo si ottiene fuori l'altro lato è stato inventato dal vostro parser sulla base di un'ipotesi Questo non è un difetto nel formato, è il formato' s intera natura - ed è il motivo per cui lo spettatore non indovina mai per conto vostro.

FAQ

Come faccio ad aprire un file CSV senza Excel?

caricare il file su Visualizzatore CSV o incolla il suo contenuto nella casella di input. Il file viene analizzato nel browser e visualizzato come tabella che puoi cercare e ordinare. Nessun software per fogli di calcolo, nessuna installazione e nessun caricamento su un server.

Perché il mio CSV si apre come una lunga colonna?

Il delimitatore non corrisponde. I file esportati nelle impostazioni locali che utilizzano una virgola come separatore decimale utilizzano in genere punti e virgola tra i campi e le esportazioni separate da tabulazioni utilizzano le schede. Cambia l'impostazione del delimitatore da Auto a punto e virgola, Tab o Pipe e le colonne si dividono correttamente.

Il visualizzatore gestisce le virgole all'interno dei campi citati?

si. Il parser segue RFC 4180: un campo avvolto in virgolette può contenere delimitatori, interruzioni di riga e virgolette evasive scritte come due virgolette di fila. un valore come "Smith, John" rimane in una cella invece di dividersi in due.

Qual è la differenza tra CSV e TSV?

Usano diversi separatori di campo - CSV separa con virgole, TSV con caratteri di tabulazione TSV ha bisogno di meno quotazione perché le schede raramente si verificano all'interno dei valori dei dati, motivo per cui le esportazioni di database e analisi spesso lo preferiscono Questo visualizzatore legge entrambi; scegli Tab come delimitatore per i file TSV.

Cosa significa l'avviso di "righe ragged"?

Una riga ha più o meno campi rispetto alla riga di intestazione. Di solito significa un delimitatore non quotato all'interno di un valore, un'esportazione troncata o un campo contenente un'interruzione di riga vagante. Il visualizzatore si associa a righe corte e tronca quelle lunghe in modo che la tabella esegua il rendering e ti dice quante righe sono state interessate.

Esiste un limite di dimensione del file?

Il limite pratico è la memoria del browser, poiché l'intero file viene analizzato in un unico passaggio JavaScript. I file fino a poche decine di megabyte vanno bene su un laptop tipico. Per le esportazioni multi-gigabyte, utilizzare invece uno strumento di streaming come CSVKit, DuckDB o Panda con ChunkSize.

Posso convertire il csv in json?

Sì. Il pannello Esporta converte la tabella analizzata in un array di oggetti JSON codificati dalla riga di intestazione, che è possibile copiare o scaricare I valori rimangono come stringhe in base alla progettazione: costringerli a numeri eliminerebbe gli zeri iniziali da ID, codici postali e numeri di telefono.

È sicuro aprire un CSV riservato qui?

si. L'analisi viene eseguita interamente nel browser utilizzando JavaScript e l'API FileReader. Nessun file, cella o query di ricerca viene trasmesso a un server o registrato. Puoi verificarlo aprendo la scheda di rete del browser DevTools mentre utilizzi lo strumento o disconnettendoti da Internet.

Strumenti correlati

  • CSV a JSON- conversione dedicata con opzioni di tipo
  • JSON a CSV- il viaggio di ritorno, compreso l'appiattimento degli oggetti nidificati
  • XML a JSON- per le esportazioni che arrivano invece come XML
  • Formattatore JSON- ripulisci la JSON che hai appena esportato
  • JSON DIFF- confronta due esportazioni e trova cosa è cambiato

Ulteriori letture: La guida definitiva agli strumenti JSON e Conversione da JSON a CSV.

Comments

0 comments

0/2000 characters

No comments yet. Be the first to share your thoughts!