LocalUtils field note · Ispeziona file delimitati di grandi dimensioni senza caricare ogni riga contemporaneamente
Ispeziona file delimitati di grandi dimensioni senza caricare ogni riga contemporaneamente
CSV è una famiglia di convenzioni piuttosto che un formato perfettamente uniforme. Delimitatori, virgolette, ritorni a capo incorporati, codifiche e lunghezze di riga irregolari influiscono tutti sul modo in cui appare un file.
Il visualizzatore legge intervalli gestibili e crea segnalibri per parti successive di un file di grandi dimensioni. È progettato per ispezioni e correzioni modeste, non per sostituire un database o un motore di calcolo completo di fogli di calcolo.
Avvio rapido
- Aprire una copia del file e verificare che il delimitatore rilevato produca colonne sensibili.
- Rivedi l'intestazione e il primo intervallo prima di approfondire il file.
- Utilizza la navigazione tra righe per esaminare gli intervalli successivi; i segnalibri vengono creati periodicamente per evitare di ripetere l'analisi dall'inizio per ogni salto.
- Apporta solo modifiche intenzionali, salva un'esportazione e confronta il numero di righe e le colonne critiche con l'origine.
device → browser engine → result
Cosa fa il browser
Papa Parse gestisce l'analisi CSV in un lavoratore. Il visualizzatore espone intervalli di circa 100 righe e registra gli offset dei file a intervalli di circa 10.000 righe per una ricerca più rapida.
Il CSV selezionato viene letto dal browser anziché caricato su un server di analisi LocalUtils. Le codifiche dei file e il comportamento del parser determinano comunque se ogni carattere e campo tra virgolette viene interpretato correttamente.
Ingressi e uscite
- Input: file di testo delimitati leggibili tramite l'API File del browser.
- Visualizza: intervalli di pagine con colonne rilevate e navigazione tra le righe.
- Output: un CSV esportato che riflette le modifiche supportate; le formule dei fogli di calcolo e le funzionalità della cartella di lavoro non rientrano nel formato.
Limiti da sapere prima di iniziare
- Il rilevamento della codifica è limitato; potrebbe essere necessario convertire un file in UTF-8.
- Le virgolette non corrette o i ritorni a capo incorporati possono spostare le colonne.
- Le modifiche sono operazioni sulla memoria del browser e non sono un flusso di lavoro del database transazionale.
- Righe molto larghe, campi enormi o memoria limitata del dispositivo possono comunque influire sulla reattività.
Risoluzione dei problemi
- Se tutti i dati vengono visualizzati in una colonna, scegli il delimitatore corretto o controlla l'origine con un editor di testo.
- Se gli accenti sembrano sbagliati, converti una copia in UTF-8 prima di riaprire.
- Se i conteggi delle righe differiscono, controlla i ritorni a capo tra virgolette, i record finali vuoti e gli avvisi del parser.
Lista di controllo per la verifica
- Confronta i nomi delle intestazioni, il conteggio delle righe e il delimitatore con l'origine.
- Esamina gli intervalli iniziale, intermedio e finale anziché solo la prima schermata.
- Apri l'esportazione in un altro parser e controlla a campione le celle modificate e le righe circostanti.
Domande che le persone fanno
Il visualizzatore carica l'intero file in una tabella?
Legge e visualizza gli intervalli, utilizzando i segnalibri per migliorare le ricerche successive, sebbene le esportazioni e le modifiche possano comunque richiedere memoria aggiuntiva.
Perché le righe vengono spostate?
Una virgoletta non corrispondente, un delimitatore imprevisto o un ritorno a capo incorporato possono far sì che i campi successivi vengano analizzati nelle colonne errate.
Può aprire cartelle di lavoro di Excel?
No. CSV è un semplice testo delimitato; La formattazione, i fogli, le formule e i tipi XLSX richiedono uno strumento di cartella di lavoro.
