Български CSV, който се отваря в една колона, и кирилица, която излиза като въпросителни, са двете причини този инструмент да съществува.
Защото на българска система запетаята е десетичен разделител. Затова Excel записва CSV с точка и запетая между полетата, а не със запетая. Файл, отворен с очакване за запетая, излиза с всичко в първата колона. Тук разделителят се измерва по самото съдържание, вместо да се предполага, и точно това решава най-честия проблем с таблици в България.
Когато вместо букви излизат странни знаци, файлът почти винаги е записан в еднобайтова кодировка Windows-1251 и се чете като UTF-8, или обратното. Байтовете са наред, четенето е грешно. Затова кодировката се разпознава, а не се приема по подразбиране.
Само понякога. Ако повреденият текст, вече със знака заместител вътре, е бил записан наново като нов файл, оригиналните байтове ги няма. Заместителят не носи информация за това какво е било преди него. Тогава единственото решение е нов експорт от източника.
Приемат се и се произвеждат CSV, TSV, JSON, Markdown, блок SQL INSERT, HTML таблица и XLSX. Последният е истинска работна книга, тоест ZIP архив с няколко XML файла вътре, а не CSV с разширение xlsx. Оттам идва и правилното четене на буквите на колоните.
Когато една колона не показва сума, причината е, че поне един ред в нея не се е разчел като число. Инструментът предпочита да не покаже нищо, вместо да покаже сбор, който тихо пропуска редове. Липсващата сума е сигнал къде да се погледне, а не дефект.
Четенето, преобразуването и свалянето стават в раздела, който гледаш. Затова инструментът работи и без връзка, след като веднъж е зареден, и затова таблица с лични данни или с цени не тръгва към чужд сървър, за да ѝ се смени разделителят.
CSV и TSV са за обмен между програми и са най-крехките заради разделителя и кодировката. JSON е за програмен вход. Markdown е за таблица вътре в документация. HTML таблицата е за страница. SQL блокът INSERT е за пренасяне на редове в база данни, без да се пише заявка на ръка. XLSX е за човек, който ще я отвори в Excel. Един и същи набор редове има смисъл във всеки от тях, но по различна причина.
Повечето проблеми след преобразуване идват от това дали първият ред е заглавен, или е данни. Ако се сбърка, едно от двете се случва: губи се един ред от данните, или всяка колона получава за име стойност от първия запис. Затова си струва да се погледне предварително какво стои на първия ред, вместо да се обяснява после защо сборът е с един ред по-малък.
Защото на българска система запетаята е десетичен разделител и Excel записва CSV с точка и запетая между полетата. Инструментът измерва разделителя по съдържанието.
Защото файлът е записан в Windows-1251 и се чете като UTF-8, или обратното. Байтовете са наред, четенето е грешно.
Само понякога. Ако повреденият текст е бил презаписан като нов файл, оригиналните байтове ги няма и заместващият знак не носи информация какво е било.
Да. XLSX работната книга е ZIP архив с XML вътре и се чете и записва направо, включително буквите на колоните.
CSV, TSV, JSON, Markdown, блок SQL INSERT, HTML таблица и XLSX.
Защото поне един ред в нея не се е разчел като число. Показването на нищо е по-честно от сбор, който тихо пропуска редове.
Не. Четенето, преобразуването и свалянето стават в браузъра, затова инструментът работи и без връзка след зареждане.
По съдържанието му: заглавният ред носи имена на колони, а не стойности. Ако се сбърка, или се губи един ред от данните, или колоните получават за имена стойности от първия запис. Проверката отнема секунда и спестява обяснения после.
Файлът не напуска машината ти, затова обработката на чувствителна таблица не я изпраща към чужд сървър.