В этой статье Вы найдёте 2 простых способа преобразовать файл CSV в Excel. Кроме того, Вы узнаете, как импортировать в Excel несколько файлов CSV и как справиться с ситуациями, когда часть данных из файла CSV не отображается корректно на листе Excel.
Недавно мы начали изучать особенности формата CSV (Comma-Separated Values – значения, разделённые запятой) и различные способы преобразования файла Excel в CSV. Сегодня мы займёмся обратным процессом – импортом CSV в Excel.
Эта статья покажет Вам, как открывать CSV в Excel и как импортировать одновременно несколько файлов CSV. Мы также обозначим возможные подводные камни и предложим наиболее эффективные решения.
- Как преобразовать CSV в Excel
- Преобразование CSV в Excel: проблемы и решения
Как преобразовать CSV в Excel
Если Вам нужно вытащить какую-то информацию на лист Excel из базы данных Вашей компании, то первая же идея, что приходит на ум, – экспортировать базу данных в файл CSV, а затем импортировать файл CSV в Excel.
Существует 3 способа преобразования CSV в Excel: Вы можете открыть файл с расширением .csv непосредственно в Excel, дважды кликнуть по файлу в Проводнике Windows либо импортировать CSV в Excel, как внешний источник данных. Далее я подробно расскажу об этих трёх способах и укажу преимущества и недостатки каждого из них.
- Способ 1: Открываем файл CSV в Excel
- Способ 2: Открываем файл CSV в Excel при помощи Проводника Windows
- Способ 3: Импортируем CSV в Excel
Как открыть файл CSV в Excel
Даже если файл CSV создан в другой программе, Вы всегда можете открыть его как книгу Excel при помощи команды Open (Открыть).
Замечание: Открытие файла CSV в Excel не изменяет формат файла. Другими словами, файл CSV при этом не будет преобразован в файл Excel (формат .xls или .xlsx), он сохранит свой изначальный тип (.csv или .txt).
- Запустите Microsoft Excel, на вкладке Home (Главная) нажмите Open (Открыть).
- Появится диалоговое окно Open (Открытие документа), в выпадающем списке в нижнем правом углу выберите Text Files (Текстовые файлы).
- Найдите в Проводнике Windows файл CSV и откройте его, дважды кликнув по нему.
Если Вы открываете файл CSV, то Excel откроет его сразу же вставив данные в новую книгу Excel. Если Вы открываете текстовый файл (.txt), то Excel запустит Мастер импорта текстов. Подробнее об этом читайте в разделе Импортируем CSV в Excel.
Замечание: Когда Microsoft Excel открывает файл CSV, то для того, чтобы понять, как именно импортировать каждый столбец данных, он использует настройки форматирования, заданные по умолчанию.
Если данные соответствуют хотя бы одному из следующих пунктов, то воспользуйтесь Мастером импорта текстов:
- В файле CSV использованы различные разделители;
- В файле CSV использованы различные форматы даты;
- Вы преобразуете данные, среди которых есть числа с нулём в начале, и Вы хотите сохранить этот ноль;
- Вы хотите предварительно просмотреть, как будут импортированы данные из файла CSV в Excel;
- Вам хочется большей гибкости в работе.
Чтобы заставить Excel запустить Мастер импорта текстов, Вы можете либо изменить расширение фала с .csv на .txt (прежде чем открывать файл), либо импортировать CSV в Excel так, как это будет описано далее.
Как открыть файл CSV при помощи Проводника Windows
Это самый быстрый способ открыть CSV в Excel. В Проводнике Windows дважды кликните по файлу .csv, и он откроется как новая книга Excel.
Однако, этот способ сработает только в том случае, если приложение Microsoft Excel установлено как программа, заданная по умолчанию, для открытия файлов .csv. Если это так, то Вы будете видеть знакомую иконку в Проводнике Windows рядом с именем файла.
Если Excel не является программой по умолчанию, вот как Вы можете это исправить:
- Кликните правой кнопкой мыши по любому файлу .csv в Проводнике Windows и в открывшемся контекстном меню нажмите Open with (Открыть с помощью) > Choose default program (Выбрать программу).
- Выберите Excel в списке рекомендованных программ, убедитесь, что стоит галочка для параметра Always use the selected program to open this kind of file (Всегда использовать выбранное приложение для такого типа файлов) и нажмите ОК.
Как импортировать CSV в Excel
Этим способом Вы можете импортировать данные из файла .csv в существующий или в новый лист Excel. В отличие от предыдущих двух способов, он не просто открывает CSV в Excel, а именно конвертирует формат .csv в .xlsx (если Вы используете Excel 2007, 2010 или 2013) или .xls (в версиях Excel 2003 и более ранних).
- Откройте нужный лист Excel и кликните по ячейке, куда нужно импортировать данные из файла .csv или .txt.
- На вкладке Data (Данные) в разделе Get External Data (Получение внешних данных) кликните From Text (Из текста).
- Найдите файл .csv, который требуется импортировать, выберите его и нажмите кнопку Import (Импорт), или просто дважды кликните по нужному CSV файлу.
- Откроется Мастер импорта текстов, Вам нужно просто выполнить его шаги.
Прежде, чем мы двинемся дальше, пожалуйста, посмотрите на снимок экрана ниже, на нем показан исходный файл CSV и желаемый результат в Excel. Надеюсь, это поможет Вам лучше понять, почему мы выбираем те или иные параметры настроек в последующем примере.
- Шаг 1. Выберите формат данных и номер строки, с которой нужно начинать импорт. Чаще всего выбирают Delimited (С разделителями) и со строки 1. Область предварительного просмотра в нижней части диалогового окна мастера показывает первые несколько записей импортируемого файла CSV.
- Шаг 2. На этом шаге нужно выбрать разделители и ограничитель строк. Delimiter (Разделитель) – это символ, который разделяет значения в файле CSV. Если в Вашем файле CSV использован какой-то символ, которого нет в предложенном списке, то поставьте галочку в варианте Other (Другой) и введите нужный символ. В нашем примере мы указали Tab (Знак табуляции) и Comma (Запятая), чтобы каждый товар (они разделены табуляцией) начинался с новой строки, а информация о товаре, например, ID и данные о продажах (они разделены запятыми), были помещены в разные ячейки.Text qualifier (Ограничитель строк) – это символ, в который заключены отдельные значения. Весь текст, заключённый между такими символами, например, «текст1, текст2», будет импортирован как одно значение, даже если в этом тексте содержится символ, указанный Вами как разделитель.В этом примере мы указали запятую как разделитель, и кавычки как ограничитель строк. В результате, все числа с разделителем десятичных разрядов (которым тоже в нашем случае служит запятая!) будут импортированы в одну ячейку, как это видно в области предпросмотра на рисунке ниже. Если мы не укажем кавычки как ограничитель строк, то все числа будут импортированы в разные ячейки.
- Шаг 3. Посмотрите в область Data preview (Образец разбора данных). Если Вы довольны тем, как выглядят Ваши данные, тогда жмите кнопку Finish (Готово).
- Шаг 1. Выберите формат данных и номер строки, с которой нужно начинать импорт. Чаще всего выбирают Delimited (С разделителями) и со строки 1. Область предварительного просмотра в нижней части диалогового окна мастера показывает первые несколько записей импортируемого файла CSV.
Совет: Если в Вашем файле CSV используется последовательно более одной запятой или другого символа-разделителя, то поставьте галочку для параметра Treat consecutive delimiters as one (Считать последовательные разделители одним), чтобы избежать появления пустых ячеек.
- Выберите, куда вставлять импортированные данные, на существующий или на новый лист, и нажмите ОК, чтобы завершить импорт файла CSV в Excel.
Совет: Вы можете нажать кнопку Properties (Свойства), чтобы настроить дополнительные параметры, такие как обновление, разметка и форматирование для импортированных данных.
Замечание: Если Ваш файл CSV содержит численные данные или даты, Excel может преобразовать их с ошибками. Чтобы изменить формат импортированных данных, выберите столбец (столбцы), в которых возникли ошибки, кликните по ним правой кнопкой мыши и в контекстном меню выберите Format cells (Формат ячеек).
Преобразование CSV в Excel: проблемы и решения
Формат CSV используется уже более 30 лет, но несмотря на его длительную историю, он никогда не был официально задокументирован. Название CSV (Comma-Separated Values) возникло из-за использования запятых для разделения полей данных. Но это в теории. На самом деле, множество так называемых CSV-файлов используют другие символы для разделения данных, например:
- Табуляция – TSV-файлы (tab-separated values)
- Точка с запятой – SCSV-файлы (semicolon separated values)
Некоторые вариации файлов CSV разделяют поля данных одинарными или двойными кавычками, другие требуют маркер последовательности байтов из Юникода (BOM), например, UTF-8, для корректной интерпретации Юникода.
Это отсутствие стандартов порождает разнообразные проблемы, с которыми Вы можете столкнуться, пытаясь преобразовать файл Excel в CSV, и особенно, когда импортируете файл CSV в Excel. Давайте разберёмся с известными проблемами, начиная с самой распространённой.
- Файл CSV отображается в Excel неправильно (все данные помещены в первый столбец)
- Первые нули потеряны при открытии файла CSV в Excel
- Значения преобразованы в даты при импорте файла CSV в Excel
Файл CSV отображается в Excel неправильно
Признаки: Вы пытаетесь открыть файл CSV в Excel, и все данные попадают в первый столбец.
Причина: Корень проблемы кроется в том, что в Ваших региональных и языковых настройках Windows и в Вашем файле CSV установлены различные разделители. В Северной Америке и некоторых других странах разделителем полей списка по умолчанию является запятая. В то время как в Европейских странах запятая используется как разделитель десятичных разрядов, а разделителем полей списка является точка с запятой.
Решение: Есть несколько возможных решений этой проблемы. Вы можете быстро просмотреть приведённые ниже рекомендации и выбрать наиболее подходящие для конкретно Вашей задачи.
- Укажите правильный разделитель непосредственно в файле CSV. Откройте файл CSV в любом текстовом редакторе (подойдёт даже обычный блокнот) и в первой строке вставьте следующий текст. Обратите внимание, что это должна быть отдельная строка перед любыми другими данными:
- Чтобы установить разделитель запятую: sep=,
- Чтобы установить разделитель точку с запятой: sep=;
Как Вы уже догадались, таким образом можно установить в качестве разделителя любой другой символ, просто указав его сразу после знака равенства.
- Выберите нужный разделитель в Excel. В Excel 2013 или 2010 на вкладке Data (Данные) в разделе Data Tools (Работа с данными) нажмите Text To Columns (Текст по столбцам).
Когда запустится Мастер распределения текста по столбцам, на первом шаге выберите формат данных Delimited (С разделителями) и нажмите Next (Далее). На втором шаге выберите нужный разделитель и нажмите Finish (Готово).
- Измените расширение с .csv на .txt. Открытие файла .txt в Excel приведёт к запуску Мастера импорта текстов, и Вы сможете выбрать нужный разделитель, как это было описано в разделе Как импортировать CSV в Excel.
- Откройте файл CSV с точкой с запятой в качестве разделителя при помощи VBA. Вот пример кода VBA, который открывает в Excel файл CSV, где в качестве разделителя используется точка с запятой. Код был написан несколько лет назад для более ранних версий Excel (2000 и 2003), но если Вы достаточно хорошо знакомы с VBA, то у Вас не должно возникнуть проблем с его обновлением или изменением для работы с файлами CSV с запятой в качестве разделителя.
Замечание: Все показанные решения изменяют разделитель только для данного файла CSV. Если Вы хотите раз и навсегда изменить разделитель, заданный по умолчанию, то Вам подойдёт следующее решение.
- Изменяем разделители в настройках региональных стандартов. Нажмите кнопку Start (Пуск) и запустите Control Panel (Панель управления), кликните пункт Region and Language (Региональные стандарты) > Additional Settings (Дополнительные параметры). Откроется диалоговое окно Customize Format (Настройка формата), в котором Вам нужно выбрать точку (.) для параметра Decimal symbol (Разделитель целой и дробной части), и установить запятую (,) для параметра List separator (Разделитель элементов списка).
Примечание переводчика: Данные настройки приведены для английской локализации Excel (и ряда других стран). Для русской локализации привычнее будет использовать запятую в качестве разделителя целой и дробной части и точку с запятой для разделения элементов списка.
Дважды нажмите ОК, чтобы закрыть диалоговые окна – всё готово! С этого момента Microsoft Excel будет открывать и отображать все файлы CSV (с разделителем запятой) корректно.
Замечание: Установка в Панели управления Windows символов-разделителей целой и дробной части и элементов списка изменит настройки символов, заданные по умолчанию, для всех программ на Вашем компьютере, а не только в Microsoft Excel.
Первые нули теряются при открытии файла CSV в Excel
Признаки: Ваш файл CSV содержит значения с первыми нулями, и эти нули теряются при открытии файла CSV в Excel.
Причина: По умолчанию, Microsoft Excel отображает файл CSV в формате General (Общий), в котором первые нули отсекаются.
Решение: Вместо того, чтобы открывать файл .csv в Excel, запустите, как мы это делали ранее, Мастер импорта текстов, чтобы конвертировать файл CSV в Excel.
На шаге 3 мастера выберите столбцы, содержащие значения с первыми нулями и измените формат этих столбцов на текстовый. Так Вы конвертируете Ваш файл CSV в Excel, сохранив нули на своих местах.
Excel преобразует некоторые значения в даты при открытии файла CSV
Признаки: Некоторые значения в Вашем файле CSV похожи на даты, и Excel автоматически преобразует такие значения из текстового формата в формат даты.
Причина: Как упоминалось выше, Excel открывает файл CSV в формате General (Общий), при этом значения, похожие на даты, преобразует из текстового формата в формат даты. Например, если Вы открываете файл CSV, содержащий логины пользователей, то запись «апр23» будет преобразована в дату.
Решение: Преобразуйте файл CSV в Excel при помощи Мастера импорта текстов. На шаге 3 мастера выберите столбцы с записями, похожими на даты, и измените формат столбца на текстовый.
Если Вам нужно достичь противоположного результата, то есть в определённом столбце преобразовать значения в даты, тогда установите формат Date (Дата) и выберите подходящий формат даты в выпадающем списке.
Как импортировать в Excel несколько файлов CSV
Думаю, Вы знаете, что Microsoft Excel позволяет открывать несколько файлов CSV при помощи команды Open (Открыть).
- На вкладке File (Файл) нажмите Open (Открыть) и в выпадающем списке в нижней правой части диалогового окна выберите Text Files (Текстовые файлы).
- Чтобы выделить несколько файлов подряд, кликните по первому файлу, затем нажав и удерживая клавишу Shift, кликните по крайнему файл. Оба эти файла, а также все, что находятся между ними, будут выделены.Чтобы выделить файлы, расположенные не подряд, удерживайте клавишу Ctrl и щелкайте по каждому файлу .csv, который хотите открыть.
- Когда выделены все нужные файлы CSV, нажмите кнопку Open (Открыть).
Этот способ простой и быстрый, и мы могли бы назвать его отличным, если бы не одно обстоятельство – каждый файл CSV открывается таким образом как отдельная книга Excel. На практике переключение туда-сюда между несколькими открытыми файлами Excel может быть крайне неудобным и обременительным.
Надеюсь, теперь Вы легко сможете преобразовать любой файл CSV в Excel. Если у Вас возникают какие-либо вопросы или сложности, смело пишите мне в комментариях. И благодарю за терпение каждого, кто осилил чтение этой длинной статьи до самого конца!
office-guru.ru
Чем открыть файл CSV
В Windows: Microsoft Excel, Microsoft Works, Corel WordPerfect Office X, Microsoft Notepad, IBM Lotus Symphony, Corel Quattro Pro, Microsoft Outlook, Numbers, ТаблицаПро, CSVed, KSpread, ANSYS, LabVIEW, Nokia PC Suite, Любой текстовый редактор
В Mac OS: Microsoft Excel, Planamesa NeoOffice
Кроссплатформенное ПО: OpenOffice.org, LibreOffice
Он-лайн сервисы: Google Forms
Описание расширения CSV
Популярность:
Раздел: Файлы с данными
Расширение CSV – простой тестовый формат, в котором данные разделены запятыми и предназначен для представления табличных данных. Каждая строка в файле CSV соответствует строке в таблице. На одной линии поля разделяются запятыми, каждое поле принадлежит одному столбцу таблицы. Разделителем (delimiter) может быть и другой символ, например, точка с запятой и т.д. Значения, содержащие зарезервированные символы (двойная кавычка, запятая, точка с запятой, новая строка) обрамляются двойными кавычками («), иногда двойными кавычками обрамляют и текстовые значения. Строки разделяются парой символов CR LF (0x0D 0x0A), но может быть и просто LF (0x0A). Т.к. разделители столбцов и строк могут быть разными, так же может быть разной кодировка текстового файла и обрамление двойными кавычками, то все это усложняет перенос данных из одних программ в другие, несмотря на всю простоту реализации поддержки CSV.
CSV – это формат файла, который поддерживается многими приложениями. .CSV файлы часто используются для импортаэкспорта табличных данных между двумя различными компьютерными программами, например, между базой данных и электронной таблицей.
Первый файл CSV появился в начале 70-х годов. Однако формат по-прежнему популярен и сегодня и используются для различных целей, например, используется в качестве экспорта/импорта контактов в Microsoft Oultook и Live Messenger.
Иногда файл .CSV имеет ошибочное расширение .cvs.
MIME тип: text/comma-separated-values, text/csv, text/anytext, application/csv, application/excel, application/vnd.msexce, application/vnd.ms-excel
Другие программы, связанные с расширением CSV
- Файл объекта Boso View Express от Mackoy
.CSV файл содержит данные маршрутов и объектов для программы Boso View Express (BVE), симулятор поезда. Другие файлы, которые используются для маршрутов: RW файлы, и B3D и X файлы используются для файлов объектов. Относится к разделу Игры.
Популярность:
- Файл подсказок игры The Secret of Monkey Island от LucasArts Entertainment Company, LLC
Расширение файла CSV используется игрой Тайна Острова Обезьян: Специальный выпуск (The Secret of Monkey Island: Special Edition) от LucasArts, которая выпускается для Xbox и ПК с операционной системой Windows. .CSV файл – это файл подсказок, используемый в игре, хранится в бинарном виде. Относится к разделу Игры.
Популярность:
fileext.ru
CSV является стандартом де-факто для связи между собой разнородных систем, для передачи и обработки объемных данных с «жесткой», табличной структурой. Во многих скриптовых языках программирования есть встроенные средства разбора и генерации, он хорошо понятен как программистам, так и рядовым пользователям, а проблемы с самими данными в нем хорошо обнаруживаются, как говорится, на глаз.
История этого формата насчитывает не менее 30 лет. Но даже сейчас, в эпоху повального использования XML, для выгрузки и загрузки больших объемов данных по-прежнему используют CSV. И, несмотря на то, что сам формат довольно неплохо описан в RFC, каждый его понимает по-своему.
В этой статье я попробую обобщить существующие знания об этом формате, указать на типичные ошибки, а также проиллюстрировать описанные проблемы на примере кривой реализации импорта-экспорта в Microsoft Office 2007. Также покажу, как обходить эти проблемы (в т.ч. автоматическое преобразование типов Excel-ом в DATETIME и NUMBER) при открытии .csv.
Начнем с того, что форматом CSV на самом деле называют три разных текстовых формата, отличающихся символами-разделителями: собственно сам CSV (comma-separated values — значения, разделенные запятыми), TSV (tab-separated values — значения, разделенные табуляциями) и SCSV (semicolon separated values — значения, разделенные точкой с запятой). В жизни все три могут называться одним CSV, символ-разделитель в лучшем случае выбирается при экспорте или импорте, а чаще его просто «зашивают» внутрь кода. Это создает массу проблем в попытке разобраться.
Как иллюстрацию возьмем казалось бы тривиальную задачу: импортировать в Microsoft Outlook данные из таблицы в Microsoft Excel.
В Microsoft Excel есть средства экспорта в CSV, а в Microsoft Outlook — соответствующие средства импорта. Что могло быть проще — сделал файлик, «скормил» почтовой программе и — дело сделано? Как бы не так.
Создадим в Excel тестовую табличку:
… и попробуем экспортировать ее в три текстовых формата:
«Текст Unicode» | Кодировка — UTF-16, разделители — табуляция, переводы строк — 0×0D, 0×0A, объем файла — 222 байт |
«CSV (разделители — запятые)» | Кодировка — Windows-1251, разделители — точка с запятой (не запятая!), во второй строке значение телефонов не взято в кавычки, несмотря на запятую, зато взято в кавычки значение «01;02», что правильно. Переводы строк — 0×0D, 0×0A. Объем файла — 110 байт |
«Текстовые файлы (с разделителями табуляции)» | Кодировка — Windows-1251, разделители — табуляция, переводы строк — 0×0D, 0×0A. Значение «01;02» помещено в кавычки (без особой нужды). Объем файла — 110 байт |
Какой вывод мы делаем из этого?.. То, что здесь Microsoft называет «CSV (разделители — запятые)», на самом деле является форматом с разделителями «точка с запятой». Формат у Microsoft — строго Windows-1251. Поэтому, если у вас в Excel есть Unicode-символы, они на выходе в CSV отобразятся в вопросительные знаки. Также то, что переводами строк является всегда пара символов, то, что Microsoft тупо берет в кавычки все, где видит точку с запятой. Также то, что если у вас нет Unicode-символов вообще, то можно сэкономить на объеме файла. Также то, что Unicode поддерживается только UTF-16, а не UTF-8, что было бы сильно логичнее.
Теперь посмотрим, как на это смотрит Outlook. Попробуем импортировать эти файлы из него, указав такие же источники данных. Outlook 2007: Файл -> Импорт и экспорт… -> Импорт из другой программы или файла. Далее выбираем формат данных: «Значения, разделенные запятыми (Windows)» и «Значения, разделенные табуляцией (Windows)».
«Значения, разделенные табуляцией(Windows)» | Скармливаем аутлуку файл tsv, с разделенными табуляцией значениями и!.. — чтобы вы думали?.. Outlook склеивает поля и табуляцию не замечает. Заменяем в файле табуляцию на запятые и, как видим, поля уже разбирает, молодец. |
«Значения, разделенные запятыми (Windows)» | А вот аутлук как раз понимает все верно. Comma — это запятая. Поэтому ожидает в качестве разделителя запятую. А у нас после экселя — точка с запятой. В итоге аутлук распознает все неверно. |
Два майкрософтовских продукта не понимают друг друга, у них напрочь отсутствует возможность передать через текстовый файл структурированные данные. Для того, чтобы все заработало, требуются «пляски с бубном» программиста.
Мы помним, что Microsoft Excel умеет работать с текстовыми файлами, импортировать данные из CSV, но в версии 2007 он делает это очень странно. Например, если просто открыть файл через меню, то он откроется без какого-либо распознавания формата, просто как текстовый файл, целиком помещенный в первую колонку. В случае, если сделать дабл-клик на CSV, Excel получает другую команду и импортирует CSV как надо, не задавая лишних вопросов. Третий вариант — вставка файла на текущий лист. В этом интерфейсе можно настраивать разделители, сразу же смотреть, что получилось. Но одно но: работает это плохо. Например, Excel при этом не понимает закавыченных переводов строк внутри полей.
Более того, одна и та же функция сохранения в CSV, вызванная через интерфейс и через макрос, работает по-разному. Вариант с макросом не смотрит в региональные настройки вообще.
Стандарта CSV как такового, к сожалению, нет, но, между тем, существует т.н. memo. Это RFC 4180
Вот краткая выжимка рекомендаций RFC 4180 и мои комментарии в квадратных скобках:
- между строками — перевод строки CRLF [на мой взгляд, им не стоило ограничивать двумя байтами, т.е. как CRLF (0×0D, 0×0A), так и CR 0×0D]
- разделители — запятые, в конце строки не должно быть запятой,
- в последней строке CRLF не обязателен,
- первая строка может быть строкой заголовка (никак не помечается при этом)
- пробелы, окружающие запятую-разделитель, игнорируются.
- если значение содержит в себе CRLF, CR, LF (символы-разделители строк), двойную кавычку или запятую (символ-разделитель полей), то заключение значения в кавычки обязательно. В противном случае — допустимо.
- т.е. допустимы переводы строк внутри поля. Но такие значения полей должны быть обязательно закавычены,
- если внутри закавыченной части встречаются двойные кавычки, то используется специфический квотинг кавычек в CSV — их дублирование.
Вот в нотации ABNF описание формата:
file = [header CRLF] record *(CRLF record) [CRLF] header = name *(COMMA name) record = field *(COMMA field) name = field field = (escaped / non-escaped) escaped = DQUOTE *(TEXTDATA / COMMA / CR / LF / 2DQUOTE) DQUOTE non-escaped = *TEXTDATA COMMA = %x2C DQUOTE = %x22 LF = %x0A CRLF = CR LF TEXTDATA = %x20-21 / %x23-2B / %x2D-7E
Также при реализации формата нужно помнить, что поскольку здесь нет указателей на число и тип колонок, поскольку нет требования обязательно размещать заголовок, здесь есть условности, о которых необходимо не забывать:
- строковое значение из цифр, не заключенное в кавычки может быть воспринято программой как числовое, из-за чего может быть потеряна информация, например, лидирующие нули,
- количество значений в каждой строке может отличаться и необходимо правильно обрабатывать эту ситуацию. В одних ситуациях нужно предупредить пользователя, в других — создавать дополнительные колонки и заполнять их пустыми значениями. Можно определиться, что количество колонок задается заголовком, а можно добавлять их динамически, по мере импорта CSV,
- Квотить кавычки через «слэш» не по стандарту, делать так не надо.
- Поскольку типизации полей нет, нет и требования к ним. Разделители целой и дробной частей в разных странах разные, и это приводит к тому, что один и тот же CSV, сгенрированный приложением, в одном экселе «понимается», в другом — нет. Потому что Microsoft Office ориентируется на региональные настройки Windows, а там может быть что угодно. В России там указано, что разделитель — запятая,
- Если CSV открывать не через меню «Данные», а напрямую, то Excel лишних вопросов не задает, и делает как ему кажется правильным. Например, поле со значением 1.24 он понимает по умолчанию как «24 января»
- Эксель убивает ведующие нули и приводит типы даже тогда, когда значение указано в кавычках. Делать так не надо, это ошибка. Но чтобы обойти эту проблему экселя, можно сделать небольшой «хак» — значение начать со знака «равно», после чего поставить в кавычках то, что необходимо передать без изменения формата.
- У экселя есть спецсимвол «равно», который в CSV рассматривается как идентификатор формулы. То есть, если в CSV встретится =2+3, он сложит два и три и результат впишет в ячейку. По стандарту он это делать не должен.
Пример валидного CSV, который можно использовать для тестов:
Фамилия, Имя, Адрес, Город/штат, индекс, просто строка Иванов,Иван, Ленина 20, Москва, 08075, "1/3" Tyler, John,110 terrace, PA,20121, "1.24" "Петров ""Кул""", Петя,120 Hambling St., NJ,08075, "1,24" Смирнов,Вася,"7452 Street ""Near the Square"" road", York, 91234, "3-01" ,Миша,,Ленинград, 00123, "03-01" "Джон ""Черная голова"", Клод",Рок,"", Маями бич,00111, "0000" Сергей,,
точно такой же SCSV:
Фамилия; Имя; Адрес; Город/штат; индекс; просто строка Иванов;Иван; Ленина 20; Москва; 08075;"1/3" Tyler; John;110 terrace; PA; 20121;"1.24" "Петров ""Кул"""; Петя;120 Hambling St.; NJ;08075;"1,24" Смирнов;Вася;"7452 Street ""Near the Square"" road"; York; 91234;"3-01" ;Миша;;Ленинград; 00123;"03-01" "Джон ""Черная голова""; Клод";Рок;""; Маями бич;00111; "0000" Сергей;;
Первый файлик, который реально COMMA-SEPARATED, будучи сохраненным в .csv, Excel-ом не воспринимается вообще.
Второй файлик, который по логике SCSV, экселом воспринимается и выходит вот что:
Ошибки Excel-я при импорте:
- Учлись пробелы, окружающие разделители
- Последний столбец вообще толком не распознался, несмотря на то, что данные в кавычках. Исключение составляет строка с «Петровым» — там корректно распозналось 1,24.
- В поле индекс Excel «опустил» ведущие нули.
- в самом правом поле последней строки пробелы перед кавычками перестали указывать на спецсимвол
Если же воспользоваться функционалом импорта (Данные -> Из файла) и обозвать при импорте все поля текстовыми, то будет следующая картина:
С приведением типов сработало, но зато теперь не обрабатываются нормально переводы строк и осталась проблема с ведущими нулями, кавычками и лишними пробелами. Да и пользователям так открывать CSV крайне неудобно.
Есть эффективный способ, как заставить Excel не приводить типы, когда это нам не нужно. Но это будет CSV «специально для Excel». Делается это помещением знака «=» перед кавычками везде, где потенциально может возникнуть проблема с типами. Заодно убираем лишние пробелы.
Фамилия;Имя;Адрес;Город/штат;индекс;просто строка Иванов;Иван;Ленина 20;Москва;="08075";="1/3" Tyler; John;110 terrace;PA;="20121";="1.24" "Петров ""Кул""";Петя;120 Hambling St.;NJ;="08075";="1,24" Смирнов;Вася;"7452 Street ""Near the Square"" road";York;="91234";="3-01" ;Миша;;Ленинград;="00123";="03-01" "Джон ""Черная голова"";Клод";Рок;"";Маями бич;="00111";="0000" Сергей;;
И вот что случаеся, если мы открываем этот файлик в экселе:
Резюмирую.
Чтобы сгенерировать такой CSV, которым можно было бы пользоваться, пользователю нужно дать возможность сделать следующие настройки перед экспортом:
- выбрать кодировку. Как правило, важно UTF-8, UTF-16, Windows-1251, KOI8-R. Чаще всего, других вариантов нет. Одна из них должна идти по умолчанию. В случае, если данные содержат символы, не имеющие аналогов в целевой кодировке, нужно предупреждать пользователя, что данные будут битые;
- выбрать разделитель между полями. Варианты — табуляция, запятая, точка с запятой. По умолчанию — точка с запятой. Не забыть, что если разделитель вводится в тексте, то будет очень непросто ввести туда табуляцию, это еще и непечатный символ;
- выбрать разделитель между строками (CRLF 0×0D 0×0A или CR 0×0D);
- выбрать разделитель целой и дробной части для числовых данных (точка или запятая).
- выбрать, выводить ли строку заголовка;
- выбрать, каким образом осуществлять квотинг спецсимволов (особенно переводов строк и кавычек). В принципе, можно отступиться от стандарта и квотировать их как n и ", но нужно в этом случае не забыть квотировать сами n, если они встретятся и не забыть сделать это опцией при экспорте-импорте. Но совместимость пойдет лесом, потому что любой RFC-стандартный парсер конструкцию …,"abc«",… посчитает за ошибку;
- совсем в идеале — поставить галочку «для Excel» и учитывать там те нестандартности, которые внесла Майкрософт. К примеру, заменять значения числовых полей, «похожих на дату», на конструкцию ="<значение поля>«.
- определиться, нужно ли оставлять «хвост» из пустых разделителей, если он образуется. Например, из 20 полей только первое содержит данные, а остальные пустые. В итоге, в строке можно либо ставить после первого 19 разделителей, либо не ставить. Для больших объемов данных это может спасти миллисекунды обработки и уменьшить размер файла.
Чтобы построить хороший и удобный импортер CSV, необходимо помнить о следующем:
- разбор файла нужно делать по лексемам в соответствии с грамматикой выше или пользоваться хорошо зарекомендовавшими себя готовыми библиотеками (Excel работает иначе, потому с импортом проблема);
- предоставлять пользователю возможность выбрать кодировку (топ 4 достаточно);
- предоставлять пользователю возможность выбрать разделитель между полями (запятая, табуляция, точка с запятой достаточно);
- предоставлять пользователю возможность выбрать разделитель между строками, но кроме вариантов CR и CRLF нужно предусмотреть «CR или CRLF». Это связано с тем, что, например, Excel при экспорте таблицы с переводами строк внутри ячеек экспортирует эти переводы строк как CR, а остальные строки разделяет CRLF. При этом при импорте файла ему все равно, CR там или CRLF;
- предоставлять пользователю возможность выбрать разделитель между целой и дробной частей (запятая или точка);
- определиться с методом разбора — сначала читаем все в память, потом обрабатываем или обрабатываем строку за строкой. В первом случае может понадобиться больше памяти, во втором случае — ошибка в середине вызовет только частичный импорт, что может вызвать проблемы. Предпочительнее первый вариант.
Рауф Алиев,
заместитель технического директора Mail.Ru Group
habr.com
Иногда возникает необходимость работы с файлами, которые имеют расширение *.csv
Что такое csv файл?
Это текстовый файл, в котором содержится информация.
Каждая строка — это отдельная строка таблицы, а столбцы отделены один от другого специальными символами — разделителями (например, запятой).
В последнее время разделителем может быть не только запятая, но и другие символы (пробел, точка с запятой, табуляция, другое).
Пример файла CSV- формата:
После преобразования в табличный вид будет выглядеть так:
Теперь рассмотрим три способа преобразования CSV формата в «табличное» представление.
Зайдем в модуль Ученики, выделим несколько учеников установив флажок напротив необходимой записи зайдем в Действие и выберем Экспортировать.
Получим файл с расширением csv.
Открыв его в excel, мы увидим не очень «дружелюбное» представление информации
Способ №1:
Выделяем весь первый столбец, переходим во вкладку «Данные» и выберем пункт «Текст по столбцам»
Далее проходим три шага согласно подсказкам.
Выбираем знак табуляции
На третьем шаге, вы сможете для каждого столбца выбрать необхоимый формат.
После нажатия кнопки «Готово», получаем «читабельный табличный» формат файла.
Способ №2:
Можем воспользоваться таким свободным и открытым офисным пакетом как Apache OpenOffice (Не реклама).
Для этого необходимо открыть файл CSV формата с помощью OpenOffice.
При открытии файла, OpenOffice, предложит импортировать текст в «читаемый табличный» вид.
В «Параметры разделителя» выбираем несколько вариантов (табуляция, точка с запятой, запятая…) и нажимаем кнопку «Ок». Файл будет преобразован в «табличный» вид.
Способ №3:
И еще один вариант преобразования, это открыть файл в любом текстовом редакторе
например в Блокноте. Первой строкой прописываем «sep=»
и сохраняем файл.
Теперь открыв файл в excel
получаем «читабельный текстовый» формат файла.
tallanto.com
Программа 1: Microsoft Excel
Файл с расширением CSV хранит в себе данные, заключенные в табличный формат. Исходя из этого можно сделать вывод, что с ним взаимодействуют табличные редакторы. И это верный вывод. Именно поэтому при возникновении вопроса: «Чем открыть CSV?», большинство пользователей предлагают использовать один из самых популярных табличных редакторов — MS Excel.
Итак, перейдем непосредственно к тому, как открыть CSV в Excel:
- Откройте приложение и на главном окне нажмите по вкладке «Файл».
- В появившемся интерфейсе нажмите по пункту «Открыть». К слову, для вызова функции «Открыть» можно использовать сочетание горячих клавиш Ctrl+O.
- Откроется окно файлового менеджера, в котором вам необходимо перейти в папку с файлом CSV, выделить его и нажать кнопку «Открыть».
- Выбранный вами файл сначала запустится в «Мастере текстов», в котором необходимо будет произвести настройку некоторых параметров перед вставкой данных в книгу Excel.
- Сначала вам необходимо поставить отметку напротив пункта «с разделителями», который находится в области «Формат исходных данных».
- Затем вам нужно выбрать непосредственно кодировку, которая будет использоваться для расшифровки данных файла. В нашем регионе применяется кодировка «Юникод (UYF-8)». Выберите ее из списка «Формат файла».
- Нажмите кнопку «Далее».
- На втором этапе в Мастере текстов вам необходимо определиться с символом-разделителем, выбрав или точку с запятой, или запятую. Дело в том, что от этого будет зависеть корректность отображения добавляемой таблицы. Проще всего это сделать ориентируясь на образец, который приведен в нижней части окна. Выберите один из представленных пунктов и нажмите «Далее».
- На третьем шаге вам будет предложено задать формат каждому столбцу отдельно. На самом деле в этом нет необходимости, так как на отображение данных это никак не повлияет, поэтому нажмите «Готово».
- Появится новое окно, в котором вам необходимо выбрать область, в которую будет вставлена добавляемая таблица. Обычно выделяют ячейку «A1» и нажимают кнопку «OK».
После этого содержимое файла будет вставлено в таблицу. Теперь вы знаете, чем открыть CSV. Но это только одна программа, переходим к следующей.
Программа 2: LibreOffice Calc
На втором месте по популярности среди табличных редакторов программа LibreOffice Calc. Конечно, процесс открытия CSV в ней мало чем отличается от предыдущей программы, но описать его все же стоит.
- Запустите приложение и в главном меню нажмите по кнопке «Открыть файл». Также это действие можно произвести, нажав Ctrl+O.
- Появится окно файлового менеджера. В нем вам нужно выбрать файл CSV и нажать кнопку «Открыть».
- Появится окно, подобное Мастеру текстов в Excel, только вместо разделения всех действий на три этапа, все действия производятся в одном окне.
- В области «Импорт» выберите следующие параметры: «Кодировка» — «Юникод (UTF-8); «Язык» — «Русский»; «Со строки» — «1».
- В области «Параметры разделителя» укажите пункт «Разделитель» и выберите «Запятая» или «Точка с запятой», как было рассказано выше, в зависимости от используемого разделителя в тексте файла.
- Нажмите «ОК».
Таблица будет вставлена. Итак, вы узнали второй метод, чем открыть CSV, теперь перейдем к третьему.
Программа 3: «Блокнот»
Как бы странно это ни звучало, но формат CSV можно открыть даже в «Блокноте». Как говорилось в начале статьи, это файл текстового формата, соответственно, вы можете его открыть в текстовом редакторе. Итак, вот, что нужно сделать:
- Запустите «Блокнот» и нажмите Ctrl+O.
- В «Проводнике» выберите файл.
- После этого он будет открыт в программе.
Вот так просто можно открыть CSV в обычном «Блокноте».
Заключение
Теперь вы знаете, чем открыть файл CSV — на выбор есть три программы. Ну, а в целом, можно сказать следующее: CSV-формат открывается в текстовых редакторах и табличных программах.
fb.ru
Формат CSV
Формат CSV ― это текстовый формат, предназначенный для представления табличных данных. Первая строка содержит названия столбцов, а следующие строки ― сами данные. Содержимое столбцов отделяется друг от друга запятой.
Данные в файле должны быть в кодировке UTF-8.
Скачать пример CSV-файла
Для просмотра примера в LibreOffice необходимо сделать импорт текста. При этом выберите кодировку UTF-8, разделитель ― «запятая», разделитель текста ― « «(двойные кавычки)».
Для просмотра примера в Excel сохраненный файл откройте через меню Данные → Получение внешних данных → Из текста. Выберите кодировку UTF-8, разделитель «запятая», ограничитель строк «»(двойные кавычки)».
- Описание элементов
Подготовка файла
Чтобы настроить автоматическое ежедневное обновление данных о ваших филиалах:
-
Подготовьте файл в формате CSV. Данные должны быть в кодировке UTF-8.
-
Выложите файл на свой сайт по обновляемой ссылке.
Данные должны быть доступны по протоколу FTP, HTTP или HTTPS.
Загрузка файла в интерфейсе
На странице сети в Загрузка филиалов файлом нажмите кнопку Добавить. В открывшемся окне укажите ссылку на подготовленный файл, выберите тип «csv» и нажмите Проверить. Проверка файла может занять несколько минут.
Если проверка прошла успешно, кнопка Результаты проверки будет отмечена зеленым. Нажмите ее и в открывшемся окне проверьте изменения в филиалах. На карте может быть показано до 50 филиалов с изменениями. Нажмите Сохранить. Данные из файла будут загружены в базу Справочника. При большом объеме данных загрузка может занять от нескольких часов до суток.
Если в результате проверки будут обнаружены ошибки, кнопка Результаты проверки будет отмечена красным. Исправьте ошибки и снова отправьте файл на проверку.
Чтобы посмотреть изменения в филиалах, переданных через файл, нажмите История загрузок. Кнопка будет доступна через сутки после первой загрузки.
Данные будут обновляться раз в сутки автоматически, если вы не отключите регулярную загрузку. Для этого установите переключатель около Загрузка филиалов файлом в положение Выкл.
Для однократного обновления данных сохраните файл в формате CSV или XSLX и передайте с помощью формы. Укажите в сообщении актуальный электронный адрес и телефон вашей организации. Если у нас возникнут вопросы по загруженному файлу, мы свяжемся с вами.
Новые данные появятся на Яндекс.Картах в течение семи дней после загрузки правильно оформленного файла.
yandex.ru
Формат CSV
Главная → Справка → Экcпорт и импорт товаров
Общие данные
Для понимания процесса импорта/синхронизации
Для работы понадобиться программа работы с таблицами (Microsoft Excel, Apple Numbers, OpenOffice Calc или любая другая программа которая может сделать экспорт в формат CSV ).
В вашей программе вы должны создать таблицу со столбцами в которых содержатся значения ваших будущих товаров.
Пример таблицы :
articul | name | price | vendor | country | images |
UX31E | ASUS ZENBOOK | 44400 | Asus | Китай | http://shopexpress.difocus.ru/alboms/3/3/zenbook.jpg |
MBA-123 | 13-inch MacBook Air | 45000 | Apple | Китай | http://shopexpress.difocus.ru/alboms/3/3/apple-air-13.jpg |
HD-8838 | Philips Saeco HD 8838 | 27462 | Philips | Россия | http://shopexpress.difocus.ru/alboms/3/3/saeco-hd-8838.jpg |
HD-8838 | Delonghi ECAM 23.210 | 27462 | Delonghi | Италия | http://shopexpress.difocus.ru/alboms/3/3/delonghi.jpg |
В самой первой строке нашей таблицы обязательно использование названий полей для наших товаров. У нас это articul — артикул, name — название товара, price — цена, vendor — производитель, country — страна производства, images — путь к изображению(подробности ниже).
Обязательное поле для создания товаров одно:
- name — название.
- price — цена,
- articul — артикул.
Другие поля товаров можно выбрать произвольно из общего количества полей. (В редакторе типов вы можете добавить новые поля для ваших товаров или других объектов.)
Вы можете указывать названия столбцов, чтобы внести или изменить значения:
- info:url — поле для Подстрока URL;
- info:name — поле для Название объекта в системе;
- info:sort — поле для сортировки объектов внутри раздела;
- info:access — поле для указания прав доступа (например: 7733);
- info:template — поле для Шаблон вывода, индексы шаблона вывода можно посмотреть тут;
- info:delete — поле для удаления товара, создайте столбец и заполните ячейку товара произвольными данными, чтобы удалить его во всемя импорта.
Список полей товара можно увидеть так, нажать «Параметры» → «Типы объектов» → «Товар».
В нашем редакторе таблица выглядит так :
После того, как таблица заполнена, экспортируйте ее в формат CSV. И сохраните файл, например на рабочем столе.
В формате CSV, если файл открыть с помощью Блокнота, таблица будет выглядеть так :
articul;name;price;vendor;country;images UX31E;ASUS ZENBOOK;44400;Asus;Китай;http://shopexpress.difocus.ru/alboms/3/3/zenbook.jpg MBA-123;13-inch MacBook Air;45000;Apple;Китай;http://shopexpress.difocus.ru/alboms/3/3/apple-air-13.jpg HD-8838;Philips Saeco HD 8838;27462;Philips;Россия;http://shopexpress.difocus.ru/alboms/3/3/saeco-hd-8838.jpg HD-8838;Delonghi ECAM 23.210;27462;Delonghi;Италия;http://shopexpress.difocus.ru/alboms/3/3/delonghi.jpg
При импорте из CSV вы можете указать:
- Раздел товара (любой уровень), если раздел не существует, он будет создан;
- Параметры товара;
- Путь к изображениям товара (изображения должны находится в одном zip-архиве с файлом CSV);
- Cпецификаций;
- Скидки;
- Размеры.
Требования и возможности:
- Наименования товаров должны быть разные:
- Если товар с указанным наименованием уже находится в разделе, он будет пропущен;
- Если в файле для импорта присутствуют товары с одинаковыми названиями в одном разделе, товарам будут присвоены индексы «Наименование {X}», где {X} — порядковый номер начиная с 1(единицы).
- Файл CSV в архиве должен быть один и находиться в корне архива;
- Изображения для выгрузки должны быть запакованы вместе с файлом CSV, кроме изображений с указанием URL;
- Количество разделов и товаров в CSV не более 5000;
- Формат CSV не поддерживает переходы строк, поэтому данные или текст внутри ячейки с использованием перехода строки будут неверно интерпретированы;
- В качестве разделителей в формате CSV используется точка с запятой «;», поэтому использование этого символа в тексте становится невозможным;
- Общий вес архива не должен превышать 64Мб для тарифов Эконом и Стандарт, 128Мб для тарифов Люкс и Максимум. Во время бесплатного пользования действует ограничение 3Мб.
Совет: Создайте несколько товаров, заполнив все поля, и воспользуйтесь функцией экспорта в формате CSV. Откройте файл в редакторе и вы узнаете какие данные необходимо использовать в ячейках таблицы.
Пример подготовленного CSV файла для импорта с изображениями можно скачать здесь.
Импорт товаров
Перейдите в систему управления сайтом и нажмите правой кнопкой мышки на нужный раздел, как будто вы собираетесь создать один новый товар, затем «Создать» → «Импорт». Появится окно с предложением ввести файл и тип файла. Нажмите «Добавить» и выберите тип файла «CVS». Нажмите «Импортировать».
Если все действия выполнены верно вы увидите, следующее окно.
Синхронизация товаров
Для синхронизации товаров сначала их нужно экспортировать.
Вы скачаете файл примерно такого содержания.
Это файл в формате CSV. Откройте его программой для работы с таблицами ( Microsoft Excel, Apple Numbers или OpenOffice Calc ). Столбец UniqueKey — содержит уникальный идентификатор товара в системе управления. Вы можете менять все значения товара, кроме этого значений в ячейках столбца UniqueKey.
Если вы очистите ячейку с идентификатором товара — он будет заново создан,
с названием «Копия (N) {Название}«, где {Название} — его название из колонки name, а N — номер копии.
Исправленный файл в формате CSV импортируйте в систему управления, как было описано выше. Товары содержащие запись UniqueKey — обновят свои данные, товары с пустой ячейкой UniqueKey будут созданы.
Если вы не редактировали и не собирались редактировать значения какого-либо столбца, его можно удалить из файла для импорта. Это ускорит загрузку файла и время импорта, т.к. не будут обрабатываться лишние данные.
Например, если вы хотели изменить только цену товаров, в файле импорта необходимо оставить только столбцы price и UniqueKey, остальные столбцы нужно удалить(вместе с заголовком столбца, т.е. целиком удалить столбец).
Внимание! При синхронизации товаров вы можете указать раздел, где будет размещен товар. В таком случае импортируйте файл в ту папку, относительно которой вы указали размещение товара.
shopexpress.difocus.ru