Переводчик CSV
Каталоги продукции, экспорт и наборы данных, переведенные столбец за столбцом, с разделителями, кавычками и столбцами идентификаторов, оставленными точно так, как ожидает ваш парсер.
Загрузите или перетащите документ для перевода
Макс. размер файла 1 GB
Структура поддерживается двумя символами
Значения, разделенные запятыми, — это едва ли формат. Существует широко распространенное описание общего диалекта, но ни один орган не обеспечивает его соблюдение, поэтому то, что вы фактически получаете, — это одна из нескольких конвенций. Вся сетка основана на двух решениях: какой символ разделяет поля в записи и какая последовательность завершает запись. Ошибитесь в любом из них, и аккуратная таблица превратится в одну неровную колонку.
Разделитель не всегда запятая. Программное обеспечение для работы с электронными таблицами в странах, где десятичные дроби записываются с помощью запятой, по умолчанию использует точку с запятой, поэтому экспорт с немецкой или французской машины часто не открывается корректно в других местах. Табуляция и вертикальная черта также широко используются, обычно выбираются именно потому, что контент полон запятых.
Каждая запись должна содержать столько же полей, сколько и заголовок, потому что это количество — это то, как парсер знает, какое значение принадлежит какому столбцу. Ничто в данных не объявляет об этом. Это инвариант, который либо выполняется, либо молча перестает выполняться на середине большого экспорта, после чего все нижележащее смещается на один столбец влево и выглядит правдоподобно.
Четыре способа, которыми перевод текста нарушает запись
Это сбои, которые не объявляют о себе. Экспорт все еще открывается, количество строк все еще выглядит примерно правильным, а повреждение проявляется позже в том, что потребляет данные.
- Новый разделитель появляется внутри значения. Английское описание продукта без запятых становится французским с двумя. Если поле не было заключено в кавычки раньше, теперь оно должно быть, иначе парсер читает одно значение как три и смещает все столбцы после него.
- Кавычка попадает внутрь заключенного значения. Внутри заключенного поля буквальная двойная кавычка должна быть написана дважды, чтобы экранировать себя. Языки, которые заключают в кавычки разными знаками, и любой процесс, который преобразует прямые кавычки в типографские, могут оставить незаэкранированный символ посреди значения, где он преждевременно завершает поле.
- Перенос строки попадает в ячейку. Запись заканчивается переносом строки, если только этот перенос строки не находится внутри кавычек. Переведенный маркетинговый текст, в котором появляется разрыв абзаца, разделит одну запись на две, и вторая половина будет иметь неправильное количество полей.
- Переводится заполнитель. Строки, предназначенные для программного обеспечения, часто содержат токены подстановки: знак процента, за которым следует буква, пронумерованное поле в скобках, именованная переменная. Это адреса для значений, вставляемых во время выполнения, а не слова, и перевод одного из них означает, что значение никогда не появится.
Половина ваших столбцов — это не язык
Набор данных смешивает прозу, предназначенную для людей, с ключами, предназначенными для машин, и они находятся рядом, и ничто не отличает их, кроме заголовка столбца. Определите, что есть что, прежде чем начать, потому что переведенный идентификатор хуже, чем непереведенное описание.
Оставьте это в покое
- Сама строка заголовка, где заголовки — это имена полей, используемые кодом, а не метки, отображаемые человеку
- Коды товаров, номера каталогов, уникальные идентификаторы и все, что используется в качестве ключа для соединения двух наборов данных
- Веб-адреса и часть URL-адреса, поскольку изменение этого нарушает ссылку и ее рейтинг
- Значения состояния, которые программное обеспечение сравнивает с фиксированным списком, такие как статус заказа или флаг да/нет
- Коды стран, языков и валют, которые уже являются стандартизированными сокращениями
- Даты в порядке год-месяц-день, числа и все, что будет разобрано, а не прочитано
Это то, ради чего вы пришли
- Названия продуктов и подробные описания, которые обычно составляют большую часть объема текста
- Названия категорий и коллекций, как их видят покупатели
- Значения атрибутов, имеющие смысл, такие как цвет, материал или размер
- Строки интерфейса, извлеченные для локализации, за вычетом их плейсхолдеров
- Тела статей поддержки, стандартные ответы и шаблоны электронной почты, хранящиеся в виде строк
- Заголовки столбцов, когда экспорт предназначен для открытия человеком, а не программой
Две вещи, которые повреждают данные до начала перевода
Открытие в электронных таблицах
Двойной щелчок по экспорту и его повторное сохранение — самый надежный способ испортить каталог. Программное обеспечение для работы с электронными таблицами угадывает тип каждого значения, и его предположения уверенны и ошибочны:
- Артикул из тринадцати цифр превращается в научную нотацию и навсегда теряет последние цифры
- Почтовый индекс, начинающийся с нуля, теряет этот ноль
- Все, что похоже на день и месяц, перезаписывается как дата в локальном формате
- Длинные идентификаторы более пятнадцати цифр округляются без уведомления
Если вам нужно сначала проверить данные, используйте диалоговое окно импорта и установите столбцы идентификаторов как текст, а не позволяйте программе решать за вас. Еще лучше — загрузите экспорт точно так, как его произвела ваша система.
Вопрос о метке порядка байтов
Ничто внутри данных не указывает на используемую кодировку символов, поэтому маркер из трех байтов иногда помещается в самое начало, чтобы сигнализировать об одной из них. Этот маркер помогает и мешает в зависимости от того, что откроет данные дальше.
Программное обеспечение для работы с электронными таблицами в Windows использует его для распознавания содержимого Unicode, и без него акцентированные и нелатинские символы отображаются как строки символов. Многие библиотеки программирования, напротив, не удаляют его, поэтому заголовок первого столбца поступает с тремя невидимыми символами, приклеенными к началу, и каждый поиск по этому заголовку не удается.
Решайте в зависимости от назначения: сохраните маркер, если результат будет открыт человеком в электронных таблицах, удалите его, если данные будет читать программа. Ответ почти на каждый вопрос о поврежденных акцентированных символах находится где-то в этом абзаце.
Сколько стоит обработка набора данных
Цена зависит от объема текста, поэтому широкий каталог с короткими значениями дешевле узкого, полного длинных описаний.
Free
Карта не требуется для регистрации
- 0,005 $/слово AI-перевод
- 1 доллар за страницу для сканов и PDF-изображений
- 120+ языков
- Файлы до 20 МБ и 20 страниц
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG и CSV
- Только 24-часовое хранение файлов
- Редактор PDF и конвертер PDF в DOCX
- Отмена в любое время
- Не включено: Поддержка по электронной почте
- Не включено: Доступ для команды
- Не включено: Неограниченные бесплатные предварительные просмотры PDF
- Не включено: Глоссарий
Storage
или 149 долларов в год
- 0,005 $/слово AI-перевод
- 1 доллар за страницу для сканов и PDF-изображений
- 120+ языков
- Файлы до 100 МБ и 100 страниц
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG и CSV
- Неограниченное хранилище файлов
- Редактор PDF и конвертер PDF в DOCX
- Поддержка по электронной почте
- Отмена в любое время
- Не включено: Доступ для команды
- Не включено: Неограниченные бесплатные предварительные просмотры PDF
- Не включено: Глоссарий
Pro
или 499 долларов в год
- ИИ-перевод 0,004 доллара за слово
- 0,80 доллара за страницу для сканов и PDF-изображений
- 120+ языков
- Файлы до 1000 МБ и 5000 страниц
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG и CSV
- Неограниченное хранилище файлов
- Редактор PDF и конвертер PDF в DOCX
- Поддержка по электронной почте
- Доступ для команды до 5 участников
- Неограниченные бесплатные предварительные просмотры PDF
- Глоссарий
- Отмена в любое время
Для бизнеса
149,99 долларов в месяц, по запросу. ИИ-перевод по цене 0,003 доллара за слово (0,60 доллара за страницу), файлы до 1000 МБ и 5000 страниц, неограниченное хранилище файлов и доступ для команды до 15 участников.
Строки на входе, строки на выходе
Увеличьте миниатюру, чтобы сравнить исходную страницу с результатом. Что демонстрируют пары:
- Количество столбцов на запись остается неизменным сверху вниз.
- Значения, заключенные в кавычки, по-прежнему заключены в них.
- Коды, ключи и числовые значения проходят без изменений.
- Только читаемые человеком столбцы возвращаются на новом языке.




Ничто здесь не открывалось в электронных таблицах между двумя состояниями.
Посмотреть все примеры переводов →Рабочий процесс, который избегает переделок
Локализация каталога — это конвейер, и дорогие ошибки происходят на его концах, а не в середине.
- 1
Чистый экспорт и указание диалекта
Возьмите экспорт непосредственно из системы, которой принадлежат данные. Откройте его один раз в простом текстовом редакторе, а не в электронных таблицах, и отметьте, какой символ разделяет поля и заключены ли значения в кавычки.
- 2
Отметьте столбцы, которые не нужно изменять
Идентификаторы, ключи, ссылки, значения статусов и коды. Если экспорт очень широкий, часто быстрее сократить его до столбцов, содержащих текст, и затем снова соединить по ключу.
- 3
Загрузка и выбор языков
Создайте учетную запись с адресом электронной почты, загрузите данные и укажите исходный и целевой языки. Загрузка данных объемом до 1 ГБ позволяет обработать весь каталог как одну задачу, а не разбивать на части.
- 4
Повторно импортируйте сначала в промежуточную копию
Загрузите результат в тестовую среду перед производством. Проверьте количество записей по сравнению с оригиналом, просмотрите самые длинные переведенные значения на предмет проблем с макетом и убедитесь, что акцентированные символы пережили передачу.
Вопросы от людей с наборами данных
Изменится ли разделитель, если я переведу на язык, использующий десятичные запятые?
Разделитель, который вы использовали при загрузке, будет и разделителем, который вы получите обратно. Его изменение означало бы переписывание структуры, а не содержания, и это нарушило бы работу всего, что обрабатывает данные на другом конце. Если вам нужен именно вариант с разделителем-точкой с запятой, потому что результат будет открыт в электронной таблице на настроенном таким образом компьютере, преобразуйте его после перевода с помощью инструмента, который понимает оба диалекта.
Как мне предотвратить перевод кодов продуктов и идентификаторов?
Держите их в четко обозначенных столбцах и, где возможно, отправляйте на обработку только столбцы с текстом, а затем объединяйте по ключу. Значения, которые явно являются кодами, а не словами, остаются без изменений, но самый надежный вариант — это тот, где неоднозначность никогда не возникает. Никогда не позволяйте электронной таблице касаться этих столбцов в процессе, потому что она переформатирует их независимо от перевода.
Мои символы с диакритикой вернулись в виде строк символов. Что произошло?
Это несоответствие кодировки, а не проблема перевода. Результат почти наверняка является правильной кодировкой Unicode, считываемой чем-то, ожидающим устаревшую однобайтовую кодировку, или наоборот. Откройте его в текстовом редакторе, который позволяет явно выбрать кодировку, и убедитесь в том, что у вас действительно есть, прежде чем предполагать, что что-то было утеряно. Если конечным пунктом является электронная таблица, маркер порядка байтов в начале обычно определяет это.
Что происходит со значениями, содержащими запятые или переносы строк?
Они остаются в кавычках. Любое значение, содержащее разделитель, кавычку или перевод строки, должно быть заключено в кавычки, а буквальная кавычка внутри такого значения должна быть удвоена. Поскольку переведенный текст может приобретать знаки препинания, которых не было в оригинале, такое заключение должно применяться к результату, а не копироваться из источника.
Сохранятся ли заполнители и переменные токены?
Они должны сохраниться, и стоит проверить образец. Токены, такие как знак процента, за которым следует буква, пронумерованное поле в скобках или именованная переменная, являются адресами для значений, вставляемых во время выполнения. Перевод одного из них означает, что значение никогда не достигнет экрана, поэтому перед отправкой проверьте несколько самых длинных строк интерфейса в выходных данных.
Мои строки становятся намного длиннее на немецком языке. Имеет ли это значение здесь?
Не для самих данных, у которых нет ширины. Это имеет значение для того, что их отображает. Увеличение на пятую или треть по сравнению с английским является нормальным для немецкого и русского языков, в то время как китайский и японский обычно сжимаются. Отсортируйте переведенный столбец по длине и посмотрите на крайние значения относительно вашего собственного макета, а также проверьте любой столбец базы данных с фиксированным ограничением символов.
Какой объем набора данных я могу отправить за один раз?
До 1 ГБ или пяти тысяч страниц эквивалентного контента в планах Pro и Enterprise. Этого достаточно для каталогов с сотнями тысяч строк. Отправка всего как одного задания также лучше для единообразия, поскольку термин, который появляется в строке 12 и строке 90 000, обрабатывается одинаково.
За что я плачу при широком экспорте?
Текст, а не сетка. Пустые ячейки, числовые столбцы и столбцы идентификаторов не являются прозой. Каждый файл оплачивается отдельно, поскольку ни один план не включает пакет слов: полцента за слово на Free и Storage, $0.004 на Pro и $0.003 на Enterprise, с минимумом $0.99. Это позволяет легко оценить стоимость большого каталога по количеству слов.
Отправьте экспорт, сохраните структуру
Загрузите данные точно так, как их произвела ваша система, выберите целевой язык и получите таблицу с одинаковым количеством столбцов в каждой записи, а ключи останутся пригодными для соединения.
Наши партнеры
Связанные услуги перевода
Форматы файлов
Инструменты для работы с PDF
