Переводчик TXT
Простой текст не содержит разметки для защиты и не имеет схемы для следования, что делает его самым простым для перевода и самым легким для незаметного испорчения. Загружайте рукописи, заметки, стенограммы или экспорты и получайте их обратно с сохранением кодировки символов, переносов строк и отступов.
Загрузите или перетащите документ для перевода
Макс. размер файла 1 GB
Расширение почти ничего не обещает
Каждый другой формат документа несет описание самого себя. Документ текстового процессора называет свои шрифты и объявляет свою кодировку символов. Страница разметки оборачивает свое содержимое тегами, которые говорят, что есть каждая часть. Простой текст ничего из этого не объявляет. Это последовательность байтов с соглашением, что кто-то прочитает их как символы, и все соглашение неписано.
Поэтому три вещи приходится выяснять, а не читать: к какой кодировке относятся байты, какую последовательность автор использовал для окончания строки, и имеют ли переносы строк смысл или просто являются шириной окна редактора. Программное обеспечение угадывает все три каждый раз, когда вы открываете такой документ, и обычно угадывает правильно, именно поэтому сбои бывают неожиданными, когда они случаются.
Обратная сторона реальна. Нет стилей для сохранения, нет движка макета для борьбы, нет встроенных объектов для потери. Если кодировка и структура строки выживают, все выживает. Остальная часть этой страницы посвящена этим двум вещам.
Что люди на самом деле хранят в простом тексте
Расширение прикрепляется к вещам, которые вообще не являются прозой, и каждая из них требует особого ухода. Знание того, что вы держите, решает, займет ли работа минуту или потребует подготовки.
- Сплошная проза. Рукописи, заметки, черновики статей, стенограммы интервью, извлеченные тексты статей. Это прямой случай, и единственное, на что стоит обратить внимание, — это разделены ли абзацы пустой строкой или ничем.
- Субтитры и подписи. Нумерованные метки, строка времени и одна или две строки диалога. Временные метки — это координаты, и их необходимо точно воспроизвести, а строки диалога должны оставаться достаточно короткими, чтобы их можно было прочитать на скорости, что важно, поскольку переведенные строки часто длиннее тех, которые они заменяют.
- Списки настроек и свойств. Ключ, разделитель и значение в каждой строке. Ключ слева — это идентификатор, который программное обеспечение ищет по имени; прикосновение к нему молча отключает настройку. Только значение справа, и только там, где это значение является сообщением, а не путем или переключателем, является языком.
- Журналы и вывод машины. Временные метки, слова уровня серьезности, идентификаторы и трассировки стека. Перевод слова уровня серьезности нарушает любой фильтр, который ищет его, а трассировка стека не является прозой ни на одном языке.
- Экспорты в табличном виде под прикрытием. Значения, разделенные табуляцией, сохраненные с неправильным расширением. Если ваш контент на самом деле является сеткой, вместо этого он принадлежит переводчику CSV, который понимает записи и столбцы.
- Заметки к файлу README и лицензионный текст. Проза с заголовками, имитированными заглавными буквами и рядами тире, нумерованными пунктами и абзацами с жестким переносом. Имитированная структура — это то, что ломается.
Три невидимых свойства, которые определяют результат
Ни одно из них не видно, когда вы смотрите на контент на экране, и каждое из них может превратить хороший перевод в непригодный.
К какой кодировке относятся байты
До того, как Unicode стал стандартом, каждый языковой регион имел свою собственную однобайтовую или многобайтовую схему: отдельные для кириллицы, для западноевропейских акцентов, для греческого, для японского, для упрощенного и традиционного китайского, для корейского. Документы, написанные по этим схемам, все еще находятся в обращении, и в них ничего не говорится о том, какая схема применяется. Откройте один по неправильному предположению, и акцентированные символы превратятся в последовательность бессмыслицы, в то время как простые буквы будут выглядеть нормально, поэтому повреждение легко пропустить при беглом взгляде. Проверьте в редакторе, который позволяет явно выбирать кодировку, и открывайте снова, пока акценты и нелатинские символы не будут читаться правильно.
Как заканчивается строка
Инструменты Windows заканчивают строку двумя управляющими символами, все, что произошло от Unix, использует один, а очень старые документы Macintosh использовали только его. Большинство современных редакторов принимают все три, но множество скриптов обработки — нет, и смешивание соглашений внутри одного документа приводит к появлению посторонних знаков в конце каждой строки или к отображению документа как одного непрерывного абзаца. Придерживайтесь одного соглашения и предпочитайте то, которое ожидает система, которая будет использовать результат.
Имеет ли перенос строки какой-либо смысл
Текст, перенесенный вручную с фиксированной шириной, имеет перенос в конце каждой строки, и эти переносы являются артефактом ширины, а не частью письма. Абзац обычно отмечается пустой строкой между блоками. Обработка каждой перенесенной строки как единицы разбивает предложения на фрагменты и переводит их вне контекста, что плохо читается на любом языке. Сохранение абзаца как единицы является правильным, и это означает, что вывод будет переноситься в других местах, чем оригинал. Это ожидаемо, а не дефект.
Все, что выровнено пробелами, будет отображаться с ошибками
Почему столбцы смещаются
Без стилей единственным способом выровнять что-либо является подсчет символов. Таблицы, нарисованные с помощью вертикальных черт и тире, заголовки, подчеркнутые строками знаков равенства, журналы, заполненные пробелами, отступы и рамки, сделанные из символов рисования линий, — все это зависит от того, что каждая запись занимает одинаковую ширину, как и раньше.
Перевод меняет ширину почти всего. Немецкий и русский языки обычно длиннее английского на пятую или треть; китайский и японский языки используют меньше символов, но каждый занимает две колонки в дисплее с фиксированной шириной. В любом случае выравнивание смещается. Ожидайте, что придется переделывать таблицы, нарисованные вручную, и подумайте, не лучше ли использовать настоящую электронную таблицу.
Начальные пробелы — это контент
В файле настроек, фрагменте кода и любом плане пробелы в начале строки имеют значение: они показывают вложенность или помечают блок как литеральный. Табуляция и последовательность пробелов выглядят одинаково на экране и являются разными байтами, поэтому инструмент, который нормализует одно в другое, изменяет документ, не проявляясь.
То же самое относится к небольшим управляющим последовательностям, записываемым как обратная косая черта и буква, которые обозначают разрыв строки или табуляцию в одной строке записи настроек. Это два обычных символа, которые какая-то последующая программа интерпретирует, и они должны быть переданы на другую сторону без изменений.
Стоимость для задания в обычном тексте
Оплата производится за слова в документе, поэтому длинный журнал с небольшим количеством уникальных сообщений стоит гораздо меньше, чем предполагает его размер.
Free
Карта не требуется для регистрации
- 0,005 $/слово AI-перевод
- 1 доллар за страницу для сканов и PDF-изображений
- 120+ языков
- Файлы до 20 МБ и 20 страниц
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG и CSV
- Только 24-часовое хранение файлов
- Редактор PDF и конвертер PDF в DOCX
- Отмена в любое время
- Не включено: Поддержка по электронной почте
- Не включено: Доступ для команды
- Не включено: Неограниченные бесплатные предварительные просмотры PDF
- Не включено: Глоссарий
Storage
или 149 долларов в год
- 0,005 $/слово AI-перевод
- 1 доллар за страницу для сканов и PDF-изображений
- 120+ языков
- Файлы до 100 МБ и 100 страниц
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG и CSV
- Неограниченное хранилище файлов
- Редактор PDF и конвертер PDF в DOCX
- Поддержка по электронной почте
- Отмена в любое время
- Не включено: Доступ для команды
- Не включено: Неограниченные бесплатные предварительные просмотры PDF
- Не включено: Глоссарий
Pro
или 499 долларов в год
- ИИ-перевод 0,004 доллара за слово
- 0,80 доллара за страницу для сканов и PDF-изображений
- 120+ языков
- Файлы до 1000 МБ и 5000 страниц
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG и CSV
- Неограниченное хранилище файлов
- Редактор PDF и конвертер PDF в DOCX
- Поддержка по электронной почте
- Доступ для команды до 5 участников
- Неограниченные бесплатные предварительные просмотры PDF
- Глоссарий
- Отмена в любое время
Для бизнеса
149,99 долларов в месяц, по запросу. ИИ-перевод по цене 0,003 доллара за слово (0,60 доллара за страницу), файлы до 1000 МБ и 5000 страниц, неограниченное хранилище файлов и доступ для команды до 15 участников.
Образцы документов рядом
Нажмите на миниатюру, чтобы открыть полное представление. Чтение пары показывает:
- Разрывы абзацев и пустые строки сохраняются.
- Акцентированные и нелатинские символы отображаются, а не превращаются в символы.
- Отступы и нумерованные последовательности сохраняют свою вложенность.
- Результат открывается как редактируемый текст, а не как изображение текста.




Каждая пара была получена из одного файла без последующей ручной доработки.
Посмотреть все примеры переводов →Пять минут подготовки, затем загрузка
Почти все жалобы на перевод обычного текста сводятся к тому, что уже было в документе до его загрузки. Эти проверки выявляют все из них.
- 1
Убедитесь, что кодировка читается правильно
Откройте документ в редакторе, который показывает и позволяет изменять кодировку. Если акцентированные или нелатинские символы выглядят как последовательности несвязанных символов, вы читаете его по неправильной схеме. Исправьте это сначала и сохраните копию в Unicode, потому что никакой перевод не сможет восстановить символы, которые уже были прочитаны неправильно.
- 2
Решите, что является прозой, а что нет
Если контент состоит из настроек, журналов или субтитров, определите части, которые должны остаться нетронутыми: ключи слева от разделителя, слова уровня важности, номера реплик и строки времени. Если большая часть документа — машинный контент с небольшим количеством прозы, извлечение прозы сначала быстрее, чем исправление результата.
- 3
Создайте учетную запись и загрузите
Зарегистрируйтесь, указав адрес электронной почты, и отправьте документ. Одиночные загрузки достигают 1 ГБ, что позволяет загружать рукописи, архивы транскрипций и экспорт журналов без разделения на части.
- 4
Установите оба языка и переведите
Указание исходного языка здесь важнее, чем в форматированном документе, потому что нет разметки или метаданных, которые система могла бы вывести. Затем выберите целевой язык и начните задание.
- 5
Снова откройте результат и проверьте те же три вещи
Кодировка, окончания строк и необходимость перевыравнивания чего-либо, выровненного вручную. Если документ будет использоваться в конвейере сборки или медиаплеере, пропустите его через этот конвейер один раз, прежде чем полагаться на него.
Если ваш контент не является обычным текстом
- Переводчик CSV для табличных данных
- Переводчик JSON для структурированных строк
- Переводчик HTML для размеченных страниц
- Переводчик документов Word
- Конвертировать документ Word в текст
- Извлечь текст из PDF
- Преобразовать текст в электронную таблицу
- Переводчик EPUB для электронных книг
- Переводчик для рукописей
- Переводчик таблиц Excel
Частые вопросы о простом тексте
Мой документ вернулся полным странных символов вместо букв с диакритикой. Почему?
Это несоответствие кодировки, и оно почти всегда предшествует переводу. Байты, записанные по старой региональной схеме и прочитанные как Unicode, дают именно такую картину: обычные буквы выглядят правильно, а символы с диакритикой и нелатинские символы превращаются в последовательности несвязанных символов. Откройте оригинал в редакторе, который позволяет выбрать кодировку, найдите ту, которая отображает его правильно, сохраните копию в Unicode и начните с нее.
Будут ли переносы строк на прежних местах?
Границы абзацев будут. Отдельные перенесенные строки — нет, и не могут быть, потому что переведенный текст занимает разное количество символов. Там, где оригинал был перенесен вручную с фиксированной шириной столбца, результат будет разбиваться в других местах. Если для места назначения документа важна определенная ширина, переформатируйте его после перевода с помощью инструмента, который его использует.
Можно ли таким образом перевести субтитры?
Да, и здесь нужно обратить внимание на две вещи. Номера реплик и строки времени — это координаты, а не слова, и они должны сохраниться точно, а переведенный диалог часто длиннее оригинала, что может привести к тому, что строка будет слишком длинной для чтения зрителем за отведенное время. Проверьте самые длинные строки с учетом времени и сократите их, если реплика была слишком плотной.
А как насчет файла настроек или свойств?
Только правая часть является языком, и то не вся. Ключ перед разделителем — это идентификатор, который программа ищет по имени, поэтому его перевод незаметно отключает настройку. Значения, являющиеся путями к файлам, переключателями, числами или ссылками на другие ключи, также не являются прозой. Там, где документ состоит в основном из ключей с несколькими сообщениями, извлечение сообщений сначала быстрее, чем проверка всего результата.
Моя нарисованная от руки таблица потеряла выравнивание. Можно ли этого избежать?
В обычном тексте — нет, потому что выравнивание там создается пробелами, а перевод изменяет количество символов, занимаемых фразой. Немецкий и русский языки обычно расширяются, китайский и японский — сжимаются по количеству символов, при этом каждый занимает две колонки отображения. Исправление — повторное заполнение пробелами. Для чего-либо действительно табличного лучше использовать электронную таблицу или экспорт с разделителями-запятыми.
Какого размера документ я могу загрузить?
Один файл может достигать 1 ГБ или пяти тысяч страниц эквивалентного контента в планах Pro и Enterprise, поэтому полноформатные рукописи, подборки стенограмм и длинные экспорты обрабатываются целиком. Отправка целиком, а не по частям, также обеспечивает единообразие повторяющейся терминологии от первой до последней страницы.
Результат редактируемый или это изображение?
Редактируемый. То, что возвращается, — это текстовый документ, который вы можете открыть в любом редакторе и продолжить работу, с тем же содержанием символов и структурой, что и оригинал. Ничего не растрировано и ничего не заблокировано.
Сколько стоит перевод длинного документа?
Ценообразование зависит от количества слов, а не от размера файла в байтах. Каждый документ оплачивается отдельно по цене 0,005 доллара за слово в планах Free и Storage, 0,004 доллара в плане Pro или 0,003 доллара в плане Enterprise, с минимальной суммой 0,99 доллара. Подписка добавляет хранилище и более высокие лимиты, но не включает переводы. Таким образом, рукопись можно оценить прямо по количеству слов перед началом работы.
Отправьте документ, сохраняя структуру
Проверьте кодировку, загрузите, выберите языки и получите обратно редактируемый текст с абзацами, отступами и нелатинскими символами на своих местах.
Наши партнеры
Связанные услуги перевода
Форматы файлов
Инструменты для работы с PDF
