На базе ИИ · 120+ языков

Переводчик TXT

Простой текст не содержит разметки для защиты и не имеет схемы для следования, что делает его самым простым для перевода и самым легким для незаметного испорчения. Загружайте рукописи, заметки, стенограммы или экспорты и получайте их обратно с сохранением кодировки символов, переносов строк и отступов.

Макс. размер файла 1 ГБ Сохраняет исходное форматирование

Загрузите или перетащите документ для перевода

Макс. размер файла 1 GB

.PDF .DOCX .PPTX .XLSX .TXT .JPG .PNG .IDML .EPUB .HTML
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Амхарский)
العربية (Arabic)
Հայերեն (Армянский)
Azərbaycan dili (Азербайджанский)
Euskara (Баскский)
Беларуская (Белорусский)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Бирманский)
Català (Каталанский)
Cebuano (Себуанский)
Chichewa (Чичева)
中文 简体 (Китайский упрощенный)
中文 繁體 (Китайский традиционный)
Corsu (Корсиканский)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Эсперанто)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (Фризский)
Galego (Галисийский)
ქართული (Грузинский)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (Гаитянский креольский)
Hausa (Хауса)
ʻŌlelo Hawaiʻi (Гавайский)
עברית (Hebrew)
हिंदी (Хинди)
Hmoob (Хмонг)
Magyar (Hungarian)
Íslenska (Исландский)
Igbo (Игбо)
Bahasa Indonesia (Индонезийский)
Gaeilge (Ирландский)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (Каннада)
Қазақ тілі (Казахский)
ខ្មែរ (Кхмерский)
Ikinyarwanda (Киньяруанда)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (Киргизский)
ລາວ (Лаосский)
Latina (Латинский)
Latviešu (Латышский)
Lietuvių (Литовский)
Lëtzebuergesch (Люксембургский)
Македонски (Македонский)
Malagasy (Малагасийский)
Bahasa Melayu (Malay)
മലയാളം (Малаялам)
Malti (Мальтийский)
Te Reo Māori (Маори)
मराठी (Marathi)
Монгол хэл (Монгольский)
नेपाली (Непальский)
Norsk (Norwegian)
ଓଡ଼ିଆ (Одия)
فارسی (Persian)
Polski (Polish)
Português (Португальский)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (Самоанский)
Gàidhlig (Шотландский)
Српски (Serbian)
Sesotho (Сесото)
Shona (Шона)
سنڌي (Синдхи)
සිංහල (Сингальский)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (Сомалийский)
Español (Spanish)
Basa Sunda (Сунданский)
Kiswahili (Суахили)
Svenska (Swedish)
Tagalog (Tagalog)
Тоҷикӣ (Таджикский)
தமிழ் (Tamil)
Татарча (Татарский)
తెలుగు (Telugu)
ไทย (Тайский)
Türkçe (Turkish)
Türkmençe (Туркменский)
Українська (Ukrainian)
اردو (Urdu)
ئۇيغۇرچە (Уйгурский)
O'zbekcha (Узбекский)
Tiếng Việt (Vietnamese)
Cymraeg (Валлийский)
isiXhosa (Коса)
ייִדיש (Идиш)
Yorùbá (Йоруба)
isiZulu (Зулу)
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Амхарский)
العربية (Arabic)
Հայերեն (Армянский)
Azərbaycan dili (Азербайджанский)
Euskara (Баскский)
Беларуская (Белорусский)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Бирманский)
Català (Каталанский)
Cebuano (Себуанский)
Chichewa (Чичева)
中文 简体 (Китайский упрощенный)
中文 繁體 (Китайский традиционный)
Corsu (Корсиканский)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Эсперанто)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (Фризский)
Galego (Галисийский)
ქართული (Грузинский)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (Гаитянский креольский)
Hausa (Хауса)
ʻŌlelo Hawaiʻi (Гавайский)
עברית (Hebrew)
हिंदी (Хинди)
Hmoob (Хмонг)
Magyar (Hungarian)
Íslenska (Исландский)
Igbo (Игбо)
Bahasa Indonesia (Индонезийский)
Gaeilge (Ирландский)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (Каннада)
Қазақ тілі (Казахский)
ខ្មែរ (Кхмерский)
Ikinyarwanda (Киньяруанда)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (Киргизский)
ລາວ (Лаосский)
Latina (Латинский)
Latviešu (Латышский)
Lietuvių (Литовский)
Lëtzebuergesch (Люксембургский)
Македонски (Македонский)
Malagasy (Малагасийский)
Bahasa Melayu (Malay)
മലയാളം (Малаялам)
Malti (Мальтийский)
Te Reo Māori (Маори)
मराठी (Marathi)
Монгол хэл (Монгольский)
नेपाली (Непальский)
Norsk (Norwegian)
ଓଡ଼ିଆ (Одия)
فارسی (Persian)
Polski (Polish)
Português (Португальский)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (Самоанский)
Gàidhlig (Шотландский)
Српски (Serbian)
Sesotho (Сесото)
Shona (Шона)
سنڌي (Синдхи)
සිංහල (Сингальский)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (Сомалийский)
Español (Spanish)
Basa Sunda (Сунданский)
Kiswahili (Суахили)
Svenska (Swedish)
Tagalog (Tagalog)
Тоҷикӣ (Таджикский)
தமிழ் (Tamil)
Татарча (Татарский)
తెలుగు (Telugu)
ไทย (Тайский)
Türkçe (Turkish)
Türkmençe (Туркменский)
Українська (Ukrainian)
اردو (Urdu)
ئۇيغۇرچە (Уйгурский)
O'zbekcha (Узбекский)
Tiếng Việt (Vietnamese)
Cymraeg (Валлийский)
isiXhosa (Коса)
ייִדיש (Идиш)
Yorùbá (Йоруба)
isiZulu (Зулу)
АРАБСКИЙ ПОРТУГАЛЬСКИЙ РУССКИЙ ИТАЛЬЯНСКИЙ КОРЕЙСКИЙ НИДЕРЛАНДСКИЙ ПОЛЬСКИЙ ТУРЕЦКИЙ ШВЕДСКИЙ АНГЛИЙСКИЙ ИСПАНСКИЙ ФРАНЦУЗСКИЙ НЕМЕЦКИЙ КИТАЙСКИЙ ЯПОНСКИЙ ХИНДИ БЕНГАЛЬСКИЙ ВЬЕТНАМСКИЙ ТАЙСКИЙ ГРЕЧЕСКИЙ ИВРИТ АРАБСКИЙ ПОРТУГАЛЬСКИЙ РУССКИЙ ИТАЛЬЯНСКИЙ КОРЕЙСКИЙ НИДЕРЛАНДСКИЙ ПОЛЬСКИЙ ТУРЕЦКИЙ ШВЕДСКИЙ АНГЛИЙСКИЙ ИСПАНСКИЙ ФРАНЦУЗСКИЙ НЕМЕЦКИЙ КИТАЙСКИЙ ЯПОНСКИЙ ХИНДИ БЕНГАЛЬСКИЙ ВЬЕТНАМСКИЙ ТАЙСКИЙ ГРЕЧЕСКИЙ ИВРИТ

Расширение почти ничего не обещает

Каждый другой формат документа несет описание самого себя. Документ текстового процессора называет свои шрифты и объявляет свою кодировку символов. Страница разметки оборачивает свое содержимое тегами, которые говорят, что есть каждая часть. Простой текст ничего из этого не объявляет. Это последовательность байтов с соглашением, что кто-то прочитает их как символы, и все соглашение неписано.

Поэтому три вещи приходится выяснять, а не читать: к какой кодировке относятся байты, какую последовательность автор использовал для окончания строки, и имеют ли переносы строк смысл или просто являются шириной окна редактора. Программное обеспечение угадывает все три каждый раз, когда вы открываете такой документ, и обычно угадывает правильно, именно поэтому сбои бывают неожиданными, когда они случаются.

Обратная сторона реальна. Нет стилей для сохранения, нет движка макета для борьбы, нет встроенных объектов для потери. Если кодировка и структура строки выживают, все выживает. Остальная часть этой страницы посвящена этим двум вещам.

Что люди на самом деле хранят в простом тексте

Расширение прикрепляется к вещам, которые вообще не являются прозой, и каждая из них требует особого ухода. Знание того, что вы держите, решает, займет ли работа минуту или потребует подготовки.

  1. Сплошная проза. Рукописи, заметки, черновики статей, стенограммы интервью, извлеченные тексты статей. Это прямой случай, и единственное, на что стоит обратить внимание, — это разделены ли абзацы пустой строкой или ничем.
  2. Субтитры и подписи. Нумерованные метки, строка времени и одна или две строки диалога. Временные метки — это координаты, и их необходимо точно воспроизвести, а строки диалога должны оставаться достаточно короткими, чтобы их можно было прочитать на скорости, что важно, поскольку переведенные строки часто длиннее тех, которые они заменяют.
  3. Списки настроек и свойств. Ключ, разделитель и значение в каждой строке. Ключ слева — это идентификатор, который программное обеспечение ищет по имени; прикосновение к нему молча отключает настройку. Только значение справа, и только там, где это значение является сообщением, а не путем или переключателем, является языком.
  4. Журналы и вывод машины. Временные метки, слова уровня серьезности, идентификаторы и трассировки стека. Перевод слова уровня серьезности нарушает любой фильтр, который ищет его, а трассировка стека не является прозой ни на одном языке.
  5. Экспорты в табличном виде под прикрытием. Значения, разделенные табуляцией, сохраненные с неправильным расширением. Если ваш контент на самом деле является сеткой, вместо этого он принадлежит переводчику CSV, который понимает записи и столбцы.
  6. Заметки к файлу README и лицензионный текст. Проза с заголовками, имитированными заглавными буквами и рядами тире, нумерованными пунктами и абзацами с жестким переносом. Имитированная структура — это то, что ломается.

Три невидимых свойства, которые определяют результат

Ни одно из них не видно, когда вы смотрите на контент на экране, и каждое из них может превратить хороший перевод в непригодный.

К какой кодировке относятся байты

До того, как Unicode стал стандартом, каждый языковой регион имел свою собственную однобайтовую или многобайтовую схему: отдельные для кириллицы, для западноевропейских акцентов, для греческого, для японского, для упрощенного и традиционного китайского, для корейского. Документы, написанные по этим схемам, все еще находятся в обращении, и в них ничего не говорится о том, какая схема применяется. Откройте один по неправильному предположению, и акцентированные символы превратятся в последовательность бессмыслицы, в то время как простые буквы будут выглядеть нормально, поэтому повреждение легко пропустить при беглом взгляде. Проверьте в редакторе, который позволяет явно выбирать кодировку, и открывайте снова, пока акценты и нелатинские символы не будут читаться правильно.

Как заканчивается строка

Инструменты Windows заканчивают строку двумя управляющими символами, все, что произошло от Unix, использует один, а очень старые документы Macintosh использовали только его. Большинство современных редакторов принимают все три, но множество скриптов обработки — нет, и смешивание соглашений внутри одного документа приводит к появлению посторонних знаков в конце каждой строки или к отображению документа как одного непрерывного абзаца. Придерживайтесь одного соглашения и предпочитайте то, которое ожидает система, которая будет использовать результат.

Имеет ли перенос строки какой-либо смысл

Текст, перенесенный вручную с фиксированной шириной, имеет перенос в конце каждой строки, и эти переносы являются артефактом ширины, а не частью письма. Абзац обычно отмечается пустой строкой между блоками. Обработка каждой перенесенной строки как единицы разбивает предложения на фрагменты и переводит их вне контекста, что плохо читается на любом языке. Сохранение абзаца как единицы является правильным, и это означает, что вывод будет переноситься в других местах, чем оригинал. Это ожидаемо, а не дефект.

Все, что выровнено пробелами, будет отображаться с ошибками

Почему столбцы смещаются

Без стилей единственным способом выровнять что-либо является подсчет символов. Таблицы, нарисованные с помощью вертикальных черт и тире, заголовки, подчеркнутые строками знаков равенства, журналы, заполненные пробелами, отступы и рамки, сделанные из символов рисования линий, — все это зависит от того, что каждая запись занимает одинаковую ширину, как и раньше.

Перевод меняет ширину почти всего. Немецкий и русский языки обычно длиннее английского на пятую или треть; китайский и японский языки используют меньше символов, но каждый занимает две колонки в дисплее с фиксированной шириной. В любом случае выравнивание смещается. Ожидайте, что придется переделывать таблицы, нарисованные вручную, и подумайте, не лучше ли использовать настоящую электронную таблицу.

Начальные пробелы — это контент

В файле настроек, фрагменте кода и любом плане пробелы в начале строки имеют значение: они показывают вложенность или помечают блок как литеральный. Табуляция и последовательность пробелов выглядят одинаково на экране и являются разными байтами, поэтому инструмент, который нормализует одно в другое, изменяет документ, не проявляясь.

То же самое относится к небольшим управляющим последовательностям, записываемым как обратная косая черта и буква, которые обозначают разрыв строки или табуляцию в одной строке записи настроек. Это два обычных символа, которые какая-то последующая программа интерпретирует, и они должны быть переданы на другую сторону без изменений.

Стоимость для задания в обычном тексте

Оплата производится за слова в документе, поэтому длинный журнал с небольшим количеством уникальных сообщений стоит гораздо меньше, чем предполагает его размер.

Free

$0

Карта не требуется для регистрации

  • 0,005 $/слово AI-перевод
  • 1 доллар за страницу для сканов и PDF-изображений
  • 120+ языков
  • Файлы до 20 МБ и 20 страниц
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG и CSV
  • Только 24-часовое хранение файлов
  • Редактор PDF и конвертер PDF в DOCX
  • Отмена в любое время
  • Не включено: Поддержка по электронной почте
  • Не включено: Доступ для команды
  • Не включено: Неограниченные бесплатные предварительные просмотры PDF
  • Не включено: Глоссарий

Storage

14,99 $/месяц

или 149 долларов в год

  • 0,005 $/слово AI-перевод
  • 1 доллар за страницу для сканов и PDF-изображений
  • 120+ языков
  • Файлы до 100 МБ и 100 страниц
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG и CSV
  • Неограниченное хранилище файлов
  • Редактор PDF и конвертер PDF в DOCX
  • Поддержка по электронной почте
  • Отмена в любое время
  • Не включено: Доступ для команды
  • Не включено: Неограниченные бесплатные предварительные просмотры PDF
  • Не включено: Глоссарий

Pro

49,99 долларов в месяц

или 499 долларов в год

  • ИИ-перевод 0,004 доллара за слово
  • 0,80 доллара за страницу для сканов и PDF-изображений
  • 120+ языков
  • Файлы до 1000 МБ и 5000 страниц
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG и CSV
  • Неограниченное хранилище файлов
  • Редактор PDF и конвертер PDF в DOCX
  • Поддержка по электронной почте
  • Доступ для команды до 5 участников
  • Неограниченные бесплатные предварительные просмотры PDF
  • Глоссарий
  • Отмена в любое время

Для бизнеса

149,99 долларов в месяц, по запросу. ИИ-перевод по цене 0,003 доллара за слово (0,60 доллара за страницу), файлы до 1000 МБ и 5000 страниц, неограниченное хранилище файлов и доступ для команды до 15 участников.

Связаться с отделом продаж

Образцы документов рядом

Нажмите на миниатюру, чтобы открыть полное представление. Чтение пары показывает:

  • Разрывы абзацев и пустые строки сохраняются.
  • Акцентированные и нелатинские символы отображаются, а не превращаются в символы.
  • Отступы и нумерованные последовательности сохраняют свою вложенность.
  • Результат открывается как редактируемый текст, а не как изображение текста.
Обычный текстовый документ на английском языке, источникТот же обычный текстовый документ, отображенный на португальском языкеВторой обычный текстовый документ на английском языке, источникТот же второй обычный текстовый документ, отображенный на испанском языке

Каждая пара была получена из одного файла без последующей ручной доработки.

Посмотреть все примеры переводов →

Пять минут подготовки, затем загрузка

Почти все жалобы на перевод обычного текста сводятся к тому, что уже было в документе до его загрузки. Эти проверки выявляют все из них.

  1. 1

    Убедитесь, что кодировка читается правильно

    Откройте документ в редакторе, который показывает и позволяет изменять кодировку. Если акцентированные или нелатинские символы выглядят как последовательности несвязанных символов, вы читаете его по неправильной схеме. Исправьте это сначала и сохраните копию в Unicode, потому что никакой перевод не сможет восстановить символы, которые уже были прочитаны неправильно.

  2. 2

    Решите, что является прозой, а что нет

    Если контент состоит из настроек, журналов или субтитров, определите части, которые должны остаться нетронутыми: ключи слева от разделителя, слова уровня важности, номера реплик и строки времени. Если большая часть документа — машинный контент с небольшим количеством прозы, извлечение прозы сначала быстрее, чем исправление результата.

  3. 3

    Создайте учетную запись и загрузите

    Зарегистрируйтесь, указав адрес электронной почты, и отправьте документ. Одиночные загрузки достигают 1 ГБ, что позволяет загружать рукописи, архивы транскрипций и экспорт журналов без разделения на части.

  4. 4

    Установите оба языка и переведите

    Указание исходного языка здесь важнее, чем в форматированном документе, потому что нет разметки или метаданных, которые система могла бы вывести. Затем выберите целевой язык и начните задание.

  5. 5

    Снова откройте результат и проверьте те же три вещи

    Кодировка, окончания строк и необходимость перевыравнивания чего-либо, выровненного вручную. Если документ будет использоваться в конвейере сборки или медиаплеере, пропустите его через этот конвейер один раз, прежде чем полагаться на него.

FAQ по переводу TXT

Частые вопросы о простом тексте

Мой документ вернулся полным странных символов вместо букв с диакритикой. Почему?

Это несоответствие кодировки, и оно почти всегда предшествует переводу. Байты, записанные по старой региональной схеме и прочитанные как Unicode, дают именно такую картину: обычные буквы выглядят правильно, а символы с диакритикой и нелатинские символы превращаются в последовательности несвязанных символов. Откройте оригинал в редакторе, который позволяет выбрать кодировку, найдите ту, которая отображает его правильно, сохраните копию в Unicode и начните с нее.

Будут ли переносы строк на прежних местах?

Границы абзацев будут. Отдельные перенесенные строки — нет, и не могут быть, потому что переведенный текст занимает разное количество символов. Там, где оригинал был перенесен вручную с фиксированной шириной столбца, результат будет разбиваться в других местах. Если для места назначения документа важна определенная ширина, переформатируйте его после перевода с помощью инструмента, который его использует.

Можно ли таким образом перевести субтитры?

Да, и здесь нужно обратить внимание на две вещи. Номера реплик и строки времени — это координаты, а не слова, и они должны сохраниться точно, а переведенный диалог часто длиннее оригинала, что может привести к тому, что строка будет слишком длинной для чтения зрителем за отведенное время. Проверьте самые длинные строки с учетом времени и сократите их, если реплика была слишком плотной.

А как насчет файла настроек или свойств?

Только правая часть является языком, и то не вся. Ключ перед разделителем — это идентификатор, который программа ищет по имени, поэтому его перевод незаметно отключает настройку. Значения, являющиеся путями к файлам, переключателями, числами или ссылками на другие ключи, также не являются прозой. Там, где документ состоит в основном из ключей с несколькими сообщениями, извлечение сообщений сначала быстрее, чем проверка всего результата.

Моя нарисованная от руки таблица потеряла выравнивание. Можно ли этого избежать?

В обычном тексте — нет, потому что выравнивание там создается пробелами, а перевод изменяет количество символов, занимаемых фразой. Немецкий и русский языки обычно расширяются, китайский и японский — сжимаются по количеству символов, при этом каждый занимает две колонки отображения. Исправление — повторное заполнение пробелами. Для чего-либо действительно табличного лучше использовать электронную таблицу или экспорт с разделителями-запятыми.

Какого размера документ я могу загрузить?

Один файл может достигать 1 ГБ или пяти тысяч страниц эквивалентного контента в планах Pro и Enterprise, поэтому полноформатные рукописи, подборки стенограмм и длинные экспорты обрабатываются целиком. Отправка целиком, а не по частям, также обеспечивает единообразие повторяющейся терминологии от первой до последней страницы.

Результат редактируемый или это изображение?

Редактируемый. То, что возвращается, — это текстовый документ, который вы можете открыть в любом редакторе и продолжить работу, с тем же содержанием символов и структурой, что и оригинал. Ничего не растрировано и ничего не заблокировано.

Сколько стоит перевод длинного документа?

Ценообразование зависит от количества слов, а не от размера файла в байтах. Каждый документ оплачивается отдельно по цене 0,005 доллара за слово в планах Free и Storage, 0,004 доллара в плане Pro или 0,003 доллара в плане Enterprise, с минимальной суммой 0,99 доллара. Подписка добавляет хранилище и более высокие лимиты, но не включает переводы. Таким образом, рукопись можно оценить прямо по количеству слов перед началом работы.

Отправьте документ, сохраняя структуру

Проверьте кодировку, загрузите, выберите языки и получите обратно редактируемый текст с абзацами, отступами и нелатинскими символами на своих местах.

Наши партнеры

Accenture
Bloomberg
Citrix
P&G
SAP