Překladač TXT
Prostý text neobsahuje žádné formátování k ochraně ani žádnou strukturu, kterou by bylo třeba dodržovat, což z něj činí nejjednodušší věc k překladu a nejsnadnější k potichému zničení. Nahrajte rukopisy, poznámky, přepisy nebo exporty a získejte je zpět s nezměněným kódováním znaků, zalomením řádků a odsazením.
Nahrajte nebo přetáhněte dokument k překladu
Max. velikost souboru 1 GB
Rozšíření neslibuje téměř nic
Každý jiný formát dokumentu obsahuje jeho popis. Dokument ve formátu pro zpracování textu uvádí svá písma a deklaruje svou znakovou sadu. Stránka značkovacího jazyka obaluje svůj obsah značkami, které říkají, co je každá část. Prostý text nic z toho neříká. Je to řada bajtů s dohodou, že je někdo přečte jako znaky, a celá dohoda je nenapsaná.
Tři věci je tedy třeba zjistit, nikoli přečíst: ke kterému kódování znaků bajty patří, jakou sekvenci autor použil k ukončení řádku a zda jsou zalomení řádků smysluplná, nebo jen šířka okna editoru. Software odhaduje všechny tři pokaždé, když takový dokument otevřete, a obvykle se nemýlí, což je přesně důvod, proč jsou selhání překvapivá, když nastanou.
Výhoda je reálná. Není třeba zachovávat žádné stylování, bojovat s žádným vykreslovacím enginem, ztratit žádný vložený objekt. Pokud kódování a struktura řádků přežijí, vše přežilo. Zbytek této stránky je o těchto dvou věcech.
Co lidé skutečně uchovávají v prostém textu
Přípona se připojuje k věcem, které vůbec nejsou prózou, a každá z nich potřebuje jiný druh péče. Vědět, co držíte, rozhoduje, zda práce zabere minutu, nebo vyžaduje přípravu.
- Souvislá próza. Rukopisy, poznámky, návrhy článků, přepisy rozhovorů, seškrábaná těla článků. Toto je přímočarý případ a jediné, na co si dát pozor, je, zda jsou odstavce odděleny prázdným řádkem, nebo vůbec ničím.
- Titulky a titulky. Číslované narážky, časová řada a jeden nebo dva řádky dialogu. Časy jsou souřadnice a musí být reprodukovány přesně, zatímco řádky dialogu musí zůstat dostatečně krátké, aby je bylo možné rychle přečíst, což je důležité, protože přeložené řádky jsou často delší než ty, které nahrazují.
- Nastavení a seznamy vlastností. Klíč, oddělovač a hodnota na každém řádku. Klíč vlevo je identifikátor, který software vyhledává podle názvu; jeho dotyk tiše deaktivuje nastavení. Pouze hodnota vpravo, a pouze tam, kde je hodnota zprávou, nikoli cestou nebo přepínačem, je jazyk.
- Protokoly a výstup stroje. Časová razítka, slova závažnosti, identifikátory a trasovací zásobníky. Překlad slova závažnosti naruší jakýkoli filtr, který jej hledá, a trasovací zásobník není v žádném jazyce prózou.
- Tabulkové exporty v přestrojení. Hodnoty oddělené tabulátory, uložené s nesprávnou příponou. Pokud je váš obsah skutečně mřížka, patří místo toho do překladače CSV, který rozumí záznamům a sloupcům.
- Poznámky k read-me a licenční text. Próza s nadpisy vytvořenými z velkých písmen a řádků pomlček, číslovanými klauzulemi a pevně zalomenými odstavci. Vytvořená struktura je část, která se rozbije.
Tři neviditelné vlastnosti, které rozhodují o výsledku
Žádná z nich není viditelná, když se na obsah díváte na obrazovce, a každá z nich může z dobrého překladu udělat nepoužitelný.
Ke kterému kódování bajty patří
Než se Unicode stal výchozím, každý jazykový region měl svou vlastní jednobajtovou nebo vícebajtovou schéma: samostatné pro cyrilici, pro západoevropské akcenty, pro řečtinu, pro japonštinu, pro zjednodušenou a tradiční čínštinu, pro korejštinu. Dokumenty napsané podle těchto schémat jsou stále v oběhu a nic v nich neříká, které platí. Otevřete jeden s nesprávným předpokladem a akcentované znaky se změní na nesmysly, zatímco prostá písmena vypadají dobře, takže poškození je při rychlém pohledu snadno přehlédnutelné. Zkontrolujte v editoru, který vám umožní explicitně zvolit kódování, a znovu otevřete, dokud se akcenty a nelatinské znaky nebudou číst správně.
Jak řádek končí
Nástroje Windows ukončují řádek dvěma řídicími znaky, vše, co pochází z Unixu, používá jeden a velmi staré dokumenty Macintosh používaly samostatně. Většina moderních editorů přijímá všechny tři, ale spousta zpracovávajících skriptů ne, a míchání konvencí v jednom dokumentu vede k nepořádným znakům na konci každého řádku nebo k dokumentu, který se zobrazí jako jediný nepřerušený odstavec. Dodržujte jednu konvenci a preferujte tu, kterou očekává systém, který bude výsledek zpracovávat.
Zda zalomení řádku něco znamená
Text ručně zalomený na pevnou šířku má na konci každého řádku zalomení a tato zalomení jsou artefaktem šířky, nikoli součástí psaní. Odstavec je obvykle označen prázdným řádkem mezi bloky. Zacházení s každým zalomeným řádkem jako s jednotkou rozseká věty na fragmenty a přeloží je mimo kontext, což se v žádném jazyce nečte dobře. Ponechání odstavce jako jednotky je správné a znamená to, že výstup bude přebalován na jiných místech než originál. To je očekávané, nikoli chyba.
Cokoli zarovnané mezerami bude špatně zarovnané.
Proč se sloupce rozcházejí
Bez stylů je jediný způsob, jak cokoli zarovnat, počítat znaky. Tabulky nakreslené pomocí svislítek a pomlček, nadpisy podtržené řádky rovnítek, účetní knihy doplněné mezerami, odsazené osnovy a rámečky vytvořené znaky pro kreslení čar – to vše závisí na tom, že každý záznam zabírá stejnou šířku jako předtím.
Překlad mění šířku téměř všeho. Němčina a ruština jsou obvykle o pětinu až třetinu delší než angličtina; čínština a japonština zabírají méně znaků, ale každý z nich zabírá dva sloupce v displeji s pevnou šířkou. V obou případech se zarovnání posune. Po ručním kreslení tabulek je třeba je znovu doplnit a zvážit, zda obsah nechce skutečný tabulkový procesor.
Úvodní bílé znaky jsou obsah
V konfiguračním souboru, ve výstřižku kódu a v jakékoli osnově mají mezery na začátku řádku význam: ukazují vnoření nebo označují blok jako doslovný. Tabulátor a řada mezer vypadají na obrazovce stejně a jsou to různé bajty, takže nástroj, který jeden normalizuje do druhého, změní dokument, aniž by se to projevilo.
Totéž platí pro malé únikové sekvence napsané jako zpětné lomítko a písmeno, které představují nový řádek nebo tabulátor v rámci jednoho řádku v položce nastavení. Jsou to dva obyčejné znaky, které později nějaký program interpretuje, a musí dorazit na druhou stranu nezměněné.
Cena za práci s prostým textem
Účtováno podle slov v dokumentu, takže dlouhý protokol s několika jedinečnými zprávami stojí mnohem méně, než naznačuje jeho velikost.
Free
K registraci není potřeba karta
- Překlad pomocí AI za 0,005 $/slovo
- 1 $ za stránku pro skeny a obrázkové PDF
- 120+ jazyků
- Soubory do 20 MB a 20 stran
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG a CSV
- Pouze 24hodinové ukládání souborů
- editor PDF a převodník PDF do DOCX
- Zrušit kdykoli
- Není zahrnuto: E-mailová podpora
- Není zahrnuto: Týmový přístup
- Není zahrnuto: Neomezené bezplatné náhledy PDF
- Není zahrnuto: Slovník
Storage
nebo 149 $/rok
- Překlad pomocí AI za 0,005 $/slovo
- 1 $ za stránku pro skeny a obrázkové PDF
- 120+ jazyků
- Soubory do 100 MB a 100 stran
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG a CSV
- Neomezené ukládání souborů
- editor PDF a převodník PDF do DOCX
- E-mailová podpora
- Zrušit kdykoli
- Není zahrnuto: Týmový přístup
- Není zahrnuto: Neomezené bezplatné náhledy PDF
- Není zahrnuto: Slovník
Pro
nebo 499 $/rok
- Překlad pomocí AI za 0,004 $/slovo
- 0,80 $ za stránku pro skeny a obrázkové PDF
- 120+ jazyků
- Soubory do 1 000 MB a 5 000 stran
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG a CSV
- Neomezené ukládání souborů
- editor PDF a převodník PDF do DOCX
- E-mailová podpora
- Týmový přístup až pro 5 členů
- Neomezené bezplatné náhledy PDF
- Slovník
- Zrušit kdykoli
Pro firmy
149,99 $/měsíc, na vyžádání. Překlad pomocí AI za 0,003 $/slovo (0,60 $ za stránku), soubory do 1 000 MB a 5 000 stran, neomezené ukládání souborů a týmový přístup až pro 15 členů.
Ukázkové dokumenty, vedle sebe
Kliknutím na miniaturu otevřete zobrazení v plné velikosti. Čtení napříč párem ukazuje:
- Zlomky odstavců a mezery mezi řádky zůstanou tam, kde byly.
- Znaky s diakritikou a nelatinkové znaky se vykreslí, místo aby degradovaly na symboly.
- Odsazení a číslované sekvence si zachovají své vnoření.
- Výsledek se otevře jako editovatelný text, nikoli jako obrázek textu.




Každý pár pochází z jednoho nahrání bez následné manuální opravy.
Zobrazit všechny příklady překladů →Pět minut přípravy, pak nahrání
Téměř každá stížnost na překlad prostého textu se vrací k něčemu, co již bylo v dokumentu pravdou před jeho nahráním. Tyto kontroly všechny zachytí.
- 1
Potvrďte, že kódování je správné
Otevřete dokument v editoru, který zobrazuje a umožňuje měnit kódování. Pokud znaky s diakritikou nebo nelatinkové znaky vypadají jako sekvence nesouvisejících symbolů, čtete jej pod nesprávným schématem. Nejprve to opravte a uložte kopii Unicode, protože žádný překlad nemůže obnovit znaky, které již byly špatně přečteny.
- 2
Rozhodněte, co je próza a co ne
Pokud je obsah nastavení, protokoly nebo titulky, identifikujte části, které musí zůstat nedotčené: klíče nalevo od oddělovače, slova závažnosti, čísla narážek a časové řádky. Pokud je většina dokumentu strojový obsah s trochou prózy, je rychlejší extrahovat prózu nejprve než opravovat výsledek.
- 3
Vytvořte si účet a nahrajte
Zaregistrujte se pomocí e-mailové adresy a odešlete dokument. Jednotlivá nahrání jsou až do velikosti 1 GB, což pokrývá rukopisy, archivy přepisu a exporty protokolů bez jejich rozdělování na části.
- 4
Nastavte oba jazyky a přeložte
Pojmenování zdroje je zde důležitější než u formátovaného dokumentu, protože neexistuje žádné označení ani metadata, ze kterých by je systém mohl odvodit. Poté vyberte cíl a spusťte úlohu.
- 5
Znovu otevřete výsledek a zkontrolujte stejné tři věci
Kódování, konce řádků a zda je třeba cokoli ručně zarovnaného znovu doplnit. Pokud dokument vstupuje do build pipeline nebo mediálního přehrávače, spusťte jej jednou přes tento pipeline, než na něj budete spoléhat.
Pokud váš obsah není skutečně prostý text
Běžné dotazy k prostému textu
Můj dokument se vrátil plný podivných symbolů místo akcentovaných písmen. Proč?
To je chyba kódování a téměř vždy předchází překladu. Byty zapsané podle staršího regionálního schématu, čtené jako by byly Unicode, produkují přesně tento vzor: běžná písmena vypadají správně, zatímco akcentované a nelatinské znaky se promění v řady nesouvisejících symbolů. Otevřete originál v editoru, který vám umožní vybrat kódování, najděte to, které jej správně zobrazí, uložte kopii Unicode a začněte odtud.
Budou moje zalomení řádků na stejném místě i poté?
Hranice odstavců budou. Jednotlivé zalomené řádky nebudou a nemohou být, protože přeložené znění zabírá jiné množství znaků. Kde byl originál ručně zalomen na pevnou šířku sloupce, výsledek se rozbije v jiných bodech. Pokud je pro místo, kam dokument směřuje, důležitá specifická šířka, po překladu jej znovu zalomte pomocí nástroje, který jej zpracovává.
Mohu tímto způsobem přeložit titulkový dokument?
Ano, a dvě věci vyžadují pozornost. Čísla titulků a časové řádky jsou spíše souřadnice než slova a musí přežít přesně, a přeložený dialog je často delší než originál, což může posunout řádek za to, co divák stihne přečíst v dostupném čase. Zkontrolujte nejdelší řádky oproti časování a zkraťte je tam, kde se titulek stal příliš hustým.
A co dokument s nastavením nebo vlastnostmi?
Pouze pravá strana je jazyk, a ne celá. Klíč před oddělovačem je identifikátor, který software vyhledává podle názvu, takže jeho překlad tiše deaktivuje nastavení. Hodnoty, které jsou cestami k souborům, přepínači, čísly nebo odkazy na jiné klíče, také nejsou próza. Kde je dokument převážně klíče s několika zprávami, vytažení zpráv je rychlejší než kontrola celého výsledku.
Moje ručně kreslená tabulka ztratila zarovnání. Lze tomu zabránit?
V prostém textu ne, protože zarovnání je tam tvořeno počítanými mezerami a překlad mění počet znaků, které fráze zabírá. Němčina a ruština se obvykle rozšiřují, čínština a japonština se smršťují v znacích, přičemž každý zabírá dva sloupce zobrazení. Následné doplnění mezer je řešení. Pro cokoli skutečně tabulkového je lepší domovem tabulkový procesor nebo export oddělený čárkami.
Jak velký dokument mohu nahrát?
Jedno nahrání může na plánech Pro a Enterprise dosáhnout 1 GB nebo pěti tisíc stran ekvivalentního obsahu, takže celonárodní rukopisy, sbírky přepisů a dlouhé exporty projdou v jednom kuse. Odeslání celku namísto po částech také udržuje opakující se terminologii konzistentní od první do poslední stránky.
Je výsledek editovatelný, nebo obrázek?
Editovatelný. To, co se vrátí, je textový dokument, který můžete otevřít v jakémkoli editoru a pokračovat v práci, se stejným obsahem znaků a strukturou jako originál. Nic není rasterizováno a nic není uzamčeno.
Kolik stojí dlouhý dokument?
Ceny se řídí počtem slov, nikoli počtem bajtů. Každý dokument je účtován zvlášť za 0,005 $ za slovo na plánech Free a Storage, 0,004 $ na Pro nebo 0,003 $ na Enterprise, s minimem 0,99 $. Předplatné přidává úložiště a vyšší limity, ale nezahrnuje žádné překlady. Rukopis lze tedy odhadnout přímo z počtu slov před začátkem.
Odešlete dokument, zachováme strukturu
Zkontrolujte kódování, nahrajte soubor, vyberte jazyky a získejte zpět upravitelný text s odstavci, odsazením a nelatinkovými znaky tam, kde mají být.
Naši partneři
Související překladatelské služby
Formáty souborů
Nástroje pro PDF
