TXT-översättare
Vanlig text har ingen markup att skydda och inget schema att följa, vilket gör den till det enklaste att översätta och det lättaste att tyst förstöra. Ladda upp manuskript, anteckningar, utskrifter eller exporter och få tillbaka dem med teckenkodningen, radbrytningarna och indragningen intakta.
Ladda upp eller släpp dokument för översättning
Max filstorlek 1 GB
Tillägget lovar nästan ingenting
Alla andra dokumentformat har en beskrivning av sig själva. Ett ordbehandlingsdokument anger sina teckensnitt och deklarerar sin teckenuppsättning. En sida med markup omsluter sitt innehåll i taggar som säger vad varje del är. Vanlig text deklarerar inget av det. Det är en ström av byte med en överenskommelse om att någon kommer att läsa dem som tecken, och hela överenskommelsen är oskriven.
Tre saker måste därför arbetas ut snarare än läsas: vilken teckenkodning byten tillhör, vilken sekvens författaren använde för att avsluta en rad, och om radbrytningarna är meningsfulla eller bara bredden på någons redigeringsfönster. Program gissar alla tre varje gång du öppnar ett sådant dokument, och det är oftast rätt, vilket är precis varför felen är överraskande när de inträffar.
Fördelen är verklig. Det finns ingen stil att bevara, ingen layoutmotor att kämpa med, inga inbäddade objekt att förlora. Om teckenkodningen och radstrukturen överlever, har allt överlevt. Resten av den här sidan handlar om dessa två saker.
Vad folk faktiskt sparar i vanlig text
Tillägget kopplas till saker som inte alls är prosa, och var och en av dessa behöver en annan typ av omsorg. Att veta vilken du håller i avgör om jobbet tar en minut eller kräver förberedelse.
- Sammanhängande prosa. Manuskript, anteckningar, artikelutkast, intervjuutskrifter, skrapade artikelkroppar. Detta är det raka fallet, och det enda att se upp med är om stycken separeras av en tom rad eller inte alls.
- Undertexter och bildtexter. Numrerade ledtrådar, en tidslinje och en eller två rader dialog. Tiderna är koordinater och måste återges exakt, medan dialograderna måste vara tillräckligt korta för att läsas i fart, vilket är viktigt eftersom översatta rader ofta är längre än de de ersätter.
- Inställningar och egenskaplistor. En nyckel, en separator och ett värde på varje rad. Nyckeln till vänster är en identifierare som program letar upp med namn; att röra den inaktiverar tyst inställningen. Endast värdet till höger, och endast där det värdet är ett meddelande snarare än en sökväg eller en switch, är språk.
- Loggar och maskinutdata. Tidsstämplar, allvarlighetsord, identifierare och stackspår. Att översätta ett allvarlighetsord bryter alla filter som söker efter det, och ett stackspår är inte prosa på något språk.
- Tabellformade exporter i förklädnad. Värden separerade av tabbar, sparade med fel filnamnstillägg. Om ditt innehåll verkligen är ett rutnät, hör det hemma i CSV-översättaren istället, som förstår poster och kolumner.
- Läsa-mig-anteckningar och licenstext. Prosa med rubriker fejkade av stora bokstäver och rader av streck, numrerade klausuler och hårt ombrutna stycken. Den fejkade strukturen är det som går sönder.
Tre osynliga egenskaper som avgör resultatet
Ingen av dessa är synlig när du tittar på innehållet på skärmen, och var och en av dem kan förvandla en bra översättning till en oanvändbar.
Vilken teckenkodning byten tillhör
Innan Unicode blev standard hade varje språkregion sin egen enkelbyte- eller flerbbyte-ordning: separata för kyrilliska, för västeuropeiska accenter, för grekiska, för japanska, för förenklade och traditionella kinesiska, för koreanska. Dokument skrivna under dessa ordningar cirkulerar fortfarande, och inget i dem säger vilken som gäller. Öppna ett under fel antagande och de accentuerade tecknen blir nonsens medan de vanliga bokstäverna ser bra ut, så skadan är lätt att missa vid en snabb blick. Kontrollera i en redigerare som låter dig välja teckenkodningen explicit, och öppna igen tills accenterna och icke-latinska tecken läses korrekt.
Hur en rad slutar
Windows-verktyg avslutar en rad med två kontrolltecken, allt som härstammar från Unix använder ett, och mycket gamla Macintosh-dokument använde det andra ensamt. De flesta moderna redigerare accepterar alla tre, men många skript för bearbetning gör det inte, och att blanda konventioner inom ett dokument är vad som ger extra tecken i slutet av varje rad eller ett dokument som visas som ett enda oavbrutet stycke. Håll en konvention genomgående, och föredra den som systemet som kommer att använda resultatet förväntar sig.
Om en radbrytning betyder något
Text som brutits för hand vid en fast bredd har en brytning i slutet av varje rad, och dessa brytningar är en artefakt av bredden snarare än en del av skrivandet. Ett stycke markeras normalt av en tom rad mellan block. Att behandla varje bruten rad som en enhet delar upp meningar i fragment och översätter dem ur sitt sammanhang, vilket låter illa på vilket språk som helst. Att behålla stycket som enhet är rätt, och det innebär att utdata kommer att brytas om på andra ställen än originalet. Det är förväntat, inte ett fel.
Allt som är anpassat med mellanslag kommer att se feljusterat ut
Varför kolumnerna driver
Utan styling är det enda sättet att rada upp saker att räkna tecken. Tabeller ritade med snedstreck och bindestreck, rubriker understrukna med rader av likhetstecken, liggare utfyllda med mellanslag, indragna dispositioner och rutor gjorda av linjeteckningar är alla beroende av att varje post upptar samma bredd som den gjorde tidigare.
Översättning ändrar bredden på nästan allt. Tyska och ryska är vanligtvis en femtedel till en tredjedel längre än engelska; kinesiska och japanska tar färre tecken men var och en upptar två kolumner i en fast bredd-display. Oavsett vilket ändras justeringen. Räkna med att behöva fylla på handritade tabeller efteråt, och överväg om innehållet vill ha ett riktigt kalkylblad istället.
Inledande blanksteg är innehåll
I ett inställningsdokument, i ett kodavsnitt och i en disposition bär mellanslagen i början av en rad mening: de visar nästling, eller de markerar ett block som bokstavligt. En tab och en rad med mellanslag ser identiska ut på skärmen och är olika byte, så ett verktyg som normaliserar det ena till det andra ändrar dokumentet utan att verka göra det.
Samma sak gäller för de små escape-sekvenserna skrivna som en snedstreck och en bokstav, som står för en radbrytning eller en tab inom en enda rad i en inställningspost. De är två vanliga tecken som ett senare program kommer att tolka, och de måste komma fram till andra sidan oförändrade.
Kostnad för ett vanligt textjobb
Debiteras per ord i dokumentet, så en lång logg med några få unika meddelanden kostar betydligt mindre än dess storlek antyder.
Free
Inget kort behövs för att registrera dig
- 0,005 $/ord AI-översättning
- 1 USD per sida för skanningar och bild-PDF:er
- 120+ språk
- Filer upp till 20 MB och 20 sidor
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG och CSV
- Endast 24-timmars fillagring
- PDF-redigerare och PDF till DOCX-konverterare
- Avbryt när som helst
- Ej inkluderat: E-postsupport
- Ej inkluderat: Teamåtkomst
- Ej inkluderat: Obegränsade gratis PDF-förhandsgranskningar
- Ej inkluderat: Ordlista
Storage
eller 149 USD/år
- 0,005 $/ord AI-översättning
- 1 USD per sida för skanningar och bild-PDF:er
- 120+ språk
- Filer upp till 100 MB och 100 sidor
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG och CSV
- Obegränsad fillagring
- PDF-redigerare och PDF till DOCX-konverterare
- E-postsupport
- Avbryt när som helst
- Ej inkluderat: Teamåtkomst
- Ej inkluderat: Obegränsade gratis PDF-förhandsgranskningar
- Ej inkluderat: Ordlista
Pro
eller 499 USD/år
- 0,004 USD per ord för AI-översättning
- 0,80 USD per sida för skanningar och bild-PDF:er
- 120+ språk
- Filer upp till 1 000 MB och 5 000 sidor
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG och CSV
- Obegränsad fillagring
- PDF-redigerare och PDF till DOCX-konverterare
- E-postsupport
- Teamåtkomst för upp till 5 medlemmar
- Obegränsade gratis PDF-förhandsgranskningar
- Ordlista
- Avbryt när som helst
Företag
149,99 USD/månad, på begäran. AI-översättning för 0,003 USD/ord (0,60 USD per sida), filer upp till 1 000 MB och 5 000 sidor, obegränsad fillagring och teamåtkomst för upp till 15 medlemmar.
Exempel på dokument, sida vid sida
Klicka på en miniatyrbild för att öppna helskärmsvyn. Att läsa över ett par visar:
- Styckeindelningar och tomma radavstånd landar där de gjorde förut.
- Tecken med accenter och icke-latinska tecken återges snarare än att förvanskas till symboler.
- Indrag och numrerade sekvenser behåller sin nästling.
- Resultatet öppnas som redigerbar text, inte som en bild av text.




Varje par kom från en enda uppladdning utan manuell reparation efteråt.
Se alla översättningsexempel →Fem minuters förberedelse, sedan uppladdningen
Nästan alla klagomål om översättning av vanlig text spårar tillbaka till något som redan var sant för dokumentet innan det laddades upp. Dessa kontroller fångar alla av dem.
- 1
Bekräfta att kodningen läses korrekt
Öppna dokumentet i en redigerare som visar och låter dig ändra kodningen. Om tecken med accenter eller icke-latinska tecken ser ut som sekvenser av osammanhängande symboler, läser du det under fel schema. Åtgärda det först och spara en Unicode-kopia, eftersom ingen översättning kan återställa tecken som redan har lästs fel.
- 2
Bestäm vad som är prosa och vad som inte är det
Där innehållet är inställningar, loggar eller undertexter, identifiera de delar som måste förbli orörda: nycklar till vänster om en separator, allvarlighetsord, cue-nummer och tidslinjer. Om majoriteten av dokumentet är maskininnehåll med lite prosa i sig, är det snabbare att extrahera prosan först än att reparera resultatet.
- 3
Skapa ett konto och ladda upp
Registrera dig med en e-postadress och skicka in dokumentet. Enkla uppladdningar går upp till 1 GB, vilket täcker manuskript, transkriptionsarkiv och logg-export utan att dela upp dem i delar.
- 4
Ställ in båda språken och översätt
Att namnge källan spelar större roll här än i ett formaterat dokument, eftersom det inte finns någon markup och inga metadata som systemet kan härleda det från. Välj sedan målet och starta jobbet.
- 5
Öppna resultatet igen och kontrollera samma tre saker
Kodning, radslut och om något som är anpassat för hand behöver fyllas på igen. Om dokumentet ska in i en byggpipeline eller en mediaspelare, kör det genom den pipelinen en gång innan du litar på det.
Om ditt innehåll inte riktigt är vanlig text
- CSV-översättare för tabulär data
- JSON-översättare för strukturerade strängar
- HTML-översättare för markerade sidor
- Word-dokumentöversättare
- Konvertera ett Word-dokument till text
- Extrahera text från en PDF
- Omvandla text till ett kalkylblad
- EPUB-översättare för e-böcker
- Översättare för manuskript
- Översättare för Excel-kalkylblad
Vanliga frågor om vanlig text
Mitt dokument kom tillbaka fullt av konstiga symboler istället för accentuerade bokstäver. Varför?
Det är en teckenkodningskonflikt och den föregår nästan alltid översättningen. Bytes skrivna under ett äldre regionalt system, lästa som om de vore Unicode, ger exakt det mönstret: vanliga bokstäver ser korrekta ut medan accentuerade och icke-latinska tecken blir till serier av osammanhängande symboler. Öppna originalet i en redigerare som låter dig välja teckenkodning, hitta den som visar det korrekt, spara en Unicode-kopia och börja därifrån.
Kommer mina radbrytningar att vara på samma ställen efteråt?
Styckesgränser kommer att finnas där. Enskilda brutna rader kommer inte, och kan inte, vara det eftersom den översatta texten upptar ett annat antal tecken. Där originalet var handbundet vid en fast kolumnbredd, kommer resultatet att brytas vid olika punkter. Om en specifik bredd är viktig för vart dokumentet ska, bryt om det efter översättningen med det verktyg som använder det.
Kan jag översätta ett undertextdokument på detta sätt?
Ja, och två saker behöver uppmärksammas. Tidsnumren och tidslinjerna är koordinater snarare än ord och måste bevaras exakt, och översatt dialog är ofta längre än originalet, vilket kan göra att en rad blir för lång för vad en tittare hinner läsa. Granska de längsta raderna mot tiderna och förkorta där en tidsangivelse har blivit för tät.
Vad sägs om ett inställnings- eller dokument med egenskaper?
Endast högra sidan är språk, och inte allt av det. Nyckeln före separatorn är en identifierare som programvara slår upp med namn, så att översätta den inaktiverar inställningen tyst. Värden som är filvägar, växlar, nummer eller referenser till andra nycklar är inte heller prosa. Där ett dokument mestadels består av nycklar med några få meddelanden, är det snabbare att ta ut meddelandena först än att kontrollera hela resultatet.
Min handritade tabell förlorade sin justering. Kan det undvikas?
Inte i vanlig text, eftersom justering där görs av räknade mellanslag och översättning ändrar hur många tecken en fras upptar. Tyska och ryska expanderar vanligtvis, kinesiska och japanska kontraherar i tecken medan varje tecken tar två visningskolumner. Omjustering efteråt är lösningen. För allt som är genuint tabulärt är ett kalkylblad eller en kommaseparerad export ett bättre hem.
Hur stor dokument kan jag ladda upp?
En enda uppladdning kan nå 1 GB eller fem tusen sidor motsvarande innehåll på Pro- och Enterprise-planerna, så fullängdsmanuskript, transkriptionssamlingar och långa exporter går igenom i ett stycke. Att skicka det helt snarare än i bitar håller också återkommande terminologi konsekvent från första till sista sidan.
Är resultatet redigerbart, eller en bild?
Redigerbart. Det som kommer tillbaka är ett textdokument du kan öppna i vilken redigerare som helst och fortsätta arbeta i, med samma teckensinnehåll och struktur som originalet. Ingenting är rasteriserat och ingenting är låst.
Vad kostar det för ett långt dokument?
Prissättningen följer ordantalet snarare än byteantalet. Varje dokument faktureras separat till 0,005 USD per ord på Free och Storage, 0,004 USD på Pro eller 0,003 USD på Enterprise, med ett minimum på 0,99 USD, och en prenumeration lägger till lagring och högre gränser men inkluderar inga översättningar. Så ett manuskript kan uppskattas direkt från dess ordantal innan du börjar.
Skicka dokumentet, behåll strukturen
Kontrollera teckenkodningen, ladda upp, välj språken och få tillbaka redigerbar text med styckena, indragningen och de icke-latinska tecknen där de hör hemma.
Våra partners
Relaterade översättningstjänster
Filformat
PDF-verktyg
