TXT-oversætter
Ren tekst indeholder ingen markup at beskytte og ingen skema at følge, hvilket gør det til den simpleste ting at oversætte og den nemmeste at ødelægge stille og roligt. Upload manuskripter, noter, udskrifter eller eksportfiler og få dem tilbage med tegnkodningen, linjeskiftene og indrykningen intakt.
Upload eller træk dokumentet hertil for oversættelse
Maks. filstørrelse 1 GB
Udvidelsen lover næsten intet
Alle andre dokumentformater indeholder en beskrivelse af sig selv. Et tekstbehandlingsdokument navngiver sine skrifttyper og erklærer sit tegnkodningssæt. En side med markup pakker sit indhold ind i tags, der siger, hvad hver del er. Ren tekst erklærer intet af det. Det er en række bytes med en aftale om, at nogen vil læse dem som tegn, og hele aftalen er uskrevne.
Tre ting skal derfor udledes snarere end læses: hvilken tegnkodning bytes tilhører, hvilken sekvens forfatteren brugte til at afslutte en linje, og om linjeskiftene er meningsfulde eller blot bredden af nogens redigeringsvindue. Software gætter alle tre, hver gang du åbner et sådant dokument, og det er normalt rigtigt, hvilket netop er grunden til, at fejlene er overraskende, når de opstår.
Fordelen er reel. Der er ingen styling at bevare, ingen layoutmotor at kæmpe med, ingen indlejret objekt at miste. Hvis kodningen og linjestrukturen overlever, har alt overlevet. Resten af denne side handler om disse to ting.
Hvad folk rent faktisk gemmer i ren tekst
Udvidelsen knyttes til ting, der slet ikke er prosa, og hver af disse kræver en anden form for pleje. At vide, hvilken du holder, afgør, om jobbet tager et minut eller kræver forberedelse.
- Sammenhængende prosa. Manuskripter, noter, artikeludkast, interviewtransskriptioner, skrabede artikelkroppe. Dette er den ligefremme sag, og det eneste, man skal være opmærksom på, er, om afsnit er adskilt af en tom linje eller slet intet.
- Undertekster og billedtekster. Nummererede signaler, en timinglinje og en eller to linjer dialog. Timingerne er koordinater og skal gengives nøjagtigt, mens dialoglinjerne skal forblive korte nok til at blive læst i fart, hvilket er vigtigt, fordi oversatte linjer ofte er længere end dem, de erstatter.
- Indstillinger og egenskabslister. En nøgle, en separator og en værdi på hver linje. Nøglen til venstre er en identifikator, som software slår op efter navn; at røre ved den deaktiverer indstillingen lydløst. Kun værdien til højre, og kun hvor den værdi er en besked snarere end en sti eller en switch, er sprog.
- Logfiler og maskinuddata. Tidsstempler, alvorlighedsord, identifikatorer og stakspor. Oversættelse af et alvorlighedsord bryder enhver filter, der søger efter det, og et stakspor er ikke prosa på noget sprog.
- Tabulære eksportfiler i forklædning. Værdier adskilt af tabuleringer, gemt med den forkerte udvidelse. Hvis dit indhold virkelig er et gitter, hører det i stedet til CSV-oversætteren, som forstår poster og kolonner.
- Læse-mig-noter og licenstekst. Prosa med overskrifter lavet af store bogstaver og rækker af bindestreger, nummererede klausuler og hårdt ombrudte afsnit. Den falske struktur er den del, der går i stykker.
Tre usynlige egenskaber, der afgør resultatet
Ingen af disse er synlige, når du ser indholdet på skærmen, og hver af dem kan gøre en god oversættelse ubrugelig.
Hvilken kodning bytes tilhører
Før Unicode blev standard, havde hver sprogregion sit eget enkelt-byte eller multi-byte-system: separate for kyrillisk, for vesteuropæiske accenter, for græsk, for japansk, for forenklet og traditionelt kinesisk, for koreansk. Dokumenter skrevet under disse systemer er stadig i omløb, og intet i dem siger, hvilket system der gælder. Åbn et under den forkerte antagelse, og de accenterte tegn bliver til en række nonsens, mens de almindelige bogstaver ser fine ud, så skaden er let at overse ved et hurtigt blik. Tjek i en editor, der lader dig vælge kodningen eksplicit, og genåbn, indtil accenterne og de ikke-latinske tegn læses korrekt.
Hvordan en linje slutter
Windows-værktøjer afslutter en linje med to kontroltegn, alt afledt af Unix bruger et, og meget gamle Macintosh-dokumenter brugte det andet alene. De fleste moderne editorer accepterer alle tre, men masser af script-behandling gør ikke, og at blande konventioner inde i et dokument er det, der producerer ekstra tegn i slutningen af hver linje eller et dokument, der vises som et enkelt ubrudt afsnit. Hold én konvention igennem, og foretræk den, som systemet, der vil forbruge resultatet, forventer.
Om et linjeskift betyder noget
Tekst ombrudt manuelt ved en fast bredde har et skift i slutningen af hver linje, og disse skift er en artefakt af bredden snarere end en del af skrivningen. Et afsnit er normalt markeret med en tom linje mellem blokke. At behandle hver ombrudt linje som en enhed hakker sætninger i fragmenter og oversætter dem ud af kontekst, hvilket læses dårligt på ethvert sprog. At holde afsnittet som enheden er korrekt, og det betyder, at outputtet vil ombrydes på andre punkter end originalen. Det er forventet, ikke en fejl.
Alt, der er justeret med mellemrum, vil blive vist forkert.
Hvorfor kolonnerne forskydes
Uden styling er den eneste måde at justere noget på at tælle tegn. Tabeller tegnet med lodrette streger og bindestreger, overskrifter understreget med rækker af lighedstegn, regnskaber polstret med mellemrum, indrykket disposition og bokse lavet af linjetegn afhænger alle af, at hver post optager den samme bredde, som den gjorde før.
Oversættelse ændrer bredden på næsten alt. Tysk og russisk fylder almindeligvis en femtedel til en tredjedel mere end engelsk; kinesisk og japansk bruger færre tegn, men hver optager to kolonner i en fast bredde-visning. Uanset hvad, flytter justeringen sig. Forvent at skulle polstre håndtegnede tabeller bagefter, og overvej, om indholdet ønsker et rigtigt regneark i stedet.
Førende mellemrum er indhold
I et indstillingsdokument, i et kodestykke og i enhver disposition bærer mellemrummene i starten af en linje mening: de viser indrykning, eller de markerer en blok som bogstavelig. En fane og en række mellemrum ser identiske ud på skærmen og er forskellige bytes, så et værktøj, der normaliserer den ene til den anden, ændrer dokumentet uden at det ser ud til.
Det samme gælder for de små escape-sekvenser skrevet som en omvendt skråstreg og et bogstav, der står for et linjeskift eller en fane inde i en enkelt linje af en indstillingspost. De er to almindelige tegn, som et senere program vil fortolke, og de skal ankomme uændret til den anden side.
Pris for et almindeligt tekstjob
Betales pr. ord i dokumentet, så en lang logfil med få unikke beskeder koster langt mindre, end dens størrelse antyder.
Free
Intet kort kræves for at tilmelde sig
- 0,005 $/ord AI-oversættelse
- 1 USD pr. side for scanninger og billed-PDF'er
- 120+ sprog
- Filer op til 20 MB og 20 sider
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG og CSV
- Kun 24-timers fillagring
- PDF-editor og PDF til DOCX-konverter
- Annuller når som helst
- Ikke inkluderet: E-mailsupport
- Ikke inkluderet: Teamadgang
- Ikke inkluderet: Ubegrænsede gratis PDF-forhåndsvisninger
- Ikke inkluderet: Ordliste
Storage
eller 149 USD/år
- 0,005 $/ord AI-oversættelse
- 1 USD pr. side for scanninger og billed-PDF'er
- 120+ sprog
- Filer op til 100 MB og 100 sider
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG og CSV
- Ubegrænset fillagring
- PDF-editor og PDF til DOCX-konverter
- E-mail support
- Annuller når som helst
- Ikke inkluderet: Teamadgang
- Ikke inkluderet: Ubegrænsede gratis PDF-forhåndsvisninger
- Ikke inkluderet: Ordliste
Pro
eller 499 USD/år
- 0,004 USD pr. ord AI-oversættelse
- 0,80 USD pr. side for scanninger og billed-PDF'er
- 120+ sprog
- Filer op til 1.000 MB og 5.000 sider
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG og CSV
- Ubegrænset fillagring
- PDF-editor og PDF til DOCX-konverter
- E-mail support
- Teamadgang for op til 5 medlemmer
- Ubegrænsede gratis PDF-forhåndsvisninger
- Ordliste
- Annuller når som helst
Virksomhed
149,99 USD/måned, efter anmodning. AI-oversættelse til 0,003 USD pr. ord (0,60 USD pr. side), filer op til 1.000 MB og 5.000 sider, ubegrænset fillagring og teamadgang for op til 15 medlemmer.
Eksempler på dokumenter, side om side
Klik på en miniature for at åbne fuld visning. Læsning på tværs af et par viser:
- Afsnitsbrud og tomme linjer lander, hvor de gjorde før.
- Accenterte og ikke-latinske tegn gengives i stedet for at blive til symboler.
- Indrykning og nummererede sekvenser bevarer deres indrykning.
- Resultatet åbnes som redigerbar tekst, ikke som et billede af tekst.




Hvert par kom fra en enkelt upload uden manuel reparation bagefter.
Se alle oversættelseseksempler →Fem minutters forberedelse, derefter upload
Næsten alle klager over oversættelse af almindelig tekst kan spores tilbage til noget, der allerede var sandt for dokumentet, før det blev uploadet. Disse kontroller fanger dem alle.
- 1
Bekræft, at kodningen læses korrekt
Åbn dokumentet i en editor, der viser og lader dig ændre kodningen. Hvis accenterte eller ikke-latinske tegn ligner sekvenser af usammenhængende symboler, læser du det under den forkerte ordning. Ret det først og gem en Unicode-kopi, for ingen oversættelse kan gendanne tegn, der allerede blev fejllæst.
- 2
Beslut, hvad der er prosa, og hvad der ikke er
Hvor indholdet er indstillinger, logs eller undertekster, skal du identificere de dele, der skal forblive urørte: nøgler til venstre for en separator, alvorlighedsord, cue-numre og timing-linjer. Hvis det meste af dokumentet er maskinindhold med lidt prosa i, er det hurtigere at udtrække prosaen først end at reparere resultatet.
- 3
Opret en konto og upload
Tilmeld dig med en e-mailadresse og send dokumentet ind. Enkelt-uploads kører op til 1 GB, hvilket dækker manuskripter, transskriptionsarkiver og log-eksport uden at opdele dem i dele.
- 4
Indstil begge sprog og oversæt
Navngivning af kilden betyder mere her end i et formateret dokument, fordi der ikke er nogen markup og ingen metadata, som systemet kan udlede det fra. Vælg derefter målet og start jobbet.
- 5
Genåbn resultatet og kontroller de samme tre ting
Kodning, linjeafslutninger og om noget, der er justeret manuelt, skal polstres igen. Hvis dokumentet skal ind i en build-pipeline eller en medieafspiller, skal du køre det gennem den pipeline én gang, før du stoler på det.
Hvis dit indhold ikke er rigtig almindelig tekst
Almindelige spørgsmål om almindelig tekst
Mit dokument kom tilbage fyldt med mærkelige symboler i stedet for accenttegn. Hvorfor?
Det er en kodningsfejl, og den ligger næsten altid før selve oversættelsen. Bytes skrevet under et ældre regionalt system, læst som om de var Unicode, producerer præcis det mønster: almindelige bogstaver ser korrekte ud, mens accentuerede og ikke-latinske tegn bliver til serier af usammenhængende symboler. Åbn originalen i en editor, der lader dig vælge kodningen, find den, der viser den korrekt, gem en Unicode-kopi og start derfra.
Vil mine linjeskift være de samme bagefter?
Afsnitsgrænser vil være. Individuelle ombrudte linjer vil ikke, og kan ikke, fordi den oversatte ordlyd optager et forskelligt antal tegn. Hvor originalen var hånd-ombrudt ved en fast kolonnebredde, vil resultatet bryde ved forskellige punkter. Hvis en bestemt bredde er vigtig for, hvor dokumentet skal hen, ombryd det efter oversættelsen med det værktøj, der skal bruge det.
Kan jeg oversætte et undertekstdokument på denne måde?
Ja, og to ting kræver opmærksomhed. Cue-numrene og tidslinjerne er koordinater snarere end ord og skal overleve nøjagtigt, og oversat dialog er ofte længere end originalen, hvilket kan skubbe en linje forbi, hvad en seer kan læse på den tilgængelige tid. Gennemgå de længste linjer i forhold til tidsstemplerne og forkort, hvor en cue er blevet for tæt.
Hvad med et indstillings- eller egenskabsdokument?
Kun højre side er sprog, og ikke alt af det. Nøglen før separatoren er en identifikator, som software slår op ved navn, så oversættelse af den deaktiverer indstillingen lydløst. Værdier, der er filstier, kontakter, tal eller referencer til andre nøgler, er heller ikke prosa. Hvor et dokument mest består af nøgler med få beskeder, er det hurtigere at trække beskederne ud først end at tjekke hele resultatet.
Min håndtegnede tabel mistede sin justering. Kan det undgås?
Ikke i ren tekst, fordi justering der er lavet af tællede mellemrum, og oversættelse ændrer, hvor mange tegn en frase optager. Tysk og russisk udvider typisk, kinesisk og japansk trækker sig sammen i tegn, mens hver af dem optager to kolonnebredder. Genpolstring bagefter er løsningen. For alt, der er ægte tabelform, er et regneark eller en kommasepareret eksport et bedre sted.
Hvor stort et dokument kan jeg uploade?
En enkelt upload kan nå 1 GB eller fem tusinde sider med tilsvarende indhold på Pro- og Enterprise-planerne, så fuldlængde manuskripter, transskriptsamlinger og lange eksporter går igennem i ét stykke. At sende det helt i stedet for i bidder holder også tilbagevendende terminologi konsistent fra første til sidste side.
Er resultatet redigerbart, eller et billede?
Redigerbart. Hvad der kommer tilbage er et tekst dokument, du kan åbne i enhver editor og fortsætte med at arbejde i, med samme tegnindhold og struktur som originalen. Intet er rasteriseret, og intet er låst.
Hvad koster det for et langt dokument?
Prissætningen følger ordantallet snarere end byteantallet. Hvert dokument faktureres for sig selv til $0,005 pr. ord på Free og Storage, $0,004 på Pro eller $0,003 på Enterprise, med et minimum på $0,99, og et abonnement tilføjer lagerplads og højere grænser, men inkluderer ingen oversættelser. Så et manuskript kan estimeres direkte ud fra dets ordantal, før du starter.
Send dokumentet, bevar strukturen
Tjek kodningen, upload, vælg sprogene, og få redigerbar tekst tilbage med afsnit, indrykninger og ikke-latinske tegn, hvor de hører hjemme.
Vores Partnere
Relaterede oversættelsestjenester
Filformater
PDF-værktøjer
