KI-drevet · 120+ språk

Oversett PDF til uigurisk

Konverter PDF-er til uigurisk i det høyre-til-venstre arabiske alfabetet som brukes i Xinjiang, og håndter sider som inneholder uigurisk, kinesisk og latinsk tekst samtidig. Filer opptil 1 GB.

Maks filstørrelse 1 GB Beholder original formatering
Registrer deg gratis

Last opp eller dra dokument for å oversette

Maks filstørrelse 1 GB

.PDF .DOCX .PPTX .XLSX .TXT .JPG .PNG .IDML .EPUB .HTML
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amharisk)
العربية (Arabic)
Հայերեն (Armensk)
Azərbaycan dili (Aserbajdsjansk)
Euskara (Baskisk)
Беларуская (Hviterussisk)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Burmesisk)
Català (Katalansk)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Kinesisk forenklet)
中文 繁體 (Kinesisk tradisjonell)
Corsu (Korsikansk)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frisisk (Frysk)
Galicisk (Galego)
Georgisk (ქართული)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Haitisk (Kreyòl Ayisyen)
Hausa (Hausa)
Hawaiisk (ʻŌlelo Hawaiʻi)
עברית (Hebrew)
Hindi (हिंदी)
Hmong (Hmoob)
Magyar (Hungarian)
Islandsk (Íslenska)
Igbo (Igbo)
Indonesisk (Bahasa Indonesia)
Irsk (Gaeilge)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
Kannada (ಕನ್ನಡ)
Kasakhisk (Қазақ тілі)
Khmer (ខ្មែរ)
Kinyarwanda (Ikinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Kirgisisk (Кыргызча)
Laotisk (ລາວ)
Latin (Latina)
Latvisk (Latviešu)
Litauisk (Lietuvių)
Luxemburgsk (Lëtzebuergesch)
Makedonsk (Македонски)
Gassisk (Malagasy)
Bahasa Melayu (Malay)
Malayalam (മലയാളം)
Maltesisk (Malti)
Maori (Te Reo Māori)
मराठी (Marathi)
Mongolsk (Монгол хэл)
Nepalsk (नेपाली)
Norsk (Norwegian)
Odia (ଓଡ଼ିଆ)
فارسی (Persian)
Polski (Polish)
Portugisisk (Português)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Samoansk (Gagana Samoa)
Skotsk (Gàidhlig)
Српски (Serbian)
Sesotho (Sesotho)
Shona (Shona)
Sindhi (سنڌي)
Singalesisk (සිංහල)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Somali (Soomaali)
Español (Spanish)
Sundanesisk (Basa Sunda)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Tojik (Tajik)
தமிழ் (Tamil)
Tatar (Tatar)
తెలుగు (Telugu)
Thai (Thai)
Türkçe (Turkish)
Türkmençe (Turkmen)
Українська (Ukrainian)
اردو (Urdu)
Uyghur (Uyghur)
Usbekisk (Usbekisk)
Tiếng Việt (Vietnamese)
Walisisk (Walisisk)
Xhosa (Xhosa)
Jiddisk (Jiddisk)
Yoruba (Yoruba)
Zulu (Zulu)
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amharisk)
العربية (Arabic)
Հայերեն (Armensk)
Azərbaycan dili (Aserbajdsjansk)
Euskara (Baskisk)
Беларуская (Hviterussisk)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Burmesisk)
Català (Katalansk)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Kinesisk forenklet)
中文 繁體 (Kinesisk tradisjonell)
Corsu (Korsikansk)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frisisk (Frysk)
Galicisk (Galego)
Georgisk (ქართული)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Haitisk (Kreyòl Ayisyen)
Hausa (Hausa)
Hawaiisk (ʻŌlelo Hawaiʻi)
עברית (Hebrew)
Hindi (हिंदी)
Hmong (Hmoob)
Magyar (Hungarian)
Islandsk (Íslenska)
Igbo (Igbo)
Indonesisk (Bahasa Indonesia)
Irsk (Gaeilge)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
Kannada (ಕನ್ನಡ)
Kasakhisk (Қазақ тілі)
Khmer (ខ្មែរ)
Kinyarwanda (Ikinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Kirgisisk (Кыргызча)
Laotisk (ລາວ)
Latin (Latina)
Latvisk (Latviešu)
Litauisk (Lietuvių)
Luxemburgsk (Lëtzebuergesch)
Makedonsk (Македонски)
Gassisk (Malagasy)
Bahasa Melayu (Malay)
Malayalam (മലയാളം)
Maltesisk (Malti)
Maori (Te Reo Māori)
मराठी (Marathi)
Mongolsk (Монгол хэл)
Nepalsk (नेपाली)
Norsk (Norwegian)
Odia (ଓଡ଼ିଆ)
فارسی (Persian)
Polski (Polish)
Portugisisk (Português)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Samoansk (Gagana Samoa)
Skotsk (Gàidhlig)
Српски (Serbian)
Sesotho (Sesotho)
Shona (Shona)
Sindhi (سنڌي)
Singalesisk (සිංහල)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Somali (Soomaali)
Español (Spanish)
Sundanesisk (Basa Sunda)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Tojik (Tajik)
தமிழ் (Tamil)
Tatar (Tatar)
తెలుగు (Telugu)
Thai (Thai)
Türkçe (Turkish)
Türkmençe (Turkmen)
Українська (Ukrainian)
اردو (Urdu)
Uyghur (Uyghur)
Usbekisk (Usbekisk)
Tiếng Việt (Vietnamese)
Walisisk (Walisisk)
Xhosa (Xhosa)
Jiddisk (Jiddisk)
Yoruba (Yoruba)
Zulu (Zulu)
ARABISK PORTUGISISK RUSISK ITALISK KOREANSK NEDERLANDSK POLSK TYRKISK SVENSK ENGELSK SPANSK FRANSK TYSK KINESISK JAPANSK HINDI BENGALI VIETNAMESISK THAI GRASK HEBRAISK ARABISK PORTUGISISK RUSISK ITALISK KOREANSK NEDERLANDSK POLSK TYRKISK SVENSK ENGELSK SPANSK FRANSK TYSK KINESISK JAPANSK HINDI BENGALI VIETNAMESISK THAI GRASK HEBRAISK

Tre alfabeter for ett språk, og skriften forteller deg hvor et dokument kommer fra

Uigurisk skrives på tre forskjellige måter avhengig av hvor leserne bor. Det persisk-arabiske alfabetet, som løper fra høyre til venstre, har vært standarden i Kina siden tidlig på 1980-tallet og er det nesten alt materiale fra Xinjiang Uyghur Autonomous Region bruker. Et latinsk alfabet utviklet tidlig på 2000-tallet brukes mye på nettet, i databehandling og i akademisk arbeid, fordi det er enkelt å skrive på et vanlig tastatur. Et kyrillisk alfabet brukes av de lenge etablerte uiguriske samfunnene i Kasakhstan og Kirgisistan, en arv fra sovjetisk språkpolitikk. Det var også en tidligere latinsk skrift, offisiell for en del av 1960- og 1970-tallet og deretter forlatt, som av og til dukker opp i dokumenter fra den perioden.

Det praktiske resultatet er at skriften på et uigurisk dokument er en grov etikett for dets opprinnelse og dato, og at målbokstaven er et spørsmål å besvare før oversettelse snarere enn etter. En fil bestemt for en uigurisk leser i Istanbul eller München ønsker normalt det arabiske alfabetet, som er det disse samfunnene vokste opp med å lese. En fil for en uigurisk familie i Almaty kan ønske kyrillisk. Et datasett, en filnavnliste eller noe som må overleve et system med dårlig arabisk støtte ønsker det latinske alfabetet. Konvertering mellom dem er mekanisk når språket er riktig, men å velge feil gir leseren noe de ikke kan bruke.

Uigur er et tyrkisk språk, i samme gren som usbekisk, og det snakkes av rundt elleve millioner mennesker. Utenfor Xinjiang finnes det samfunn over hele Sentral-Asia og en diaspora konsentrert i Tyrkia, Tyskland, Nederland, Sverige, Australia og USA, som er der de fleste oversettelsesforespørsler i dette paret oppstår.

En arabisk skrift som staves ut alle åtte vokalene

Uigur tilhører den lille gruppen språk som har tilpasset den arabiske skriften og deretter gjort den fullstendig alfabetisk. Arabisk og persisk utelater korte vokaler og forventer at leserne rekonstruerer dem; uigur skriver alle sine åtte vokaler som bokstaver, så ingenting er underforstått. Det er utmerket for lesere og krevende for fonter, fordi flere av bokstavene som er involvert, sammen med ڭ for ng-lyden, ۋ, گ, پ, چ og ژ, mangler i skriftsnitt bygget kun for arabisk. Et skriftsnitt som mangler en bokstav, kan heller ikke koble den til nabobokstavene i den kursive linjen, så de manglende tegnene bryter ut og flyter alene, og et ord ser ut som om det har blitt revet i stykker.

Grammatikken er grundig tyrkisk. Uigur er agglutinerende, og stabler suffikser på en rot der engelsk ville brukt separate ord, og det plasserer verbet på slutten av leddet. Det har ingen grammatisk kjønn og ingen artikler. Vokalharmoni styrer hvilken form av et suffiks som festes til hvilken rot, der fremre vokaler krever fremre vokalsuffikser og bakre vokaler bakre, og en oversettelse som ignorerer harmoni, produserer ord som er gjenkjennelige og feil på samme måte som en feilstaving.

Suffiks-stabling gjør også ord lange, og lange ord i en kolonne fra høyre til venstre skaper samme layout-press som de gjør andre steder, med den ekstra komplikasjonen at selve kolonnen må speilvendes. Tabeller leses fra høyre kant innover, overskrifter justeres til høyre, og nummererte lister går motsatt vei.

Fire problemer spesifikke for uiguriske dokumenter

Tre skriveretninger på én side

Offisielle skjemaer fra Xinjiang er ofte tospråklige, noe som plasserer en arabisk skrift fra høyre til venstre, en blokk med kinesiske tegn og vestlige sifre i samme layout. Den kombinasjonen er omtrent det vanskeligste en side kan presentere, og det er der arvet engelsk geometri faller mest synlig fra hverandre.

Én person, tre stavemåter av navnet deres

Et navn kan vises i arabisk skrift på et uigurisk dokument, i en pinyin-transliterasjon gjennom kinesisk på et identitetskort, og i en tredje latinsk stavemåte på et reisedokument, og de tre stemmer ikke overens. I en innvandrings- eller asylsak må den uoverensstemmelsen forklares i stedet for å bli stille glattet over.

Skanninger heller enn filer

Mye av det som kommer inn i dette paret er fotografert heller enn eksportert: en side holdt opp mot et telefonkamera, et gammelt sertifikat, et dokument kopiert flere ganger. Bildekvalitet bestemmer utfallet mer enn noe annet ved språket, så bruk den beste kopien som er tilgjengelig.

Datoer og administrativt vokabular

Kinesisk administrativ terminologi sitter inne i uiguriske dokumenter i oversatt form, fra enhetsnavn til offisielle titler, og å gjengi det tilbake til engelsk trenger det kinesiske originalen synlig i stedet for en bokstavelig lesing av uiguren. Å få et institusjonsnavn feil i en fil er verre enn å la det stå i kilden.

Hva folk tar med for oversettelse

Nesten all etterspørselen i dette paret kommer fra diasporaen og fra organisasjonene, advokatene og forskerne som jobber med den:

  • Asyl- og beskyttelseskrav innlevert i Tyrkia, Tyskland, Nederland, Sverige, Australia og USA, sammen med støttedokumentene som er vedlagt dem
  • Kinesiske identifikasjonsdokumenter, husholdningsregistreringsjournaler og reisedokumenter med uiguriske navnefelt
  • Akademiske vitnemål, diplomer og faglige kvalifikasjoner utstedt i Xinjiang
  • Medisinske journaler og behandlingshistorikker, ofte trengt raskt og ofte bare tilgjengelig som fotografier
  • Familiegjenforeningssaker, korrespondanse og personlige erklæringer
  • Vitnesbyrd, vitneforklaringer og dokumentasjon samlet inn av menneskerettighetsorganisasjoner og forskere
  • Sivile dokumenter i kyrillisk uigur fra Kasakhstan og Kirgisistan, som tilhører et annet administrativt system igjen
  • Religiøse, litterære og samfunnspublikasjoner, og eldre trykt materiale som går inn i arkiver

Maskinoversettelse er den raske måten å finne ut hva et dokument inneholder, noe som er viktig når en saksmappe kommer som femti fotografier. Selve innleveringen krever en sertifisert oversettelse fra en kvalifisert oversetter, og beskyttelseskrav er spesielt viktige, da de leses med oppmerksomhet på datoer, stedsnavn og stavemåten av navn, så det er feltene som bør sjekkes av et menneske før noe sendes inn.

Priser for oversettelse av uiguriske PDF-er

Registrer deg gratis, betal per dokument, og oppgrader etter hvert som dine oversettelsesbehov vokser.

Free

$0

Ingen kort kreves for registrering

  • 0,005 USD/ord AI-oversettelse
  • 1 dollar per side for skanninger og bilde-PDF-er
  • 120+ språk
  • Filer opptil 20 MB og 20 sider
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG og CSV
  • Kun 24-timers fillagring
  • PDF-redigering og PDF til DOCX-konvertering
  • Avbryt når som helst
  • Ikke inkludert: E-poststøtte
  • Ikke inkludert: Tilgang for team
  • Ikke inkludert: Ubegrensede gratis PDF-forhåndsvisninger
  • Ikke inkludert: Ordliste

Storage

14,99 $/måned

eller 149 dollar/år

  • 0,005 USD/ord AI-oversettelse
  • 1 dollar per side for skanninger og bilde-PDF-er
  • 120+ språk
  • Filer opptil 100 MB og 100 sider
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG og CSV
  • Ubegrenset fillagring
  • PDF-redigering og PDF til DOCX-konvertering
  • E-poststøtte
  • Avbryt når som helst
  • Ikke inkludert: Tilgang for team
  • Ikke inkludert: Ubegrensede gratis PDF-forhåndsvisninger
  • Ikke inkludert: Ordliste

Pro

49,99 dollar/måned

eller 499 dollar/år

  • 0,004 dollar per ord for AI-oversettelse
  • 0,80 dollar per side for skanninger og bilde-PDF-er
  • 120+ språk
  • Filer opptil 1000 MB og 5000 sider
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG og CSV
  • Ubegrenset fillagring
  • PDF-redigering og PDF til DOCX-konvertering
  • E-poststøtte
  • Tilgang for team for opptil 5 medlemmer
  • Ubegrensede gratis PDF-forhåndsvisninger
  • Ordliste
  • Avbryt når som helst

Bedrift

149,99 dollar/måned, på forespørsel. AI-oversettelse til 0,003 dollar per ord (0,60 dollar per side), filer opptil 1000 MB og 5000 sider, ubegrenset fillagring og tilgang for team for opptil 15 medlemmer.

Kontakt salg
Nødvendige trinn

Slik oversetter du PDF-en din til uigurisk

01

Opprett en gratis konto

Registrer deg med e-posten din for å få tilgang til dashbordet for nettbasert oversettelse.

02

Last opp PDF-filen din

Dra og slipp filen eller bla etter den. Fotograferte dokumenter er vanlige i dette paret og støttes, selv om den skarpeste kopien alltid gir det beste resultatet.

03

Velg uigurisk som målspråk

Still inn kildespråket, og velg deretter uigurisk. Utdata bruker den høyre-til-venstre arabiske alfabetstandarden i Xinjiang, med ڭ og de åtte vokalbokstavene skrevet riktig.

04

Oversett og last ned

Kjør jobben og åpne filen. Sjekk en linje som blander uigurisk med sifre eller kinesisk, siden blandede retningslinjer er der en layoutfeil vises først.

Ofte stilte spørsmål om oversettelse av uiguriske PDF-er

Hvilket uigurisk alfabet vil jeg få?

Det persisk-arabiske, som går fra høyre til venstre, som har vært standarden i Kina siden tidlig på 1980-tallet og er det som det store flertallet av uiguriske lesere bruker, inkludert i den tyrkiske og europeiske diasporaen. Et latinsk alfabet eksisterer og er populært på nettet og i databehandling, og et kyrillisk alfabet brukes av uiguriske samfunn i Kasakhstan og Kirgisistan. Hvis leserne dine er i Sentral-Asia, eller hvis resultatet må passere gjennom et system med svak arabisk støtte, si ifra før jobben i stedet for å konvertere etterpå.

Hvorfor vises ikke mitt uiguriske riktig med en arabisk font?

Fordi uigurisk skriver alle sine åtte vokaler som bokstaver i stedet for å utelate korte vokaler fra siden, og flere av disse bokstavene, sammen med ڭ for ng og noen konsonanter lånt fra persisk, ikke eksisterer i det arabiske alfabetet. En font laget for arabisk har rett og slett ingen glyf for dem. Den kan heller ikke koble sammen det den ikke har, så de manglende bokstavene faller ut av den kursive linjen og står alene, noe som får ord til å se ut som om de har blitt brutt midt på.

Mine dokumenter har uigurisk og kinesisk på samme side. Er det et problem?

Det er den vanskeligste layout-saken i dette paret, og det er også helt normalt for offisielle skjemaer fra Xinjiang. Siden inneholder en høyre-til-venstre-skrift, en blokk med kinesiske tegn som flyter den andre veien, og vestlige sifre som følger sine egne regler, og alle tre må plasseres under Unicode tosidige algoritme i stedet for å slippes inn i et rutenett designet for engelsk. Last opp hele siden i stedet for å beskjære til ett språk, fordi layouten er en del av det som må gjengis.

Navnet på dokumentene mine er stavet forskjellig på hver av dem. Hva skal oversettelsen bruke?

Hold forskjellene synlige i stedet for å rydde dem bort. Et uigurisk navn kan vises i arabisk skrift på ett dokument, som en pinyin-transliterasjon gjennom kinesisk på et identitetskort, og i en annen latinsk stavemåte på et reisedokument, og ingen av de tre samsvarer med de andre. I en innvandrings- eller asylsak er en uforklart uoverensstemmelse et problem, men en stille harmonisert en er verre. Vanlig praksis er å gjengi hvert dokument slik det står og forklare forholdet separat.

Hvor mye betyr skansekvalitet?

Mye, fordi det meste som kommer inn i dette paret er fotografert i stedet for eksportert: en side holdt under en telefonkamera, et sertifikat kopiert flere ganger, et gammelt dokument som har vært brettet. Lese-steget, ikke oversettelses-steget, er der kvaliteten går tapt, og ingen mengde språkmodellering gjenoppretter tegn som aldri var leselige. Hvis en skarpere kopi av et dokument eksisterer, er det verdt å vente på.

Er en AI-oversettelse akseptabel for en asylsøknad?

Bruk den til å finne ut hva du holder, spesielt når en fil kommer som dusinvis av fotografier og noen må triagere den raskt. Ikke arkiver den. Beskyttelseskrav undersøkes nøye, og datoer, stedsnavn, institusjonsnavn og stavemåten av personnavn er nøyaktig feltene der en automatisert lesing av en dårlig skanning går galt. Innleveringen trenger en sertifisert oversettelse signert av en kvalifisert oversetter.

Kan jeg oversette fra uigurisk til engelsk også?

Ja, og det er den vanligste retningen med stor margin. Advokater, saksbehandlere, forskere og journalister trenger å lese identitetsdokumenter, utskrifter, medisinske journaler, korrespondanse og vitnesbyrd som bare eksisterer på uigurisk. Motsatt retning oppstår hovedsakelig for organisasjoner som produserer informasjon for uiguriske samfunn i utlandet, der det arabiske alfabetet igjen er det riktige valget for de fleste lesere.

Oversett PDF-en din til uigurisk

DocTranslator konverterer PDF-er til uigurisk online, skriver hele det arabiske alfabetet språket bruker, legger ut sider som blander uigurisk, kinesisk og latinsk tekst, og holder strukturen din intakt på filer opptil 1 GB.

Våre partnere

Accenture
Bloomberg
Citrix
P&G
SAP