เทคโนโลยีการแปลเอกสารของเราเอง
DocTranslator AI Engine
DocTranslator AI Engine คือเทคโนโลยีการแปลเอกสารที่เราพัฒนาขึ้นเอง ในขณะที่เครื่องมือแปลส่วนใหญ่ทำงานกับข้อความธรรมดา เครื่องมือนี้ทำงานกับทั้งหน้า: มันค้นหาตำแหน่งของแต่ละบรรทัด แปล และเขียนคำแปลกลับไปยังตำแหน่งเดิม ดังนั้นไฟล์ที่คุณดาวน์โหลดจะมีเลย์เอาต์เหมือนกับไฟล์ที่คุณอัปโหลด
ออกแบบและเขียนโดยทีม DocTranslator
วิธีการทำงาน
สี่ขั้นตอนตั้งแต่การอัปโหลดจนถึงไฟล์ที่เสร็จสมบูรณ์
- 01
อ่าน
อ่านไฟล์
เครื่องมือจะระบุประเภทของไฟล์จากเนื้อหาแทนที่จะเป็นชื่อไฟล์: ไฟล์ PDF ที่มีเลเยอร์ข้อความจริง, ไฟล์สแกน, รูปภาพ หรือเอกสาร Office แต่ละประเภทจะใช้เส้นทางที่แตกต่างกัน
- 02
แยก
แยกคำออกจากหน้า
เฉพาะข้อความเท่านั้นที่จะถูกดึงออกมา รูปภาพ ไดอะแกรม แผนภูมิ ภาพถ่าย ลายเซ็น และตราประทับจะยังคงอยู่ที่เดิมและจะไม่ถูกส่งไปแปล
- 03
แปล
แปลและตรวจสอบ
แต่ละส่วนจะถูกแปลและตรวจสอบก่อนที่จะยอมรับ ส่วนที่ล้มเหลวในการตรวจสอบจะถูกแปลอีกครั้ง
- 04
สร้างใหม่
สร้างหน้าใหม่
คำแปลจะกลับไปอยู่ในตำแหน่งเดิม โดยตั้งค่าด้วยฟอนต์ที่มีอักขระของภาษาเป้าหมาย
A · PDF ดิจิทัล
ไฟล์ PDF ที่มีเลเยอร์ข้อความ
ในไฟล์ PDF ที่ส่งออกจาก Word, InDesign หรือโปรแกรมที่คล้ายกัน เครื่องมือจะอ่านข้อความทีละบล็อกและทีละเซลล์ตาราง จะรวมบรรทัดของย่อหน้าเข้าเป็นส่วนเดียวก่อนแปล ดังนั้นประโยคที่แบ่งเป็นสามบรรทัดจะถูกแปลเป็นประโยคเดียวแทนที่จะเป็นสามส่วน จากนั้นจะลบคำต้นฉบับออกจากหน้า ปล่อยให้รูปภาพ ไดอะแกรม และภาพวาดเวกเตอร์ไม่เปลี่ยนแปลง และเขียนคำแปลลงในกล่องเดียวกัน
คำแปลมักจะมีความยาวไม่เท่ากับต้นฉบับ ภาษาเยอรมันและรัสเซียมักจะยาวกว่าภาษาอังกฤษ และภาษาจีนและญี่ปุ่นใช้ตัวอักษรน้อยกว่า เครื่องมือจะปล่อยให้ข้อความพันกันภายในบล็อกเดิม และลดขนาดฟอนต์ก็ต่อเมื่อคำแปลยังคงไม่พอดี เซลล์ตารางจะถูกจัดการทีละรายการ ดังนั้นตัวเลขจะยังคงอยู่ในแถวและคอลัมน์ของตนเอง
B · สแกนและรูปภาพ
ไฟล์สแกนและรูปภาพ
หน้าสแกนคือรูปภาพ ดังนั้นจึงไม่มีข้อความให้แทนที่ เครื่องมือจะเก็บรูปภาพต้นฉบับไว้เป็นพื้นหลังของหน้า จดจำข้อความที่พิมพ์ด้วย OCR จากนั้นจะลบเฉพาะหมึกของตัวอักษรเหล่านั้น โดยเติมแต่ละจุดด้วยสีของกระดาษรอบๆ สิ่งที่ไม่ใช่ข้อความที่กำลังวิ่งจะถูกปล่อยไว้ ตราประทับ, ซีล, ลายเซ็น, รูปภาพ, แผนภูมิ และไดอะแกรมจะยังคงเหมือนเดิมกับที่สแกน ซึ่งเป็นสิ่งที่คุณต้องการบนใบรับรองหรือสัญญาที่ลงนาม
ตารางจะยังคงเส้นตารางเดิมไว้ ระบบจะค้นหาเส้นกรอบของตารางต้นฉบับในรูปภาพ ล้างข้อความภายในแต่ละเซลล์โดยไม่กระทบเส้นขอบ และเขียนคำแปลลงในเซลล์เดียวกัน เส้นที่พิมพ์ในแนวตั้งตามขอบจะถูกเขียนกลับในแนวตั้ง
บางครั้งเส้นไม่สามารถลบออกได้อย่างหมดจด เช่น เมื่อข้อความอยู่บนพื้นหลังที่ซับซ้อน ในกรณีนั้น เครื่องมือจะปล่อยให้การพิมพ์ต้นฉบับยังคงอยู่แทนที่จะทำให้เลอะ และเพิ่มสำเนาข้อความที่มองไม่เห็นเพื่อให้หน้ายังคงสามารถค้นหาได้
C · ไฟล์ที่มีโครงสร้าง
Word, Excel, PowerPoint, EPUB และ HTML
ไฟล์ Office จะเก็บข้อความแยกจากเค้าโครงอยู่แล้ว ดังนั้นเครื่องมือจะแปลจากภายใน จะแทนที่คำในแต่ละย่อหน้า สไลด์ และเซลล์สเปรดชีต และคงตัวหนา ตัวเอียง และการจัดรูปแบบอื่นๆ ไว้กับคำที่เคยเป็นของมัน แม้ว่าคำแปลจะทำให้คำเหล่านั้นมีลำดับที่แตกต่างกัน
หนังสือ EPUB และหน้า HTML จะถูกแปลทีละข้อความ และมาร์กอัปจะยังคงอยู่เหมือนเดิม ดังนั้นบท หัวเรื่อง และลิงก์จะยังคงทำงานในสำเนาที่แปลแล้ว
ENThe report is ready today.
↓
DEDer Bericht ist heute fertig.คำที่เน้นจะย้ายไปท้ายประโยคภาษาเยอรมัน และการจัดรูปแบบจะย้ายตามไปด้วย
คุณภาพ
ตรวจสอบก่อนที่ไฟล์จะกลับมา
การแปลด้วย AI อาจล้มเหลวในลักษณะที่มองข้ามได้ง่ายในการอ่านอย่างรวดเร็ว ดังนั้นเครื่องมือจะตรวจสอบแต่ละส่วนก่อนที่จะยอมรับ:
rejectคำตอบที่ซ้ำกับต้นฉบับแทนที่จะแปลจะถูกปฏิเสธrejectเช่นเดียวกับคำตอบในภาษาที่ไม่ถูกต้อง คำตอบที่วนซ้ำหรือหยุดครึ่งทาง และคำตอบที่มีอักขระแปลกปลอมจากสคริปต์อื่นretryส่วนที่ถูกปฏิเสธจะถูกแปลอีกครั้ง ก่อนอื่นจะแปลพร้อมกับบรรทัดรอบๆ เพื่อบริบท จากนั้นจะแปลแยกต่างหากcompareตัวเลข ที่อยู่เว็บ และที่อยู่อีเมลจะถูกเปรียบเทียบระหว่างต้นฉบับและคำแปล ดังนั้นตัวเลขที่เปลี่ยนแปลงจะถูกตั้งค่าสถานะreuseประโยคที่ปรากฏในหลายหน้าจะถูกแปลเพียงครั้งเดียว ดังนั้นหัวเรื่องหรือคำศัพท์จะอ่านเหมือนกันทุกที่ในเอกสารdiscardหากเอกสารส่วนใหญ่ไม่ได้รับการแปล ระบบจะทิ้งผลลัพธ์นั้นไป แทนที่จะส่งมอบไฟล์ที่แปลไม่สมบูรณ์
สร้างและดำเนินการโดย DocTranslator
โค้ดของเราเอง ตั้งแต่การอ่านหน้าไปจนถึงการสร้างใหม่
ระบบนี้พัฒนาโดยทีม DocTranslator การวิเคราะห์หน้า การจัดการไฟล์สแกนและตาราง การสร้างหน้าใหม่แต่ละหน้า และการตรวจสอบข้างต้น ล้วนเป็นโค้ดของเราเอง เนื่องจากเราเขียนระบบนี้ขึ้นเอง ปัญหา เช่น ตารางที่เลื่อนหรือตัวอักษรที่หายไป สามารถแก้ไขได้ในตัวระบบเอง
คำแปลเป็นภาษาจีน ญี่ปุ่น เกาหลี ฮินดี ไทย และสคริปต์อื่นๆ จะถูกตั้งค่าด้วยฟอนต์ที่มีอักขระเหล่านั้น ดังนั้นคุณจะไม่ได้รับกล่องว่างเปล่าที่ควรจะเป็นตัวอักษร เฉพาะอักขระที่เอกสารใช้งานจริงเท่านั้นที่จะถูกฝัง ซึ่งช่วยลดขนาดไฟล์
คำถามที่พบบ่อยเกี่ยวกับ DocTranslator AI Engine
DocTranslator AI Engine สร้างโดย DocTranslator หรือไม่?
ใช่ค่ะ ระบบของเราพัฒนาขึ้นเองโดยทีม DocTranslator การวิเคราะห์หน้า การจัดการไฟล์สแกน การสร้างโครงสร้างเลย์เอาต์ และการตรวจสอบคุณภาพ ล้วนเป็นโค้ดของเราเอง
มันยังคงตราประทับ, ซีล และลายเซ็นบนเอกสารสแกนไว้หรือไม่?
ใช่ เอ็นจิ้นจะลบเฉพาะหมึกของข้อความที่จดจำได้ ตราประทับ, ซีล, ลายเซ็น, รูปภาพ, แผนภูมิ และไดอะแกรมจะยังคงอยู่เหมือนตอนที่สแกน ดังนั้นใบรับรองจะยังคงแสดงซีล และสัญญาจะแสดงลายเซ็นหลังจากการแปล
เกิดอะไรขึ้นกับตาราง?
ใน PDF ที่มีเลเยอร์ข้อความ แต่ละเซลล์จะถูกแปลแยกกันและเขียนกลับเข้าไปในเซลล์เดิม ในเอกสารสแกน เอ็นจิ้นจะค้นหาเส้นตารางที่พิมพ์ในรูปภาพ ลบข้อความภายในแต่ละเซลล์โดยไม่แตะต้องเส้น และเขียนคำแปลลงในเซลล์ที่มาจาก
ไฟล์ที่แปลจะมีลักษณะเหมือนต้นฉบับทุกประการหรือไม่?
ใกล้เคียง แต่ไม่เสมอไป การแปลมักจะยาวกว่าหรือสั้นกว่าต้นฉบับ ดังนั้นข้อความอาจมีการตัดคำที่แตกต่างกัน หรือตั้งค่าให้เล็กลงเล็กน้อยเพื่อให้พอดีกับกรอบ ในหน้าที่มีข้อมูลหนาแน่น เช่น ตารางที่ถ่ายภาพ ควรดูผลลัพธ์อย่างรวดเร็วก่อนส่งไฟล์ต่อไป
DocTranslator รองรับภาษาอะไรบ้าง
DocTranslator รองรับ 108 ภาษา และคุณสามารถแปลระหว่างสองภาษาใดก็ได้ รายการภาษาทั้งหมด แสดงทุกภาษา
ฉันสามารถใช้บริการนี้สำหรับการยื่นขอวีซ่าหรือเอกสารทางศาลได้หรือไม่
เครื่องมือสร้างคำแปลด้วย AI สำนักงานตรวจคนเข้าเมือง ศาล และมหาวิทยาลัยมักจะขอคำแปลที่ได้รับการรับรอง ซึ่งลงนามโดยนักแปลมืออาชีพที่ยืนยันว่าถูกต้องและสมบูรณ์ สำหรับสิ่งนั้น ใช้บริการ แปลเอกสารรับรอง ของเรา
เครื่องมือที่เกี่ยวข้อง
รูปแบบไฟล์
ประเภทเอกสาร
