AI 기반 · 120개 이상 언어

CSV 번역

제품 카탈로그, 내보내기 및 데이터 세트를 열별로 번역하며, 구분 기호, 따옴표 및 식별자 열은 파서가 예상하는 대로 그대로 유지됩니다.

최대 파일 크기 1 GB 원본 서식 유지
무료 가입

번역할 문서를 업로드하거나 드롭하세요

최대 파일 크기 1 GB

.PDF .DOCX .PPTX .XLSX .TXT .JPG .PNG .IDML .EPUB .HTML
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (암하라어)
العربية (Arabic)
Հայերեն (아르메니아어)
Azərbaycan dili (아제르바이잔어)
Euskara (바스크어)
Беларуская (벨라루스어)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (버마어)
Català (카탈루냐어)
Cebuano (세부아노어)
Chichewa (치체와어)
中文 简体 (중국어 간체)
中文 繁體 (중국어 번체)
Corsu (코르시카어)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (에스페란토)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (프리지아어)
Galego (갈리시아어)
ქართული (조지아어)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (아이티어)
Hausa (하우사어)
ʻŌlelo Hawaiʻi (하와이어)
עברית (Hebrew)
हिंदी (힌디어)
Hmoob (몽어)
Magyar (Hungarian)
Íslenska (아이슬란드어)
Igbo (이그보어)
Bahasa Indonesia (인도네시아어)
Gaeilge (아일랜드어)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (칸나다어)
Қазақ тілі (카자흐어)
ខ្មែរ (크메르어)
Ikinyarwanda (키냐르완다어)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (키르기스어)
ລາວ (라오어)
Latina (라틴어)
Latviešu (라트비아어)
Lietuvių (리투아니아어)
Lëtzebuergesch (룩셈부르크어)
Македонски (마케도니아어)
Malagasy (말라가시어)
Bahasa Melayu (Malay)
മലയാളം (말라얄람어)
Malti (몰타어)
Te Reo Māori (마오리어)
मराठी (Marathi)
Монгол хэл (몽골어)
नेपाली (네팔어)
Norsk (Norwegian)
ଓଡ଼ିଆ (오리야어)
فارسی (Persian)
Polski (Polish)
Português (포르투갈어)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (사모아어)
Gàidhlig (스코틀랜드 게일어)
Српски (Serbian)
Sesotho (세소토어)
Shona (쇼나어)
سنڌي (신디어)
සිංහල (싱할라어)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (소말리어)
Español (Spanish)
Basa Sunda (순다어)
스와힐리어 (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
타지크어 (Tajik)
தமிழ் (Tamil)
타타르어 (Tatar)
తెలుగు (Telugu)
태국어 (Thai)
Türkçe (Turkish)
투르크멘어 (Turkmen)
Українська (Ukrainian)
اردو (Urdu)
위구르어 (Uyghur)
우즈베크어 (Uzbek)
Tiếng Việt (Vietnamese)
웨일스어 (Welsh)
코사어 (Xhosa)
이디시어 (Yiddish)
요루바어 (Yoruba)
줄루어 (Zulu)
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (암하라어)
العربية (Arabic)
Հայերեն (아르메니아어)
Azərbaycan dili (아제르바이잔어)
Euskara (바스크어)
Беларуская (벨라루스어)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (버마어)
Català (카탈루냐어)
Cebuano (세부아노어)
Chichewa (치체와어)
中文 简体 (중국어 간체)
中文 繁體 (중국어 번체)
Corsu (코르시카어)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (에스페란토)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (프리지아어)
Galego (갈리시아어)
ქართული (조지아어)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (아이티어)
Hausa (하우사어)
ʻŌlelo Hawaiʻi (하와이어)
עברית (Hebrew)
हिंदी (힌디어)
Hmoob (몽어)
Magyar (Hungarian)
Íslenska (아이슬란드어)
Igbo (이그보어)
Bahasa Indonesia (인도네시아어)
Gaeilge (아일랜드어)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (칸나다어)
Қазақ тілі (카자흐어)
ខ្មែរ (크메르어)
Ikinyarwanda (키냐르완다어)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (키르기스어)
ລາວ (라오어)
Latina (라틴어)
Latviešu (라트비아어)
Lietuvių (리투아니아어)
Lëtzebuergesch (룩셈부르크어)
Македонски (마케도니아어)
Malagasy (말라가시어)
Bahasa Melayu (Malay)
മലയാളം (말라얄람어)
Malti (몰타어)
Te Reo Māori (마오리어)
मराठी (Marathi)
Монгол хэл (몽골어)
नेपाली (네팔어)
Norsk (Norwegian)
ଓଡ଼ିଆ (오리야어)
فارسی (Persian)
Polski (Polish)
Português (포르투갈어)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (사모아어)
Gàidhlig (스코틀랜드 게일어)
Српски (Serbian)
Sesotho (세소토어)
Shona (쇼나어)
سنڌي (신디어)
සිංහල (싱할라어)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (소말리어)
Español (Spanish)
Basa Sunda (순다어)
스와힐리어 (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
타지크어 (Tajik)
தமிழ் (Tamil)
타타르어 (Tatar)
తెలుగు (Telugu)
태국어 (Thai)
Türkçe (Turkish)
투르크멘어 (Turkmen)
Українська (Ukrainian)
اردو (Urdu)
위구르어 (Uyghur)
우즈베크어 (Uzbek)
Tiếng Việt (Vietnamese)
웨일스어 (Welsh)
코사어 (Xhosa)
이디시어 (Yiddish)
요루바어 (Yoruba)
줄루어 (Zulu)
아랍어 포르투갈어 러시아어 이탈리아어 한국어 네덜란드어 폴란드어 터키어 스웨덴어 영어 스페인어 프랑스어 독일어 중국어 일본어 힌디어 벵골어 베트남어 태국어 그리스어 히브리어 아랍어 포르투갈어 러시아어 이탈리아어 한국어 네덜란드어 폴란드어 터키어 스웨덴어 영어 스페인어 프랑스어 독일어 중국어 일본어 힌디어 벵골어 베트남어 태국어 그리스어 히브리어

구조는 두 개의 문자로 지탱됩니다

쉼표로 구분된 값은 거의 형식이 아닙니다. 널리 따르는 일반적인 방언에 대한 설명이 있지만, 이를 강제하는 권위는 없으므로 실제로 받는 것은 여러 관례 중 하나입니다. 전체 그리드는 두 가지 결정에 달려 있습니다. 레코드의 필드를 구분하는 문자, 그리고 레코드를 끝내는 시퀀스입니다. 둘 중 하나라도 잘못되면 깔끔한 테이블이 하나의 불규칙한 열이 됩니다.

구분 기호가 항상 쉼표는 아닙니다. 소수점을 쉼표로 쓰는 국가의 스프레드시트 소프트웨어는 기본적으로 세미콜론을 사용하므로, 독일 또는 프랑스 기계의 내보내기가 다른 곳에서 깔끔하게 열리지 않는 경우가 많습니다. 탭과 수직 막대는 둘 다 일반적으로 사용되며, 일반적으로 내용에 쉼표가 많기 때문에 선택됩니다.

각 레코드는 헤더와 동일한 수의 필드를 가져야 합니다. 왜냐하면 그 개수가 파서가 어떤 값이 어떤 열에 속하는지 아는 방법이기 때문입니다. 데이터에는 이를 알리는 것이 없습니다. 이것은 유지되거나, 큰 내보내기 중간에서 조용히 유지되지 않게 되는 불변량이며, 그 시점에서 아래의 모든 것이 한 열 왼쪽으로 이동하고 그럴듯하게 보입니다.

번역된 텍스트가 레코드를 깨뜨리는 네 가지 방법

이것들은 스스로 알리지 않는 실패입니다. 내보내기는 여전히 열리고, 행 수는 대략적으로 올바르게 보이며, 데이터 소비 시 나중에 손상이 나타납니다.

  1. 새로운 구분 기호가 값 안에 나타납니다. 쉼표가 없는 영어 제품 설명은 쉼표가 두 개인 프랑스어 설명이 됩니다. 필드가 이전에 따옴표로 묶이지 않았다면, 이제는 묶어야 합니다. 그렇지 않으면 파서는 하나의 값을 세 개로 읽고 그 뒤의 모든 열을 이동시킵니다.
  2. 따옴표가 따옴표로 묶인 값 안에 들어갑니다. 포함된 필드 안에서, 리터럴 큰따옴표는 자신을 이스케이프하기 위해 두 번 작성해야 합니다. 다른 따옴표를 사용하는 언어, 그리고 직선 따옴표를 타이포그래피 따옴표로 변환하는 모든 프로세스는 값 중간에 이스케이프되지 않은 문자를 남겨 필드를 조기에 종료시킬 수 있습니다.
  3. 줄 바꿈이 셀 안으로 들어갑니다. 레코드는 줄 바꿈 문자에서 종료됩니다. 단, 해당 줄 바꿈 문자가 따옴표 안에 있는 경우는 제외합니다. 단락 구분이 생긴 번역된 마케팅 문구는 하나의 레코드를 두 개로 분할하며, 두 번째 부분은 필드 수가 잘못됩니다.
  4. 자리 표시자가 번역됩니다. 소프트웨어를 위해 준비된 문자열에는 종종 치환 토큰, 문자 뒤에 오는 퍼센트 기호, 중괄호 안의 번호가 매겨진 슬롯, 이름이 지정된 변수가 포함됩니다. 이것들은 런타임에 삽입되는 값의 주소이지 단어가 아니며, 하나를 번역하면 해당 값은 절대 나타나지 않습니다.

열의 절반은 언어가 아닙니다

데이터 세트는 사람에게 보여주기 위한 글과 기계가 사용하기 위한 키를 혼합하며, 열 제목 외에는 구별할 것이 거의 없이 나란히 놓여 있습니다. 시작하기 전에 어떤 것이 어떤 것인지 파악하십시오. 왜냐하면 번역된 식별자는 번역되지 않은 설명보다 더 나쁘기 때문입니다.

이것들은 그대로 두십시오

  • 사람에게 표시되는 레이블이 아닌 코드가 사용하는 필드 이름인 헤더 행 자체
  • 재고 코드, 카탈로그 번호, 고유 식별자 및 두 데이터 세트를 조인하는 데 사용되는 모든 키
  • 웹 주소 및 해당 주소의 슬러그 부분, 왜냐하면 이를 변경하면 링크와 순위가 깨지기 때문입니다.
  • 주문 상태 또는 예-아니오 플래그와 같이 고정된 목록과 비교하는 소프트웨어 상태 값
  • 국가, 언어 및 통화 코드 (이미 표준화된 약어)
  • 연-월-일 순서로 작성된 날짜, 숫자 및 읽기보다는 파싱될 모든 것

이것들이 여러분이 찾던 것입니다

  • 제품 제목 및 긴 설명, 일반적으로 단어 수의 대부분을 차지합니다
  • 고객이 보는 카테고리 및 컬렉션 이름
  • 색상, 재료 또는 크기 단어와 같이 의미가 있는 속성 값
  • 로컬라이제이션을 위해 추출된 인터페이스 문자열, 플레이스홀더 제외
  • 행으로 보관된 지원 기사 본문, 미리 정의된 응답 및 이메일 템플릿
  • 프로그램이 아닌 사람이 열도록 의도된 내보내기의 열 머리글

번역이 시작되기도 전에 데이터를 손상시키는 두 가지

스프레드시트에서 열기

내보내기를 두 번 클릭하고 다시 저장하는 것은 카탈로그를 손상시키는 가장 확실한 방법입니다. 스프레드시트 소프트웨어는 자신이 보는 모든 값의 유형을 추측하며, 그 추측은 확신에 차 있지만 틀립니다:

  • 13자리 상품 번호가 과학적 표기법으로 바뀌고 마지막 자릿수가 영구적으로 손실됩니다
  • 0으로 시작하는 우편 번호에서 0이 손실됩니다
  • 날짜와 월처럼 보이는 모든 것이 로컬 형식의 날짜로 다시 작성됩니다
  • 15자리 이상의 긴 식별자가 조용히 반올림됩니다

먼저 데이터를 검사해야 하는 경우, 가져오기 대화 상자를 사용하고 프로그램이 결정하도록 두는 대신 식별자 열을 텍스트로 설정하십시오. 더 나은 방법은 시스템이 생성한 대로 내보내기를 정확하게 업로드하는 것입니다.

바이트 순서 표시기 문제

데이터 내에는 어떤 문자 인코딩을 사용하는지 알려주는 것이 없으므로, 3바이트 표시기가 때때로 하나를 신호하기 위해 맨 앞에 배치됩니다. 이 표시기는 다음에 데이터를 여는 것에 따라 도움이 되기도 하고 방해가 되기도 합니다.

Windows의 스프레드시트 소프트웨어는 유니코드 콘텐츠를 인식하기 위해 이를 사용하며, 이것이 없으면 악센트가 있는 문자 및 비라틴 문자가 기호 문자열로 나옵니다. 반면에 많은 프로그래밍 라이브러리는 이를 제거하지 않으므로 첫 번째 열 머리글에 보이지 않는 세 개의 문자가 앞에 붙어 오고 해당 머리글에 대한 모든 조회가 실패합니다.

대상에 따라 결정하십시오: 결과물을 사람이 스프레드시트에서 열 경우 표시기를 유지하고, 프로그램이 읽을 경우 삭제하십시오. 손상된 악센트 문자 문제에 대한 거의 모든 질문의 답은 이 단락 어딘가에 있습니다.

데이터셋 처리 비용

텍스트 볼륨별 가격 책정, 따라서 값이 짧은 넓은 카탈로그는 긴 설명으로 가득 찬 좁은 카탈로그보다 저렴합니다.

Free

$0

가입 시 카드 불필요

  • 단어당 $0.005 AI 번역
  • 스캔 및 이미지 PDF의 경우 페이지당 $1
  • 120개 이상의 언어
  • 최대 20MB 및 20페이지 파일
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG 및 CSV
  • 24시간 파일 저장만 가능
  • PDF 편집기 및 PDF를 DOCX로 변환하는 도구
  • 언제든지 취소 가능
  • 포함되지 않음: 이메일 지원
  • 포함되지 않음: 팀 액세스
  • 포함되지 않음: 무제한 무료 PDF 미리보기
  • 포함되지 않음: 용어집

Storage

월 $14.99

또는 연간 $149

  • 단어당 $0.005 AI 번역
  • 스캔 및 이미지 PDF의 경우 페이지당 $1
  • 120개 이상의 언어
  • 최대 100MB 및 100페이지 파일
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG 및 CSV
  • 무제한 파일 저장
  • PDF 편집기 및 PDF를 DOCX로 변환하는 도구
  • 이메일 지원
  • 언제든지 취소 가능
  • 포함되지 않음: 팀 액세스
  • 포함되지 않음: 무제한 무료 PDF 미리보기
  • 포함되지 않음: 용어집

Pro

월 $49.99

또는 연간 $499

  • 단어당 $0.004 AI 번역
  • 스캔 및 이미지 PDF의 경우 페이지당 $0.80
  • 120개 이상의 언어
  • 최대 1,000MB 및 5,000페이지 파일
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG 및 CSV
  • 무제한 파일 저장
  • PDF 편집기 및 PDF를 DOCX로 변환하는 도구
  • 이메일 지원
  • 최대 5명 팀 액세스
  • 무제한 무료 PDF 미리보기
  • 용어집
  • 언제든지 취소 가능

엔터프라이즈

월 $149.99, 요청 시. 단어당 $0.003 AI 번역($0.60/페이지), 최대 1,000MB 및 5,000페이지 파일, 무제한 파일 저장 및 최대 15명 팀 액세스.

영업팀에 문의

행 입력, 행 출력

썸네일을 확대하여 원본 페이지와 결과 페이지를 비교하십시오. 쌍이 보여주는 것:

  • 레코드당 열 수는 위에서 아래까지 변경되지 않습니다.
  • 따옴표로 묶인 값은 여전히 따옴표로 묶여 있습니다.
  • 코드, 키 및 숫자 값은 변경되지 않고 통과됩니다.
  • 사람이 읽을 수 있는 열만 새 언어로 돌아옵니다.
영어의 표 형식 데이터, 원본스페인어로 렌더링된 동일한 표 형식 데이터영어의 두 번째 표 형식 데이터 세트, 원본독일어로 렌더링된 동일한 두 번째 표 형식 데이터

두 상태 사이에 스프레드시트에서 열린 것은 없습니다.

모든 번역 예시 보기 →

재작업을 피하는 작업 순서

카탈로그 로컬라이제이션은 파이프라인이며, 비싼 실수는 중간이 아닌 끝에서 발생합니다.

  1. 1

    깨끗하게 내보내고 방언을 기록하십시오

    데이터를 소유한 시스템에서 직접 내보내기를 가져오십시오. 스프레드시트가 아닌 일반 텍스트 편집기에서 한 번 열고, 필드를 구분하는 문자와 값이 따옴표로 묶여 있는지 기록하십시오.

  2. 2

    건드리지 않을 열 표시

    식별자, 키, 링크, 상태 값 및 코드. 내보내기가 매우 넓은 경우, 산문을 포함하는 열로 잘라내고 나중에 키로 다시 결합하는 것이 더 빠릅니다.

  3. 3

    언어 업로드 및 선택

    이메일 주소로 계정을 만들고, 데이터를 드롭하고, 원본 및 대상 언어를 설정하세요. 업로드는 최대 1GB까지 가능하므로 전체 카탈로그를 여러 배치로 분할하는 대신 하나의 작업으로 처리할 수 있습니다.

  4. 4

    먼저 스테이징 복사본으로 다시 가져오기

    프로덕션에 적용하기 전에 테스트 환경으로 결과를 로드하세요. 원본과 레코드 수를 비교하고, 가장 긴 번역된 값을 확인하여 레이아웃 문제를 살펴보고, 악센트 문자가 제대로 전달되었는지 확인하세요.

CSV 번역 FAQ

데이터 세트가 있는 사람들의 질문

소수점 기호를 사용하는 언어로 번역할 경우 구분 기호가 변경되나요?

업로드 시 사용한 구분 기호가 그대로 반환됩니다. 이를 변경하면 콘텐츠가 아닌 구조를 다시 작성하는 것이므로, 다른 쪽에서 데이터를 처리하는 데 문제가 발생합니다. 결과가 해당 방식으로 구성된 스프레드시트에서 열릴 것이므로 세미콜론으로 구분된 버전이 특별히 필요한 경우, 두 방언을 모두 이해하는 도구로 번역 후 변환하세요.

제품 코드 및 식별자가 번역되지 않도록 하려면 어떻게 해야 하나요?

명확하게 식별된 열에 유지하고, 가능한 경우 처리할 텍스트 열만 보내고 나중에 키에서 다시 결합하세요. 명백히 단어가 아닌 코드 값은 그대로 두지만, 모호함이 발생하지 않는 것이 가장 안전한 방법입니다. 스프레드시트는 해당 열을 재서식 지정하므로 그동안 해당 열을 절대 건드리지 마세요.

악센트 문자가 기호 문자열로 돌아왔습니다. 무슨 일인가요?

이는 인코딩 불일치이며 번역 문제는 아닙니다. 결과는 거의 확실하게 올바른 유니코드이지만, 레거시 단일 바이트 인코딩을 예상하는 프로그램에서 읽거나 그 반대일 수 있습니다. 명시적으로 인코딩을 선택할 수 있는 텍스트 편집기에서 열고 손실된 것이 있다고 가정하기 전에 실제로 가지고 있는 것을 확인하세요. 대상이 스프레드시트인 경우, 시작 부분의 바이트 순서 표시기가 일반적으로 이를 결정합니다.

쉼표나 줄 바꿈이 포함된 값은 어떻게 되나요?

그대로 포함됩니다. 구분 기호, 따옴표 또는 줄 바꿈을 포함하는 모든 값은 따옴표로 묶어야 하며, 해당 값 안의 리터럴 따옴표는 두 번 사용해야 합니다. 번역된 텍스트는 원본에 없던 구두점을 포함할 수 있으므로, 원본에서 복사하는 대신 결과에 해당 처리를 적용해야 합니다.

자리 표시자 및 변수 토큰이 유지되나요?

유지되어야 하며, 샘플을 확인해 볼 가치가 있습니다. 퍼센트 기호 뒤에 문자가 오는 토큰, 중괄호 안의 번호가 매겨진 슬롯 또는 이름이 지정된 변수는 런타임에 삽입되는 값의 주소입니다. 이를 번역하면 값이 화면에 도달하지 않으므로, 배포 전에 출력에서 가장 긴 인터페이스 문자열 몇 개를 확인하세요.

독일어로 번역하면 제 문자열이 훨씬 길어집니다. 여기서는 문제가 되나요?

데이터 자체에는 문제가 되지 않습니다. 데이터에는 너비가 없기 때문입니다. 표시하는 요소에 문제가 됩니다. 독일어와 러시아어의 경우 영어보다 5분의 1에서 3분의 1까지 확장되는 것이 일반적이며, 중국어와 일본어는 일반적으로 축소됩니다. 번역된 열을 길이별로 정렬하고 자신의 레이아웃과 비교하여 극단값을 확인하고, 고정된 문자 제한이 있는 모든 데이터베이스 열을 확인하세요.

한 번에 얼마나 많은 데이터셋을 보낼 수 있나요?

Pro 및 Enterprise 플랜에서는 최대 1GB 또는 5,000페이지에 달하는 콘텐츠를 처리할 수 있으며, 이는 수십만 행의 카탈로그를 처리할 수 있습니다. 전체를 한 번에 작업으로 보내는 것이 일관성 측면에서도 더 좋습니다. 왜냐하면 12행과 90,000행에 나타나는 용어는 동일하게 처리되기 때문입니다.

대규모 내보내기 시 무엇에 대해 요금이 청구되나요?

그리드가 아닌 텍스트입니다. 빈 셀, 숫자 열, 식별자 열은 산문이 아닙니다. 어떤 플랜도 단어를 번들로 제공하지 않으므로 각 파일은 별도로 청구됩니다. Free 및 Storage에서는 단어당 반 센트, Pro에서는 $0.004, Enterprise에서는 $0.003이며, 최소 $0.99가 적용됩니다. 이를 통해 단어 수를 기준으로 대형 카탈로그의 견적을 쉽게 산출할 수 있습니다.

내보내기 보내기, 구조 유지

시스템에서 생성된 그대로 데이터를 업로드하고, 대상 언어를 선택하면 각 레코드에 동일한 수의 열이 있고 키가 여전히 조인 가능한 그리드를 받게 됩니다.

파트너사

Accenture
Bloomberg
Citrix
P&G
SAP