Tłumacz CSV
Katalogi produktów, eksporty i zbiory danych tłumaczone kolumna po kolumnie, z zachowaniem separatorów, cudzysłowów i kolumn identyfikatorów dokładnie tak, jak oczekuje tego Twój parser.
Prześlij lub upuść dokument do tłumaczenia
Maks. rozmiar pliku 1 GB
Struktura jest podtrzymywana przez dwa znaki
Wartości rozdzielane przecinkami to ledwo format. Istnieje powszechnie przestrzegany opis wspólnego dialektu, ale żaden autorytet go nie egzekwuje, więc to, co faktycznie otrzymujesz, jest jedną z kilku konwencji. Cała siatka opiera się na dwóch decyzjach: który znak rozdziela pola w rekordzie, a która sekwencja kończy rekord. Pomyl się w jednym z nich, a schludna tabela stanie się pojedynczą, poszarpaną kolumną.
Separator nie zawsze jest przecinkiem. Oprogramowanie arkusza kalkulacyjnego w krajach, które zapisują dziesiętne liczby z przecinkiem, domyślnie używa średnika, dlatego eksport z niemieckiej lub francuskiej maszyny często nie otwiera się poprawnie w innych miejscach. Tabulatory i pionowe kreski są również powszechnie używane, zazwyczaj wybierane właśnie dlatego, że zawartość jest pełna przecinków.
Każdy rekord musi zawierać taką samą liczbę pól jak nagłówek, ponieważ ta liczba informuje parser, która wartość należy do której kolumny. Nic w danych tego nie sygnalizuje. Jest to niezmiennik, który albo się utrzymuje, albo po cichu przestaje się utrzymywać w połowie dużego eksportu, po czym wszystko poniżej przesuwa się o jedną kolumnę w lewo i wygląda wiarygodnie.
Cztery sposoby, w jakie przetłumaczony tekst psuje rekord
Są to błędy, które nie dają o sobie znać. Eksport nadal się otwiera, liczba wierszy nadal wygląda mniej więcej poprawnie, a szkoda ujawnia się później w czymkolwiek, co przetwarza dane.
- Nowy separator pojawia się wewnątrz wartości. Angielski opis produktu bez przecinków staje się francuskim z dwoma. Jeśli pole nie było wcześniej ujęte w cudzysłów, teraz musi być, w przeciwnym razie parser odczyta jedną wartość jako trzy i przesunie wszystkie kolejne kolumny.
- Znak cudzysłowu ląduje wewnątrz wartości w cudzysłowie. Wewnątrz zamkniętego pola, dosłowny cudzysłów musi być napisany dwukrotnie, aby się uciec. Języki, które używają innych znaków cudzysłowu, i każdy proces, który konwertuje proste znaki na typograficzne, mogą pozostawić nieuciekający znak pośrodku wartości, gdzie wcześniej kończy pole.
- Nowa linia pojawia się w komórce. Rekord kończy się znakiem nowej linii, chyba że ta nowa linia znajduje się w cudzysłowie. Przetłumaczona treść marketingowa, która zyskuje podział na akapity, podzieli jeden rekord na dwa, a druga połowa będzie miała niewłaściwą liczbę pól.
- Tłumaczone jest zastępcze pole. Ciągi znaków przeznaczone dla oprogramowania często zawierają tokeny zastępcze, znak procentu poprzedzający literę, ponumerowane miejsce w nawiasach, nazwaną zmienną. Są to adresy dla wartości wstawianych w czasie wykonywania, a nie słowa, a przetłumaczenie jednego oznacza, że wartość nigdy się nie pojawi.
Połowa Twoich kolumn to nie język
Zbiór danych miesza prozę przeznaczoną dla ludzi z kluczami przeznaczonymi dla maszyn, i siedzą one obok siebie, a nic ich nie odróżnia oprócz nagłówka kolumny. Zorientuj się, co jest czym, zanim zaczniesz, ponieważ przetłumaczony identyfikator jest gorszy niż nieprzetłumaczony opis.
Zostaw te rzeczy w spokoju
- Sam wiersz nagłówka, gdzie nagłówki są nazwami pól używanymi przez kod, a nie etykietami wyświetlanymi osobie
- Kody magazynowe, numery katalogowe, unikalne identyfikatory i wszystko, co jest używane jako klucz do połączenia dwóch zbiorów danych
- Adresy internetowe i część adresu URL (slug), ponieważ zmiana tego ostatniego psuje link i jego ranking
- Wartości statusu, które oprogramowanie porównuje z ustaloną listą, takie jak stan zamówienia lub flaga tak/nie
- Kody krajów, języków i walut, które są już znormalizowanymi skrótami
- Daty zapisane w kolejności rok-miesiąc-dzień, liczby i wszystko, co zostanie przetworzone, a nie przeczytane
To są te, po które przyszliście
- Tytuły produktów i długie opisy, które zazwyczaj stanowią większość liczby słów
- Nazwy kategorii i kolekcji, tak jak widzą je klienci
- Wartości atrybutów mające znaczenie, takie jak kolor, materiał lub słowo określające rozmiar
- Ciągi interfejsu wyodrębnione do lokalizacji, bez ich symboli zastępczych
- Treści artykułów pomocy, gotowe odpowiedzi i szablony e-maili przechowywane jako wiersze
- Nagłówki kolumn, gdzie eksport ma być otwarty przez osobę, a nie program
Dwie rzeczy, które niszczą dane, zanim jeszcze rozpocznie się tłumaczenie
Otwieranie w arkuszu kalkulacyjnym
Dwukrotne kliknięcie eksportu i ponowne jego zapisanie to najpewniejszy sposób na uszkodzenie katalogu. Oprogramowanie arkuszy kalkulacyjnych zgaduje typ każdej widzianej wartości, a jego zgadywanie jest pewne i błędne:
- Numer artykułu składający się z trzynastu cyfr zamienia się w notację naukową i na zawsze traci ostatnie cyfry
- Kod pocztowy zaczynający się od zera traci zero
- Wszystko, co przypomina dzień i miesiąc, jest przepisywane jako data w lokalnym formacie
- Długie identyfikatory przekraczające piętnaście cyfr są zaokrąglane, cicho
Jeśli musisz najpierw sprawdzić dane, użyj okna dialogowego importu i ustaw kolumny identyfikatorów na tekst, zamiast pozwalać programowi decydować. Jeszcze lepiej, prześlij eksport dokładnie tak, jak wygenerował go Twój system.
Kwestia znacznika kolejności bajtów
Nic w danych nie mówi, jakiego kodowania znaków używają, więc znacznik trzech bajtów jest czasami umieszczany na samym początku, aby go zasygnalizować. Ten znacznik pomaga i szkodzi w zależności od tego, co otworzy dane później.
Oprogramowanie arkuszy kalkulacyjnych w systemie Windows używa go do rozpoznawania zawartości Unicode, a bez niego znaki akcentowane i niełacińskie pojawiają się jako ciągi symboli. Wiele bibliotek programistycznych, wręcz przeciwnie, nie usuwa go, więc pierwszy nagłówek kolumny pojawia się z trzema niewidocznymi znakami przyklejonymi z przodu, a każde wyszukiwanie tego nagłówka kończy się niepowodzeniem.
Zdecyduj według przeznaczenia: zachowaj znacznik, jeśli osoba otworzy wynik w arkuszu kalkulacyjnym, usuń go, jeśli program go odczyta. Odpowiedź na prawie każde pytanie dotyczące uszkodzonych znaków akcentowanych znajduje się w tym akapicie.
Ile kosztuje przetworzenie zbioru danych
Cena według objętości tekstu, więc szeroki katalog z krótkimi wartościami jest tańszy niż wąski z długimi opisami.
Free
Nie jest wymagana karta do rejestracji
- Tłumaczenie AI za 0,005 $/słowo
- 1 USD za stronę dla skanów i plików PDF w formacie obrazu
- 120+ języków
- Pliki do 20 MB i 20 stron
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG i CSV
- Tylko 24-godzinne przechowywanie plików
- Edytor PDF i konwerter PDF do DOCX
- Anuluj w dowolnym momencie
- Nie wliczone: Wsparcie e-mail
- Nie wliczone: Dostęp zespołowy
- Nie wliczone: Nieograniczone bezpłatne podglądy PDF
- Nie wliczone: Glosariusz
Storage
lub 149 USD rocznie
- Tłumaczenie AI za 0,005 $/słowo
- 1 USD za stronę dla skanów i plików PDF w formacie obrazu
- 120+ języków
- Pliki do 100 MB i 100 stron
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG i CSV
- Nieograniczone przechowywanie plików
- Edytor PDF i konwerter PDF do DOCX
- Wsparcie e-mail
- Anuluj w dowolnym momencie
- Nie wliczone: Dostęp zespołowy
- Nie wliczone: Nieograniczone bezpłatne podglądy PDF
- Nie wliczone: Glosariusz
Pro
lub 499 USD rocznie
- Tłumaczenie AI za 0,004 USD za słowo
- 0,80 USD za stronę dla skanów i plików PDF w formacie obrazu
- 120+ języków
- Pliki do 1000 MB i 5000 stron
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG i CSV
- Nieograniczone przechowywanie plików
- Edytor PDF i konwerter PDF do DOCX
- Wsparcie e-mail
- Dostęp zespołowy dla maksymalnie 5 członków
- Nieograniczone bezpłatne podglądy PDF
- Glosariusz
- Anuluj w dowolnym momencie
Enterprise
149,99 USD miesięcznie, na żądanie. Tłumaczenie AI za 0,003 USD za słowo (0,60 USD za stronę), pliki do 1000 MB i 5000 stron, nieograniczone przechowywanie plików i dostęp zespołowy dla maksymalnie 15 członków.
Wiersze wchodzą, wiersze wychodzą
Powiększ miniaturę, aby porównać stronę źródłową z jej wynikiem. Co pokazują pary:
- Liczba kolumn na rekord pozostaje niezmieniona od góry do dołu.
- Wartości, które były ujęte w cudzysłowy, nadal są ujęte.
- Kody, klucze i wartości numeryczne przechodzą bez zmian.
- Tylko kolumny czytelne dla człowieka wracają w nowym języku.




Nic tutaj nie zostało otwarte w arkuszu kalkulacyjnym między tymi dwoma stanami.
Zobacz wszystkie przykłady tłumaczeń →Pracujący porządek, który pozwala uniknąć przeróbek
Lokalizacja katalogu to potok, a kosztowne błędy zdarzają się na jego końcach, a nie w środku.
- 1
Eksportuj czysto i zanotuj dialekt
Pobierz eksport bezpośrednio z systemu, który jest właścicielem danych. Otwórz go raz w zwykłym edytorze tekstu, nie w arkuszu kalkulacyjnym, i zanotuj, jaki znak rozdziela pola i czy wartości są ujęte w cudzysłowy.
- 2
Oznacz kolumny, których nie chcesz ruszać
Identyfikatory, klucze, linki, wartości statusu i kody. Jeśli eksport jest bardzo szeroki, często szybciej jest go ograniczyć do kolumn zawierających prozę i połączyć kluczem później.
- 3
Prześlij i wybierz języki
Załóż konto, podając adres e-mail, prześlij dane i ustaw język źródłowy i docelowy. Przesyłane pliki mogą mieć rozmiar do 1 GB, więc cały katalog jest przetwarzany jako jedno zadanie, a nie dzielony na partie.
- 4
Zaimportuj najpierw do kopii testowej
Załaduj wynik do środowiska testowego przed produkcyjnym. Sprawdź liczbę rekordów w porównaniu z oryginałem, przyjrzyj się najdłuższym przetłumaczonym wartościom pod kątem problemów z układem i potwierdź, że znaki diakrytyczne przetrwały podróż.
Pytania od osób posiadających zbiory danych
Czy separator zmienia się, jeśli tłumaczę na język używający przecinków dziesiętnych?
Separator, z którym przesłałeś plik, jest separatorem, który otrzymasz z powrotem. Zmiana go oznaczałaby przepisanie struktury, a nie treści, i zepsułaby wszystko, co przetwarza dane po drugiej stronie. Jeśli potrzebujesz wersji rozdzielanej średnikiem, ponieważ wynik zostanie otwarty w arkuszu kalkulacyjnym na komputerze skonfigurowanym w ten sposób, przekonwertuj go po tłumaczeniu za pomocą narzędzia rozumiejącego oba dialekty.
Jak zapobiec tłumaczeniu kodów produktów i identyfikatorów?
Trzymaj je w wyraźnie zidentyfikowanych kolumnach i, jeśli to możliwe, przesyłaj do przetworzenia tylko kolumny tekstowe, a następnie połącz je ponownie na podstawie klucza. Wartości, które są oczywiście kodami, a nie słowami, pozostają bez zmian, ale najbezpieczniejszym rozwiązaniem jest takie, w którym nie powstaje niejednoznaczność. Nigdy nie pozwól, aby arkusz kalkulacyjny dotykał tych kolumn w międzyczasie, ponieważ przeformatuje je niezależnie od tłumaczenia.
Moje znaki diakrytyczne wróciły jako ciągi symboli. Co się stało?
To problem z kodowaniem, a nie z tłumaczeniem. Wynik to prawie na pewno poprawny Unicode odczytywany przez coś, co oczekuje starszego kodowania jednobajtowego, lub odwrotnie. Otwórz go w edytorze tekstu, który pozwala na jawne wybranie kodowania i potwierdź, co faktycznie masz, zanim założysz, że coś zostało utracone. Jeśli docelowym formatem jest arkusz kalkulacyjny, znacznik kolejności bajtów na początku zazwyczaj decyduje o tym.
Co się dzieje z wartościami zawierającymi przecinki lub znaki nowej linii?
Pozostają w cudzysłowach. Każda wartość zawierająca separator, cudzysłów lub znak nowej linii musi być ujęta w cudzysłów, a dosłowny cudzysłów w takiej wartości musi być podwojony. Ponieważ przetłumaczony tekst może zawierać znaki interpunkcyjne, których nie było w oryginale, to ujęcie musi być zastosowane do wyniku, a nie skopiowane ze źródła.
Czy symbole zastępcze i tokeny zmiennych przetrwają?
Powinny i warto sprawdzić próbkę. Tokeny, takie jak znak procentu z literą, numerowane pola w nawiasach klamrowych lub nazwane zmienne, to adresy dla wartości wstawianych w czasie rzeczywistym. Przetłumaczenie jednego z nich oznacza, że wartość nigdy nie dotrze do ekranu, więc przed wysłaniem sprawdź kilka najdłuższych ciągów interfejsu w wynikach.
Moje ciągi znaków stają się znacznie dłuższe w języku niemieckim. Czy to ma tutaj znaczenie?
Nie dla samych danych, które nie mają szerokości. Ma znaczenie dla tego, co je wyświetla. Rozszerzenie o jedną piątą do jednej trzeciej w porównaniu do angielskiego jest normalne dla niemieckiego i rosyjskiego, podczas gdy chiński i japoński zazwyczaj się kurczą. Posortuj przetłumaczoną kolumnę według długości i porównaj skrajne wartości z własnym układem, a także sprawdź każdą kolumnę bazy danych z ograniczoną liczbą znaków.
Jak duży zbiór danych mogę wysłać za jednym razem?
Do 1 GB lub pięciu tysięcy stron treści o równoważnej objętości na planach Pro i Enterprise. Obejmuje to katalogi liczące setki tysięcy wierszy. Wysyłanie całości jako jedno zadanie jest również lepsze dla spójności, ponieważ termin pojawiający się w wierszu 12 i wierszu 90 000 jest traktowany tak samo.
Za co jestem obciążany przy szerokim eksporcie?
Tekst, a nie siatka. Puste komórki, kolumny numeryczne i kolumny identyfikatorów nie są prozą. Każdy plik jest fakturowany osobno, ponieważ żaden plan nie zawiera słów w pakiecie: pół centa za słowo na planach Free i Storage, 0,004 USD na Pro i 0,003 USD na Enterprise, z minimum 0,99 USD. To sprawia, że duży katalog jest łatwy do oszacowania na podstawie liczby słów.
Wyślij eksport, zachowaj strukturę
Prześlij dane dokładnie tak, jak wygenerował je Twój system, wybierz język docelowy i otrzymaj z powrotem siatkę z taką samą liczbą kolumn w każdym rekordzie i kluczami, które nadal można połączyć.
Nasi partnerzy
Powiązane usługi tłumaczeniowe
Formaty plików
Narzędzia PDF
