Аудармашыға арналған PDF
Аудармашының PDF-пен жұмысы бір сұраққа тіреледі: файлда мәтін бар ма. Редактордан шығарылған құжат мәтін қабатын жол ауысуларымен бірге толық береді. Скан ештеңе бермейді — онда беттердің суреті бар, ешбір шығару оның ішінен әріп таппайды. Осы екі шектің арасында үшінші жағдай жатыр: мәтін бар, бірақ қазақ әріптері базалық әріп пен бөлек белгіден құралған да, іздеу оларды таппайды.
Сандар туралы қысқаша
- Жол ауысулары
- сөздер арасындағы қашықтықтан емес, жол соңы белгісінен алынады
- Қалыпқа келтіру
- бөлшектелген қазақ әріптері біртұтас таңбаға жиналады, лигатуралар ажыратылады
- Скан
- мәтін қабаты жоқ, шығару бос файл береді
- Өңделетін құжатқа түрлендіру
- серверлік амал, файлға 25 МБ дейін
- Тану тілдері
- орыс, қазақ, ағылшын
Түпнұсқаның үш күйі
- Мәтіндік PDF: қабат бар, шығару мазмұнды жол ауысуларымен береді — жол соңы қашықтықпен болжанбай, оқу қозғалтқышы беретін белгіден алынады.
- Скан: мәтін қабаты мүлде жоқ. Шығару бос файл береді, бұл құралдың ақауы емес, мазмұнның дәл сипаттамасы.
- Аралас құжат: беттердің бір бөлігі терілген, бір бөлігі сканмен жапсырылған. Әрқайсысын тексеру керек, себебі мұндай файлды бірінші бетінен ажырата алмайсыз.
- Формасы бар құжат: өріс мәндері беттен бөлек өмір сүреді және бекітілгенге дейін шығарылған мәтінге түспеуі мүмкін.
Қазақ әріптері және олар неге көрінбей қалады
Бір қазақ әрпі екі түрлі жазылады: біртұтас таңба ретінде және базалық әріп пен диакритикалық белгінің тіркесімі ретінде. Көзге бірдей, ал іздеу үшін бұл екі бөлек жол — іздеу жолағына сөзді терсеңіз, оны басқаша құралған мәтіннен таппайсыз. Көптеген PDF генераторы дәл бөлшектелген түрін береді.
Сондықтан шығарылған мәтін бірыңғай қалыпты түрге келтіріледі: бөлшектелген тіркесімдер біртұтас таңбаға жиналады, ал жабысқан латын лигатуралары әріптерге қайта ажыратылады. Содан кейін іздеу де, аударма жадындағы алмастыру да болжамды жұмыс істейді, ал глоссарий айқын сәйкестіктерден жаңылмайды.
Word қашан керек, мәтін қашан жеткілікті
- Тек мағына керек болса — мәтін қабатын алыңыз: ол браузерде шығарылады және мазмұнды безендірусіз береді.
- Аударма сол беттеуге түсуі керек болса — өңделетін құжатқа түрлендіріп, сонда түзетіңіз, ал PDF-ке дайын аударманы қайтарыңыз.
- Екі бағанды беттеуді бірінші кезекте тексеріңіз: кез келген шығаруда араласқан жолдардың басты көзі — бағандар.
- Қос тілді құжатты тілдер бойынша алдын ала бөліңіз, әйтпесе екі тілдің абзацтары кезектесіп, аударма жадын шатастырады.
- Сканды тануға жіберіңіз: біздегі тану тілдері — орыс, қазақ және ағылшын.
Жиі қойылатын сұрақтар
Шығарылған мәтінде жолдар неге араласып кетті?
Бет екі бағанмен беттелген болуы ықтимал. Файлдағы жолдардың реті генератор жазған күйінде тұрады және сіз бетті көзбен оқитын ретпен сәйкес келуге міндетті емес.
Қазақ сөзі бетте тұр, бірақ іздеу таппайды. Себебі не?
Әріп база мен бөлек диакритикалық белгі ретінде жазылған, ал сіз біртұтас таңбаны іздеп отырсыз. Көзге бірдей, бірақ бұл әртүрлі тізбектер, ортақ түрге келтірмей сәйкестік болмайды.
Аудармаға не таңдау керек: мәтін бе, өңделетін құжат па?
Мәтін жылдамырақ әрі мазмұны бойынша дәлірек, түрлендіру құрылым мен безендіруді сақтайды. Аударма сол беттеуге қайтатын болса, екінші жол кесте мен тақырыпты көшіруге кететін уақытты үнемдейді.
Нотариат куәландырған сканды қалай аударуға болады?
Алдымен тану арқылы мәтін қабатын алып, содан кейін кәдімгі құжат сияқты жұмыс істеу керек. Мұнда тікелей шығару болмайды: сканда бірде-бір әріп жоқ, тек беттің суреті бар.