PDF ішіндегі кестені қалай тану керек
Ұяшықтардың мазмұны кәдімгі мәтін болып танылады, ал кестенің құрылымы жоғалады. Тор сызықтары суреттің бөлігі болып қалады: қозғалтқыш оларды баған шекарасы емес, графика деп көреді, мәтін қабатына олардан ештеңе түспейді. Сіз бет оқылу ретімен келген мәндер ағынын аласыз, одан іздеу жұмыс істейді, бірақ есептеуге келетін тор шықпайды. Бөлек өкініштісі — кестедегі цифр қатесі көзге байқалмайды.
Сандар туралы қысқаша
- Танылады
- ұяшық мәтіні және әр таңбаның координаты
- Жоғалады
- жол, баған, біріктірілген ұяшық, бағандық рет
- Тор сызықтары
- суреттегі графика күйінде қалады, қабатқа түспейді
- Шығу реті
- бет оқылу ретімен ағын, ешқандай белгілеусіз
- Бірінші тексерілетіні
- цифрлар: 0 мен O, 1 мен l, 5 пен S жиі шатасады
Нақты не шығады, не шықпайды
- Шығады: файлдағы барлық ұяшық мәтіні, мән бойынша істейтін іздеу, үзіндіні көшіру мүмкіндігі.
- Шығады: баған тақырыптары кәдімгі абзац сияқты іздеуден табылады.
- Шықпайды: жол мен бағанға бөліну, біріктірілген ұяшықтар, бағандар бойынша жүру реті.
- Шықпайды: сандық типтер мен формулалар — танушы сан емес, таңба қайтарады.
- Шықпайды: сканнан XLSX. Word түрлендіргішіне мәтін қабаты керек, бірақ кесте құрылымын оның да алатын жері жоқ.
Сканерленген кестемен жұмыс тәртібі
- Түпнұсқа ұсақ болса, парақты 300 DPI-мен қайта сканерлеңіз: кестеде қаріп әдетте ұсақ, 150-де цифрлар қосылып кетеді.
- Тақырыптар мен қолтаңбалар жазылған тілдерді таңдап, құжатты таныңыз.
- Мәтінді TXT-ке шығарып, мәндердің қандай ретпен келгенін қараңыз — бұл әрі қарай қалай талдау керегін айтады.
- Сандарды суретпен салыстырыңыз: бірліктер, жетілер мен нөлдерді бірінші кезекте тексеріңіз.
- Кесте есептеуге керек болса, мәндерді қолмен көшіріңіз — сонда әр цифрды өз көзіңізбен көресіз.
Құрылым неге қалпына келмейді
Танушы үшін бет — мәтін аймақтары бар сурет. Ол жолдарды тауып, ретін анықтап, таңбаларды координаттарымен жазады. Екі ұяшық арасындағы сызық ол үшін астын сызудан немесе тақырып айналасындағы жақтаудан ажырамайды: бұл графика, белгілеу емес. Нәтижеде «баған» деген ұғым пайда болмайды, өйткені бастапқы суретте де ол болмаған — ол тек сіздің басыңызда және көзіңізде бар.
Таңбалардың координаттары, әйтсе де, дәл сақталады, теория жүзінде солар бойынша кестені қайта жинауға болады — бұл беттің құрылымын талдайтын мамандандырылған құралдар шешетін бөлек міндет. Біздің тану оны шешпейді және шешкен болып көрінбейді: біз құжатты ізделетін ететін мәтін қабатын береміз және шекара қайда өтетінін тура айтамыз.
Жиі қойылатын сұрақтар
Сканерленген кестеден Excel алуға бола ма?
Бізде — жоқ. Танудан кейін файлда мәтін қабаты пайда болады да, Word түрлендіргіші құжатты бос мәтін тексерісі бойынша қабылдамауын қояды, бірақ ұяшықтарға бөліну ол қабатта жоқ және оны алатын жер де жоқ.
Сандар неге сөзден нашар танылады?
Сөздің контексті бар: көрші әріптер модельге дұрыс нұсқаны меңзейді. Санда контекст жоқ, әр цифр өз бетінше тұр, ал нөлмен шатасқан O әрпі немесе латын l-мен шатасқан бірлік өзін ешнәрсемен әшкерелемейді.
Кестедегі мән бойынша іздеу жұмыс істей ме?
Иә, тану дәл сол үшін жасалады. Ұяшықтағы нөмірді немесе тегін теріңіз — көрсеткіш оны тауып, беттегі керекті орынды бөліп көрсетеді, файлда кесте құрылымы жоқ болса да.
Тор сызықтарының сапасы нәтижеге әсер ете ме?
Әлсіз, өйткені сызықтар мәтін қабатына бәрібір түспейді. Ұяшықтардағы қаріп өлшемі мен баспа контрасты әлдеқайда маңызды: цифрлар бағандар шекарасында емес, дәл соларда жоғалады.