ວິທີດຶງຂໍ້ຄວາມພາສາລາວຈາກ PDF ທີ່ສະແກນ (OCR)
ອ່ານຂໍ້ຄວາມຈາກເອກະສານສະແກນ ເປັນພາສາລາວ, ໄທ, ອັງກິດ ແລະ ພາສາອື່ນອີກຫຼາຍກວ່າ 20 ພາສາ — ເຮັດໃນເຄື່ອງຂອງທ່ານ.
ເອກະສານສະແກນ ແມ່ນຮູບຂອງໜ້າເຈ້ຍ, ສະນັ້ນຈຶ່ງສຳເນົາຕົວໜັງສືບໍ່ໄດ້. OCR ຈະອ່ານຮູບນັ້ນ ແລ້ວປ່ຽນເປັນຕົວໜັງສືທີ່ສຳເນົາໄດ້. ທຸກຢ່າງເຮັດໃນໂປຣແກຣມທ່ອງເວັບຂອງທ່ານ — ໜ້າເອກະສານບໍ່ຖືກອັບໂຫຼດ.
ຂັ້ນຕອນ
- ເປີດ PDF ໃນ ໂປຣແກຣມແກ້ໄຂ.
- ກົດ ດຶງຂໍ້ຄວາມອອກ.
- ໜ້າທີ່ເປັນຮູບສະແກນ ຈະຖືກກວດພົບເອງ. ເລືອກພາສາຂອງເອກະສານ (ເຊັ່ນ ລາວ) ແລ້ວກົດ ອ່ານດ້ວຍ OCR.
- ຖ້າເລືອກສຳເນົາຕົວໜັງສືໄດ້ ແຕ່ອອກມາເປັນຕົວອັກສອນແປກໆ, ໃຫ້ກົດ ບັງຄັບໃຊ້ OCR. ອັນນີ້ມັກເກີດກັບເອກະສານທີ່ພິມດ້ວຍຟອນລາວເກົ່າທີ່ບໍ່ແມ່ນ Unicode.
- ກົດ ສຳເນົາຂໍ້ຄວາມ, ຫຼື ດາວໂຫຼດເປັນໄຟລ໌ .TXT ຫຼື Markdown.
ເພື່ອໃຫ້ໄດ້ຜົນດີ
- ເລືອກພາສາໃຫ້ຖືກກ່ອນເລີ່ມ — ສຳຄັນທີ່ສຸດ.
- ເອກະສານທີ່ສະແກນຊື່ ແລະ ຊັດເຈນ ຈະອ່ານໄດ້ດີກວ່າຮູບຖ່າຍທີ່ອຽງ.
- OCR ໃຊ້ເວລາ. ເອກະສານຍາວຈະຊ້າ, ແລະ ຄັ້ງທຳອິດຕ້ອງດາວໂຫຼດຂໍ້ມູນຂອງພາສານັ້ນ.
- ຄວນກວດຄືນສະເໝີ. OCR ດີຫຼາຍ ແຕ່ບໍ່ສົມບູນແບບ — ໂດຍສະເພາະຕາຕະລາງ, ລາຍມື ແລະ ຮູບທີ່ບໍ່ຊັດ.