ტექსტის ამოცნობა
ამოიღე ტექსტი ფოტოდან ან სკანირებული სურათიდან
ამოიღებს ტექსტს ფოტოდან ან სკანირებული სურათიდან — გამოსადეგია ეკრანის ანაბეჭდებიდან, სკანირებული დოკუმენტებიდან, ქვითრებიდან თუ აბრებიდან ტექსტის ამოსაღებად — ტექსტის ამოცნობა ხდება პირდაპირ მოწყობილობაზე, ინგლისურისა და ქართულის (ბეტა) მხარდაჭერით.
როგორ მუშაობს
ხელსაწყო უშვებს Tesseract.js-ს — ღია კოდის OCR ძრავას, კომპილირებულს WebAssembly-ში — მთლიანად თქვენს ბრაუზერის ჩანართში. ის ჩამოტვირთავს არჩეული ენის სავარჯიშო მონაცემებს, სურათს ლოკალურად აანალიზებს და ამოცნობილ ტექსტს აბრუნებს პროცესის ცოცხალი ინდიკატორით — არც სურათი და არც ტექსტი არსად იგზავნება.
ხშირად დასმული კითხვები
რამდენად ზუსტია?
დიდწილად სურათის ხარისხზეა დამოკიდებული — სუფთა, მაღალკონტრასტული, კარგად განათებული ტექსტი ჩვეულებრივი შრიფტით ძალიან კარგად ამოიცნობა, მაშინ როცა ბუნდოვანი ფოტოები, ხელნაწერი ტექსტი ან უჩვეულო შრიფტები მეტ შეცდომას იძლევა. ამოღებული ტექსტი ყოველთვის გადაამოწმეთ, სანამ დაეყრდნობით.
ქართული ამოცნობა ინგლისურის იგივე სიზუსტისაა?
ქართული ამოცნობა ამჟამად ბეტა რეჟიმშია და შესამჩნევად ინგლისურზე ნაკლებ ზუსტი შეიძლება იყოს, განსაკუთრებით გარკვეული ასოებისთვის — შედეგი ყურადღებით შეამოწმეთ, ვიდრე ავტომატურად სწორად ჩათვალოთ.
რა არის ზომის ლიმიტი?
100 მბ ერთ სურათზე — ეს ფარავს დიდი სკანირებული გვერდებსაც და მაღალი გარჩევადობის ფოტოებსაც.
იტვირთება თუ არა ჩემი სურათი სადმე?
არა — OCR ძრავა ლოკალურად, თქვენს ბრაუზერში მუშაობს WebAssembly-ის საშუალებით. სურათი და მიღებული ტექსტი თქვენს მოწყობილობას არასდროს ტოვებს.
რატომ მუშაობს ნელა პირველად?
კონკრეტული ენისთვის პირველი გაშვება მოითხოვს ამ ენის სავარჯიშო მონაცემების ჩამოტვირთვას თქვენს ბრაუზერში. შემდეგ ბრაუზერი მას ინახავს, ამიტომ შემდგომი გამოყენება უფრო სწრაფია.