შიგთავსზე გადასვლა
toola.

გზამკვლევი · 2 წთ საკითხავი · განახლდა: 8 ოქტომბერი, 2026

როგორ დავაკოპიროთ ტექსტი დასკანერებული PDF-იდან ან ფოტოდან (ქართული, ინგლისური, რუსული)

PDF-ში ტექსტს ვერ მონიშნავთ, ან მხოლოდ გვერდის ფოტო გაქვთ. ამ ტექსტის დასაკოპირებლად, დასარედაქტირებლად ან მოსაძებნად გჭირდებათ OCR — ტექსტის ოპტიკური ამოცნობა, რომელიც სურათიდან ასოებს კითხულობს. ეს გზამკვლევი გაჩვენებთ, როგორ გაიგოთ, გჭირდებათ თუ არა ის, როგორ მიიღოთ საუკეთესო შედეგი და რა ვუყოთ ძველ ქართულ ფაილებს, რომლებიც უაზრო სიმბოლოებად გამოდის.

ჯერ გაარკვიეთ: სკანია თუ ნამდვილი ტექსტი?

გახსენით PDF ბრაუზერში ან PDF-ის მნახველში და მაუსით სცადეთ წინადადების მონიშვნა.

  • ტექსტის მონიშვნა გამოდის. PDF-ში უკვე ნამდვილი ტექსტია, ამიტომ OCR არ გჭირდებათ. უბრალო ტექსტისთვის გამოიყენეთ PDF ტექსტად, რედაქტირებადი დოკუმენტისთვის კი PDF-დან Word-ში.
  • ვერაფერს ნიშნავთ, ან მთელი გვერდი ერთ ბლოკად ინიშნება. ეს ტექსტის სურათია — სკანი ან ფოტო — და სწორი ხელსაწყო OCR-ია.

ფოტოს ან დასკანერებული PDF-ის წაკითხვა OCR-ით

  1. გახსენით სურათიდან ტექსტი და დაამატეთ ფოტოები, ეკრანის სურათები ან დასკანერებული PDF (ერთდროულად 50 გვერდამდე).
  2. მონიშნეთ ენები, რომლებიც ნამდვილად არის ტექსტში. ქართული და ინგლისური ნაგულისხმევად ჩართულია; რუსულიც ხელმისაწვდომია და შერეული გვერდებიც მუშაობს.
  3. დააჭირეთ ტექსტის ამოღებას. PDF-ის შემთხვევაში თითოეული გვერდი სურათად გადაიქცევა და წაიკითხება, ტექსტი კი გვერდების მიხედვით იქნება დასათაურებული.
  4. დააკოპირეთ შედეგი ან ჩამოტვირთეთ .txt ფაილად.
OCR · აბგ · ABCსურათიდან ტექსტის ამოღება (OCR)ამოიღეთ ტექსტი ფოტოებიდან, სქრინშოტებიდან და დასკანერებული PDF-ებიდან OCR-ით, ბრაუზერში. ქართული, ინგლისური და რუსული. უფასოდ, პირადად, ატვირთვის გარეშე.

პირველად გამოყენებისას OCR-ის ძრავა და ენების მოდელები ბრაუზერში ჩამოიტვირთება (5–10 მბ, შემდეგ ინახება). ამის შემდეგ ამოცნობა თქვენს მოწყობილობაზე მუშაობს, ამიტომ პირადობის მოწმობები, ხელშეკრულებები და სხვა პირადი ქაღალდები არასოდეს იტვირთება.

როგორ მივიღოთ უკეთესი შედეგი

OCR იმდენად კარგია, რამდენადაც კარგია სურათი, რომელსაც კითხულობს. რამდენიმე ჩვევა დიდ განსხვავებას ქმნის:

  • გადაიღეთ პირდაპირ. ტელეფონი გვერდის პარალელურად დაიჭირეთ და არა კუთხით; ასევე თავი აარიდეთ წიგნის ხერხემალთან მოღუნულ გვერდებს.
  • გამოიყენეთ თანაბარი განათება. ტექსტზე გადაფენილი ჩრდილები შეცდომების ყველაზე ხშირი მიზეზია. კარგად მუშაობს ფანჯრიდან შემოსული დღის სინათლე.
  • დაასკანერეთ 300 DPI-ზე, თუ სკანერი გაქვთ. დაბალი გარჩევადობა წვრილ ასოებს ბუნდოვანს ხდის, გაცილებით მაღალი კი მხოლოდ ფაილს ანელებს.
  • ზედმეტი მოაშორეთ. წაკითხვამდე სურათის ამოჭრით მოაცილეთ ჩარჩოები, თითები და მაგიდა.
  • მონიშნეთ მხოლოდ საჭირო ენები. ქართულ-ინგლისურ გვერდს უკეთ ამოიცნობს, თუ მონიშნულია ზუსტად ეს ორი ენა და არა ყველა.

დაბეჭდილ ტექსტს ბევრად უკეთ კითხულობს, ვიდრე ხელნაწერს ან დეკორატიულ შრიფტებს, რომლებიც ნებისმიერი OCR ძრავისთვის რთულია.

გადაამოწმეთ დაკოპირებული ტექსტი

სუფთა OCR-საც კი აქვს მცირე შეცდომები. ერთხელ წაიკითხეთ შედეგი ორიგინალთან შედარებით და განსაკუთრებით ყურადღებით შეამოწმეთ რიცხვები, სახელები, თარიღები და თანხები — შეცვლილი ციფრი ჩვეულებრივ ტექსტს ჰგავს და ადვილად რჩება შეუმჩნეველი. ცხრილები ტექსტის სტრიქონებად გამოდის და არა ცხრილად, ამიტომ მათი ხელახლა აწყობა მოგიწევთ.

ძველი ქართული PDF-ები, რომლებიც ლათინურ ასოებად იქცევა

წლების წინ შექმნილი ქართული დოკუმენტების უმეტესობა ძველ შრიფტებს, მაგალითად AcadNusx-ს, იყენებდა. PDF ეკრანზე სწორად გამოიყურება, მაგრამ მასში შენახული სიმბოლოები ლათინური ასოებია, ამიტომ ტექსტის დაკოპირებით „საქართველოს“ ნაცვლად ლათინურ ასოებს, მაგალითად „saqarTvelo“-ს, მიიღებთ. ეს სკანი არ არის: ტექსტი ნამდვილია, უბრალოდ ძველებურად არის კოდირებული.

დააკოპირეთ, ჩასვით AcadNusx → Unicode გადამყვანში და ჩვეულებრივ ქართულ ტექსტს დაგიბრუნებთ.

AcadNusx → Unicodeძველი ქართული ფონტები → Unicodeგადაიყვანეთ AcadNusx, AcadMtavr ან LitNusx ფონტებით აკრეფილი ტექსტი Unicode ქართულში (და პირიქით). გაასწორეთ „saqarTvelo“ ტიპის აბრაკადაბრა ძველ დოკუმენტებში.

რომელი ხელსაწყო რომელი ფაილისთვის?

გაქვთგამოიყენეთ
ფოტო, ეკრანის სურათი ან სკანისურათიდან ტექსტი
PDF, სადაც ტექსტი მიიშნებაPDF ტექსტად ან PDF-დან Word-ში
ქართული ტექსტი, რომელიც ლათინური ასოებით ჩანსAcadNusx → Unicode

ხშირად დასმული კითხვები

მუშაობს OCR ქართულზე?

დიახ. Toola იყენებს Tesseract-ის ქართულ მოდელს, რომელიც დაბეჭდილ ქართულ (მხედრულ) ტექსტს კითხულობს. ხელნაწერი და დეკორატიული შრიფტები გაცილებით რთულია.

იტვირთება ჩემი ფაილები?

არა. მხოლოდ OCR-ის ძრავა და ენის მოდელები ჩამოიტვირთება, ერთხელ. ამოცნობა თქვენს მოწყობილობაზე მუშაობს.

რამდენი გვერდის წაკითხვა შეიძლება ერთდროულად?

დასკანერებული PDF-ის 50 გვერდამდე. უფრო დიდი ფაილები ჯერ გაჰყავით.

რატომ ჩანს ჩემი ქართული PDF ლათინური ასოებით?

ის ძველი არაუნიკოდური შრიფტით, მაგალითად AcadNusx-ით, არის შექმნილი. დაკოპირებულ ტექსტზე გამოიყენეთ AcadNusx → Unicode გადამყვანი.