რატომ რჩება თქვენი დოკუმენტები უხილავი
PDF-ის ტექსტი არ ინახება ღია სახით. ის დევს შეკუმშულ შიგთავსის ნაკადებში, თითოეული შრიფტისთვის ცალკე კოდირებული. 2007 წლიდან Office-ის ფაილები ZIP-კონტეინერებია, რომელთა შიგნით შეკუმშული XML-ია. ძებნა, რომელიც ამ ფაილების ნედლ ბაიტებს კითხულობს, პრინციპულად ვერაფერს იპოვის — და სწორედ ამიტომაა, რომ ამდენი ადამიანი დარწმუნებულია, დოკუმენტი «ამ კომპიუტერზე არ არის», მაშინ როცა ის იქ მთელი დროის განმავლობაში იდო.
- PDF — ტექსტი FlateDecode-ით შეკუმშულ ნაკადებშია
- DOCX, XLSX, PPTX — ZIP-კონტეინერები შეკუმშული XML-ით
- ODT, ODS, ODP — იგივე პრინციპი, სხვა XML
- Windows-ის ძებნა — მხოლოდ არჩეულ საქაღალდეებს ინდექსირებს და მთელ დისკებს ტოვებს
📄 იპოვეთ დოკუმენტი და არა მხოლოდ ფაილის სახელი
Deskora ეძებს PDF, Word, Excel, PowerPoint და OpenDocument ფაილების შიგნით — ყველა დისკზე.
ჩამოტვირთეთ Deskora უფასოდრომელი ფორმატები მოწმდება
Deskora ამოიღებს დოკუმენტის წასაკითხ ტექსტს და სწორედ მას ეძებს. აი, რა არის დაფარული — და რა შეგნებულად არა.
| ფორმატი | რა მოწმდება |
|---|---|
| PDF (.pdf) | გვერდების სრული ტექსტი, შეკუმშული ნაკადებისა და CID-შრიფტების ჩათვლით. მიეთითება გვერდის ნომერი. |
| Word (.docx, .docm) | ძირითადი ტექსტი, ცხრილები, კოლონტიტულები, სქოლიოები. შესწორებებში წაშლილი ტექსტი გამორიცხულია. |
| Excel (.xlsx, .xlsm) | ყველა ფურცლის ყველა უჯრა. მიეთითება ფურცლის სახელი. |
| PowerPoint (.pptx, .ppsx) | ყველა სლაიდის ტექსტი თანმიმდევრობით. მიეთითება სლაიდის ნომერი. |
| OpenDocument (.odt) | სრული ტექსტი სათაურებითა და ცხრილებით. |
| OpenDocument (.ods) | ყველა ცხრილის ყველა უჯრა. მიეთითება ცხრილის სახელი. |
| OpenDocument (.odp) | ყველა სლაიდის ტექსტი. მიეთითება სლაიდის სახელი. |
| RTF (.rtf) | სრული ტექსტი, სამართავი სიტყვებითა და სიმბოლოთა კოდებით ამოხსნილი. |
| TXT, LOG, CSV, XML, JSON | ეძებება პირდაპირ, ბაიტ-ბაიტ — სწრაფი გზა, უცვლელი. |
| .doc, .xls, .msg | არ არის მხარდაჭერილი. ძველი ორობითი ფორმატები და ფოსტის კონტეინერები ცალკე თემაა და შეგნებულად რჩება მიღმა, ვიდრე ნახევრად გაკეთდეს. |
როგორ მუშაობს
ტექსტის ამოღება ძვირი ჯდება, ამიტომ ერთხელ ხდება. შემდეგ ტექსტი შეკუმშულად რჩება ინდექსში და ყოველი მომდევნო ძებნა ჩვეულებრივი ტექსტის ძებნასავით მოქმედებს.
🔍 ტექსტის ამოღება
PDF-ის ნაკადები იშლება და შრიფტის ცხრილებით იშიფრება; Office-ის ფაილები იშლება და მათი XML სწორად იკითხება — ერთეულებისა და აბზაცების გამოყოფის ჩათვლით.
💾 მუდმივი ინდექსი
ამოღებული ტექსტი შეკუმშულად ინახება. თავიდან მხოლოდ მაშინ ამოიღება, თუ ფაილის ზომა ან დრო შეიცვალა.
🌙 წყნარი ფონური აგება
ნაკადისა და შეტანა-გამოტანის ყველაზე დაბალი პრიორიტეტი, ნებისმიერ დროს შეწყვეტადი. ვერც უნდა შეამჩნიოთ.
📄 ნამდვილი ადგილი
შედეგი მიუთითებს გვერდზე 7, ფურცელზე «შემოსავალი» ან სლაიდზე 3 — და არა უაზრო სტრიქონის ნომერზე.
Deskora შედარებით
პატიოსანი შედარება. Deskora უფასო სამაგიდო პროგრამაა და არა იურიდიული e-discovery პლატფორმა — და თავს ასეთად არც აჩვენებს.
| Deskora | Windows-ის ძებნა | Agent Ransack | dtSearch | |
|---|---|---|---|---|
| ეძებს PDF-ის შიგნით | დიახ | მხოლოდ ინდექსირებულ საქაღალდეებში | დიახ | დიახ |
| ეძებს Office-ის ფაილებში | დიახ | მხოლოდ ინდექსირებულ საქაღალდეებში | დიახ | დიახ |
| მოიცავს ყველა დისკს | დიახ | არა | დიახ | დიახ |
| რეგულარული გამოსახულებები | დიახ | არა | დიახ | დიახ |
| მიუთითებს გვერდს / ფურცელს / სლაიდს | დიახ | არა | არა | დიახ |
| ფასი | უფასო | სისტემაშია | უფასო / ფასიანი | რამდენიმე ასეული ევროდან |
ვისთვისაა
⚖️ იურიდიული და საგადასახადო ბიუროები
საქმის ნომერი გვხვდება PDF-ის კოლონტიტულში, ცხრილის მესამე ფურცელზე და დასკანერებულ ხელშეკრულებაში. ფაილის სახელით ვერცერთს იპოვით, შიგთავსით — სამივეს, თანაც მიუთითებს, რომელი გვერდი გახსნათ.
🔬 კვლევა და სწავლა
ასეულობით სტატია, ათეულობით მონაცემთა ნაკრები, ჩანაწერები სამ ფორმატში. «რომელ სტატიაში იყო ის მეთოდი?» შიგთავსის კითხვაა და წამი უნდა დასჭირდეს, და არა ნახევარი დღე.
🔧 ტექნიკური დოკუმენტაცია
ნაწილების ნომრები და შეცდომების კოდები სახელმძღვანელოებშია და არა მათ ფაილთა სახელებში. ძებნა, რომელიც შიგნით იხედება, PDF-ებით სავსე საქაღალდეს ცოდნის ბაზად აქცევს.
თქვენი დოკუმენტები თქვენს კომპიუტერზე რჩება
ტექსტის ამოღება მთლიანად ლოკალურად მიმდინარეობს. არაფერი იტვირთება, არაფერი იგზავნება სერვერზე, ანგარიში საჭირო არაა. დოკუმენტების ინდექსი სრულად გამორთვადია, არჩეულ საქაღალდეებამდე შეზღუდვადი ან გამონაკლისებით შევსებადი — პროგრამამ, რომელიც ყველა დისკს იცნობს, საზღვრის გავლება თქვენთვის უნდა დაუტოვოს.
ხშირად დასმული კითხვები
იპოვის დასკანერებულ PDF-ში ტექსტს?
არა. დასკანერებული PDF ტექსტის სურათია და არა ტექსტი. საჭირო იქნებოდა ოპტიკური ამოცნობა, რაც სხვა ტიპის პროგრამაა. Deskora უბრალოდ შეატყობინებს, რომ დამთხვევა არ არის, ნაცვლად იმისა, რომ თავი მოაჩვენოს.
პაროლით დაცული ფაილები?
გამოტოვებულია. Deskora არ ცდილობს დაშიფვრის გატეხვას, არც გავრცელებულ შემთხვევაში, როცა მომხმარებლის პაროლი ცარიელია: ეს საკეტი შემქმნელმა შეგნებულად დაადო.
შეანელებს ეს კომპიუტერს?
ინდექსი ფონურად, ყველაზე დაბალი პრიორიტეტით შენდება და ნებისმიერ დროს წყდება. ჩვეულებრივი ტექსტის ძებნა უცვლელი რჩება: ისევ პირდაპირ ფაილზე მუშაობს, ასლის გარეშე.
რამდენ ადგილს იკავებს ინდექსი?
ამოღებული ტექსტი შეკუმშულად ინახება და დოკუმენტების მცირე ნაწილია. რამდენიმე ათასი დოკუმენტი, როგორც წესი, რამდენიმე ათეულ მეგაბაიტს იკავებს.
მუშაობს არალათინურ დამწერლობებთან?
დიახ. ჩინური, იაპონური, კირილიცა, არაბული და დევანაგარი მუშავდება, ხოლო რეგისტრისადმი გულგრილი ძებნა ASCII-ს გარეთაც მოქმედებს.
შემიძლია რეგულარული გამოსახულებების გამოყენება?
დიახ, ECMAScript-ის სინტაქსით. მცდარი გამოსახულება ველთან მინიშნებას აჩვენებს და არა ჩუმად ჩავარდნას.
📄 იპოვეთ დოკუმენტი და არა მხოლოდ ფაილის სახელი
Deskora ეძებს PDF, Word, Excel, PowerPoint და OpenDocument ფაილების შიგნით — ყველა დისკზე.
ჩამოტვირთეთ Deskora უფასოდ