फ़ोन से दस्तावेज़ स्कैन कैसे करें

न आपको फ़्लैटबेड स्कैनर चाहिए, न कुछ इंस्टॉल करना है। फ़ोन का कैमरा और पर्सपेक्टिव करेक्शन मिलकर ऐसी PDF बना देते हैं जो फ़ोटो जैसी नहीं, स्कैन जैसी दिखती है। इस पेज पर बताया गया है कि फ़ोटो कैसे लें और फिर ScanPDF में उसके साथ क्या करें।

फ़ोटो और स्कैन में फ़र्क़ क्या है

काग़ज़ की फ़ोटो अक्सर तिरछे एंगल से ली जाती है, इसलिए पन्ना सीधे आयत की जगह एक तरफ़ से चौड़ा और दूसरी तरफ़ से पतला दिखता है। उसमें कमरे की रोशनी का रंग आ जाता है, आपके हाथ या सिर की परछाई पड़ जाती है, और आसपास मेज़ पर जो कुछ रखा था वह भी साथ में आ जाता है।

इसे स्कैन में बदलने के लिए चार अलग-अलग सुधार करने पड़ते हैं: पता लगाना कि पन्ना असल में कहां है, उसे वापस सीधे आयत में लाना, उसे काग़ज़ के असली साइज़ में ढालना, और रोशनी को इतना बराबर करना कि काग़ज़ सफ़ेद दिखे। ScanPDF ये चारों काम करता है, इसीलिए नतीजा काटी-छांटी फ़ोटो से ज़्यादा फ़्लैटबेड स्कैन जैसा लगता है।

ऐसी फ़ोटो लें जिसे सीधा करना आसान हो

किनारों की ऑटोमैटिक पहचान चार कोनों वाला ऐसा आकार ढूंढती है जो अपने आसपास से अलग दिखे। कुछ आदतें अपना लें तो यह लगभग हर बार सही काम करती है:

  • पन्ने को ऐसी सतह पर रखें जिसका रंग अलग हो। गहरे रंग की मेज़ पर सफ़ेद काग़ज़ सबसे आसान मामला है। सफ़ेद मेज़ पर सफ़ेद काग़ज़ सबसे मुश्किल, क्योंकि वहां ढूंढने लायक़ कोई किनारा ही नहीं होता।
  • चारों कोने फ़्रेम में रखें, और पन्ने के चारों तरफ़ थोड़ी जगह छोड़ें। जो कोना फ़्रेम से बाहर कट गया, वह न पहचाना जा सकता है और न बाद में खींचकर वापस लाया जा सकता है।
  • फ़ोटो बगल से नहीं, ऊपर से लें। किसी भी एंगल को ठीक किया जा सकता है, लेकिन बहुत तिरछे एंगल से पन्ने का दूर वाला हिस्सा खिंच जाता है और वहां की शार्पनेस कम हो जाती है।
  • रोशनी बराबर हो और सीधी न पड़े। फ़्लैश बंद रखें। बगल की खिड़की से आती रोशनी उस बल्ब से बेहतर है जो ठीक आपके पीछे ऊपर लगा हो, क्योंकि उससे आपकी ही परछाई पन्ने पर पड़ती है।
  • पन्ने को सपाट कर लें। जिल्द के पास का मोड़ किनारे को टेढ़ा कर देता है, और टेढ़े किनारे पर सीधी लाइन बिठाना मुश्किल होता है।

इनमें से कुछ भी एकदम परफ़ेक्ट होना ज़रूरी नहीं। पहचान चूक जाए तो उसे ठीक करने में पांच सेकंड लगते हैं, और नीचे की गाइड में यही बताया गया है।

स्टेप-बाय-स्टेप तरीक़ा

  1. फ़ोटो जोड़ें। उन्हें पेज पर ड्रैग करके छोड़ें, "फ़ोटो जोड़ें" पर क्लिक करें, या फ़ोन पर "फ़ोटो लें" से सीधे ऐप में फ़ोटो खींचें। आप पूरा ढेर एक साथ जोड़ सकते हैं - हर फ़ोटो एक पेज बन जाती है।
  2. पहचाने गए कोने जांचें। हर थंबनेल पर वह फ़्रेम दिखता है जो पहचाना गया। जिस पेज पर पहचान पक्की नहीं थी, उस पर "कोने ठीक करें" का बैज लग जाता है, इसलिए आपको सिर्फ़ वही पेज देखने हैं जिन्हें आपकी ज़रूरत है।
  3. कोनों को खींचकर पन्ने के किनारों तक ले जाएं। हैंडल के साथ-साथ एक मैग्निफ़ायर चलता है, ताकि आप ठीक कोने पर पहुंच सकें। "दोबारा पहचानें" ऑटोमैटिक पहचान फिर से चलाता है, और अगर नए सिरे से शुरू करना हो तो "कोने रीसेट करें" उन्हें वापस पूरे फ़्रेम पर रख देता है।
  4. ज़रूरत हो तो घुमाएं। फ़ोन की फ़ोटो में उनकी दिशा EXIF मेटाडेटा में दर्ज रहती है और वे अपने आप सीधी हो जाती हैं, फिर भी आड़े खींचे गए पेजों के लिए 90 डिग्री वाले बटन मौजूद हैं।
  5. फ़िल्टर चुनें, और अगर सारी फ़ोटो एक ही रोशनी में ली गई थीं तो "सब पर लागू करें" दबाएं।
  6. पेजों का क्रम लगाएं। किसी पेज को खिसकाने के लिए उसका थंबनेल ड्रैग करें, और जो ठीक नहीं आए उन्हें डिलीट कर दें। थंबनेल जिस क्रम में हैं, PDF में पेज उसी क्रम में होंगे।
  7. पेज साइज़ चुनें और सेव करें। ऑटो, A4, Letter, बैंक कार्ड, फ़ोटो या कोई और फ़ॉर्मैट चुनें, फिर "PDF सेव करें" दबाएं। फ़ाइल ब्राउज़र में ही तैयार होती है और आपके डाउनलोड फ़ोल्डर में पहुंच जाती है।

सही फ़िल्टर कैसे चुनें

फ़िल्टर तय करता है कि तैयार पेज कैसा दिखेगा, और सही चुनाव इस पर निर्भर है कि काग़ज़ पर क्या है।

  • रंगीन सब कुछ वैसा ही रखता है जैसा फ़ोटो में आया। इसे वहां इस्तेमाल करें जहां रंग का कोई मतलब हो: हाइलाइट किया हुआ टेक्स्ट, मुहरें, नीली स्याही के दस्तख़त, रसीदें, पेज पर छपी तस्वीरें।
  • ग्रेस्केल कंट्रास्ट को छेड़े बिना कमरे की रोशनी से आई रंगत हटा देता है। मिले-जुले पेजों के लिए यह बीच का सुरक्षित विकल्प है, और उन पेजों के लिए भी जिनमें कोई तस्वीर हो और आप उसे स्मूद रखना चाहते हों।
  • ब्लैक एंड व्हाइट वह फ़िल्टर है जिससे दस्तावेज़ सचमुच स्कैन किया हुआ लगता है। यह कोई सख़्त थ्रेशोल्ड नहीं है - यह इमेज को बैकग्राउंड के अनुमान से भाग देता है, जिससे परछाइयां और ऊंची-नीची रोशनी बराबर हो जाती है, काग़ज़ सचमुच सफ़ेद हो जाता है, और टेक्स्ट के किनारे दांतेदार होने की जगह स्मूद (एंटी-एलियास्ड) बने रहते हैं। सादे छपे या हाथ से लिखे टेक्स्ट के लिए यह सबसे साफ़ और सबसे छोटी फ़ाइल देता है। तस्वीरों पर इसे न लगाएं, यह उन्हें बिगाड़ देगा।

आज़माने में कुछ नहीं जाता: फ़िल्टर बदलें और लाइव प्रीव्यू देखें, क्योंकि आपकी पसंद हर पेज के लिए अलग से याद रखी जाती है और सिर्फ़ एक्सपोर्ट के समय लागू होती है। पेज पर पड़ी छाया या किताब की जिल्द के पास की धूसर पट्टी के लिए फ़िल्टर के बगल में अलग स्विच है: यह किसी भी फ़िल्टर के साथ रोशनी एक-सी कर देता है, और जिन पेजों पर ज़्यादातर तस्वीरें हों उनके लिए इसे बंद ही रखना बेहतर है।

पेज साइज़ और आउटपुट क्वालिटी

A4 और Letter हर पेज को ठीक उसी साइज़ का बना देते हैं, और जो चीज़ प्रिंट होनी है या दूसरे दस्तावेज़ों के साथ फ़ाइल में लगनी है उसके लिए यही चाहिए। ऑटो हर पेज को उसी अनुपात में रखता है जो आपके खींचे हुए पन्ने का था - रसीदों, टिकटों, आईडी कार्ड और ऐसे दूसरे अलग आकार वाले काग़ज़ों के लिए यही सही चुनाव है, जो वरना A4 पेज के बीच में अकेले पड़े रह जाते। डिफ़ॉल्ट रूप से ऑटो चुना रहता है। सूची में बैंक और आईडी कार्ड, पासपोर्ट, बिज़नेस कार्ड, फ़ोटो प्रिंट, लिफ़ाफ़ों वगैरह के सटीक फ़ॉर्मैट भी हैं - जब PDF पेज को असली चीज़ के साइज़ का होना हो, तब इनमें से कोई चुनें।

रफ़्तार के लिए पहचान छोटी की हुई कॉपी पर चलती है, लेकिन एक्सपोर्ट हमेशा फ़ुल-रेज़ोल्यूशन वाली असली फ़ोटो से होता है, जो लंबी तरफ़ से 3500 px तक सीमित रहती है और A4 पर लगभग 220 DPI पर लिखी जाती है। पढ़ने, प्रिंट करने और बाद में चाहें तो OCR चलाने के लिए यह आराम से काफ़ी है।

अगर फ़ाइल को किसी सीमा के अंदर रखना है - ईमेल अटैचमेंट, या ऐसा अपलोड फ़ॉर्म जो 2 MB से बड़ी फ़ाइल नहीं लेता - तो पेज साइज़ के बगल में फ़ाइल का अधिकतम साइज़ चुनें। ScanPDF पहले JPEG क्वालिटी घटाता है और ज़रूरत पड़ने पर ही रिज़ॉल्यूशन, और टेक्स्ट के अपठनीय होने से पहले रुक जाता है। अगर इस तरह भी सीमा पूरी न हो, तो सबसे छोटा पढ़ने लायक संस्करण सेव होता है और उसका असली साइज़ बता दिया जाता है।

जब पन्ने की पहचान न हो पाए

ऑटोमैटिक पहचान तब चूकती है जब ढूंढने लायक़ कोई किनारा ही न हो, और वजह लगभग हमेशा इन तीन में से एक होती है: पन्ना उसी रंग की सतह पर रखा है, कोई कोना फ़्रेम से बाहर है, या कोई गहरी परछाई पन्ने के आर-पार जा रही है और नक़ली किनारे जैसी दिख रही है।

पहली दो वजहों में नई फ़ोटो लेनी पड़ेगी। तीसरी में आम तौर पर नहीं - चारों कोने हाथ से खींचकर सही जगह रख दें और पर्सपेक्टिव करेक्शन ठीक वैसे ही काम करेगा जैसे वरना करता। पहचान एक सहूलियत है, ज़रूरी शर्त नहीं।

कुछ भी अपलोड नहीं होता

ऊपर का हर स्टेप आपके अपने डिवाइस पर होता है। इमेज को खोलने, जांचने, सीधा करने और PDF में पैक करने का काम आपके ब्राउज़र टैब में चल रहा कोड करता है; उन्हें भेजने के लिए कोई सर्वर है ही नहीं। कॉन्ट्रैक्ट, मेडिकल रिकॉर्ड, बैंक स्टेटमेंट और पहचान पत्रों के मामले में यह बात मायने रखती है, और प्राइवेसी पेज पर इसे और विस्तार से समझाया गया है।

स्कैनर खोलें और अपनी मेज़ पर जो भी काग़ज़ पड़ा हो, उसी से आज़माकर देखें।