TextSnatcher: Linux डेस्कटॉप के लिए इमेज से टेक्स्ट कॉपी करें
Linux users TextSnatcher को उजागर करते हैं, एक Flatpak-आधारित टूल जो आपको स्क्रीन का एक region पकड़कर Tesseract OCR चलाने देता है ताकि images से text को clipboard में copy किया जा सके, जबकि कई लोग scrot, maim, grim, और desktop-specific screenshot utilities जैसे tools के साथ अपने streamlined Bash pipelines भी साझा करते हैं। OCR quality के अनुभव मिश्रित हैं: Tesseract parameters को tune करना और simple preprocessing मदद कर सकते हैं, लेकिन low-quality, stylized, या non‑English text अक्सर समस्या बना रहता है, जिससे कुछ लोग newer deep-learning OCR libraries या platform-native solutions को तरजीह देते हैं। Commenters Windows PowerToys, macOS Live Text और third-party apps, iOS/Android OCR features जैसे cross-platform alternatives की भी तुलना करते हैं, और privacy-sensitive content के लिए cloud-based services की बजाय local processing के लाभों पर ज़ोर देते हैं।
टूल और मूल तरीका
- TextSnatcher
scrot(portals के माध्यम से) और Tesseract का उपयोग डिफ़ॉल्ट सेटिंग्स के साथ, बिना किसी अतिरिक्त preprocessing के, करता है। - इसे Flatpak के रूप में पैकेज किया गया है; Tesseract Flatpak manifest में bundled है।
- साफ़ UI टेक्स्ट और डायलॉग्स के लिए यह काफ़ी ठीक काम करता है, लेकिन noisy / skewed इमेजों पर संघर्ष करता है और CAPTCHAs के लिए उपयुक्त नहीं है।
Shell script विकल्प और सुधार
- कई उपयोगकर्ता लगभग-identical Bash scripts साझा करते हैं: region screenshot लें, वैकल्पिक रूप से ImageMagick से preprocess करें (जैसे grayscale और 4× resize), Tesseract को feed करें, clipboard में copy करें, notification दिखाएँ।
- वेरिएंट मुख्यतः इनमें अलग होते हैं: screenshot tool (
scrot,maim,grim+slurp,gnome-screenshot,spectacle,import,flameshot,mate-screenshot), clipboard tool (xsel,xclip,wl-copy), और language selection UIs (dmenu,fuzzel, wofi)। - कुछ scripts मज़बूत error handling,
mktemp -dऔरtrapके जरिए cleanup, और अच्छी shell quoting practices पर ज़ोर देती हैं।
OCR गुणवत्ता और Tesseract पर चर्चा
- मिश्रित अनुभव: कुछ लोगों को Tesseract sans‑serif UI fonts और ऐतिहासिक scans के लिए “काफ़ी खराब” लगता है; दूसरे कहते हैं कि पिछले दशक में इसमें बहुत सुधार हुआ है और नियंत्रित scans के लिए यह अच्छी तरह काम करता है।
- Page segmentation mode पर ज़ोर दिया गया है: default PSM 3 suboptimal हो सकता है; disconnected text के लिए PSM 11 मदद कर सकता है।
- Alternative OCR stacks (EasyOCR, OCRmyPDF) कुछ परिस्थितियों में Tesseract से बेहतर बताए गए हैं।
- यह धारणा भी है कि OCR “हल हो जाना चाहिए,” फिर भी receipts और low‑res scans अक्सर गलतियाँ कराते हैं।
Platform-specific alternatives
- Windows: PowerToys Text Extractor और built-in Snipping Tool OCR आम समाधान हैं।
- macOS/iOS: Preview, Quick Look, Safari, system-wide photo text selection में Live Text, और macOCR, TRex, तथा Textinator जैसे third-party tools।
- Android: Google Lens, Photos, overview-screen text selection, और “circle to search.”
- अन्य desktop tools में NormCap और Frog शामिल हैं।
Packaging, compatibility, and maintenance
- Flatpak को व्यापक रूप से उपलब्ध माना जाता है, लेकिन हमेशा preinstalled नहीं; कुछ लोग unmaintained apps के लिए संभावित GTK/desktop compatibility issues का उल्लेख करते हैं।
- TextSnatcher का repo निष्क्रिय दिखता है और इसकी website certificate expired है, जिससे long-term support को लेकर चिंताएँ बढ़ती हैं, हालांकि कुछ का तर्क है कि पुराने tools भी उपयोगी हो सकते हैं।
Privacy and security considerations
- एक commenter को remote processing का संदेह था, लेकिन source inspection में केवल local Tesseract use दिखा; code में external services का कोई प्रमाण नहीं है।