Hister: आपके देखे गए पृष्ठों और रखी गई फ़ाइलों के लिए एक निजी खोज इंजन
Hister नाम का एक नया open-source tool आपके browsing history, bookmarks, local files, और यहाँ तक कि social media content को आपकी अपनी machines पर रहने वाले एक private, full-text searchable index में बदल देता है। टिप्पणीकार इसकी तुलना Google Desktop, ArchiveBox, Zotero, और विभिन्न DIY setups जैसे पुराने प्रयासों से करते हैं, तथा स्थानीय बनाम cloud hosting, browser integrations, और long-term archival से जुड़े trade-offs पर बहस करते हुए इसकी पिछली देखी गई pages को सामने लाने की क्षमता की सराहना करते हैं। परियोजना का लेखक planned features, multi-device support, project को rename करने पर कानूनी दबाव, और local LLMs तथा अन्य self-hosted services के साथ संभावित integrations पर टिप्पणी करता है।
अवलोकन और उद्देश्य
- यह टूल आपके देखे गए पृष्ठों और रखी गई फ़ाइलों पर एक निजी खोज इंजन बनाता है।
- इसका ध्यान सामान्य वेब खोज पर नहीं, बल्कि व्यक्तिगत ज्ञान पुनर्प्राप्ति पर है।
- यह देखे गए पृष्ठों, बुकमार्क्स, ब्राउज़र इतिहास, स्थानीय फ़ाइलों और क्रॉल की गई साइटों का एक इंडेक्स के रूप में काम करता है।
विशेषताएँ और वास्तुकला
- निकाले गए पृष्ठ-सामग्री को ऑफ़लाइन प्रीव्यू के साथ सहेजता है, इसलिए स्रोत बदलने या गायब होने पर भी परिणाम बने रहते हैं।
- पूर्ण-पाठ और सिमैंटिक खोज का समर्थन करता है, तथा AI/assistant इंटीग्रेशन्स के लिए एक वेब UI, CLI, और MCP endpoint देता है।
- ब्राउज़र एक्सटेंशन टैब्स में वास्तव में रेंडर की गई सामग्री को इंडेक्स करता है, जिससे यह लॉगिन के पीछे और “बंद” साइटों (Instagram, Discord, Twitter,
yt-dlpके जरिए YouTube transcripts, आदि) की सामग्री कैप्चर कर सकता है। - इसे कई मशीनों और multi-user सेटअप्स से उपयोग किया जा सकता है; कोई अनिवार्य cloud component नहीं है।
अन्य टूल्स से तुलना
- ArchiveBox से तुलना में: यह तेज़ ज्ञान पुनर्प्राप्ति पर केंद्रित है; ArchiveBox दीर्घकालिक संरक्षण पर। कुछ उपयोगकर्ता एक ही साझा archive चाहते हैं, दो नहीं।
- लोग समान या संबंधित टूल्स का उल्लेख करते हैं: linkwarden/linkding/Betula, Zotero, SingleFile, Google Desktop, पुरानी Chrome/Opera history search, recoll, और कई homegrown history-indexers।
- कुछ इसे शक्तिशाली स्थानीय खोज टूल्स के आधुनिक समकक्ष के रूप में देखते हैं, जिन्हें browsers ने तब से “nerf” कर दिया है।
गोपनीयता, सुरक्षा और होस्टिंग संबंधी चिंताएँ
- डेटा को स्थानीय रखने और cloud LLMs पर निर्भर न रहने में गहरी रुचि है; अन्य लोग इसे ChatGPT या स्थानीय मॉडलों के साथ एक “reasoning layer” के रूप में जोड़ने में सहज हैं।
- कुछ लोग distro repositories के बाहर कुछ भी चलाने से सावधान हैं या security vulnerabilities को लेकर चिंतित हैं; सुझावों में containers, AppArmor, systemd hardening, और कड़ी network segmentation शामिल हैं।
- कुछ लोग PDF में प्रिंट करना और फिर
pdfgrepजैसी कम-तकनीकी वैकल्पिक विधियाँ पसंद करते हैं।
वास्तविक उपयोग रिपोर्ट्स
- कई उपयोगकर्ता हफ्तों–महीनों के उपयोग की रिपोर्ट देते हैं और इसे भूले हुए लिंक खोजने, notes/Obsidian को इंडेक्स करने, तथा social/web सामग्री को searchable बनाने के लिए “invaluable” कहते हैं।
- Nginx के माध्यम से reverse-proxy करने पर गंभीर resource issues की एक रिपोर्ट मिली; मूल कारण स्पष्ट नहीं है।
सीमाएँ और फीचर अनुरोध
- वांछित फीचर्स:
- पृष्ठों पर notes/annotations, केवल-बुकमार्क फ़िल्टर, visibility-time thresholds (जैसे केवल वे टैब्स इंडेक्स करें जिन्हें >4s देखा गया हो), पुराने versions और diffs रखना, email indexing, Android/Chrome support, अधिक bookmark manager integrations।
- कुछ लोग elaborate knowledge bases पर अपने व्यक्तिगत ROI पर सवाल उठाते हैं और minimalism को प्राथमिकता देते हैं।
नामकरण और ट्रेडमार्क विवाद
- वर्तमान नाम एक मौजूदा US trademark से टकराता है; maintainers को पुनः नामकरण की उम्मीद है।
- थ्रेड में कई वैकल्पिक नाम सुझाव और इस पर बहस शामिल है कि क्या कानूनी रूप से rename करना आवश्यक है।