Vesuvius Challenge 2023 Grand Prize awarded: हम पहली स्क्रॉल पढ़ सकते हैं
Machine learning और advanced X-ray imaging ने Vesuvius के 79 CE के विस्फोट में दबी एक carbonized scroll से substantial Greek text सफलतापूर्वक उजागर किया है, जो $1M Vesuvius Challenge के माध्यम से हासिल एक breakthrough है। टिप्पणीकार scrolls को virtually unwrapping और पढ़ने की तकनीकी ingenuity, संभावित रूप से megabytes of lost ancient philosophy को unlock करने के ऐतिहासिक महत्व, और भविष्य की technologies के लिए fragile artifacts को unopened छोड़कर archaeologists द्वारा दिखाई गई सावधानी को रेखांकित करते हैं। ध्यान आगे के कदमों पर भी जाता है: scanning और segmentation को scale up करना, funding constraints, image analysis और future textual interpretation दोनों में AI की भूमिका, और दुनिया भर के अन्य papyri और codices जैसे unread artifacts के लिए व्यापक निहितार्थ।
समग्र प्रतिक्रिया
- कई टिप्पणीकार विस्मय व्यक्त करते हैं, परिणाम को “sci‑fi–like” कहते हैं और इसे साल का एक प्रमुख क्षण मानते हैं।
- लोग 270-वर्षीय यात्रा पर ज़ोर देते हैं: 18वीं सदी की खोज से, औद्योगिक और वैज्ञानिक प्रगतियों के माध्यम से, आधुनिक ML तक, जो अंतिम “unlock” बना।
- कई लोग पहले बरती गई संयम की अहमियत नोट करते हैं: इतिहास में कई अवशेष आक्रामक हैंडलिंग से नष्ट हो गए थे; यहाँ, इंतज़ार रंग लाया।
तकनीकी दृष्टिकोण और सत्यापन
- चर्चा स्पष्ट करती है कि यह CT डेटा पर computer vision है, generative language models नहीं; मॉडल 3D volumes में स्याही-जैसी विशेषताओं का पता लगाते हैं।
- डेटा संरचना (layer stacks / volumes) वीडियो आर्किटेक्चर के पुन: उपयोग को स्वाभाविक बनाती है (उदा., “layers as time” पर transformers)।
- hallucination को लेकर चिंताएँ आम हैं। दूसरे जवाब देते हैं:
- खुले code और data से methods को स्वतंत्र रूप से reproduce किया गया।
- अलग-अलग models और labels वाले कई teams लगभग समान readings पर पहुँचे।
- Models पूरे letters या words नहीं, बल्कि बहुत छोटे local patches पर काम करते हैं, और ink का पता लगाते हैं।
- एक “campfire scroll” test object बनाया और scan किया गया; इसके before/after comparison कितना convincing है, इस पर कुछ बहस बनी हुई है।
बॉटलनेक्स और स्केलिंग अप
- थ्रेड दो मुख्य तकनीकी bottlenecks को उजागर करता है: महँगा high-resolution synchrotron scanning और scroll layers की labor-intensive segmentation।
- सुझाए गए विचार: Naples के पास scanners बनाना या वहाँ स्थानांतरित करना, scanning के लिए crowdfunding या philanthropic funding (दशकों of millions के स्तर पर), और distributed volunteer segmentation (captcha- या SETI@home-स्टाइल) का उपयोग करना।
- लोग इस पर बहस करते हैं कि प्रयास की तुलना में prize money बड़ा है या छोटा; कई लोग प्रतिभा आकर्षित करने के लिए prize framing को बेहद महत्वपूर्ण मानते हैं।
सामग्री और शैक्षणिक प्रभाव
- पहली recovered text Epicurean philosophy of pleasure and scarcity पर केंद्रित है; कुछ इसे निराशाजनक मानते हैं, जबकि दूसरे बताते हैं कि इतिहासकारों के लिए “mundane” texts भी सोना हैं।
- अपेक्षाएँ अलग-अलग हैं: कुछ एक दार्शनिक circle से “more of the same” की आशंका करते हैं; दूसरे तर्क देते हैं कि एक ही mind की पूरी library भी ऐतिहासिक रूप से परिवर्तनकारी है।
- टिप्पणीकार इसे खोई हुई literature, history, और रोज़मर्रा के documents (tax records सहित) को पुनः प्राप्त करने की व्यापक आशाओं से जोड़ते हैं।
पुरातत्व, संरक्षण, और व्यापक चिंतन
- Herculaneum areas और अन्य प्रमुख sites की जानबूझकर non-excavation की गहरी सराहना की जाती है, ताकि तकनीक बेहतर होने तक अपरिवर्तनीय नुकसान से बचा जा सके।
- आगे excavation में बाधाओं पर चर्चा होती है: villa के ऊपर आधुनिक town, स्थानीय प्रतिरोध, आपराधिक हस्तक्षेप, और funding priorities।
- कई लोग इस project का उपयोग इन पर विचार करने के लिए करते हैं:
- आधुनिक ML के नीचे compute और engineering का कितना बड़ा stack है।
- आधुनिक digital data की नाज़ुकता बनाम प्राचीन सामग्रियों की आश्चर्यजनक recoverability।
- rich patrons बनाम collective public funding की भूमिका, और किस तरह के problems बड़े incentives से unlock हो सकते हैं।