2 पॉइंट द्वारा GN⁺ 2025-02-27 | 1 टिप्पणियां | WhatsApp पर शेयर करें
  • कुछ महीने पहले, Anna’s Archive ने घोषणा की थी कि Anna’s Archive डेटा के ISBN स्पेस को सबसे अच्छे तरीके से विज़ुअलाइज़ करने वाले व्यक्ति को $10,000 का इनाम दिया जाएगा
  • यह विज़ुअलाइज़ेशन पहले से आर्काइव की गई और अभी तक आर्काइव न की गई फ़ाइलों को दिखाता है, और इसमें उन लाइब्रेरी की संख्या दर्शाने वाला डेटासेट शामिल है जिनके पास ISBN है
  • बहुत से लोगों ने भाग लिया और रचनात्मक आइडिया प्रस्तुत किए। इस प्रोजेक्ट के लिए उनका जुनून और ऊर्जा प्रभावशाली थी
  • लक्ष्य यह समझना है कि दुनिया में मौजूद किताबों में से कितनी पहले से आर्काइव हो चुकी हैं और किन किताबों पर आगे ध्यान केंद्रित करना चाहिए

बुनियादी विज़ुअलाइज़ेशन

  • 300kb से कम की इमेज में मानव इतिहास की सबसे बड़ी "किताबों की सूची" को संक्षेप में दिखाया गया है।
  • इसमें कई डेटा स्रोत शामिल हैं: All ISBNs, Anna’s Archive, Google Books, Internet Archive आदि।

चुनौती और विजेता

  • $6,000 का पहला पुरस्कार, $3,000 का दूसरा पुरस्कार, और $1,000 का तीसरा पुरस्कार देने का फैसला किया गया था। बड़ी संख्या में भागीदारी के कारण, तीसरा पुरस्कार चार लोगों को $500-$500 के रूप में देने का निर्णय लिया गया।
  • 1वाँ स्थान $6,000: phiresky - लचीले विज़ुअलाइज़ेशन विकल्प और तेज़, स्मूथ implementation खास रहे।
  • 2रा स्थान $3,000: hypha - मैक्रो स्तर का विज़ुअलाइज़ेशन प्रभावशाली है, और यह user-friendly UI प्रदान करता है।
  • 3रा स्थान $500 #1: maxlion - कई तरह के views, खासकर comparison और publisher view, प्रभावशाली हैं।
  • 3रा स्थान $500 #2: abetusk - comparison फीचर बेहतरीन है।
  • 3रा स्थान $500 #3: conundrumer0 - यह एक बेहद लचीला विज़ुअलाइज़ेशन टूल है और काफी प्रभावशाली है।
  • 3रा स्थान $500 #4: charelf - सरल लेकिन प्रभावी फीचर्स प्रदान करता है।

उल्लेखनीय आइडिया

  • BWV_1011: rare books के लिए skyscraper
  • robingchan: real-time statistics
  • reguster: annotations और real-time statistics
  • orangereporter: अनोखा map view और filters
  • joe.davis: शानदार default color scheme और heatmap
  • timharding: datasets की तेज़ comparison के लिए आसान switching
  • j1618: सुंदर labels
  • immartian: किताबों की संख्या दिखाने वाला scale bar
  • backrndsource: DJ की तरह datasets compare करने के लिए बहुत सारे sliders

निष्कर्ष

  • पहले स्थान वाले काम को मुख्य वेबसाइट में integrate किया जाएगा, और अन्य कामों पर भी विचार किया जा रहा है।
  • यह सोचा जा रहा है कि दुर्लभ किताबों की पहचान, सत्यापन और आर्काइविंग की प्रक्रिया को कैसे संगठित किया जाए।
  • भाग लेने वाले सभी लोगों का धन्यवाद, और इस प्रोजेक्ट में रुचि दिखाने वाले इतने लोगों के लिए भी आभार।

1 टिप्पणियां

 
GN⁺ 2025-02-27
Hacker News की राय
  • विजेता एंट्री वही visualization थी, जिसे हाल ही में HN पर भी कवर किया गया था
    technical choices और graphic design—दोनों ही तरफ से प्रभावशाली, और 2 अरब किताबों को bookshelf जैसा दिखाते हुए बेहद elegant तरीके से visualize किया गया
    संबंधित HN चर्चा: https://news.ycombinator.com/item?id=42897120

  • मेरी एंट्री के तीसरे स्थान पर आने से थोड़ा आश्चर्य हुआ। शायद simplicity और visualization को अच्छा माना गया होगा
    अभी भी https://isbnviz.pages.dev पर देखी जा सकती है
    ईमानदारी से कहूं तो मुझे लगता है कि नीचे की दो एंट्रीज़ बेहतर हैं: https://bwv-1011.github.io/isbn-viewer/, https://anna.candyland.page/map-sample.html
    खासकर bwv की एंट्री technical रूप से मिलती-जुलती है, लेकिन कुल मिलाकर मेरी एंट्री से कहीं बेहतर है, और उस रूप के ज्यादा करीब है जिसे मैं बनाना चाहता था

    • मेरे तीसरे स्थान पर आने से मुझे भी आश्चर्य हुआ
      हालांकि तुम्हारी एंट्री और bwv की एंट्री की तुलना करें, तो मैं इस बात से सहमत नहीं हूं कि bwv हर मामले में technical रूप से बेहतर है
      उसमें comparison feature, ISBN selection, और link generation नहीं हैं, और लगता है कि bwv ने दुर्लभ किताबों को highlight करने वाले एक feature पर focus किया, जबकि Anna’s Archive की बाकी desired requirements पर कम ध्यान दिया
    • मुझे जानना है कि तुम्हारी एंट्री और bwv की एंट्री में Spain/Italy वगैरह floating islands की तरह अलग क्यों दिखते हैं, जबकि main blob में भी साथ-साथ दिखाई देते हैं
    • यह सुनकर अच्छा लगा। मुझे भी आश्चर्य हुआ कि bwv-1011 ने rarity visualization पर technical focus रखने के बावजूद सिर्फ honorable mention पाया
      बाहर से देखने पर तो यही इस प्रयास का मुख्य उद्देश्य लगता था
  • सचमुच शानदार। हालांकि मुझे एक अजीब बात दिखी
    ‘Stubborn Attachments’ search किया तो सही आया, और उसी bookshelf में Stripe Press की कई किताबें थीं
    उनमें Stephanie Friedman की “Zero to One Hundred” नाम की एक किताब है, लेकिन Amazon पर search करने पर title अलग दिखता है। चूंकि वह अभी publish नहीं हुई है, इसलिए title final न हुआ हो—यह समझ में आता है: https://a.co/d/bQX5CNf
    अजीब बात यह है कि bookshelf पर दिख रहे title “Zero to One Hundred” से search करने पर वह नहीं आती, लेकिन ISBN से search करने पर आती है, और search result में नाम फिर किसी और title के रूप में दिखता है
    इसलिए वही bookshelf position इस पर निर्भर करके अलग दिखती है कि आपने क्या search किया। यह visualization कैसे काम करता है, उस पर blog post मैंने अभी नहीं पढ़ी है, इसलिए कारण नहीं पता

    • लगता है समस्या tool की नहीं, बल्कि book data खुद उलझा हुआ है
      web पर ISBN search करने पर “Built to Grow” cover के साथ “Zero to One Hundred” दिखता है, और उल्टा भी वैसा ही है
      उसी ISBN के साथ, पहले दो titles से जुड़े हुए, “Experiment, Build, Scale” भी आता है, और visualization में इसी किताब के रूप में दिखता है
      Stephanie की किताबों में Google Books पर शायद सिर्फ “Experiment, Build, Scale” है, और Worldcat पर “Built to Grow” cover के साथ “Zero to One Hundred” है
      ज्यादातर online bookstores इसी तरह उलझे हुए हैं, इसलिए यह upstream data quality problem के ज्यादा करीब लगती है, tool को दोष देना मुश्किल है
  • दिलचस्प है। https://archive.anarchy.cool/maps/isbn.html पर zoom करके देखें तो कई चीजें दिखती हैं। अफसोस, coordinates या zoom level के साथ direct link देने का option शायद नहीं है
    German-language section के पूर्व में Hueber Verlag जैसे publishers मिलते हैं, और ऐसा pattern दिखता है जैसे ISBN numbers को लगभग 1360000 के interval पर बिखेरा गया हो
    मुझे पता है कि ISBN में checksum होता है, इसलिए numbers के बीच खाली जगहें बनती हैं, लेकिन लगता है कि इसी वजह से बहुत खाली जगह वाला repeating pattern बन रहा है, और publisher के बड़े allotted range का काफी हिस्सा waste हो रहा है
    क्या publishers को numbers कैसे assign करने हैं, इसके लिए कोई नियम नहीं हैं? बेहतर होगा कि जिन unused blocks की अब जरूरत नहीं है, उन्हें वापस किया जा सके
    यह भी लगता है कि अगर आप 30 भाषाओं में learning materials publish करते हैं, तो ISBN assignment में कई “ideas” आ सकते हैं: https://de.wikipedia.org/wiki/Hueber_Verlag

  • बड़े datasets की visualizations में, जिनमें user से खुद “explore” करने की उम्मीद की जाती है, वे आम तौर पर सुंदर तो लगती हैं, लेकिन मुझे लगता है कि वे कोई खास insight नहीं देतीं
    किसी specific message या narrative को convey करने के बजाय वे बस इधर-उधर देखने को कहती हैं, इसलिए ये visualizations भी खासकर वैसी ही लगती हैं

    • visualization को जबरन 3D बनाने की कोशिशों में मुझे जो समस्या महसूस होती है, वह यही है
      medical imaging या CAD की तरह अगर आप असली 3D volume model नहीं कर रहे हैं, तो 3D से जुड़ा “forced exploration” insight को छिपाता ही है
    • ISBN जिन चीजों को map करता है, वे publisher, assigned title, और roughly publication order तक हैं
      वह बस इतनी ही जानकारी देता है, और discovery में मदद करने या content को organize करने वाली कोई hierarchical structure नहीं है
      ऊपर से वही text अलग bindings में कई बार दिख सकता है, जो ebook के नजरिए से कोई खास meaningful difference नहीं है
      इससे भी बड़ी समस्या यह है कि “Anna’s Archive” कोई legal book repository नहीं, बल्कि pirate site है, और जो वे दिखा रहे हैं वह चोरी की completeness और उसके चलते compensation की कमी का खुला प्रदर्शन है
      अगर यह LoC जैसे hierarchical system पर आधारित होता, और https://www.gutenberg.org/ पर सच में accessible legal books, या http://onlinebooks.library.upenn.edu/ पर मौजूद books, या https://www.wikibooks.org/ पर काम चल रही books तक पहुंचने का interface होता, तो यह कहीं ज्यादा interesting होता
  • सबसे ऊपर वाली इमेज देखते ही reflex में disk defragmenter प्रोग्राम खोलने का मन हो गया

    • Windows 98 का animation सबसे बढ़िया था। उसके बाद की सारी चीज़ें बहुत खराब रहीं, इसका अफसोस है
  • हिस्सा लेना अपने-आप में बहुत मजेदार था, और इससे जुड़े सभी लोगों को बधाई
    जिसे दिलचस्पी हो, उसके लिए मेरी entry अब भी live है: https://d199hl4t3ts6d9.cloudfront.net/

  • सभी shadow libraries के लिए दिल से प्यार। वे सच में ईश्वर का काम कर रही हैं

    • वे आधा काम कर रही हैं, और वह आधा भी बहुत बड़ा है। बाकी आधा किताबों को digitize करने वाले volunteers कर रहे हैं
      अपने देश की “bookshelf” देखते हुए इतने सारे गायब titles देखकर दुख हुआ
      इतना कि मन हुआ कि पुरानी, out of print और अब unavailable किताबों को local library में जाकर खुद digitize करूँ
      बहुत सारा ज्ञान गायब होता जा रहा है
  • सोच रहा हूँ कि इस ISBN visualization में कोई साफ़ Spanish-speaking region क्यों नहीं दिखता
    English के लिए 2 खांचे हैं, France, Germany, Japan, Soviet Union, China वगैरह के बड़े sections हैं, लेकिन Spain के लिए कोई बड़ा section नहीं है
    क्या Spanish books वाकई इतनी कम हैं? या distribution मुख्य रूप से English-speaking दुनिया की तरफ skewed है?
    Spanish libraries और bookstores में बड़ा हुआ हूँ और Spanish books से घिरा रहा हूँ, इसलिए इस world map में हमारा हिस्सा इतना छोटा दिखना थोड़ा अजीब लगता है

    • dataset Anna’s Archive में मौजूद किताबों से बना है, और हर किताब ISBN से पहचानी जाती है
      ISBN और titles https://annas-archive.li/datasets के dataset से निकाले गए हैं, जिसमें मुख्य रूप से Chinese, English, French magazines और books शामिल हैं
      उदाहरण के लिए Germany, Netherlands से 5 गुना ज्यादा किताबें publish करता है, और Spain, Netherlands से 2 गुना ज्यादा publish करता है: https://internationalpublishers.org/wp-content/uploads/2023/11/IPA-Nielsen-BookData-IPA-Full-Report-23022024.pdf
      लेकिन visualization में Germany, Netherlands जैसा ही दिखता है, और Spain और Mexico top labels से ठीक से match नहीं करते: https://software.annas-archive.li/AnnaArchivist/annas-archive/-/issues/244#note_2913
    • मेरे मन में भी बिल्कुल यही सवाल था, और कोई सबूत तो नहीं है, लेकिन एक hypothesis है
      Argentina या Peru जैसा दिखने वाला एक बड़ा block है, और titles उस बड़े block के किनारों पर हैं
      दूसरे major blocks की तरह उसके बीच में नाम नहीं लगा है और वह खाली है; अगर वह पूरा Argentina है तो मुझे थोड़ा आश्चर्य होगा, और अगर वह block Spanish-speaking region है तो यह काफी समझ में आता है
  • winning entry कुछ हद तक Eagle mode file manager जैसी लगी, जिसमें directory के अंदर files देखने के लिए zoom in करते हैं, और subdirectory तक पहुँचने के लिए लगातार zoom in करते रहते हैं
    https://eaglemode.sourceforge.net/emvideo.html