3 पॉइंट द्वारा GN⁺ 2024-07-12 | 1 टिप्पणियां | WhatsApp पर शेयर करें
  • बच्चे का नाम चुनने को competitive decision-making के रूप में सरल बनाकर, जब माता-पिता केवल नाम की uniqueness देखकर निर्णय लेते हैं तो कैसी distribution बनती है, इसे game theory के जरिए देखा गया है
  • माता-पिता को myopic और पूरी जानकारी रखने वाले agents मानकर, विश्लेषण योग्य रूप वाला naming model बनाया गया है
  • basic setting, parameters और माता-पिता की incentive structure को formalize करते हुए, सरल interpretation में दिखने वाले myopic behavior के जोखिम को रेखांकित किया गया है
  • numerical experiments दिखाते हैं कि parameters बदलने पर name distribution और strategy outcomes बदल सकते हैं
  • large language model tools का analysis और future research directions भी शामिल हैं, और related work section मौजूदा naming research को मजाकिया अंदाज में सूचीबद्ध करता है

नाम की uniqueness के इर्द-गिर्द game

  • बच्चे का नाम जन्म के तुरंत बाद, बच्चे के input या approval के बिना तय किया जाता है; परंपरागत रूप से वह जीवनभर बना रहता है और भविष्य के जीवन-पथ पर बड़ा असर डालता है—यह premise माना गया है
  • माता-पिता को naming जैसे competitive domain में game theory की लगभग कोई training न होते हुए भी निर्णय लेना पड़ता है
  • model में माता-पिता को इस तरह सरल बनाया गया है
    • myopic agents
    • पूरी जानकारी रखने वाले agents
    • केवल नाम की uniqueness के आधार पर चुनने वाले agents
  • इसी setting के आधार पर naming game की basic structure, parameters, और माता-पिता जिन name attributes व incentives को चाहते हैं, उन्हें formalize किया गया है
  • model की सबसे सरल interpretation में मुख्य मुद्दा यह है कि माता-पिता की myopic choice नाम की strategy में कैसी pitfalls पैदा कर सकती है

प्रयोग और विस्तार पर चर्चा

  • numerical experiments यह जांचने का काम करते हैं कि model के भीतर name distribution कैसे shift होती है
  • parameters बदलने पर naming strategy के results भी बदल सकते हैं, इसलिए सिर्फ uniqueness का पीछा करना हमेशा एक जैसे result तक नहीं ले जाता
  • numerical experiments के अलावा large language model tools analysis भी साथ में कवर किया गया है
  • अंत में future research directions को summarize किया गया है
  • related work section पहले कहता है कि “कोई existing research बिल्कुल नहीं है”, फिर “अगर कई prior studies को सुविधाजनक रूप से ignore कर दें” जैसी शर्त के साथ उन्हें सूचीबद्ध करने वाली मजाकिया संरचना अपनाता है

1 टिप्पणियां

 
GN⁺ 2024-07-12
Hacker News की टिप्पणियां
  • लेखकों की सूची Katy Blumer, Kate Donahue, Katie Fritz, Kate Ivanovich, Katherine Lee, Katie Luo, Cathy Meng, Katie Van Koevering है; जो लोग अंग्रेज़ी नामों से परिचित नहीं हैं, उनके लिए बता दें कि ये सभी नाम Katherine से मिलते-जुलते हैं या उसी से निकले हैं

    • सबसे मज़ेदार बात यह है कि इतने सारे माता-पिता एक ही आम नाम चुनते हैं, इसका सबूत देने के लिए यह पेपर खुद को ही recursive तरीके से cite करता है
      “उदाहरण के लिए, कुछ माता-पिता सोच सकते हैं कि ‘Kate’ नाम सुखद रूप से पारंपरिक होने के साथ-साथ अलग भी है, और इसकी लोकप्रियता भी ठीक-ठाक रहेगी। वे गलत हैं [6]।” यहां reference 6 यही पेपर है
    • पेपर का शीर्षक भी John Green के प्रसिद्ध young adult novel "An Abundance of Katherines" की ओर इशारा करता है
    • इसी तरह का एक उदाहरण Goodman, Goodman, Goodman, Goodman द्वारा लिखा A Few Goodmen: Surname-Sharing Economist Authors है: https://scholar.harvard.edu/files/joshuagoodman/files/goodma...
      और O.W. Greenberg, D.M Greenberger, T.V. Greenbergest का (Para)bosons, (para)fermions, quons and other beasts in the menagerie of particle statistics भी है: https://arxiv.org/abs/hep-ph/9306225
      Wally Greenberg से सुना है कि T.V. “the very” का abbreviation है। और यह भी ध्यान देना चाहिए कि मूल लेख 1 अप्रैल की पोस्ट है
    • कुछ साल पहले KatieConf हुआ था, जिसका मकसद tech conferences में महिला speakers की कमी को सामने लाना था
      https://2019.katieconf.xyz/
    • मुझे जिज्ञासा हुई कि “Katerina” संबंधित है या नहीं; आम तौर पर इसे “Kat” छोटा कर दिया जाता है, और यहां दिखी etymology दिलचस्प लगी: https://www.behindthename.com/name/katherine
  • इसमें कई काफी वाजिब मज़ेदार points थे
    “चूंकि यह पेपर 2024 में लिखा गया है, इसलिए इसमें generative AI और LLMs पर अनिवार्य section शामिल है।”
    “एक और ERA mayfly-parent households है, जिसमें माना जाता है कि सभी माता-पिता बच्चे का नाम रखते ही तुरंत मर जाते हैं, जिससे गणित काफी आसान हो जाता है।”
    “यह सर्वविदित है कि माता-पिता हमेशा पूरी तरह सहमत होते हैं कि वे अपने नवजात बच्चे को कौन-सा नाम देना चाहते हैं।”

    • “हम बिना आधार के दावा करते हैं कि log-normal distribution उचित है...” भी अच्छा था, और Figure 8 में थोड़ा कटा हुआ ChatGPT screenshot खास तौर पर पसंद आया, जिसमें लिखा था “Can you write me a paper on the game theory of names”
    • dinosaur और squid के आकार वाले distribution graph भी मज़ेदार थे
    • Danger 5 तो सबसे बढ़िया था: https://imgur.com/P80uqLB
  • references [12] देखने पर लगता है कि पेपर का title पिछले काम से प्रेरित है: https://en.wikipedia.org/wiki/An_Abundance_of_Katherines
    submission date 31 मार्च 2024 है, इससे लगता है कि इसे April Fools’ paper के तौर पर निकालने की कोशिश की गई थी

  • मुझे लगता है Wait But Why ने baby naming theory को सचमुच अच्छी तरह पकड़ा था: https://waitbutwhy.com/2013/12/how-to-name-baby.html

    • मुझे लगता है कि किसी baby name का boring होना एक गलतफहमी है
      छोटे, चंचल इंसान द्वारा “यही मैं हूं” कहकर आत्मविश्वास से अपनाए गए नाम से कम boring कुछ नहीं होता। खिलौने के नाम के लिए आप खुद को मनाने के लिए कोई अलग-सा नाम चाह सकते हैं, लेकिन बच्चे के लिए यह बिल्कुल समस्या नहीं है
    • Freakonomics में इस बारे में बात हुई थी: [0]
      “नामों से जुड़े सबसे predictable patterns में से एक यह है कि लोकप्रिय होने वाले लगभग हर नाम की शुरुआत ऊपरी वर्ग या ज्यादा पढ़े-लिखे वर्ग के नाम के रूप में होती है। California data में माता-पिता की education level देखी जा सकती थी, और Tiffany, Brittany, Caitlyn जैसे नाम भी, जो बाद में तथाकथित ‘सबसे देहाती’ नाम बन जाते हैं, income distribution के top से शुरू होते हैं और 20, 30, 40 सालों में नीचे की ओर आते हुए कम पढ़े-लिखे वर्गों में धीरे-धीरे और आम हो जाते हैं।”
      पेपर में Mabel trend names के लौटने का उदाहरण लगता है। Hipsters उन्हें revive करते हैं, फिर hipster taste वाले upper-class parents उन्हें फैलाते हैं, और उसके बाद वे आम जनता में फैलते हैं। तरकीब यह है कि ऐसा नाम चुना जाए जो पुराना या अनजान लगे, लेकिन बच्चे के जीवनकाल में लोकप्रिय हो जाए। अगर अभी करना हो तो Linda या Iris जैसे नाम चुने जा सकते हैं
      syllable count analysis भी देखना चाहूंगा। baby-boomer शैली के 2-syllable names फिर कब trend में आएंगे?
      [0] https://freakonomics.com/podcast/how-much-does-your-name-mat...
    • अगर किसी को जिज्ञासा हो, तो यहां वाला why _why नहीं है: https://viewsourcecode.org/why/
  • Jinseok Kim, Jenna Kim, Jinmo Kim का पेपर “Effect of Chinese characters on machine learning for Chinese author name disambiguation: A counterfactual evaluation” भी है
    हालांकि लेखक चीनी नामों वाले नहीं हैं, लेकिन निजी तौर पर मुझे लगता है कि अगर किसी के पास ऐसा नाम हो जिसके लिए एक ही नाम वाले अलग-अलग लोगों की पहचान ज़रूरी हो, तो वह इस शोध क्षेत्र में रुचि ले सकता है। पेपर में यह भी कहा गया है कि कोरियाई नामों में भी यही समस्या है
    https://journals.sagepub.com/doi/full/10.1177/01655515211018...

    • सिर्फ़ surname लिखने की परंपरा उन संस्कृतियों में ठीक काम करती है जहाँ surname लंबे और अलग-अलग होते हैं और given names आम होते हैं, लेकिन उन संस्कृतियों में यह हास्यास्पद तरीका बन जाता है जहाँ surname छोटे और आम होते हैं, और ज़्यादातर जानकारी given name में होती है
  • “...हम एक ऐसा model बनाते हैं जो न सिर्फ़ संभालने में आसान और साफ़-सुथरा है, बल्कि वास्तविक दुनिया को पूरी तरह पकड़ता है” यह वाक्य पढ़कर तुरंत समझ आ गया कि इसका मूड कैसा है
    लेखकों का sense of humour अच्छा है

  • “ऊपर के model में कुछ Extremely Reasonable Assumptions (ERA) शामिल हैं। [...] एक और ERA mayfly parents assumption है, जिसमें माना जाता है कि सभी माता-पिता बच्चे का नाम रखते ही तुरंत मर जाते हैं, जिससे गणित काफ़ी आसान हो जाता है।”
    यह पेपर ऐसे मज़ेदार वाक्यों से भरा है

  • “An Abundance of Katherines” नहीं, An Abundance of K8s जैसा सुनाई देता है

    • Kubernetes लड़की के नाम के तौर पर वाकई प्यारा है
    • ज़्यादा दुखद version Keighty भी है
    • KT’s भी चल सकता है
  • रात में नींद न आने पर बच्चे का नाम रखने की समस्या के बारे में सोचता हूँ
    चाहता हूँ कि बच्चे का नाम किसी सही balance पर हो। न बहुत आम, न बहुत अनोखा, और खासकर ऐसा नहीं जो सिर्फ़ थोड़े समय के लिए trend में रहा हो और जिसे सुनकर मोटे तौर पर उम्र का अंदाज़ा लग जाए[0]
    लेकिन जो लोग इस तरह सोचते हैं, वे आखिरकार उन्हीं कुछ नामों की ओर जमा हो जाते हैं, और अनजाने में “थोड़े समय में बहुत लोकप्रिय” वाला असर पैदा कर देते हैं। मैं पहले ही एक बार fail हो चुका हूँ: मेरी बिल्ली का नाम Olivia है, और बाद में पता चला कि वह उस दशक का popular girls’ name था
    [0] मेरा अपना नाम भी ऐसे नामों में से एक है, इसलिए झुंझलाहट होती है

    • बच्चे करने का इरादा नहीं था, लेकिन अगर करता तो नाम रखने के कुछ नियम थे
      1. वही नाम रखें जिससे सच में बुलाना है। अगर “Kate” बुलाना चाहते हैं तो “Katherine” नाम न रखें, और अगर “Sam” बुलाना चाहते हैं तो Samuel नाम न रखें
      2. किसी नज़दीकी रिश्तेदार जैसा नाम न रखें
      3. आम नाम की अनोखी spelling न रखें। इससे बस उस व्यक्ति को ज़िंदगी भर हर बार नाम बताते समय spelling बताने की झंझट मिलती है
        मेरे माता-पिता ने मेरा नाम रखते समय पहले दो नियम तोड़े, और बड़े होते हुए इससे परेशानियाँ हुईं। Intel में internship के दौरान भी दिक्कत आई, क्योंकि मेरे पिता वहाँ 15 साल से काम कर रहे थे; कभी पिता को जाने वाली email मुझे आ जाती थी या उल्टा होता था
    • बच्चे को अपने समय की उपज बनने देने में क्या बुराई है? आप कोई भी नाम चुनें, परनाती-पोते यह नहीं सोचेंगे कि दादी का नाम कितना cool और अपने समय के हिसाब से चुना गया था
    • क्या मैं https://www.fantasynamegenerators.com सुझा सकता हूँ?
      fantasy नामों के अलावा real-world name categories भी काफ़ी बड़ी हैं। मैं सच में कह रहा हूँ। baby names की lists हज़ारों नामों की होती हैं, यानी typical information overload; random generator इस्तेमाल करें तो 10 नाम देख सकते हैं, पसंद न आएँ तो फिर 10 और निकाल सकते हैं
    • Social Security Administration की site सुझाता हूँ: https://www.ssa.gov/oact/babynames/
      100 साल पहले तक या जिस भी दौर तक चाहें पीछे जाकर lists देखें, और कोई पसंद का नाम मिल जाए जो आजकल top X में भी नहीं है, तो वह काफ़ी safe है। आपको ऐसा नाम मिलेगा जो reasonable है, बहुत ज़्यादा अनोखा भी नहीं, और मौजूदा generation में ज़्यादातर लोगों का नहीं है। site पर recent years का data भी है, और नाम आमतौर पर रातोंरात list के बाहर से popular names में jump नहीं करते
      “उस दशक का popular girls’ name” वाली बात में यह भी ध्यान रखना चाहिए कि internet era में search optimization के लिए खराब common name होना उल्टा अच्छा भी हो सकता है। बेशक यह अक्सर surname पर निर्भर करता है
    • ऐसा नाम होना मुझे पसंद है। पहले लोकप्रिय रहा था, इसलिए जाना-पहचाना नाम है, लेकिन उसी नाम वाले लोग मुझे बस कुछ ही मिले हैं
      दिलचस्प बात यह है कि समान popularity वाले surname के साथ मिलाने पर, अमेरिका में मेरे जैसे first name और surname दोनों वाले लगभग 30 लोग हैं
  • “31 मार्च 2024 को submitted” — यह लगभग April Fools’ joke जैसा लगता है
    “ऊपर के model में कुछ Extremely Reasonable Assumptions (ERA) शामिल हैं। पहला ERA एक बहुत conservative assumption है: gender सिर्फ़ एक है और सभी बच्चे और सभी नाम उसी gender के हैं। इसलिए जब तक कोई नाम list में मौजूद है, किसी भी बच्चे को कोई भी नाम दिया जा सकता है। एक और ERA mayfly parents assumption है, जिसमें माना जाता है कि सभी माता-पिता बच्चे का नाम रखते ही तुरंत मर जाते हैं, जिससे गणित काफ़ी आसान हो जाता है।”

    • न्यूज़ीलैंड और ऑस्ट्रेलिया में तो पहले ही April Fools’ था, बस GMT-XX time zones का पीछा थोड़ा धीमा है
    • SIGBOVIK हमेशा April Fools’ Day के आसपास ही होता है :)