1 पॉइंट द्वारा GN⁺ 2025-01-26 | 1 टिप्पणियां | WhatsApp पर शेयर करें
  • 2001 में शुरू हुई विज्ञान कम्युनिटी PhysicsForums के पुराने archive में LLM-जनित पोस्ट्स को पिछली तारीखों के साथ डाला गया और उन्हें मौजूदा user names से जोड़े जाने के संकेत मिले
  • पोस्ट ID और लिखे जाने के समय के monotonically increasing relationship की तुलना करके reverse-insertion pattern खोजा गया, और MathHelpBoards merger जैसे वैध exceptions हटाने के बाद लगभग 115,000 पोस्ट्स LLM द्वारा लिखी गई मानी गईं
  • representative case ravenprp account में 2019 के Wayback Machine record में केवल 74 पोस्ट्स थीं, लेकिन अब 2,891 दिखाई देती हैं; जोड़ी गई 2,817 पोस्ट्स account creation से पहले/बाद और last login के बाद तक फैली हुई हैं
  • LLM-जनित पोस्ट्स कुल पोस्ट्स का लगभग 1.6% और कुल शब्दों का लगभग 3% मानी गईं, लेकिन FAQ और summaries शामिल करने पर साइट के कुल शब्दों में मानव-लिखित हिस्सा घटकर 66% रह जाता है
  • Greg Bernhardt ने जवाब दिया कि AI features और test account experiments quality standards पर खरे नहीं उतरे, लेकिन मौजूदा users की identity से बिना सहमति posts जोड़ने का तरीका community trust और archive integrity को नुकसान पहुंचाता है

पुराने science forum की archival value

  • PhysicsForums 2001 में Greg Bernhardt द्वारा शुरू की गई science community है, जिसका स्वरूप मुख्य रूप से physics homework के hints देने वाले forum जैसा था
  • साइट 2012 तक अपेक्षाकृत लगातार बढ़ी, लेकिन बाद में ध्यान StackExchange जैसी centralized sites की ओर शिफ्ट हुआ और 2025 तक केवल एक छोटी community बची
  • कई शुरुआती web forums के विपरीत, PhysicsForums ने 2003 से 2025 तक URLs बनाए रखे और पुराने posts हटाए या साइट बंद नहीं की, इसलिए यह 2000s की शुरुआत के internet time capsule जैसा बचा रहा

ravenprp account में दिखे असामान्य संकेत

  • ravenprp account फिलहाल सितंबर 2006 से अप्रैल 2007 तक 7 महीनों में 2,891 posts लिखता हुआ दिखता है
    • औसतन रोज़ 13 से ज़्यादा posts, और content में वह university faculty, mechanical engineering student, chemical plant recruiter, structural engineer, biologist, medical physicist, chemist, aerospace engineer जैसी कई identities के बीच आता-जाता है
    • कुछ posts account creation से 3 साल पहले से लेकर last login के 1 साल बाद तक लिखे गए बताए गए हैं
    • OpenAI की स्थापना से 7 साल पहले ही “OpenAI द्वारा विकसित language model” होने का मज़ाक करने वाली posts भी हैं
  • 2019 के Wayback Machine record में इस account की post count 74 थी, लेकिन अब 2,891 दिखाई देती है
    • लगता है बाद में किसी समय posts सीधे database में insert किए गए, और profile की join date या last login information उसके हिसाब से update नहीं हुई
  • मूल 74 posts ही देखें तो ravenprp MATLAB book के बारे में पूछने, 555 timer IC problem देखने और Bernoulli Equation link share करने वाला electrical engineering student जैसा दिखता है
  • असली व्यक्ति द्वारा लिखी 74 posts के विचार और लेखन उसी account में जोड़ी गई 2,817 posts के नीचे लगभग दब जाते हैं

पोस्ट ID से सामने आया reverse-insertion pattern

  • PhysicsForums के posts और threads के sequential numeric IDs हैं
    • सामान्यतः बड़े post ID का writing time बाद का होना चाहिए
    • deletion, restoration, thread split, database issues जैसे exceptions हो सकते हैं, लेकिन overall flow monotonically increasing होना चाहिए
  • randomly collected 30,000 posts में अधिकांश periods में यह rule बना रहा
  • एक बड़ा exception 2022 में MathHelpBoards के साथ merger था
    • करीब 150,000 posts का archive original dates बनाए रखते हुए integrate किया गया
  • MathHelpBoards merger और वास्तविक writing time के करीब लगने वाले cases हटाने पर, लगभग 115,000 posts LLM द्वारा लिखकर human accounts से जोड़ी गई मानी गईं
  • प्रभावित users representative sample के आधार पर कम से कम 110 हैं
    • शुरुआती commenters, one-time posters, long-time readers, और founder/admin Greg Bernhardt तक शामिल हैं
    • हर account से ऐसे viewpoints जुड़ गए जिनके लिए असली user की consent थी या नहीं, यह पता नहीं

LLM-जनित FAQ और summaries से बनी quality problem

  • HP 50g Graphing Calculator पर 2007 के thread में LLM-जनित दिखने वाला answer और FAQ original information की value नहीं बढ़ाते
  • उस thread में LLM-written answer सिर्फ “HP 50g Connectivity Kit” के अस्तित्व का एक fact सही बताता है, बाकी बातें HP 50g manual या अन्य वास्तविक sources में reflected नहीं हैं
  • FAQ “GET” और “PUT” functions का ज़िक्र करता है, लेकिन ये functions और “HP 50g Spreadsheet” manual में नहीं आते और search results भी उस thread के अलावा नहीं मिलते
  • उस thread की word count में LLM-written portion 92% है
    • Summary: 99 words, human नहीं
    • Springo: 38 words, human
    • Phys.org: 34 words, human नहीं
    • Shinny_head: 11 words, human
    • Ravenprp: 164 words, human नहीं
    • FAQ: 260 words, human नहीं
  • पूरी साइट के स्तर पर reverse-inserted LLM posts कुल posts का लगभग 1.6%, और कुल words का लगभग 3% मानी गईं
  • LLM FAQs और summaries शामिल करने पर PhysicsForums के कुल words में humans द्वारा लिखा हिस्सा 66% निकला

community द्वारा पकड़ा गया AI-written content और छिपे बदलाव

  • PhysicsForums users ने नवंबर 2024 में अजीब घटना देखी कि Azntoon account ने 2012 के last login के बाद 2022 के thread में post किया हो
    • उस समय discussion का निष्कर्ष database issue की संभावना के रूप में निकला
    • बाद में Azntoon की last login date दिसंबर 2022 में बदल गई
  • Forum users ने 2022 से ChatGPT-generated answers पर policies पर चर्चा की
    • Vanadium 50 ने शिकायत की कि ChatGPT की “barely-lucid posts” बहुत काम पैदा करती हैं और इसे DoS attack जैसा देखा जा सकता है
    • Greg Bernhardt ने कहा कि Stack Overflow शायद ban की कोशिश कर रहा है, और PhysicsForums को भी कम से कम ChatGPT content को quote के रूप में treat करना चाहिए
  • 1 अप्रैल 2023 को April Fool’s event के रूप में display names ChatGPT में बदल दिए गए, लेकिन इसे इस तरह नहीं माना गया कि posts सचमुच ChatGPT ने लिखे हैं
  • LLM-प्रभावित users search autocomplete से छिपा दिए गए, और posts के profile links भी हटा दिए गए
    • profile क्लिक करके last login date जैसी असामान्य चीज़ें verify करना अब और मुश्किल हो गया है
  • लिखे जाने के दौरान FAQ problem भी community ने पकड़ी, और low-quality FAQ discussion खुली
    • लगता है FAQ logged-in users को दिखाई नहीं देता था
    • FAQ हटा दिया गया, लेकिन closed threads के ऊपर LLM-generated summaries बची हुई हैं

Greg Bernhardt का जवाब और test explanation

  • Greg Bernhardt ने PhysicsForums के LLM usage पर सवाल के जवाब में कहा कि community value बढ़ाने के लिए कई AI tests चल रहे हैं
  • 2024 feedback form में कई members ने कहा कि वे AI features नहीं चाहते, और उन्होंने जवाब दिया कि features को काफी improve या remove किया जाएगा
  • उन्होंने बताया कि पिछले साल test accounts से AI answers का experiment किया गया था, लेकिन वे quality standards पर खरे नहीं उतरे
  • follow-up question पर उन्होंने कहा कि वे ऐसे bot की कल्पना कर रहे थे जो 1 साल से ज़्यादा unanswered threads पर high-quality answers दे, लेकिन वह failed रहा
  • उन्होंने कहा कि unanswered threads forum को clutter करते हैं, इसलिए उन सभी को clean up करने का option भी consider किया जा रहा है

account identity और archive integrity

  • मौजूदा user accounts में LLM-generated posts भरने का तरीका online communities में यह expectation हिला देता है कि account identity user की होती है
  • account अपेक्षाकृत anonymous हो, तब भी उस नाम से user ने जो लिखा और जो समय लगाया, वह real identity से जुड़ता है
  • humans से मुख्यतः interaction करने वाला social contract टूटे तो online community द्वारा दी जाने वाली human interaction की value घट जाती है
  • पुराने web content को already गायब servers और बंद sites के कारण खोजना मुश्किल है, और इसमें past-dated AI-generated data मिल जाए तो internet archive investigation और कठिन हो जाती है
  • forum operations पर server costs, database maintenance, bots, DDoS, advertising और click competition जैसे pressures होते हैं, लेकिन survival के लिए community की core identity और user trust को नुकसान पहुंचाने पर site की नींव कमजोर हो जाती है

1 टिप्पणियां

 
GN⁺ 2025-01-26
Hacker News की राय
  • LLM-जनित कंटेंट के बारे में मुझे सबसे ज़्यादा जो बात महसूस होती जा रही है, वह यह है कि इसे कोई नहीं चाहता
    अगर AI से बात करनी हो तो सीधे AI से बात की जा सकती है। ब्लॉग या चर्चा फ़ोरम पढ़ने का कारण यह है कि वहाँ इंसानों द्वारा लिखा हुआ पढ़ना होता है, न कि किसी इंसानी नाम के नीचे चिपकाया गया कॉपी-पेस्ट LLM बकवास पढ़ना
    आजकल वेब पर LLM कंटेंट से बचने में मैं काफ़ी समय और ऊर्जा खर्च करता हूँ। कोई लेख पढ़ते-पढ़ते अगर “As we dive into the ever-evolving realm of...” जैसी ChatGPT-शैली दिख जाए तो मैं तुरंत वापस चला जाता हूँ, और image search में -AI, -Midjourney, -StableDiffusion जैसे exclusion filters भर देता हूँ। कुछ searches को तो 2022 से पहले तक सीमित कर देता हूँ
    अगर Google एक ठीक से काम करने वाला “generated content हटाओ” global filter जोड़ दे, तो मैं उसे चालू करके फिर कभी बंद नहीं करूँगा। इस पर research भी थी कि users, quality चाहे जैसी भी हो, AI से बने लगने वाले कंटेंट को तुरंत नापसंद करते हैं, और इसलिए publishers के पास AI-लिखे टेक्स्ट को इंसानों द्वारा लिखा हुआ दिखाने के लिए human laundering करने की incentive बनती है। timestamps में हेरफेर करना और पुराने accounts पर कब्ज़ा करना मैंने पहली बार देखा है

    • पूरी तरह सहमत। अभी तक कम से कम social media पर ऐसे posts को voting से नीचे जाते देखा है, यह राहत की बात है, लेकिन यह देखकर हैरानी होती है कि कुछ लोग ChatGPT के जवाबों को copy-paste करना productive मानते हैं
      Reddit पर “मुझे ठीक से नहीं पता, लेकिन ChatGPT यह कहता है” जैसे posts भी दिखते हैं, और उससे भी बुरा तब होता है जब लोग ChatGPT का copy-paste अपने लिखे की तरह पोस्ट कर देते हैं। मज़ेदार बात यह है कि उसकी शैली HR वाले व्यक्ति की लिखावट जैसी लगती है, इसलिए तुरंत पहचान में आ जाती है
    • “LLM output को service की तरह पेश करने” वाले मॉडल की समस्या यह है कि, मेरी feed को भर देने वाली ChatGPT-स्टाइल listicles के सबसे अच्छे मामले में भी, अगर मुझे LLM का नतीजा चाहिए होता तो मैं खुद सीधे LLM से पूछ लेता
      अगर किसी के पास अच्छे model की access नहीं है तो उसमें थोड़ी-बहुत value हो सकती है, लेकिन एक सवाल का ढंग से जवाब देने की कोशिश में दस पैराग्राफ़ का static page बना देना ऐसा format है जिसे कोई पसंद नहीं करता। असली chatbot interface जानकारी को मेरे हिसाब से पेश कर सकता है, लेकिन listicle-जैसी बकवास सिर्फ़ सबसे बड़े पाठक-वर्ग के लिए बनाया गया lowest common denominator है
      एक और समस्या यह है कि जानकारी को दोबारा शब्दों में कह देने से कोई नई जानकारी पैदा नहीं होती। जब मुझे कार में डालने वाले oil का प्रकार या blueberry muffin recipe चाहिए होती है, तब मुझे वास्तविक आधार चाहिए—जैसे क्या manufacturer ने किसी खास grade का oil सुझाया है, या किसी ने सच में उसे bake करके नतीजे की पुष्टि की है। दूसरे स्रोतों के टेक्स्ट को बस जुगाली करके दोहराना आम तौर पर मेरी ज़िंदगी में कुछ नहीं जोड़ता
    • ChatGPT 3 के आने के आसपास का समय याद आ गया, जब Hacker News की comments में “इस विषय पर ChatGPT यह कहता है” जैसे posts भरे पड़े थे
    • मैं भी ऐसा ही हूँ, और मुझे LLM खुद में पसंद हैं। उनसे बातचीत करना और लिखना मज़ेदार और दिलचस्प है, लेकिन उनकी reliability कम है, यह सब जानते हैं
      अगर कोई लेख LLM-जनित लगता है, तो मैं उसे इस संकेत की तरह लेता हूँ कि लेखक को मुझसे ज़्यादा नहीं पता, और मेरे पास यह मानने का कोई तरीका नहीं होता कि वह जानकारी सही है
    • इसकी अच्छी तुलना दुकान के salesperson से की जा सकती है। कोई भी salesperson से बात नहीं करना चाहता। अनजान ग्राहक भी आम तौर पर दुकान के products के बारे में salesperson से ज़्यादा जानते हैं, इसलिए salesperson शायद ही कोई मदद कर पाता है
      बहुत-से ग्राहक salespeople को नापसंद करते हैं, और कुछ तो उनके कारण दुकान छोड़ देते हैं या अंदर ही नहीं जाते, जिससे दुकानों की बिक्री घटती है। फिर भी यह प्रथा चलती रही है। AI को भी सबसे बुरे के लिए तैयार रहना चाहिए। न ethics, न business judgment, न rationality—इनमें से कोई भी चीज़ कंपनियों को AI ठूँसने से नहीं रोकेगी। लगता है वे ग्राहकों को परेशान करना ज़्यादा महत्वपूर्ण मानती हैं
  • 2010 के दशक की शुरुआत के आसपास Google ने पारंपरिक forum पोस्ट और blog लेखों को, उनकी quality कैसी भी हो, अगर वे “बड़ी” sites पर नहीं थे तो धीरे-धीरे search results में ऊपर लाना बंद करना शुरू किया था — यह बात मेरे अपने blog के अनुभव से भी मेल खाती है
    दूसरी ओर, 2003 से 2025 तक URL बदले बिना, पुराने लेख हटाए बिना, और site के गायब हुए बिना बने रहना वाकई प्रभावशाली है। मेरे blog के 2008 के bookmark भी अभी तक काम करते हैं
    CMS अब हट चुका है और सब कुछ static site बन गया है, लेकिन अपनी web presence को “refresh” करते समय इतनी बुनियादी सफाई भी न करने वाले संगठन बहुत ज़्यादा हैं

  • PhysicsForums के साथ ऐसा होना दुखद है। 15 साल पहले physics के प्रति अपने जुनून के दौर में, और बाद में जब मैंने अपना career शुरू किया, यह उन पहली websites में से एक थी जिनका मैं अक्सर इस्तेमाल करता था
    मैं ज़्यादातर पढ़ता था और कभी-कभी योगदान भी देता था, और मुझे अब भी वे सदस्य याद हैं जिनके बारे में मैं सोचता था कि एक दिन मैं भी उनकी तरह इतना smart और knowledgeable बनूँगा। Arab Spring के बाद social media की ओर बढ़ते रुझान के बीच, जब forums चर्चा का केंद्र हुआ करते थे, उस दौर के खत्म होने के साथ माहौल बदलना शुरू हो गया
    2018 के आसपास से मैं वहाँ तभी जाता था जब Google, और बाद में Kagi search से पहुँचता था, लेकिन archive अब भी सवालों के जवाब देने में उपयोगी है। इस दावे से सहमत होना मुश्किल है कि Twitter पर link share न होने का मतलब है कि किसी को परवाह नहीं

  • यह लेख अपने मुख्य बिंदु को बहुत दबाकर रखता है। कहानी के लगभग आखिर में site owner पुष्टि करता है कि backdated AI comments उसने खुद जोड़े थे। शायद यह साफ़ ही रहा हो

    • इस खास website पर जो हुआ उसकी जाँच करना, internet content, identity, और LLM पर कहीं अधिक व्यापक तर्क दिखाने के लिए एक tool जैसा लगता है
    • मुझे नहीं मिला। क्या वे site को सक्रिय दिखाने के लिए seed posts डालने की कोशिश कर रहे थे?
  • जब ऑनलाइन कम्युनिटी में अकाउंट बनाया जाता है, तो आम तौर पर यह एक सामाजिक अनुबंध होता है कि हम इंसानों के साथ interact करेंगे। प्रमोशनल अकाउंट, bots और advertisers हो सकते हैं, लेकिन users और community provider के बीच समझ यह होती है कि provider हमें ऐसी चीज़ों से बचाने की कोशिश करेगा, और हम भागीदारी व content देंगे
    इसलिए Meta का AI-generated user experiment हास्यास्पद और घिनौना है। अगर आप किसी ऐसी चीज़ के साथ interact कर सकते हैं जो इंसान होने का नाटक करती है, और उसका नतीजा ज़्यादा से ज़्यादा फीका कचरा हो, तो इंटरनेट के ज़रिये होने वाले मानवीय interaction की कीमत खत्म हो जाती है
    यह एक आपदा है। ऐसा कोई भविष्य दिख नहीं रहा जिसमें AI से बना बेकार लेखन आखिरकार इंटरनेट के हर हिस्से पर हावी होकर उसे अनुपयोगी न बना दे। user-generated content का युग शायद खत्म हो चुका है

    • इसका एक समाधान है। उनमें से एक है socialized trust system। Nostr पर मुझे पता है कि मैं जिस Lyn Alden को follow करता हूँ वह सच में वही है, सिर्फ इसलिए नहीं कि वह खुद ऐसा कहती हैं, बल्कि इसलिए भी कि बहुत से दूसरे लोग भी उन्हें follow करते हैं
      impersonation bot accounts भी हैं, लेकिन follower count देखकर उन्हें आसानी से block किया जा सकता है। एक बार Lyn की public key पता चल जाए, तो उसके नीचे आने वाली posts को मैं भरोसे से उनका मान सकता हूँ
      वह LLM बकवास पोस्ट कर सकती हैं, लेकिन लोग जल्दी समझ जाएंगे और unfollow कर देंगे। अहम बात यह है कि मेरी feed में क्या दिखेगा यह तय करने वाला कोई algorithm नहीं है, जब तक मैं खुद न चाहूँ, इसलिए random LLM content के मेरी feed में घुस आने की संभावना कम है
      दूसरा विकल्प है zero-knowledge identity proof जो privacy उजागर किए बिना यह साबित करे कि आप इंसान हैं, या फिर ऐसे तरीके पर निर्भर न हो जिसमें कोई central server आपकी तरफ से login करे: https://zksync.mirror.xyz/kWRhD81C7il4YWGrkDplfhIZcmViisRe3l...
    • कम से कम खुला और सार्वजनिक open user-generated content शायद खत्म होने वाला है
      सुना है कुछ Discord servers ऐसे हैं जहाँ जब तक आप admin से सीधे न मिले हों, या group में कोई आपका भरोसा न दिलाए, या video call पर “verification” न कर लें, तब तक आपको सभी channels का access नहीं मिलता
      यही भविष्य है। Discord जैसी संरचना में web page जैसी mechanism भी चाहिए, यानी ऐसी जगह जहाँ सिर्फ posts ही नहीं बल्कि documents का संग्रह भी रखा जा सके, और जिसे browser से access किया जा सके
      लेकिन discovery के तरीके पर निर्भर करते हुए, यह नया “इंटरनेट” अब किसी खास reality या जगह से आसानी से निकल भागने का साधन नहीं रहेगा। 90s और 00s के इंटरनेट उपयोग की बड़ी प्रेरणा स्थानीय community में न मिलने वाली नई चीज़ों को खोजने की जिज्ञासा थी, और उस समय का भरोसेमंद Google उसका मुख्य इंजन था
      बहुत असामाजिक लोगों के लिए यह अच्छा बदलाव नहीं है, लेकिन ऐसे लोग AI से भरे माहौल में उल्टा और फल-फूल सकते हैं। अगर इस संभावित नए group-to-group human internet के gate hubs खुले lobbies बनाए रखें, तो शायद दोनों तरफ के फायदे मिल सकते हैं
    • invite-only forums या किसी न किसी तरह का real identity verification करने वाले forums ही जवाब हो सकते हैं। Google और Facebook दूसरी websites को असली online identity services देने के लिए अच्छी स्थिति में हैं, इसलिए यह और भी मज़ेदार है कि Facebook खुद ही bots बना रहा है
      आखिरकार बात बैंक या सरकार द्वारा जारी online identity authentication तक पहुँच सकती है
    • विडंबना यह है कि Facebook पर दोस्त वही होते हैं जिन्हें आप सचमुच जानते हैं, इसलिए feed में दिखने वाली ज़्यादातर चीज़ें वही होती हैं जो उन लोगों ने पोस्ट की हैं
    • ईमानदार अंत शायद यह होगा कि जो platforms AI content को अनुमति देते हैं या बढ़ावा देते हैं, वे video games जैसे दिखने लगेंगे। अगर स्कूल में हर कोई AI media celebrity है, तो फिर कोई भी celebrity नहीं है
      तुरंत influencer celebrity बनने वाले game के लिए निश्चित ही बाज़ार होगा, लेकिन वह social media market की तुलना में बहुत छोटा होगा
  • मुझे “backdating” या account hijacking वाली समस्या ठीक से समझ नहीं आई। यह ठीक-ठीक किया कैसे गया? लेख पढ़ने के बाद भी लगा कि शायद मैं कुछ मिस कर गया

    • आखिरी section में PhysicsForums admin कहता है कि वे LLM-generated responses का experiment कर रहे हैं, इसलिए लगता है कि site owner ही इसके लिए जिम्मेदार है
      Greg Bernhardt के जवाब के मुताबिक community में value जोड़ने के लिए कई AI tests चल रहे हैं, और बहुत से members AI features नहीं चाहते। पिछले साल test accounts से AI responses का प्रयोग किया गया था, लेकिन वे quality standards पर खरे नहीं उतरे, और अगर किसी छूटे हुए test account का पता चले तो बताने को कहा गया था
      पुराने human accounts को AI “test accounts” के रूप में दोबारा क्यों इस्तेमाल किया गया, यह मुझे बिल्कुल समझ नहीं आता
    • शायद यह site owner का किया हुआ है। चाहे नई management हो, या पुरानी team ही हताश या लालची हो गई हो
    • जो व्यक्ति site या database चलाता है, वह बस मौजूदा, शायद छोड़े जा चुके account names के नीचे fake dates वाली rows insert कर देता है
    • मेरा भी यही सवाल था। लेख को अंत तक पढ़ना मुश्किल था। खोज अपने-आप में दिलचस्प थी, लेकिन लेखन अच्छा नहीं था और लेखक की सोच का पीछा करना कठिन था। बीच-बीच में डाले गए quotes खास तौर पर उलझाऊ थे
  • यह मानना मुझे पसंद है कि वे मूल रूप से असली accounts थे
    अगर आप कोई forum या active comments वाला blog चलाते हैं, और users आते हैं, इधर-उधर देखते हैं, लेकिन पूरे हफ्ते कुछ नहीं कहते, तो कैसा लगेगा? शुरुआत में आप अपने नाम से topics बनाते हैं और मददगार replies लिखते हैं, लेकिन आखिर में आप ऐसे लगने लगते हैं जैसे कोई अकेला मूर्ख खुद से ही बात कर रहा हो
    अगर किसी forum पर traffic अच्छा हो और spammy ads बहुत हों, तो नए posts न होने के कारण visitors के चले जाने पर इस तरह का लालच ज़रूर आता होगा
    मैंने पहले एक कुछ ठहरे हुए forum में एक ही IP से मिलते-जुलते नाम वाले दो accounts बनाए थे और खुद ही बहस की थी। शुरू में लगा था कि admin या दूसरे users पकड़ लेंगे, लेकिन जल्द ही समझ आया कि वहाँ इतनी अजीब चीज़ें होती रहती हैं कि ऐसा व्यवहार भी असामान्य नहीं लगता

    • मौजूदा अनुभव की तुलना में, जहाँ भारी संख्या में दूसरे posters spam bots हैं, मैं तो अकेले पोस्ट करना ज़्यादा पसंद करूँगा। मैं पहले ही दो forums में ऐसा झेल चुका हूँ
  • यह विचार — या हक़ीक़त — कि साइट का मालिक लोगों के अकाउंट हड़पकर, शायद ad revenue के लिए, उनके नाम से नकली बकवास लिख सकता है, गुस्सा दिलाने वाला और मन तोड़ देने वाला है
    भरोसे और संबंध/स्वामित्व की समस्या वेब पर हमेशा रही है, लेकिन कई कारणों से अब यह बहुत ज़्यादा बदतर लगती है। कोई बड़ा बदलाव होने के लिए इसे और कितना बिगड़ना पड़ेगा, पता नहीं
    समाधान भी समझ नहीं आता। क्या अपने नाम या handle को trademark के रूप में register करा लें, और पैसे कम होने पर भी मुकदमे की धमकी देते फिरें? क्या सबको public-key infrastructure के आधार पर अपनी पोस्ट पर private key से sign करना चाहिए, और impersonation जाँचने के लिए CPU खर्च करके signatures verify करने चाहिए? क्या किसी साझा लेकिन अनकही सामुदायिक अपेक्षा को पकड़कर, दुनिया भर की बिखरी हुई कानूनी व्यवस्थाओं के भीतर उसे औपचारिक रूप देना चाहिए? जैसे उस नाम से सलाह और राय बेचने वाला एक छोटा मगर भरोसेमंद-सा “business” खड़ा कर लिया जाए, और फिर कहा जाए कि नक़ल करने वाले ने brand को नुकसान पहुँचाया है

    • किसी ने जो बात वास्तव में नहीं कही, उसे उसके कहे जैसा दिखाने वाली impersonation को defamation जैसी किसी चीज़ के रूप में माना जाना चाहिए
      और उन जवाबों की लिखने की शैली भी काफ़ी असहज करती है। engineering degree होने पर भी, online हल्के-फुल्के अंदाज़ में जवाब देते समय मैं लगभग कभी “एक engineer के तौर पर” नहीं कहता। क्योंकि ऐसी नैतिक हैसियत से जवाब देना हो तो पर्याप्त analysis करना पड़ता है। लेकिन bots को ऐसी कोई झिझक नहीं दिखती
      ravenprp नाम का व्यक्ति कुछ साल पहले engineering student था। उसने असली नाम से comment नहीं किया था, इसलिए मामला थोड़ा कम गंभीर लग सकता है, लेकिन इस साइट के content की प्रकृति देखते हुए ऐसी स्थिति आसानी से बन सकती है जहाँ किसी असली पेशेवर, किसी विशेष क्षेत्र में काम करने वाले और पेशेवर reputation रखने वाले व्यक्ति की “एक engineer के तौर पर” नकल की जाए
      साइट पर उस व्यक्ति के पढ़ाई के दौरान पूछे और दिए गए जवाबों का ऐतिहासिक रिकॉर्ड तक मौजूद है, इसलिए लोगों को यह यक़ीन दिलाने के लिए बहुत प्रभावी ढंग से गुमराह किया जा सकता है कि कोई वास्तविक engineer सवालों का जवाब दे रहा है। मैं जानता हूँ कि आधुनिक अति-कॉरपोरेट दुनिया में किसी व्यक्ति की professional reputation की धारणा काफ़ी कमजोर पड़ चुकी है, लेकिन जितना ज़्यादा इस बारे में सोचता हूँ, उतना ही यह बेहद घटिया और सचमुच ख़तरे के क़रीब लगता है
    • यह दुखद है। अजीब समस्याओं से बचने के लिए मैं अपने resume के नीचे copyright notice डालता हूँ
      मैं हमेशा सोचता रहा हूँ कि क्या लोग अपनी लिखी चीज़ों पर कोई cryptographic निशान लगा सकते हैं, जिसे कहीं किसी archive से जोड़ा जा सके। पहले मैं ज़्यादातर यह सोचता था कि Yelp की posts हटें नहीं, इसलिए उनका backup हो जाए, लेकिन शायद यह उन चीज़ों को रोकने में भी काम आ सकता है जो किसी ने लिखी ही नहीं
    • क्या हमें ऐसा protocol नहीं बनाना चाहिए जो हमें अपने बनाए content पर खुद नियंत्रण दे, और forums या Facebook जैसी जगहें सिर्फ discovery mechanism और interaction facilitator बनें, न कि हर संचार की स्थायी संरक्षक? सूचना के स्रोत तक स्वतंत्र रूप से पहुँचने की क्षमता लगातार अधिक महत्वपूर्ण होती जा रही है
    • अपने क़रीबी दोस्तों के साथ मैं आमने-सामने मिलकर public keys का आदान-प्रदान करता हूँ। बड़े पैमाने का समाधान बहुत Orwellian होगा। ISP से जुड़ने के लिए smart card के रूप में national ID चाहिए होगी, और शायद biometric authentication भी
    • पोस्ट पर sign मत कीजिए!
  • ShackNews forum https://www.shacknews.com/chatty भी कुछ ऐसा ही था। समय में पीछे जाएँ तो 9/11 के घटित होने की स्थिति पर लिखी posts मिल सकती हैं

    • Ars Technica की शुरुआत इस नए विचार के साथ हुई थी कि communication forums में tech news की reporting भी जोड़ी जाए। forum अब भी हैं, लेकिन शुरुआती camaraderie अब पहले जैसी नहीं रही
  • प्रवाह को देखते हुए लगता है कि अमेरिका और शायद यूरोप के लोग PhysicsForum जैसे हर तरह के specialized forums पसंद करते हैं। इसके उलट, चीन के लोग केंद्रीकृत जगहों को पसंद करते दिखते हैं
    उदाहरण के लिए Zhihu(zhihu.com) Quora की एक copy था, लेकिन अब यह गणित, machine learning, इतिहास, physics, engineering, सामान्य विज्ञान आदि लगभग हर क्षेत्र में गहरी चर्चा खोजने के लिए सबसे बड़ी साइट बन चुका है। अनगिनत researchers, experts और hobbyists वहाँ insights साझा करते हैं
    दूसरी ओर, Quora की quality हर साल गिरती हुई लगती है, और ज़्यादातर विशेषज्ञ तरह-तरह के specialized forums में बिखरे हुए हैं। सोचता हूँ यह फ़र्क क्यों पैदा हुआ