2 पॉइंट द्वारा GN⁺ 3 시간 전 | 1 टिप्पणियां | WhatsApp पर शेयर करें
  • Codeberg e. V. के सदस्यों ने यूज़र·प्रोजेक्ट डेटा को LLM training में इस्तेमाल न करने की नीति और ‘vibe coding’ प्रोजेक्ट्स को सीमित करने वाले Terms of Service बदलाव, दोनों को मंजूरी दी
  • ज़्यादा विवादित दूसरा प्रस्ताव 358 समर्थन, 144 विरोध, 14 तटस्थ मत और लगभग 50% मतदान दर के साथ पारित हुआ, और तुरंत बड़े पैमाने पर deletion के बिना नए नियमों को मामले-दर-मामले स्पष्ट किया जाएगा
  • LLM crawlers issue filters, Git history और duplicate file pages तक खंगालकर database पर लोड डाल रहे हैं, और SSD की कीमत €700 से बढ़कर €3,700 हो गई है, जिससे infrastructure cost और operational burden बढ़ गया है
  • maintainers को कम-गुणवत्ता वाले LLM contributions की review burden, अस्पष्ट human oversight वाले प्रोजेक्ट्स, copyleft code की license laundering, और machine-generated होने को लेकर अविश्वास का सामना करना पड़ रहा है
  • सक्रिय community वाले या LLM से पहले के इतिहास वाले प्रोजेक्ट्स पर लगभग कोई असर नहीं होगा, लेकिन autonomous agents द्वारा बनाए गए या LLM का अत्यधिक उपयोग करने वाले, और team size की तुलना में ज़्यादा repository·CI/CD resources खर्च करने वाले प्रोजेक्ट्स का अब स्वागत न किया जाए

सदस्य मतदान से तय हुई LLM नीति

  • Codeberg e. V. की वार्षिक आम सभा में LLM से जुड़े दो प्रस्तावों पर चर्चा के बाद 14 दिन की asynchronous voting हुई और दोनों पारित हो गए
  • पहले प्रस्ताव के अनुसार Codeberg forge और संबंधित सेवाएं project code या user data को generative AI और LLM के उपयोग या training के लिए इस्तेमाल नहीं करेंगी, और आगे भी नहीं करेंगी
  • यह माना गया कि input की नकल जैसा output बनाने वाली ऐसी तकनीकें free और open source software को जिम्मेदारी से विकसित और maintain करने के साथ आसानी से मेल नहीं खातीं
  • दूसरा प्रस्ताव 358 समर्थन, 144 विरोध और 14 तटस्थ मतों के साथ पारित हुआ, और सक्रिय सदस्यों में से लगभग 50% ने भाग लिया
  • इस प्रस्ताव में Terms of Service बदलकर ‘vibe coding projects’ पर रोक लगाने की बात है, और यह पहले प्रस्ताव की तुलना में अधिक विवादित था

LLM की लागत Codeberg पर कैसे डाली जा रही है

  • बेकार crawling से बढ़ता server load

    • LLM कंपनियों के web crawlers सार्वजनिक code को git clone से लेने के बजाय Codeberg के हर web page को पढ़ने की कोशिश करते हैं
    • जिन चीज़ों तक पहुंचने की कोशिश की जाती है, उनमें ये शामिल हैं
      • कई issue filter combinations
      • पूरा Git history
      • हर point-in-time की असली file pages
      • वे files जिनकी content पहले के किसी point से समान है
    • इस तरह की access महंगे database queries पैदा करती है, पूरी service quality घटाती है और system administrators का काम बढ़ाती है
    • नए features बनाने के बजाय defense mechanisms पर समय लगाना पड़ता है, और limits व blocking नए और पुराने वैध users के workflow को भी प्रभावित करते हैं
  • community के बिना बड़े projects

    • LLM की मदद से कोई अकेला व्यक्ति भी बड़े team की तरह तेज़ी से development कर सकता है, लेकिन वह बस ऊर्जा को code में बदलने वाली सांख्यिकीय मशीन के साथ काम कर रहा होता है; development community अपने-आप नहीं बनती
    • कुछ solo developer projects के लगभग कोई users नहीं होते, फिर भी वे code activity, CI/CD tests, और बड़े व बार-बार जारी होने वाले release binaries बढ़ाते रहते हैं, और असली users से भी अधिक platforms support करते हैं
    • ऐसे projects कभी-कभी उतने ही या उससे भी ज़्यादा resources खा जाते हैं जितने Codeberg के बड़े community projects, जो CI/CD और repositories को किफ़ायत से चलाते हैं
    • Codeberg का मानना है कि donations को बड़े पैमाने पर ghost projects host करने में लगाना उचित नहीं है
  • hardware prices में बढ़ोतरी

    • LLM training और deployment की वजह से SSD और memory खरीदने की लागत बहुत बढ़ गई है; कुछ साल पहले €700 में मिलने वाली drive अब €3,700 तक पहुंच गई है और अक्सर stock में भी नहीं होती
    • अपना hardware होने की वजह से cloud rent बढ़ने का सीधा असर नहीं पड़ता, लेकिन equipment replacement और expansion की लागत बहुत बढ़ गई है
    • महंगा hardware खरीद भी लें, तब भी service improvements और Codeberg के mission पर खर्च किया जा सकने वाला budget उतना ही कम हो जाता है
    • इसका असर code hosting cost और storage limits पर भी पड़ रहा है

digital divide और नागरिक infrastructure पर बोझ

  • hardware prices बढ़ने के बीच सिर्फ सबसे बड़े cloud providers ही स्थिर supply contracts हासिल कर पा रहे हैं, जिससे digital divide और बढ़ रही है
  • web hosting, storage और computing cost में बढ़ोतरी छोटे NGOs, स्थानीय cooperatives, research projects और दूसरे digital tool users पर बोझ बन रही है
  • computers और smartphones की कीमतें भी प्रभावित हो रही हैं, जिससे personal computing फिर से luxury बन सकती है, जबकि आज सामाजिक भागीदारी के लिए digital tools लगभग अनिवार्य हैं
  • कम computing और storage capacity वाले devices users की स्वायत्तता कम करते हैं, और उन्हें cloud providers की उस cost structure की ओर धकेलते हैं जहां कमी वाली सुविधाएं फिर से बेची जाती हैं
  • LLM training data centers की energy और water demand के कारण कुछ इलाकों में बिजली और पीने के पानी की लागत बढ़ रही है, और पास के निवासी सीधे air और noise pollution के संपर्क में आ रहे हैं
  • कंपनियां data centers को बिजली देने के लिए environmental regulation exemptions मांग रही हैं, और Frankfurt में data centers पहले ही स्थानीय बिजली का 40% इस्तेमाल कर रहे हैं, जबकि मांग लगातार बढ़ रही है
  • इस बढ़ती बिजली मांग को पूरा करने के लिए fossil fuels का उपयोग करने की कोशिश की जा रही है

FLOSS collaboration और trust की कमजोरी

  • reusable software से disposable code तक

    • FLOSS ecosystem मुक्त sharing और आपसी सीख पर आधारित एक सामाजिक phenomenon है, जिसमें छोटे tools भी दोबारा इस्तेमाल होते हैं और उन्हीं के इर्द-गिर्द collaboration शुरू होती है
    • LLM आने पर मौजूदा tools को मिलकर बेहतर बनाने के बजाय ज़रूरत के हिसाब से disposable software शुरू से बनाने की प्रवृत्ति बढ़ती है
    • shared code की मात्रा बढ़ सकती है, लेकिन उसमें बहुत-सा code ऐसा होता है जिसे इंसानों ने सीधे नहीं लिखा और जिसे कोई maintain भी नहीं कर रहा
  • maintainers पर बोझ और license laundering

    • भले ही good faith में भेजा गया हो, कम मेहनत से बना LLM contribution review में काफी समय लेता है और maintainers का बोझ बढ़ाता है
    • skilled developers द्वारा maintained projects और बिना सार्थक human oversight के LLM से बने projects में फर्क करना कठिन होता जा रहा है
    • copyleft projects में training data से code को ‘generate’ करके reciprocity obligations हटाने वाली license laundering होती है
  • machine-generated होने को लेकर अविश्वास

    • ऐसे मामले बढ़ रहे हैं जहां वास्तव में समस्या का विश्लेषण करने या सुझाव लिखने वाले लोगों पर भी LLM इस्तेमाल करने का शक किया जाता है
    • दूसरी ओर, कुछ users LLM को generation traces और सामान्य patterns छिपाने के लिए निर्देश देते हैं
    • contributions और communication की review करने वालों को machine-generated संकेतों पर अधिक ध्यान देना पड़ता है, और सदस्यों के बीच trust कमज़ोर पड़ता है

collaboration cost से बनता दुष्चक्र

  • collaboration की transaction cost बढ़ने पर high-quality projects में योगदान की संभावना घटती है, और सिर्फ व्यक्तिगत ज़रूरतों के लिए disposable software को vibe coding से बनाने की संभावना बढ़ती है
  • नतीजतन collaboration का reward घटता है, जबकि बिना maintained या improved हुए disposable software बढ़ता जाता है, और एक दुष्चक्र बनता है
  • सिर्फ prompt output share करके उसे “free software” कह देने से लोगों के बीच collaboration नहीं बनती
  • Codeberg खुद को ऐसा स्थान मानता है जहां लोग मिलकर software बेहतर बनाते हैं, न कि ऐसी जगह जहां कोई फिर कभी न देखे जाने वाले generative disposable software को फेंक दिया जाए
  • इसी वजह से वह LLM creation को सक्रिय रूप से support या उसमें भाग नहीं लेना चाहता, और सीमित resources को FLOSS commons को प्रदूषित करने वाले disposable software को store करने में इस्तेमाल नहीं करेगा

नए Terms of Service का दायरा

  • Terms of Service में बदलाव यह स्पष्ट करता है कि Codeberg किस तरह के projects को support करना चाहता है, लेकिन आने वाले कुछ दिनों में वह बड़े पैमाने पर content delete नहीं करेगा
  • संचालन टीम प्रभावित repositories की पूरी सूची अपने-आप बनाकर हटाने के बजाय, वास्तविक मामलों के आधार पर नए नियमों को स्पष्ट करेगी
  • developers द्वारा LLM के उपयोग की मात्रा लगभग पूरा coding काम सौंप देने से लेकर सिर्फ कुछ tasks तक सीमित रखने तक अलग-अलग हो सकती है, इसलिए सभी projects पर लागू एक ही जवाब नहीं है
  • content को अपने-आप खोजने में बहुत समय और resources खर्च करने की योजना नहीं है
  • जिन projects पर असर पड़ने की संभावना कम है

    • निम्न प्रकार के projects पर लगभग कोई असर नहीं पड़ेगा
      • सक्रिय community वाले projects जो software को manage और maintain करती है
      • वे projects जिनका पर्याप्त history LLM के आने से पहले का है
      • वे projects जो खुद LLM का अत्यधिक उपयोग नहीं करते, और जिनके maintainers अन्य contributors के LLM-generated contributions को जाने-अनजाने स्वीकार कर चुके हों
  • जिन projects को व्यवहार में अनुमति मिलने की संभावना अधिक है

    • निम्न प्रकार के projects private repositories की तरह recommended नहीं हैं, लेकिन resource use कम होने और automatic search न होने के कारण व्यवहार में संभवतः अनुमति पा सकते हैं
      • side projects और experiments जो लगभग कोई resources नहीं लेते
      • ऐसे खास tools और custom scripts जिनमें, चाहे वे LLM-generated हों या नहीं, community बनना कठिन है
  • जिन projects का अब स्वागत न किया जाए

    • निम्न प्रकार के projects को तुरंत migrate करने की जरूरत नहीं है, लेकिन Codeberg की तुलना में कोई दूसरा hosting स्थान उनके लिए अधिक उपयुक्त हो सकता है
      • autonomously generated projects जिन्हें LLM agents ने बनाया हो
      • ऐसे projects जिन्हें LLM का अत्यधिक उपयोग करके लिखा और maintain किया जाता हो
      • ऐसे projects जिनका repository या CI/CD resource use भाग लेने वाले लोगों की हाथ से बनाने की क्षमता की तुलना में स्पष्ट रूप से बहुत बड़ा हो
      • LLM writing tools जैसे projects जो LLM ecosystem से गहराई से जुड़े हों और LLM उपयोग को आसान बनाते हों
      • ऐसे users जो project-specific policies का उल्लंघन करते हुए LLM contributions भेजते हों
    • सटीक wording Codeberg Terms of Service change commit में देखी जा सकती है

1 टिप्पणियां

 
GN⁺ 3 시간 전
Lobste.rs टिप्पणियाँ
  • मैं AI का बेहद आलोचक हूँ, लेकिन यह नीति व्यवहार में कैसे काम करेगी, समझ नहीं आ रहा। असल में रुख यह है कि “कम-गुणवत्ता वाली generated चीज़ें प्रतिबंधित हैं, लेकिन हर LLM उपयोग पर निगरानी रखना बेतुका है”, पर अगर लागू किए जा सकने वाले स्पष्ट नियम नहीं हैं, तो अंत में यह पसंद-नापसंद के आधार पर की गई कार्रवाई बन सकती है

    • लागू करने से भी ज़्यादा महत्वपूर्ण यह है कि Codeberg ने साफ़ किया है कि वह किन मूल्यों और किस समुदाय की ओर बढ़ना चाहता है। vibe coding प्रोजेक्ट भी नियमों को चकमा देकर समुदाय के सदस्य होने का दिखावा कर सकते हैं, लेकिन शायद अपने मूल्यों से मेल खाने वाला समुदाय ढूँढना बेहतर होगा
    • Lobsters के दिशानिर्देश भी सीमाएँ धुंधली रखते हैं, कई उल्लंघन छूट जाते हैं, और admins पर पक्षपात तथा favoritism के आरोप अक्सर लगते हैं। फिर भी जैसे वे दिशानिर्देश अपेक्षा का स्तर तय करते हैं और सबसे बुरे उल्लंघनकर्ताओं पर कार्रवाई करके साइट को काफी बेहतर बनाते हैं, वैसे ही लगता है Codeberg भी वही असर चाहता है
    • यह कुछ वैसा लगता है जैसे कोई fair use policy हो, जिसे तब आधार के तौर पर दिखाया जा सके जब कोई project संसाधनों का अत्यधिक उपयोग करता मिले
    • ब्लॉग पोस्ट के अंत में ठोस उदाहरण दिए गए थे, और लगता है उसका मतलब यही है कि उस तरह के projects आगे स्वीकार नहीं किए जाएंगे
  • ब्लॉग पोस्ट और Codeberg की Terms of Service में वास्तव में जो पंक्ति जोड़ी गई है, उनके बीच की दूरी चिंताजनक है। ब्लॉग LLM की सामाजिक लागत और सहयोग में बाधा पर बात करता है, और खासकर यह हिस्सा काफ़ी प्रभावशाली था कि एकबारगी generated software FLOSS commons को प्रदूषित करता है, इसलिए संसाधन मानव-केंद्रित सहयोग पर केंद्रित किए जाएंगे
    लेकिन अंत में दिया गया terms change link उन projects पर प्रतिबंध लगाता है जिनका ज़्यादातर code generative AI ने लिखा हो, क्योंकि copyright की अस्पष्टता और हानिकारक code के जोखिम हैं। ब्लॉग में “copyright” या “harm” का ज़िक्र ही नहीं है, और खासकर यह दावा कि LLM-generated code ज़्यादा हानिकारक होता है, अपने-आप में स्पष्ट नहीं है
    Terms की भाषा में “Such projects having” जैसी व्याकरण त्रुटि, अनावश्यक hyphen, और “OpenAI Codex” तथा “Claude” के नामकरण में असंगति भी है। ड्राफ्ट के रूप में यह ठीक था, लेकिन 400 से अधिक लोगों के मतदान के बाद भी बिना प्रूफ़रीडिंग के इसे Terms में डाल देना Codeberg के governance को लेकर असहज करता है

    • व्याकरण पर विवाद कम करना हो तो शायद Terms को उनके स्थान के अनुसार जर्मन में लिखना बेहतर हो सकता है। अंग्रेज़ी के विपरीत, जर्मन में कुछ हद तक बाध्यकारी मानक भाषा भी मौजूद है
  • कहा गया है कि “software की परवाह करने और उसका रखरखाव करने वाला सक्रिय समुदाय” प्रभावित नहीं होगा, लेकिन LLM की मदद से development करते हुए भी software की परवाह करना संभव है
    MapLibre ने एक project Codeberg पर शिफ्ट किया था, लेकिन उसके maintainer development में LLM का बहुत उपयोग करते हैं, इसलिए अब repository फिर बंद करनी पड़ेगी। GitHub छोड़ने की गंभीर कोशिश कर रहा project Ghostty भी अब Codeberg नहीं जा सकता
    नियम अस्पष्ट हैं और ब्लॉग के दिशानिर्देश भी विरोधाभासी हैं, इसलिए व्यवहार में इसका असर सभी LLM उपयोग पर प्रतिबंध जैसा होगा। कोई भी open source समुदाय जो LLM उपयोग को लेकर थोड़ा भी उदार है, वह Codeberg से निकाले जाने का जोखिम नहीं उठाएगा

    • चूँकि तर्क यह है कि “developers और users की संख्या की तुलना में LLM-आधारित projects बहुत अधिक संसाधन खर्च करते हैं”, इसलिए यह मानना तर्कसंगत है कि human-centered development से अलग, जब सैकड़ों CI builds बनें या कई GB artifacts भेजे जाएँ, तब निकाला जाएगा
      Codeberg के operators बड़ी IT कंपनियों की automated abuse-prevention systems जैसे नहीं, बल्कि असली लोग हैं। ज़्यादा संभव है कि वे पहले यह बातचीत शुरू करें कि शायद project यहाँ फिट नहीं बैठता, और किसी दूसरी जगह migration की योजना के साथ Codeberg पर सीमित-उद्देश्य वाला एक जानकारी repository भी दें
    • यह सिर्फ Codeberg नहीं, बल्कि MapLibre और Ghostty की भी अपनी पसंद है। अगर Codeberg नीति बदल दे, तो उल्टा बाहरी मूल्यों को Codeberg समुदाय पर थोपना होगा
      मुझे नहीं लगता कि हर नीति को बिना किसी व्याख्या-स्थान के बनाना ज़रूरी है, और न ही यह संभव है। मैं अभी Codeberg पर एक ऐसा fork maintain करता हूँ जिसमें LLM उपयोग निषेध नीति है, लेकिन fork से पहले upstream project ने जो generated code बनाया था, वह उसमें मौजूद है। अभी मैं इसे अनुमति-योग्य मानता हूँ, लेकिन अगर ऐसा नहीं है तो मैं उस फैसले का सम्मान करूँगा और कहीं और चला जाऊँगा
    • सक्रिय समुदाय को सफल project का मानदंड बनाना भी अजीब है। अच्छा software और खराब software दोनों के आसपास समुदाय हो सकते हैं, और core-js जैसी चीज़ें भी हैं जिनकी अहमियत तब सामने आती है जब एक व्यक्ति के रखरखाव के बाद वह गायब हो जाता है
      यह भी अस्पष्ट है कि क्या tzdata के आसपास कोई समुदाय कहा जा सकता है। अगर कोई व्यक्ति दूसरे समुदायों के projects को compile होने में मदद करने वाली utility अकेले maintain कर रहा हो, और उसे ज़्यादातर vibe coding से बनाया हो, तो क्या वह योग्य माना जाएगा, यह भी साफ़ नहीं है। इस तरह के चयन मानदंड अजीब लगते हैं और open source की भावना के खिलाफ़ महसूस होते हैं
  • GitHub पहले से ही कम-गुणवत्ता वाले generated सामान का कूड़ाघर है, इसलिए Codeberg को दूसरा landfill बनाने की ज़रूरत नहीं है

  • मैं 2 साल से Codeberg का paid member हूँ, लेकिन मुझे यह भी नहीं पता था कि यह vote चल रहा है। 1,800 शब्दों वाले email के बीच में सिर्फ “Codeberg’s AI usage statement” की एक पंक्ति थी, और vote होने की सूचना के बावजूद मुझे voting link नहीं मिला
    यह स्पष्ट नहीं है कि सिर्फ मैं छूट गया या कई members को मतदान की सूचना ही नहीं मिली

    • paid signup के समय आपने शायद full member (active member) और supporting member में से एक चुना होगा। full member को proposals पर चर्चा करने वाली annual general meeting का निमंत्रण और हर बदलाव के लिए voting link मिलते हैं, लेकिन supporting member को न निमंत्रण मिलता है न voting rights, और उन्हें संगठन के दस्तावेज़ों के pull requests से जुड़े email भी नहीं मिलते
      चाहें तो आप कभी भी full member में बदल सकते हैं, और https://codeberg.org/Codeberg/org पर संगठन के दस्तावेज़ों के pull requests देखकर संभावित बदलावों को ट्रैक भी कर सकते हैं
    • मेरी जानकारी में signup के समय यह चुनने का विकल्प होता है कि आप सिर्फ support करना चाहते हैं या voting rights वाले full member भी बनना चाहते हैं
  • Codeberg ने यह भी घोषित किया है कि वह क्रिप्टोकरेंसी से जुड़े प्रोजेक्ट्स को ब्लॉक करेगा, और साफ़ कहा कि “Codeberg एक तटस्थ स्थान नहीं है, यह राजनीतिक है”
    मेरा मुख्य काम भले ही क्रिप्टोकरेंसी क्षेत्र में हो, लेकिन कोड बैकअप और open source प्रोजेक्ट की सार्वजनिक पहचान बनने वाली सेवा चुनते समय मैं ऐसी जगह से बचना चाहूँगा जो कल के राजनीतिक माहौल के हिसाब से मेरे क्षेत्र से नफ़रत करके मेरा बैकअप और पहचान मिटा दे। इन्फ्रास्ट्रक्चर की भूमिका तटस्थता बनाए रखने में है

    • वह तर्क समझ में आता है, लेकिन मुझे यह भी अच्छा लगता है कि Codeberg में अपने संचालन पर नैतिक मानदंड लागू करने का साहस है। computing उद्योग में नैतिकता की बहुत ज़्यादा कमी है
      आज का विज्ञापनों से भरा और यूज़र-विरोधी टेक माहौल भी इस वजह से बना है कि संगठनों ने खुलकर अपने मूल्यों की घोषणा नहीं की और उन्हें निभाया नहीं। Google का “don’t be evil” को चुपचाप छोड़ देना, भले ही वह पहले से पतन के बाद हुआ हो, सांस्कृतिक रूप से एक महत्वपूर्ण प्रतीक है
    • यह जानने के बाद मुझे Codeberg और भी पसंद आया
    • Codeberg बैकअप सेवा नहीं है
    • अगर आप क्रिप्टोकरेंसी से पैसा कमाना चाहते हैं, तो किसी non-profit मुफ्त सॉफ़्टवेयर forge के संसाधनों का उपयोग मत कीजिए; अपना hosting खर्च खुद दीजिए। आदर्शवादियों के संसाधनों पर निर्भर रहना ठीक नहीं है
    • हर किसी को रोज़ नैतिक चुनाव करने होते हैं, और सिर्फ़ इसलिए कि दूसरे लोग उस चुनाव से सहमत नहीं हैं, इसे “कल को शायद उन्हें मेरा चेहरा पसंद न आए” जैसा मामला नहीं मानना चाहिए। अगर आपने काल्पनिक मुद्रा की नैतिकता पर पर्याप्त विचार किया है, तो आप समझ पाएँगे कि दूसरे लोग उससे सहमत क्यों नहीं हैं
  • प्रोजेक्ट्स को अपनी मनचाही नीतियाँ तय करने का अधिकार है, लेकिन LLM से कोड बनाने वाले प्रोजेक्ट्स पर रोक लगाना 20 साल बाद उच्च-स्तरीय भाषाओं के इस्तेमाल पर रोक जितना अजीब लग सकता है
    हमने कभी यह कहकर compiler को नहीं ठुकराया कि वे assembler से ज़्यादा ऊर्जा खर्च करते हैं, या optimizing compiler उससे भी ज़्यादा, या यह कि उच्च-स्तरीय भाषाओं से एक व्यक्ति पूरी टीम का काम कर सकता है और इससे साधन-संपन्न लोगों व machine code उपयोगकर्ताओं के बीच डिजिटल खाई बन जाएगी
    एक समय ऐसा भी था जब लोग मानते थे कि garbage collector से manual memory management बेहतर है और bounds checking बहुत धीमी है, लेकिन अगर SourceForge ने Lisp या Haskell प्रोजेक्ट्स को ठुकरा दिया होता तो वह चौंकाने वाला होता। प्रोग्रामर और यूज़र, दोनों की क्षमता को बहुत बढ़ाने वाली तकनीक के प्रति ऐसा नकारात्मक रवैया अजीब है

    • compiler या उच्च-स्तरीय भाषाओं के विकास में मानवाधिकार उल्लंघन के आरोप नहीं थे, और न ही उन्होंने ऐसे उल्लंघनों को संभव बनाया
      compiler ने निवेश बुलबुले के कारण computing उपकरणों की कीमतें नहीं बढ़ाईं, और न ही उन्होंने सूचना सेवाओं को बिना अनुमति बड़े पैमाने पर समेटकर छोटे संगठनों और व्यक्तियों की परिचालन लागत बढ़ाई। LLM industrial complex ब्लॉग में उठाए गए हर आलोचनात्मक बिंदु पर compiler या उच्च-स्तरीय भाषाओं से गुणात्मक रूप से अलग है, इसलिए ज़बरदस्ती की उपमा देने के बजाय उसी समस्या का जवाब देना चाहिए
    • मुझे लगता है कि भविष्य में इसका आकलन asbestos की तरह होगा। asbestos भी कभी जादुई नई सामग्री माना जाता था, लेकिन उसके carcinogenic होने का पता चलने के बाद उसका उपयोग घट गया
    • तथाकथित generative AI पर ज़्यादातर आलोचना तकनीक से ज़्यादा उस उन्माद पर है जिसने पूरे उद्योग को घेर लिया है। जैसे कोई परमाणु विखंडन तकनीक का विरोध न करे, लेकिन परमाणु हथियारों का कड़ा विरोध करे
    • 1950 के दशक में IBM जैसी कंपनियों से mainframe किराये पर लिए जाते थे और बिजली का बिल भी बहुत आता था, इसलिए यह आलोचना वास्तव में मौजूद थी कि compiler कीमती CPU समय बर्बाद करते हैं। उस समय कंप्यूटरों की तुलना में प्रोग्रामर सस्ते थे
      जब मैंने 1980 के दशक के मध्य में कंप्यूटर शुरू किए, तब मुफ्त भाषा सिर्फ़ मशीन के साथ आने वाली BASIC थी; assembler, compiler, linker और application सब पैसे देकर लेने पड़ते थे। मैंने अपना पहला assembler खरीदने के लिए पैसे बचाए, MS-DOS और Amiga के लिए C compiler भी अलग-अलग खरीदे, और 1990 के दशक में जाकर ही generated code “भयानक से थोड़ा बेहतर” स्तर तक पहुँचा
      1970 के दशक में भी कुछ प्रोग्रामर bounds checking बनाए रखने की माँग करते थे, लेकिन management benchmarks पर अटका रहा, इसलिए अब जाकर ऐसी भाषाएँ बढ़ रही हैं जो bounds checking देती हैं। मैं मानता हूँ कि LLM कुछ सॉफ़्टवेयर उपयोगकर्ताओं को implementation में मदद देते हैं, लेकिन उन्होंने सभी प्रोग्रामरों की क्षमता नहीं बढ़ाई, और मेरे लिए तो बिल्कुल नहीं
    • इस पर चर्चा हुई थी कि repository में compiled output से ज़्यादा source code रखना बेहतर है, और autoconf/automake से generated scripts को release tarball में रखा जाए लेकिन repository में नहीं — इस पर मोटे तौर पर सहमति बनी थी
      मैंने अभी तक ऐसा कोई उपयोगी repository नहीं देखा जो सिर्फ़ prompts से बना हो, इसलिए compiler और LLM की तुलना इस बिंदु पर ही कमज़ोर पड़ जाती है
  • हाल ही में Codeberg पर migrate हुए एक यूज़र की दिलचस्प प्रतिक्रिया है: https://マリウス.com/i-regret-migrating-to-codeberg/
    यह ऐसी साइट है जो JavaScript चालू करने पर काफ़ी आक्रामक ढंग से सलाह देती है कि किसी भी साइट को उस हालत में ब्राउज़ न करें

  • दुनिया global village बन गई है, संचार की पहुँच बढ़ने से पूरी सभ्य दुनिया मनोवैज्ञानिक रूप से आदिम जनजातियों जैसी हो गई है, नए धर्म लगातार बन रहे हैं, और secularism ग़ायब हो रहा है
    GitHub की आत्म-क्षतिकारी दिशा से थककर डिजिटल commons का समर्थन करना चाहने वाले लोग Codeberg को व्यापक रूप से अपनाने लगे थे, इसलिए जब Ghostty ने GitHub छोड़ा तब की तरह अब Codeberg छोड़ना पड़े, यह बहुत दुखद है
    ब्लॉग अपेक्षाकृत तर्कसंगत है, लेकिन terms of service में बदलाव की बात अलग है, और वह भी “LLM extrusion पर रोक” जैसे प्रस्ताव नाम से तो बेहतर ही है। LLM-generated सामग्री के बाद अगला निशाना क्रिप्टोकरेंसी है, और यह यहीं रुकेगा ऐसा नहीं लगता; तो फिर चाहें तो The JSON License की यह पंक्ति भी अपना सकते हैं कि “software का उपयोग बुराई नहीं बल्कि भलाई के लिए होना चाहिए”
    Ghostty, Redis, rsync, Linux kernel जैसे और भी FLOSS प्रोजेक्ट अब AI tools का ज़िम्मेदारी से उपयोग कर रहे हैं, और इन्हें GitHub से बाँधे रखना प्रतिगामी है। इस बदलाव से कुछ हासिल नहीं होगा, बल्कि software freedom और digital commons की प्रगति को ही बड़ा नुकसान पहुँचेगा

    • Codeberg, https://docs.codeberg.org/getting-started/what-is-codeberg/… पर दूसरे विकल्पों का सक्रिय रूप से परिचय देता है, इसलिए यह भी स्पष्ट नहीं है कि व्यापक अपनापन ही उसका लक्ष्य है या नहीं
  • Abject प्रोजेक्ट को Codeberg पर ले जाने की कोशिश की थी, लेकिन अब यह संभव नहीं है। 30 साल से कोडिंग कर रहा हूँ और कई open source प्रोजेक्ट चला चुका हूँ, और Abject में LLM का काफी उपयोग होता है तथा आंतरिक coding agent के रूप में प्रोग्राम भी जनरेट किए जाते हैं
    उद्देश्य Ask प्रोटोकॉल का अध्ययन करना है, और सिर्फ programmer या engineer ही नहीं बल्कि आम यूज़र भी SaaS या FLOSS डेवलपर्स की सद्भावना पर निर्भर हुए बिना अपनी व्यक्तिगत समस्याएँ हल करने वाला software बना सकें। मुक्त सॉफ़्टवेयर आंदोलन का मकसद यूज़र के लिए source code को अपने उद्देश्यों के अनुसार संशोधित करने हेतु खुला रखना था, और Abject उस भावना को और आगे बढ़ाता है ताकि यूज़र बिना computer science degree या वर्षों की पढ़ाई के भी खुद software बना सकें
    मैं समझ सकता हूँ कि LLM के लिए data training को रोकना क्यों चाहेंगे, लेकिन अगर सिर्फ LLM से code लिखे जाने के कारण project repository को भी प्रतिबंधित किया जाएगा, तो मुक्त सॉफ़्टवेयर का समर्थक होने के नाते मेरे लिए Codeberg का अब कोई मतलब नहीं रह जाता। Codeberg, FLOSS के मुक्त सॉफ़्टवेयर से अधिक open source software पक्ष के करीब लगता है