1 पॉइंट द्वारा GN⁺ 2024-01-17 | 1 टिप्पणियां | WhatsApp पर शेयर करें
  • शीर्षक Midjourney training data में कलाकार के रूप में सूचीबद्ध किए जाने की समस्या की ओर इशारा करता है, लेकिन इनपुट में शामिल मुख्य पाठ उस विवाद के विवरण से ज़्यादा पाठकों की छोटी प्रतिक्रियाओं जैसा है
  • एक पाठक ने बताया कि उन्होंने Feeling Hard Or Hardly Feeling को 2005-07-17 से अपने hard drive पर सेव करके रखा था, फिर भी उन्हें इसके निर्माता के बारे में पता नहीं था
  • बाद में बनाने वाले को खोजने के बाद उन्होंने “It means something” लिखा, जिससे पता चलता है कि यह काम उनके लिए निजी तौर पर लंबे समय तक मायने रखता रहा
  • एक और प्रतिक्रिया में रचनाकार की उदारता, जायज़ गुस्से और कला के प्रति आभार का ज़िक्र है, और माना गया कि वह कला पहले की दोनों बातों को खूबसूरती से समेटती है
  • दिए गए टेक्स्ट के आधार पर Midjourney training list के मानदंड, इस्तेमाल किए गए कामों का दायरा, या जवाबी कार्रवाइयों जैसी ठोस जानकारी की पुष्टि नहीं की जा सकती

लंबे समय से सेव किया गया काम और देर से हुई खोज

  • एक पाठक ने Feeling Hard Or Hardly Feeling को 2005-07-17 से अपने hard drive पर सेव करके रखा था
  • सेव करते समय उन्हें नहीं पता था कि इसे किसने बनाया है, और समय बीतने के बाद ही उन्होंने निर्माता को खोजा
  • “It means something” वाक्य से पता चलता है कि यह काम उनके लिए निजी तौर पर अर्थपूर्ण बना रहा

मुख्य पाठ में दिखने वाली प्रतिक्रियाओं का दायरा

  • छोटी प्रतिक्रियाओं में रचनाकार की उदारता, जायज़ गुस्सा, और कला के प्रति आभार शामिल है
  • इसमें यह आकलन भी शामिल है कि उस कला ने पहले की दोनों बातों को खूबसूरती से समेटा है
  • Midjourney training में इस्तेमाल किए गए कामों की सूची, कलाकारों को सूचीबद्ध करने का तरीका, और कानूनी·तकनीकी विवरण दिए गए मुख्य पाठ से स्पष्ट नहीं होते

1 टिप्पणियां

 
GN⁺ 2024-01-17
Hacker News की रायें
  • मेरे लिए यही मुख्य मुद्दा है। OpenAI भले ही profit-making company न हो, लेकिन यह साफ तौर पर कीमती company है, और उसकी वैल्यू दूसरों के बनाए content को लेकर बनी है, जबकि उन्हें कोई वैल्यू वापस नहीं दी गई
    कानूनी रूप से जो भी हो, मुझे यह गलत लगता है। अगर OpenAI की training से copyright वाले और बिना अनुमति वाले सारे content हटा दिए जाएँ, तो product की कितनी वैल्यू बचेगी? अगर आपको लगता है कि copyright content इस्तेमाल न कर पाने से OpenAI की वैल्यू घटती है, तो उस वैल्यू का कुछ हिस्सा content वालों को लौटना चाहिए

    • copyright content का इस्तेमाल करना allowed है, लेकिन copyright content की copy बनाना allowed नहीं है। हम उसे देख और consume कर सकते हैं, उससे प्रभावित हो सकते हैं, और कई मामलों में सीधे copy करना भी allowed होता है
      अगर कोई चाहता है कि उसके काम को कोई न देखे, न consume करे, न उससे प्रभावित हो, तो उसे उसे डिब्बे में बंद करके किसी को नहीं दिखाना चाहिए। उन artists से कुछ हद तक सहानुभूति है जो कहते हैं कि AI उनके काम से बहुत मिलती-जुलती images बना रहा है, लेकिन यह सहानुभूति धीरे-धीरे कम हो रही है। output सच में मिलता-जुलता दिख सकता है, लेकिन अगर उस काम की तुलना लाखों अन्य लोगों के काम से करें, तो मौजूदा human works में भी उससे मिलता-जुलता कुछ मिल जाएगा
      इसलिए clothing copyright protection के दायरे में नहीं आती। आपको वह कितना भी original लगे, पिछले हजारों सालों के fashion history में किसी न किसी ने वह पहले ही कर लिया होगा। visual art भी शायद इसी तरह की स्थिति के करीब पहुँच रही है। आपकी painting आपको कितनी भी original लगे, कहीं न कहीं वैसी चीज पहले से मौजूद है, और AI भी images को शब्दशः copy नहीं करता। जैसे इस reality ने fashion industry को नहीं मारा, वैसे ही यह visual art को भी नहीं मारेगी
    • मुझे लगता है OpenAI काफी हद तक एक for-profit company है, जिसमें पैसा कमाने की वही incentives हैं जो दूसरी अमेरिकी for-profit companies में होती हैं। मैं समझता हूँ कि अलग से एक non-profit company है और वही for-profit company को direct करती है, लेकिन यह governance का footnote ज्यादा है; इससे OpenAI non-profit नहीं बन जाती
      website पर भी यह लिखा है: “equity जारी करके capital raise करने और world-class talent को hire करने के लिए एक नई for-profit subsidiary बनाई जाती है, जो अब भी non-profit corporation के direction में रहती है। for-profit business पर काम करने वाले employees नई subsidiary में चले गए।”
      https://openai.com/our-structure
    • यह Instagram जैसे platforms की बात है। वहाँ illustration distribute करने पर implicitly उनकी advertising machine मेरे काम से profit कमाती है
    • मैं इसे अलग तरह से देखता हूँ। अगर किसी artist ने अपना काम online डाल दिया है, तो वह ऐसी स्थिति में है जहाँ हर कोई उसे देख सकता है और उससे प्रेरणा ले सकता है
      जब तक कोई उसे ज्यों-का-त्यों copy नहीं कर रहा, मुझे नहीं लगता कि किसी दूसरे इस्तेमाल से नुकसान हुआ है। कोई दूसरा artist उसे देखकर inspire हो सकता है, और AI का देखकर inspire होना भी मुझे उसी तरह हानिरहित लगता है
    • क्या यही logic search engines पर भी लागू नहीं किया जा सकता? अगर search करने के लिए content ही न हो, तो Google की वैल्यू क्या होगी?
      तो क्या search engines से royalty दिलवानी चाहिए? Google के scale पर यह practical नहीं लगता। क्या Google को बस illegal बना देना चाहिए? वह भी खराब नतीजा होगा। मुझे लगता है search engines का मौजूद होना अच्छा है
      इसलिए मुझे यह logic पसंद नहीं। क्योंकि इसे स्वाभाविक रूप से अंत तक ले जाएँ, तो यह दूसरे projects पर भी वही निष्कर्ष थोपने लगता है
  • इसी विषय पर एक और webcomic: https://www.penny-arcade.com/comic/2024/01/03/terminarter
    अगर operating system ने scrollbar छिपा दिया और आपको पता नहीं चला कि page और लंबा है, तो comic के नीचे का text commentary भी देखें

    • “उस पल की composition जो भी हो, मैं हमेशा ‘conversation’ में पूरी तरह कूदने से हिचकता हूँ। वह markers की smoothie जैसा होता है। ऐसी चीजों को कुछ ppm के level पर भी detect कर पाना चाहिए। क्योंकि एक बार transfer हो जाने पर, बात मूल विषय से हटकर धीरे-धीरे और ऊँची आवाज में catechism और pledge of allegiance पढ़ने जैसी हो जाती है।”
      सच में सही बात जैसी लगती है
    • सोचता हूँ कि Penny Arcade के Gabe को गुस्सा आएगा या नहीं अगर उनकी comic को art classes में अगली पीढ़ी के artists को train करने के लिए इस्तेमाल किया जाए
    • इससे समझ आता है कि Midjourney की drawings इतनी भद्दी क्यों दिखती हैं
  • बात यह नहीं कि इस लेख या Penny Arcade के वाक्यों का जवाब देना मुश्किल है, बल्कि rhetoric के बीच ठोस तर्क समझना मुश्किल है। उनके comment section या social channels पर इस विषय पर चर्चा करना भी सावधानी वाला काम लगता है
    तो किन conditions में AI art acceptable होगी? उदाहरण के लिए, क्या यह सच में मायने रखता है कि ऐसा model किसी बड़ी company ने बनाया है? अगर किसी individual ने वही model बनाया हो, तो कानूनी और ethical रूप से क्या बदलता है, यह मुझे समझ नहीं आता
    क्या यह महत्वपूर्ण है कि training data में उन artists के काम शामिल थे? अगर केवल public domain photos, videos और artworks से train किया गया नया model उतना ही powerful हो तो? अगर future model सिर्फ एक-दो works देखकर भी style imitate कर सके तो? ऐसा model आना शायद सिर्फ समय की बात है। तब क्या वह ठीक होगा? अगर नहीं, तो क्यों?
    व्यक्तिगत रूप से, मेरा मानना है कि AI image बनाने वाले व्यक्ति पर, ठीक वैसे ही जैसे उसने खुद वह image बनाई हो, AI model user के रूप में उसे legal और ethical तरीके से इस्तेमाल करने की जिम्मेदारी है

    • “किन conditions में AI art acceptable है?” इस सवाल पर, यह internet-style rebuttal जैसा सुनाई दे सकता है, लेकिन artists या society पर यह अनिवार्य जिम्मेदारी नहीं है कि culture के भीतर AI art के लिए acceptable जगह जरूर छोड़ी जाए
      ऐसी संभावना हो भी सकती है और नहीं भी। लेकिन अगर मौजूदा AI कई बड़ी companies द्वारा scrape की जा सकी artworks का जटिल मगर आधा literal average जैसा है, तो उसके खिलाफ backlash काफी उचित लगता है
    • मुझे ये सवाल दिलचस्प लगते हैं। खासकर तब, जब user ने sample के रूप में style context दिया हो
      आज भी किसी artist को images दिखाकर कहना कि “ऐसा feel चाहिए, लेकिन ये हिस्से अलग करें” fair use में आता है। किसी screenwriter से Star Wars देखकर वैसा कुछ लिखने को भी कहा जा सकता है
      copyright issue इस पर निर्भर नहीं करता कि copyright वाला work inspiration के रूप में इस्तेमाल हुआ या नहीं, बल्कि इस पर निर्भर करता है कि output पर्याप्त रूप से transformative है या नहीं
    • “किन conditions में AI art acceptable है?” यह सवाल पर्याप्त बार नहीं उठता। इसे acceptable बनाने में समय लगाना एक worthwhile goal है, और बाधा नहीं बल्कि path का हिस्सा है
  • क्रिएटर्स के exclusive content से ट्रेन हुए model से फायदा कमाने वालों के लिए बेहतर है कि वे जल्द ही content cost देना शुरू करें—यह क्रिएटर्स, समाज, और यहां तक कि AI कंपनियों के लिए भी अच्छा होगा
    copyright law AI कंपनियों पर लागू होता है या नहीं, इस पर बहस करना थकाऊ है। लागू होता है। बस एक सही licensing model व्यवस्थित करना होगा

    • a16z ने लिखा था कि “AI model creators पर वास्तविक या संभावित copyright liability की लागत डालने से development खत्म हो जाएगा या बहुत बाधित होगा”
      उन्होंने यह भी कहा कि अगर बड़े language models में पहले से इस्तेमाल की गई सभी copyrighted material के लिए payment करनी पड़े, तो इन्हें बनाने वाली कंपनियों को हर साल “tens of billions से hundreds of billions of dollars” तक royalty देनी होगी
      https://www.businessinsider.com/marc-andreessen-horowitz-ai-...
    • काश “लागू होता है” कह देने से वैसा हो जाता, लेकिन असल में यह आसान नहीं है
      copyright law सिर्फ fixed tangible expression की रक्षा करता है, ideas, concepts, principles आदि की नहीं, और fair use नाम का बड़ा loophole भी है, इसलिए कानूनी दलील सरल नहीं है
    • सही है। ऐसा करने से free alternatives खत्म हो सकते हैं। बड़े rights holders के साथ license करने के लिए जिनके पास पैसा नहीं है, वे कोई अंदर नहीं आ पाएंगे, और Google खुश होगा
      क्रिएटर्स को मामूली पैसे मिलेंगे, सबको proprietary API से होकर गुजरना होगा, और open source को illegal किया जा सकता है। यह वह भविष्य नहीं है जिसे देखना चाहूंगा
    • दरअसल समस्या “model से फायदा कमाने वाला कोई भी” नहीं, बल्कि “model बनाने वाला कोई भी” है
      अगर आप बिना अनुमति के किसी और की art पर model train करके model या output मुफ्त में distribute भी करते हैं, और एक पैसा भी नहीं कमाते, तब भी आप उनका काम चुरा रहे हैं
    • यह बात उल्लेखनीय है कि Adobe Firefly और iStock में पहले से ऐसे generators हैं जो सिर्फ licensed content का उपयोग करते हैं
  • अगर artist का license non-commercial use तक सीमित था, तो उसे commercial AI training में इस्तेमाल करना साफ उल्लंघन नहीं है? सच में जानना चाहता हूं कि क्यों नहीं

    • fair use की वजह से। ऐसे license copyright के जरिए enforce होते हैं, और अगर वह use copyright के दायरे में आता ही नहीं, तो license terms अर्थहीन हैं
    • fair use यह समझाने की दलील है कि license या copyright का उल्लंघन क्यों हुआ। यह इस तथ्य पर निर्भर है कि copy बिना अनुमति की गई थी
    • अगर fair use सच में लागू होता है, तो license की परवाह नहीं होती
    • तो क्या वह non-commercial use condition उस AI के साथ co-created या created works तक भी extend होनी चाहिए?
  • इस विषय पर यह पहली चीज है जिसने इसे भावनात्मक रूप से महसूस कराया, इसलिए लेखक को सलाम
    आज दुनिया बदल रही generative AI तीन समूहों के काम पर बनी है: software developers, Reddit commenters, और digital artists। Reddit commenters ने बहुत पहले अपने rights छोड़ दिए थे और उन्हें परवाह नहीं है। बचे software developers और digital artists
    आम तौर पर software developers को अच्छा compensation मिला, digital artists को नहीं। software developers ने अपना काम modify करने योग्य रूप में public किया, artists ने ऐसा नहीं किया। शायद सबसे बड़ा फर्क यह है कि software developers ने generative AI बनाई। एक अर्थ में यह हमारी अपनी creation है, इसलिए अपने पेशे को खुद खाते हुए महसूस करना और किसी बाहरी अजनबी समूह द्वारा खाए जाते हुए महसूस करना बहुत अलग है
    अगर Washington को जलना ही है, तो उसे Martians के बजाय British जलाएं तो बेहतर है। अगर हमने जो किया वह हमारे अपने हाथों से न हुआ होता, तो हमारी प्रतिक्रिया कैसी होती?

  • ऐसी स्थिति में बुरा लगने की भावना से उबरना बहुत मुश्किल होगा
    गैर-तकनीकी लोगों को technology समझ से परे लगती है, आम लोगों को law समझ से परे लगता है, और ethics सबको समझ से परे लगती है
    इतनी ज्यादा उलझन हो तो class-action lawsuit में शामिल होकर पुराने मामलों को निपटाना ही न्यायपूर्ण व्यवहार महसूस कराने के लिए काफी नहीं हो सकता। उदाहरण के लिए, कंपनियों के खिलाफ मुकदमा करने के इच्छुक लोगों को जोड़ने वाला कोई protocol या site हो तो public trust में मदद मिलेगी। कुछ ऐसा चाहिए जो दिखाए कि समाज equality और justice के मूल्यों का समर्थन करता है

    • मेरे हिसाब से ethics काफी स्पष्ट है
      1. लोगों के साथ वह मत करो जो वे नहीं चाहते
      2. दूसरों के साथ वैसा व्यवहार करो जैसा तुम अपने लिए चाहते हो
        सच में यह इतना ही सरल है
  • एक सरल solution है
    public data पर train किए गए closed large models पर ban लगाएं, और ऐसे models के लिए open weights की requirement रखें। अगर कोई company बड़ा closed model train करना चाहती है, तो अपने data से करे

    • ऐसे proposals ज्यादा नहीं देखे, लेकिन यह सोचने का तरीका मुझे काफी पसंद है। model का artists से सीखना illegal होना चाहिए या artists को model से पैसा निकालने का अधिकार है—यह विचार ज्यादा sense नहीं बनाता। क्योंकि यह humans के सीखने के तरीके से बहुत ज्यादा radical departure है
      लेकिन company का ऐसे model को own कर पाना unfair लगता है। वह company का work product नहीं, बल्कि मूल रूप से पूरी humanity के cultural output का coded expression है। इसे हम सबको own करना चाहिए
    • सरल solution यह है कि एक और AI हो जो check करे कि output copyright का उल्लंघन करता है या नहीं
      यहां समस्या यह है कि model copyrighted works को ज्यों का त्यों generate करता है। यह दावा करने वालों के पास कानूनी तौर पर खड़े होने की जगह नहीं है कि copyrighted works पर train करना ही copyright violation है। वे जानबूझकर concepts को धुंधला कर रहे हैं ताकि ऐसा लगे, और कोई competent judge इसे तुरंत भांप लेगा
    • public data के कुछ हिस्सों पर भी license हो सकता है, इसलिए provenance tracking, attribution, और copyright के मुद्दे फिर भी रहेंगे
      software से तुलना करें तो, public source code के commercial और closed use की अनुमति देने वाला MIT license है। जिस दिशा की कल्पना की जा रही है, उसके करीब copyleft license हो सकता है
    • सच कहूं तो यह शानदार compromise है। थोड़ा ही संबंधित बात है, लेकिन copyright law opt-out model पर हो तो कैसा रहेगा? अगर चाहें तो उसे ignore कर सकें, लेकिन बदले में खुद भी किसी copyright का दावा न कर सकें। मैं शायद participate करूंगा
    • मुझे नहीं लगता इससे बहुत कुछ solve होगा। लोग बस open-source image generators इस्तेमाल करेंगे। artists अब भी वही dilemma झेलेंगे
  • कैमरा आने से पहले, और शायद आज भी कुछ मामलों में, कई चित्रकार ऐसी कंपनियाँ चलाते थे जो मुख्य रूप से प्रसिद्ध कलाकारों की कृतियों की प्रतियां बनाकर बेचती थीं। यानी आप अपने घर में किसी मशहूर पेंटिंग की शानदार प्रतिकृति टांग सकें।
    Midjourney जैसे टूल्स को भी इसी श्रेणी में माना जा सकता है, लेकिन एक अहम फर्क है। अब तक की प्रतिकृति-व्यवस्था आम तौर पर सफल और मशहूर कलाकारों के इर्द-गिर्द घूमती थी। पैसे कमाने के लिए आपको ऐसी चीज़ की नकल करनी होती थी जिसकी लोगों की नज़र में पहले से बहुत कीमत हो, और यह भी बहुत स्पष्ट होता था कि वह एक प्रतिकृति है।
    अब स्थिति बदल गई है। आम तौर पर लगभग अनजान कलाकारों के विशाल काम का आंशिक रूप से पुनरुत्पादन किया जा रहा है, और उसके स्रोत को और धुंधला करते हुए इस्तेमाल किया जा रहा है। इन कलाकारों का यह महसूस करना उचित है कि उनके साथ चोरी हुई है। वे प्रसिद्धि की संपत्ति या मृत्यु के बाद मिलने वाली प्रसिद्धि की सांत्वना के बिना Van Gogh जैसा व्यवहार झेल रहे हैं।

  • मैं Cat and Girl से ज़्यादा परिचित नहीं था, इसलिए यूँ ही कुछ स्ट्रिप्स देख रहा था और यह कॉमिक मिली: https://catandgirl.com/heroes-and-villains/
    कभी-कभी लगता है कि ब्रह्मांड में डार्क ह्यूमर की भावना है।