Midjourney प्रशिक्षण में इस्तेमाल किए गए कामों के कलाकार के रूप में सूचीबद्ध होने पर
(catandgirl.com)- शीर्षक Midjourney training data में कलाकार के रूप में सूचीबद्ध किए जाने की समस्या की ओर इशारा करता है, लेकिन इनपुट में शामिल मुख्य पाठ उस विवाद के विवरण से ज़्यादा पाठकों की छोटी प्रतिक्रियाओं जैसा है
- एक पाठक ने बताया कि उन्होंने Feeling Hard Or Hardly Feeling को 2005-07-17 से अपने hard drive पर सेव करके रखा था, फिर भी उन्हें इसके निर्माता के बारे में पता नहीं था
- बाद में बनाने वाले को खोजने के बाद उन्होंने “It means something” लिखा, जिससे पता चलता है कि यह काम उनके लिए निजी तौर पर लंबे समय तक मायने रखता रहा
- एक और प्रतिक्रिया में रचनाकार की उदारता, जायज़ गुस्से और कला के प्रति आभार का ज़िक्र है, और माना गया कि वह कला पहले की दोनों बातों को खूबसूरती से समेटती है
- दिए गए टेक्स्ट के आधार पर Midjourney training list के मानदंड, इस्तेमाल किए गए कामों का दायरा, या जवाबी कार्रवाइयों जैसी ठोस जानकारी की पुष्टि नहीं की जा सकती
लंबे समय से सेव किया गया काम और देर से हुई खोज
- एक पाठक ने Feeling Hard Or Hardly Feeling को 2005-07-17 से अपने hard drive पर सेव करके रखा था
- सेव करते समय उन्हें नहीं पता था कि इसे किसने बनाया है, और समय बीतने के बाद ही उन्होंने निर्माता को खोजा
- “It means something” वाक्य से पता चलता है कि यह काम उनके लिए निजी तौर पर अर्थपूर्ण बना रहा
मुख्य पाठ में दिखने वाली प्रतिक्रियाओं का दायरा
- छोटी प्रतिक्रियाओं में रचनाकार की उदारता, जायज़ गुस्सा, और कला के प्रति आभार शामिल है
- इसमें यह आकलन भी शामिल है कि उस कला ने पहले की दोनों बातों को खूबसूरती से समेटा है
- Midjourney training में इस्तेमाल किए गए कामों की सूची, कलाकारों को सूचीबद्ध करने का तरीका, और कानूनी·तकनीकी विवरण दिए गए मुख्य पाठ से स्पष्ट नहीं होते
1 टिप्पणियां
Hacker News की रायें
मेरे लिए यही मुख्य मुद्दा है। OpenAI भले ही profit-making company न हो, लेकिन यह साफ तौर पर कीमती company है, और उसकी वैल्यू दूसरों के बनाए content को लेकर बनी है, जबकि उन्हें कोई वैल्यू वापस नहीं दी गई
कानूनी रूप से जो भी हो, मुझे यह गलत लगता है। अगर OpenAI की training से copyright वाले और बिना अनुमति वाले सारे content हटा दिए जाएँ, तो product की कितनी वैल्यू बचेगी? अगर आपको लगता है कि copyright content इस्तेमाल न कर पाने से OpenAI की वैल्यू घटती है, तो उस वैल्यू का कुछ हिस्सा content वालों को लौटना चाहिए
अगर कोई चाहता है कि उसके काम को कोई न देखे, न consume करे, न उससे प्रभावित हो, तो उसे उसे डिब्बे में बंद करके किसी को नहीं दिखाना चाहिए। उन artists से कुछ हद तक सहानुभूति है जो कहते हैं कि AI उनके काम से बहुत मिलती-जुलती images बना रहा है, लेकिन यह सहानुभूति धीरे-धीरे कम हो रही है। output सच में मिलता-जुलता दिख सकता है, लेकिन अगर उस काम की तुलना लाखों अन्य लोगों के काम से करें, तो मौजूदा human works में भी उससे मिलता-जुलता कुछ मिल जाएगा
इसलिए clothing copyright protection के दायरे में नहीं आती। आपको वह कितना भी original लगे, पिछले हजारों सालों के fashion history में किसी न किसी ने वह पहले ही कर लिया होगा। visual art भी शायद इसी तरह की स्थिति के करीब पहुँच रही है। आपकी painting आपको कितनी भी original लगे, कहीं न कहीं वैसी चीज पहले से मौजूद है, और AI भी images को शब्दशः copy नहीं करता। जैसे इस reality ने fashion industry को नहीं मारा, वैसे ही यह visual art को भी नहीं मारेगी
website पर भी यह लिखा है: “equity जारी करके capital raise करने और world-class talent को hire करने के लिए एक नई for-profit subsidiary बनाई जाती है, जो अब भी non-profit corporation के direction में रहती है। for-profit business पर काम करने वाले employees नई subsidiary में चले गए।”
https://openai.com/our-structure
जब तक कोई उसे ज्यों-का-त्यों copy नहीं कर रहा, मुझे नहीं लगता कि किसी दूसरे इस्तेमाल से नुकसान हुआ है। कोई दूसरा artist उसे देखकर inspire हो सकता है, और AI का देखकर inspire होना भी मुझे उसी तरह हानिरहित लगता है
तो क्या search engines से royalty दिलवानी चाहिए? Google के scale पर यह practical नहीं लगता। क्या Google को बस illegal बना देना चाहिए? वह भी खराब नतीजा होगा। मुझे लगता है search engines का मौजूद होना अच्छा है
इसलिए मुझे यह logic पसंद नहीं। क्योंकि इसे स्वाभाविक रूप से अंत तक ले जाएँ, तो यह दूसरे projects पर भी वही निष्कर्ष थोपने लगता है
इसी विषय पर एक और webcomic: https://www.penny-arcade.com/comic/2024/01/03/terminarter
अगर operating system ने scrollbar छिपा दिया और आपको पता नहीं चला कि page और लंबा है, तो comic के नीचे का text commentary भी देखें
सच में सही बात जैसी लगती है
बात यह नहीं कि इस लेख या Penny Arcade के वाक्यों का जवाब देना मुश्किल है, बल्कि rhetoric के बीच ठोस तर्क समझना मुश्किल है। उनके comment section या social channels पर इस विषय पर चर्चा करना भी सावधानी वाला काम लगता है
तो किन conditions में AI art acceptable होगी? उदाहरण के लिए, क्या यह सच में मायने रखता है कि ऐसा model किसी बड़ी company ने बनाया है? अगर किसी individual ने वही model बनाया हो, तो कानूनी और ethical रूप से क्या बदलता है, यह मुझे समझ नहीं आता
क्या यह महत्वपूर्ण है कि training data में उन artists के काम शामिल थे? अगर केवल public domain photos, videos और artworks से train किया गया नया model उतना ही powerful हो तो? अगर future model सिर्फ एक-दो works देखकर भी style imitate कर सके तो? ऐसा model आना शायद सिर्फ समय की बात है। तब क्या वह ठीक होगा? अगर नहीं, तो क्यों?
व्यक्तिगत रूप से, मेरा मानना है कि AI image बनाने वाले व्यक्ति पर, ठीक वैसे ही जैसे उसने खुद वह image बनाई हो, AI model user के रूप में उसे legal और ethical तरीके से इस्तेमाल करने की जिम्मेदारी है
ऐसी संभावना हो भी सकती है और नहीं भी। लेकिन अगर मौजूदा AI कई बड़ी companies द्वारा scrape की जा सकी artworks का जटिल मगर आधा literal average जैसा है, तो उसके खिलाफ backlash काफी उचित लगता है
आज भी किसी artist को images दिखाकर कहना कि “ऐसा feel चाहिए, लेकिन ये हिस्से अलग करें” fair use में आता है। किसी screenwriter से Star Wars देखकर वैसा कुछ लिखने को भी कहा जा सकता है
copyright issue इस पर निर्भर नहीं करता कि copyright वाला work inspiration के रूप में इस्तेमाल हुआ या नहीं, बल्कि इस पर निर्भर करता है कि output पर्याप्त रूप से transformative है या नहीं
क्रिएटर्स के exclusive content से ट्रेन हुए model से फायदा कमाने वालों के लिए बेहतर है कि वे जल्द ही content cost देना शुरू करें—यह क्रिएटर्स, समाज, और यहां तक कि AI कंपनियों के लिए भी अच्छा होगा
copyright law AI कंपनियों पर लागू होता है या नहीं, इस पर बहस करना थकाऊ है। लागू होता है। बस एक सही licensing model व्यवस्थित करना होगा
उन्होंने यह भी कहा कि अगर बड़े language models में पहले से इस्तेमाल की गई सभी copyrighted material के लिए payment करनी पड़े, तो इन्हें बनाने वाली कंपनियों को हर साल “tens of billions से hundreds of billions of dollars” तक royalty देनी होगी
https://www.businessinsider.com/marc-andreessen-horowitz-ai-...
copyright law सिर्फ fixed tangible expression की रक्षा करता है, ideas, concepts, principles आदि की नहीं, और fair use नाम का बड़ा loophole भी है, इसलिए कानूनी दलील सरल नहीं है
क्रिएटर्स को मामूली पैसे मिलेंगे, सबको proprietary API से होकर गुजरना होगा, और open source को illegal किया जा सकता है। यह वह भविष्य नहीं है जिसे देखना चाहूंगा
अगर आप बिना अनुमति के किसी और की art पर model train करके model या output मुफ्त में distribute भी करते हैं, और एक पैसा भी नहीं कमाते, तब भी आप उनका काम चुरा रहे हैं
अगर artist का license non-commercial use तक सीमित था, तो उसे commercial AI training में इस्तेमाल करना साफ उल्लंघन नहीं है? सच में जानना चाहता हूं कि क्यों नहीं
इस विषय पर यह पहली चीज है जिसने इसे भावनात्मक रूप से महसूस कराया, इसलिए लेखक को सलाम
आज दुनिया बदल रही generative AI तीन समूहों के काम पर बनी है: software developers, Reddit commenters, और digital artists। Reddit commenters ने बहुत पहले अपने rights छोड़ दिए थे और उन्हें परवाह नहीं है। बचे software developers और digital artists
आम तौर पर software developers को अच्छा compensation मिला, digital artists को नहीं। software developers ने अपना काम modify करने योग्य रूप में public किया, artists ने ऐसा नहीं किया। शायद सबसे बड़ा फर्क यह है कि software developers ने generative AI बनाई। एक अर्थ में यह हमारी अपनी creation है, इसलिए अपने पेशे को खुद खाते हुए महसूस करना और किसी बाहरी अजनबी समूह द्वारा खाए जाते हुए महसूस करना बहुत अलग है
अगर Washington को जलना ही है, तो उसे Martians के बजाय British जलाएं तो बेहतर है। अगर हमने जो किया वह हमारे अपने हाथों से न हुआ होता, तो हमारी प्रतिक्रिया कैसी होती?
ऐसी स्थिति में बुरा लगने की भावना से उबरना बहुत मुश्किल होगा
गैर-तकनीकी लोगों को technology समझ से परे लगती है, आम लोगों को law समझ से परे लगता है, और ethics सबको समझ से परे लगती है
इतनी ज्यादा उलझन हो तो class-action lawsuit में शामिल होकर पुराने मामलों को निपटाना ही न्यायपूर्ण व्यवहार महसूस कराने के लिए काफी नहीं हो सकता। उदाहरण के लिए, कंपनियों के खिलाफ मुकदमा करने के इच्छुक लोगों को जोड़ने वाला कोई protocol या site हो तो public trust में मदद मिलेगी। कुछ ऐसा चाहिए जो दिखाए कि समाज equality और justice के मूल्यों का समर्थन करता है
सच में यह इतना ही सरल है
एक सरल solution है
public data पर train किए गए closed large models पर ban लगाएं, और ऐसे models के लिए open weights की requirement रखें। अगर कोई company बड़ा closed model train करना चाहती है, तो अपने data से करे
लेकिन company का ऐसे model को own कर पाना unfair लगता है। वह company का work product नहीं, बल्कि मूल रूप से पूरी humanity के cultural output का coded expression है। इसे हम सबको own करना चाहिए
यहां समस्या यह है कि model copyrighted works को ज्यों का त्यों generate करता है। यह दावा करने वालों के पास कानूनी तौर पर खड़े होने की जगह नहीं है कि copyrighted works पर train करना ही copyright violation है। वे जानबूझकर concepts को धुंधला कर रहे हैं ताकि ऐसा लगे, और कोई competent judge इसे तुरंत भांप लेगा
software से तुलना करें तो, public source code के commercial और closed use की अनुमति देने वाला MIT license है। जिस दिशा की कल्पना की जा रही है, उसके करीब copyleft license हो सकता है
कैमरा आने से पहले, और शायद आज भी कुछ मामलों में, कई चित्रकार ऐसी कंपनियाँ चलाते थे जो मुख्य रूप से प्रसिद्ध कलाकारों की कृतियों की प्रतियां बनाकर बेचती थीं। यानी आप अपने घर में किसी मशहूर पेंटिंग की शानदार प्रतिकृति टांग सकें।
Midjourney जैसे टूल्स को भी इसी श्रेणी में माना जा सकता है, लेकिन एक अहम फर्क है। अब तक की प्रतिकृति-व्यवस्था आम तौर पर सफल और मशहूर कलाकारों के इर्द-गिर्द घूमती थी। पैसे कमाने के लिए आपको ऐसी चीज़ की नकल करनी होती थी जिसकी लोगों की नज़र में पहले से बहुत कीमत हो, और यह भी बहुत स्पष्ट होता था कि वह एक प्रतिकृति है।
अब स्थिति बदल गई है। आम तौर पर लगभग अनजान कलाकारों के विशाल काम का आंशिक रूप से पुनरुत्पादन किया जा रहा है, और उसके स्रोत को और धुंधला करते हुए इस्तेमाल किया जा रहा है। इन कलाकारों का यह महसूस करना उचित है कि उनके साथ चोरी हुई है। वे प्रसिद्धि की संपत्ति या मृत्यु के बाद मिलने वाली प्रसिद्धि की सांत्वना के बिना Van Gogh जैसा व्यवहार झेल रहे हैं।
मैं Cat and Girl से ज़्यादा परिचित नहीं था, इसलिए यूँ ही कुछ स्ट्रिप्स देख रहा था और यह कॉमिक मिली: https://catandgirl.com/heroes-and-villains/
कभी-कभी लगता है कि ब्रह्मांड में डार्क ह्यूमर की भावना है।