Hugging Face CEO: “ओपन सोर्स AI अमेरिकी हितों के अनुरूप है”
(venturebeat.com)- अमेरिकी प्रतिनिधि सभा की विज्ञान समिति की सुनवाई में Hugging Face के CEO Clement Delangue ने इस बात पर जोर दिया कि open science और open source AI अमेरिका के मूल्यों और हितों के साथ गहराई से मेल खाते हैं
- Delangue का मानना है कि PyTorch, Tensorflow, Keras, transformers, diffusers जैसे अमेरिका में विकसित open source tools ने AI की प्रगति और इस क्षेत्र में अमेरिका की अग्रणी स्थिति को सहारा दिया है
- यह गवाही Meta के LLaMA leak के बाद सीनेटरों द्वारा spam, fraud, malware, privacy violations, harassment और अन्य दुरुपयोग की संभावनाओं पर सवाल उठाने के 2 सप्ताह बाद आई
- उन्होंने समझाया कि नैतिक openness नागरिक समाज, non-profit संगठनों, academia और policymakers को बड़ी निजी कंपनियों पर निगरानी रखने की क्षमता देती है और black-box systems को कम करती है
- Hugging Face model cards, access restrictions, phased releases, community moderation, और opt-in·opt-out datasets को मिलाकर openness और safeguards दोनों साथ लेकर चलना चाहता है
अमेरिकी प्रतिनिधि सभा की सुनवाई में open source AI के पक्ष में दलील
- Hugging Face के CEO Clement Delangue ने अमेरिकी प्रतिनिधि सभा की विज्ञान समिति की पूर्ण समिति सुनवाई Artificial Intelligence: Advancing Innovation Towards the National Interest में गवाही दी
- इसी सुनवाई में RAND Corporation के CEO Jason Matheny, Lux Capital के general partner Shahin Farshchi, Harvard University की responsible AI fellow Rumman Chowdhury, और Georgetown University Center for Security and Emerging Technology के executive director Dewey Murdick ने भी भाग लिया
- Delangue का कहना है कि AI में हाल की प्रगति open science और open source की बुनियाद पर संभव हुई है
- PyTorch, Tensorflow, Keras, transformers, diffusers को अमेरिका में विकसित open source technologies के रूप में उल्लेख किया गया
- उनका कहना था कि अगर ये तकनीकें नहीं होतीं, तो संभव है कि अमेरिका AI में अग्रणी देश न होता
LLaMA विवाद के बीच रखी गई नैतिक openness
- Delangue की गवाही Meta के open source LLM LLaMA leak पर सीनेटरों द्वारा Mark Zuckerberg से सवाल पूछे जाने के 2 सप्ताह बाद आई
- उस पत्र में चिंता जताई गई थी कि LLaMA का उपयोग spam, fraud, malware, privacy violations, harassment और अन्य गलत गतिविधियों तथा नुकसान के लिए किया जा सकता है
- LLaMA के फैलाव से आम जनता के लिए उपलब्ध AI मॉडलों की sophistication काफी बढ़ी है, और misuse या abuse की आशंका भी बढ़ी है
- Hugging Face न्यूयॉर्क स्थित startup है, जिसे पिछले साल $2 billion valuation मिला था, और यह open source code तथा models के hub के रूप में स्थापित हो चुका है
- अप्रैल में Delangue ने San Francisco के Exploratorium में आयोजित open source technology meetup में 5,000 से अधिक लोगों को जुटाया
- Delangue ने कहा कि open science और open source, AI का उपयोग करने वाले दसियों हजार startups को बढ़ावा देते हैं
- नैतिक openness नागरिक समाज, non-profit संगठनों, academia और policymakers को बड़ी निजी कंपनियों की ताकत पर निगरानी रखने के लिए जरूरी क्षमता प्रदान करती है
- यह black-box systems को रोकती है और corporate accountability बढ़ाती है
- यह bias mitigation, misinformation reduction, copyright को मजबूत करने, और artists व content creators सहित stakeholders को compensation दिलाने में मदद कर सकती है
- Hugging Face का दृष्टिकोण institutional policies, technical safeguards, और community incentives को एक साथ जोड़ता है
- इसमें documentation और model cards शामिल हैं, जिनमें Dr. Margaret Mitchell द्वारा विकसित model cards भी शामिल हैं
- artifacts पर access restrictions और phased releases को technical safeguards के रूप में उपयोग किया जाता है
- community moderation, opt-in·opt-out datasets भी incentive structure का हिस्सा हैं
- पिछले कुछ महीनों में बड़े language models की लगातार releases, और startups, समूहों तथा academia द्वारा closed और proprietary LLMs की ओर झुकाव के विरोध के बीच open source AI debate और अधिक गर्म हो गई है
1 टिप्पणियां
Hacker News की राय
यह सिस्टम के काम करने के तरीके का एकदम सही लघु-रूप है। इस व्यक्ति की बात सही है, लेकिन वह बहुत देर से पहुँचे, उनके पास पैसा भी कम था, और उन्हें पर्याप्त ध्यान भी नहीं मिला
वहीं Sam Altman एक consumer product का चेहरा है, जिसके पास शानदार marketing team और lobbyists भी हैं, Microsoft से अरबों डॉलर मिले हैं, और ऐसा product भी है जिसे कोई भी मुफ्त में आज़मा सकता है
बस पहले पहुँचना है, AI जोखिम की दलील रखनी है, और सांसदों को समझाना है कि latest technology खतरनाक है। OpenAI जल्द ही latest technology का पर्याय जैसा मान लिया जाता है, इसलिए लोग industry leader के पीछे चलते हैं, लेकिन वे कहाँ जा रहे हैं यह ठीक से नहीं देखते, और आखिरकार हम यहाँ पहुँचते हैं
काश open source software की अदालत में निष्पक्ष प्रतिनिधित्व होता, लेकिन विचार अपने खर्च खुद नहीं उठा सकते और पैसे की आवाज़ बहुत ऊँची होती है
कांग्रेस को यह बोझ महसूस हो रहा है कि उसने social media को यूँ ही छोड़ दिया, और वह AI regulation करने को उतावली है। सुनवाई में कोई वास्तविक असहमति नहीं थी, और सरकार व industry की मंशा पूरी तरह मेल खा रही थी। केंद्रीकृत नियंत्रण के लिए red carpet बिछाया जा रहा है, और regulation के ज़रिए competition खत्म करने की दिशा है
जो चीज़ local पर चलती है, वह wiretap/surveillance किए जा सकने वाले network boundary को bypass कर देती है। Google से पूछो तो वह record होता है और search history subpoena से हासिल की जा सकती है, जैसे public library के borrowing records भी। OpenAI जैसे gatekeeper उस भूमिका को निभा सकते हैं और toll भी वसूल सकते हैं
Vicuna-13B-ggml जैसी चीज़ से वही खोजबीन करो तो कोई भी sniff नहीं कर सकता कि क्या हो रहा है। जो व्यक्ति अकेला रहना चाहता है उसके लिए यह अच्छा लगता है, लेकिन जो लोग अधिक malicious users को रोकना चाहते हैं उनके लिए इसके निहितार्थ डरावने हैं
दुर्भाग्य से, ऐसे मुद्दों में समझौते की गुंजाइश लगभग नहीं होती। सबसे अच्छा विकल्प शायद हाल के Netherlands कानून जैसा होगा, जिसमें पर्याप्त कारण होने पर सरकार को निजी device में घुसने दिया जा सकता है, लेकिन ऐसा होने वाला नहीं है। सरकार के लिए फ़ायदेमंद एकमात्र दूसरा विकल्प local models और उनके open source development पर ही प्रतिबंध लगाना है
status quo के प्रतिरोध को पार करने के लिए बड़े जनसमर्थन की ज़रूरत होगी, लेकिन ऐसा समर्थन है नहीं, और उसे पैसे से खरीदना भी बहुत महँगा है
open source हमारे घोषित मूल्यों के अधिक करीब एक स्वस्थ डिजिटल समाज बनाने का अनिवार्य घटक है
AI महत्वपूर्ण है, लेकिन इस पूरे बदलाव में वह आखिरकार एक छोटा हिस्सा ही है। यह याद रखना चाहिए कि Bitcoin भी open source है, जबकि वह आर्थिक जीवन की बुनियाद हिलाने की कोशिश करता है
समाज-स्तर पर open source क्षमता रोपने की यह विकास-प्रक्रिया न तो स्वचालित है और न ही स्पष्ट रूप से अच्छी। ऊपर का cryptocurrency उदाहरण यही दिखाता है
अभी भी बहुत-सी technologies, institutions और व्यवहार-पद्धतियाँ हैं जिन्हें कल्पना करना, विकसित करना, परखना और फैलाना बाकी है। यह वर्तमान और भविष्य के डिजिटल “society” engineers के लिए सचमुच एक अच्छा काम है, जिसमें वे पूरी ताकत लगा सकते हैं
dystopia के अलावा किसी दूसरे universe की कल्पना करना मुश्किल है। अगर कभी किसी ने ऐसा monopoly vision पेश किया हो जो व्यक्तिगत agency, freedom, democratic control और नैतिकता के अनुरूप भी हो, और साथ ही अपने incentives के बारे में बौद्धिक ईमानदारी भी रखता हो, तो मैं सच में उसके बारे में जानना चाहूँगा
Hugging Face CEO ने अच्छा किया। मैंने दोस्त और परिवार के लोगों के साथ 5 मिनट का YouTube link साझा किया था, जिसमें open models और open source के फायदे बहुत अच्छी तरह समझाए गए थे
इस मामले में open source और free software के बीच का अंतर काफ़ी महत्वपूर्ण लगता है
चाहे उसे जानबूझकर जारी किया गया हो, अगर license “non-commercial use” तक सीमित है, या commercial use तभी देता है जब आप उसे जारी करने वाली company से “compete” न करें, तो वह भी वही बात है
पिछले 20 वर्षों में इस क्षेत्र की प्रगति इसी आदान-प्रदान की वजह से बेहद तेज़ हुई है। कंपनियाँ अपने परिणामों को छिपाकर secret sauce बचाने के बजाय बहुत-सी details साझा कर रही हैं, और एक-दूसरे के नतीजों को reproduce, improve और verify कर रही हैं
OpenAI ने ChatGPT बनाया, Meta ने Llama बनाया, और Google Bard कर रहा है। Llama कुछ हद तक open source community तक पहुँचा है, और लोग अब उसे इस्तेमाल कर रहे हैं, सुधार रहे हैं, और अपने models व benchmarks के साथ तुलना कर रहे हैं
कम से कम image generation में तो crowdsource training के कारण open models अब काफ़ी बेहतर नतीजे देते दिखते हैं
Hugging Face का इस तरह ख़बरों में आना अजीब लगता है। मुझे याद है कि 2019 की गर्मियों के आसपास, जब उसके लगभग 4 हज़ार stars थे, मैंने एक fix patch contribute किया था, और तब भी मुझे यह काफ़ी लोकप्रिय project लगा था
Hugging Face का अंतिम लक्ष्य क्या है? क्या वह AI के लिए GitHub बनना चाहता है?
वे AI model training और inference execution की ओर भी फैलना चाहते हैं। लेकिन inference cost, CoreWeave जैसे GPU providers की तुलना में, बहुत कम प्रतिस्पर्धी लगती है
यह अच्छा लगता है कि social media पर वह अभी भी काफ़ी accessible व्यक्ति है
कांग्रेस software, open source, AI जैसी चीज़ों में दखल क्यों दे रही है?
कांग्रेस के पास विदेशों, राज्यों के बीच, और Indian tribes के साथ व्यापार को विनियमित करने की शक्ति है
सोच रहा हूँ कि क्या आपने Bittensor project देखा है, और उस पर आपकी क्या राय है। क्या integration पर विचार करना चाहिए?
मुझे लगता है कि यह project जैसी चीज़ें open source AI movement के लिए मददगार हो सकती हैं
क्या Hugging Face पर मौजूद ज़्यादातर models किसी अजीब RAIL license के तहत नहीं हैं, open source के बजाय?