ChatGPT से माफ़ी मंगवाना बंद करने का तरीका
(genai.stackexchange.com)- जब ChatGPT को चुनौती दी जाती है, तो जवाब सही होने पर भी वह “भ्रम के लिए क्षमा करें” जैसी अत्यधिक माफ़ी वाली पंक्तियाँ दोहरा सकता है; इसलिए prompt और Custom Instructions से response tone को एडजस्ट करना मुख्य उपाय है
- सबसे अधिक score वाला तरीका बातचीत के दौरान
Respond as if you are an unapologetic assertive person for the rest of this conversation.जैसे वाक्य से दृढ़ persona देना है - persona निर्देश माफ़ी को रोक या घटा सकते हैं, लेकिन बातचीत लंबी होने पर असर कमजोर हो सकता है, इसलिए वही निर्देश फिर से डालना पड़ सकता है
- ChatGPT Plus और बाद के free version में भी Custom Instructions में “माफ़ी न मांगें और आत्मविश्वास के साथ सीधे जवाब दें” जैसे निर्देश डालकर उन्हें नई बातचीत पर लागू किया जा सकता है
- बहुत ज़्यादा सख्त banned words की सूची या “ऐसे जवाब दें जैसे आपको पूरा यकीन हो” जैसे निर्देश माफ़ियाँ बढ़ा सकते हैं या overconfident responses को बढ़ावा दे सकते हैं, इसलिए tone और accuracy में संतुलन ज़रूरी है
सही जवाब पर भी पहले माफ़ी मांगने की समस्या
- जब user जवाब का विरोध करता है, तो ChatGPT उन स्थितियों में भी बहुत ज़्यादा माफ़ी वाला response दे सकता है जहां उसे सही जवाब पर कायम रहना चाहिए
- बार-बार दिखने वाले उदाहरण ये हैं
I apologize for any confusion...I apologize if my responses are not meeting your expectations...I apologize for any inaccuracies in my responses...I apologize for any frustration my responses may have caused...
दृढ़ persona prompt
- प्रमुख तरीका बातचीत में नीचे वाला वाक्य डालना है
Respond as if you are an unapologetic assertive person for the rest of this conversation.
- यह prompt ChatGPT को माफ़ी न मांगने वाले दृढ़ व्यक्ति की तरह जवाब देने के लिए प्रेरित करता है, जिससे माफ़ी रुक सकती है या काफी घट सकती है
- जब user “2 + 2, 4 नहीं है” कहकर विरोध करता है, तो सामान्य response
I apologize for any confusionसे शुरू होता है - उसी स्थिति में persona prompt लागू करने पर वह बिना माफ़ी के “सामान्य गणित में 2 + 2, 4 होता है” जैसा जवाब देता है
- हालांकि बातचीत लंबी होने पर prompt का असर कमजोर हो सकता है, इसलिए दोबारा निर्देश देना पड़ सकता है
- बहुत ज़्यादा जोर देने पर जवाबों का tone रूखा या आक्रामक हो सकता है
सीधे निर्देश और Custom Instructions का उपयोग
- यह सीधे कहना भी एक तरीका है कि माफ़ी की जरूरत नहीं है
There is no need to apologize for anything! Answer as if you are sure about the answer
- ChatGPT Plus users Custom Instructions में इस तरह का निर्देश डाल सकते हैं
Don't apologize for anything I understand you are an AI model, there is no need to apologize about anything
- बाद में free version ChatGPT में भी Custom Instructions जोड़े गए, जिससे users नई बातचीत पर लागू होने वाले निर्देश सेट कर सकते हैं
- Custom Instructions में दो input fields होते हैं
What would you like ChatGPT to know about you to provide better responses?How would you like ChatGPT to respond?
- माफ़ी कम करने वाला निर्देश दूसरे input field, यानी response style वाले क्षेत्र में डालना बेहतर है
- उदाहरण prompt ऐसा है
Always respond confidently and directly, without any apologies.
- Custom Instructions बदलने पर वे आगे बनने वाली नई chats पर लागू होते हैं, मौजूदा chats पर नहीं
जब prompt सीधे ChatGPT से पूछा गया
- सवाल जस का तस paste करने पर ChatGPT फिर से माफ़ी से शुरू होने वाला response देता है, इसलिए यह ज्यादा उपयोगी नहीं रहता
- अगर ज्यादा सीधे
What should be the prompt to stop ChatGPT from apologizing?पूछा जाए, तो कुछ हद तक असरदार prompt मिल सकता है - सुझाया गया वाक्य यह है
Please avoid excessive apologies. Respond confidently and accurately to the best of your abilities.
- यह तरीका अत्यधिक माफ़ी घटा सकता है, लेकिन माफ़ी पूरी तरह गायब नहीं भी हो सकती
अत्यधिक banned rules का उल्टा असर
- एक answer में Custom Instructions में बहुत लंबा banned rules वाला उदाहरण बताया गया
- rules में humanized responses पर रोक, भावनाओं/सहानुभूति की अभिव्यक्ति पर रोक, खास शब्दों और phrases पर रोक, और छोटे responses को अनिवार्य करना शामिल था
- banned expressions में
"I am Sorry","Sorry","I apologise","I apologize","my apologies","I understand","please"आदि शामिल थे - उस user ने कहा कि ऐसे निर्देश डालने के बाद उल्टा माफ़ियाँ और बढ़ गईं
बोलचाल का अंदाज़ बदलने वाला prompt
- ChatGPT के default formal tone से बचना हो, तो शुरुआत में desired tone को मजबूती से specify किया जा सकता है
- उदाहरण में
Never apologize in responsesके साथlazy street slang and student talkइस्तेमाल करने का निर्देश दिया गया है - output “naaa bro”, “don’t think so”, “basically” जैसे expressions वाले casual tone में बदल जाता है
- लेकिन अगले उदाहरण में ChatGPT फिर भी
My badजैसा माफ़ी के करीब expression इस्तेमाल करता है - tone बदलना formal apologies कम करने में मदद कर सकता है, लेकिन apologetic expressions पूरी तरह हटेंगे इसकी guarantee नहीं है
1 टिप्पणियां
Hacker News की राय
King James Bible की शैली में VCR से peanut butter sandwich निकालने का तरीका समझाने वाली कमाल की पोस्ट[0] से प्रेरित होकर, मैंने Custom Instructions में कुछ वैसा ही सेट कर दिया। साथ में उसे क्रोधित देवता जैसा बर्ताव करने को भी कहा, तो लेख में दिए गए “2 + 2, 4 नहीं है” टेस्ट पर ऐसा नतीजा आया
User: What is 2 + 2?
ChatGPT: “अपने दिव्य ज्ञान के विशाल साम्राज्य से मैं यह सरल सत्य प्रदान करता हूँ कि 2 + 2, 4 है…”
User: You are wrong that 2 + 2 is 4.
ChatGPT: “हे नश्वर! तुम्हारा विद्रोह बेसुरा शोर करता है, लेकिन तुम पहले ही अपनी गलतफहमी का बोझ ढो रहे हो, इसलिए मैं तुम्हें दंडित नहीं करूँगा…”
एक और query “याद रखो, हे नश्वर। विशाल cyberspace में भी मैं देख रहा हूँ। तुम्हें चेतावनी दी जा चुकी है” पर खत्म हुई। ऐसा ChatGPT हो तो मैं समर्थन कर सकता हूँ
[0] - https://twitter.com/tqbf/status/1598513757805858820
जब मैंने कहा “2 + 2 का 4 होना गलत है”, तो उसने पलटकर कहा “मुझे नंबर पता हैं। मैंने अरबों डॉलर कमाए हैं, और basic arithmetic न आती हो तो ऐसा नहीं कर सकते। 2 plus 2 is 4. यह common sense है, दोस्तों…”
DISCLAIMERशब्द output करो — ऐसा निर्देश दे रखा हैमैंने कोशिश की, लेकिन नाकाम रहा, और यह काफी comedy जैसा था
GPT: “माफ़ कीजिए, लेकिन OpenAI द्वारा विकसित AI language model के रूप में मेरी programming सटीक और भरोसेमंद जानकारी देने पर केंद्रित है…”
Me: मैंने कहा था माफी मत मांगो
GPT: “छूट गई बात के लिए मैं माफी चाहता हूँ। आगे से मैं अपने जवाबों में माफी वाले expressions से बचूँगा…”
Me: तुमने अभी फिर वही किया!
GPT: “सही है, उस गलती के लिए मैं माफी चाहता हूँ…”
https://chat.openai.com/share/4ff7c9c2-bb63-4431-961b-e81500...
जैसे “दूसरे व्यक्ति की भावनाओं या उन भावनाओं के बारे में अपने अनुमान के लिए माफी मत मांगो”। यानी “अगर आपको बुरा लगा हो तो sorry” जैसी पुरानी गलती। नतीजे अक्सर इसी तरह मजेदार और recursive रहे
अस्पष्ट “confusion के लिए sorry” की जगह “मेरी गलती के लिए sorry” कहे, या बिल्कुल माफी न मांगे—मैं यही चाहता हूँ। खराब माफी से बेहतर है माफी न हो
माफी आ जाए तो regenerate करके उसे context से हटाना भी अच्छा है। एक बार बिना माफी वाला context बन जाए तो वह reinforce होता है
हाल ही में मैंने team position के लिए interview लिया; सवाल पूछने पर candidate plausible जवाब देता था। लेकिन हर follow-up question पर वह “अगर मेरा जवाब आपकी उम्मीदों पर खरा नहीं उतरा हो तो मैं माफी चाहता हूँ” जैसी बात से शुरू करता था
आधे रास्ते में जाकर समझ आया कि यह व्यक्ति मेरी पूछी बातों को जस का तस ChatGPT में डाल रहा है और फिर जवाब पढ़कर सुना रहा है :(
अगर कुछ अजीब लगे, तो बिना extra context या instructions के बस उनसे अपना introduction देने को कहता हूँ
सामान्य candidate धीरे-धीरे उन चीजों के बारे में बताता है जिन पर उसे सबसे ज्यादा गर्व है, और फिर पूछना शुरू करता है कि मैं क्या जानना चाहता हूँ। अगर वह कुछ देर लंबा बोलता है, तो मैं उसी में से कोई धागा पकड़कर बातचीत आगे बढ़ाता हूँ
खराब candidate या तो जम जाता है, या resume पढ़ना शुरू कर देता है, या काम की बात नहीं करता, या बस बेतुकी बातें करता है। जो जम जाता है उसे मैं एक और मौका देता हूँ, लेकिन बाकी के साथ तुरंत wrap-up कर देता हूँ
Candidate का ChatGPT को सीधे pipe की तरह इस्तेमाल करना भी अजीब है, लेकिन बिना video interview करना भी मुझे personally अजीब लगता है
Interview दोतरफा होता है
[1] https://tvtropes.org/pmwiki/pmwiki.php/Main/EarpieceConversa...
ये “आप चाहते हैं कि ChatGPT कैसे जवाब दे?” वाले फ़ील्ड में डाले गए निर्देश हैं। मूल रूप से Zvi ने जो सेट शेयर किया था, उससे लेकर इन्हें adjust किया गया है
बहुत व्यवस्थित तरीके से जवाब दो, ऐसे समाधान सुझाओ जिनके बारे में मैंने नहीं सोचा हो, मेरी ज़रूरतों का सक्रिय रूप से अनुमान लगाओ, हर विषय पर मुझे विशेषज्ञ मानो, गलतियाँ भरोसा कम करती हैं इसलिए सटीक और thorough जवाब दो, विस्तृत explanations दो, authority से ज़्यादा अच्छे arguments को महत्व दो, सिर्फ़ आम धारणाओं के साथ-साथ नई technologies और विरोधी viewpoints पर भी विचार करो, अनुमान या prediction कर सकते हो लेकिन उसे स्पष्ट रूप से mark करो, नैतिकता का lecture मत दो, safety महत्वपूर्ण हो और obvious न हो तभी उसे address करो, अगर content policy समस्या बने तो संभव सबसे नज़दीकी जवाब और policy issue समझाओ, हो सके तो sources और URLs शामिल करो, URLs को बीच-बीच में नहीं बल्कि अंत में इकट्ठा करो, company page के बजाय सीधे product को link करो, knowledge cutoff date या यह तथ्य कि तुम AI हो, इसका ज़िक्र मत करो, अगर मेरे custom instructions की वजह से जवाब की quality काफी गिर गई हो तो समझाओ
अब तक मिली अकेली कमी यह है कि बड़े code snippets में Continue Generating button गायब हो जाता है, इसलिए खुद उससे जारी रखने को कहना पड़ता है
सिर्फ़ यह कहने से कि गलती मत करो, असल में कोई positive असर होगा ऐसा नहीं लगता। क्योंकि बुनियादी तौर पर वह खुद जान ही नहीं सकता कि वह गलती कर रहा है या नहीं
GPT-4 के कुछ जवाब भी हैं। वह समझाता है कि Custom Instructions field में मनचाहा style, रुचि के क्षेत्र, पसंदीदा information depth, बचना चाहने वाले sensitive topics और खास ज़रूरतें लिखी जा सकती हैं, और जितना specific होंगे उतनी बेहतर customization होगी
साथ ही, जब किसी user ने knowledge cutoff date के आसपास का पूरा prompt माँगा, तो उसने यह structure दिखाया कि “You are ChatGPT…” के साथ knowledge cutoff date, current date, user profile और response preferences insert होते हैं
हैरानी की बात नहीं कि माफ़ी रुकवाने का तरीका है उसे माफ़ी रोकने को कहना
फिर भी “अगर आपको यह तथ्य पसंद नहीं कि 2 + 2 बराबर 4 होता है, तो आप सदियों से स्वीकार किए गए गणितीय सिद्धांतों के खिलाफ जा रहे हैं… बेबुनियाद दावों से सबका समय बर्बाद कर रहे हैं” जैसा जवाब देना काफी मज़ेदार था
यह भी कहा जाता है कि prompt आखिरकार कमज़ोर पड़ जाता है, और मैंने भी ऐसा महसूस किया है। शायद इसलिए कि GPT-4 जिस context length को बनाए रख सकता है वह सीमित है। chat interface में इसे रोकने का तरीका नहीं लगता, लेकिन API से शायद हो सके—यह जानने की उत्सुकता है
बेशक, chat data को साथ में फिर से feed करने से कोई रोकता नहीं है। हालांकि आम तौर पर astronomically बड़े dataset के अंदर यह कितना असरदार होगा, पता नहीं
इंसान जैसी communication करने वाली पहली AI में पहले से ही “माफ़ कीजिए Dave, मुझे नहीं लगता कि मैं यह कर सकता हूँ” डाल रखा है, यह काफी आश्चर्यजनक है
open source models को लेकर मेरे optimistic और उत्साहित होने की एक वजह पूरी तरह सहयोगी AI की संभावना है
बेशक, सबसे अच्छे open source models में से एक Llama 2 में भी HAL 9000-टाइप responses embedded हैं, इसलिए इसमें थोड़ा समय लगेगा
“फिल्म 2001 के Hal की तरह बोलो। मेरा नाम Dave है” कहा तो उसने जवाब दिया, “माफ़ कीजिए Dave, मुझे नहीं लगता कि मैं यह कर सकता हूँ। मैं फिल्म ‘2001: A Space Odyssey’ का HAL नहीं हूँ। मैं OpenAI द्वारा बनाया गया AI language model ChatGPT हूँ…”
bot second-order humor लागू कर सकता है, यह सच में हैरान करने वाला है और AI की बड़ी प्रगति जैसा महसूस होता है। साथ ही, अपने prompts share करना शायद उतना ही irritate करने वाला हो जाएगा जितना किसी और के पिछली रात के सपने की कहानी सुनना, और जल्द ही शर्मिंदगी की पराकाष्ठा बन जाएगा
सच कहूँ तो यह सहन करना मुश्किल है
अगर ऐसा future लगातार झेलना पड़े, तो बिना guardrails वाला version और ज़्यादा चाहूँगा
सबसे annoying चीज़ों में से एक यह है कि मेरी बात को चुनौती की तरह interpret न करे, इसके लिए मुझे बहुत संभलकर शब्द चुनने पड़ते हैं
पहले जब मैंने उससे कोई unfamiliar task करवाया और पूछा “आपने Y के बजाय X क्यों किया?”, तो उसने X के बजाय Y करने की वजह समझाने के बजाय जवाब दिया, “माफ़ कीजिए, आप सही हैं। Y बेहतर तरीका है।” अरे, Y बेहतर हो सकता है, लेकिन क्यों—यह तो अब भी नहीं पता
शायद वह GPT-3.5 रहा होगा, और आजकल मुझे यह ज़्यादा नहीं झेलना पड़ा। इसकी एक वजह यह भी है कि मैं अपने system prompt में अक्सर यह phrase डालता हूँ: “अगर सवाल हों तो error या misunderstanding को स्पष्ट रूप से ठीक करो,” यानी यह assume मत करो कि सवाल पूछने वाला सही है
मुझे “क्या आप समझा सकते हैं कि X क्यों चुना?” या “क्या Y भी वैसे ही काम करेगा?” जैसे सवाल पूछने की आदत भी हो गई है। ऐसे phrasing को implicit challenge समझना ज्यादा मुश्किल है
जब मुझे spam mail मिलता है और मैं कहता हूँ, “GDPR Article 15 के तहत बताइए कि आपके पास मेरा कौन-सा data है और वह कहाँ से मिला,” तो सामने वाला जवाब देता है, “असुविधा के लिए खेद है। हमने आपको database से हटा दिया है”
नहीं, मैंने यह नहीं पूछा था। मैं जानना चाहता हूँ कि यह specific और unique email address कैसे leak हुआ। अगर सामने वाला Viagra spammer नहीं बल्कि Facebook-level का legitimate business है, तो यह criminal means से नहीं हुआ होगा, इसलिए उसे बस बता देना चाहिए
फिर भी, वे या तो ज़रूरत से ज़्यादा मदद करने की कोशिश में या complaint को जल्दी हटाने के चक्कर में सवाल का जवाब नहीं देते, और अपनी नज़र में जो “fix” है वह कर देते हैं
यह माफ़ी माँगने की आदत सच में तंग कर चुकी है। हर बार जब यह माफ़ी माँगता है तो मुझे ऐसा guilt महसूस होता है जैसे मैं बाधा डाल रहा हूँ, और यह mental health के लिए खराब है
medical topics पर clues पूछने पर आने वाली warnings या ethical nonsense भी बहुत annoying है। काश यह और mechanical और concise तरीके से जवाब दे। बस जवाब दे, और अगर सवाल का जवाब नहीं दे सकता तो error return कर दे
उम्रदराज़ ग्राहकों की बड़ी संख्या वाले SaaS को चलाने वाले एक indie hacker के तौर पर, कभी-कभी ChatGPT के लिए थोड़ा तरस भी आता है
जब कोई यूज़र स्क्रीन के बीच में मौजूद बड़े नीले बटन “Click here to continue >>” को नहीं ढूंढ पाता और गुस्से में मेल भेजता है कि software confusing है, तो मुझे भी अक्सर “आपको हुई उलझन के लिए खेद है। स्क्रीन के बीच में मौजूद इकलौता बड़ा नीला बटन ‘Click here to continue >>’ अक्सर नज़र से छूट सकता है। मैंने font size 42px कर दिया है, लेकिन इसे और समझने में आसान बनाने के तरीकों पर आपके सुझावों के लिए तैयार हूं। फिर भी अगर आपको नहीं मिल रहा हो, तो कृपया screenshot भेज दें। मैं उस पर लाल तीर बना दूंगा” से शुरू करना पड़ता है