- डिफ़ॉल्ट रूप से लागू: Max, Team, Enterprise उपयोगकर्ताओं के लिए Opus 4.6 में 1M context अपने-आप सक्षम होता है
- कोई अतिरिक्त शुल्क नहीं: 900K token request पर भी token के हिसाब से वही दर लागू होती है जो 9K पर
- throughput पर कोई सीमा नहीं: context लंबा होने पर भी rate limit घटे बिना मौजूदा account throughput जैसा का तैसा लागू रहता है
- beta header भेजने की ज़रूरत नहीं: 200K से अधिक requests अपने-आप काम करती हैं, मौजूदा code में बदलाव की आवश्यकता नहीं
6 टिप्पणियां
लगता है कि gpt5.4 और opus 4.6 दोनों में 1M तक पूरा इस्तेमाल करना उतना अच्छा नहीं है.. मेरा ख्याल है कि लगभग 700~800k पर काटकर इस्तेमाल करना बेहतर है
पक्का 1M होने पर compaction भी बार-बार नहीं होता, तो अच्छा लगता है।
अच्छा है ..
"कोई अतिरिक्त शुल्क नहीं"
लेकिन 200K विकल्प अब हट गया है।
लगता है
CLAUDE_CODE_DISABLE_1M_CONTEXTनाम के option से opt-out किया जा सकता है.https://code.claude.com/docs/en/env-vars देखिए!