टोकन दक्षता बढ़ाने से मॉडल की कीमत क्यों बढ़ती है
Categories:
GPT5.5 की कीमत GPT5.4 की तुलना में दोगुनी है, GPT5.4 की कीमत GPT5.3codex की तुलना में लगभग 40% अधिक है, दोनों बार कीमत वृद्धि का एक आधारभूत तर्क है, अर्थात टोकन दक्षता में वृद्धि।
GPT5.2 एक ऐसा मॉडल है जो बेहद धीमा है, लेकिन GPT5 श्रृंखला के मॉडल समस्या का सटीक पता लगाने की दर उच्च है, बग कम हैं, जिससे समीक्षा का मानसिक बोझ काफी कम होता है, इसलिए इसे छोड़ने का मन नहीं हुआ। 5.3codex से शुरू होकर, GPT मॉडल की हर पीढ़ी ने गति में स्पष्ट सुधार किया है, आधिकारिक कथन के अनुसार, मॉडल प्रदर्शन बढ़ाने के साथ-साथ सोचने के टोकन व्यय को कम करता है। अर्थात हार्डवेयर अपरिवर्तित रहने और प्रदर्शन बेहतर होने की स्थिति में, मॉडल अधिक “सीधे निशाने पर” है, मेरी समझ है कि मॉडल की बुद्धिमत्ता अधिक है, तर्क अधिक स्पष्ट है, वह जल्दी सही निष्कर्ष पर पहुंच सकता है, बार-बार चिंतन नहीं करता।
जो लोग कुछ ओपन-सोर्स मॉडल की थॉट चेन देख चुके हैं, वे ध्यान देंगे कि उनकी सोच प्रक्रिया का अधिकांश भाग गलत हो सकता है, लेकिन बार-बार चिंतन और विवरणों को शामिल करने से, अंततः सही उत्तर मिल सकता है, बस थॉट चेन लंबी और बेकार होती है।
GPT5.5 की सोच दक्षता अब उद्योग में अनूठी कही जा सकती है, opus का सोचना कभी नाममात्र का था, 4.7 से “क्या आपको… चाहिए?” भी आया, मेरे अनुभव से GPT5.4 के बाद सिफारिश की सटीकता बहुत उच्च है, हमारे मॉडल के जल्दी GPT5 को पकाने (पछाड़ने) की उम्मीद है, अब opus को मत पकाओ।

