AI Battel में कौन सबसे आगे। (सौ. Design) 
टेक्नॉलजी

AI models की जंग: ChatGPT-5 ने जीता भरोसा, Gemini Deep Think ने भी किया प्रभावित

AI usability: AI मॉडल्स का रोज़मर्रा के कामों में इस्तेमाल किया जाना उनके बारे में कई बातें बताता है। हाल ही में एक टेक यूज़र ने कई AI Tools का एक साथ इस्तेमाल किया और उनके फर्क को जाना।

सिमरन सिंह

AI model comparison: टेक दुनिया में बेंचमार्क टेस्ट भले ही अहम माने जाते हों, लेकिन असली मायने तब सामने आते हैं जब इन AI मॉडल्स का रोज़मर्रा के कामों में इस्तेमाल किया जाता है। हाल ही में एक टेक यूज़र ने Grok 4, Grok 4 Heavy, Gemini 2.5 Pro, Gemini Deep Think, ChatGPT-5 और ChatGPT-5 Thinking जैसे मॉडल्स को परखा और पाया कि असली फर्क usability में है।

बिज़नेस के लिए कौन सा AI सबसे भरोसेमंद

यूज़र ने बताया कि एक बिज़नेस ओनर के तौर पर उनका मकसद सिर्फ टेस्टिंग नहीं, बल्कि ऐसा टूल ढूंढना था जो समय बचाए, अलग-अलग लोगों पर निर्भरता कम करे और भरोसेमंद तरीके से काम पूरा करे। इस मामले में ChatGPT-5 ने बाज़ी मारी। यह न केवल ZIP फाइल को आसानी से अनज़िप कर सका, बल्कि उसके अंदर के कोड का विश्लेषण कर सुधार के सुझाव भी दिए। वहीं, Grok 4 ZIP फाइल्स पर फेल हो गया और Gemini फाइल्स खोलने में सक्षम था, लेकिन ज्यादा फाइल्स होने पर गड़बड़ा गया।

क्वांटम फिजिक्स के सवालों पर हुई असली परीक्षा

टेस्टिंग यहीं तक सीमित नहीं रही। यूज़र के एक दोस्त, जो क्वांटम फिजिक्स के प्रोफेसर हैं, ने AI मॉडल्स को बेहद जटिल और रिसर्च-लेवल सवाल पूछे, ऐसे सवाल जिनके जवाब इंटरनेट पर उपलब्ध नहीं थे। खास बात यह थी कि सवाल में एक ज़रूरी जानकारी जानबूझकर छोड़ दी गई थी, ताकि देखा जा सके कि मॉडल उस कमी को पहचान पाता है या नहीं।

ChatGPT-5 Thinking और Gemini Deep Think ने मारी बाज़ी

इस चुनौती में केवल ChatGPT-5 Thinking और Gemini Deep Think ही ऐसे मॉडल साबित हुए जिन्होंने गायब जानकारी को पहचानकर उस खाली जगह को भरने की कोशिश की। Grok 4 इस स्तर पर टिक नहीं पाया और सवाल की गहराई समझने में चूक गया।

असली क्षमता बेंचमार्क से नहीं, असली चुनौतियों से पता चलती है

इस अनुभव ने साबित किया कि किसी भी AI मॉडल की असली क्षमता सिर्फ मानक परीक्षणों से नहीं, बल्कि जटिल और रियल-टाइम समस्याओं से परखी जाती है। खासकर जब बात कोडिंग, डाटा एनालिसिस या आउट-ऑफ-द-बॉक्स सोच की हो, तो ChatGPT-5 और Gemini Deep Think जैसे मॉडल्स सबसे आगे निकलते हैं। इससे ये भी साबित होता है कि सवालों के अनुसार सभी AI की अपनी खासियत है।

आज की ताजा खबर 21 अगस्त LIVE: एक क्लिक में पढ़ें दिनभर की सारी बड़ी खबरें

जंतर-मंतर पर आरक्षण के खिलाफ प्रदर्शन पर पुलिस का एक्शन, RAF ने प्रदर्शनकारियों को खदेड़ा, कई हिरासत में

RSS-ISI सीक्रेट मीटिंग! आंबेडकर ने PM मोदी और भागवत से पूछे सवाल, कोलंबो बैठक के 4 मुद्दों के खुलासे की मांग

असम बाढ़ पर CM हिमंता की वित्त मंत्री से अहम मुलाकात, निर्मला सीतारमण ने दिया केंद्र के सहयोग का भरोसा

Japan Delegation Varanasi: 109 सदस्यीय जापानी प्रतिनिधिमंडल पहुंचा काशी, निवेश और संस्कृति को मिलेगी नई उड़ान