aiminute. ← सभी AI समाचार
अफ़वाहें AI Minute Newsroom 2026-08-21

अफ़वाह: गुमनाम मुफ़्त मॉडल को अब भी झिपू का बताया जा रहा है — पर जिस स्कोर ने उसे मशहूर किया वह दस कामों का था, और पूरा परीक्षण साधारण निकला

अफ़वाह: गुमनाम मुफ़्त मॉडल को अब भी झिपू का बताया जा रहा है — पर जिस स्कोर ने उसे मशहूर किया वह दस कामों का था, और पूरा परीक्षण साधारण निकला

यह एक असत्यापित अफ़वाह है और इसे अफ़वाह के रूप में ही प्रकाशित किया जा रहा है। Ox Alpha नाम का एक मॉडल 20 अगस्त को OpenRouter पर सामने आया, जिसका प्रदाता गुमनाम है और उस पर केवल 'Stealth' लिखा है — एक हफ़्ते के लिए मुफ़्त, 10,48,576 टोकन की कॉन्टेक्स्ट विंडो, 1,31,072 टोकन तक आउटपुट, और टेक्स्ट, चित्र तथा वीडियो इनपुट। 21 अगस्त को शोधकर्ता बेन डेविस ने एक फ़िंगरप्रिंट विश्लेषण प्रकाशित कर कहा कि वे '99% निश्चित' हैं कि यह मॉडल झिपू के GLM-5 परिवार का कोई अघोषित सदस्य है: वीडियो एनकोडर की टोकन खपत GLM-5V-Turbo से बिल्कुल मेल खाती है, 75 टोकन के स्थिर आवरण को छोड़कर टोकनाइज़र GLM-5.3 जैसा है, ऑडियो इनपुट पर वही इनकार व्यवहार है, वही '1301' त्रुटि कोड है, और आउटपुट में इमोजी की दर भी मिलती-जुलती है। उनके अनुसार यह विश्लेषण शाओमी MiMo, DeepSeek, गूगल, Qwen, xAI, OpenAI और Anthropic को बाहर कर देता है। इनमें से कुछ भी पुष्ट नहीं है: 23 अगस्त तक किसी कंपनी ने Ox Alpha को अपना नहीं बताया और झिपू ने कुछ नहीं कहा। डेटा का सवाल भी ध्यान देने योग्य है। OpenRouter के अपने मॉडल पेज पर लिखा है कि Ox Alpha को भेजे गए प्रॉम्प्ट और उत्तर गुमनाम प्रदाता द्वारा रखे जाते हैं, भले ही प्रशिक्षण में उपयोग न हों — जबकि OpenCode ने इसी मॉडल को 'शून्य डेटा प्रतिधारण' कहकर प्रचारित किया। जब तक प्रदाता का नाम सामने न आए, सुरक्षित धारणा यही है कि आप जो भेजते हैं उसे एक ऐसी कंपनी रख रही है जिसने अपना नाम नहीं बताया। (सुधार, 23 अगस्त: हमारी मूल रिपोर्ट में कहा गया था कि Ox Alpha ने DeepSWE कोडिंग बेंचमार्क पर 80% pass@1 हासिल किया, जो Claude Fable 5 के 65%, GLM-5.3 के 62% और GPT-5.6-sol के 52% से आगे है। वह आँकड़ा 10 कामों के एक उपसमुच्चय से आया था — बेंचमार्क के 9 प्रतिशत से भी कम। डेविस ने उसके बाद पूरे 113 कामों पर परीक्षण किया और लगभग 63% पाया, जो सबसे आगे नहीं बल्कि GPT-5.6 Sol के बराबर है; वे स्वयं कहते हैं कि पूरे सेट का आँकड़ा ही समझ में आने वाला है। Ox Alpha बेंचमार्क में शीर्ष पर नहीं रहा। हमारे शीर्षक ने कहा कि रहा, और वह ग़लत था।)

यह क्यों मायने रखता हैसुधार ही असली ख़बर है। दस कामों का एक नतीजा दो दिन में 'गुमनाम मॉडल कोडिंग बेंचमार्क में शीर्ष पर' बनकर दुनिया घूम आया; उसे झुठलाने वाला 113 कामों का नतीजा उसका आधा रास्ता भी तय नहीं करेगा। जब भी कोई मॉडल बड़े अंतर से सबको पीछे छोड़ता दिखे, पहला सवाल यही होना चाहिए कि उससे कितने सवाल पूछे गए — छोटा नमूना बड़े, रोमांचक और निरर्थक अंतर पैदा करता है। बाक़ी बात अब भी क़ायम है: पहचान प्रमाणित नहीं है, और किसी मज़बूत मॉडल को गुमनाम तथा एक हफ़्ते मुफ़्त रखना उपहार नहीं, वितरण का रास्ता है। बेंचमार्क आप हैं, और इस मामले में प्रदाता कहता है कि वह आपकी भेजी सामग्री रखता है।
#कोडिंग

⚠ अपुष्ट अफ़वाह — सावधानी से

WhatsApp X Telegram
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ

संबंधित खबरें

ओपनएआई 28 दिन रोज़ सुधार देगा या सीमाएँ रीसेट करेगा
2026-10-05
एआई से लिखी रिपोर्टों की बाढ़ में गूगल ने बग बाउंटी रोक दी।
2026-10-04
Anthropic दस हजार इंजीनियरों को Claude लगाना सिखाएगा
2026-10-04
एक लिनक्स डेस्कटॉप ने एआई से लिखा कोड पूरी तरह ठुकरा दिया।
2026-10-04
डीपसीक ने अपना एजेंट डेस्कटॉप पर रखा और कोड भी खोल दिया।
2026-10-03