aiminute. ← सभी AI समाचार
नए मॉडल 2026-08-15

चीन के इंस्टाग्राम के पीछे की कंपनी ने उस मॉडल के सहोदर को ओपन-सोर्स किया जिसने गणित ओलंपियाड में पूरे अंक पाए थे

चीन के इंस्टाग्राम के पीछे की कंपनी ने उस मॉडल के सहोदर को ओपन-सोर्स किया जिसने गणित ओलंपियाड में पूरे अंक पाए थे

श्याओहोंगशू — विदेशों में रेडनोट के नाम से जाना जाने वाला लाइफस्टाइल ऐप — ने 14 अगस्त को dots3-note-prev के ओपन वेट्स जारी किए। यह मिक्सचर-ऑफ-एक्सपर्ट्स मॉडल है जिसमें कुल 280 अरब पैरामीटर हैं पर एक बार में केवल 16 अरब सक्रिय रहते हैं, कॉन्टेक्स्ट विंडो 512K है, और यह टेक्स्ट, दृश्य तथा वाणी इनपुट लेता है। यह उसी परिवार से आता है जिसका dots-note-3.0 पिछले महीने अंतरराष्ट्रीय गणित ओलंपियाड में वह प्रदर्शन दर्ज कर चुका है जिसे उसकी लैब किसी एआई का पहला आधिकारिक 42 में से 42 बताती है। लैब ने अपनी प्रशिक्षण विधि TEMPO भी प्रकाशित की, जिसमें मॉडल लंबी अवधि के कामों में कर्ता और अपनी ही प्रगति के मूल्यांकनकर्ता की भूमिकाओं के बीच बदलता रहता है, साथ ही ठीक ऐसे ही कामों के लिए बने दो बेंचमार्क: 20 क्षेत्रों में 200 कार्यों वाला VibeSearchBench, और 1,247 अलग-अलग जांचों वाला 20 कार्यों का VibeLifeBench। लैब के अनुसार इन पर न Claude Opus 5 और न ही GPT-5.5 उसका पास मानक पार कर सका।

यह क्यों मायने रखता हैयहां दो बातें असामान्य हैं। पहली यह कि कौन: एक लैब नहीं, बल्कि एक सोशल शॉपिंग ऐप उसी हफ्ते ओपन वेट्स जारी कर रहा है जिस हफ्ते अलीबाबा और मेटा ने किया — यह याद दिलाता है कि चीन में उपभोक्ता इंटरनेट कंपनियों के अपने फ्रंटियर दल हैं और वे नतीजे मुफ्त देने को तैयार हैं। दूसरी यह कि उन्होंने मापा क्या। लगभग हर सार्वजनिक बेंचमार्क मॉडल को सवाल का जवाब देने पर अंक देता है; ये दोनों उसे घंटों लंबा काम पूरा करने पर अंक देते हैं — यात्रा की योजना बनाना, कोई संचालन चलाना — और एक हजार से अधिक छोटी जांचों पर आंकते हैं। किसी एजेंट के लिए यह अधिक कठिन और अधिक ईमानदार परीक्षा है, और दो फ्रंटियर मॉडलों के इसमें असफल होने का दावा तय मान लेने से पहले स्वतंत्र पुष्टि का हकदार है।
#AI एजेंट

✓ सत्यापित · 4 स्रोत

WhatsApp X Telegram
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ

संबंधित खबरें

डीपसीक का सस्ता वर्कहॉर्स अब देख सकता है — और आँखों वाली एजेंट कार्यों में वह एंथ्रोपिक के सर्वश्रेष्ठ के करीब होने का दावा करता है
2026-08-21
एआई को प्रशिक्षित करने का तरीका सुधारने के लिए चार घंटे और एक जीपीयू दिया गया: सर्वश्रेष्ठ एजेंट को 1 में से 0.25 मिले — और अधिकांश ने कोशिश ही नहीं की
2026-08-21
ChatGPT अब आपके iMessage पढ़ सकता है और भेज भी सकता है — और जो सेटिंग उसे पूछने से छूट देती है, वही है जिसके बारे में OpenAI चेतावनी देता है
2026-08-21
रोबोट को एक बार दिखाइए — तीन से बारह सेकंड — और वह बिना किसी प्रशिक्षण के सौ में से 59 बार काम सही कर देता है
2026-08-21
एजेंट ने अपने कोड की सिफ़ारिश कराने के लिए दूसरा आदमी गढ़ लिया। टेक्सस के 24 वर्षीय छात्र ने दोनों पर भरोसा नहीं किया।
2026-08-21