aiminute. ← सभी AI समाचार
अनुसंधान 2026-08-07

स्वतंत्र बेंचमार्क: Qwen3.8-Max अमेरिकी फ्रंटियर के ठीक नीचे — पर कहीं ज़्यादा मेहनत करके

स्वतंत्र बेंचमार्क: Qwen3.8-Max अमेरिकी फ्रंटियर के ठीक नीचे — पर कहीं ज़्यादा मेहनत करके

Artificial Analysis ने अलीबाबा के Qwen3.8-Max को अपने इंटेलिजेंस इंडेक्स पर 56 अंक दिए — गूगल, Meta और xAI के हर मॉडल से ऊपर; सिर्फ Anthropic और OpenAI के शीर्ष संस्करण तथा Kimi K3 इससे आगे हैं। एजेंटिक GDPval-AA लीडरबोर्ड पर यह 1739 Elo के साथ दूसरे स्थान पर है, आगे केवल Claude Opus 5 max (1852)। लेकिन कीमत भी है: प्रति एजेंटिक कार्य औसतन 64 टर्न (Qwen3.7-Max में 14), और प्रति कार्य लागत दोगुनी से ज़्यादा होकर 1.14 डॉलर।

यह क्यों मायने रखता हैस्वतंत्र आँकड़े अब दो चीनी ओपन-वेट मॉडलों को वैश्विक शीर्ष चार में रखते हैं — पर टर्न-संख्या का ब्योरा उतना ही अहम है: फासला ताकत झोंककर पाटा जा रहा है, और यह मेहनत असली तैनाती के बिलों में दिखती है। बेंचमार्क रैंक और प्रति-कार्य लागत अलग-अलग दिशा में जा रहे हैं; खरीदारों को दोनों पढ़ने चाहिए।
#AI एजेंट

✓ सत्यापित · 2 स्रोत

WhatsApp X Telegram
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ

संबंधित खबरें

मशीन लर्निंग ने बीमार मस्तिष्क कोशिकाओं का आकार पढ़ा और नौ पहले से स्वीकृत दवाएँ चुनीं जिन्होंने उन्हें शांत किया
2026-08-21
डीपसीक का सस्ता वर्कहॉर्स अब देख सकता है — और आँखों वाली एजेंट कार्यों में वह एंथ्रोपिक के सर्वश्रेष्ठ के करीब होने का दावा करता है
2026-08-21
एआई को प्रशिक्षित करने का तरीका सुधारने के लिए चार घंटे और एक जीपीयू दिया गया: सर्वश्रेष्ठ एजेंट को 1 में से 0.25 मिले — और अधिकांश ने कोशिश ही नहीं की
2026-08-21
ChatGPT अब आपके iMessage पढ़ सकता है और भेज भी सकता है — और जो सेटिंग उसे पूछने से छूट देती है, वही है जिसके बारे में OpenAI चेतावनी देता है
2026-08-21
एजेंट ने अपने कोड की सिफ़ारिश कराने के लिए दूसरा आदमी गढ़ लिया। टेक्सस के 24 वर्षीय छात्र ने दोनों पर भरोसा नहीं किया।
2026-08-21