aiminute. ← सभी AI समाचार
अनुसंधान AI Minute Newsroom 2026-08-08

ARC Prize ने DeepSeek V4 Flash को सत्यापित किया: ARC-AGI-2 पर 61%, चार सेंट प्रति टास्क

ARC Prize ने DeepSeek V4 Flash को सत्यापित किया: ARC-AGI-2 पर 61%, चार सेंट प्रति टास्क

ARC Prize टीम ने DeepSeek के ओपन-वेट मॉडल V4 Flash 0731 के सत्यापित सेमी-प्राइवेट नतीजे जारी किए: अधिकतम रीज़निंग स्तर पर ARC-AGI-1 में 89.0% (लगभग दो सेंट प्रति टास्क) और ARC-AGI-2 में 61.4% (लगभग चार सेंट प्रति टास्क)। यह मॉडल 284 अरब पैरामीटर वाला मिक्सचर-ऑफ-एक्सपर्ट्स है, जो हर टोकन पर सिर्फ़ 13 अरब पैरामीटर सक्रिय करता है और 10 लाख टोकन का कॉन्टेक्स्ट सँभालता है। नतीजा Hacker News के शीर्ष पर पहुँच गया, जहाँ सबसे ज़्यादा चर्चा इसके क़ीमत-प्रदर्शन अनुपात की रही।

यह क्यों मायने रखता हैARC-AGI-2 को रटने से बचने और असली अमूर्त तर्कशक्ति को परखने के लिए बनाया गया था; कम सक्रिय पैरामीटर वाले एक ओपन मॉडल का मामूली दामों पर ऐसा स्कोर ओपन और क्लोज़्ड AI के बीच की एक और खाई पाट देता है। डेवलपरों के लिए मतलब साफ़ है: फ्रंटियर के क़रीब की रीज़निंग अब सिर्फ़ किराए पर लेने की नहीं, डाउनलोड करके चलाने की चीज़ है।

✓ सत्यापित · 2 स्रोत

▶ संबंधित वीडियो: DeepSeek V4 Flash GA IS INCREDIBLE! Powerful, Cheap, & Fast! (Fully Tested)
WhatsApp X Telegram
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ

संबंधित खबरें

एक मॉडल उस तरीके के बिना सीखा जिससे हर AI सीखता है।
2026-10-06
गणितज्ञों ने आम चैट बॉक्स से पाँच खुली समस्याएँ सुलझाईं
2026-10-05
कच्चे मॉडल ने वे काम किए जो उनके चमकाए संस्करण नहीं कर सके।
2026-10-04
आम तस्वीरों से सीखे मॉडल ने तर्क परीक्षा में 70% अंक पाए
2026-10-04
आठ हज़ार डॉलर में बना एआई स्ट्रैटेगो के सबसे बड़े खिलाड़ी से जीता।
2026-10-03