नए मॉडल
2026-08-17
एक कोरियाई प्रयोगशाला ने अपने ही मॉडल का स्कोर एक पीढ़ी में तीन गुना कर दिया — और दाम है 30 सेंट प्रति दस लाख टोकन
Upstage ने इस महीने Solar Pro 4 जारी किया। Artificial Analysis के इंटेलिजेंस इंडेक्स पर इसका स्कोर 42 है, जबकि Solar Pro 3 का 14 था — इस साल किसी भी प्रयोगशाला द्वारा एक पीढ़ी में दर्ज की गई सबसे बड़ी छलाँगों में से एक। इससे यह Thinking Machines के Inkling के बराबर आ जाता है और MiMo-V2.5-Pro से एक अंक पीछे। बढ़त वहीं केंद्रित है जहाँ Upstage का कहना है कि उसने इसे बनाया — एजेंट कार्यों में। Terminal-Bench v2.1 43.2 से 57 पर पहुँचा, AA-LCR पर लंबे दस्तावेज़ों का तर्क 62.7 से 71 पर, और GDPval-AA v2 एजेंट बेंचमार्क पर इसका Elo 498 से 1277 हो गया, जबकि मानव आधाररेखा 1000 है। कीमत प्रति दस लाख इनपुट टोकन 0.30 डॉलर और प्रति दस लाख आउटपुट टोकन 1.20 डॉलर है, कैश हिट 0.06 डॉलर पर, फ़िलहाल 10 सितंबर तक 90% छूट के साथ। संदर्भ 3,84,000 टोकन का है, आउटपुट 2,56,000 टोकन तक, केवल टेक्स्ट, Upstage के API और OpenRouter के ज़रिए। इसकी कीमत भी है: मॉडल अपने पूर्ववर्ती से 17% कम आउटपुट टोकन इस्तेमाल करता है, पर प्रति कार्य 6.0 मिनट के बजाय 8.6 मिनट लेता है। यह अंग्रेज़ी, कोरियाई और जापानी में काम करता है।
यह क्यों मायने रखता हैदिलचस्प संख्या 42 नहीं है — वहाँ बहुत से मॉडल बैठे हैं। दिलचस्प है एक ही पीढ़ी में 14 से 42, और वह भी उस प्रयोगशाला से जिसे कोरिया के बाहर अधिकांश लोगों ने कभी परखा तक नहीं। इस श्रेणी तक पहुँचने का नुस्खा अब इतना समझा जा चुका है कि एक मध्यम आकार की राष्ट्रीय प्रयोगशाला उसे महीनों में लागू कर सकती है — यही वजह है कि दामों का फ़र्श सीमा-रेखा के आगे बढ़ने से भी तेज़ी से गिर रहा है। मानव आधाररेखा से ऊपर के एजेंट Elo को उसी सावधानी से लें जो किसी एक बेंचमार्क के लिए ज़रूरी है, और विलंब पर ध्यान दें: यह स्कोर सिर्फ़ बेहतर वेट्स से नहीं, घड़ी के समय से भी खरीदा गया है।
✓ सत्यापित · 3 स्रोत
▶ संबंधित वीडियो: Solar Pro 4 First Look & Test – South Korea's DeepSeek Competitor!
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ
संबंधित खबरें
डीपसीक का सस्ता वर्कहॉर्स अब देख सकता है — और आँखों वाली एजेंट कार्यों में वह एंथ्रोपिक के सर्वश्रेष्ठ के करीब होने का दावा करता है
2026-08-21एआई को प्रशिक्षित करने का तरीका सुधारने के लिए चार घंटे और एक जीपीयू दिया गया: सर्वश्रेष्ठ एजेंट को 1 में से 0.25 मिले — और अधिकांश ने कोशिश ही नहीं की
2026-08-21ChatGPT अब आपके iMessage पढ़ सकता है और भेज भी सकता है — और जो सेटिंग उसे पूछने से छूट देती है, वही है जिसके बारे में OpenAI चेतावनी देता है
2026-08-21रोबोट को एक बार दिखाइए — तीन से बारह सेकंड — और वह बिना किसी प्रशिक्षण के सौ में से 59 बार काम सही कर देता है
2026-08-21एजेंट ने अपने कोड की सिफ़ारिश कराने के लिए दूसरा आदमी गढ़ लिया। टेक्सस के 24 वर्षीय छात्र ने दोनों पर भरोसा नहीं किया।
2026-08-21