aiminute. ← सभी AI समाचार
टूल्स AI Minute Newsroom 2026-08-23

30 करोड़ पैरामीटर वाला एक मॉडल अंदाज़ा लगाता है कि बड़ा मॉडल आगे क्या कहेगा — और मैकबुक 2.87 गुना तेज़ जवाब देता है

30 करोड़ पैरामीटर वाला एक मॉडल अंदाज़ा लगाता है कि बड़ा मॉडल आगे क्या कहेगा — और मैकबुक 2.87 गुना तेज़ जवाब देता है

Liquid AI ने 20 अगस्त को DSpark प्रकाशित किया: लगभग 30 करोड़ पैरामीटर वाले छोटे ड्राफ़्ट मॉडल, जो उसके LFM2.5 परिवार — 1.2B Instruct, 2.6B और 8B-A1B — के साथ एक-से-एक जोड़े गए हैं। ड्राफ़्ट नौ टोकन का एक ब्लॉक आगे प्रस्तावित करता है, असली मॉडल पूरे ब्लॉक को एक ही फ़ॉरवर्ड पास में जाँचता है, और जिससे वह असहमत हो उसे हटा दिया जाता है। ग्रीडी डिकोडिंग में निकलने वाला पाठ बड़े मॉडल के अकेले चलने जैसा बिल्कुल एक समान होता है, इसलिए बेंचमार्क सटीकता ज़रा भी नहीं बदलती। बदलता है समय: H100 पर 3.18 गुना तक, M4 Max मैकबुक प्रो पर 2.87 गुना तक; 2.6B मॉडल उस लैपटॉप पर लगभग 140 टोकन प्रति सेकंड से ऊपर जाता है, और बहु-टूल परीक्षणों में औसतन 57 प्रतिशत कम विलंब देता है। पेच स्वीकृति दर में है। MATH500 पर 8B-A1B ड्राफ़्ट के प्रस्तावित हर 10 टोकन में से 8.27 स्वीकार होते हैं, जो 3.18 गुना के बराबर है। GSM8K पर यह 4.02 रह जाता है, यानी 1.29 गुना — वही हार्डवेयर, वही मॉडल, लाभ लगभग एक-तिहाई।

यह क्यों मायने रखता हैस्पेक्युलेटिव डिकोडिंग उन दुर्लभ अनुकूलनों में है जिनके साथ गुणवत्ता का कोई विवाद नहीं जुड़ता: आउटपुट प्रमाणित रूप से वही पाठ होता है, इसलिए एकमात्र सवाल यह है कि छोटा मॉडल कितनी बार सही अंदाज़ा लगाता है। इसीलिए आपको बेचे जा रहे किसी भी गति-वृद्धि के आँकड़े पर भरोसा करने से पहले इसे समझ लेना उपयोगी है। '3 गुना तेज़' कहने वाला विक्रेता अपने सबसे अच्छे कार्यभार की बात कर रहा होता है; आपको वास्तव में क्या मिलेगा, यह आपका कार्यभार तय करता है, और यहाँ 3.18 और 1.29 के बीच की दूरी ही पूरा सबक है। यह सबसे ज़्यादा उन लोगों के लिए मायने रखता है जो एपीआई के बजाय अपनी मशीन पर मॉडल चलाते हैं, क्योंकि यही वह बदलाव है जो किसी स्थानीय मॉडल को 'इतना धीमा कि झंझट' से 'इतना तेज़ कि चालू छोड़ा जा सके' तक ले आता है।

✓ सत्यापित · 2 स्रोत

WhatsApp X Telegram
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ

संबंधित खबरें

गूगल आपके लिखे एक वाक्य से खेलने लायक खेल बना देता है।
2026-10-08
ChatGPT अब जवाब के साथ परदे की बनावट भी मॉडल से तय कराता है।
2026-10-08
मेटा और सियरा ने ख़रीदारी एजेंट के लिए एक लॉगिन नियम रखा।
2026-10-07
एक एआई ने छोटे भाषा मॉडल चलाने वाली खुली चिप बनाई।
2026-10-07
ओपनएआई का नया एपीआई 150 मिलीसेकंड में एक विकल्प चुनता है।
2026-10-07