aiminute. ← सभी AI समाचार
टूल्स AI Minute Newsroom 2026-08-23

30 करोड़ पैरामीटर वाला एक मॉडल अंदाज़ा लगाता है कि बड़ा मॉडल आगे क्या कहेगा — और मैकबुक 2.87 गुना तेज़ जवाब देता है

30 करोड़ पैरामीटर वाला एक मॉडल अंदाज़ा लगाता है कि बड़ा मॉडल आगे क्या कहेगा — और मैकबुक 2.87 गुना तेज़ जवाब देता है

Liquid AI ने 20 अगस्त को DSpark प्रकाशित किया: लगभग 30 करोड़ पैरामीटर वाले छोटे ड्राफ़्ट मॉडल, जो उसके LFM2.5 परिवार — 1.2B Instruct, 2.6B और 8B-A1B — के साथ एक-से-एक जोड़े गए हैं। ड्राफ़्ट नौ टोकन का एक ब्लॉक आगे प्रस्तावित करता है, असली मॉडल पूरे ब्लॉक को एक ही फ़ॉरवर्ड पास में जाँचता है, और जिससे वह असहमत हो उसे हटा दिया जाता है। ग्रीडी डिकोडिंग में निकलने वाला पाठ बड़े मॉडल के अकेले चलने जैसा बिल्कुल एक समान होता है, इसलिए बेंचमार्क सटीकता ज़रा भी नहीं बदलती। बदलता है समय: H100 पर 3.18 गुना तक, M4 Max मैकबुक प्रो पर 2.87 गुना तक; 2.6B मॉडल उस लैपटॉप पर लगभग 140 टोकन प्रति सेकंड से ऊपर जाता है, और बहु-टूल परीक्षणों में औसतन 57 प्रतिशत कम विलंब देता है। पेच स्वीकृति दर में है। MATH500 पर 8B-A1B ड्राफ़्ट के प्रस्तावित हर 10 टोकन में से 8.27 स्वीकार होते हैं, जो 3.18 गुना के बराबर है। GSM8K पर यह 4.02 रह जाता है, यानी 1.29 गुना — वही हार्डवेयर, वही मॉडल, लाभ लगभग एक-तिहाई।

यह क्यों मायने रखता हैस्पेक्युलेटिव डिकोडिंग उन दुर्लभ अनुकूलनों में है जिनके साथ गुणवत्ता का कोई विवाद नहीं जुड़ता: आउटपुट प्रमाणित रूप से वही पाठ होता है, इसलिए एकमात्र सवाल यह है कि छोटा मॉडल कितनी बार सही अंदाज़ा लगाता है। इसीलिए आपको बेचे जा रहे किसी भी गति-वृद्धि के आँकड़े पर भरोसा करने से पहले इसे समझ लेना उपयोगी है। '3 गुना तेज़' कहने वाला विक्रेता अपने सबसे अच्छे कार्यभार की बात कर रहा होता है; आपको वास्तव में क्या मिलेगा, यह आपका कार्यभार तय करता है, और यहाँ 3.18 और 1.29 के बीच की दूरी ही पूरा सबक है। यह सबसे ज़्यादा उन लोगों के लिए मायने रखता है जो एपीआई के बजाय अपनी मशीन पर मॉडल चलाते हैं, क्योंकि यही वह बदलाव है जो किसी स्थानीय मॉडल को 'इतना धीमा कि झंझट' से 'इतना तेज़ कि चालू छोड़ा जा सके' तक ले आता है।

✓ सत्यापित · 2 स्रोत

WhatsApp X Telegram
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ

संबंधित खबरें

लोगों के लिए नहीं, कोड लिखने वाले एजेंटों के लिए बना सर्च इंडेक्स: 7 करोड़ README, इशू और पुल रिक्वेस्ट — आज़माने को कुंजी तक नहीं चाहिए
2026-08-23
एआई को आपके औज़ारों से जोड़ने वाला मानक इस मान्यता पर बना था कि कोई इंसान 'अनुमति दें' दबाएगा। उसका नया रोडमैप मानता है कि अब बुलाने वाला एक मशीन है।
2026-08-23
OpenAI ने Codex के नीचे का इंजन मुफ़्त बाँट दिया — और उसके अपने आँकड़े कहते हैं कि इंजन मॉडल से ज़्यादा कीमती है
2026-08-22
एक आवाज़ मॉडल जो 50 मिलीसेकंड से भी कम में बोलना शुरू कर देता है, और सर्विंग कोड खुला है
2026-08-22
Anthropic अपने सबसे ताक़तवर मॉडल को आपके कोड में ख़ामियाँ ढूँढ़ने देगा, पर उससे बात नहीं करने देगा
2026-08-22