टूल्स
AI Minute Newsroom
2026-08-23
30 करोड़ पैरामीटर वाला एक मॉडल अंदाज़ा लगाता है कि बड़ा मॉडल आगे क्या कहेगा — और मैकबुक 2.87 गुना तेज़ जवाब देता है
Liquid AI ने 20 अगस्त को DSpark प्रकाशित किया: लगभग 30 करोड़ पैरामीटर वाले छोटे ड्राफ़्ट मॉडल, जो उसके LFM2.5 परिवार — 1.2B Instruct, 2.6B और 8B-A1B — के साथ एक-से-एक जोड़े गए हैं। ड्राफ़्ट नौ टोकन का एक ब्लॉक आगे प्रस्तावित करता है, असली मॉडल पूरे ब्लॉक को एक ही फ़ॉरवर्ड पास में जाँचता है, और जिससे वह असहमत हो उसे हटा दिया जाता है। ग्रीडी डिकोडिंग में निकलने वाला पाठ बड़े मॉडल के अकेले चलने जैसा बिल्कुल एक समान होता है, इसलिए बेंचमार्क सटीकता ज़रा भी नहीं बदलती। बदलता है समय: H100 पर 3.18 गुना तक, M4 Max मैकबुक प्रो पर 2.87 गुना तक; 2.6B मॉडल उस लैपटॉप पर लगभग 140 टोकन प्रति सेकंड से ऊपर जाता है, और बहु-टूल परीक्षणों में औसतन 57 प्रतिशत कम विलंब देता है। पेच स्वीकृति दर में है। MATH500 पर 8B-A1B ड्राफ़्ट के प्रस्तावित हर 10 टोकन में से 8.27 स्वीकार होते हैं, जो 3.18 गुना के बराबर है। GSM8K पर यह 4.02 रह जाता है, यानी 1.29 गुना — वही हार्डवेयर, वही मॉडल, लाभ लगभग एक-तिहाई।
यह क्यों मायने रखता हैस्पेक्युलेटिव डिकोडिंग उन दुर्लभ अनुकूलनों में है जिनके साथ गुणवत्ता का कोई विवाद नहीं जुड़ता: आउटपुट प्रमाणित रूप से वही पाठ होता है, इसलिए एकमात्र सवाल यह है कि छोटा मॉडल कितनी बार सही अंदाज़ा लगाता है। इसीलिए आपको बेचे जा रहे किसी भी गति-वृद्धि के आँकड़े पर भरोसा करने से पहले इसे समझ लेना उपयोगी है। '3 गुना तेज़' कहने वाला विक्रेता अपने सबसे अच्छे कार्यभार की बात कर रहा होता है; आपको वास्तव में क्या मिलेगा, यह आपका कार्यभार तय करता है, और यहाँ 3.18 और 1.29 के बीच की दूरी ही पूरा सबक है। यह सबसे ज़्यादा उन लोगों के लिए मायने रखता है जो एपीआई के बजाय अपनी मशीन पर मॉडल चलाते हैं, क्योंकि यही वह बदलाव है जो किसी स्थानीय मॉडल को 'इतना धीमा कि झंझट' से 'इतना तेज़ कि चालू छोड़ा जा सके' तक ले आता है।
✓ सत्यापित · 2 स्रोत
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ
संबंधित खबरें
लोगों के लिए नहीं, कोड लिखने वाले एजेंटों के लिए बना सर्च इंडेक्स: 7 करोड़ README, इशू और पुल रिक्वेस्ट — आज़माने को कुंजी तक नहीं चाहिए
2026-08-23एआई को आपके औज़ारों से जोड़ने वाला मानक इस मान्यता पर बना था कि कोई इंसान 'अनुमति दें' दबाएगा। उसका नया रोडमैप मानता है कि अब बुलाने वाला एक मशीन है।
2026-08-23OpenAI ने Codex के नीचे का इंजन मुफ़्त बाँट दिया — और उसके अपने आँकड़े कहते हैं कि इंजन मॉडल से ज़्यादा कीमती है
2026-08-22एक आवाज़ मॉडल जो 50 मिलीसेकंड से भी कम में बोलना शुरू कर देता है, और सर्विंग कोड खुला है
2026-08-22Anthropic अपने सबसे ताक़तवर मॉडल को आपके कोड में ख़ामियाँ ढूँढ़ने देगा, पर उससे बात नहीं करने देगा
2026-08-22