aiminute. ← सभी AI समाचार
अनुसंधान AI Minute Newsroom 2026-08-16

उन्होंने ऐसा भाषा मॉडल बनाया जिसने पाँचवीं कक्षा से ऊपर कुछ नहीं पढ़ा — फिर पाया कि वे उसे और नहीं सिखा सकते

उन्होंने ऐसा भाषा मॉडल बनाया जिसने पाँचवीं कक्षा से ऊपर कुछ नहीं पढ़ा — फिर पाया कि वे उसे और नहीं सिखा सकते

मैक्स प्लांक इंस्टिट्यूट फ़ॉर इंटेलिजेंट सिस्टम्स, ELLIS इंस्टिट्यूट ट्यूबिंगन और ETH ज़्यूरिख़ के शोधकर्ताओं ने LittleLearner जारी किया: 0.6B, 1.3B और 5B पैरामीटर वाले भाषा मॉडल, जो 88 अरब टोकन के एक कोष पर शून्य से प्रशिक्षित हैं। यह कोष FineWeb-Edu से पाँच-चरणीय छननी के ज़रिये निकाला गया, अमेरिकी कॉमन कोर मानकों के अनुरूप ढाला गया, और उसमें से कक्षा 5 से ऊपर पढ़ाई जाने वाली हर चीज़ हटा दी गई। हर मॉडल का एक जोड़ीदार नियंत्रण-मॉडल भी है, जो उसी प्रक्रिया से पर बिना छननी के प्रशिक्षित हुआ। मुख्य निष्कर्ष: मॉडल का आकार बढ़ाना, SFT और GRPO से पश्च-प्रशिक्षण, और संदर्भ-आधारित सीखना — ये सब पाठ्यक्रम में पहले से मौजूद चीज़ को बढ़ाते हैं, पर इनमें से कोई भी उसके बाहर के ज्ञान पर प्रदर्शन को उल्लेखनीय रूप से नहीं सुधारता। कोष और मॉडल ज्ञान-अर्जन के अध्ययन के लिए प्रयोगशाला के रूप में प्रकाशित हुए हैं।

यह क्यों मायने रखता हैमॉडल ने क्या "सीखा", इस बारे में लगभग हर दावा अपरीक्ष्य है, क्योंकि कोई नहीं बता सकता कि प्रशिक्षण डेटा में क्या था। इस मॉडल की सीमा जानबूझकर खींची गई है, जिससे यह उस बहस के लिए नियंत्रित प्रयोगशाला बन जाता है जो यह क्षेत्र बार-बार करता है: मॉडल सुधारने की मानक तकनीकें सचमुच ज्ञान जोड़ती हैं, या बस पहले से मौजूद चीज़ को और खींच लाती हैं? इस सीमा के भीतर उत्तर दूसरा निकला — और यह ऐसा नतीजा है जो किसी अज्ञात आहार वाले अग्रणी मॉडल को कुरेदकर नहीं मिल सकता।
#विज्ञान और अनुसंधान

✓ सत्यापित · 2 स्रोत

WhatsApp X Telegram
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ

संबंधित खबरें

अमेरिका ने 16 देशों को विज्ञान के केंद्र में AI रखवाया
2026-10-05
गणितज्ञों ने आम चैट बॉक्स से पाँच खुली समस्याएँ सुलझाईं
2026-10-05
कच्चे मॉडल ने वे काम किए जो उनके चमकाए संस्करण नहीं कर सके।
2026-10-04
आम तस्वीरों से सीखे मॉडल ने तर्क परीक्षा में 70% अंक पाए
2026-10-04
गूगल ने अपने एआई चिप कक्षा में भेजे, टिकाऊपन जांचने के लिए।
2026-10-03