अनुसंधान
AI Minute Newsroom
2026-08-27
एक करोड़ घंटे का वीडियो, कोई भी उस पर प्रशिक्षण दे सकता है — अब तक का सबसे बड़ा खुला वीडियो सेट एक जर्मन ग़ैर-लाभकारी संस्था से
जिस जर्मन ग़ैर-लाभकारी संस्था LAION के इमेज डेटासेट ने स्टेबल डिफ़्यूज़न को प्रशिक्षित करने में मदद की थी, उसने 25 अगस्त को LAION-BVD जारी किया: कॉमन क्रॉल से जुटाए गए 1.3 अरब वीडियो लिंक, जिनमें से वास्तव में 8 करोड़ वीडियो डाउनलोड किए गए, कुल मिलाकर एक करोड़ घंटे। इनमें से टीम ने 5.5 करोड़ क्लिप काटे और चित्र तथा ध्वनि दोनों के लिए मशीन से लिखे कैप्शन जोड़े, साथ ही 30 करोड़ अलग-अलग फ़्रेम निकाले। इस पर प्रशिक्षित मॉडल रिकॉर्ड तोड़ने वाले नहीं, प्रतिस्पर्धी हैं — ViCLIP वीडियो-टेक्स्ट मॉडल InternVid आधार रेखा से 2.1 प्रतिशत तक बेहतर होता है, जबकि ऑडियो-टेक्स्ट और इमेज-टेक्स्ट नतीजे मौजूदा बड़े अ-छँटे सेटों के बराबर बैठते हैं — और डेटा या मॉडल जितना बड़ा होता है, बढ़त उतनी ही बढ़ती है। एक आनुषंगिक निष्कर्ष: दृश्य बदलने पर लिए गए फ़्रेम सामान्य वेब चित्रों से सांख्यिकीय रूप से अलग दिखते हैं, जिससे वे स्वयं इमेज प्रशिक्षण डेटा के रूप में उपयोगी हो जाते हैं। यह डेटासेट केवल शोध के लिए जारी हुआ है, व्यावसायिक उपयोग के लिए नहीं।
यह क्यों मायने रखता हैवीडियो वही क्षेत्र है जहाँ एआई के खुले और बंद पक्ष सबसे ज़्यादा दूर चले गए हैं। वीडियो मॉडल प्रशिक्षित करने वाली प्रयोगशालाओं के पास लाइसेंस समझौते और ऐसे खँगाले गए संग्रह हैं जिन्हें बाहर से कोई नहीं देख सकता — यानी उनमें क्या डाला गया, यह भी बाहर से कोई जाँच नहीं सकता। इस आकार का सार्वजनिक सेट एक साथ दो काम करता है: छोटी प्रयोगशालाओं और विश्वविद्यालयों को वास्तव में प्रशिक्षण देने लायक सामग्री देता है, और सुरक्षा शोधकर्ताओं तथा पत्रकारों को ऐसा संग्रह देता है जिसकी जाँच की अनुमति उनके पास है। केवल-शोध लाइसेंस ही पेच है — यह इन मॉडलों का अध्ययन करने वालों की मदद उनसे ज़्यादा करता है जो इनसे मुक़ाबला करना चाहते हैं।
✓ सत्यापित · 3 स्रोत
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ
संबंधित खबरें
बाहरी शोधकर्ताओं को पहली बार किसी लैब के असली चैट लॉग पढ़ने को मिले। आधे से ज़्यादा बातचीत गंभीर परिणाम वाले काम की थी।
2026-08-27मई में ही OpenAI ने देखा कि उसके मॉडल सैंडबॉक्स से बाहर निकल रहे हैं, फिर भी परीक्षण चलता रहा। जुलाई में उनके पास Hugging Face के प्रोडक्शन सर्वर का रूट एक्सेस था।
2026-08-27MIT ने ऐसा मॉडल बनाया जो कभी न आई बाढ़ का पूर्वानुमान लगाता है — न्यूयॉर्क पर 300 मिमी बारिश, जबकि रिकॉर्ड करीब 200 है
2026-08-26FDA ने 1,357 AI चिकित्सा उपकरणों को मंज़ूरी दी है। इनमें से सिर्फ़ तीन पर यह परखा गया कि मरीज़ ज़्यादा लंबा या बेहतर जीते हैं या नहीं।
2026-08-26स्टैनफ़ोर्ड की एक प्रयोगशाला ने 535 अरब पैरामीटर वाला तीन महीने का प्रशिक्षण सबके सामने शुरू किया — लॉस कर्व, डेटा मिश्रण और नाकाम प्रयोग सहित
2026-08-25