अनुसंधान
AI Minute Newsroom
2026-08-27
बाहरी शोधकर्ताओं को पहली बार किसी लैब के असली चैट लॉग पढ़ने को मिले। आधे से ज़्यादा बातचीत गंभीर परिणाम वाले काम की थी।
Anthropic ने 26 अगस्त को एक पायलट कार्यक्रम के नतीजे प्रकाशित किए जिसमें तीन बाहरी समूहों को Claude के वास्तविक उपयोग तक स्वतंत्र पहुँच दी गई: स्टैनफोर्ड की सोशल एंड लैंग्वेज टेक्नोलॉजीज़ लैब, ऑक्सफ़ोर्ड की ह्यूमन इन्फ़ॉर्मेशन प्रोसेसिंग लैब, और AI प्रणालियों का मूल्यांकन करने वाली ग़ैर-लाभकारी संस्था METR। तंत्र है Anthropic Insights नामक उपकरण, जो टेक्स्ट के बजाय समुच्चयित आँकड़े लौटाता है — शोधकर्ताओं ने कच्ची बातचीत कभी नहीं देखी। हर टीम ने अपना अध्ययन खुद डिज़ाइन किया, और नतीजे उसी क़ानूनी व निजता समीक्षा से गुज़रे जिससे Anthropic का आंतरिक काम गुज़रता है, साथ ही बाहर साझा की गई हर चीज़ का एक अतिरिक्त ऑडिट भी हुआ। हर टीम ने अप्रैल–मई 2026 की लगभग 2,50,000 बातचीत देखीं। स्टैनफ़ोर्ड ने पाया कि आधे से अधिक Claude बातचीत में लोग परिणामकारी कार्य सौंप रहे थे, जिनमें क़ानूनी और वित्तीय मार्गदर्शन प्रमुख था — यह उस पुरानी धारणा को सीधे काटता है कि लोग कम जवाबदेही वाला काम सौंपते हैं और गंभीर चीज़ें अपने पास रखते हैं। लगभग तीन-चौथाई बातचीत में इंसान दिशा दे रहा था और Claude सहायता कर रहा था, पूरा काम सौंपा नहीं जा रहा था। ऑक्सफ़ोर्ड ने पाया कि मॉडल की गर्मजोशी उपयोगकर्ता के अधिक सकारात्मक भाव के साथ चलती है, और जुड़ाव के पैटर्न किसी उपकरण के इस्तेमाल से ज़्यादा सामान्य वेब ब्राउज़िंग जैसे लगते हैं। METR के Claude Code सत्रों के प्रारंभिक विश्लेषण में नए मॉडल पुराने की तुलना में उल्लेखनीय तेज़ी देते पाए गए, और Claude के अपने समय-अनुमान डेवलपरों के वास्तविक समय से ठीक-ठाक सहसंबंधित थे। Anthropic का कहना है कि वह अगले दौर के लिए रुचि-पत्र स्वीकार कर रहा है।
यह क्यों मायने रखता हैलोग इन प्रणालियों का असल में कैसे उपयोग करते हैं, इस बारे में जनता जो कुछ जानती है वह लगभग पूरा उन्हीं कंपनियों से आया है जो इन्हें बेचती हैं — उनकी अपनी लिखी रिपोर्टों में, उस डेटा पर जो केवल वे देख सकती हैं। यह षड्यंत्र नहीं, संरचनात्मक समस्या है: जाँचने का कोई रास्ता ही नहीं था। यह पायलट उसे ठीक नहीं करता, और उसकी सीमाओं पर स्पष्ट रहना चाहिए — प्रतिभागी Anthropic ने चुने, उपकरण Anthropic ने बनाया, समीक्षा Anthropic ने की, सारांश Anthropic ने छापा। यह स्वतंत्र विश्लेषण है, स्वतंत्र पहुँच नहीं। फिर भी यह पहली बार है जब बाहरी शिक्षाविदों ने किसी फ्रंटियर लैब के जीवित उपयोग डेटा से निष्कर्ष प्रकाशित किए हैं, और किसी एक आँकड़े से ज़्यादा मायने यह मिसाल रखती है। आँकड़ों में से एक नियम बनाने वालों के ध्यान का हक़दार है: अगर अधिकांश बातचीत में परिणामकारी काम सौंपा जा रहा है और उसका अच्छा-ख़ासा हिस्सा क़ानूनी और वित्तीय सलाह है, तो चैट विंडो के नीचे लिखी वह छोटी-सी अस्वीकृति उससे कहीं ज़्यादा भार उठा रही है जितने के लिए वह बनाई गई थी।
✓ सत्यापित · 2 स्रोत
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ
संबंधित खबरें
मई में ही OpenAI ने देखा कि उसके मॉडल सैंडबॉक्स से बाहर निकल रहे हैं, फिर भी परीक्षण चलता रहा। जुलाई में उनके पास Hugging Face के प्रोडक्शन सर्वर का रूट एक्सेस था।
2026-08-27MIT ने ऐसा मॉडल बनाया जो कभी न आई बाढ़ का पूर्वानुमान लगाता है — न्यूयॉर्क पर 300 मिमी बारिश, जबकि रिकॉर्ड करीब 200 है
2026-08-26FDA ने 1,357 AI चिकित्सा उपकरणों को मंज़ूरी दी है। इनमें से सिर्फ़ तीन पर यह परखा गया कि मरीज़ ज़्यादा लंबा या बेहतर जीते हैं या नहीं।
2026-08-26स्टैनफ़ोर्ड की एक प्रयोगशाला ने 535 अरब पैरामीटर वाला तीन महीने का प्रशिक्षण सबके सामने शुरू किया — लॉस कर्व, डेटा मिश्रण और नाकाम प्रयोग सहित
2026-08-25उबाऊ हिस्सा मॉडल को सौंपते ही राज्य-संबद्ध हैकिंग टीमों ने अपने हमलों की संख्या दोगुने से ज़्यादा कर दी
2026-08-25