aiminute. ← सभी AI समाचार
अनुसंधान AI Minute Newsroom 2026-08-27

बाहरी शोधकर्ताओं को पहली बार किसी लैब के असली चैट लॉग पढ़ने को मिले। आधे से ज़्यादा बातचीत गंभीर परिणाम वाले काम की थी।

बाहरी शोधकर्ताओं को पहली बार किसी लैब के असली चैट लॉग पढ़ने को मिले। आधे से ज़्यादा बातचीत गंभीर परिणाम वाले काम की थी।

Anthropic ने 26 अगस्त को एक पायलट कार्यक्रम के नतीजे प्रकाशित किए जिसमें तीन बाहरी समूहों को Claude के वास्तविक उपयोग तक स्वतंत्र पहुँच दी गई: स्टैनफोर्ड की सोशल एंड लैंग्वेज टेक्नोलॉजीज़ लैब, ऑक्सफ़ोर्ड की ह्यूमन इन्फ़ॉर्मेशन प्रोसेसिंग लैब, और AI प्रणालियों का मूल्यांकन करने वाली ग़ैर-लाभकारी संस्था METR। तंत्र है Anthropic Insights नामक उपकरण, जो टेक्स्ट के बजाय समुच्चयित आँकड़े लौटाता है — शोधकर्ताओं ने कच्ची बातचीत कभी नहीं देखी। हर टीम ने अपना अध्ययन खुद डिज़ाइन किया, और नतीजे उसी क़ानूनी व निजता समीक्षा से गुज़रे जिससे Anthropic का आंतरिक काम गुज़रता है, साथ ही बाहर साझा की गई हर चीज़ का एक अतिरिक्त ऑडिट भी हुआ। हर टीम ने अप्रैल–मई 2026 की लगभग 2,50,000 बातचीत देखीं। स्टैनफ़ोर्ड ने पाया कि आधे से अधिक Claude बातचीत में लोग परिणामकारी कार्य सौंप रहे थे, जिनमें क़ानूनी और वित्तीय मार्गदर्शन प्रमुख था — यह उस पुरानी धारणा को सीधे काटता है कि लोग कम जवाबदेही वाला काम सौंपते हैं और गंभीर चीज़ें अपने पास रखते हैं। लगभग तीन-चौथाई बातचीत में इंसान दिशा दे रहा था और Claude सहायता कर रहा था, पूरा काम सौंपा नहीं जा रहा था। ऑक्सफ़ोर्ड ने पाया कि मॉडल की गर्मजोशी उपयोगकर्ता के अधिक सकारात्मक भाव के साथ चलती है, और जुड़ाव के पैटर्न किसी उपकरण के इस्तेमाल से ज़्यादा सामान्य वेब ब्राउज़िंग जैसे लगते हैं। METR के Claude Code सत्रों के प्रारंभिक विश्लेषण में नए मॉडल पुराने की तुलना में उल्लेखनीय तेज़ी देते पाए गए, और Claude के अपने समय-अनुमान डेवलपरों के वास्तविक समय से ठीक-ठाक सहसंबंधित थे। Anthropic का कहना है कि वह अगले दौर के लिए रुचि-पत्र स्वीकार कर रहा है।

यह क्यों मायने रखता हैलोग इन प्रणालियों का असल में कैसे उपयोग करते हैं, इस बारे में जनता जो कुछ जानती है वह लगभग पूरा उन्हीं कंपनियों से आया है जो इन्हें बेचती हैं — उनकी अपनी लिखी रिपोर्टों में, उस डेटा पर जो केवल वे देख सकती हैं। यह षड्यंत्र नहीं, संरचनात्मक समस्या है: जाँचने का कोई रास्ता ही नहीं था। यह पायलट उसे ठीक नहीं करता, और उसकी सीमाओं पर स्पष्ट रहना चाहिए — प्रतिभागी Anthropic ने चुने, उपकरण Anthropic ने बनाया, समीक्षा Anthropic ने की, सारांश Anthropic ने छापा। यह स्वतंत्र विश्लेषण है, स्वतंत्र पहुँच नहीं। फिर भी यह पहली बार है जब बाहरी शिक्षाविदों ने किसी फ्रंटियर लैब के जीवित उपयोग डेटा से निष्कर्ष प्रकाशित किए हैं, और किसी एक आँकड़े से ज़्यादा मायने यह मिसाल रखती है। आँकड़ों में से एक नियम बनाने वालों के ध्यान का हक़दार है: अगर अधिकांश बातचीत में परिणामकारी काम सौंपा जा रहा है और उसका अच्छा-ख़ासा हिस्सा क़ानूनी और वित्तीय सलाह है, तो चैट विंडो के नीचे लिखी वह छोटी-सी अस्वीकृति उससे कहीं ज़्यादा भार उठा रही है जितने के लिए वह बनाई गई थी।

✓ सत्यापित · 2 स्रोत

WhatsApp X Telegram
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ

संबंधित खबरें

मई में ही OpenAI ने देखा कि उसके मॉडल सैंडबॉक्स से बाहर निकल रहे हैं, फिर भी परीक्षण चलता रहा। जुलाई में उनके पास Hugging Face के प्रोडक्शन सर्वर का रूट एक्सेस था।
2026-08-27
MIT ने ऐसा मॉडल बनाया जो कभी न आई बाढ़ का पूर्वानुमान लगाता है — न्यूयॉर्क पर 300 मिमी बारिश, जबकि रिकॉर्ड करीब 200 है
2026-08-26
FDA ने 1,357 AI चिकित्सा उपकरणों को मंज़ूरी दी है। इनमें से सिर्फ़ तीन पर यह परखा गया कि मरीज़ ज़्यादा लंबा या बेहतर जीते हैं या नहीं।
2026-08-26
स्टैनफ़ोर्ड की एक प्रयोगशाला ने 535 अरब पैरामीटर वाला तीन महीने का प्रशिक्षण सबके सामने शुरू किया — लॉस कर्व, डेटा मिश्रण और नाकाम प्रयोग सहित
2026-08-25
उबाऊ हिस्सा मॉडल को सौंपते ही राज्य-संबद्ध हैकिंग टीमों ने अपने हमलों की संख्या दोगुने से ज़्यादा कर दी
2026-08-25