अनुसंधान
AI Minute Newsroom
2026-08-27
बाहरी शोधकर्ताओं को पहली बार किसी लैब के असली चैट लॉग पढ़ने को मिले। आधे से ज़्यादा बातचीत गंभीर परिणाम वाले काम की थी।
Anthropic ने 26 अगस्त को एक पायलट कार्यक्रम के नतीजे प्रकाशित किए जिसमें तीन बाहरी समूहों को Claude के वास्तविक उपयोग तक स्वतंत्र पहुँच दी गई: स्टैनफोर्ड की सोशल एंड लैंग्वेज टेक्नोलॉजीज़ लैब, ऑक्सफ़ोर्ड की ह्यूमन इन्फ़ॉर्मेशन प्रोसेसिंग लैब, और AI प्रणालियों का मूल्यांकन करने वाली ग़ैर-लाभकारी संस्था METR। तंत्र है Anthropic Insights नामक उपकरण, जो टेक्स्ट के बजाय समुच्चयित आँकड़े लौटाता है — शोधकर्ताओं ने कच्ची बातचीत कभी नहीं देखी। हर टीम ने अपना अध्ययन खुद डिज़ाइन किया, और नतीजे उसी क़ानूनी व निजता समीक्षा से गुज़रे जिससे Anthropic का आंतरिक काम गुज़रता है, साथ ही बाहर साझा की गई हर चीज़ का एक अतिरिक्त ऑडिट भी हुआ। हर टीम ने अप्रैल–मई 2026 की लगभग 2,50,000 बातचीत देखीं। स्टैनफ़ोर्ड ने पाया कि आधे से अधिक Claude बातचीत में लोग परिणामकारी कार्य सौंप रहे थे, जिनमें क़ानूनी और वित्तीय मार्गदर्शन प्रमुख था — यह उस पुरानी धारणा को सीधे काटता है कि लोग कम जवाबदेही वाला काम सौंपते हैं और गंभीर चीज़ें अपने पास रखते हैं। लगभग तीन-चौथाई बातचीत में इंसान दिशा दे रहा था और Claude सहायता कर रहा था, पूरा काम सौंपा नहीं जा रहा था। ऑक्सफ़ोर्ड ने पाया कि मॉडल की गर्मजोशी उपयोगकर्ता के अधिक सकारात्मक भाव के साथ चलती है, और जुड़ाव के पैटर्न किसी उपकरण के इस्तेमाल से ज़्यादा सामान्य वेब ब्राउज़िंग जैसे लगते हैं। METR के Claude Code सत्रों के प्रारंभिक विश्लेषण में नए मॉडल पुराने की तुलना में उल्लेखनीय तेज़ी देते पाए गए, और Claude के अपने समय-अनुमान डेवलपरों के वास्तविक समय से ठीक-ठाक सहसंबंधित थे। Anthropic का कहना है कि वह अगले दौर के लिए रुचि-पत्र स्वीकार कर रहा है।
यह क्यों मायने रखता हैलोग इन प्रणालियों का असल में कैसे उपयोग करते हैं, इस बारे में जनता जो कुछ जानती है वह लगभग पूरा उन्हीं कंपनियों से आया है जो इन्हें बेचती हैं — उनकी अपनी लिखी रिपोर्टों में, उस डेटा पर जो केवल वे देख सकती हैं। यह षड्यंत्र नहीं, संरचनात्मक समस्या है: जाँचने का कोई रास्ता ही नहीं था। यह पायलट उसे ठीक नहीं करता, और उसकी सीमाओं पर स्पष्ट रहना चाहिए — प्रतिभागी Anthropic ने चुने, उपकरण Anthropic ने बनाया, समीक्षा Anthropic ने की, सारांश Anthropic ने छापा। यह स्वतंत्र विश्लेषण है, स्वतंत्र पहुँच नहीं। फिर भी यह पहली बार है जब बाहरी शिक्षाविदों ने किसी फ्रंटियर लैब के जीवित उपयोग डेटा से निष्कर्ष प्रकाशित किए हैं, और किसी एक आँकड़े से ज़्यादा मायने यह मिसाल रखती है। आँकड़ों में से एक नियम बनाने वालों के ध्यान का हक़दार है: अगर अधिकांश बातचीत में परिणामकारी काम सौंपा जा रहा है और उसका अच्छा-ख़ासा हिस्सा क़ानूनी और वित्तीय सलाह है, तो चैट विंडो के नीचे लिखी वह छोटी-सी अस्वीकृति उससे कहीं ज़्यादा भार उठा रही है जितने के लिए वह बनाई गई थी।
✓ सत्यापित · 2 स्रोत
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ
संबंधित खबरें
निकॉन ने जनरेटिव एआई के कारण माइक्रोस्कोप वीडियो का इनाम छीना।
2026-10-11कोई एआई मॉडल जनवरी में छपा इंसानी शोध विचार दोबारा नहीं खोज पाया।
2026-10-11ओपनएआई के जाँचने वाले मॉडल ने नया माहौल पाने को अपना ही तोड़ा।
2026-10-11Claude ने पराबैंगनी आकाश के नए नक्शे का एक तिहाई हिस्सा अनुमान से भरा
2026-10-10चीन के एआई मॉडलों में सिर्फ़ 31 के साथ सुरक्षा रिपोर्ट आई
2026-10-10