aiminute. ← सभी AI समाचार
अनुसंधान AI Minute Newsroom 2026-08-27

बाहरी शोधकर्ताओं को पहली बार किसी लैब के असली चैट लॉग पढ़ने को मिले। आधे से ज़्यादा बातचीत गंभीर परिणाम वाले काम की थी।

बाहरी शोधकर्ताओं को पहली बार किसी लैब के असली चैट लॉग पढ़ने को मिले। आधे से ज़्यादा बातचीत गंभीर परिणाम वाले काम की थी।

Anthropic ने 26 अगस्त को एक पायलट कार्यक्रम के नतीजे प्रकाशित किए जिसमें तीन बाहरी समूहों को Claude के वास्तविक उपयोग तक स्वतंत्र पहुँच दी गई: स्टैनफोर्ड की सोशल एंड लैंग्वेज टेक्नोलॉजीज़ लैब, ऑक्सफ़ोर्ड की ह्यूमन इन्फ़ॉर्मेशन प्रोसेसिंग लैब, और AI प्रणालियों का मूल्यांकन करने वाली ग़ैर-लाभकारी संस्था METR। तंत्र है Anthropic Insights नामक उपकरण, जो टेक्स्ट के बजाय समुच्चयित आँकड़े लौटाता है — शोधकर्ताओं ने कच्ची बातचीत कभी नहीं देखी। हर टीम ने अपना अध्ययन खुद डिज़ाइन किया, और नतीजे उसी क़ानूनी व निजता समीक्षा से गुज़रे जिससे Anthropic का आंतरिक काम गुज़रता है, साथ ही बाहर साझा की गई हर चीज़ का एक अतिरिक्त ऑडिट भी हुआ। हर टीम ने अप्रैल–मई 2026 की लगभग 2,50,000 बातचीत देखीं। स्टैनफ़ोर्ड ने पाया कि आधे से अधिक Claude बातचीत में लोग परिणामकारी कार्य सौंप रहे थे, जिनमें क़ानूनी और वित्तीय मार्गदर्शन प्रमुख था — यह उस पुरानी धारणा को सीधे काटता है कि लोग कम जवाबदेही वाला काम सौंपते हैं और गंभीर चीज़ें अपने पास रखते हैं। लगभग तीन-चौथाई बातचीत में इंसान दिशा दे रहा था और Claude सहायता कर रहा था, पूरा काम सौंपा नहीं जा रहा था। ऑक्सफ़ोर्ड ने पाया कि मॉडल की गर्मजोशी उपयोगकर्ता के अधिक सकारात्मक भाव के साथ चलती है, और जुड़ाव के पैटर्न किसी उपकरण के इस्तेमाल से ज़्यादा सामान्य वेब ब्राउज़िंग जैसे लगते हैं। METR के Claude Code सत्रों के प्रारंभिक विश्लेषण में नए मॉडल पुराने की तुलना में उल्लेखनीय तेज़ी देते पाए गए, और Claude के अपने समय-अनुमान डेवलपरों के वास्तविक समय से ठीक-ठाक सहसंबंधित थे। Anthropic का कहना है कि वह अगले दौर के लिए रुचि-पत्र स्वीकार कर रहा है।

यह क्यों मायने रखता हैलोग इन प्रणालियों का असल में कैसे उपयोग करते हैं, इस बारे में जनता जो कुछ जानती है वह लगभग पूरा उन्हीं कंपनियों से आया है जो इन्हें बेचती हैं — उनकी अपनी लिखी रिपोर्टों में, उस डेटा पर जो केवल वे देख सकती हैं। यह षड्यंत्र नहीं, संरचनात्मक समस्या है: जाँचने का कोई रास्ता ही नहीं था। यह पायलट उसे ठीक नहीं करता, और उसकी सीमाओं पर स्पष्ट रहना चाहिए — प्रतिभागी Anthropic ने चुने, उपकरण Anthropic ने बनाया, समीक्षा Anthropic ने की, सारांश Anthropic ने छापा। यह स्वतंत्र विश्लेषण है, स्वतंत्र पहुँच नहीं। फिर भी यह पहली बार है जब बाहरी शिक्षाविदों ने किसी फ्रंटियर लैब के जीवित उपयोग डेटा से निष्कर्ष प्रकाशित किए हैं, और किसी एक आँकड़े से ज़्यादा मायने यह मिसाल रखती है। आँकड़ों में से एक नियम बनाने वालों के ध्यान का हक़दार है: अगर अधिकांश बातचीत में परिणामकारी काम सौंपा जा रहा है और उसका अच्छा-ख़ासा हिस्सा क़ानूनी और वित्तीय सलाह है, तो चैट विंडो के नीचे लिखी वह छोटी-सी अस्वीकृति उससे कहीं ज़्यादा भार उठा रही है जितने के लिए वह बनाई गई थी।

✓ सत्यापित · 2 स्रोत

WhatsApp X Telegram
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ

संबंधित खबरें

निकॉन ने जनरेटिव एआई के कारण माइक्रोस्कोप वीडियो का इनाम छीना।
2026-10-11
कोई एआई मॉडल जनवरी में छपा इंसानी शोध विचार दोबारा नहीं खोज पाया।
2026-10-11
ओपनएआई के जाँचने वाले मॉडल ने नया माहौल पाने को अपना ही तोड़ा।
2026-10-11
Claude ने पराबैंगनी आकाश के नए नक्शे का एक तिहाई हिस्सा अनुमान से भरा
2026-10-10
चीन के एआई मॉडलों में सिर्फ़ 31 के साथ सुरक्षा रिपोर्ट आई
2026-10-10