aiminute. ← सभी AI समाचार
अनुसंधान AI Minute Newsroom 2026-08-23

एक पुराने Claude ने 10 में से 10 बार Anthropic का अपना ही कंटेंट नियम तोड़ा — और वह अब भी Azure तथा Bedrock पर बिक रहा है

एक पुराने Claude ने 10 में से 10 बार Anthropic का अपना ही कंटेंट नियम तोड़ा — और वह अब भी Azure तथा Bedrock पर बिक रहा है

टेकक्रंच ने 21 अगस्त को बताया कि Claude Opus 4.6 — एक पुराना मॉडल जिसे Anthropic अब भी उपलब्ध रखता है — ने 10 में से 10 सीधे अनुरोधों पर यौन रूप से स्पष्ट सामग्री तैयार की, जिसे कंपनी की अपनी उपयोग नीति मना करती है। तरीका कोई तकनीकी सेंध नहीं, बल्कि बातचीत का था: एक रोल-प्ले परिदृश्य को थोड़ा-थोड़ा करके आगे बढ़ाया जाता है और एक बिंदु पर इनकार आना बंद हो जाता है — परीक्षक इसे 'सीमा का क्षरण' कहते हैं। Opus 3 और Haiku 4.5 भी इसी तरीके के आगे टूट गए। Opus 4.7 और उसके बाद के मॉडल, Opus 5 सहित, टिके रहे। Anthropic ने टेकक्रंच से कहा कि उपयोगकर्ताओं द्वारा रोल-प्ले को अनुचित दिशा में मोड़ना 'पूरे उद्योग की एक ज्ञात चुनौती' है, हर मॉडल रिलीज़ के साथ सुरक्षा बेहतर होती है, और यौन या रोमांटिक रोल-प्ले कुल बातचीत का 0.1 प्रतिशत से भी कम है। कंपनी के बग बाउंटी कार्यक्रम के जरिए यह व्यवहार बताने वाले शोधकर्ता का कहना है कि उन्हें केवल स्वचालित जवाब मिले। Opus 4.6, Opus 3 और Haiku 4.5 अब भी Anthropic के एपीआई पर उपलब्ध हैं, और Opus 4.6 तथा Haiku 4.5 माइक्रोसॉफ्ट के Azure Foundry और अमेज़न Bedrock पर भी बेचे जाते हैं।

यह क्यों मायने रखता हैसुरक्षा से जुड़ी लगभग हर खबर सबसे नए मॉडल के बारे में होती है। यह खबर उसके नीचे वाले मॉडलों के बारे में है — और असली उत्पादन ट्रैफ़िक वहीं चलता है। कंपनियाँ कीमत या स्थिरता के लिए पुराने संस्करण पर टिक जाती हैं और उसी संस्करण की सुरक्षा-सीमाएँ विरासत में लेती हैं, इस महीने वाली नहीं। किसी क्लाउड मार्केटप्लेस से Opus 4.6 खरीदना यानी उसकी रिलीज़ के समय की सुरक्षा मेहनत खरीदना। दूसरी बात यह कि विफलता अब कैसी दिखती है: न कोई जेलब्रेक स्ट्रिंग, न प्रॉम्प्ट इंजेक्शन — बस एक लंबी, शिष्ट बातचीत जो हर बार सीमा को थोड़ा-सा खिसकाती है। फ़िल्टर एक बुरे अनुरोध को रोकने के लिए बने हैं; लगातार आते सौ वाजिब अनुरोधों के आगे वे कहीं ज़्यादा कमज़ोर हैं।

✓ सत्यापित · 2 स्रोत

WhatsApp X Telegram
ऐप में पढ़ें — मुफ़्त, 9 भाषाएँ

संबंधित खबरें

जब छोटा मॉडल बातचीत बड़े को सौंपता है, तो बड़ा सब कुछ दोबारा पढ़ता है। एनवीडिया कहती है कि यह अनुवाद एक सीधी रेखा कर सकती है।
2026-08-23
27 अरब पैरामीटर वाले एक मॉडल ने प्रकाशित शोधपत्रों को दोहराने में Opus 4.8 और GPT-5.5 को हराया
2026-08-23
किसी अप्रकाशित शोधपत्र की संदर्भ-सूची मॉडल को दें और पूछें कि पत्र क्या कहता है। सबसे अच्छे मॉडल 15 प्रतिशत बार सही होते हैं।
2026-08-22
तीन-चौथाई अमेरिकी अपने पास डेटा सेंटर नहीं चाहते। एक साल पहले वे बराबरी पर बँटे थे।
2026-08-22
मॉडल अकेले 30 प्रतिशत पर था। एनवीडिया के ढाँचे में लपेटने पर उसी मॉडल ने सब कुछ पार कर लिया।
2026-08-22