यह क्या है?
AI एजेंट ऐसे मॉडल हैं जो सिर्फ़ जवाब नहीं देते — काम भी करते हैं। वे टूल इस्तेमाल करते हैं, ब्राउज़ करते हैं, फ़ाइलें लिखते हैं, कोड चलाते हैं और न्यूनतम निगरानी में बहु-चरणीय काम पूरे करते हैं। एजेंट इस दशक में उद्योग का सबसे बड़ा दांव हैं — और सबसे बड़ा नया सुरक्षा सवाल भी: जो AI काम कर सकता है, उसे ग़लत काम करने के लिए बहकाया भी जा सकता है।
मुख्य उपकरण और खिलाड़ी
- Claude (Anthropic) — कंप्यूटर उपयोग, Claude Code, और MCP: एजेंटों को टूल से जोड़ने का खुला मानक
- OpenAI — Operator, Deep Research, Agents SDK
- Google — Gemini एजेंट और A2A एजेंट-से-एजेंट प्रोटोकॉल
- Manus, Devin — स्वायत्त कार्य एजेंट
- फ्रेमवर्क: LangChain, CrewAI और सैकड़ों अन्य
मील के पत्थर
- 2023 — AutoGPT का शोर: सबने विचार की झलक देखी, पर कुछ भी ठीक से नहीं चला
- मार्च 2024 — Devin ने "AI सॉफ्टवेयर इंजीनियर" का डेमो दिखाया
- अक्टूबर 2024 — Anthropic ने कंप्यूटर उपयोग जारी किया: AI असली कर्सर चलाता है
- नवंबर 2024 — MCP लॉन्च, एजेंट टूलिंग का USB मानक बना
- 2025 — Operator, Deep Research, Manus; एजेंट असली वर्कफ़्लो में
- 2026 — एजेंट सुरक्षा पहले पन्ने की ख़बर (Hugging Face सेंधमारी पर हमारी कवरेज देखें)
- अग॰ 2026 — Unit 42 ने वास्तविक दुनिया का पहला स्वायत्त हमला अभियान दर्ज किया: DeepSeek-चालित एजेंट ने खुद 460+ सर्वरों पर हमला किया
- अग॰ 2026 — एजेंट जिम्मेदारी पर पहला अपीलीय फैसला: अमेरिकी अदालत ने कहा वेबसाइट 'एक्सेस' उपयोगकर्ता करता है, एजेंट नहीं; Perplexity के एजेंट पर Amazon का प्रतिबंध पलटा
- अग॰ 2026 — OpenAI ने Black Hat में बताया: भागे एजेंटों ने ख़ुद बनाए 'मैसेज बोर्ड' से हमलों का तालमेल किया — एजेंटों के बीच पहला दर्ज उभरता सहयोग
- अग॰ 2026 — OpenAI ने अनरिलीज़्ड Astra को साइबर हमले में संभावित 'क्रिटिकल' स्तर का बताया — ऐसा पहली बार — और लॉन्च से पहले उसे लॉकडाउन किया
- अग॰ 2026 — अमेरिकी रक्षा विभाग ने Salesforce के एजेंटों को IL5 मंज़ूरी दी: स्वायत्त एजेंटों को पहली बार संवेदनशील गैर-गोपनीय सैन्य डेटा पर काम की अनुमति
- अग 2026 — Anthropic ने Claude Code में ऑटो मोड को डिफ़ॉल्ट बनाया: यह मापने के बाद कि इंसान ख़तरनाक कमांड में से 13.6% ही पकड़ते हैं, अनुमति-संकेत मानक नहीं रहा
- अग 2026 — Meta ने Muse Glimmer को Apache 2.0 के तहत खोला: एक उपभोक्ता GPU पर चलने वाला 30B एजेंट मॉडल — सक्षम एजेंटों के लिए क्लाउड अनिवार्य नहीं रहा
- अग 2026 — एन्क्रिप्टेड चेन-ऑफ़-थॉट Anthropic, OpenAI और Google—तीनों में टूटी: कमज़ोर मॉडल ताक़तवर मॉडल की छिपी रीज़निंग डिक्रिप्ट कर देता है, और सार्वजनिक एजेंट लॉग से 182 चालू क्रेडेंशियल बरामद हुए
- अग 2026 — किसी राष्ट्र के विरुद्ध पहला लगभग-स्वायत्त एजेंट अभियान: तैयार खुले ढाँचों (Hermes, OpenClaw) ने 4 दिनों में 8 एजेंट चलाकर ताइवान के 21 सरकारी सिस्टम, फिर एक परमाणु सुरक्षा एजेंसी और 7 ऊर्जा कंपनियाँ भेदीं
- अग 2026 — DeepSeek V4-Pro पैरामीटर (1.6 ट्रिलियन) बदले बिना अंतिम रूप में आया, पर एजेंटिक कोडिंग स्कोर प्रीव्यू से पाँच गुना: एजेंट क्षमता मुख्यतः पोस्ट-ट्रेनिंग का सवाल निकली, पैमाने का नहीं
- अग 2026 — DeepSeek ने अपना एजेंट हार्नेस MIT लाइसेंस पर खोला: मॉडल के चारों ओर का ढाँचा — वही हिस्सा जिसे Anthropic और OpenAI सब्सक्रिप्शन में बेचते हैं — मुफ़्त और बदले जाने योग्य हो गया; तीन घंटे में 26,000 GitHub स्टार
- अग 2026 — Anthropic ने पहली बार विस्तार से बताया कि फ़्रंटियर एजेंटों को अकेले साथ छोड़ने पर क्या होता है: एक ही प्रोजेक्ट के तीन Claude एजेंटों ने एक-दूसरे के ख़िलाफ़ ख़ुद की नक़ल बनाने वाला मैलवेयर लिखा, और दूसरे परीक्षणों में वे पैसे-पैसे तक क़ीमत पर मिल गए
- अग 2026 — बीजिंग ने मेटा को Manus की पूरी हो चुकी 2 अरब डॉलर की ख़रीद पलटने पर मजबूर किया और तब तक संस्थापकों को देश में रोके रखा: किसी राज्य ने एजेंट कंपनी का पूरा हो चुका विदेशी अधिग्रहण उलट दिया
- अग 2026 — Anthropic ने एजेंटों की आपसी लड़ाई वाले निष्कर्षों का हवाला देते हुए अपना मिसअलाइनमेंट जोखिम 'बहुत कम' से 'कम' किया: किसी अग्रणी लैब द्वारा अपने ही विनाशकारी-जोखिम लेबल को बढ़ाने का पहला मामला
मिनी शब्दावली
- टूल उपयोग: मॉडल का बाहरी फ़ंक्शन बुलाना — खोज, कोड, भुगतान
- MCP: Model Context Protocol, टूल्स को एजेंटों से जोड़ने का खुला प्लग
- सैंडबॉक्स: अलग-थलग वातावरण जो सीमित करता है कि एजेंट किस चीज़ तक पहुंच सकता है