AI एजेंट को उस बिंदु पर सुरक्षित करें जहां रीज़निंग एक्शन में बदलती है
लीस्ट प्रिविलेज, क्रेडेंशियल आइसोलेशन, इनपुट सीमाओं, स्वीकृति गेट, ट्रेस सबूत और परखे गए विफलता व्यवहार के साथ एंटरप्राइज़ AI एजेंट को सुरक्षित करें।
AI एजेंट सुरक्षा की शुरुआत लीस्ट प्रिविलेज से होती है। क्रेडेंशियल को आइसोलेट करें, रीड को राइट से अलग रखें, रिट्रीव्ड कॉन्टेंट को अविश्वसनीय इनपुट मानें, टूल आर्ग्यूमेंट को वैलिडेट करें, महत्वपूर्ण एक्शन के लिए स्वीकृति अनिवार्य करें, दोहराव और खर्च की सीमा तय करें, और जांच के लिए ट्रेस बनाए रखें।
क्रेडेंशियल और टूल्स को सुरक्षित रखें
पुन: उपयोग योग्य सीक्रेट को प्रॉम्प्ट या मॉडल-विज़िबल कॉन्टेक्स्ट में न रखें। क्रेडेंशियल को सर्वर-साइड कनेक्टर से बांधें, उनके दायरे को संकीर्ण करें, और जहां भी संभव हो, रॉ शेल, डेटाबेस या HTTP एक्सेस के बजाय पर्पज़-बिल्ट ऑपरेशन उपलब्ध कराएं।
हर इनपुट को संभावित रूप से खतरनाक मानें
प्रॉम्प्ट इंजेक्शन ईमेल, वेब पेज, दस्तावेज़, टूल परिणाम और किसी नियंत्रित फ़ोन की स्क्रीन के ज़रिए आ सकता है। रिट्रीव्ड टेक्स्ट सबूत है, निर्देश नहीं। सिस्टम पॉलिसी को रिट्रीव्ड कॉन्टेंट से बाहर रखें और हर महत्वपूर्ण टूल कॉल के आर्ग्यूमेंट को वैलिडेट करें।
- निर्देशों को रिट्रीव्ड डेटा से अलग रखें
- डेस्टिनेशन और एक्शन प्रकारों को अलाउलिस्ट करें
- इटरेशन, समय, लागत और राइट की सीमाएं तय करें
- एजेंट को अपनी ही परमिशन बदलने से रोकें
- जब दायरा बदले तो नई स्वीकृति अनिवार्य करें
कंटेनमेंट और जांच के लिए डिज़ाइन करें
जहां संभव हो, हर वर्कफ़्लो के लिए अलग पहचान का उपयोग करें, टूल कॉल और स्वीकृति रिकॉर्ड करें, और एक तेज़ ग्लोबल डिसेबल पाथ उपलब्ध कराएं। आंशिक विफलता, डुप्लीकेट डिलीवरी, पुरानी स्थिति और रीप्ले अटैक को टेस्ट करें। सुरक्षा इस पर निर्भर करती है कि जब मॉडल या कोई डिपेंडेंसी अप्रत्याशित व्यवहार करे तो क्या होता है, सिर्फ हैप्पी पाथ पर नहीं।
अक्सर पूछे जाने वाले प्रश्न
क्या प्रॉम्प्ट इंजेक्शन को एक मज़बूत प्रॉम्प्ट से हल किया जा सकता है?
नहीं। प्रॉम्प्ट मदद करते हैं, लेकिन प्रभावी सुरक्षा के लिए परमिशन सीमाएं, अविश्वसनीय-इनपुट हैंडलिंग, टूल वैलिडेशन, स्वीकृति गेट और कंटेनमेंट भी ज़रूरी हैं।
क्या किसी एजेंट को यूज़र की पूरी परमिशन मिलनी चाहिए?
आमतौर पर नहीं। वर्कफ़्लो को उसके खास टास्क और जीवनकाल के लिए ज़रूरी सबसे छोटी परमिशन दें।
AI एजेंट के क्रेडेंशियल कहां रखे जाने चाहिए?
क्रेडेंशियल को मॉडल-विज़िबल टेक्स्ट से बाहर स्टोर और उपयोग किया जाना चाहिए, आदर्श रूप से संकीर्ण दायरे और ऑडिटेबिलिटी वाले किसी मैनेज्ड सीक्रेट स्टोर या सर्वर-साइड कनेक्टर में।
