मुख्य सामग्री पर जाएँ

बुनियादी बातें

AI डेटा प्राइवेसी और रिटेंशन, समझाया गया

जब आप किसी AI प्रोडक्ट में कुछ टाइप करते हैं, तो वह असल में कहाँ जाता है? कौन इसे देख सकता है, क्या यह किसी मॉडल को ट्रेन करने में इस्तेमाल होता है, कितने समय तक रखा जाता है, और किसी भी AI टूल में कुछ संवेदनशील पेस्ट करने से पहले पूछने लायक़ सवाल।

सभी लेख · आख़िरी समीक्षा:

पहला सवाल: क्या यह आपके ढाँचे से बाहर निकलता ही है

क्लाउड AI प्रोडक्ट आप जो टाइप करते हैं उसे एक दूर के सर्वर पर भेजता है जिसे आप नियंत्रित नहीं करते, जिसे मॉडल कंपनी या प्रोडक्ट का अपना बैकएंड चलाता है। आपके अपने हार्डवेयर पर लोकल चलने वाला मॉडल (देखें लोकल AI क्या है) आपका इनपुट कभी कहीं नहीं भेजता — न कोई नेटवर्क रिक्वेस्ट रोकने के लिए है, न कोई तीसरा पक्ष जिस पर भरोसा करना पड़े, क्योंकि कैलकुलेशन उसी मशीन पर होता है जिसे आप पहले से नियंत्रित करते हैं।

क्या आपका डेटा भविष्य का मॉडल ट्रेन करता है, यह इससे अलग सवाल है कि क्या इसे स्टोर किया जाता है

कोई कंपनी परिचालन कारणों से — बग ठीक करने, दुरुपयोग पकड़ने, प्रोडक्ट एनालिटिक्स के लिए — आपकी बातचीत स्टोर कर सकती है बिना उन्हें मॉडल ट्रेन करने में इस्तेमाल किए, और कोई कंपनी दोनों काम भी कर सकती है। ज़्यादातर प्रोडक्ट्स में ये असल में अलग-अलग फ़ैसले हैं जिनकी अलग-अलग सेटिंग्स होती हैं, इसलिए एक अच्छी प्राइवेसी पॉलिसी हर एक को साफ़ बताती है, बजाय इन्हें "हमारी सेवाओं को बेहतर बनाना" जैसे धुँधले वाक्य में समेटने के। अगर कोई प्रोडक्ट इन दोनों को साफ़ तौर पर अलग नहीं करता, तो वह अस्पष्टता ही ध्यान देने लायक़ है।

रिटेंशन अवधि तभी मायने रखती है जब डिलीट असल में होता है

बताई गई रिटेंशन विंडो — मान लीजिए "30 दिन" — एक इरादा बताती है, गारंटी नहीं, जब तक प्रोडक्ट यह भी न दिखा सके कि इसका पालन हुआ: अकाउंट-लेवल एक्सपोर्ट, कोई दिखने वाली डिलीट कार्रवाई, या एक सपोर्ट प्रक्रिया जो डेटा को असल में हटाती है, न कि सिर्फ़ इंटरफ़ेस से छिपाती है। बैकअप आम कमी है: लाइव सिस्टम से डिलीट हुआ डेटा बैकअप में एक अलग, अक्सर लंबी, रिटेंशन अवधि के लिए बना रह सकता है जिसे पॉलिसियाँ हमेशा साफ़ तौर पर नहीं बतातीं।

आपके डेटा के रास्ते में अक्सर सिर्फ़ AI कंपनी से ज़्यादा पक्ष शामिल होते हैं

तीसरे पक्ष के मॉडल API पर बना कोई प्रोडक्ट आपके इनपुट को कम-से-कम दो संगठनों से गुज़ारता है: खुद प्रोडक्ट और वह मॉडल कंपनी जिसका API वह बुलाता है। लॉगिंग इंफ़्रास्ट्रक्चर, एरर-ट्रैकिंग टूल और क्लाउड होस्टिंग जोड़ें, तो एक अकेले मैसेज की असली कस्टडी चेन कई कंपनियों तक फैल सकती है, हर एक की अपनी पॉलिसी के साथ। भरोसेमंद प्रोडक्ट अपने सब-प्रोसेसर बताता है, बजाय "और कौन इसे देखता है" को खुला सवाल छोड़ने के।

किसी भी AI टूल में कुछ संवेदनशील पेस्ट करने से पहले असल में क्या जाँचें

क्या प्रोडक्ट डिफ़ॉल्ट रूप से आपके इनपुट पर मॉडल ट्रेन करता है, और क्या इसे बंद किया जा सकता है। बताई गई रिटेंशन अवधि क्या है, और क्या डिलीट कुछ ऐसा है जिसे आप ख़ुद शुरू और सत्यापित कर सकते हैं। क्या प्रोसेसिंग क्लाउड में होती है या ऐसे डेटा के लिए लोकल चल सकती है जो आपके ढाँचे से बाहर नहीं जा सकता। और क्या प्रोडक्ट अपने सब-प्रोसेसर बताता है, बजाय इसे बिना जवाब वाला सवाल छोड़ने के जिसे आपको भरोसे पर मानना पड़े।

अक्सर पूछे जाने वाले सवाल

क्या हर AI प्रोडक्ट मेरी बातचीत अपने मॉडल ट्रेन करने में इस्तेमाल करता है?
नहीं — यह प्रोडक्ट के हिसाब से बदलता है और आमतौर पर डेटा स्टोरेज से अलग सेटिंग होती है। बग ठीक करने या सपोर्ट के लिए बातचीत स्टोर करने का अपने-आप यह मतलब नहीं कि उन्हें ट्रेनिंग में इस्तेमाल किया जाता है; एक साफ़ प्राइवेसी पॉलिसी हर इस्तेमाल को साफ़ तौर पर बताती है।
अगर मैं अपना डेटा डिलीट करूँ, तो क्या वह तुरंत चला जाता है?
ज़रूरी नहीं कि हर सिस्टम से। लाइव प्रोडक्ट से डिलीट होना आम है, पर बैकअप अक्सर डेटा को एक अलग अवधि के लिए रखते हैं जो हमेशा साफ़ तौर पर नहीं बताई जाती — यह ख़ास तौर पर जाँचने लायक़ है, बजाय यह मान लेने के कि डिलीट हर जगह तुरंत होता है।
क्या लोकल AI अपने-आप क्लाउड AI प्रोडक्ट से ज़्यादा निजी होता है?
इस ख़ास सवाल के लिए कि क्या आपका इनपुट आपके ढाँचे से बाहर जाता है, हाँ — आपके अपने हार्डवेयर पर चलने वाले मॉडल के पास कहीं भेजने के लिए कुछ नहीं होता। यह अपने-आप हर प्राइवेसी सवाल हल नहीं करता (जैसे कोई क्लाइंट ऐप लोकल पर क्या लॉग करता है), पर यह तीसरे पक्ष को भेजे जाने के सवाल को पूरी तरह हटा देता है।
सब-प्रोसेसर क्या होते हैं, और वे प्राइवेसी के लिए क्यों मायने रखते हैं?
खुद AI प्रोडक्ट के अलावा आपके डेटा को संभालने में शामिल दूसरी कंपनियाँ — वह मॉडल कंपनी जिसका API वह बुलाता है, होस्टिंग इंफ़्रास्ट्रक्चर, लॉगिंग या एनालिटिक्स टूल। हर एक ऐसा पक्ष है जो आपका डेटा देख सकता है, इसलिए जो प्रोडक्ट अपने सब-प्रोसेसर बताता है वह उस प्रोडक्ट से साफ़ तस्वीर देता है जो नहीं बताता।

पढ़ने से बेहतर, आज़माकर देखें

ऐसे कामों के लिए जिनका डेटा आपके ढाँचे से बिल्कुल भी बाहर नहीं जा सकता, ClawAI मॉडल्स को लोकल चलाने का समर्थन करता है (देखें लोकल AI क्या है) — ClawAI की क्लाउड-कनेक्टेड सुविधाओं का इस्तेमाल करते समय बिल्कुल क्या लागू होता है, यह जानने के लिए ClawAI की प्राइवेसी पॉलिसी और सिक्योरिटी पेज देखें।