AI चैटबॉट्स अब सिर्फ सवालों के जवाब देने वाले टूल नहीं रहे। लोग इनसे अपनी चिंताओं, आर्थिक स्थिति, सेहत और रिश्तों पर बात कर रहे हैं। इसी वजह से इन सेवाओं के साथ साझा की गई जानकारी की प्राइवेसी बड़ा मुद्दा बन गई है।
ChatGPT, Claude और Gemini जैसी बड़ी सेवाएं बातचीत का डेटा रख सकती हैं। कुछ स्थितियों में यह डेटा सेवा संचालक, साझेदार कंपनियों, सिस्टम सुधारने वाले ठेकेदारों, कानून प्रवर्तन एजेंसियों या सिविल मुकदमे से जुड़े पक्षों तक कानूनी प्रक्रिया के जरिए पहुंच सकता है।
जॉन्स हॉपकिन्स यूनिवर्सिटी के कंप्यूटर साइंस प्रोफेसर Matt Green के मुताबिक, यूजर हर सवाल के साथ अपनी जिंदगी का बड़ा प्रोफाइल तैयार कर सकता है। Signal बनाने वाले Moxie Marlinspike का कहना है कि AI के साथ निजी बातचीत अब मैसेजिंग जैसी प्राइवेसी कमजोरी का नया केंद्र बन रही है।
0 data retention क्या है
0 data retention यानी ZDR ऐसी संविदात्मक व्यवस्था है, जिसमें AI सेवा यूजर की बातचीत को प्रोसेसिंग के बाद तुरंत मिटाने का वादा करती है। OpenAI, Anthropic और Google अपने enterprise संस्करणों में ऐसी नीतियां देते हैं।
यह सुविधा आम उपभोक्ता खातों के बजाय paid enterprise और developer खातों से जुड़ी है। इसके बावजूद ZDR का अर्थ हर स्थिति में पूर्ण गोपनीयता नहीं है। कुछ मॉडलों और सुरक्षा जांचों के लिए अपवाद लागू हो सकते हैं।
Anthropic अपने सबसे उन्नत “Mythos-class” मॉडल, जैसे Fable 5.1, के लिए ZDR नहीं देता। कंपनी ने इसके पीछे धोखाधड़ी, हैकिंग और ऐसे AI agents के संभावित दुरुपयोग का जिक्र किया है, जो यूजर के अनुरोध पर अपने स्तर से कार्रवाई कर सकते हैं।
OpenAI ने बताया है कि उसका Private Safety Processing सिस्टम डेटा हटाने से पहले यूजर गतिविधि की जांच कर सकता है। कंपनी के मुताबिक, दुरुपयोग मिलने पर ग्राहक संगठन को इसकी जानकारी दी जा सकती है। कुछ मामलों में OpenAI के कर्मचारियों को भी अलर्ट मिल सकता है, हालांकि बातचीत की सामग्री दिखाए बिना।
Google ने भी कहा है कि ZDR चालू होने पर Gemini के कुछ prompts का दुरुपयोग निगरानी के लिए लॉग रखा जा सकता है। ऐसे लॉग में Google ID या IP address शामिल नहीं होता, लेकिन अनुरोध में मौजूद पहचान योग्य जानकारी किसी व्यक्ति तक पहुंचने में मदद कर सकती है।
प्राइवेसी वादे और proxy सेवाएं
आम यूजर्स के लिए कई AI सेवाएं तकनीकी रोक के बजाय अपनी privacy policy पर भरोसा करने को कहती हैं। Proton का Lumo चैटबॉट बातचीत लॉग न करने का दावा करता है। यह दावा Proton Mail या Proton Drive जैसी सेवाओं की end-to-end encryption पर आधारित तकनीकी गारंटी नहीं है।
Venice.ai और DuckDuckGo का Duck.ai भी बातचीत को लॉग न रखने की बात कहते हैं। दोनों सेवाएं कई बार यूजर के सवालों को Claude या ChatGPT जैसे दूसरे AI मॉडल तक पहुंचाती हैं। इस तरह वे proxy की तरह काम करती हैं और मूल मॉडल को यूजर की कुछ पहचान संबंधी जानकारी से दूर रख सकती हैं।
Duck.ai में यूजर third-party मॉडल चुन सकता है। Venice.ai अनुरोध के आधार पर अलग-अलग सेवाओं को बातचीत भेज सकता है और हर बार यह स्पष्ट नहीं करता कि कौन-सा मॉडल इस्तेमाल हो रहा है। कुछ अनुरोधों के जवाब उसके अपने infrastructure पर मौजूद मॉडल से भी मिल सकते हैं।
Green के अनुसार, proxy पहचान संबंधी metadata को हटा सकता है, लेकिन संदेशों में खुद पहचान योग्य संकेत मौजूद रहते हैं। किसी व्यक्ति के इलाके के सबसे अच्छे coffee shops पूछने से उसके रहने की जगह का संकेत मिल सकता है। अलग-अलग सवाल मिलकर यूजर की एक विशिष्ट डिजिटल पहचान बना सकते हैं।
TEE और तकनीकी सुरक्षा
सिर्फ policy या privacy promise की तुलना में Trusted Execution Environment यानी TEE एक तकनीकी सुरक्षा व्यवस्था है। इसमें AI मॉडल अलग hardware enclave में यूजर के सवालों को प्रोसेस करता है और सिस्टम के दूसरे हिस्सों को उस डेटा से दूर रखने का cryptographic प्रमाण दे सकता है।
AI बातचीत अभी Signal या WhatsApp संदेशों की तरह पूरी तरह end-to-end encrypted नहीं हो सकती, क्योंकि मौजूदा AI मॉडल को prompts का unencrypted रूप प्रोसेस करना पड़ता है। TEE इसी समस्या के बीच सर्वर की पहुंच सीमित करने का तरीका है।
Marlinspike का Confer चैटबॉट Nvidia के Confidential Computing पर आधारित TEE इस्तेमाल करता है। इसमें passkeys और audit किए जा सकने वाले open-source code का भी इस्तेमाल होता है। Confer ने सेवा को इस तरह बनाने का लक्ष्य रखा है कि उसका अपना सर्वर बातचीत को देख या लॉग न कर सके।
WhatsApp में शामिल Meta AI का एक अलग chat mode भी TEE आधारित सुरक्षा देता है। WhatsApp में “Ask Meta AI or Search” बार से Ask विकल्प चुनने के बाद lock वाले speech-bubble विकल्प के जरिए यह स्क्रीन खोली जा सकती है। Meta के मुताबिक, इस Incognito सिस्टम में बातचीत का रिकॉर्ड रखने से बचाव किया जाता है।
यह सुविधा WhatsApp की सामान्य messaging के समान end-to-end encryption नहीं है। फिर भी यह Meta AI को WhatsApp में शामिल करते हुए निजी बातचीत जैसी सुरक्षा देने की कंपनी की कोशिश है।
Meta का Muse AI agent अभी TEE आधारित सुरक्षा नहीं देता। यह cloud में अलग virtual machine पर चलने का वादा करता है। Meta के अनुसार, उसका ad system इस डेटा तक नहीं पहुंच सकता और यूजर अपने डेटा को AI training में इस्तेमाल होने से रोक सकता है। कंपनी ने Muse Confidential VM जारी करने पर काम करने की बात कही है।
Apple और स्थानीय AI का मॉडल
Apple का Private Cloud Compute यानी PCC सिस्टम भी सर्वर पर प्रोसेस होने वाली Apple Intelligence और Siri queries के लिए सुरक्षा देता है। यूजर का device cryptographically जांचता है कि सर्वर PCC code का बदला हुआ संस्करण नहीं चला रहा। यह सिस्टम लॉग न रखने और remote access से डेटा अलग रखने के लिए बनाया गया है।
अगर यूजर Apple Intelligence या Siri से ChatGPT जैसे third-party AI को सवाल भेजने को कहता है, तो PCC जैसी सुरक्षा लागू नहीं रहती। Apple ऐसे अनुरोध को आगे भेजने से पहले यूजर से पुष्टि करता है। साधारण सवालों के लिए Apple का सीमित on-device AI मॉडल भी इस्तेमाल होता है। इसमें डेटा phone, computer या smartwatch से बाहर नहीं जाता, लेकिन इसकी क्षमता server-based मॉडल से कम है।
Ollama, LMStudio और LocalAI जैसे टूल कंप्यूटर पर स्थानीय रूप से चल सकते हैं। इनका डेटा cloud service तक नहीं जाता, इसलिए प्राइवेसी का स्तर बेहतर हो सकता है। इसके बदले ऐसे मॉडल अक्सर कम सक्षम होते हैं और cloud-based AI की तुलना में ज्यादा बार गलत या काल्पनिक जवाब दे सकते हैं।
प्राइवेसी की कीमत
प्राइवेसी और AI क्षमता के बीच समझौते के साथ लागत भी जुड़ी है। Confer मुफ्त इस्तेमाल में रोजाना लगभग 20 से 25 queries देता है। इसके बाद उसका सबसे सस्ता tier 34.99 डॉलर प्रति माह का है। Claude और ChatGPT के सबसे सस्ते paid tiers 20 डॉलर प्रति माह के हैं।
Marlinspike के मुताबिक, Confer की ज्यादा कीमत AI मॉडल चलाने की वास्तविक लागत को दर्शाती है। उनके अनुसार, दूसरे paid providers डेटा संग्रह या विज्ञापन से भविष्य की कमाई की उम्मीद के जरिए लागत को subsidize कर सकते हैं।
Green ने कहा है कि frontier AI मॉडल चलाने में ऊर्जा और hardware की बड़ी लागत आती है। अगर कंपनियां यूजर डेटा से कमाई नहीं करतीं, तो ज्यादा निजी AI सेवाओं के लिए टिकाऊ business model बनाना चुनौती हो सकता है।
# अलग-अलग सुरक्षा मॉडलों का फर्क
- ZDR: बातचीत हटाने का contractual वादा, लेकिन enterprise और developer खातों तक सीमित।
- Privacy policy: सेवा बातचीत लॉग न रखने की बात कहती है, पर सुरक्षा मुख्य रूप से कंपनी के वादे पर निर्भर रहती है।
- Proxy: सवाल को दूसरे AI मॉडल तक पहुंचाते हुए कुछ पहचान संबंधी जानकारी सीमित करता है।
- TEE: अलग hardware environment के जरिए सेवा की अपनी पहुंच तकनीकी रूप से रोकने की कोशिश करता है।
- On-device AI: डेटा को फोन, कंप्यूटर या smartwatch से बाहर नहीं भेजता, लेकिन क्षमता सीमित हो सकती है।
निष्कर्ष
AI में बेहतर प्राइवेसी संभव है, लेकिन हर विकल्प में कुछ सीमा है। ZDR contractual सुरक्षा देता है, TEE तकनीकी रोक लगाता है और स्थानीय AI डेटा को device से बाहर नहीं जाने देता। इनके साथ उपलब्धता, कीमत और AI क्षमता में फर्क बना रहता है।
अक्सर पूछे जाने वाले सवाल
Q. AI चैटबॉट्स में प्राइवेसी का सबसे बड़ा जोखिम क्या है?
निजी बातचीत रिकॉर्ड की जा सकती है या कानूनी प्रक्रिया के जरिए हासिल की जा सकती है। बातचीत में मौजूद पहचान योग्य संकेत किसी व्यक्ति की पहचान तक पहुंचने में मदद कर सकते हैं।
Q. 0 data retention क्या करता है?
ZDR नीति के तहत बातचीत को प्रोसेसिंग के बाद हटाने का contractual प्रावधान होता है। यह सुविधा आमतौर पर paid enterprise और developer खातों के लिए उपलब्ध है।
Q. क्या ZDR हर डेटा को तुरंत मिटा देता है?
नहीं। अलग-अलग सेवाओं में सुरक्षा जांच और दुरुपयोग निगरानी के लिए अपवाद हो सकते हैं। Anthropic और Google ने अपनी सेवाओं में ऐसे अपवाद बताए हैं।
Q. Trusted Execution Environment क्या है?
TEE एक अलग hardware environment है, जिसमें AI prompts प्रोसेस किए जाते हैं। इसका उद्देश्य सर्वर के बाकी हिस्सों को उस डेटा तक पहुंचने से रोकना है।
Q. क्या proxy AI सेवाएं पूरी तरह निजी होती हैं?
नहीं। Duck.ai और Venice.ai जैसी सेवाएं पहचान संबंधी metadata सीमित कर सकती हैं, लेकिन सवालों में मौजूद जानकारी मूल AI मॉडल तक पहुंच सकती है।
Q. Apple Private Cloud Compute कैसे काम करता है?
Apple के अनुसार, device सर्वर के PCC code की cryptographic जांच करता है। यह सिस्टम Apple Intelligence और Siri की server-processed queries को लॉग और remote access से अलग रखने के लिए बनाया गया है।
Q. स्थानीय AI का मुख्य फायदा क्या है?
Ollama, LMStudio और LocalAI जैसे टूल डेटा को cloud service तक भेजे बिना कंप्यूटर पर चल सकते हैं। उनकी AI क्षमता server-based मॉडलों से कम हो सकती है।
Q. Confer की कीमत कितनी है?
Confer रोजाना लगभग 20 से 25 queries मुफ्त देता है। इसके बाद उसका सबसे सस्ता paid tier 34.99 डॉलर प्रति माह का है।














