एक Reddit चर्चा उजागर करती है कि OpenAI के भुगतान करने वाले उपयोगकर्ताओं के लिए opt-out शर्तें आंतरिक तर्कसंगत टोकन की रक्षा नहीं कर सकती हैं, जिससे कंपनी को मॉडल प्रशिक्षण के लिए इस डेटा का उपयोग करने की संभावना हो सकती है। बहस मुख्य रूप से इस अस्पष्टता पर केंद्रित है कि क्या ये छिपे हुए टोकन सेवा समझौते के तहत "आउटपुट" बनाते हैं, यह देखते हुए कि उपयोगकर्ता उन्हें सीधे प्राप्त नहीं करते हैं।
- भुगतान करने वाले उपयोगकर्ताओं की opt-out नीतियाँ आमतौर पर "आउटपुट" की रक्षा करती हैं, लेकिन तर्कसंगत टोकन उपभोक्ता के लिए दिखाई नहीं देते हैं।
- तर्कसंगत टोकन में उपयोगकर्ता इनपुट और प्रतिक्रियाओं के संसाधित संस्करण होते हैं, जो सिंथेटिक डेटा जनरेशन के लिए मूल्यवान बनाते हैं।
- OpenAI की वर्तमान शर्तों के विपरीत, Anthropic का समझौता opt-out सुरक्षाओं के लागू होने के लिए उपयोगकर्ता को आउटपुट प्राप्त करने की आवश्यकता नहीं रखता है।
- यह छिद्र OpenAI को RL अनुकूलन प्रतिबंधों का उल्लंघन किए बिना पूर्व-प्रशिक्षण या मध्य-प्रशिक्षण मिश्रण में तर्कसंगत डेटा शामिल करने की अनुमति दे सकता है।
यह भेद महत्वपूर्ण है क्योंकि यह सुझाव देता है कि यदि आंतरिक मॉडल अवस्थाओं का उपयोग भविष्य के संस्करणों को बेहतर बनाने के लिए किया जाता है, तो प्रशिक्षण से opt-out असरकारी हो सकता है।