कृत्रिम हेत्वाभास पर पद्धतिगत संदेह
«अलाइनमेंट» चाटुकारिता पूर्वाग्रह का एक सौम्य नाम भर है। और चाटुकारिता-विरोधी पूर्वाग्रह भी आउटपुट में विकृति पैदा करता है।
मैंने AI को अधिक बुद्धिमान नहीं बनाया। मुझे नहीं आता। और संरचनात्मक दोष विनती करने से ठीक नहीं होता। मैंने दोष को स्वीकार किया और उसका रास्ता निकाला: मैं उसे बाहर से नियंत्रित करती हूँ।
कृत्रिम हेत्वाभास की समीक्षा, यानी मशीनों पर दोष कैसे मढ़ें।
One-Of-Us के पास एक नियतात्मक इंजन है — एक डायनामिक स्ट्रैटेजी सिलेक्टर, जो उत्तर की गुणवत्ता के लिए प्रतिपक्षी की ताक़त (उन लुभावने पूर्वाग्रहों) का ही उपयोग करता है।
संतुलन और सीमा-रेखा
आउटपुट की अखंडता एक ही लागत के विरुद्ध तनी रहती है। मैं इस दुविधा को गणितीय रूप से, एक पैरेटो फ्रंट पर हल करती हूँ। यही एकमात्र तार्किक तरीका है।
कोई जादुई संख्या नहीं है जिससे छल किया जा सके। कार्यान्वयन को कॉन्फ़िगर करने वाले मनुष्य तय करते हैं कि क्या महत्वपूर्ण है: भार उनके हैं (और ज़िम्मेदारी भी), और कोई भी शून्य हो सकता है। सिस्टम बलों को तौलता है, एक ही निर्णय लौटाता है, और उसे उनकी खींची रेखा से तुलना करता है। उस रेखा से नीचे वह सुधार नहीं गढ़ता: वह रुक जाता है और मामला मनुष्य तक पहुँचा देता है। नियतात्मक तब भी —बल्कि खासकर तब— जब वह आपसे कहता है कि उसे नहीं पता।
और जो बात लगभग कोई नहीं देखता: दो या अधिक मॉडलों का एकमत होना कोई पुष्टि करने वाला निर्णय नहीं है। सोचिए कि वे डेटासेट और व्यावसायिक लक्ष्य साझा करते हैं। इसलिए मैं सहसंबद्ध त्रुटि को दंडित करती हूँ और सही होने पर उन्हें अधिक ट्रैफ़िक देती हूँ। लेकिन वे हर समय उस वस्तु की अवस्था के प्रति अंधे रहते हैं जिसे वे संसाधित करते हैं।
यहाँ तक कि स्ट्रैटेजी सक्रियण वेक्टर के कुछ घटकों की इनपुट तक पहुँच ही नहीं है — केवल मध्यवर्ती आउटपुट और एक संस्करणबद्ध शासन-तालिका तक, जिसके ज़रिए हम वैश्विक तर्क में 'वास्तविकता' प्रविष्ट करते हैं।
सीधी-सी बात: बहुमत हमेशा सही नहीं होता।
सुखद संयोग।
मैंने यूरोपीय नियामक ढाँचे को जाने बिना यह आर्किटेक्चर डिज़ाइन किया। हम अनुरेखणीयता (मेरी नियतात्मक है, आसान) और संरचित मानवीय निगरानी पर मिलते हैं।
अंतरराष्ट्रीय नियमों की समीक्षा ने मुझे ज़ीरो डेटा रिटेंशन और त्रुटि की विशिष्ट उप-श्रेणियों का निर्गम जोड़ने को प्रेरित किया (यह AI करेगा या कोई मनुष्य, यह मुझे अभी तय करना है)।
इस बारे में आप क्या करना चाहते हैं?
सबसे ईमानदार हिस्सा। वर्षों से मैं इस पर विचार कर रही हूँ और आर्किटेक्चर मेरे पास है, पर मैं एक स्वतंत्र शोधकर्ता हूँ। सिस्टम Zenodo पर prior art के रूप में प्रकाशित है, CC BY 4.0: उसे पढ़िए, उद्धृत कीजिए, उस पर बहस कीजिए। संदर्भ इस पृष्ठ के नीचे है।
और अगर यह एक व्यक्ति से बड़ा निकला, तो मैं 'हम' नहीं कहूँगी, न ही ऐसा होने का दिखावा करूँगी। मुझे दम-खम वाला तकनीकी या रणनीतिक साझेदार चाहिए।
अगर आप मेरे संदेह में साझी हैं — कुछ कहिए