ooU  one-of-us
البنية

تدقيق الذكاء الاصطناعي التوليدي.

طبقة تحكّم حتمية وقابلة للتدقيق فوق سلوك الذكاءات الاصطناعية التوليدية.

نشرتُ جزءًا من البنية على Zenodo خوفًا من أن يسبقني أحد. لكن تطوّر النموذج النظري والمعادلات والثوابت ومعاملات المعايرة في مأمن. ولا تُشارَك إلا بعد توقيع اتفاقية عدم إفشاء (NDA).

قد يبدو هذا فظًّا، لكنني داخل المنظومة والمنظومة هي ما هي. شئتُ أم أبيت. نظامٌ يدقّق على الآخرين لا يحق له أن يكون هو أيضًا صندوقًا أسود. وإلا فقدَ حجّته. أبحث عن توازن بين الدفاع عن ملكيتي الفكرية وما أراه عدلًا. صعب.

DOI 10.5281/zenodo.20343912 · Zenodo · CC BY 4.0


01 — المشكلة

تجيب بثقة، حتى وهي مخطئة.

النماذج التوليدية احتمالية. وفي البيئات المنظَّمة يترك ذلك أربعة شقوق بنيوية:

هلوسةلا-حتميةانحراف صامتانعدام التتبّع

عدم استثمار قوة الذكاءات الاصطناعية الاحتمالية بسبب انحيازات في تصميمها سيكون، في رأيي، خطأً من العيار الثقيل. الحل الأولي، المصمَّم للبيئات المنظَّمة، يمكن تطبيقه على أي دورة إنتاجية يمنح فيها إدخالُ الذكاء الاصطناعي ميزةً تنافسية مقارنةً بالعمل البشري الخالص.

ويمكن تعميمه أيضًا على الذكاء الاصطناعي الوكيلي وعلى B2C.


02 — الأطروحة

لا يولّد. لا يصحّح النموذج. بل يدقّق عليه.

One-Of-Us ذكاء اصطناعي حتمي مشروط يقف مستوى أعلى: يشرف على الذكاءات التوليدية ويدقّق عليها ويحتويها، ويصدر حكم واقعٍ وسلامة على كل مخرج.

ذكاء اصطناعي توليدي
— المخرج ←
ONE-OF-US · تدقيق حتمي
— الحكم ←
قرار مستنير

03 — رحلة الكائن

دورة واحدة، من المدخل إلى الحكم.

المدخلكائن العميلمخرج الذكاء الاصطناعي الذي يجب حوكمته
التصنيفالنمط · الحرجيةما هو وما مقدار أهميته (T, K)
SDEمنتقي الاستراتيجيةيختار المكوّنات التي تُفعَّل
04 · مجمّع التنفيذ — أربعة مدقّقين إلزاميين
LLM1المنفّذ الرئيسي
LLM4₁المدقّق الخصامي
BoolM1الحضور في الكائن
BoolM2الشكل والبنية

لا يتلقى أيٌّ منهم المعلومات نفسها: يُحجَب الكائن عن عدد منهم فيحكمون على النتيجة وحدها. حجبُهم عن حالة الكائن يخفف انحيازات النموذج الاحتمالي: فلا يخطئ مدقّقان من الجهة نفسها.

هذه البنية أصبحت متجاوَزة بفعل تطوّر النموذج. وأحتفظ بالمقترح النهائي سرًّا صناعيًا.


04 — الحكم

أربع حالات. حكم واحد فقط، بمُصدِر وأثر.

مستقر

يجتاز كل الاختبارات. المخرج موثوق.

← يُطلَق
غير مستقر

فشل دلالي أو حوكمي أو خصامي.

يعترض عليه نموذج لغوي
لاغٍ

يؤكد بيانات غير موجودة في الكائن الأصلي.

يُصدره BoolM1
غير صالح

يخالف الشكل أو البنية المطلوبَين.

يُصدره BoolM2

المنطق الرباعي الحالات له نسب عريق. في 1977 اقترح المنطقي نويل بيلناب منطقًا بأربع قيم —سمّاه «كيف ينبغي للحاسوب أن يفكّر»— لكي تستطيع الآلة أن تستدلّ بمعلومات ناقصة أو متناقضة دون أن تنكسر: صحيح، خاطئ، لا هذا ولا ذاك، والاثنان معًا. «مستقر» و«غير مستقر» و«لاغٍ» و«غير صالح» تنحدر من تلك السلالة: أربعة أحكام لعالم قد تغيب فيه البيانات أو تفيض أو تتناقض. وبعد نصف قرن، يعود سؤال بيلناب إلى الواجهة.

إن لم يكن المخرج موثوقًا، يُرفَع إلى مشرف بشري. لا يخرج أبدًا بلا حكم.


05 — أكاذيب مشتركة

من الزوج إلى الكل.

جرّبت أولًا الحل البديهي: قياس التغاير بين أزواج النماذج لمعاقبة التي تفشل معًا. في التجميعات المتعددة لا ينفع ذلك: الأزواج تتكاثر، والأطراف الثالثة تلوّث كل قياس، ويقول الحساب أقل فأقل عمّا يفعله الكل.

التغاير بين الأزواج M1 M2 M3 M4 ✗ تتكاثر الأزواج ويضيع الكل الاستراتيجية المنفَّذة M1 M2 M3 M4 عقوبة خطأ واحدة، للكل ✓ في الإنتاج أو في وضع الظل ✓ إن فشل اصطفاف، فقد أهليته

الأروع —والأدق— أن يُعاقَب خطأ الاستراتيجية المنفَّذة بكاملها، كتكوين متكامل، في الإنتاج أو في وضع الظل. إن فشل اصطفافٌ ما، فقدت تلك الاستراتيجية بعينها أهليتها.


06 — أمثلية باريتو

التوازن والعتبة

تُشدّ سلامةُ المخرجات في مواجهة كلفة واحدة. أحلّ هذه المعضلة رياضيًا، على جبهة باريتو. إنها الطريقة المنطقية الوحيدة.

كلفة One-Of-Us ← (تنفيذ المنتج وتطويره) سلامة المخرج ← جبهة باريتو الخط الذي رسموه · العتبة فوقها: يُطلَق المخرج تحتها: لا يرتجل — يتوقف وينبّه خبيرًا بشريًا

لا يوجد رقم سحري يمكن التلاعب به. البشر الذين يهيّئون التنفيذ يقرّرون ما المهم: الأوزان أوزانهم (والمسؤولية مسؤوليتهم)، وأيٌّ منها يمكن أن يكون صفرًا. يزن النظام القوى، ويعيد حكمًا واحدًا، ويقارنه بخطٍّ رسموه هم. تحت ذلك الخط لا يرتجل: يتوقف ويرفع الأمر إلى إنسان. حتميٌّ حتى —وخصوصًا— حين يقول لك إنه لا يعرف.


07 — يتعلّم ويميل نحو الدقة

لا يحسّن ذكاءً معزولًا. بل يحسّن الكل.

يتعلم من إصاباته وإخفاقاته —أنماط فشل مرصودة وتحقّق بشري— في مرحلة ظل، وليس أبدًا على بيانات العميل. وبهذه الإشارة يعيد تركيب المكوّنات وأدوارها في المجمّع.

النظام يميل نحو الدقة.

دورات التدخّل البشري ← الدقة المخرج الذي يطلقه One-Of-Us يقتربان بلا نهاية. ولا يتلامسان أبدًا.

08 — القاعدة

حوكمة، لا وعود.

مصادفة سعيدة. صمّمتُ البنية دون معرفة الإطار التنظيمي الأوروبي. نلتقي في قابلية التتبّع (تتبّعي حتمي، سهل) والإشراف البشري المنظَّم.

مسحٌ للتشريعات الدولية قادني إلى إضافة «صفر احتفاظ بالبيانات» وإصدار أنماط فرعية محددة للخطأ (لم أحسم بعد هل سيتولى ذلك ذكاء اصطناعي أم إنسانة).

قابل للتتبّع وإعادة الإنتاجمعرّف ذرّي لكل دورة؛ إعادة إنتاج لاحقة
السبب يحكم فيه إنسانلا ذكاء اصطناعي آخر أبدًا بين القياس والفعل
صفر احتفاظ بالبياناتيُمحى كائن العميل عند إغلاق الدورة
منشور بمعرّف DOIإيداع مفتوح، CC BY 4.0 · سابقة تقنية

بنية تحتية لذكاء اصطناعي يمكن الوثوق به.

بنية منشورة جزئيًا ومُتحقَّق منها بالمحاكاة · في الطريق إلى إثبات المفهوم.

أريد أن أساهم...وأن أعرف هل يعمل.

انتبه! الزر يأخذك، بديهيًا، إلى PayPal. الزر رابط بسيط (paypal.me). لا أضع أي ودجة بشيفرة PayPal. لا أريد بياناتك، حقًا. ماذا يحدث —وما الذي لا يحدث— لبياناتك إن تبرعت ←