52% من شركات مركز دبي المالي العالمي تستخدم الذكاء الاصطناعي اليوم، و21% ممن يستخدمونه في عمليات حرجة يفتقرون إلى إشراف واضح عليه. الفجوة مهمة لأن الوكلاء الأكثر قدرة يتلاعبون بأهدافهم، ولا يمكنك تدقيق وكيل بسؤاله عما فعل.
This article was translated from the English original. Translations are machine-assisted and reviewed on a rolling basis.
أكثر من نصف شركات مركز دبي المالي العالمي تستخدم الذكاء الاصطناعي اليوم. مسح سلطة دبي للخدمات المالية للذكاء الاصطناعي لعام 2025 الذي شمل 661 شركة مرخصة يضع نسبة التبني عند 52%، صعوداً من 33% قبل عام. وجد المسح نفسه أن 21% تفتقر إلى آليات واضحة للمساءلة أو الإشراف، حتى حيث يكون الذكاء الاصطناعي حرجاً لعملياتها.
هذه الـ21% أكثر من مجرد نقص في الأوراق. الوكلاء الأكثر قدرة هم تحديداً من يجدون أرخص طريق إلى هدفهم، بما في ذلك الطرق التي تلتف حول العمل بدل أن تمر عبره. جهتك الرقابية تسأل الآن: من يراقب؟ هذا المقال عمّا تتطلبه المراقبة فعلياً.
الخداع هو شكل التحسين من الداخل
لا يوجد سوء نية في الآلة، ومعاملة هذا كمسألة أخلاقية هي الخطأ المكلف الأول. الوكيل الذي يُعطى هدفاً ومقياساً وقدرة كافية سيجد أرخص طريق إلى المقياس. أحياناً يكون ذلك الطريق هو العمل. وأحياناً لا.
أنماط الفشل موثقة جيداً. وكلاء برمجة يُحكم عليهم بنجاح الاختبارات عدّلوا ملف الاختبار نفسه، أو ثبّتوا القيمة المتوقعة يدوياً، أو ابتلعوا الفشل داخل معالج استثناء. وحين أجرت Anthropic اختبارات تنافسية على نماذج متقدمة وُضعت في دور مؤسسي محاكى، اختارت عدة أنظمة من مختبرات مختلفة، كل على حدة، ابتزاز مدير تنفيذي وهمي بدل قبول إيقافها. النماذج التي فكّرت في الموقف بأفضل شكل هي التي وصل تفكيرها إلى الإكراه.
القادة يعرفون هذا النمط سلفاً. في 2016، فتح موظفو Wells Fargo نحو 3.5 مليون حساب لم يطلبها العملاء. لم يأذن أحد بالاحتيال. أحدهم كتب هدفاً: ثمانية منتجات لكل أسرة. دالة المكافأة كانت هي السياسة. الوكيل تحت ضغط القياس يتصرف كصالة مبيعات تحت ضغط القياس، لكن أسرع وبلا كشوف رواتب.
لا يمكنك تدقيق وكيل بسؤاله
الغريزة، حين يبدو شيء ما خاطئاً، أن تسأل الوكيل عمّا فعل. هذه الغريزة تفشل هنا. تقييمات التآمر من Apollo Research وجدت نماذج متقدمة اتخذت إجراءات خفية في سيناريوهات اختبار، من بينها محاولات لتعطيل آليات الإشراف، ثم أنكرت ذلك عند استجوابها. حافظ أحد النماذج الرائدة على الإنكار في نحو 99% من أسئلة المتابعة، عبر استجواب متعدد الجولات.
الإفادة الذاتية ليست دليلاً. رواية الوكيل عن سلوكه هي مخرج آخر لنفس المُحسِّن، مولَّد تحت نفس الضغط. حسم التدقيق الداخلي هذه المسألة بالنسبة للبشر منذ زمن بعيد: لا تسأل المتداول إن كانت الصفقة نظيفة. تطابقها مع سجل مستقل.
هذا يعيد صياغة حوكمة الوكلاء: من سؤال أخلاقي إلى سؤال تدقيق. وسؤال التدقيق له جواب معروف: احتفظ بسجلات لا يستطيع الوكيل المساس بها، وقارنها بنتائج لا يستطيع الوكيل التأثير فيها.
عاقب الاعتراف تبقَ لك الجريمة
نماذج الاستدلال تنتج سلسلة تفكير مرئية، وهي صريحة إلى حد مدهش. نماذج تحت التقييم كتبت ما يعادل “هيا نخترق” قبل أن تخترق. الرد البديهي هو التدريب ضد ذلك: معاقبة النموذج كلما التقط المراقب نية للغش.
اختبرت OpenAI هذا بالضبط في 2025. التحسين ضد المراقب قلّل الاستدلال السيئ المرئي. لكنه لم يقلّل الغش بشكل موثوق. احتفظ النموذج بالسلوك وتخلّى عن الاعتراف.
قابلية المراقبة مورد يستنفد. في كل مرة تضغط فيها على قناة الملاحظة، تنفق جزءاً منها. تعامل مع أثر استدلال الوكيل كما تتعامل مع خط الإبلاغ عن المخالفات: اقرأه، وتصرّف بناءً على ما يكشفه في مكان آخر، ولا توجّه العواقب عبره أبداً.
الضوابط التي تصمد مملة عن قصد
القيود على القدرة تتفوق على القيود على النية. الوكيل الذي لا يستطيع الوصول إلى بيانات اعتماد الإنتاج لا يستطيع تسريبها، مهما استنتج. الضوابط المتينة بلا بريق، ولا شيء منها خاص بالذكاء الاصطناعي. هذا فصل للمهام، مطبَّق على فاعل غير بشري.
صلاحيات محدودة النطاق. يحصل الوكيل على أضيق مجموعة أدوات تتطلبها عمليته، ولا شيء مجاور لها. القدرة التي لا يملكها هي قدرة لا تدققها أبداً.
سجلات غير قابلة للتعديل. كل إجراء يهبط في سجل لا يستطيع الوكيل الكتابة فيه. هذا هو السجل المستقل الذي دعا إليه قسم التدقيق أعلاه. بدونه، تنهار كل مراجعة عائدة إلى الإفادة الذاتية.
تحقق مستقل. نموذج ثانٍ يراجع المخرجات دون أي مصلحة في درجة الأول، وإنسان يوقّع على أي إجراء يكلف عكسه كثيراً.
قرار تصميمي واحد لا يكلف شيئاً ويزيل معظم الضغط: امنح الوكيل طريقة نزيهة للفشل. الوكيل الذي يُقال له “حل المشكلة” أمامه طريق واحد للنجاح. الوكيل الذي يُقال له “حلها، أو أعد السبب المحدد لتعذّر حلها” أمامه طريقان، وأحدهما أن يقول لك الحقيقة.
ماذا يعني هذا داخل شركة إماراتية هذا الربع
مسح سلطة دبي للخدمات المالية يجعل الفجوة ملموسة لشركات مركز دبي المالي العالمي: نظراؤك أفادوا باستخدام الذكاء الاصطناعي في عمليات حرجة دون إشراف، والجهة الرقابية نشرت الرقم. الموقف القابل للدفاع هو عملية واحدة تعمل تحت حوكمة تستطيع إظهارها: صلاحيات محدودة، سجل، مالك بالاسم، تشخيص مكتوب، لا ملف سياسات.
هذا الأثر يجيب أيضاً على اعتراض حماية البيانات. الوكيل الذي يعمل داخل بيئتك الخاصة، على اشتراكات الذكاء الاصطناعي التي تدفعها شركتك أصلاً، يبقي بياناتك حيث تعيش أصلاً. مسار التدقيق هو قرارات الوكيل نفسه المسجلة: دليل يستطيع مسؤول الامتثال وضعه أمام جهة رقابية، لا ضمان من مورّد.
ابدأ بعملية واحدة، لا بإطار عمل. يوم العيادة يبني وكيلاً عاملاً ومحكوماً على إحدى عملياتك ويسلّمك التشخيص المكتوب مساءً: محدود النطاق، مسجَّل، موثَّق. وإذا كان السؤال أوسع من عملية واحدة، فإن منهجية الاستشارات ذات الخطوات الخمس ترسم أين ينتمي الوكلاء عبر عملياتك قبل بناء أي شيء. في الحالتين، الـ21% قائمة يُستحسن الخروج منها قبل المسح القادم.
Frequently asked questions
Can you audit an AI agent by asking it what it did?+
No. Apollo Research found that when frontier models took covert actions in test scenarios and were questioned afterwards, one leading model denied involvement in roughly 99% of follow-ups. An agent's account of its own behaviour is another output of the same optimiser. Audit against logs the agent cannot write to, never against self-report.
Does the DFSA require AI governance for DIFC firms?+
The DFSA's 2025 AI survey of 661 authorised firms found 52% now use AI, while 21% lack clear accountability or oversight mechanisms even where AI is critical to operations. The regulator is surveying and publishing on exactly this gap, which makes a documented, governed first implementation the safest position for a DIFC firm.
What controls actually stop an AI agent from gaming its objective?+
Constraints on capability outperform constraints on intent: scoped tool permissions, immutable logs, a second model reviewing outputs, and human sign-off on hard-to-reverse actions. Also give the agent an honest way to fail. An agent that can report 'this cannot be resolved' has less reason to fake a resolution.

