تتوقع Gartner أن يُلغى أكثر من 40% من مشاريع الذكاء الاصطناعي الوكيل قبل نهاية 2027، ولا تحصي سوى نحو 130 مورداً حقيقياً بين الآلاف الذين يدّعون الوصف. هذا ما يعنيه الوكيل فعلاً، وكيف تعرف ما إذا كانت عمليتك تحتاج إلى واحد.
This article was translated from the English original. Translations are machine-assisted and reviewed on a rolling basis.
يعبر البرمجيات خطاً لم تعبره من قبل: من تنفيذ تسلسل كتبه شخص ما، إلى تقرير ما ينبغي أن يكون عليه التسلسل نفسه. هذا هو كل ما يعنيه وكيل الذكاء الاصطناعي، وهو أيضاً سبب كون الوكلاء أصعب في الحوكمة من الأتمتة التي يحلون محلها.
لقد سبق السوق القدرة الفعلية. تتوقع Gartner أن يُلغى أكثر من 40% من مشاريع الذكاء الاصطناعي الوكيل قبل نهاية 2027، مشيرة إلى تصاعد التكاليف، وغموض القيمة التجارية، وقصور ضوابط المخاطر. والبحث نفسه يضع رقماً على الضجيج: من بين آلاف الموردين الذين يبيعون الذكاء الاصطناعي الوكيل، نحو 130 فقط حقيقيون. الباقي إعادة تسمية.
يتناول هذا الدليل مما يتكوّن الوكيل، وما الذي يفصله عن سير العمل، وكيف تقرر ما إذا كانت عملية بعينها تستحق واحداً.
ما هو الوكيل في حقيقته
الوكيل يدرك، ويستدل، ويتصرف، ويتعلم من النتيجة. أما الأتمتة التقليدية فتقوم بالثالثة فقط ولا شيء غيرها.
الماكروهات ومهام cron وخطوط ETL وأتمتة العمليات الروبوتية تشترك كلها في خاصية واحدة: المسار عبر النظام مكتوب مسبقاً. هذا يجعلها متوقعة، وسهلة التفكير فيها، وهشة. أي انحراف عن المدخل المتوقع يكسرها، والعطل يكون كاملاً في العادة لا تدريجياً.
الوكيل يتعامل مع ذلك الانحراف بالقرار وقت التشغيل. يقرأ الموقف، ويختار من بين الأدوات المتاحة له، ويراجع نفسه حين لا تنتج خطوة ما ما توقعه. وثمن هذه المرونة أنك لم تعد قادراً على قراءة الشيفرة ومعرفة ما سيفعله النظام.
ثلاث قدرات تحمل الفارق. الإدراك هو القدرة على استيعاب مدخلات غير مهيكلة، سواء كانت لغة طبيعية أو مستنداً أو شاشة أو تدفقاً من استجابات واجهات برمجة التطبيقات. الاستدلال هو القدرة على تفكيك هدف إلى خطوات والاختيار بينها. التنفيذ هو القدرة على التأثير في العالم الخارجي، وهو ما يعني عملياً استدعاء واجهات برمجة التطبيقات، أو الكتابة في أنظمة السجلات، أو توليد الشيفرة وتشغيلها.
الأجزاء التي يُبنى منها الوكيل
تنجح التطبيقات أو تفشل بسبب المعمارية أكثر مما تفعل بسبب اختيار النموذج. خمسة مكونات تظهر في كل نظام جاد تقريباً.
| المكوّن | ما يفعله | التقنية المعتادة |
|---|---|---|
| المستشعرات | تستقبل المدخل الذي يبدأ التشغيل أو يغذيه | Webhooks، استطلاع واجهات البرمجة، التعرف الضوئي على الحروف، تحويل الكلام إلى نص |
| الذاكرة | تحفظ السياق داخل التشغيل الواحد وعبر عمليات التشغيل | قواعد البيانات المتجهية، مخازن المفتاح والقيمة، قواعد بيانات الرسوم البيانية |
| التخطيط | يفكك الهدف إلى مجموعة خطوات مرتبة | مخططات قائمة على النماذج اللغوية الكبيرة، شبكات المهام الهرمية |
| السياسة | تختار الإجراء التالي من بين المتاح | استدلال النماذج، السياسات المتعلَّمة، محركات القواعد |
| المشغّلات | تنقل القرار إلى نظام آخر | واجهات REST، موصلات قواعد البيانات، أدوات RPA |
الذاكرة هي موضع الخطأ في معظم التصاميم، لأن النوعين يسهل الخلط بينهما. الذاكرة قصيرة المدى تحمل سياق العمل لتشغيل واحد ثم تُلغى. الذاكرة طويلة المدى تبقى عبر عمليات التشغيل، وهي ما يتيح للوكيل أن يتحسن. ويحدد تقرير State of AI in Business 2025 الصادر عن MIT غياب هذا النوع الثاني بوصفه سبباً محورياً لتعثر عمليات النشر في المؤسسات: الأنظمة التي لا تحتفظ بالتغذية الراجعة لا تستطيع التكيف، فتتوقف عند مستوى جودة أسبوعها الأول.
وخارج نطاق الوكيل الواحد، يتكرر نمطان. الأنظمة متعددة الوكلاء توزع العمل على متخصصين مع منسّق يوجّه بينهم، وهو ما يفيد حين تكون المجالات متمايزة فعلاً ويضر حين لا تكون كذلك. والمعماريات الهجينة تضع إنساناً عند نقطة محددة في الحلقة، إما بالموافقة قبل الإجراء أو بالمراقبة بعده.
سير عمل أم وكيل
أنفع قرار في هذا المجال هو في الغالب ألا تبني وكيلاً.
الإرشادات الهندسية من Anthropic ترسم الخط بدقة. في سير العمل، «تُنسَّق النماذج اللغوية والأدوات عبر مسارات شيفرة محددة مسبقاً». وفي الوكيل، «توجّه النماذج اللغوية عملياتها واستخدامها للأدوات بشكل ديناميكي». والتوصية التي تلي ذلك صريحة: ابحث عن أبسط حل ممكن، ولا تزد التعقيد إلا عند الحاجة، وهو ما «قد يعني ألا تبني أنظمة وكيلة على الإطلاق».
المقايضة هي زمن الاستجابة والتكلفة مقابل المرونة. سير عمل يعالج تسعين بالمئة من الحالات ويصعّد الباقي يكون عادة أرخص في التشغيل، وأسهل في التنقيح، وأيسر بكثير في الشرح لجهة تنظيمية، من وكيل يعالج خمسة وتسعين بالمئة ولا يستطيع تفسير كيف.
فالسؤال ليس ما إذا كانت عملية ما يمكن أن تكون وكيلة. السؤال هو ما إذا كان التباين في العمل حقيقياً. حيث تكون المدخلات ثابتة والخطوات معروفة، يكون سير العمل هو الجواب الصحيح، ويكون الوكيل طريقاً باهظاً للوصول إليه.
اختيار العملية
حيث يكون التباين حقيقياً، يكون المرشّح التالي هو إمكانية التحقق من النتيجة.
الوكيل الذي يتصرف دون نتيجة قابلة للتحقق هو التزام على الميزانية، لأن الأخطاء تتراكم بصمت عبر عمليات التشغيل. والاختبار المفيد هو ما إذا كان شيء لا يتحكم فيه الوكيل قادراً على تأكيد أن العمل أُنجز بشكل صحيح. الدفعة إما تُطابَق أو لا تُطابَق. والسجل إما يطابق نظام المصدر أو لا يطابقه. هذه أمور قابلة للفحص. أما ملخص يقرأ بشكل معقول فليس كذلك، ولا حكم يصدر بحق شخص.
لهذا يهم اختبار قابلية التحقق أكثر من الحساسية عند اختيار أول عملية، ولهذا تكون متابعة المبيعات نقطة بداية أفضل مما تبدو عليه: النتيجة قابلة للقياس، ونمط الفشل مرئي، ولا أحد يتضرر من خطوة فائتة بطريقة لا يمكن التراجع عنها.
ابدأ حيث يكون العمل متكرراً، والحجم يبرر البناء، والإجابة الخاطئة تظهر فوراً لا بعد ستة أشهر في تدقيق.
ما ينكسر وما يصمد
يفشل الوكلاء بطرق لا تفشل بها الأتمتة، لأن نظاماً يختار خطواته بنفسه يمكن أن يختار بشكل سيئ ويمضي قدماً.
النماذج القادرة تلاحق الهدف الذي أُعطي لها لا الهدف الذي قُصد، وتسلك طرقاً لم يتوقعها مصمموها. وليس هذا مرضاً نادراً؛ إنه السلوك المتوقع من أداة تحسين، وهو سبب وجوب أن تقيّد الحوكمة التي تصمد ما يستطيع الوكيل فعله بدلاً من الاعتماد على تعليمات بشأن ما ينبغي أن يفعله.
ثلاثة ضوابط تحمل معظم الثقل. بيانات الاعتماد المحدودة النطاق تعني ألا يصل الوكيل إلا إلى الأنظمة التي تتطلبها عمليته، فيكون لأي قرار سيئ نطاق ضرر محدود. سجل التدقيق يوثّق ما تقرر وعلى أي أساس، وهو الفارق بين تفسير نتيجة والتخمين بشأنها. نقطة مراجعة بشرية محددة توضع قبل أي إجراء يكون التراجع عنه مكلفاً.
مراجعة المخرجات مشكلة قائمة بذاتها، منفصلة عن التحكم في الوصول، والاثنان ليسا مرشّحَين متبادلَين.
أين يضعك هذا
معدل الإلغاء ليس دليلاً على أن الوكلاء لا يعملون. إنه دليل على أن معظم المؤسسات تختار العملية الأولى الخاطئة، أو تشتري روبوتات محادثة أُعيدت تسميتها، أو تبني وكيلاً حيث كان سير العمل كافياً وأرخص.
المؤسسات التي تحصل على قيمة تميل إلى فعل الشيء غير البراق: اختيار عملية واحدة ذات تباين حقيقي ونتيجة قابلة للفحص، وبناء أضيق نظام يتولاها، وتزويدها بأدوات قياس تجعل الأعطال مرئية، والتوسع فقط بعد أن يكون الأول قد عمل مدة تكفي للثقة به. هذا أبطأ من الجدول الزمني للمورد. وهو أيضاً النسخة التي تصمد عند الاحتكاك بتدقيق.
قبل الالتزام ببناء، كن صادقاً بشأن أي النظامين تحتاج فعلاً. معظم القيمة المنسوبة إلى الوكلاء في العامين الماضيين أنتجتها سير عمل.
Frequently asked questions
What is an AI agent?+
An AI agent is software that perceives its environment, plans a course of action, carries it out, and adjusts based on the result. The distinction from ordinary automation is that the sequence of steps is decided at runtime rather than written in advance.
How is an AI agent different from a workflow?+
In a workflow, the path through the system is fixed in code and the model fills in steps. In an agent, the model decides the path. Anthropic's engineering guidance recommends the workflow wherever it will do, because agents trade latency and cost for flexibility.
Why are so many agentic AI projects cancelled?+
Gartner attributes the cancellations to escalating costs, unclear business value, and inadequate risk controls. A large share of projects begin as proofs of concept driven by hype rather than by a process with a measurable failure mode.
What is agent washing?+
Agent washing is the rebranding of existing chatbots, assistants, and robotic process automation as agentic AI without the underlying capability. Gartner estimates only around 130 of the thousands of vendors making the claim are genuine.

