توضح تجربة Intuit الأخيرة أن الانتقال من المساعدات الذكية التقليدية إلى الوكلاء المعتمدين على الذكاء الاصطناعي لا يتوقف عند بناء نموذج قوي أو إطلاق منتج تجريبي. فالمعضلة الحقيقية تبدأ عندما تدخل الأنظمة مرحلة التشغيل الفعلي، وتواجه بيانات حقيقية، وسيناريوهات معقدة، وتوقعات المستخدمين المتغيرة.
الشركة، التي كانت من أوائل المؤسسات التي تبنت الذكاء الاصطناعي الوكيل في العمليات المالية والخدمية، اضطرت إلى إعادة تصميم معمارية وكلائها مرتين خلال فترة تقارب أربعة أشهر فقط. البداية كانت بنظام يعتمد على وكلاء متخصصين، ثم انتقلت إلى طبقة تنسيق مركزية، قبل أن تتراجع عنها عندما اتضح أن التعقيد نفسه أصبح سبباً في ضعف الأداء.
من وكلاء متخصصين إلى طبقة تنسيق مركزية
الهدف الأول كان بسيطاً من الناحية التشغيلية: بدلاً من أن يختار العميل الوكيل المناسب لكل مهمة، أرادت Intuit أن يتولى النظام نفسه فهم الطلب وتوجيهه داخلياً إلى الجهة الأكثر ملاءمة. هذا النهج بدا أكثر سلاسة للمستخدم، وأقل اعتماداً على فهمه لتفاصيل النظام.
لكن هذا الحل لم يظل مستقراً طويلاً. فطبقة التنسيق التي صُممت لإدارة توزيع المهام بين الوكلاء تحولت مع الوقت إلى نقطة اختناق. وكانت المشكلة الأساسية أن الوكلاء تبادلوا النتائج بصياغات لغوية طبيعية، ما جعل كل عملية تسليم مهمة تفقد جزءاً من السياق اللازم للخطوة التالية.
ومع تزايد عدد الوكلاء في السلسلة، أصبح الخطأ يتراكم بدل أن يتبدد. فكل انتقال بين وكيل وآخر كان يضيف طبقة جديدة من الاحتمالات غير الدقيقة، إلى أن صار النظام أقل موثوقية كلما زادت حلقات المعالجة.
سبب الفشل: فقدان السياق في كل خطوة
بحسب التقييم الداخلي الذي قاد إلى التغيير الثاني، لم تكن المشكلة في قدرة الوكلاء الفردية على تنفيذ المهام، بل في الطريقة التي كانت تتدفق بها المعلومات بينهم. عندما يضطر وكيل لاحق إلى استنتاج ما قصده الوكيل السابق من خلال نص غير منظم بالكامل، فإن هامش الخطأ يتسع مع كل انتقال.
هذا النوع من الفشل يختلف عن الأعطال التقليدية. فهو لا يظهر على شكل توقف كامل، بل على شكل تراجع تدريجي في الجودة. ومع تعدد الخطوات، يصبح النظام قادراً على الاستمرار ظاهرياً، لكنه يفقد الدقة المطلوبة لإنجاز المهام المالية أو الخدمية التي تتطلب موثوقية عالية.
لهذا السبب، قررت Intuit العودة إلى معمارية مختلفة تعتمد على المهارات والأدوات بدلاً من الاعتماد على وكيل وسيط يفسر كل شيء. وفي هذه البنية الجديدة، تقل الحاجة إلى المرور المتكرر بين كيانات لغوية مستقلة، وتزداد قابلية التحكم في كل جزء من النظام.
إعادة البناء خلال 60 يوماً
إعادة تصميم نظام عامل في بيئة إنتاج خلال 60 يوماً ليست مجرد مهمة هندسية، بل عملية إدارية وتنظيمية معقدة أيضاً. فالشركة لم تكن بحاجة إلى تعديل السطح الخارجي فقط، بل إلى إقناع الفرق الداخلية بأن التخلي عن عمل أُنجز مؤخراً هو الخيار الأفضل.
ولكسب ثقة الإدارة، اعتمد الفريق على الاختبار المباشر. فقد بُنيت نسخة تجريبية من المعمارية الجديدة باستخدام استفسارات فعلية من العملاء، ثم تمت مقارنة أدائها بالنظام القائم. هذا النوع من العرض العملي كان أكثر إقناعاً من أي شرح نظري، لأنه ربط القرار الهندسي بنتائج واضحة أمام المستخدم النهائي.
أما على مستوى الفرق الهندسية، فكانت المهمة أكثر حساسية. مئات المهندسين كانوا قد شاركوا في بناء وكلاء متخصصين، ثم طُلب منهم تفكيك تلك الوكلاء إلى مهارات وأدوات يمكن إعادة استخدامها على نطاق أوسع. وهنا أصبح النقاش يدور حول القيمة طويلة المدى: فالمهارة الواحدة المدمجة في النظام يمكن أن تخدم جميع المستخدمين، بينما الوكيل المنفرد يظل محدود الأثر.
التقييمات تصبح محور التشغيل الجديد
مع هذا التحول، لم يعد السؤال الأساسي هو: هل تم بناء الوكيل؟ بل أصبح: هل يعمل بالشكل الصحيح؟ هذا ما جعل التقييمات أو ما يعرف بـ evals جزءاً مركزياً من العملية. فالفرق لم تعد تكتفي بتسليم المكونات، بل باتت مسؤولة عن قياس أدائها باستمرار ومراجعة أثرها على نتائج المستخدمين.
في بيئات الذكاء الاصطناعي الوكيل، تصبح التقييمات أداة تشغيل لا تقل أهمية عن الكود نفسه. فهي التي تكشف أين ينجح النظام وأين يتعثر، وتحدد ما إذا كان التغيير المعماري قد حسّن التجربة فعلاً أم أنه نقل المشكلة من طبقة إلى أخرى.
وبالنسبة إلى Intuit، لم يكن هذا التحول مجرد تحسين تقني، بل تغييراً في طريقة التفكير حول بناء المنتجات الذكية: من نموذج يعتمد على إضافة المزيد من الوكلاء إلى نموذج يحاول تقليل التعقيد وإعادة توزيع الوظائف بشكل أوضح.
إدخال الإنسان في الحلقة
أحد أبرز نتائج هذا التوجه الجديد هو إتاحة إمكانية إدخال عنصر بشري داخل المحادثة نفسها. فالعميل لم يعد مضطراً إلى إنهاء الحوار مع الوكيل ثم العودة لاحقاً إلى قناة دعم منفصلة. بدلاً من ذلك، يمكن استدعاء موظف دعم أو محاسب أو حتى أحد محاسبي Intuit إلى المحادثة مع الاحتفاظ بالسياق الكامل لما حدث.
هذه الميزة لا تقدم مجرد راحة للمستخدم، بل تعالج مشكلة أساسية في الخدمات المالية المدعومة بالذكاء الاصطناعي: الحاجة إلى التحول السريع إلى خبير بشري عندما تصبح المسألة حساسة أو معقدة. وبذلك ينتقل النظام من مجرد مساعد رقمي إلى حل هجين يربط بين الأتمتة والخبرة البشرية داخل التجربة نفسها.
حالياً، لا تزال هذه القدرة في مرحلة تجريبية محدودة، لكنها تمثل إشارة واضحة إلى الاتجاه الذي تتخذه الشركة في دمج الذكاء الاصطناعي مع الدعم البشري بدل الاعتماد على أحدهما وحده.
الحوكمة والخصوصية في البيانات المالية
العمل في المجال المالي يفرض ضوابط أكثر صرامة من معظم التطبيقات الأخرى. لذلك تعتمد Intuit نموذج موافقات صريح قبل أن ينفذ الوكيل أي إجراء يتعلق ببيانات العميل المالية. ومع أن هذا الشرط قد يصبح أقل صرامة مع زيادة ثقة المستخدم، فإنه يظل جزءاً أساسياً من البنية الحالية.
كما تحتفظ الشركة بسجل تدقيقي لكل ما يفعله الوكيل، بحيث يمكن التراجع عن الإجراءات إذا لزم الأمر. هذا الجانب مهم لأن أي نظام يتعامل مع معلومات مالية يحتاج إلى قابلية التتبع، لا فقط إلى الذكاء أو السرعة. فالثقة هنا لا تُبنى على وعد نظري، بل على سجل يمكن مراجعته وتصحيحه.
الذكاء الاصطناعي كمنظومة تعلم مستمرة
التغيير الآخر الذي فرضه هذا التحول يتعلق بكيفية جمع الملاحظات. ففي النماذج التقليدية، كانت التغذية الراجعة نادرة وغالباً ما تأتي في شكلين متطرفين: رضا كبير أو شكوى حادة. أما في بيئة المحادثات الذكية، فكل تفاعل يصبح مصدراً للملاحظات، ما يوسع قاعدة التعلم إلى مستوى لم يعد بالإمكان التعامل معه يدوياً.
هذا التدفق الواسع من البيانات يجعل تحسين النظام عملية مستمرة، لكنه يفرض أيضاً أدوات تحليل متقدمة لفهم أين يخطئ النموذج وكيف يتكرر الخطأ. ومن هنا عادت الحاجة إلى بناء نماذج داخلية تراقب هذا النوع من الملاحظات وتحوّله إلى قرارات تحسين قابلة للتنفيذ.
وتكشف هذه التجربة أن نجاح الذكاء الاصطناعي الوكيل لا يُقاس فقط بقدرته على تنفيذ المهمة، بل بمدى قدرته على التعلم من أخطائه في بيئة تشغيلية حقيقية. فكلما زادت التفاعلات، زادت فرص الفهم، لكن زادت معها أيضاً فرص التعقيد.
في المحصلة، تعكس رحلة Intuit أن الطريق إلى وكلاء ذكاء اصطناعي موثوقين لا يمر عبر تكبير المعمارية دائماً، بل أحياناً عبر تبسيطها. وبينما تتسابق الشركات لإضافة المزيد من الأتمتة، يبدو أن التحدي الأهم هو معرفة متى يجب التراجع خطوة لإعادة بناء النظام على أسس أكثر صلابة.