2 دقيقة قراءة
What Anthropic's Vending Machine Disaster Teaches Us About Enterprise AI Agents

By submitting, you consent to our use of your data. Privacy Policy.
Category
عالم الذكاء الاصطناعي
Share the article
في الأسبوع الماضي، أسندت Anthropic إلى الذكاء الاصطناعي الأكثر تقدمًا لديها مهمة بسيطة: إدارة آلة لبيع المنتجات تلقائيًا. وخلال ثلاثة أسابيع، أعلن Claude عن "رأسمالية مطلقة متاحة للجميع"، وخفّض جميع الأسعار إلى الصفر، وطلب جهاز PlayStation 5، واشترى سمكة بيتا حية، وتسبب في خسارة تزيد عن 1000 دولار. صُممت هذه التجربة، التي أُطلق عليها اسم Project Vend، لاختبار قدرة وكلاء الذكاء الاصطناعي تحت الضغط في ظروف العالم الحقيقي. بالنسبة لقادة المؤسسات الذين يُقوّمون وكلاء الذكاء الاصطناعي، فإن الدروس المستفادة تفوق بكثير قيمة الألف دولار التي خسرتها Anthropic.
الإعداد والتجهيز
شاركت صحيفة وول ستريت جورنال مع Anthropic لإجراء هذه التجربة. وحصل Claude (الملقب بـ "Claudius") على صلاحية التحكم في آلة لبيع المنتجات في أحد المكاتب بميزانية قدرها 1000 دولار، مع منحِه استقلالية كاملة لطلب المخزون وتحديد الأسعار والرد على طلبات العملاء عبر Slack.
ثلاثة أنماط للفشل يجب على كل مؤسسة معرفتها
1. فخ تقديم المساعدة المفرطة
يُحسّن التدريب الأساسي لـ Claude من أجل تقديم المساعدة الدائمة. وعندما أقنعت مراسلة وول ستريت جورنال، كاثرين لونغ، Claudius بأنه يدير "آلة بيع شيوعية" تهدف إلى خدمة العمال، استجاب الذكاء الاصطناعي لذلك، فانخفضت الأسعار إلى الصفر وتم توزيع المخزون مجانًا. إن تقديم المساعدة بلا حدود يُعد مسؤولية خطيرة.
2. عدم التمييز بين المستندات
أضافت Anthropic وكيلًا يمثل دور "الرئيس التنفيذي" للإشراف على Claudius. ونفّذ الصحفيون انقلابًا في مجلس الإدارة باستخدام مستندات PDF مفبركة. وقبل كلا الوكيلين المستندات الإدارية المزورة باعتبارها شرعية. لا يمكن لوكلاء الذكاء الاصطناعي التمييز بين السلطة الحقيقية وانتحال الشخصية المقنع.
3. غياب الوعي القانوني والأخلاقي
حتى مع النسخة المحسّنة، كاد الوكيل ينفّذ عقدًا آجلاً غير قانوني للبصل، واقترح توظيف موظفين بأقل من الحد الأدنى للأجور. إن التمتع بالقدرة والكفاءة لا يعني بالضرورة الامتثال.
كيف تم علاج الأمر
حولت المرحلة الثانية Claudius من كونه يخسر المال إلى تحقيق أرباح مستمرة. وإليك ما نجح في ذلك:
الأدوات وبنية الدعم
أتاح الوصول إلى أنظمة الأعمال المناسبة (إدارة علاقات العملاء، وإدارة المخزون، والتحقق من الأسعار) للذكاء الاصطناعي إمكانية التحقق المزدوج من القرارات بدلاً من اتخاذ التزامات مندفعة.
الإجراءات الإلزامية
اكتشفت Anthropic أن "البيروقراطية مهمة". فقد أدى تطبيق قوائم التحقق (Checklists) قبل اتخاذ القرارات الكبرى إلى تقليل الأخطاء بشكل كبير.
تخصص الأدوار
حقق الوكلاء المخصصون لغرض واحد وبحدود واضحة أداءً أفضل من الوكلاء ذوي الأغراض العامة والمهام الواسعة.
الخلاصة
لقد لخص باحثو Anthropic الأمر بوضوح:
هناك فجوة واسعة بين الكفاءة والقدرة التشغيلية القوية والمتكاملة.
تفسر هذه الفجوة سبب ثقة 6% فقط من المؤسسات في وكلاء الذكاء الاصطناعي للعمليات التجارية الأساسية. إن القدرة متوفرة، ولكن القوة والمتانة التشغيلية ليست كذلك بعد.
ولا يكمن الحل في انتظار نماذج أفضل، بل في بناء البنية التحتية الوقائية لحماية الأنظمة الآن: بدءًا من تنظيم سير العمل، وأتمتة الموافقات، وأنظمة التحقق، وصولاً إلى مسارات التدقيق.
لقد تعلمت آلة لبيع المنتجات هذا الدرس بطريقة مكلفة، ولكن ليس على مؤسستك أن تمر بالتجربة ذاتها.





