تقييم جاهزية الذكاء الاصطناعياعرف ما الذي يعرقلك فعلاً

الجاهزية ليست رقماً واحداً. قد تملك المنظمة بيانات ممتازة وبلا مالك للعملية، أو وظيفة حوكمة ناضجة وبلا بيانات صالحة. نقيّم خمسة أبعاد كلاً على حدة، لأن العائق دائماً تقريباً واحد منها، والعلاج مختلف في كل حالة.

خمسة أبعاد تُقيَّم منفصلةالإطار منشور بالكامليشمل فحصاً ذاتياًنتائج محايدة تجاه المورّدين
Animated Beams
Overview

أقل من ربع المؤسسات تبلغ النضج المتقدّم

معظم نماذج نضج الذكاء الاصطناعي أدوات تسويقية. تنتج درجة واحدة، وتضعك في مكان ما على منحنى، وتخلص إلى أنك تحتاج الشريحة التالية من منتج المورّد. والدرجة غير قابلة للتنفيذ لأنها تذيب في متوسطها البُعد الوحيد الذي يوقفك فعلاً.

تجد المسوح القطاعية باستمرار أن أقل من ربع المؤسسات الكبرى تعمل عند نضج متقدّم في الذكاء الاصطناعي، وأن معظم البرامج تتعثّر بين مرحلتي التطوير والتوسّع لا عند البداية. ونقطة التعثّر هذه تشخيصية. فالمنظمات التي تفشل عند البداية تفشل عادةً في البيانات. والمنظمات التي تفشل بين التجربة والتوسّع تفشل دائماً تقريباً في ملكية العمليات والحوكمة، بعد أن أثبتت أن التقنية تعمل ثم اكتشفت أن لا أحد مسؤول عن تشغيلها.

لذلك نقيّم خمسة أبعاد بشكل مستقل ونعرضها بشكل مستقل. تقييم الجاهزية الذي يعيد رقماً واحداً يكون قد رمى المعلومة الوحيدة التي كانت ستخبرك بما تصلحه أولاً.

الأبعاد الخمسة

/Icons/cloud.svg

البيانات

هل توجد السجلات التي تحتاجها حالة الاستخدام، وهل هي مكتملة بما يكفي، وهل هناك نظام سجل واحد، وهل يجوز نظاماً معالجتها حيث سيعمل النموذج؟ تُقيَّم لكل حالة استخدام لا للمنظومة ككل، لأن مستودعاً نظيفاً لا يعني شيئاً إن كانت الحقول التي تحتاجها نصاً حراً.

/Icons/ideation.svg

العمليات

هل سير العمل موثّق، وهل يتكرر بما يكفي للقياس، وهل هناك خط أساس، وهل يملك شخص واحد النتيجة؟ هذا البُعد هو الأكثر عرقلةً للقفزة من التجربة إلى الإنتاج، وهو الأقل احتمالاً لأن يُقيَّم.

/Icons/architecture.svg

التقنية

هل يمكن دمج الأنظمة المعنية أصلاً: واجهات برمجية صالحة، ونموذج مصادقة عملي، وبيئة يمكن فيها النشر والمراقبة. الأنظمة القديمة بلا واجهات تحوّل بناءً من ستة أسابيع إلى ستة أشهر.

/Icons/brain.svg

الكوادر

هل هناك من يستطيع تشغيل النظام وتعديله بعد التسليم، وهل حُسمت مسألة إعادة توزيع المهام، وهل يعرف من سيتغيّر عملهم أن ذلك قادم؟ المقاومة الصامتة توقف عمليات نشر أكثر مما يوقفه الفشل التقني.

/Icons/it-consultation.svg

الحوكمة

من يعتمد إطلاق نموذج، وماذا يحدث حين يخطئ، وكيف تُسجَّل القرارات، وأي الأنظمة تنطبق. وفي عمليات النشر السعودية يشمل ذلك مبادئ سدايا لأخلاقيات الذكاء الاصطناعي والتزامات نظام حماية البيانات الشخصية؛ وفي غيرها أنظمة القطاع وعقود العملاء.

/Icons/integration.svg

الصورة المركّبة

تُعرض التقييمات الخمسة جنباً إلى جنب، ولا تُحسب متوسطاً أبداً. أدنى أبعادك هو الحد الأقصى الفعلي لسرعة برنامجك، والتقييم موجود لتسميته لا لتليينه في رقم عنوان.

مستويات النضج

أربعة مستويات، لكل بُعد

يوضع كل بُعد على المقياس الرباعي نفسه، لترى بوضوح أنك قد تكون في المستوى الثالث تقنياً والمستوى الأول في العمليات. هذا التفاوت هو النتيجة.

01

عشوائي

أفراد يجرّبون، غالباً بحسابات شخصية وبلا أي رؤية. هناك حماس وبلا خط أساس، وبلا جرد لما يُستخدم، وبلا طريقة لمعرفة إن كان شيء قد ساعد. ومعظم المنظمات التي تصف نفسها بأنها «تعمل بالذكاء الاصطناعي» هنا.

02

تجريبي

توجد تجارب ممولة برعاة محدّدين، لكن كلاً منها منفصلة. لا شيء قابل لإعادة الاستخدام بينها، ويُحكم على النجاح بالعرض لا بمؤشر. وهنا يحدث معظم التعثّر، وهنا يسدّد تقييم الجاهزية كلفته بأعلى موثوقية.

03

تشغيلي

نظام واحد على الأقل يعمل في الإنتاج مقابل خط أساس مسجّل، بمالك ووتيرة مراجعة وحدّ دقة متفق عليه. وتُكتشف الأعطال بالمراقبة لا بشكوى عميل. والفجوة بين المستويين الثاني والثالث عمليات وحوكمة بالكامل تقريباً.

04

متوسّع

بنية تحتية مشتركة، وممارسة تقييم قابلة لإعادة الاستخدام، ومسار حوكمة تمرّ عبره حالات الاستخدام الجديدة بدل التفاوض حوله، ورؤية محفظة لما يعمل. أقل من ربع المؤسسات الكبرى تصل إلى هنا، ولا أحد يصل بشراء منصة.

شغّله بنفسك

فحص ذاتي قبل توظيف أي أحد

لا تحتاجنا لقراءة أولى. إن عادت أكثر من ثلاث من هذه بـ«لا»، فسيجد التقييم عوائق حقيقية. وإن عادت كلها بـ«نعم»، فالأرجح أنك تحتاج تدقيق سير عمل لا تقييم جاهزية.

أسئلة البيانات

  • هل تستطيع تسمية نظام السجل الواحد للبيانات التي تحتاجها حالة الاستخدام؟
  • هل تعرف نسبة السجلات المكتملة منها؟
  • هل تعرف إن كان يجوز نظاماً معالجة تلك البيانات خارج بيئتك؟
  • هل تستطيع تصدير عيّنة ممثّلة هذا الأسبوع دون مشروع؟

أسئلة العمليات

  • هل يوجد وصف مكتوب لكيفية سير العمل فعلياً اليوم؟
  • هل تعرف كم مرة يعمل أسبوعياً؟
  • هل تعرف كم تستغرق الحالة الواحدة وكم مرة تُعاد؟
  • هل هناك شخص واحد مسمّى مسؤول عن ذلك الرقم؟

أسئلة التقنية

  • هل تكشف الأنظمة المعنية واجهات برمجية سبق أن استخدمتها؟
  • هل توجد بيئة يمكن فيها نشر شيء ومراقبته؟
  • هل تعرف من يمنح الوصول، وكم يستغرق ذلك عادةً؟
  • هل جرى دمج أي شيء مع تلك الأنظمة خلال السنتين الماضيتين؟

أسئلة الكوادر

  • هل هناك من يستطيع تشغيل النظام بعد التسليم؟
  • هل أُبلغ الفريق الذي سيتغيّر عمله بأن هذا قيد الدراسة؟
  • هل حُسمت مسألة إعادة التوزيع، كتابةً؟
  • هل هناك ميزانية لوقت المراجعة الباقي بعد الأتمتة؟

أسئلة الحوكمة

  • هل تعرف من يعتمد إدخال نموذج إلى الإنتاج؟
  • هل هناك جواب متفق عليه لما يحدث حين يخطئ النموذج؟
  • هل تُسجَّل القرارات المدعومة بالذكاء الاصطناعي بصورة يستطيع مدقق تتبّعها؟
  • هل تعرف أنظمة أي جهة رقابية تنطبق على هذا العمل تحديداً؟

السؤال الصادق

  • لو أُوقف هذا النظام بعد ستة أشهر، هل سيلاحظ أحد؟
  • هل تستطيع اليوم تحديد النتيجة التي تجعله نجاحاً؟
  • هل ستبقى تلك النتيجة معتبَرة لو تحققت دون ذكاء اصطناعي؟
  • هل مكافأة أحدهم مرتبطة بالرقم المفترض أن يحرّكه؟

أسئلة عن تقييم الجاهزية

هو تقييم منظّم لقدرة المنظمة على نشر أنظمة ذكاء اصطناعي وتشغيلها بنجاح، مقاساً عبر البيانات والعمليات والتقنية والكوادر والحوكمة. والتقييم المفيد يعرض هذه الأبعاد الخمسة منفصلة بدل دمجها في درجة نضج واحدة، لأن أدنى بُعد هو ما يحدّد وتيرة البرنامج فعلاً. ويجب أن يسمّي المخرج العوائق المحددة، وكم تكلّف إزالة كل منها، وأي حالات الاستخدام قابلة للتنفيذ قبل إنجاز ذلك العمل.
تدقيق سير العمل يتعمّق في عملية واحدة: يرافق العمل، ويسجّل خط أساس للزمن والأخطاء، ويرتّب مرشّحي الأتمتة داخل تلك العملية وحدها. أما تقييم الجاهزية فيتوسّع عبر المنظمة ويسأل هل تستطيع تشغيل أي نظام ذكاء اصطناعي أصلاً. فإن كنت تعرف مسبقاً أي عملية تريد أتمتتها، فالتدقيق إنفاق أفضل. وإن كانت عدة إدارات تطلب وتحتاج ترتيبها، أو تعثّرت تجربة سابقة ولا يستطيع أحد تفسير السبب، فابدأ بالجاهزية.
معظمها يقيس مقدار ما تبنّيته من مجموعة منتجات المورّد، ولهذا تكون التوصية غالباً تبنّي المزيد منها. والنموذج الجدير بالاستخدام يقيس وقائع قابلة للملاحظة: هل يوجد خط أساس، وهل حُدّد نظام سجل، وهل سُمّي مالك، وهل هناك مسار حوكمة تمرّ عبره حالة الاستخدام، وهل يعمل شيء حالياً في الإنتاج مقابل حدّ متفق عليه. وكل واحد من هذه قابل للتحقق من خارج المنظمة، وهو الاختبار الذي يجب أن يجتازه أي ادعاء نضج.
يعتمد على مكان تعثّر البرنامج. فالمنظمات التي لا تنجح في تشغيل تجربة أصلاً تتعثّر عادةً في البيانات: سجلات ناقصة أو موزّعة عبر أنظمة أو بصيغة نص حر لا تستطيع حالة الاستخدام استهلاكها. أما المنظمات التي نجحت تجربتها ولم تستطع توسيعها فتتعثّر دائماً تقريباً في العمليات والحوكمة، بعد أن أثبتت أن التقنية تعمل ثم وجدت أن لا أحد مسؤول عن تشغيلها ولا مسار لاعتمادها في الإنتاج.
عادةً أسبوعان إلى ثلاثة حسب عدد وحدات الأعمال داخل النطاق، ومعظمه في المقابلات ومراجعة الأنظمة لا في التحليل. وهو أسرع من تدقيق سير العمل لكل إدارة لأنه لا يتطلب ملاحظة مستمرة للعمل نفسه، لكنه أبطأ في الجدولة لأنه يحتاج وقتاً مع أشخاص في البيانات وتقنية المعلومات والعمليات والشؤون القانونية وفرق الأعمال المتأثرة.
غالباً لا. فإن كان هناك مرشّح واحد واضح وإدارة واحدة معنية، فتدقيق سير العمل يجيب عن السؤال الحقيقي أسرع ويمنحك خط أساس تحاسب عليه المورّد. أما تقييمات الجاهزية فتستحق كلفتها حين تتنافس الطلبات وتحتاج ترتيبها، أو حين فشلت محاولة سابقة بلا تشخيص واضح، أو حين يريد مجلس الإدارة خطة قابلة للدفاع عنها عبر المنظمة لا مشروعاً واحداً.
الأبعاد الخمسة ومستويات النضج الأربعة وأسئلة الفحص الذاتي كلها منشورة في هذه الصفحة، ولك أن تشغّلها داخلياً. وما يضيفه الارتباط هو الاستقلالية والأدلة: نتحقق من الادعاءات مقابل الأنظمة بدل تسجيل ما يعتقده كل فريق، والتقييمات الداخلية تميل إلى التساهل تحديداً في البُعد الذي يوقف البرنامج لاحقاً.
يُقيَّم بُعد الحوكمة مقابل مبادئ سدايا السبعة لأخلاقيات الذكاء الاصطناعي والتزامات نظام حماية البيانات الشخصية لا مقابل قائمة عامة. ويعني ذلك عملياً السؤال عن وجود مراجعة قبل النشر تغطي العدالة والخصوصية والأمن والإنسانية والمنفعة الاجتماعية والبيئية والموثوقية والسلامة والشفافية وقابلية التفسير والمساءلة، وهل وُثِّق الأساس النظامي وموقف الاحتفاظ، وهل حُسمت إقامة البيانات لهذا العمل تحديداً لا افتُرضت. وبصفتنا شركة هندسية نقيّم التصميم؛ وينبغي أن يؤكد مستشارك القانوني الموقف النهائي.
SeedInov Services

جاهزون لتحويل عملكم؟

لنناقش كيف يمكننا إنشاء حل مخصص مدعوم بـ GPT ومصمم خصيصاً لاحتياجاتكم الخاصة وتحديات قطاعكم.

وجود عالمي

نحن حيث تحتاجنا

ثلاثة مراكز ومهمة واحدة، فرق متخصصة عبر المناطق الزمنية تقدم تعاوناً سلساً وتغطية على مدار الساعة لكل عميل.

فلوريدا
USالمقر الرئيسي

الولايات المتحدة

فلوريدا

EST • UTC−5·الاثنين-الجمعة • 9:00، 18:00
كراتشي
PKمركز الهندسة

باكستان

كراتشي

PKT • UTC+5·الاثنين-السبت • 10:00، 19:00
الرياض
SAالمكتب الإقليمي

المملكة العربية السعودية

الرياض

AST • UTC+3·الأحد-الخميس • 9:00، 18:00