منشور

قبل أن تختار نموذجًا، حرّر السؤال

قد يكون أصعب ما في مشروع الذكاء الاصطناعي هو تحديد ما ينبغي أن ينجح فيه. كيف ننتقل من الانبهار بالقدرة إلى وضوح الغرض؟

السؤال الجيد يحدد ما يستحق أن نطلبه من الآلة. حين تبدأ مؤسسة نقاشها باختيار نموذج أو منصة، تبدو كأنها اختصرت الطريق إلى الحل. لكنها ربما اختصرت أيضًا المرحلة التي تكشف أن المشكلة لم تكن ما ظنته. القدرة على إنتاج إجابة ليست دليلًا على أن السؤال الذي استدعاها مفيد.

لنفترض فريقًا يستقبل طلبات كثيرة من العملاء. يقترح أحد أفراده أتمتة الردود، ويقترح آخر تلخيصها، وثالث يريد تصنيف أصحابها. تبدو الاقتراحات متقاربة لأن الأداة واحدة تقريبًا، لكن كل اقتراح يعالج مشكلة مختلفة. هل يتأخر الرد بسبب الكتابة؟ أم بسبب غموض الصلاحية؟ أم لأن المعلومة موزعة بين أنظمة لا تتصل ببعضها؟

إذا كانت المشكلة غموض الصلاحية، فقد يجعل النص المصقول التأخير أكثر أناقة فقط. وإذا كانت المعلومات متناقضة، فقد ينتج التلخيص صورة شديدة الوضوح عن واقع غير صحيح. أول قرار تقني ناضج في هذا المثال هو تأجيل اختيار الأداة إلى أن يُرسم مسار الطلب: أين يدخل، ومن يفهمه، ومن يملك التصرف فيه، وأين يتوقف.

لا يبدأ التحول بشراء قدرة، بل بتحرير غرضها. يمكن كتابة الغرض في جملة قابلة للفحص: نريد تقليل الوقت الذي يقضيه الموظف في جمع المعلومات، مع إبقاء قرار التعويض لديه. هذه الجملة أضيق من وعد بتحويل خدمة العملاء، لكنها تشرح ما ستفعله الآلة وما لن يُسلّم إليها، وتجعل الاعتراض عليها ممكنًا.

بعد ذلك تأتي عينة صغيرة من الحالات. لا نختار أسهل الطلبات وحدها، ولا نبدأ بالفوضى كلها دفعة واحدة. نحتاج حالات عادية، وأخرى ناقصة المعلومات، وحالات تتعارض فيها المصادر. ما الذي ينبغي أن يحدث إذا لم يستطع النظام ترجيح جواب؟ الاعتراف بالنقص نتيجة مفيدة حين يكون البديل ثقة زائفة تُحمّل العميل تبعات الخطأ.

من السهل قياس عدد الردود التي أُنتجت. الأصعب أن نعرف إن كانت قد اختصرت المشكلة بالفعل أو نقلتها إلى شخص آخر. لذلك ينبغي فحص ما يحدث بعد الرد: هل يعود العميل بالسؤال نفسه؟ هل يضطر الموظف إلى تصحيح الوعد؟ وهل أصبح توضيح الخطأ أسهل؟ معيار النجاح الذي ينتهي عند مخرج النموذج يرى جزءًا ضيقًا من التجربة.

كل تفويض للآلة يحتاج حدًا واضحًا للمسؤولية. من يراجع المعلومة؟ من يملك إيقاف النظام؟ ومن يشرح القرار للشخص الذي تأثر به؟ هذه الأسئلة ليست إضافات أخلاقية مؤجلة إلى نهاية المشروع؛ إنها جزء من تعريف العمل نفسه. لا يمكن توزيع المهام بوضوح بينما تظل تبعاتها معلقة في الهواء.

هذا لا يعني أن كل تجربة تحتاج مشروع حوكمة ضخمًا. تجربة داخلية لتلخيص ملاحظات غير حساسة تختلف عن أداة تتخذ قرارًا له أثر مالي أو إنساني. المطلوب هو تناسب العناية مع العواقب، مع طريق معروف للتراجع. الخفة المفيدة تقلل الكلفة غير الضرورية، لكنها لا تجعل الخطر غير الضروري فضيلة.

وقد يكون استخدام الآلة وسيلة لاكتشاف السؤال أيضًا. يمكن للنموذج أن يقترح فئات لمراجعتها، أو يكشف تناقضًا بين تعليمات، أو يساعد في صياغة بدائل. يبقى هذا نافعًا ما دمنا نعامل الاقتراح كفرضية نختبرها، ولا نحوله إلى وصف نهائي لواقع لم نتحقق منه. الاستكشاف يوسّع النظر؛ الاعتماد يحتاج دليلًا مختلفًا.

قبل التجربة التالية، جرّب ورقة واحدة بثلاثة أسطر: القرار الذي نريد تحسينه، والمعلومة التي تنقصه، والضرر الذي نرفض أن تنتجه محاولة التحسين. إذا عجز الفريق عن الاتفاق عليها، فذلك ليس سببًا لإخفاء الخلاف خلف عرض تقني. ربما يكون تحديد هذا الخلاف هو أول نتيجة تستحق الاستثمار.

عودة