درجة الثقة (Confidence Score)
درجة الثقة قيمة بين 0 و1 يعبر بها نموذج الذكاء الاصطناعي عن مدى تأكده من إجابته. في روبوتات المحادثة، تقرر الدرجة ما إذا كان الذكاء الاصطناعي سيرد بنفسه، أم يسأل سؤال استيضاح، أم يسلِّم إلى موظف بشري.
ما هي درجة الثقة؟
درجة الثقة هي التقييم الذاتي المُكمَّم لنموذج ذكاء اصطناعي: ما مدى يقيني من هذه الإجابة؟ تتراوح القيم عادة من 0 (غير مؤكد) إلى 1 (مؤكد جداً) وتمثل احتمالاً، لا مقياساً مطلقاً.
في سياق روبوت محادثة (bot)، تُوجِّه درجة الثقة ما يحدث بعد سؤال المستخدم: ثقة عالية → الروبوت يجيب؛ متوسطة → سؤال استيضاحي متابع؛ منخفضة → تسليم إلى موظف بشري.
كيف تنشأ درجة الثقة
تُنتج أنواع الروبوتات المختلفة الدرجات بطرق مختلفة:
| نوع الروبوت | كيف تُقاس الثقة |
|---|---|
| روبوت كلمات مفتاحية (autoresponder) | تطابق أو لا — لا توجد درجة ثقة حقيقية. القاعدة تُطلَق أو لا. |
| روبوت NLU (تصنيف النية) | احتمال أن ينتمي إدخال المستخدم إلى النية X. الناتج: توزيع احتمالي عبر كل النيات. |
| روبوت RAG (توليد مُعزَّز بالاسترجاع) | التشابه بين سؤال المستخدم وأفضل مقطع مطابق في قاعدة المعرفة، مدموجاً مع التقييم الذاتي للنموذج. |
| وكيل ذكاء اصطناعي | متعدد الخطوات: ثقة في اختيار الأداة، ثقة في النتيجة، الإجمالي المُرجَّح. |
العتبات
في الممارسة، يُعمَل بعتبات تُوجِّه سلوك النظام:
- ≥ 0.80 — يجيب الذكاء الاصطناعي بنفسه. يقين عالٍ.
- 0.50 إلى 0.80 — يطرح الذكاء الاصطناعي سؤال استيضاح («هل تقصد X أم Y؟»).
- < 0.50 — تسليم إلى موظف بشري.
تعتمد العتبات الدقيقة على النموذج وحالة الاستخدام. للمواضيع الحرجة (الصحة والقانون والمال) تكون العتبات أعلى.
درجة الثقة ومنطق التسليم
تدعم روبوتات الذكاء الاصطناعي في SendSeven منطق تصعيد قابلاً للتهيئة: بعد max_failed_attempts من الإجابات منخفضة الثقة متتالية، يسلِّم الروبوت تلقائياً إلى بشري. الافتراضي عادة 2 أو 3 — حتى لا يعلق العميل في حلقة.
مهم: الروبوتات القائمة على الكلمات المفتاحية (autoresponders) لا تستخدم منطق التصعيد هذا، لأنها لا تمتلك درجة ثقة حقيقية. فهي إما تتطابق أو تُعيد نص احتياطي.
أسباب شائعة لانخفاض الثقة
- سؤال خارج قاعدة المعرفة: يسأل العميل عن موضوع لم يُستوعب.
- صياغة ملتبسة: «لدي مشكلة في التطبيق» يناسب 15 موضوعاً.
- لغة خاطئة: يكتب المستخدم بالإنجليزية، والروبوت مدرَّب بالعربية.
- هجاء/عامية: أخطاء طباعية أو لهجة لا يتعرف عليها النموذج.
- نيات متعددة: يطرح العميل سؤالَين دفعة واحدة — النموذج لا يعرف أيهما يجيب أولاً.
إظهار الثقة
في عرض الموظف، تُظهر SendSeven درجة الثقة التي أعطاها الروبوت للإجابة. تُمَيَّز الإجابات منخفضة الثقة كتحذيرات — يستطيع الموظفون التصحيح ضمن السياق والإبلاغ عن الفجوة لمُشرف قاعدة المعرفة. هكذا يتعلم النظام من كل تسليم.
الثقة مقابل الصواب
درس مهم: الثقة العالية لا تعني الصواب العالي. يمكن للنموذج أن يكون شديد الثقة ويظل مخطئاً («هلوسة»). الثقة إشارة، لا ضمان. لذلك يتضمن الإعداد الإنتاجي دائماً: مجموعة اختبار مع حقيقة مرجعية، عينات منتظمة، وحلقة تغذية راجعة من الموظفين إلى مُشرفي قاعدة المعرفة.