ما هو الترسيخ (Grounding) في الذكاء الاصطناعي؟ كيف تبقى النماذج دقيقة


الترسيخ هو الطريقة التي توقف بها نموذج الذكاء الاصطناعي عن اختلاق الحقائق. فبدلًا من الإجابة من الذاكرة وحدها، يسحب النموذج المُرسَّخ مادة مصدرية حقيقية (مستنداتك، أو قاعدة بيانات، أو API حيّ) ويجيب انطلاقًا منها. إنها الرافعة الأكبر لجعل الذكاء الاصطناعي جديرًا بالثقة بما يكفي لوضعه أمام العملاء. وRAG هو الأسلوب الأكثر شيوعًا لتحقيق ذلك، لكنه ليس الأسلوب الوحيد.
في ما يلي: ما هو الترسيخ، وكيف يختلف عن RAG والضبط الدقيق (fine-tuning)، والطرق الخمس التي تستخدمها الفرق، وكيفية بنائه، وكيفية قياسه، ولماذا يصبح أصعب ما يكون خلال مكالمة هاتفية مباشرة.
فكرتان مختلفتان تتشاركان كلمة الترسيخ، ويظهر هذا اللبس في كل مكان تنظر إليه.
الأولى هي الأقدم، من العلوم المعرفية: مشكلة ترسيخ الرمز. وهي تتساءل كيف يرتبط رمزٌ ما، مثل كلمة تفاحة، بالشيء الحقيقي الذي يشير إليه بدلًا من الإشارة إلى رموز أخرى فقط. هذا السؤال مهم في الروبوتات والذكاء الاصطناعي المُجسَّد، حيث يتعيّن على النظام أن يربط اللغة بأجهزة الاستشعار والعالم المادي.
الثانية هي التي جئت من أجلها على الأرجح. في الذكاء الاصطناعي الإنتاجي، يعني الترسيخ ربط مُخرَجات النموذج بمادة مصدرية قابلة للتحقق، بحيث تعود إجاباته إلى معلومات حقيقية ومحدّدة بدلًا من أنماط التقطها أثناء التدريب. الإجابة المُرسَّخة يمكن التحقق منها. أما غير المُرسَّخة فهي تخمين واثق.
هذه المقالة تدور حول النوع الثاني. عندما يقول مهندس إننا رسّخنا الوكيل، فهو يعني أن النموذج يجيب من مصدر معلوم للحقيقة، لا مما استوعبه أثناء التدريب.
النموذج اللغوي محرّك تنبؤ. لقد دُرِّب على تخمين الكلمة التالية في تسلسلٍ ما، مرارًا وتكرارًا، حتى صار بارعًا في إنتاج نص يُقرأ سلسًا ومقنعًا. لم يدرّبه أحد على أن يكون صحيحًا. بل درّبوه على أن يبدو صحيحًا.
هذه الفجوة هي مصدر الهلوسات. اسأل النموذج عن شيء يعرفه جزئيًا، أو عن شيء يقع بعد حدّ تدريبه الزمني، أو عن شيء خاص بعملك، فيجيب على أي حال. يملأ الفراغ بأكثر الكلمات وقوعًا في الاحتمال. المُخرَج نحويّ وواثق، وأحيانًا خاطئ.
في محادثة عابرة، تكون الإجابة الخاطئة مزعجة. أما بالنسبة لوكيل يقتبس سياسة استرداد، أو يؤكّد جرعة، أو يخبر متصلًا برصيده، فإن الإجابة الخاطئة تمثّل مسؤولية قانونية. يسدّ الترسيخ الفجوة بتسليم النموذج الحقائق لحظة إجابته، ثم إلزامه بها.
تخيّل عميلًا يسأل، ماذا تبقّى في رصيدي، ومتى موعد الدفع التلقائي؟
من دون ترسيخ، لا يملك النموذج أي وصول إلى ذلك الحساب. لذا يولّد شيئًا يبدو على شكل إجابة: رصيدك 42.50$ والدفع التلقائي يجري في الخامس عشر. مقنع. ومختلق أيضًا. الأرقام جاءت من العدم.
مع الترسيخ، يستدعي الوكيل نظام الفوترة لديك أولًا، ويسحب السجل الحقيقي، ويجيب انطلاقًا منه: لديك 128.40$ متبقية، والدفع التلقائي مضبوط على الثاني والعشرين. السؤال نفسه، لكن الإجابة الآن مرتبطة بنظام تسجيل. وإذا سأل أحد من أين جاء الرقم، يمكنك الإشارة إلى المصدر بدقة.
هذه هي اللعبة كلها. يحوّل الترسيخ يبدو صحيحًا إلى هو صحيح، وإليك السبب.
تُستخدم هذه الثلاثة على نحو تبادلي، وينبغي ألّا يكون كذلك. الترسيخ هو الهدف: مُخرَجات مرتبطة بالحقيقة. وRAG والضبط الدقيق أسلوبان تستخدمهما لبلوغه.
الخلط بينها يقود الفرق إلى ضبط نموذج بدقة ثم التساؤل لماذا لا يزال يختلق الحقائق.
|
المنهج |
ما هو |
الأفضل لـ |
هل يتعامل مع البيانات الحديثة أو الخاصة؟ |
هل يقلّل الهلوسات؟ |
|
الترسيخ |
النتيجة: إجابات مرتبطة بمصدر قابل للتحقق |
الهدف النهائي لأي نظام إنتاجي |
نعم، بحكم التصميم |
مباشرة |
|
RAG |
استرجاع المستندات ذات الصلة وقت السؤال، والإجابة انطلاقًا منها |
قواعد المعرفة الكبيرة أو السريعة التغيّر |
نعم |
نعم، الأسلوب الرئيسي |
|
الضبط الدقيق |
إعادة تدريب أوزان النموذج على مجموعة بيانات مُنسَّقة |
النبرة والتنسيق وأسلوب المجال والمهام الضيّقة |
لا، المعرفة مُجمَّدة عند التدريب |
ليس وحده |
باختصار: الضبط الدقيق يغيّر كيف يتحدّث النموذج وأي مجال يرتاح فيه، لكنه يُدمج المعرفة في الأوزان وقت التدريب، فتصبح قديمة ولا يزال يعجز عن الاستشهاد بمصدر. أما RAG فيحقن حقائق حديثة ومحدّدة لحظة السؤال. إذا كانت مشكلتك أن النموذج مخطئ بشأن بياناتنا، فنادرًا ما يصلح الضبط الدقيق ذلك. الترسيخ يفعل.
يحظى RAG بكل الاهتمام، لكنه خيار واحد. معظم الأنظمة الإنتاجية تجمع بين بعض هذه الطرق.
تسلسل عملي، بالترتيب:
يبدو أفضل ليس مقياسًا. إليك بعض المقاييس الفعلية:
في الإنتاج، تهمّ إشارتان إضافيتان: كم مرة يقول الوكيل لا أعرف، فالمعدّل الصحي يعني أنه يحترم مصادره، وكم مرة يصعّد. مراجعة النصوص المكتوبة وفق جدول تلتقط الإخفاقات التي تفوّتها مقاييسك.
كل ما سبق صعب بما يكفي في نافذة محادثة. وعلى مكالمة هاتفية يصبح أصعب، لأسباب خاصة بالصوت.
زمن الاستجابة هو الأول. في النص، ينتظر القارئ ثانية من أجل جولة استرجاع. أما على مكالمة، فتبدو فجوة ثانية واحدة وكأن الخط قد انقطع. عليك أن تسترجع وترسّخ وتبدأ بالتحدّث ضمن إيقاع المحادثة الطبيعية، وغالبًا ببدء الجملة قبل أن تُحسب الإجابة الكاملة.
التفريغ النصّي هو الثاني. يرسّخ النموذج على ما سمعه مُتعرِّف الكلام، وإذا سمع خمسين بدلًا من خمسة عشر، أو شوّه رقم حساب، فإن الوكيل يرسّخ بثقة على مقدّمة خاطئة. أنظف استرجاع في العالم لا يمكنه إصلاح تفريغ نصّي سيّئ.
الاستشهادات هي الثالث. لا يستطيع المتصل النقر على رابط مصدر. الثقة يجب أن تأتي من سحب الوكيل للسجل الصحيح وذكره بوضوح، إضافة إلى مسار سهل نحو إنسان عندما لا يستطيع.
هنا تُثبت المنصّة الصوتية جدارتها. مع Retell AI، تعمل قاعدة المعرفة بنظام RAG متدفّق يتزامن تلقائيًا من موقعك ومستنداتك، فيجيب الوكلاء من معلومات حديثة بدلًا من بيانات تدريب قديمة. ويتيح استدعاء الدوال في الوقت الفعلي لـ وكيل صوتي بالذكاء الاصطناعي سحب بيانات حيّة من أنظمتك في منتصف المكالمة، مرسّخًا الإجابات في السجل الحقيقي. وعندما لا يستطيع الوكيل ترسيخ شيء بأمان، يقوم تحويل المكالمات بالتسليم إلى شخص مع إرفاق السياق الكامل. ويمنحك تحليل ما بعد المكالمة النصوص المكتوبة والتقييم لالتقاط إخفاقات الترسيخ لاحقًا، وهي خطوة المراقبة الواردة سابقًا. وإذا كنت تُقيّم أي منصة ذكاء اصطناعي حواري للدعم الهاتفي، فإن سلوك الترسيخ في ظل ظروف مكالمة حقيقية هو ما ينبغي اختباره، لا العرض التوضيحي.
يقلّل الترسيخ الهلوسات. لكنه لا ينهيها، والتظاهر بغير ذلك يجعلك عرضة للتضرّر.
لا شيء من هذا سبب لتجاوز الترسيخ. بل هي أسباب لقياسه ولتصميم آلية احتياطية صادقة. الوكيل الذي يقول دعني أُحضر لك من يستطيع تأكيد ذلك أفضل من واحد يختلق إجابة في كل مرة.
هل الترسيخ هو نفسه RAG؟
لا. الترسيخ هو الهدف، إجابات مرتبطة بمصادر حقيقية. وRAG هو الأسلوب الأكثر شيوعًا لبلوغه، لكن يمكنك أيضًا الترسيخ عبر استدعاءات الدوال، أو عمليات البحث في قاعدة البيانات، أو فرض الاستشهاد بالمصادر.
هل يقضي الترسيخ على الهلوسات؟
يقلّلها بشدة، وليس إلى الصفر. لا يزال بإمكان النموذج أن يسيء قراءة مصدر أو يجيب من مصدر قديم. الترسيخ إضافة إلى القياس إضافة إلى آلية احتياطية هو ما يوصلك إلى موثوقية على مستوى الإنتاج.
هل يمكنك ترسيخ نموذج من دون RAG؟
نعم. استدعاء الأدوات والدوال يرسّخ الإجابات في بيانات النظام الحيّة، والبحث المهيكل يسحب حقولًا محدّدة، وفرض الاستشهاد يُلزم النموذج بالمصادر المقدّمة. RAG أداة واحدة في العدّة.
هل الترسيخ أفضل من الضبط الدقيق؟
إنهما يحلّان مشكلتين مختلفتين. الضبط الدقيق يشكّل النبرة وسلوك المجال لكنه يجمّد المعرفة وقت التدريب. أما الترسيخ فيوفّر حقائق حديثة ومحدّدة وقت الإجابة. لمشكلة النموذج مخطئ بشأن بياناتنا، الترسيخ هو الحل.
كيف يبقى الوكلاء الصوتيون بالذكاء الاصطناعي مُرسَّخين خلال مكالمة مباشرة؟
يسترجعون من قاعدة معرفة في الوقت الفعلي، ويستدعون أنظمة تسجيلك للبيانات الحيّة، ويصعّدون إلى إنسان عندما لا يستطيعون تأكيد إجابة، كل ذلك ضمن ميزانية زمن الاستجابة للكلام الطبيعي.
هل ما زلت بحاجة إلى الترسيخ إذا استخدمت نموذجًا من الطراز الأول؟
نعم. النموذج الأقوى أكثر سلاسة وغالبًا أكثر دقة، لكنه لا يزال بلا وصول مدمج إلى بياناتك الخاصة أو الحديثة. الترسيخ هو ما يربط أي نموذج بحقيقتك.
See how much your business could save by switching to AI-powered voice agents.
Total Human Agent Cost
AI Agent Cost
Estimated Savings
رقم هاتف تجريبي من Retell Clinic Office

Start building smarter conversations today.




.avif)