البحث التقريبي في الكلمات يساعد على البحث رغم بعض الأخطاء الكتابية، لكنه يقارن تركيب المصطلحات ولا يثبت أنها تعني الشيء نفسه. تصف وثائق Azure AI Search توسعا يعتمد على مسافة التحرير، وقد يشمل كلمات مختلفة المعنى. [1] سنفحص حروفا عربية يدويا لفهم حدود الفكرة، دون تشغيل محرك أو إعلان نتيجة بحث فعلية.
الخلاصة السريعة
عامل قرب الكتابة كوسيلة للعثور على مرشحين، ثم اقرأ معناهم؛ تصحيح خطأ محتمل لا يساوي اكتشاف مرادف.
- يسمح الوصف المذكور بالإدراج والحذف والاستبدال وتبديل حرفين متجاورين ضمن مسافة محددة؛ تشابه التركيب ليس تشابه المعنى. [1]
- حذف الميم الزائدة من «قلمم» يعطي «قلم» في فحصنا اليدوي، لكن تغيير لام «حبل» إلى راء يعطي «حبر» المختلف المعنى.
- في Azure يتطلب البحث التقريبي صيغة Lucene الكاملة؛ نص السؤال فيه لا يخضع للتحليل اللغوي المعتاد، بينما تحليل الفهرسة يظل مؤثرا. [1]
- راجع الكلمة والسياق اللذين طابقهما البحث؛ لا تسم النتيجة تصحيحا مؤكدا أو مرادفا، ولا تفترض أن كل أداة تنفذ هذا الخيار.
أي نوع من القرب تبحث عنه؟
نفترض أن مساعدا يبحث في دليل أدوات الرسم عن «قلمم»، مع ميم زائدة كتبها المستخدم. نحذف الميم الأخيرة على الورق، فتصبح «قلم». أجرينا تغييرا واحدا على كتابة الكلمة، ولم نسأل نموذج لغة عن المقصود ولم نقس جودة مطابقة عربية.
تصف الوثيقة مسافة Damerau-Levenshtein بعمليات إدراج حرف أو حذفه أو استبداله أو تبديل حرفين متجاورين. [1] نستخدم هذا الوصف لنميز سؤالا عن عدد تغييرات الكتابة من سؤال عن علاقة المعاني. لا نحتاج نسبة ثقة مصطنعة حتى نرى الميم الزائدة.
كيف يقرب حرفان كلمتين مختلفتين؟
لدينا في دفتر المثال كلمتا «حبل» و«حبر». استبدال اللام بالراء يحول الأولى إلى الثانية بتغيير واحد، لكن الحبل أداة مختلفة عن الحبر. لذلك لا نستنتج أن إحدى الكلمتين خطأ بمجرد أن تظهر الأخرى قريبة في الحروف.
وإذا طلب المستخدم «أداة تترك خطا على الورق»، فقد تتصل أقلام وريش رسم بطلبه من حيث الاستعمال. هذه علاقة نراجعها في الوصف، لا نتيجة حساب تغيير حرف واحد. نفصل قائمة الكلمات القريبة كتابيا عن تفسير حاجة المستخدم، حتى لا يختار المساعد حبلا لأنه يشبه كلمة حبر في الكتابة.
هل كتابة الأمر وحدها تفعّل هذا النوع؟
تشرح الوثيقة أن الخيار يستعمل صيغة Lucene الكاملة، مع علامة الموجة بعد المصطلح؛ كما لا يجري التحليل اللغوي المعتاد على نص الاستعلام التقريبي، مع بقاء تحليل الكلمات وقت الفهرسة مهما. [1] هذا شرط في الخدمة الموصوفة، وليس إعدادا مشتركا لكل مساعد.
نقترح قبل تجربة فعلية معرفة هل الأداة تعرض هذا النوع من البحث، وكيف خزنت كلمات الدليل. طلب «ابحث بطريقة تقريبية» في محادثة عادية لا يثبت تشغيل الخيار الموثق. كما لا نحسب المطابقة على جملة كاملة هنا؛ أمثلتنا تقارن كلمات منفردة معلنة.
ماذا تفحص بعد ظهور المرشحين؟
نسجل سؤال المستخدم والكتابة التي أدخلها والكلمة الموجودة في البطاقة. لو ظهرت بطاقة حبر عند طلب حبل، نقرأ وصفها ونسأل عن المقصود عند اللبس، بدلا من إعادة تسميتها. وقد يختار المستخدم الحبل فعلا؛ احتمال الخطأ ليس رخصة لتغيير طلبه.
في دليل رسم حقيقي، نقترح تجربة أخطاء معلومة وكلمات متقاربة مختلفة المعنى، ثم تسجيل ما أعيد بالفعل. المثال الحالي لا يثبت أداء عربيا أو أن كلمة بعينها ستظهر في الإعداد الافتراضي. فائدته وضع مراجعة المعنى بعد توسيع الكتابة، قبل استعمال المقطع في جواب المساعد.
المصادر ومتابعة القراءة
- Microsoft Learn: Fuzzy search (يفتح في نافذة جديدة)learn.microsoft.com
أُعدّ هذا المقال بصياغة عربية أصلية بالاستناد إلى المصادر أعلاه، وهو مدخل تمهيدي إلى الموضوع. اقرأ منهجية المحتوى وحدوده.
