جميع المقالات (الصفحة 102)

قراءات عربية في العلوم والتقنية والطبيعة والثقافة، تبدأ بسؤال وتترك لك مساحة للاستكشاف.

2302 مقال

تقنية

إعادة كتابة سؤال البحث: توضيح مرجع سؤال المتابعة

إعادة كتابة سؤال البحث تساعد على تسمية ما يقصده سؤال متابعة مثل «وما مقاسها؟». لكن تحويله إلى عبارة أطول لا يبيح اختيار مرجع ملتبس أو إضافة معلومة لم يقلها المستخدم. في مثالنا، نراجع حوارا عن نموذج ورقي، ثم نكتب سؤالا مستقلا يصلح للبحث عن تعليماته. [1]

3 دقائق قراءةمصدر واحد

تقنية

تفكيك السؤال المركب للاسترجاع: قيود مشتركة وأسئلة تابعة

تفكيك السؤال المركب للاسترجاع يفصل المعلومات التي نحتاجها، مع حفظ العلاقة بينها. سؤال مثالنا يطلب اختيار نموذج ورقي يمكن صنعه من ورقة واحدة بلا قص، ثم شرح خطوات النموذج المناسب. إذا بحثنا عن خطوات أي نموذج قبل فحص الشرطين، فقد نجمع جوابا كاملا لسؤال مختلف. [1]

3 دقائق قراءةمصدر واحد

تقنية

توسيع سؤال البحث: مرادفات مقيدة بسياق المجموعة

توسيع سؤال البحث بمترادفات يغير المصطلحات التي يمكن مطابقتها، لكنه لا يثبت أن كل بديل يشير إلى الشيء نفسه. في مثالنا، مجموعة مواد تستعمل «دفتر رسم»، ويسأل القارئ عن «كراسة رسم». نراجع اتفاق المعنى داخل المجموعة قبل ربطهما، ونحفظ أي شرط آخر في السؤال. [1]

3 دقائق قراءةمصدر واحد

تقنية

استخدام ملخص المستند في الاسترجاع: بوابة إلى الأصل

استخدام ملخص المستند في الاسترجاع يجعل النص المختصر وسيلة للعثور على أصله، إذا صمم المسار بهذه العلاقة. لكن الملخص لا يغطي بالضرورة سؤالا عن تفصيل لم يحتفظ به. في مثالنا، نبحث في دليل ترتيب مسرح دمى عن حالة فيها حاجزان، بينما يذكر ملخصه الستارة والإضاءة فقط. [1]

3 دقائق قراءةمصدر واحد

تقنية

الاسترجاع الهرمي: اختيار الفرع قبل المقطع

الاسترجاع الهرمي قد ينتقل من نطاق واسع إلى فرع ثم إلى مقطع أدق. لذلك تؤثر صلة الفرع بالسؤال في المادة التي نصل إليها. في مثالنا، دليل معرض مصغرات يضم وسائل العرض والتغليف للنقل؛ والبحث عن حامل داخل صندوق يحتاج الفرع الثاني لا مجرد أول موضع للكلمة. [1]

3 دقائق قراءةمصدر واحد

تقنية

HyDE: مستند افتراضي للبحث لا مصدر للإجابة

HyDE يستخدم مستندا افتراضيا وسيطا في البحث، ولا يعامل هذا النص كأنه وثيقة حقيقية. الفكرة أن ينشأ نص قريب من شكل المادة المطلوبة، ثم يستعمل تمثيله للعثور على مواد فعلية. يحتاج القارئ إلى معرفة الفرق بين الوسيط المولد والمصدر الذي قرئ قبل الإجابة. [1]

3 دقائق قراءةمصدر واحد

تقنية

ضغط النص المسترجع: إبقاء الدليل الضروري

ضغط النص المسترجع هو تنقيح المادة بعد جلبها بحسب سؤال المستخدم. يصف LangChain ذلك باستخراج المعلومات ذات الصلة، أو استبعاد وثائق كاملة. [1] لكن قصر النص وحده لا يثبت أن الدليل المطلوب بقي فيه. نقترح فحص ما يحتاجه الجواب قبل اعتماد النسخة المختصرة.

3 دقائق قراءةمصدر واحد

تقنية

استرجاع المعرفة المنظمة: الصف المرتبط ليس كل السجل

استرجاع المعرفة المنظمة قد يمر بصفوف جدول بدلا من فقرات سردية. يعرض دليل LlamaIndex استرجاع صفوف مشابهة للسؤال للاستفادة منها في سياق تحويل السؤال إلى استعلام. [1] هذه الصفوف المساعدة لا تصبح بمجرد قربها الدلالي جوابا شاملا عن عدد السجلات أو حالتها.

3 دقائق قراءةمصدر واحد

تقنية

استرجاع الرسوم البيانية: نوع العلاقة واتجاهها

استرجاع الرسوم البيانية يبحث في كيانات وعلاقات بينها ليجلب سياقا للجواب. يصف Neo4j الوصول إلى نقاط بداية ثم تتبع علاقات مناسبة وجمع معلومات مرتبطة بها. [1] لفهم النتيجة نراجع نوع العلاقة وطرفيها؛ مجرد اتصال اسم بالقصة لا يخبرنا هل ألفها أم راجعها.

3 دقائق قراءةمصدر واحد

تقنية

التضمين النصي: توافق تمثيل السؤال والمستند

التضمين النصي يحول النص إلى قائمة أرقام تستخدم في البحث والمقارنة. في تكامل Azure AI Search، ينص التوثيق على استعمال نموذج التضمين نفسه للمحتوى عند الفهرسة وللسؤال عند البحث. [1] نركز هنا على توافق الطرفين؛ تطابق عدد الأرقام وحده لا يبين أنها تحمل المعنى نفسه.

3 دقائق قراءةمصدران

تقنية

تشابه المتجهات: هل بقي النفي في المعنى؟

تشابه المتجهات والنفي يطرحان سؤالين مختلفين: هل النصان قريبان، وهل يتفقان في الادعاء؟ يناقش ملخص بحث SNCSE مبالغة نماذج من الفئة التي يدرسها في تشابه نصوص متقاربة لفظيا، ويستعمل نفي الجملة في منهجه. [1] لا نستنتج من ذلك أن كل نموذج يهمل النفي، لكننا نراجعه عندما يغير المطلوب.

3 دقائق قراءةمصدر واحد

تقنية

بحث سؤال مشابه أم فقرة تجيبه؟

بحث سؤال مشابه أم فقرة تجيبه؟ يميز توثيق Sentence Transformers بين بحث متماثل عن نصوص متقاربة الدور والمحتوى، وبحث غير متماثل عن فقرة تجيب عن سؤال قصير. [1] اختيار المادة المناسبة يبدأ بتحديد ما تريد أن تعيده النتائج، لا بطول كلمات السؤال وحده.

3 دقائق قراءةمصدر واحد

تقنية

دمج قوائم البحث: الرتب قبل الدرجات الخام

دمج قوائم البحث باستخدام RRF يعتمد على موضع الوثيقة في كل قائمة، ثم يجمع مساهماتها ليصنع ترتيبا جديدا. يوضح توثيق Microsoft اختلاف نطاقات الدرجات الأصلية بين طرق البحث. [1] لهذا لا نجمع أرقاما خاما من مسارين على أنها مقياس واحد لمجرد أنها أرقام.

3 دقائق قراءةمصدر واحد

تقنية

تصفية نتائج الاسترجاع: هل تطبق الشرط قبل اختيار الأقرب؟

تصفية نتائج الاسترجاع تحتاج إلى تحديد وقت تطبيق الشرط، إضافة إلى صياغته. يوضح Azure AI Search أن preFilter يختار النتائج من المرشحين المطابقين، بينما postFilter يرشح أقرب النتائج داخل كل جزء من الفهرس ثم يجمعها؛ وقد تفوته مطابقات. [1] نفهم أثر الترتيب بمثال مكتوب، دون تشغيل خدمة بحث أو افتراض أن كل نظام ينفذ التصفية بالطريقة نفسها.

3 دقائق قراءةمصدر واحد

تقنية

أعلى نتائج الاسترجاع: العدد المختار لا يثبت كفاية الدليل

أعلى نتائج الاسترجاع تحدد حجم قائمة يقرأها المساعد، لكن امتلاءها لا يثبت أنها تكفي للإجابة. في الحالة المتجهية الأساسية التي يصفها Azure AI Search، يحدد k عدد النتائج، ويحد حجم الفهرس العدد الممكن؛ وقد تعود نتائج ضعيفة الصلة رغم اكتمال العدد. [1] نستخدم ثلاث بطاقات خيالية لنفصل سؤال «كم نتيجة؟» عن سؤال «ما الدليل الذي وصل؟».

3 دقائق قراءةمصدر واحد

تقنية

البحث عن رمز منتج: هل حفظ المحلل الرمز كاملا؟

البحث عن رمز منتج يحتاج إلى معرفة كيف يعالج الفهرس حروف الرمز وعلاماته. تعرض وثائق Azure AI Search محلل keyword الذي يحفظ الحقل في رمز واحد، ومحللا مخصصا يمكنه إضافة تحويل الأحرف إلى الصغيرة؛ بينما توضح أمثلة التحليل العادي تقسيم رموز تتضمن شرطات. [1] نراجع بطاقة خيالية دون وصف بحث فعلي أو اعتماد إعداد موحد لكل كتالوج.

3 دقائق قراءةمصدر واحد

تقنية

ربط الأسماء المشتركة: أي سجل يقصده السؤال؟

ربط الأسماء المشتركة يختار السجل الذي يشير إليه الاسم داخل سياق محدد. توضح وثائق spaCy أن EntityLinker يربط الأسماء الموسومة بمعرفات فريدة من قاعدة معرفة، اعتمادا على مرشحين وسياق محلي ونموذج للاختيار. [1] نستخدم ورشتين خياليتين تحملان الاسم نفسه لنوضح المعلومات التي ينبغي حفظها، دون الادعاء باختبار مكون عربي جاهز.

3 دقائق قراءةمصدر واحد