تقنية

تلخيص الفيديو من تفريغ الكلام: ماذا ينقص من كلمة هنا؟

رسم يميز عبارة هنا عن اختيار سلة من وصف مستقل مرتبط بالمشهد.
رسم توضيحي من إعداد بحر العلوم؛ لا يمثل تفريغا لفيديو حقيقي.

تلخيص الفيديو من تفريغ الكلام قد يحفظ الكلمات ولا يحفظ كل المعلومات اللازمة لفهمها. إذا قال المتحدث «ضع القطعة هنا»، فأين هنا؟ نؤلف مشهدا لسلتين لنبين دور الإشارة المرئية، ونفرق بين ما قدمه النص وما يضيفه وصف مستقل راجعناه.

الخلاصة السريعة

يلخص المساعد ما في مدخله؛ كلمة هنا في تفريغ الكلام وحده لا تعين وجهة مرئية لم توصف فيه.

  • توضح W3C أن الوصف ينقل معلومات مرئية مهمة للفهم قد لا يتضمنها الصوت. [1] نطاقنا نقص هذه المعلومة في المدخل، وليس حكما على امتثال فيديو.
  • في تمريننا توجد سلة خضراء وأخرى بيضاء، والتفريغ يقول ضع القطعة هنا؛ النص وحده لا يسمي السلة المقصودة.
  • إن قدم وصف مراجع للمشهد نفسه يبين الإشارة إلى الخضراء، انسب المعلومة إلى ذلك الوصف؛ لا تنسب اسم اللون إلى قول المتحدث إذا لم يقله.
  • احتفظ بمصدر الكلام والوصف وحدود كل منهما، وأبق الوجهة مجهولة إذا لم يقدم دليلها؛ لم نشاهد تسجيلا أو نختبر أداة تلخيص.

أي معلومة قد يغيب عنها تفريغ الكلام؟

تشرح إرشادات W3C أن الوصف يقدم المعلومات المرئية اللازمة لفهم المحتوى. وتسأل هل توجد معلومة مرئية يحتاجها الفهم ولا تنقلها المادة المسموعة؛ لذلك لا يحتاج كل فيديو نوع الوصف نفسه. [1]

نركز على المدخل الذي وصل إلى المساعد. تفريغ الكلام المكتوب لا يعد تلقائيا وصفا للصور؛ قد يقول المتحدث أسماء الأشياء ومواقعها، وقد يعتمد على إشارة يراها المشاهد. اقرأ النص المعين قبل تقرير ما ينقصه، ولا تفترض أن كل تفريغ ناقص بالقدر نفسه.

ولو قال المتحدث «السلة الخضراء» صراحة، يكون الاسم متاحا في الكلمات المعلنة. المشكلة التي نختبرها هنا هي أنه لم يقله، لا خطأ تعرف صوتي نريد تصحيحه.

ماذا يتيح نص السلتين؟

نؤلف مشهدا تعليميا فيه سلة خضراء وسلة بيضاء. النص الوحيد الذي نعطيه للمساعد هو «ضع القطعة هنا». ثم نسأل «أي سلة يقصد؟». لا يحتوي هذا المدخل وصفا لاتجاه اليد أو موضع القطعة أو اسم لون الوجهة.

يمكن أن يخرج ملخص أمين «طلب وضع القطعة في موضع أشار إليه». أما «طلب وضعها في الخضراء» فيحتاج معلومة لم نقدمها في الكلام. وجود سلتين في عنوان السؤال لا يختار إحداهما، كما أن شيوع لون في أمثلة سابقة لا يثبت قصد هذا المتحدث.

هذا مثال مؤلف؛ لم نقدم فيديو فعليا أو نسمع عبارة أصلية. المقارنة تبين حدود المعطى النصي، ولا تحكم على قدرة نموذج بعينه على رؤية الإشارة إن أعطي مدخلا آخر.

كيف نضيف وصفا دون تغيير نسبة الكلام؟

نفترض الآن بطاقة وصف مراجعة يعلن صاحب التمرين أنها تخص المشهد نفسه: «يشير إلى السلة الخضراء». يمكن استعمال هذه المعلومة مع تسميتها وصفا مقدما، مع إبقاء العبارة المنطوقة كما هي.

نكتب مثلا «يطلب وضع القطعة هنا، ويبين الوصف المرفق أن إشارته إلى السلة الخضراء». لا نضع «ضع القطعة في السلة الخضراء» بين علامات اقتباس وننسبها إليه بوصفها الكلمات الأصلية. نقل معنى مستند إلى الوصف يختلف عن نقل لفظ قاله.

وإذا جاءت بطاقة من مشهد آخر، لا نلصقها بهذا التفريغ لمجرد أنها تذكر سلتين. يلزم ربط مناسب بالمصدر المقصود قبل ملء المقصد المرئي.

أي جواب نبقيه عندما يغيب الوصف؟

نبقي الوجهة غير معينة من المدخل المتاح، ونطلب مشاهدة الجزء المناسب أو وصفا يمكن مراجعته إذا كانت الوجهة لازمة للمهمة. لا نخترع لونها كي يبدو الملخص كاملا، ولا نساوي «غير معلوم» بقول إن المتحدث لم يشر إلى شيء.

احفظ مصدر النص وأي وصف أضيف إليه ونطاق مراجعته. لم نجر اختبار إتاحة أو قراءة شاشة أو تجربة نموذج؛ المثال يساعد في التفريق بين تلخيص الكلمات واستعادة مرجع إشارة لم يصل في الكلمات.

المصادر ومتابعة القراءة

  1. W3C WAI: Description of Visual Information (يفتح في نافذة جديدة)w3.org

أُعدّ هذا المقال بصياغة عربية أصلية بالاستناد إلى المصادر أعلاه، وهو مدخل تمهيدي إلى الموضوع. اقرأ منهجية المحتوى وحدوده.