أزمة الرقمنة لماذا تعجز الآلة عن قراءة الذاكرة العربية
تتراكم في الأرشيفات العربية ملايين الوثائق والمخطوطات والصحف التي نجت من التلف، لكن انتقالها من الورق إلى الشاشة لم يضمن لها الحضور في العالم الرقمي. فالحاسوب لا يزال يرى هذه الصفحات صوراً لا نصوصاً، مما يجعلها عصية على محركات البحث ونماذج الذكاء الاصطناعي التي تعتمد على البيانات القابلة للقراءة الآلية.
تكمن المعضلة في الفجوة الرقمية؛ حيث لا يكفي المسح الضوئي لحفظ المعرفة، بل يتطلب الأمر تحويل هذه الذاكرة إلى بيانات مهيكلة يمكن للآلة فهمها وفهرستها، وهو تحدٍ يزداد تعقيداً مع المخطوطات القديمة والوثائق المتضررة التي تتطلب تقنيات متقدمة للتعرف الضوئي (OCR) والتعرف على الكتابة اليدوية (HTR).
من صورة إلى بيانات: محاولات لسد الفجوة
لا تتوقف عملية الرقمنة عند المسح الضوئي، بل تمتد إلى تدريب الأنظمة على التعرف على بنية النص العربي. في هذا السياق، برزت مجموعة سرد (SARD) -التي أطلقها باحثون من جامعة الأمير سلطان وأكاديمية طويق- كخطوة لسد الفجوة، حيث تضم أكثر من 2.6 مليون صورة لصفحات عربية تحاكي تخطيطات الكتب، لتكون مادة تدريبية لأنظمة الذكاء الاصطناعي.
يوضح وديع بوعليلة، مدير مختبر الروبوتات وإنترنت الأشياء بجامعة الأمير سلطان، أن الهدف من سرد كان تجاوز محدودية المجموعات السابقة التي ركزت على أحرف أو كلمات منفردة. ويؤكد بوعليلة أن النجاح في قراءة النص المطبوع لا يعني تلقائياً النجاح في قراءة المخطوطات، مشدداً على ضرورة التعاون مع المكتبات لجمع عينات حقيقية تتضمن عيوب الطباعة وتخطيطات الصفحات المعقدة.
تحديات الوثيقة القديمة: ما وراء الحروف
من جانبه، يشير حمدي مبارك، المهندس الرئيسي في معهد قطر لبحوث الحوسبة، إلى أن التحدي لا يتوقف عند التعرف على الحروف، بل في استعادة هيكلية الوثيقة التي فقدت أجزاءً من بنيتها. فضعف
ارسال الخبر الى: