Development of Part-of-Arabic Word Corpus for Handwriting Text Recognition
No Thumbnail Available
Date
Authors
Journal Title
Journal ISSN
Volume Title
Publisher
Saudi Digital Library
Abstract
يعتبر التعرف على الخط العربي المكتوب باليد أحد المواضيع الشيقة للبحث في الوقت الراهن, ويعزى ذلك إلى نقوم في هذه الرسالة بالتركيز على استرجاع ، الحاجة لاستخلاص النصوص العربية من الصور الرقمية وتمثيلها نصيا الأجزاء النصية العربية ( من الصور المخزنة مسبقا ، فقمنا – - والتي تتكون منها الكلمات Part of Arabic Words) شبه تلقائي وذلك لاستخراج الأجزاء العربية المتصلة وتخزينها كصورة (Framework)بتطوير نظام أو إطار عمل مصغر مع ما يقابلها من النص ، حيث يمكن استخدام هذا النظام في توليد قاعدة بيانات مختصة بهذه الأجزاء بأقل وقت ممكن وكفاءة عالية. كما قمنا بتطوير نظام لتصنيف هذه الأجزاء العربية المتصلة والتعرف عليها. ولتوليد قاعدة البيانات هذه ، استخدمت الصور المحتوية على الأسطر المفردة من النص لقاعدة البيانات "خط" .)بالإضافة الى ذلك قمنا بتحليل الأجزاء العربية المكتوبة بخط اليد IFN/ENIT وقاعدة البيانات ( (KHATT-Database) التي تم توليدها ، كما درسنا تكرار وحجم هذه الإجزاء من أجل التعرف عليها آليا فيما بعد. Machine ( نعتمد في هذه الرسالة على تطويع تقنيات التعلم الآلي -) في التعرف على الأجزاء العربية Learning K ( المتصلة حيث قمنا بدراسة تقنية أقرب عنصر مجاور ), كما تمت SVM -) و تقنية القوة الداعمة ( nearest Neighbor (C تجربة ميزة الشبكة القطبية الدائرية الناتجة من مجموعة مميزات حسابية بسيطة ، وميزة لوغاريثم ircular Polar Grid) تصنيف 0111 وتم استخدام ، (Gabor)غابور حيث تم استرداد ما يقرب من ، مختلف من البيانات المجمعة (Class) من إجمالي الأجزاء المختلفة الموجودة في الصور بواسطة تقنية القوة الداعمة مستخدمين لخليط من ميزات (73.07%) لوغاريثم غابور والشبكة القطبية الدائرية.
