Extraction d'information à partir d'un texte arabe : extraction des entités nommées et leurs relations sémantiques
Résumé
Dans cette thèse on aborde le sujet d’extraction des connaissances à partir du texte arabe. Cette tache a été réalisée à travers la détection et l’extraction des relations sémantiques entre les entités nommées. La problématique de repérage et d’extraction des entités nommées ainsi que les relations sémantiques les reliant a été résolue en utilisant une approche à base de règles, où les règles de l’expert sont traduites sous formes de transducteurs à états finis. Le manque terrible des ressources linguistiques et d’outils nécessaires au TAL arabe nous a conduit à construire nos propres ressources et à l’adaptation des outils de la plateforme Unitex/GramLab afin d’accomplir les taches citées ci-dessus. Les ressources sont aussi construites et puis compressées et stockées en utilisant les transducteurs à états finis.
Citer ce document
Accès au document
Voir sur le dépôt sourceCe document est hébergé sur son dépôt institutionnel d'origine.
Auteur(s)
Statistiques
Consultations : 2
Téléchargements : 0