QR Code (код быстрого отклика)

NoorGhateh: A Benchmark Dataset for Training and Evaluating Arabic Morphological Analysis Systems

This dataset provides a linguistically and morphologically annotated sample of 313 Arabic words drawn from a larger corpus of 223,690 words compiled from Sharaye al-Islam, a classical Arabic jurisprudential text. Each token includes segmentation, lemma, part-of-speech, and affix-level annotations th...

Полное описание

Сохранить в:
Библиографические подробности
Главные авторы: Behrouz Minaei-Bidgoli, Huda AlShuhayeb
Формат: Artigo
Язык:Inglês
Опубликовано: Ubiquity Press 2026-02-01
Серии:Journal of Open Humanities Data
Предметы:
Online-ссылка:https://account.openhumanitiesdata.metajnl.com/index.php/up-j-johd/article/view/409
Метки: Добавить метку
Нет меток, Требуется 1-ая метка записи!