Sobes.tech
Junior — Middle

POS-teqləmə nədir? Tarixən hansı modellər istifadə olunub?

sobes.tech Süni İntellekt

AI-dan cavab

POS-etiketleme (Part-Of-Speech tagging) — bu, hər bir söz üçün avtomatik olaraq nitq hissəsini (isim, fel, sifət və s.) müəyyən etmək prosesidir.

Tarixən, POS-etiketleme üçün aşağıdakı modellər istifadə olunmuşdur:

  • Lüğətlər və qrammatik qaydalara əsaslanan qaydalar — nitq hissələrini müəyyən etmək üçün əl ilə qaydalar yaratmaq.
  • Statistik modellər — məsələn, gizli Markov modelləri (HMM), keçid ehtimallarını istifadə edir.
  • Şərti təsadüfi sahələr (CRF) əsaslı modellər — daha çevik modellər, konteksti nəzərə alır.
  • Nöron şəbəkələri — müasir yanaşmalar, RNN, LSTM və transformatorlar istifadə edir və yüksək dəqiqlik təmin edir.

Python-da NLTK kitabxanası ilə sadə POS-etiketleme nümunəsi:

import nltk
nltk.download('averaged_perceptron_tagger')

mətn = "I am learning POS tagging."
tokens = nltk.word_tokenize(mətn)
tags = nltk.pos_tag(tokens)
print(tags)

Nəticə — söz və nitq hissəsi etiketi ilə tuple-lər siyahısı.