Skip to content

Latest commit

 

History

History
47 lines (27 loc) · 3.13 KB

File metadata and controls

47 lines (27 loc) · 3.13 KB

Keelemudelid

Semantilised vektorid, nagu Word2Vec ja GloVe, on tegelikult esimene samm keelemudelite suunas – mudelite loomine, mis mingil moel mõistavad (või esindavad) keele olemust.

Keelemudelite peamine idee seisneb nende treenimises märgistamata andmekogumite põhjal juhendamata viisil. See on oluline, kuna meil on saadaval tohutul hulgal märgistamata teksti, samas kui märgistatud teksti hulk on alati piiratud ajaga, mida saame märgistamisele kulutada. Enamasti saame luua keelemudeleid, mis suudavad ennustada puuduvaid sõnu tekstis, kuna juhusliku sõna maskeerimine tekstis ja selle kasutamine treeningnäitena on lihtne.

Vektorite treenimine

Eelnevates näidetes kasutasime eelnevalt treenitud semantilisi vektoreid, kuid huvitav on näha, kuidas neid vektoreid saab treenida. Selleks on mitmeid võimalikke ideid:

  • N-grammi keelemudel, kus ennustame tokenit, vaadates N eelnevat tokenit (N-gramm).
  • Järjepidev sõnakott (CBoW), kus ennustame keskmist tokenit $W_0$ tokenite järjestuses $W_{-N}$, ..., $W_N$.
  • Skip-gramm, kus ennustame keskmise tokeni $W_0$ põhjal naabertokenite komplekti {$W_{-N},\dots, W_{-1}, W_1,\dots, W_N$}.

pilt artiklist, mis käsitleb sõnade teisendamist vektoriteks

Pilt sellest artiklist

✍️ Näidisnotebookid: CBoW mudeli treenimine

Jätka õppimist järgmistes notebookides:

Kokkuvõte

Eelmises tunnis nägime, et sõnade vektorid toimivad nagu võluväel! Nüüd teame, et sõnade vektorite treenimine ei ole väga keeruline ülesanne ning vajadusel peaksime suutma treenida oma vektoreid spetsiifilise valdkonna tekstide jaoks.

Ülevaade ja iseseisev õppimine

Laboris kutsume sind üles muutma selle tunni koodi, et treenida CBoW asemel Skip-Gram mudelit. Loe lähemalt


Lahtiütlus:
See dokument on tõlgitud AI tõlketeenuse Co-op Translator abil. Kuigi püüame tagada täpsust, palume arvestada, et automaatsed tõlked võivad sisaldada vigu või ebatäpsusi. Algne dokument selle algses keeles tuleks pidada autoriteetseks allikaks. Olulise teabe puhul soovitame kasutada professionaalset inimtõlget. Me ei vastuta selle tõlke kasutamisest tulenevate arusaamatuste või valesti tõlgenduste eest.