Laboriülesanne AI for Beginners Curriculum materjalidest.
Selles laboris kutsume teid üles treenima Word2Vec mudelit, kasutades Skip-Gram tehnikat. Treenige võrgustik koos sisseehitatud vektoritega, et ennustada naabersõnu
Võite kasutada ükskõik millist raamatut. Palju tasuta tekste leiate Project Gutenberg lehelt, näiteks siin on otselink Lewis Carrolli teosele Alice Imedemaal. Või võite kasutada Shakespeare'i näidendeid, mille saate järgmise koodi abil:
path_to_file = tf.keras.utils.get_file(
'shakespeare.txt',
'https://storage.googleapis.com/download.tensorflow.org/data/shakespeare.txt')
text = open(path_to_file, 'rb').read().decode(encoding='utf-8')Kui teil on aega ja soovite teemasse süveneda, proovige uurida mitmeid asju:
- Kuidas mõjutab sisseehitatud vektori suurus tulemusi?
- Kuidas mõjutavad erinevad tekstistiilid tulemust?
- Võtke mitu väga erinevat tüüpi sõna ja nende sünonüümid, hankige nende vektorrepresentatsioonid, rakendage PCA, et vähendada dimensioonid 2-le, ja kujutage need 2D-ruumis graafiliselt. Kas näete mingeid mustreid?
Lahtiütlus:
See dokument on tõlgitud AI tõlketeenuse Co-op Translator abil. Kuigi püüame tagada täpsust, palume arvestada, et automaatsed tõlked võivad sisaldada vigu või ebatäpsusi. Algne dokument selle algses keeles tuleks pidada autoriteetseks allikaks. Olulise teabe puhul soovitame kasutada professionaalset inimtõlget. Me ei vastuta selle tõlke kasutamisest tulenevate arusaamatuste või valesti tõlgenduste eest.