
Foto - Evija Trifanova, LETA
Mākslīgais intelekts (MI) mūsdienās kļūst par ikdienas tehnoloģiju neatņemamu sastāvdaļu, un tā izplatība strauji pieaug. Daudzi to saista ar tādiem rīkiem kā ChatGPT, kuru pamatā ir lielie valodas modeļi, kas trenēti, izmantojot milzīgus teksta un citu datu apjomus. Tomēr šajā procesā mazo kopienu valodas, arī latviešu valoda, bieži paliek ēnā.
Piemēram, vairāk nekā 90% ChatGPT modeļa apmācībā izmantoto datu ir angļu valodā, bet atlikušo daļu pārsvarā sastāda dati tādās lielajās valodas kā vācu, franču, portugāļu, spāņu un mandarīnu. Šis ir tikai viens no iemesliem, kādēļ Latvijai ir jāveido savs nacionālais lielais valodas modelis, kas spētu nodrošināt latviešu valodas saglabāšanu un attīstību digitālajā laikmetā. Ceram, ka nesenajā Valsts prezidenta Edgara Rinkēviča tikšanās reizē ar “OpenAI” vadītāju Samu Altmanu arī šis jautājums ir pārrunāts.