Suuret kielimallit AI sivu

Tiivis katsaus siihen, miten suuret kielimallit toimivat ja mihin niitä käytetään. LLM:t tuottavat, tiivistävät, kääntävät ja analysoivat tekstiä, ja niiden laatu riippuu vahvasti koulutusdatan tasosta.

Suuret kielimallit (LLM)

Alarge language model (LLM) on neuroverkko, joka on koulutettu valtavalla määrällä tekstiä luonnollisen kielen käsittelyn tehtäviä varten, erityisesti tekstin tuottamiseen. LLM:t voivat tyypillisesti tuottaa, tiivistää, kääntää ja analysoida tekstiä monissa yhteyksissä, ja ne ovat modernien chatbottien taustalla oleva perus­teknologia.[1] Vinoutunut tai epätarkka koulutusdata voi tehdä LLM:n tuottamasta sisällöstä vähemmän luotettavaa.[2]

LLM:t perustuvat tyypillisesti transformer-arkkitehtuuriin.[3] Generatiiviset esikoulutetut transformerit (GPT:t) ovat LLM-tyyppi, joka on esikoulutettu ennustamaan seuraava sana.[4] Sen jälkeen GPT:tä usein hienosäädetään noudattamaan ohjeita ja toimimaan avustajina.[5]