Velký jazykový model – základ ChatGPT, Clauda, Gemini
LLM (Large Language Model, velký jazykový model) je typ umělé inteligence natrénovaný na obrovském množství textu z internetu a knih, který odpověď skládá tak, že vždy predikuje nejpravděpodobnější další token. Žádné hlubší rozumění světu za tím nehledejte – model se z miliard vět naučil, jaká slova obvykle následují po jakých. Ono se ale ukázalo, že tenhle jednoduchý mechanismus v obřím měřítku stačí na psaní, překlady i kód. Na LLM stojí ChatGPT (OpenAI), Claude (Anthropic) i Gemini (Google).
Model vezme váš prompt, spočítá pravděpodobnosti možných pokračování, jedno vybere, přilepí na konec a celý postup opakuje – klidně tisíckrát na jedinou odpověď. Nic víc v tom není.
Z toho plyne to podstatné: LLM negeneruje ověřenou pravdu, generuje věrohodně znějící text. Většinou se obojí kryje. Když ne, vznikne halucinace – sebejistě podaná smyšlenka, kterou nepoznáte podle tónu, jen ověřením.
V čem je tedy LLM silný? V práci s jazykem samotným. Přepsat text do jiného tónu, shrnout dlouhý dokument, vysypat deset variant nadpisu, napsat regex nebo kus měřicího skriptu – tam šetří hodiny a případnou chybu snadno odhalíte.
Slabina jsou fakta. Čísla, jména, citace, ceny: cokoli, co model „ví“ jen z trénovacích dat, může být zastaralé nebo rovnou vymyšlené. Po pravdě, ptát se LLM na aktuální ceny konkurence je špatný nápad. Nechat ho ty ceny přehledně zpracovat z podkladů, které mu dodáte, je nápad dobrý.
LLM beru jako rychlého, ale nespolehlivého stážistu. Osnovu článku nebo deset variant nadpisu mi připraví za minutu – jen nic z toho nejde ven bez čtení, redakce a kontroly faktů. A nejvíc rozhoduje zadání: konkrétní prompt s příklady a popsaným tónem značky vrátí o třídu lepší výstup než jednořádkový pokyn.