AI & Nové technologie

LLM

Velký jazykový model – základ ChatGPT, Clauda, Gemini

LARG
(Large Language Model)

Co je LLM

LLM (Large Language Model, velký jazykový model) je typ umělé inteligence natrénovaný na obrovském množství textu z internetu a knih, který odpověď skládá tak, že vždy predikuje nejpravděpodobnější další token. Žádné hlubší rozumění světu za tím nehledejte – model se z miliard vět naučil, jaká slova obvykle následují po jakých. Ono se ale ukázalo, že tenhle jednoduchý mechanismus v obřím měřítku stačí na psaní, překlady i kód. Na LLM stojí ChatGPT (OpenAI), Claude (Anthropic) i Gemini (Google).

Všechno je predikce dalšího tokenu

Model vezme váš prompt, spočítá pravděpodobnosti možných pokračování, jedno vybere, přilepí na konec a celý postup opakuje – klidně tisíckrát na jedinou odpověď. Nic víc v tom není.

Z toho plyne to podstatné: LLM negeneruje ověřenou pravdu, generuje věrohodně znějící text. Většinou se obojí kryje. Když ne, vznikne halucinace – sebejistě podaná smyšlenka, kterou nepoznáte podle tónu, jen ověřením.

V čem je tedy LLM silný? V práci s jazykem samotným. Přepsat text do jiného tónu, shrnout dlouhý dokument, vysypat deset variant nadpisu, napsat regex nebo kus měřicího skriptu – tam šetří hodiny a případnou chybu snadno odhalíte.

Slabina jsou fakta. Čísla, jména, citace, ceny: cokoli, co model „ví“ jen z trénovacích dat, může být zastaralé nebo rovnou vymyšlené. Po pravdě, ptát se LLM na aktuální ceny konkurence je špatný nápad. Nechat ho ty ceny přehledně zpracovat z podkladů, které mu dodáte, je nápad dobrý.

Jak to funguje v praxi

LLM beru jako rychlého, ale nespolehlivého stážistu. Osnovu článku nebo deset variant nadpisu mi připraví za minutu – jen nic z toho nejde ven bez čtení, redakce a kontroly faktů. A nejvíc rozhoduje zadání: konkrétní prompt s příklady a popsaným tónem značky vrátí o třídu lepší výstup než jednořádkový pokyn.

Časté otázky

Proč si LLM občas vymýšlí fakta?
Protože nic „neví“ – jen předpovídá pravděpodobné pokračování textu. Když mu znalost chybí, mezeru stejně vyplní, a to textem, který zní naprosto věrohodně. Říká se tomu halucinace a je to hlavní důvod, proč výstupy potřebují lidskou kontrolu.
Jaký je rozdíl mezi ChatGPT a LLM?
LLM je samotná technologie – jazykový model. ChatGPT, Claude nebo Gemini jsou aplikace nad ním postavené: přidávají rozhraní, paměť konverzace a další funkce.
Můžu texty od LLM rovnou publikovat?
Nedoporučuju. Model je bohužel nejpřesvědčivější právě tam, kde se plete, a šablonovitý tón čtenář pozná. Jako první draft skvělá věc, jako finál ne – redakce a ověření faktů jsou minimum.