Keď prvýkrát otvoríš ChatGPT alebo Claude, natrafíš na slová, ktoré sa v bežnej reči nepoužívajú: prompt, token, context window, halucinácia, agent. Nikde ich nevysvetlia, jednoducho sa predpokladá, že ich poznáš. Tento slovník ich vysvetľuje po slovensky, bez žargónu, s konkrétnym príkladom pri každom pojme.
Pojmy sú zoskupené podľa témy, nie podľa abecedy, aby dávali zmysel v poradí, v akom ich reálne potrebuješ. Ak si úplný začiatočník a ešte len zvažuješ, čo je Claude AI a ako s ním začať, pokojne si najprv prečítaj úvodný návod a k slovníku sa vráť neskôr.
Základy: ako AI vlastne funguje
Čo je umelá inteligencia (AI) a čo je LLM
Umelá inteligencia (AI) je široký pojem pre softvér, ktorý dokáže robiť úlohy, ktoré bežne vyžadujú ľudské myslenie: rozpoznávať reč, generovať text, odpovedať na otázky. Claude aj ChatGPT patria do jednej konkrétnej kategórie AI, ktorá sa volá veľký jazykový model, po anglicky Large Language Model, skrátene LLM.
LLM je model natrénovaný na obrovskom množstve textu, ktorý sa naučil predpovedať, aké slovo (presnejšie token) má nasledovať za predchádzajúcim textom. Znie to jednoducho, ale z tejto jednej schopnosti vzniká všetko, čo LLM vie: písať texty, prekladať, vysvetľovať, programovať. Príklad: keď napíšeš "Dobrý deň, volám sa", model odhadne, že pravdepodobne bude nasledovať meno, a pokračuje v tomto duchu.
Čo je prompt
Prompt je text, ktorý zadáš AI ako vstup, teda tvoja otázka, inštrukcia alebo zadanie. Kvalita promptu priamo ovplyvňuje kvalitu odpovede. Prompt "napíš text" dá vágny výsledok, prompt "napíš tri vety zhrnutia tejto zmluvy v bežnej slovenčine, bez právnických výrazov" dá výsledok, ktorý sa dá reálne použiť. Väčšina frustrácie z AI nástrojov nepochádza z toho, že by model bol zlý, ale z toho, že prompt bol príliš všeobecný.
Čo je token
Token je základná jednotka textu, s ktorou AI model pracuje. Nie je to vždy celé slovo, niekedy je to časť slova, niekedy interpunkcia. Napríklad slovo "nepochopiteľné" sa môže rozdeliť na viacero tokenov, kým krátke bežné slovo ako "a" alebo "je" tvorí len jeden. Ako približné pravidlo platí, že jeden token je zhruba tri až štyri znaky bežného textu. Token je aj jednotka, podľa ktorej sa počíta cena používania AI cez API, a jednotka, ktorá určuje, koľko textu sa zmestí do jedného rozhovoru.
Čo je context window (kontextové okno)
Context window je množstvo textu, ktoré si model dokáže "pamätať" a brať do úvahy v rámci jedného rozhovoru, meria sa v tokenoch. Ak pošleš modelu dlhý dokument a potom naň nadväzuješ otázkami, model musí mať v context window uložený celý dokument aj celú predchádzajúcu konverzáciu, aby vedel odpovedať relevantne. Keď sa context window naplní, staršie časti rozhovoru model prestáva "vidieť". Rôzne modely majú rôzne veľké context window, napríklad Sonnet a Opus zvládajú výrazne dlhší kontext ako menšie modely, čo má priamy dopad na to, s akým objemom podkladov s nimi dokážeš pracovať. Presný rozpis podľa jednotlivých Claude modelov nájdeš v prehľade Claude modelov.
Ako AI spracováva a generuje odpovede
Čo je inference
Inference je samotný proces, pri ktorom model na základe promptu generuje odpoveď, teda okamih, keď model "premýšľa" a token po tokene skladá výstup. Odlišuje sa od tréningu, čo je proces, pri ktorom sa model najprv učil z dát predtým, než bol vôbec sprístupnený používateľom. Keď píšeš do Claude a čakáš na odpoveď, práve prebieha inference, tréning modelu sa v tej chvíli nedeje.
Čo je temperature (teplota)
Temperature je nastavenie, ktoré určuje, ako "kreatívne" alebo naopak ako "predvídateľné" má byť generovanie odpovede. Nízka teplota znamená, že model vyberá skoro vždy najpravdepodobnejšie ďalšie slovo, výsledok je konzistentný a menej prekvapivý, hodí sa napríklad na faktické zhrnutia. Vysoká teplota znamená viac náhodnosti a rozmanitosti, hodí sa skôr na brainstorming alebo kreatívne písanie. Bežný používateľ v Claude alebo ChatGPT toto nastavenie priamo nevidí, funguje na pozadí alebo sa dá meniť len cez API.
Čo je embedding
Embedding je číselná reprezentácia textu (alebo obrázka), ktorá zachytáva jeho význam v podobe vektora čísel. Vďaka embeddingom vie systém povedať, že veta "kúpil som si nový notebook" je významovo bližšie k vete "hľadám lacný laptop" než k vete "dnes bolo pekné počasie", aj keď nezdieľajú takmer žiadne rovnaké slová. Embeddingy sú základ toho, ako fungujú vyhľadávanie podľa významu a systémy odporúčania, aj toho, ako AI dokáže nájsť relevantnú pasáž v dlhom dokumente.
Čo je multimodalita
Multimodalita znamená, že model dokáže spracovať a niekedy aj generovať viac typov obsahu než len text, napríklad obrázky, zvuk alebo video. Keď nahráš do Claude fotku faktúry a spýtaš sa, koľko treba zaplatiť, využívaš práve multimodálnu schopnosť modelu, ktorý vie "prečítať" obsah obrázka a prepojiť ho s textovou otázkou.
Keď sa AI mýli
Čo je halucinácia
Halucinácia je situácia, keď AI model vygeneruje informáciu, ktorá znie sebavedomo a hladko, ale nie je pravdivá, napríklad si vymyslí neexistujúci zákon, citát alebo zdroj. Nejde o "klamstvo" v ľudskom zmysle, model si nie je vedomý, že si niečo vymýšľa, len štatisticky doskladá najpravdepodobnejšie pokračovanie textu, aj keď to pokračovanie nezodpovedá realite.
Prečo k nej dochádza a ako ju spoznať
Model generuje text tak, že predpovedá najpravdepodobnejšie ďalšie slovo, nie tak, že by si "overoval fakty" v nejakej databáze. Ak sa ho spýtaš na niečo, čo v tréningových dátach chýbalo, bolo nejednoznačné alebo veľmi špecifické (napríklad presné číslo, meno menej známej osoby, konkrétny paragraf zákona), model má tendenciu doplniť odpoveď, ktorá znie prijateľne, aj keď je nesprávna. Praktické pravidlo: čím konkrétnejší fakt, číslo alebo citácia, tým viac si to over z nezávislého zdroja. Halucinácia sa dá čiastočne obmedziť aj tak, že modelu dáš k dispozícii konkrétne podklady namiesto toho, aby si sa spoliehal len na jeho pamäť, čo súvisí s pojmom RAG nižšie.
Pokročilejšie AI: agenti a nástroje
Čo je AI agent
AI agent je systém postavený nad jazykovým modelom, ktorý nielen odpovedá na otázky, ale dokáže aj sám vykonávať kroky smerom k cieľu: prehľadať internet, spustiť kód, upraviť súbor, zavolať externý nástroj, a na základe výsledku sa rozhodnúť, čo urobiť ďalej. Kým bežný chatbot čaká na každý ďalší tvoj pokyn, agent dokáže reťaziť viacero krokov samostatne. Príklad: poprosíš agenta, aby ti pripravil podklad na stretnutie, a on si sám nájde relevantné súbory, zhrnie ich a poskladá výstup, bez toho, aby si mu musel diktovať každý jednotlivý krok.
Čo je MCP (Model Context Protocol)
MCP je otvorený štandard, ktorý určuje, ako sa AI model môže pripojiť k externým nástrojom a zdrojom dát, napríklad ku kalendáru, databáze alebo internému systému firmy. Namiesto toho, aby si pre každý nástroj musel stavať samostatné prepojenie, MCP funguje ako spoločný "jazyk", ktorým si model a nástroj rozumejú. Práve cez tento typ prepojení Claude rieši prácu s externými dátami a agentmi inak ako ChatGPT, čo je jeden z rozdielov, na ktorý naraziš, ak prechádzaš z ChatGPT do Claude.
Čo je system prompt
System prompt je súbor inštrukcií, ktorý sa nastaví na začiatku a platí pre celú konverzáciu, bez toho, aby si ho musel opakovať v každej správe. Určuje napríklad tón odpovedí, rolu, v akej má model vystupovať, alebo pravidlá, ktoré má dodržiavať. Firma môže mať system prompt "odpovedaj vecne, po slovensky, bez emotívneho jazyka", a model sa tým riadi v každej odpovedi v danom kontexte. Presne s týmto typom nastavenia ťa krok za krokom prevedie aj Klod pri onboardingu z ChatGPT do Claude.
Ako sa AI "učí" a získava vedomosti
Čo je fine-tuning
Fine-tuning je dodatočné dotrénovanie už existujúceho modelu na užšej, špecializovanej sade dát, aby sa zlepšil v konkrétnej úlohe alebo doméne. Základný model sa najprv naučí zo všeobecných dát, fine-tuning ho potom "vyladí" napríklad na medicínsku terminológiu, právne texty alebo firemný tón komunikácie. Je to nákladnejší a technickejší proces, s ktorým sa bežný používateľ Claude alebo ChatGPT priamo nestretáva, ale často sa oň opiera to, ako presne model odpovedá v špecializovaných oblastiach.
Čo je RAG (Retrieval-Augmented Generation)
RAG je technika, pri ktorej model pred vygenerovaním odpovede najprv vyhľadá relevantné informácie v externom zdroji (napríklad v databáze dokumentov) a tie potom použije ako podklad pre odpoveď, namiesto toho, aby sa spoliehal len na to, čo sa naučil počas tréningu. Vďaka tomu vie odpovedať aj na otázky o informáciách, ktoré vôbec neboli súčasťou jeho tréningových dát, napríklad o internej firemnej dokumentácii nahranej včera. RAG je jeden z hlavných spôsobov, ako sa v praxi znižuje riziko halucinácie, pretože model má k dispozícii konkrétny zdroj namiesto toho, aby si fakt musel "vymyslieť" z pamäti.
Open-source vs closed model (uzavretý model)
Open-source model má verejne dostupný spôsob, akým funguje, prípadne aj samotné váhy modelu, takže si ho môže kdekto stiahnuť, upraviť alebo prevádzkovať na vlastnej infraštruktúre. Closed (uzavretý) model je dostupný len cez rozhranie firmy, ktorá ho vyvinula, napríklad cez webovú appku alebo API, bez prístupu k jeho vnútornému fungovaniu. Claude aj GPT modely od OpenAI sú closed modely, prevádzkujú ich len Anthropic a OpenAI. Výhoda closed modelov je typicky vyšší výkon a jednoduchšie používanie bez nutnosti spravovať vlastnú infraštruktúru, výhoda open-source modelov je kontrola nad dátami a nezávislosť od jedného dodávateľa.
Rýchly register pojmov A-Z
Ak hľadáš konkrétny pojem, tu je abecedný prehľad všetkého vyššie, s odkazom na sekciu, kde ho nájdeš vysvetlený aj s príkladom.
- AI agent: Pokročilejšie AI: agenti a nástroje
- Context window: Základy: ako AI vlastne funguje
- Embedding: Ako AI spracováva a generuje odpovede
- Fine-tuning: Ako sa AI "učí" a získava vedomosti
- Halucinácia: Keď sa AI mýli
- Inference: Ako AI spracováva a generuje odpovede
- LLM (veľký jazykový model): Základy: ako AI vlastne funguje
- MCP (Model Context Protocol): Pokročilejšie AI: agenti a nástroje
- Multimodalita: Ako AI spracováva a generuje odpovede
- Open-source vs closed model: Ako sa AI "učí" a získava vedomosti
- Prompt: Základy: ako AI vlastne funguje
- RAG: Ako sa AI "učí" a získava vedomosti
- System prompt: Pokročilejšie AI: agenti a nástroje
- Temperature: Ako AI spracováva a generuje odpovede
- Token: Základy: ako AI vlastne funguje
- Umelá inteligencia (AI): Základy: ako AI vlastne funguje
Časté otázky
Čo je to prompt v AI?
Prompt je text, ktorý zadáš AI modelu ako vstup, teda tvoja otázka alebo inštrukcia. Od jeho konkrétnosti priamo závisí, aká presná a použiteľná bude odpoveď.
Aký je rozdiel medzi tokenom a slovom?
Token nie je to isté ako slovo. Krátke bežné slová tvoria zvyčajne jeden token, dlhšie alebo menej bežné slová sa môžu rozdeliť na viac tokenov. Ako hrubý odhad platí, že jeden token zodpovedá zhruba trom až štyrom znakom bežného textu.
Prečo AI niekedy "klame" (halucinuje)?
AI model negeneruje odpoveď overovaním faktov, ale predpovedaním najpravdepodobnejšieho ďalšieho textu na základe toho, čo sa naučil počas tréningu. Pri veľmi konkrétnych alebo menej známych faktoch preto niekedy doplní odpoveď, ktorá znie sebavedomo, ale nie je pravdivá. Konkrétne čísla, citácie a mená si preto vždy oplatí overiť z nezávislého zdroja.
Čo je AI agent a ako sa líši od bežného chatbota?
Bežný chatbot odpovie na jednu otázku a čaká na tvoj ďalší pokyn. AI agent dokáže na základe zadaného cieľa sám vykonať viacero krokov za sebou, napríklad vyhľadať informácie, spustiť nástroj a spracovať výsledok, bez toho, aby si mu musel diktovať každý krok zvlášť.
Čo znamená MCP (Model Context Protocol) a prečo sa o ňom hovorí pri Claude?
MCP je štandard, ktorý umožňuje AI modelu pripojiť sa k externým nástrojom a zdrojom dát jednotným spôsobom, napríklad ku kalendáru alebo internej databáze. Claude ho využíva ako jeden zo spôsobov prepojenia s okolitým svetom, čo je aj jeden z rozdielov oproti tomu, na čo si zvyknutý z ChatGPT.