AI dokáže počas pár sekúnd odpovedať takmer na akúkoľvek otázku. Niekedy ale sebavedome uvedie aj informáciu, ktorá nie je pravdivá. Prečo sa to deje a čo sú takzvané AI halucinácie? V článku si vysvetlíme, ako veľké jazykové modely fungujú, prečo niekedy vytvárajú nepravdivé odpovede a ako sa vývojári snažia tento problém postupne obmedziť.

Umelá inteligencia dnes zvládne veci, ktoré ešte nedávno vyzerali ako čisté sci-fi. Píše texty, navrhuje programátorský kód a radí nám s množstvom zložitých úloh. Čím plynulejšie a presvedčivejšie ale jej odpovede znejú, tým ľahšie zabúdame na jedno veľké riziko: AI dokáže vytvoriť úplne vymyslenú odpoveď, ktorá ale na prvý pohľad pôsobí stopercentne dôveryhodne.
Tento fenomén dostal pomenovanie „AI halucinácie“. Nejde o žiadnu náhodnú softvérovú chybu alebo schválne zabudnutú funkciu, ktorú by vývojári proste len nevypnuli. Je to prirodzený a hlboko zakorenený dôsledok toho, ako sú dnešné veľké jazykové modely (LLM) vymyslené a trénované. Poďme sa pozrieť pod pokrievku toho, ako tieto systémy fungujú, aby sme pochopili, prečo tak sebavedome „rozprávajú“.
U generatívnej umelej inteligencie sa ako halucinácie označuje situácia, keď model vytvorí odpoveď, ktorá síce gramaticky i štylisticky vyzerá dokonale a dôveryhodne, ale v reálnom svete nemá vôbec žiadnu oporu.
Modely vedia halucinovať naozaj prekvapivými spôsobmi. Kľudne si vymyslia neexistujúce paragrafy zákonov, narobia chyby v matematických výpočtoch alebo vám vygenerujú realisticky znejúce vedecké štúdie vrátane konkrétnych mien autorov a webových adries, ktoré pritom nikdy neexistovali. Zvláštne je, že sa to deje aj pri úplne banálnych otázkach, napríklad keď chcete overiť dátum narodenia nejakej osobnosti alebo dohľadať oficiálne historické čísla o počte obyvateľov v archíve.
Aby sme pochopili, kde sa tieto chyby berú, musíme si ujasniť jednu vec: veľkí chatboti ako ChatGPT alebo Gemini nefungujú ako internetové vyhľadávače a nie sú to ani žiadne obrovské databázy faktov. Nemajú žiadne skutočné znalosti o našom svete a vôbec netušia, čo je pravda a čo lož.
Jazykový model je vo svojej podstate obrovská neurónová sieť, čo je vlastne komplikovaná sada „vytrénovaných inštinktov“. Tieto inštinkty získal analýzou biliónov slov z internetu, kníh a diskusií. Cieľom celého tohto finančne i technologicky mimoriadne náročného tréningu nie je naučiť stroj chápať význam textu, ale proste ho naučiť skvele a plynule napodobovať ľudskú reč.
Keď do chatbota napíšete svoju otázku, neurónová sieť s vašimi slovami nepracuje priamo. Text najprv rozkúskuje na takzvané tokeny. Tokeny sú vopred pripravené slová alebo ich časti, ktorým zodpovedajú konkrétne čísla. Matematická sieť vo vnútri počítača totiž vie spracovávať len čísla.
Model vezme tieto čísla (váš dotaz spolu s celým predchádzajúcim kontextom konverzácie) a preženie ich svojimi vrstvami. Výsledkom ale nie je to, že by sa pozrel do nejakej zásuvky pre „správnu odpoveď“. Výstupom je čisto matematická predpoveď: model spočíta, ktorý ďalší token má s najväčšou pravdepodobnosťou nasledovať za textom, ktorý už bol napísaný.
Celý princíp fungovania umelej inteligencie stojí na odhadovaní pravdepodobností, nie na overovaní pravdivosti. Model dáva text dohromady slovo po slove (token po tokene). Každé novo vygenerované slovo sa okamžite zaradí do zadania a na základe tohto čerstvého kontextu sa hneď počíta pravdepodobnosť pre slovo ďalšie.
Aby výstupy neboli úplne nudné a suché, používa sa pri generovaní skrytý parameter, ktorému sa hovorí „teplota“ (temperature). Keď je teplota na nule, model vyberie vždy ten najviac predvídateľný token, čo vedie k fádnym a stále rovnakým odpovediam. Vyššia teplota dáva modelu možnosť siahnuť aj po menej pravdepodobných slovách. Tým sa síce odomyká kreativita a schopnosť písať zaujímavé príbehy, no zároveň tým drasticky rastie šanca, že model skĺzne k úplným výmyslom.
Celý proces od zadania dotazu po finálnu halucináciu vyzerá v praxi takto:

Pri trénovaní (tzv. predtrénovaní) vidí model iba správne, plynulé texty. Lenže v dátach sú rôzne druhy informácií. Pravopisné pravidlá alebo správne uzatváranie zátvoriek sa v textoch opakujú neustále, takže sa ich AI naučí bezchybne.
Problém nastáva u špecifických faktov, ktoré sa v dátach objavujú zriedka a nesledujú žiadny opakovateľný vzorec. Typickým príkladom sú presné čísla, letopočty, dátumy narodenia alebo málo známe historické udalosti. Pretože tieto fakty v dátach pôsobia v podstate náhodne, model ich nedokáže spoľahlivo odvodiť. Ak sa teda umelej inteligencie opýtate na konkrétny číselný údaj alebo detaily, ktoré si človek musí presne pamätať z archívu, riziko halucinácie vystrelí raketovo nahor.
V súčasnosti vývojári používajú niekoľko hlavných stratégií, ako divokú fantáziu modelov krotiť:
Hlavný problém však tkvie v tom, ako sa modely hodnotia v testoch. Väčšina rebríčkov meria čistú úspešnosť (presnosť) na škále 1 (správne) alebo 0 (zle). Opatrné priznanie „neviem“ skončí vždy nulou, zatiaľ čo za riskantné tipovanie môže model občas získať bod. Systém tak umelú inteligenciu doslova motivuje k tomu, aby radšej sebavedome hádala, než aby priznala neistotu. Spoločnosť OpenAI preto vo svojich výskumoch presadzuje úpravu metodiky hodnotenia, ktorá by modely za vymýšľanie informácií penalizovala a naopak ich bodovo odmeňovala za otvorené priznanie neistoty.
Dokým sa systémy hodnotenia nezmenia, musíme ako užívatelia k výstupom z chatbotov pristupovať kriticky. Tu je niekoľko tipov, ako eliminovať riziká:
Model nemá žiadne povedomie o svojich reálnych technických možnostiach ani o aktuálnom čase. Iba dopĺňa text na základe štatistickej pravdepodobnosti. Keď mu napíšete úlohu, vyhodnotí ako najprirodzenejšie pokračovanie vety zdvorilé potvrdenie, že na úlohe už pracuje, aj keď na pozadí žiadny proces neprebieha.
Áno, stáva sa to veľmi často. AI sa z textov naučila štruktúru odborných citácií, takže dokáže vygenerovať názvy, ktoré znejú veľmi reálne a odborne. Informácie v takejto citácii ale môžu byť celkom vymyslené a jediný spôsob, ako to zistiť, je pokúsiť sa dané dielo nezávisle dohľadať.
Áno, otvorenie nového chatu je veľmi účinná pomoc. Zmažete tým totiž celý predchádzajúci kontext konverzácie. Ak AI urobila v predchádzajúcich vetách chybu, v pôvodnom chate by na nej kvôli svojej povahe ďalej stavala, zatiaľ čo v čistom okne začína s výpočtom pravdepodobností od nuly.
Žiadnu istotu bohužiaľ nemáte. Vyhľadávač síce dodáva modelu správne dáta, ale AI z nich text stále zostavuje odhadovaním ďalšieho slova. Testy ukazujú, že chatboti aj s prístupom na web dokážu informácie zle pochopiť, popliesť súvislosti a vytvoriť chybu, ktorú navyše preložia reálnymi odkazmi.
Určite áno, len je potrebné zmeniť očakávania. Pre brainstorming, písanie e-mailov, vymýšľanie kreatívnych konceptov alebo hľadanie netradičných súvislostí je táto voľnosť modelu obrovskou výhodou. Musíte však fungovať ako editor, nechať AI písať a faktické detaily si vždy skontrolovať sami.

Za každým načítaným videom, fotografií alebo webovou stránkou stojí technológia zvaná CDN. Využívajú ju streamovacie služby, sociálne siete i bežné weby, napriek tomu o nej mnoho ľudí nikdy nepočulo. V článku si vysvetlíme, čo táto skratka znamená, ako funguje, prečo sa obsah internetu ukladá na rôznych miestach sveta a prečo sa bez nej dnešný internet len ťažko zaobíde.

Keď sa hovorí o dedičstve, väčšina ľudí si predstaví dom, auto alebo peniaze na účte. Lenže po sebe zanechávame aj tisíce fotiek, e-maily, účty na sociálnych sieťach alebo dáta uložené v cloude. Čo sa s nimi stane po smrti a kto k nim získa prístup? V článku sa pozrieme na to, ako funguje digitálne dedičstvo, prečo môžu mať pozostalí s dátami problémy a ako si v online stope urobiť poriadok už dnes.

Predstava, že internet prúdi hlavne vzduchom, je mýtus. Celý technologický svet je závislý na ťažkom hardvéri v morském piesku. V článku preberieme technológiu podmorských káblov. Dozviete sa, ako fungujú optické vlákna, čo znamená ich pokládka z lodí a ako sa z hlbín oceánov stalo geopolitické bojisko.

Koľko peňazí mesačne odchádza z vášho účtu za online služby? Model trvalých platieb ľudí často vyčerpáva, pretože z peňaženky miznú desiatky drobných súm, ktoré sa postupne nazbierajú v nečakane vysoké sumy. V texte sa oprieme o čerstvé dáta z roku 2026, ukážeme si priepastný rozdiel medzi našimi odhadmi a realitou a ponúkneme štyri konkrétne kroky, ako mať svoje výdavky o niečo viac pod kontrolou.

Máte na poschodí alebo v spálni „mŕtvu zónu“, kam Wi-Fi nedosiahne, a vŕtanie do stien neprichádza do úvahy? Zistite, ako využiť elektrické rozvody, ktoré už v stenách máte, na prenos internetu po elektrickej sieti. V článku vám ukážeme, ako funguje moderný powerline adaptér, prečo si poradí so 4K streamovaním aj hrami a na čo si dať pozor pri starších hliníkových rozvodoch.

Máte doma bleskové pripojenie, ale napriek tomu sa video na YouTube alebo seriál na Netflixe neustále pozastavuje? Rýchly internet je síce základ, ale pre plynulé sledovanie videa často nestačí. Problémom býva prázdna medzipamäť, ktorá nestíha zásobovať vaše zariadenie dátami. Pozrite sa, ako nájsť slabé miesta vo vašej sieti a čo robiť, keď teória od poskytovateľa v praxi zlyháva.