Vážení studenti, je nezbytné si uvědomit, že LLM nepracuje s databází faktů, nýbrž generuje text na základě statistické pravděpodobnosti. Proces predikce probíhá tak, že model na základě předchozího kontextu odhaduje nejpravděpodobnější následující token. Tento proces se opakuje, dokud není dosaženo koncového znaku nebo limitu délky.
Z hlediska informatiky hovoříme o distribuci pravděpodobnosti nad slovní zásobou. Pokud položíte modelu otázku, nehledá odpověď v archivu, ale konstruuje ji slovo po slově. Tento mechanismus vysvětluje, proč může model generovat gramaticky bezchybné, ale fakticky nesprávné konstrukce.
"Model neví, co je pravda; ví pouze, co následuje podle vzorců v datech, na kterých byl trénován." — Metodický pokyn Kernpair 08/2023.
V souladu s Etickým rámcem našeho portálu je proto nutné každý výstup podrobit kritické verifikaci. Statistická inference není náhradou za studium primárních zdrojů, ale nástrojem pro strukturování myšlenek.