Lieber Matthias,
Ein Large Language Model, kurz LLM, macht zunächst etwas erstaunlich Einfaches:
Es bekommt Text (den sogenannten prompt), zerlegt diesen in seine Bestandteile und berechnet, welches Token wahrscheinlich als Nächstes kommt.
Ein Token ist dabei nicht unbedingt ein ganzes Wort. Das kann ein Wort, ein Wortteil, ein Satzzeichen oder auch ein Leerzeichen sein.
schön dazu auch das Erklär-Video von der Maus (Link geht zu Youtube).
Liebe Grüße
Felix Riesterer