Lieber Matthias,

Ein Large Language Model, kurz LLM, macht zunächst etwas erstaunlich Einfaches:

Es bekommt Text (den sogenannten prompt), zerlegt diesen in seine Bestandteile und berechnet, welches Token wahrscheinlich als Nächstes kommt.

Ein Token ist dabei nicht unbedingt ein ganzes Wort. Das kann ein Wort, ein Wortteil, ein Satzzeichen oder auch ein Leerzeichen sein.

schön dazu auch das Erklär-Video von der Maus (Link geht zu Youtube).

Liebe Grüße

Felix Riesterer

freiwillig, öffentlich sichtbar
freiwillig, öffentlich sichtbar

Ihre Identität in einem Cookie zu speichern erlaubt es Ihnen, Ihre Beiträge zu editieren. Außerdem müssen Sie dann bei neuen Beiträgen nicht mehr die Felder Name, E-Mail und Homepage ausfüllen.

abbrechen