Was ist ein LLM?
Wissen
LLM steht für "Large Language Model" — auf Deutsch: großes Sprachmodell. Es ist eine Software, die mit riesigen Mengen an Text trainiert wurde und dadurch gelernt hat, menschliche Sprache zu erzeugen. ChatGPT, Claude und Gemini basieren alle auf LLMs.
Stell dir dein Handy vor, wenn du eine Nachricht tippst: Es schlägt dir das nächste Wort vor. Ein LLM macht im Grunde dasselbe — aber millionenfach besser. Es hat aus Milliarden von Texten gelernt: Bücher, Webseiten, wissenschaftliche Artikel und Programmcode. Dadurch kann es nicht nur einzelne Wörter, sondern ganze Absätze, Geschichten oder sogar Code erzeugen.
iWichtig zu verstehen
Ein LLM ist KEINE Suchmaschine. Google sucht existierende Webseiten und zeigt sie dir. Ein LLM generiert neuen Text basierend auf Mustern, die es gelernt hat. Es "erfindet" quasi jede Antwort neu.
Verstehen
Das Training eines LLM funktioniert so: Das Modell liest Milliarden von Texten und lernt dabei statistische Muster. Es lernt, welche Wörter wahrscheinlich aufeinander folgen. Wenn du fragst "Die Hauptstadt von Frankreich ist...", hat das Modell dieses Muster so oft gesehen, dass es mit hoher Wahrscheinlichkeit "Paris" vorhersagt.
Es gibt eine spannende Debatte: Ist ein LLM nur ein "stochastischer Papagei", der Muster nachplappert? Oder entwickelt es durch seine Größe tatsächlich emergente Fähigkeiten — also Fähigkeiten, die nicht explizit trainiert wurden? Die Wahrheit liegt wahrscheinlich irgendwo dazwischen. LLMs verstehen Sprache nicht wie Menschen, aber sie können erstaunlich komplexe Aufgaben lösen.
Was ist der Hauptunterschied zwischen einem LLM und einer Suchmaschine?
*Ein Vorhersagemodell, kein Wissensmodell
Merke dir: Ein LLM sagt immer nur das nächste wahrscheinlichste Wort vorher. Es "weiß" nichts im menschlichen Sinne -- es erkennt Muster. Wenn du das verstehst, verstehst du auch, warum LLMs manchmal überzeugend klingende, aber falsche Antworten geben.
Anwenden
Wenn du das nächste Mal ChatGPT oder Claude benutzt, beobachte: Die Antwort wird Wort für Wort generiert. Das LLM "weiß" zu Beginn nicht, wie die Antwort enden wird. Es sagt immer nur das nächste wahrscheinlichste Wort vorher — und baut so Satz für Satz auf.
Reflektieren
Ein LLM hat beim Training Millionen von Kochrezepten gelesen. Was kann es danach am besten?