Large Language Model (LLM)
auch: LLM · Grosses Sprachmodell · Large Language Model
Kurz gesagt: Ein Large Language Model (LLM) ist ein KI-Modell, das auf riesigen Textmengen trainiert wurde und Sprache verstehen sowie erzeugen kann. LLMs wie GPT oder Claude bilden die Basis von ChatGPT und modernen KI-Chatbots.
Ein Large Language Model (grosses Sprachmodell, LLM) ist ein neuronales Netz, das auf enormen Textmengen trainiert wurde, um menschliche Sprache zu verstehen und zu erzeugen. Es funktioniert, indem es das jeweils wahrscheinlichste nächste Wort vorhersagt. LLMs sind die treibende Technologie hinter generativer KI – von ChatGPT über Programmierassistenten bis zu firmeneigenen Chatbots.
Definition
Ein LLM ist ein Sprachmodell mit typischerweise Milliarden von Parametern, das auf umfangreichen Textkorpora trainiert wurde[1]. «Gross» meint Modellgrösse und Datenmenge – daraus ergeben sich die Sprachfähigkeiten.
Die meisten heutigen LLMs basieren auf der Transformer-Architektur, die 2017 von Google-Forschern vorgestellt wurde[2] und das Feld grundlegend verändert hat.
Wie ein LLM funktioniert
Text wird in kleine Einheiten («Tokens») zerlegt. Das Modell lernt während des Trainings, welche Tokens in welchem Kontext aufeinander folgen. Bei der Nutzung sagt es Schritt für Schritt das wahrscheinlichste nächste Token voraus und erzeugt so flüssige Antworten.
Der Aufmerksamkeitsmechanismus (Attention) erlaubt es dem Modell, relevante Teile des bisherigen Textes zu gewichten. Wichtig zu verstehen: Ein LLM «weiss» nichts im menschlichen Sinn – es modelliert statistische Sprachmuster. Deshalb braucht es bei Faktenfragen Verfahren wie RAG.
Bekannte Modelle
Einsatzgebiete
Vorteile & Grenzen
- Versteht und erzeugt Sprache nahezu menschlich
- Vielseitig über viele Aufgaben und Sprachen
- Beschleunigt Text- und Wissensarbeit massiv
- Lokale Modelle ermöglichen volle Datenkontrolle
- Kann Fakten erfinden (Halluzinationen)
- Wissen ist auf den Trainingsstichtag begrenzt (ohne RAG)
- Cloud-Nutzung wirft Datenschutzfragen auf
- Betrieb grosser Modelle ist ressourcenintensiv
Verwandte Begriffe
Verwandte Leistungen von Mirostudio
Häufig gestellte Fragen
Was ist ein Large Language Model?
Was ist der Unterschied zwischen einem LLM und ChatGPT?
Warum erfinden LLMs manchmal Fakten?
Kann man ein LLM lokal in der Schweiz betreiben?
Was bedeutet «Token» bei einem LLM?
Quellen
- Wikipedia: Large language model – en.wikipedia.org/wiki/Large_language_model
- Vaswani et al.: «Attention Is All You Need» (2017) – arxiv.org/abs/1706.03762

