Large Language Model (Großes Sprachmodell)
Ein Large Language Model (LLM) ist ein neuronales Netzwerk, das mithilfe riesiger Textdatensätze trainiert wird, um natürliche Sprache zu verstehen und zu generieren.
Merkmale: Millionen bis Milliarden von Parametern, breites Wissen aus Büchern und Internet, generative Fähigkeiten (menschenähnliche Texte). Beispiele: GPT-4, Claude, Gemini, Llama.
Technologische Grundlagen: Transformer-Architektur, Self-Attention-Mechanismus, Pre-Training (allgemeine Sprachmuster) + Fine-Tuning (spezifische Aufgaben), Skalierung von Parametern. LLMs generieren Text durch Vorhersage des wahrscheinlichsten nächsten Tokens.
Vorteile: Vielseitigkeit, hohe Genauigkeit, Kontextverständnis, generative Kreativität. Herausforderungen: hoher Rechenaufwand, Halluzinationen, Bias, Datenschutzbedenken. Anwendungen: Chatbots, Textgenerierung, Übersetzung, Zusammenfassung, Programmiertools.
Beispiel
Ein LLM formuliert aus einem kurzen Stichpunkt-Prompt einen vollständigen Kundenbrief, indem es Wort für Wort die passende Fortsetzung wählt.