Tiefe
Gleiches Kapitel, drei Tiefen. Die Wahl gilt überall und bleibt gespeichert.

GrundlagenGrundkursKapitel 01von 16 im Pfad

Was ein Sprachmodell ist

Tiefe 1: Überblick · Lesezeit 6 Min. · Stand

Wenn über KI geredet wird, fallen drei Wörter fast immer durcheinander: KI, Sprachmodell und der Name irgendeines Programms. Sie meinen nicht dasselbe, und der Unterschied ist der Anfang von allem.

Was oft verwechselt wird

Ein Sprachmodell ist ein Bauteil. Man kann es nicht anfassen und nicht starten; es ist eine sehr große Datei mit Zahlen, die aus Text weiteren Text erzeugen kann. Für sich allein tut es nichts.

Eine Anwendung ist das, was Sie bedienen. Sie hat ein Eingabefeld, merkt sich das Gespräch, kann Dateien annehmen und im Netz nachschlagen. Im Inneren benutzt sie ein Sprachmodell.

KI ist der Oberbegriff für das ganze Feld. Sprachmodelle sind ein Teil davon, aber längst nicht alles. Was sonst noch dazugehört, steht in KI-Wissen, Kapitel 01.

Das Beispiel, das man sich merken kann

ChatGPT ist die Anwendung. GPT ist das Sprachmodell.

Anwendung

ChatGPT

Das Programm, das Sie öffnen und bedienen.

  • hat eine Oberfläche und ein Eingabefeld
  • merkt sich das Gespräch
  • nimmt Dateien an und sucht im Netz
  • verwaltet Konto, Rechte und Abrechnung

Auch: Claude, Gemini, Copilot, Perplexity

Sprachmodell

GPT-4o

Die Datei mit gelernten Werten, die aus Text weiteren Text erzeugt.

  • kennt kein gestern und kein morgen
  • hat keinen Netzzugang
  • vergisst zwischen zwei Aufrufen alles
  • wird ausgetauscht, ohne dass es auffällt

Auch: GPT-3.5, GPT-4, Claude Opus, Gemini Pro

Das Sprachmodell ist der Motor. Die Anwendung ist das Auto.

Das lässt sich an der eigenen Geschichte der beiden zeigen. Als OpenAI ChatGPT am 30. November 2022 veröffentlichte, stand in der Ankündigung (externe Seite, openai.com) kein Modellname mit Versionsnummer. Dort hieß es, ChatGPT sei aus „einem Modell der GPT-3.5-Serie“ einem Fine-Tuning unterzogen worden. Die Anwendung bekam einen Namen und ein Gesicht, das Modell darunter blieb ungenannt.

Seitdem wurde dieses Modell mehrfach ausgetauscht: GPT-4 (externe Seite, openai.com) im März 2023, GPT-4o (externe Seite, openai.com) im Mai 2024, danach weitere. Der Name der Anwendung hat sich in dieser Zeit nicht geändert.

Drei Schichten übereinander: das Modell unten, die Laufzeitumgebung darüber, die Anwendung mit ihrem Namen ganz oben. WAS SIE BEDIENEN die Anwendung mit dem Namen ChatGPT Oberfläche, Verlauf, Konto, Dateien, Suche, Bilder greift auf ein Modell zu, das sich ändern darf WAS RECHNET das Sprachmodell darunter GPT-3.5-Serie ab 11/2022 GPT-4 ab 03/2023 GPT-4o und Nachfolger ab 05/2024 2022 2023 2024 heute Der Name oben bleibt. Das Modell darunter wird ausgetauscht. Deshalb ist die Frage „welche KI nutzt du“ ungenauer, als sie klingt.

seitlich verschiebbar

Oben die Anwendung mit dem Namen, darunter das Modell, das mehrfach gewechselt hat.

eigene Darstellung nach den Ankündigungen von OpenAI, Stand 07/2026

Warum die Trennung wichtig ist

Weil sonst Eigenschaften verwechselt werden. Dass ein Chatprogramm eine aktuelle Nachricht kennt, liegt meist daran, dass die Anwendung im Netz nachgesehen und das Ergebnis mitgegeben hat. Was ein Modell von sich aus weiß, hat einen Stichtag, siehe Kapitel 08. Dass eine Rechnung stimmt, liegt oft daran, dass die Anwendung einen Taschenrechner aufgerufen hat.

Woran Sie es im Alltag merken

Dasselbe Sprachmodell verhält sich in zwei Programmen unterschiedlich. Das eine antwortet knapp, das andere ausführlich; das eine kann Dateien lesen, das andere nicht. Der Unterschied steckt in der Anwendung, nicht im Modell.

Umgekehrt gilt dasselbe: Wenn eine Anwendung von heute auf morgen bessere Antworten gibt, ohne dass sich an der Oberfläche etwas geändert hat, wurde meist das Modell darunter getauscht.

In Kapitel 02 geht es darum, was das Bauteil eigentlich tut.

Quellen

8 Einträge, davon 3 Schlüsselarbeitenalle erreichbar

Erreichbarkeit automatisch geprüft

  • SchlüsselarbeitAnkündigung des Herstellerserreichbar

    Introducing ChatGPT (externe Seite, openai.com)

    openai.comgeprüft 24.09.2026

    Die Ankündigung vom 30.11.2022, mit der Sprachmodelle aus der Fachwelt heraustraten. Aufschlussreich ist der Wortlaut: Statt eines Modells mit Versionsnummer nennt OpenAI nur eine Herkunft, ChatGPT sei aus einem Modell der GPT-3.5-Serie einem Fine-Tuning unterzogen worden. Die Anwendung bekam einen Namen, das Modell dahinter blieb ungenannt. Diese Trennung besteht bis heute.

    Archivfassung (externe Seite, web.archive.org)

  • SchlüsselarbeitOriginalarbeiterreichbar

    Training language models to follow instructions with human feedback (externe Seite, arxiv.org)

    arxiv.orggeprüft 24.09.2026

    Ouyang und Mitautoren zeigen am 04.03.2022, dass ein deutlich kleineres, mit menschlicher Rückmeldung nachtrainiertes Modell hilfreicher antwortet als ein sehr viel größeres ohne. Das ist der Schritt, der aus einem Textfortsetzer einen Assistenten macht, und die Voraussetzung für ChatGPT acht Monate später.

  • SchlüsselarbeitOriginalarbeiterreichbar

    Attention Is All You Need (externe Seite, arxiv.org)

    arxiv.orggeprüft 24.09.2026

    Die Arbeit, mit der alles anfing. Vaswani und sieben Mitautoren stellen am 12.06.2017 die Transformer-Architektur vor und zeigen, dass ein Netz allein über den Mechanismus der Aufmerksamkeit auskommt, ohne die bis dahin übliche schrittweise Verarbeitung. Erst dadurch ließen sich Modelle sinnvoll auf viele Rechenkerne verteilen. Jedes GPT, jedes Claude und jedes Gemini steht auf dieser Arbeit. Abschnitt 3.2.3 hält die Einschränkung fest, die für alle fortsetzenden Modelle gilt: „self-attention layers in the decoder allow each position in the decoder to attend to all positions in the decoder up to and including that position“, dazu die Begründung „We need to prevent leftward information flow in the decoder to preserve the auto-regressive property“. Beide Stellen stehen im Volltext und sind deshalb ohne hinterlegtes Zitat, der Prüflauf liest die Abstract-Seite.

    Archivfassung (externe Seite, web.archive.org)

  • Ankündigung des Herstellerserreichbar

    GPT-4 (externe Seite, openai.com)

    openai.comgeprüft 24.09.2026

    GPT-4, vorgestellt am 14.03.2023. Erstmals verarbeitet ein Modell dieser Reihe neben Text auch Bilder. Der technische Bericht nennt bewusst keine Angaben zu Größe und Trainingsdaten, ein Bruch mit der bis dahin üblichen Offenheit.

  • Ankündigung des Herstellerserreichbar

    Hello GPT-4o (externe Seite, openai.com)

    openai.comgeprüft 24.09.2026

    GPT-4o, vorgestellt am 13.05.2024. Text, Bild und Ton laufen durch ein einziges Modell statt durch mehrere hintereinandergeschaltete. Mit diesem Modell kam auch das Vokabular o200k_base, nach dem der Tokenizer im Grundkurs zerlegt.

  • Originalarbeiterreichbar

    Improving Language Understanding by Generative Pre-Training (externe Seite, openai.com)

    openai.comgeprüft 24.09.2026

    GPT-1, vorgestellt am 11.06.2018. Führt das Muster ein, das bis heute gilt: erst ein Modell auf sehr viel unbeschriftetem Text vortrainieren, dann für einzelne Aufgaben nachjustieren. Das G in GPT steht für generative, das P für pre-trained, das T für Transformer.

  • Ankündigung des Herstellerserreichbar

    Better language models and their implications (externe Seite, openai.com)

    openai.comgeprüft 24.09.2026

    GPT-2, angekündigt am 14.02.2019. Die Technik zählte dabei weniger als die Entscheidung, das größte Modell zunächst zurückzuhalten. Die erste öffentliche Debatte darüber, ob ein Sprachmodell zu gut sein kann.

  • Originalarbeiterreichbar

    Language Models are Few-Shot Learners (externe Seite, arxiv.org)

    arxiv.orggeprüft 24.09.2026

    GPT-3, eingereicht am 28.05.2020. Zeigt, dass ein ausreichend großes Modell Aufgaben löst, für die es nie eigens trainiert wurde, wenn man ihm im Text ein paar Beispiele vorlegt. Das ist der Grund, warum Prompting überhaupt funktioniert. Die Zusammenfassung beschreibt außerdem, was vorher galt: Ein Sprachverarbeitungssystem brauchte für jede Aufgabe eigens gesammelte Beispiele, Tausende bis Zehntausende.

    Archivfassung (externe Seite, web.archive.org)

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.