Lernpfade und Tiefen
Zwei Dinge lassen sich unabhängig voneinander wählen. Der Lernpfad bestimmt, welche Kapitel aufeinander folgen. Die Tiefe bestimmt, wie ausführlich ein einzelnes Kapitel ausfällt.
Sie können einen Pfad durcharbeiten oder gezielt ein Kapitel herausgreifen. Der Grundkurs erklärt die Begriffe, auf die die anderen aufsetzen.
Überblick, Verstehen, Vertiefen. Gleiche Aussage, gleiche Grafiken, unterschiedlicher Detailgrad. Umschaltbar im Kapitel selbst.
Was hinter den Begriffen KI, LLM und ChatGPT steckt und wie sie zusammenhängen.
02Was ein Sprachmodell tutWas ein Sprachmodell überhaupt tut, ohne Fachbegriffe.
03Token, die Bausteine der SpracheEin Sprachmodell liest Token statt Wörter. Was das ist, und warum deutsche Fachwörter mehr davon brauchen als englische.
04Embedding, Bedeutung als ZahlenreiheWie aus einem Token eine Zahlenreihe wird, warum Nähe in diesem Raum Bedeutung heißt und wozu das gut ist.
05Der PromptWas ein Prompt ist, aus welchen Teilen er besteht und welcher davon Ihre Nachricht ist.
06Gute Prompts schreibenWarum Prompting-Ratgeber schneller altern als die Modelle, und was trotzdem stehen bleibt.
07Halluzinationen erkennenWoran Sie eine erfundene Angabe erkennen, warum die Rückfrage nichts prüft und welche drei Handgriffe wirklich etwas belegen.
08Was ein Modell weiß, und woherWarum das Wissen eines Modells einen Stichtag hat, warum das Modell ihn selbst nicht kennt, und auf welchen drei Wegen Neues hineinkommt.
09ToolsWas passiert, wenn ein Modell im Netz nachschlägt oder rechnet: Es tut es nicht selbst, es bittet darum. Warum dieser Unterschied im Alltag zählt.
10Welches Modell, welche StufeWarum es die Frage überhaupt noch gibt, was die Stufen unterscheidet und wofür der zweite Regler da ist. Mit dem Versuch, die Wahl abzuschaffen, und seinem Ende.
11Über die APIDie zweite Tür zum Modell, warum der Schlüssel ein Ausweis ist, was daraus folgt, dass jede Anfrage für sich steht, und warum das auch angeht, wer nie eine Zeile programmiert
12Wie zufällig die Antwort istDass das Modell eine Rangliste liefert, wer daraus das nächste Wort zieht, was die Temperatur dabei einstellt, und warum dieselbe Frage zweimal zwei Antworten ergibt
13Was ein Modell auf einem Bild erkenntEin Bild wird nach Fläche in Token umgerechnet, ein PDF Seite für Seite genauso. Was das kostet, und die drei Grenzen, die man vor der ersten Nutzung kennen sollte.
14Ein Bild, das es vorher nicht gabStable Diffusion und seine Linie lernen, Rauschen zu entfernen, und seit 2025 gibt es ein zweites Verfahren. Was daraus für den Alltag folgt, und warum sich ein erzeugtes Bild hinterher nicht als solches erkennen lässt.
15Wofür man ein Sprachmodell benutztFünf Formen, in die fast jede Aufgabe fällt, je mit dem Gegencheck und dem Werkzeug, das sie besser kann, und die Trennung zwischen gemessenen und behaupteten Fähigkeiten.
16Das GesamtbildEine einzige Frage, vom Tippen bis zur Antwort, quer durch alles, was der Grundkurs behandelt hat. Neun Stationen, jede mit dem Kapitel dahinter.
Was einen Agenten von einem festen Ablauf unterscheidet, warum der Hersteller selbst davon abrät, solange etwas Einfacheres genügt, und woran man beides auseinanderhält.
02MCPWarum es einen Standard für Tool-Anbindungen gibt, was er festlegt, und was sich dadurch für das Modell nicht ändert.
03RAG, die Suche vor der AntwortWie ein Programm eigene Dokumente durchsucht und das Gefundene dem Modell vorlegt, warum die Suche vor dem Modell zu prüfen ist, und woran Sie erkennen, dass sie danebengriff.
04Der HarnessAlles, was um ein Modell herum steht, damit ein Agent daraus wird: woraus es besteht, und wie viel es gemessen ausmacht. Mit der Zahl, die ein Anbieter am eigenen Werkzeug erhoben hat.
Warum die Frage nach dem Ort zwei Fragen sind, wieso zu demselben Modell je nach Betreiber eine andere Zusage gehört, und was offene Gewichte damit zu tun haben.
02Ein Modell auf eigene Daten abstimmenWas geschieht, wenn ein Modell wirklich verändert wird, wofür sich das eignet, welche drei billigeren Antworten davor stehen, und warum die Rechnung auch an Tagen läuft, an denen niemand fragt.
03Chancen und GrenzenZwei Größen machen die Frage beantwortbar, was ein Modell heute erledigt: wie lang eine Aufgabe ist und wie oft sie gelingen muss. Mit den gemessenen Werten und dem, was daraus für die Auswahl folgt.
04Was eine Benchmarkzahl sagtWoraus eine Testzahl entsteht, und die vier Gründe, warum dieselbe Zahl an zwei Stellen etwas anderes bedeutet. Mit der Frage, was davon für die eigene Entscheidung übrig bleibt.
05Geschwindigkeit der EntwicklungMehrere Größen wachsen gleichzeitig und in sehr verschiedenen Takten. Welche das sind, welcher davon im Alltag ankommt, und warum sich 2024 der Antrieb dahinter geändert hat.
06Der Blick ins ModellWas Forscher über das Innenleben von Sprachmodellen herausgefunden haben, wo sie dabei aufhören, und warum ein Modell über sich selbst keine verlässliche Auskunft gibt.
07Die Systemkarte lesenWas in dem Dokument steht, das jedes große Modell begleitet, wer es schreibt, und was davon für eine eigene Entscheidung übrig bleibt. Mit fünf Fragen an jede Karte.
08Wo die Daten liegen und wie langeWarum eine europäische Region noch nichts darüber sagt, wo gerechnet wird, welcher Speicher auch ohne Training entsteht, und warum derselbe Vertrag je nach Zugangsweg mit einem anderen Partner besteht.
Der Begriff ist von Februar 2025 und war für kleine, ersetzbare Projekte gedacht. Fünfzehn Monate später hat sein Urheber selbst die Grenze gezogen: Vibe-Coding hebt den Boden, Agentic Engineering die Decke. Dazu die Zahlen, wie weit das in den Betrieben ist, und was sie messen.
02Die WerkzeugeDrei Bauformen statt einer Produktliste: Code-Completion beim Tippen, Agent in der Entwicklungsumgebung, Agent auf der Kommandozeile. Was ein Werkzeug sehen und ausführen darf, hängt weniger an seiner Oberfläche als an seinen Einstellungen.
03Der InitJede Sitzung fängt mit leerem Fenster an. Was der Agent trotzdem weiß, steht in einer Datei, die er sich beim ersten Mal selbst schreibt. Was dabei herauskommt, was davon gemessen nützt, und warum sie nichts erzwingt.
04VersionierungEin Agent ändert zwanzig Dateien in zwei Minuten. Warum Git dabei kein Nebenschauplatz ist, was der eingebaute Rückweg der Werkzeuge leistet, und wo er aufhört.
05Das GedächtnisEin Sprachmodell erinnert sich an nichts. Der Agent trotzdem, weil er beim nächsten Mal an fünf Orten nachsieht. Welche das sind und wer sie jeweils füllt.
06Wissensbasis im VaultDer fünfte Ort liegt außerhalb des Projekts: eine Sammlung von Notizen, die ein Agent pflegt und die über Projekte hinweg gilt. Was das Muster dahinter ist und warum es sich von einer Suche über Dokumente unterscheidet.
07Prüfen statt glaubenEin Agent hört auf, wenn die Arbeit fertig aussieht. Was daraus folgt, was als Prüfung taugt, und wer die Schleife schließt, solange es keine gibt.
08Berechtigungen und RechtemodiDie Rückfrage vor jedem Befehl war lange die eigentliche Sicherung. Gemessen wird sie zu 97 Prozent bejaht. Was seit dem 14. August 2026 an ihre Stelle getreten ist, und welche Regel unabhängig vom Modus gilt.
08Hooks und SkillsZwei Einrichtungen liegen neben dem Modell und arbeiten gegenläufig: Ein Hook läuft, ob der Agent will oder nicht. Ein Skill liegt bereit und kommt, wenn er gebraucht wird.
09Sandbox und IsolierungEine Rechteregel entscheidet, ob ein Befehl laufen darf. Was er dabei erreicht, entscheidet etwas anderes: eine Grenze, die das Betriebssystem zieht und die auch dann gilt, wenn ein erlaubter Befehl mehr tut, als sein Name sagt.
09Subagenten und SchleifenEine Nebenaufgabe, deren Zwischenstände niemand wieder braucht, läuft besser in einem eigenen Fenster. Wofür sich das lohnt, was zurückkommt, und was es kostet.
10Vorgabe und UmfangWer genauer aufschreibt, bekommt Besseres. Zwei kontrollierte Versuche messen diese Annahme nach und widersprechen ihr an beiden Enden: Die Form der Vorgabe wirkt am stärksten dort, wo das Modell schwach ist, und ab einer gewissen Menge wirkt sie gegen sich selbst.
11Codequalität und RefactoringEine Runde endet grün, und trotzdem wird der Bestand schlechter. Vier Kennzahlen aus 623 Millionen Änderungen, die Gegenrechnung aus 15.451 Umbauten, und was daraus für die eigene Arbeit folgt.
Warum Chat und Sprachdialog dasselbe System mit verschiedenen Rändern sind, wie die drei Stufen dazwischen heißen, und woran sich entscheidet, ob ein System antwortet oder handelt.
02Sprache und AudioZwei Bauformen für gesprochene Sprache, was Erkennung und Erzeugung sind, und warum diese Entscheidung vor allen anderen steht.
03Wenn das Gespräch nicht in Runden läuftWarum es im Gespräch kein Enter gibt, wer stattdessen entscheidet, wann jemand fertig geredet hat, und welche zwei Bauarten es dafür gibt.
04Über das TelefonWie ein Anruf bei einem Sprachagenten ankommt, warum die Leitung dem System weniger Ton liefert, als seine Erkennung gewohnt ist, und was der fehlende Bildschirm kostet.
05Wissen anbindenWarum das Nachschlagen im Gespräch dieselbe Mechanik hat wie im Chatfenster und trotzdem eine andere Entscheidung ist, was das System sagt, während es sucht, und was eine leere Trefferliste bedeutet, die niemand sehen kann.
06Tools anbindenWarum ein Tool Call das Gespräch anhält, was ein System in dieser Zeit sagen sollte und was besser nicht, und welche Rechnung aus dem MCP-Kapitel dabei unverändert weiterläuft.
07GuardrailsAn welchen drei Stellen ein Gesprächssystem geprüft wird, warum eine Prüfung der Ausgabe im Gespräch später kommt als im Chatfenster, und weshalb zwei Anwendungen mit demselben Modell sich verschieden verhalten.
08Eskalation an einen MenschenWas Human in the Loop heißt und welche zwei Formen es kennt, warum die Voreinstellung eines Herstellers ein Eingeständnis ist, und was sich gegenüber dem Tastenmenü geändert hat.
09Was die Stimme noch beweistSeit dem 02.08.2026 muss ein Sprachagent sagen, dass er eine Maschine ist. Was die Verordnung wörtlich verlangt, welche Ausnahme sie kennt, und wann die Ansage fällig ist.
10Testen, bevor jemand anruftWarum sich ein Sprachagent nicht wie eine Rechnungsprüfung testen lässt, was ein aufgezeichneter Testfall stattdessen festhält, und was ein Abdeckungsbericht über einen Testbestand sagt.
11Ton wird nach Zeit bezahltTon hat keine Wortzahl, er hat eine Dauer. Wie daraus Token werden, warum die Rate beim Sprechen doppelt so hoch ist wie beim Zuhören, und was das je Minute bedeutet.
12Was nach dem Gespräch übrig bleibtEin Transkript zeigt, was gesagt wurde, und verschweigt alles dazwischen. Was ein Trace festhält, und warum manche Fehler ausschließlich aus einer Reihenfolge bestehen.
Was das Gesetz als KI-System bestimmt, wo die Grenze zu gewöhnlicher Software verläuft, und was außer Sprachmodellen noch unter denselben Begriff fällt.
02Maschinelles LernenWie Verhalten aus Beispielen entsteht statt aus aufgeschriebenen Regeln, warum das Verfahren in zwei getrennten Phasen läuft, und die drei Arten, aus Daten zu lernen.
03Neuronale Netze und Deep LearningWas in einem Netz aus Schichten und Gewichten geschieht, warum die Anleihe bei der Biologie in die Irre führt, was das Wort tief beziffert, und woran sich 2012 alles änderte.
04Mustererkennung und KlassifikationWarum eine Klassenliste eine Entwurfsentscheidung ist, wer vor 2012 festlegte, worauf ein Verfahren achtet, warum am Ende eine Wahrscheinlichkeit mit einer Schwelle steht, und welche der beiden Fehlerrichtungen im Betrieb teurer ist.
05Computer VisionVier Aufgaben hinter einem Wort, die Zeit, in der jemand aufschrieb worauf ein Verfahren achten soll, was ein Kasten um ein Ding behauptet, und wo die KI-Verordnung die biometrische Identifizierung untersagt.
06NLP vor den SprachmodellenEin Programm von 1966, das ohne jede Bedeutung auskam und trotzdem verstanden wirkte, die Zeit der aufgeschriebenen Grammatiken, und wie aus einem Text eine Zählung wurde, in der ein seltenes Wort mehr wiegt als ein häufiges.
07SpracherkennungWie aus einer Schallwelle Text wird, warum das jahrzehntelang drei getrennte Bauteile brauchte, und was ein heutiges Modell davon übernommen hat.
08SprachsyntheseWie aus Text Schall wird, welche zwei Bauformen es vor 2016 gab, und warum die eine Stimme klingen ließ wie ein Automat und die andere sich nicht ändern ließ.
09WeltmodelleEin Modell, das die nächste Lage seiner Umgebung vorhersagt, warum ein Agent darin üben kann statt in der Welt, und was Videomodelle damit zu tun haben.
10Small Language ModelsWarum bei manchen Modellen die Größe im Namen steht und bei den bekanntesten nirgends, ab wann ein Modell als klein gilt, und was auf einem Telefon inzwischen rechnet.
11Woher der Begriff KI kommtDas Wort künstliche Intelligenz stammt aus einem Förderantrag von 1955, seine Tagesordnung liest sich wie ein Inhaltsverzeichnis von heute, der erste Rückschlag des Fachs hat ein Datum, und das Kürzel AGI hat drei Definitionen.
12Was die KI-Verordnung verlangtDie vier Risikostufen der KI-Verordnung nebeneinander, die eine Pflicht, die unabhängig von jeder Stufe gilt, und warum jede Angabe eines Geltungsdatums ohne die zugehörige Pflicht unvollständig bleibt.
13Video, Musik und 3DWas an der Zeitachse anders ist als am Einzelbild, warum die Cliplänge die wichtigste Angabe dieses Gebiets ist, und weshalb Musik und Raum über ganz andere Wege entstehen.
14Physical AIWas Physical AI meint, warum Bewegung für ein Modell schwerer ist als Text, welche Bauform dahintersteckt und wo solche Systeme heute wirklich arbeiten.
gelesen angesehen offen67 von 82 Kapiteln veröffentlicht