Jeder Eintrag folgt derselben Form: eine Kurzantwort in zwei bis vier Sätzen, drei bis fünf prüfbare Fakten, eine Einordnung für die Praxis und Verweise auf verwandte Begriffe. Die Kurzantwort ist so geschrieben, dass sie ohne den umgebenden Text verständlich bleibt – das ist keine Stilfrage, sondern die Bedingung dafür, dass ein Sprachmodell sie unverfälscht übernehmen kann.
Aufgenommen wird, was in den Beiträgen und Leistungsseiten dieses Portals vorkommt und dort sonst jedes Mal neu erklärt werden müsste. Ein Glossar ist kein Selbstzweck, sondern eine Entlastung für den Fließtext.
109 Begriffe
Alle Begriffe von A bis Z
- Attention-Mechanismus Attention ist ein Rechenschritt, mit dem ein neuronales Netz für jede Position in einer Eingabe bestimmt, wie stark…
- Aktivierungsfunktion Eine Aktivierungsfunktion wandelt die gewichtete Summe der Eingänge eines Neurons in dessen Ausgabe um und bringt…
- Accuracy Accuracy ist der Anteil der richtig eingeordneten Fälle an allen Fällen. Die Kennzahl ist leicht verständlich und bei…
- Anomalieerkennung Anomalieerkennung findet Fälle, die deutlich vom üblichen Muster abweichen – ungewöhnliche Transaktionen,…
- API Eine API ist eine definierte Schnittstelle, über die ein Programm die Funktionen eines anderen nutzt. Bei KI-Diensten…
- AutoML AutoML automatisiert Teile des Entwicklungsvorgangs: Verfahrensauswahl, Merkmalsaufbereitung und die Suche nach guten…
- Artificial General Intelligence (AGI) AGI bezeichnet eine hypothetische künstliche Intelligenz, die beliebige geistige Aufgaben auf menschlichem Niveau…
- AI Governance AI Governance ist der organisatorische Rahmen, in dem ein Unternehmen den Einsatz von KI steuert: Verzeichnis der…
- AI Safety AI Safety befasst sich damit, KI-Systeme so zu bauen und zu betreiben, dass sie zuverlässig, vorhersehbar und…
- AI Alignment AI Alignment bezeichnet die Aufgabe, ein KI-System so auszurichten, dass sein Verhalten den beabsichtigten Zielen…
- Adversarial Examples Adversarial Examples sind Eingaben, die gezielt so verändert wurden, dass ein Modell sie falsch einordnet, während der…
- Bestärkendes Lernen Beim bestärkenden Lernen handelt ein Agent in einer Umgebung und erhält für seine Entscheidungen Belohnungen oder…
- Backpropagation Backpropagation ist das Verfahren, mit dem der Fehler am Ausgang eines neuronalen Netzes rückwärts durch die Schichten…
- Bias-Variance-Tradeoff Der Bias-Variance-Tradeoff beschreibt den Zielkonflikt zwischen einem zu einfachen und einem zu komplexen Modell. Ein…
- Bilderkennung Bilderkennung ordnet einem Bild eine oder mehrere vorher festgelegte Kategorien zu – etwa „Gutteil" oder „Ausschuss".…
- BERT BERT ist ein 2018 von Google vorgestelltes Sprachmodell, das einen Text in beide Richtungen zugleich liest und dadurch…
- Bias (Verzerrung) Bias bezeichnet systematische Schieflagen in Daten oder Modellen, die zu ungleichen Ergebnissen für bestimmte Gruppen…
- Chain of Thought Chain of Thought bezeichnet die Aufforderung an ein Sprachmodell, seine Zwischenschritte auszuformulieren, bevor es…
- Computer Vision Computer Vision umfasst Verfahren, mit denen Maschinen Bilder und Videos auswerten – von der Frage, was zu sehen ist,…
- Convolutional Neural Network (CNN) Ein Convolutional Neural Network wertet Bilder aus, indem es kleine Filter über die Fläche schiebt und dabei örtliche…
- ChatGPT ChatGPT ist die Chat-Anwendung von OpenAI, über die Nutzer im Dialog mit den GPT-Modellen arbeiten. Wichtig ist die…
- Claude Claude ist eine Familie von Sprachmodellen des Unternehmens Anthropic, verfügbar als Chat-Anwendung und über eine…
- Deep Learning Deep Learning ist maschinelles Lernen mit künstlichen neuronalen Netzen, die viele Schichten zwischen Ein- und Ausgabe…
- Datensatz Ein Datensatz ist eine geordnete Sammlung von Beispielen, mit der ein KI-Modell trainiert oder bewertet wird. Er…
- Datenvorverarbeitung Datenvorverarbeitung umfasst alle Schritte, die Rohdaten in eine für das Training geeignete Form bringen: Bereinigen,…
- Data Cleaning Data Cleaning ist das Beseitigen von Fehlern und Widersprüchen in einem Datenbestand: Dubletten, unmögliche Werte,…
- Data Labeling Data Labeling ist das Versehen von Rohdaten mit der jeweils richtigen Antwort, damit ein Modell überwacht trainiert…
- Data Augmentation Data Augmentation erzeugt zusätzliche Trainingsbeispiele, indem vorhandene leicht verändert werden – Bilder…
- Dropout Dropout schaltet während des Trainings in jedem Durchlauf zufällig einen Teil der Neuronen ab. Das Netz kann sich…
- Diffusion Models Diffusionsmodelle erzeugen Bilder, indem sie von reinem Rauschen ausgehen und dieses schrittweise entfernen, bis ein…
- Deepfake Ein Deepfake ist ein mit KI erzeugtes oder verändertes Medium, das eine reale Person etwas sagen oder tun lässt, das…
- Datenschutz bei KI Sobald in einer Eingabe an ein KI-System ein Name, eine Kundennummer oder ein anderer Personenbezug steht, liegt eine…
- Embedding Ein Embedding ist die Darstellung eines Textstücks, Bildes oder anderen Objekts als Zahlenfolge, in der Ähnlichkeit…
- Empfehlungssysteme Empfehlungssysteme schlagen Nutzern Inhalte oder Produkte vor, die zu ihrem bisherigen Verhalten oder zu ähnlichen…
- Edge AI Edge AI bezeichnet die Ausführung von KI-Modellen direkt auf dem Gerät – auf einem Sensor, einer Maschine, einem…
- Explainable AI (XAI) Explainable AI umfasst Verfahren, die nachvollziehbar machen, wie ein Modell zu einer Ausgabe gekommen ist.…
- Few-Shot Learning Few-Shot Learning bezeichnet das Lösen einer Aufgabe anhand weniger Beispiele. Bei Sprachmodellen meint der Begriff…
- Feature Engineering Feature Engineering ist das Ableiten aussagekräftiger Merkmale aus Rohdaten – etwa eine Dauer aus zwei Zeitstempeln…
- F1-Score Der F1-Score fasst Präzision und Recall als harmonisches Mittel zu einer Zahl zusammen. Anders als der einfache…
- Feinjustierung (Fine-Tuning) Feinjustierung passt ein bereits trainiertes Modell mit eigenen Beispielen an eine bestimmte Aufgabe an. Verändert…
- Fairness Fairness beschreibt die Anforderung, dass ein KI-System Personengruppen nicht ungerechtfertigt ungleich behandelt. Es…
- Guardrails Guardrails sind vorgeschaltete und nachgelagerte Prüfungen, die ein KI-System davon abhalten sollen, unerwünschte…
- Gradientenabstieg Der Gradientenabstieg ist das Standardverfahren, mit dem die Parameter eines Modells beim Training angepasst werden.…
- Gewichte Gewichte sind die Zahlen, die festlegen, wie stark ein Eingangssignal in einem neuronalen Netz weitergegeben wird; der…
- Generative KI Generative KI umfasst Verfahren, die neue Inhalte erzeugen – Text, Bilder, Ton, Video oder Programmcode – statt…
- GANs (Generative Adversarial Networks) Ein GAN besteht aus zwei Netzen, die gegeneinander trainiert werden: Ein Generator erzeugt künstliche Daten, ein…
- GPT (Generative Pretrained Transformer) GPT bezeichnet eine Familie von Sprachmodellen von OpenAI, die auf der Transformer-Architektur beruhen und Text…
- GPU Grafikprozessoren führen sehr viele einfache Rechenoperationen gleichzeitig aus und eignen sich dadurch besonders für…
- Generative Engine Optimization (GEO) Generative Engine Optimization bezeichnet die Aufbereitung von Inhalten so, dass Sprachmodelle sie in ihren Antworten…
- Künstliche Intelligenz (KI) Künstliche Intelligenz ist der Sammelbegriff für Verfahren, mit denen Computer Aufgaben lösen, für die beim Menschen…
- Kontextfenster Das Kontextfenster ist die Menge an Text, die ein Sprachmodell bei einer Anfrage gleichzeitig berücksichtigen kann –…
- KI-Agent Ein KI-Agent ist ein System, das ein Sprachmodell mit Werkzeugen verbindet und es in mehreren Schritten selbstständig…
- Konfusionsmatrix Die Konfusionsmatrix stellt in einer Tabelle gegenüber, wie oft ein Modell jede Klasse richtig und wie oft es sie mit…
- Kreuzvalidierung Bei der Kreuzvalidierung wird der Datenbestand in mehrere Teile zerlegt; jeder Teil dient einmal als Testmenge,…
- KI-Verordnung (AI Act) Die KI-Verordnung der Europäischen Union regelt den Einsatz von KI-Systemen nach ihrem Risiko: verbotene Praktiken,…
- Large Language Model (LLM) Ein Large Language Model ist ein neuronales Netz, das auf sehr großen Textmengen darauf trainiert wurde, das jeweils…
- Lernrate Die Lernrate legt fest, wie stark die Parameter eines Modells bei jedem Trainingsschritt verändert werden. Sie ist der…
- LoRA (Low-Rank Adaptation) LoRA ist ein sparsames Verfahren zur Feinjustierung: Statt alle Gewichte eines Modells zu verändern, werden kleine…
- LangChain LangChain ist ein Rahmenwerk, das den Bau von Anwendungen mit Sprachmodellen erleichtert: Anbindung an Modelle,…
- llms.txt Die llms.txt ist eine Textdatei im Wurzelverzeichnis einer Website, die Sprachmodellen einen geordneten Überblick über…
- Maschinelles Lernen Maschinelles Lernen bezeichnet Verfahren, bei denen ein Programm Regeln aus Beispieldaten ableitet, statt sie von…
- Multi-Head Attention Multi-Head Attention führt mehrere Attention-Berechnungen parallel aus, jede mit eigenen gelernten Gewichten. Dadurch…
- Modellparameter und Hyperparameter Modellparameter sind die Werte, die ein Modell während des Trainings selbst lernt – bei neuronalen Netzen die Gewichte…
- MLOps MLOps überträgt die Arbeitsweisen von DevOps auf maschinelles Lernen: Versionierung von Daten und Modellen,…
- Model Deployment Model Deployment ist die Überführung eines trainierten Modells in den produktiven Betrieb, wo es Anfragen beantwortet…
- Mixture of Experts (MoE) Bei einem Mixture-of-Experts-Modell wird nicht das gesamte Netz für jede Anfrage durchgerechnet, sondern nur ein…
- Neuronale Netze Ein künstliches neuronales Netz besteht aus Schichten einfacher Recheneinheiten, die gewichtete Eingangssignale…
- Natural Language Processing (NLP) Natural Language Processing ist das Fachgebiet, das sich mit der maschinellen Verarbeitung natürlicher Sprache befasst…
- Named Entity Recognition (NER) Named Entity Recognition findet in Texten benannte Einheiten – Personen, Organisationen, Orte, Daten, Beträge – und…
- Narrow AI (Schwache KI) Narrow AI bezeichnet Systeme, die eine eng umrissene Aufgabe lösen – Bilder einordnen, Sprache übersetzen, Text…
- Overfitting Overfitting bezeichnet den Zustand, in dem ein Modell die Trainingsdaten samt ihrer Zufälligkeiten auswendig gelernt…
- Objekterkennung Objekterkennung bestimmt in einem Bild nicht nur, welche Objekte vorhanden sind, sondern auch wo sie sich befinden und…
- Optical Character Recognition (OCR) OCR wandelt Text in Bildern und Scans in maschinenlesbaren Text um. Bei sauberen gedruckten Vorlagen ist die Erkennung…
- OpenAI API Über die OpenAI API lassen sich die Modelle von OpenAI in eigene Anwendungen einbinden. Abgerechnet wird nach…
- Prompt Ein Prompt ist die Eingabe, mit der ein KI-System zu einer Ausgabe veranlasst wird – von einer einzelnen Frage bis zu…
- Prompt Engineering Prompt Engineering ist die planmäßige Gestaltung und Prüfung von Eingaben an KI-Systeme, damit sie reproduzierbar…
- Prompt Injection Prompt Injection ist ein Angriff, bei dem in Daten, die ein KI-System verarbeitet, Anweisungen versteckt werden, die…
- Präzision und Recall Präzision gibt an, welcher Anteil der als positiv eingestuften Fälle tatsächlich positiv ist. Recall gibt an, welcher…
- Predictive Analytics Predictive Analytics nutzt historische Daten, um wahrscheinliche künftige Ereignisse abzuschätzen – Nachfrage,…
- PyTorch PyTorch ist die derzeit meistgenutzte Programmbibliothek für Deep Learning und stammt aus dem Umfeld von Meta. Sie ist…
- Privacy-Preserving AI Privacy-Preserving AI fasst Verfahren zusammen, die Modelle trainieren oder betreiben, ohne sensible Daten zentral…
- Retrieval-Augmented Generation (RAG) Retrieval-Augmented Generation verbindet ein Sprachmodell mit einer Suche über eigene Dokumente: Zur Laufzeit werden…
- Regularisierung Regularisierung fasst Verfahren zusammen, die ein Modell während des Trainings zur Einfachheit zwingen, damit es…
- ROC-Kurve Die ROC-Kurve zeigt für alle möglichen Schwellenwerte, wie sich die Rate richtig erkannter positiver Fälle gegen die…
- Self-Attention Self-Attention ist der Fall von Attention, bei dem eine Folge auf sich selbst bezogen wird: Jedes Element bewertet,…
- Semi-Supervised Learning Semi-Supervised Learning kombiniert eine kleine Menge beschrifteter Daten mit einer großen Menge unbeschrifteter. Das…
- Synthetische Daten Synthetische Daten werden künstlich erzeugt, statt in der Wirklichkeit erhoben zu werden – durch Simulation,…
- Stable Diffusion Stable Diffusion ist ein 2022 veröffentlichtes Diffusionsmodell zur Bildgenerierung, dessen Gewichte offen verfügbar…
- Sentimentanalyse Die Sentimentanalyse ordnet einem Text eine Grundstimmung zu – meist positiv, neutral oder negativ. Eingesetzt wird…
- Spracherkennung Spracherkennung wandelt gesprochene Sprache in Text um. Moderne Systeme wie Whisper arbeiten mehrsprachig und bleiben…
- Semantische Suche Die semantische Suche vergleicht die Bedeutung von Suchanfrage und Inhalten statt nur die verwendeten Wörter. Möglich…
- Transformer-Architektur Der Transformer ist eine 2017 vorgestellte Netzarchitektur, die eine Eingabefolge nicht Schritt für Schritt, sondern…
- Tokenisierung Tokenisierung zerlegt Text in kleine Einheiten, sogenannte Token, die ein Sprachmodell verarbeiten kann. Ein Token…
- Temperature Temperature ist ein Einstellwert, der steuert, wie stark ein Sprachmodell bei der Auswahl des nächsten Tokens vom…
- Trainingsdaten Trainingsdaten sind die Beispiele, aus denen ein Modell seine Regeln ableitet. Ihre Qualität, Vollständigkeit und…
- Text-to-Image Text-to-Image-Systeme erzeugen aus einer Textbeschreibung ein Bild. Sie verbinden ein Modell, das Sprache und…
- Textgenerierung Textgenerierung bezeichnet die automatische Erzeugung von Fließtext durch Sprachmodelle – von der Produktbeschreibung…
- Textklassifikation Textklassifikation ordnet Dokumente automatisch vorgegebenen Kategorien zu – etwa E-Mails einer Zuständigkeit oder…
- Transferlernen Transferlernen nutzt ein Modell, das bereits auf einer großen allgemeinen Datenmenge trainiert wurde, als…
- Vektordatenbank Eine Vektordatenbank speichert Embeddings und findet zu einem Suchvektor schnell die ähnlichsten Einträge. Sie ist der…
- Verlustfunktion Die Verlustfunktion misst als einzelne Zahl, wie weit die Vorhersagen eines Modells von den bekannten richtigen Werten…
- Variational Autoencoder (VAE) Ein Autoencoder verdichtet Daten über eine schmale Zwischenschicht und rekonstruiert sie anschließend wieder; der…
Kein Begriff passt zu dieser Eingabe.
Häufige Fragen zum KI-Glossar
Warum sind die Einträge so kurz?
Weil Länge hier nichts hilft. Ein Glossareintrag soll eine Frage vollständig beantworten und dann aufhören. Wer mehr zum Thema sucht, findet unter „Verwandte Begriffe" und im Blog die ausführliche Fassung.
Was bedeutet das Prüfdatum?
Es gibt an, wann der Eintrag zuletzt inhaltlich durchgesehen wurde – nicht, wann zuletzt ein Komma geändert wurde. Bei einem Feld, in dem sich Modelle im Quartalstakt ändern, ist das Datum oft die wichtigste Information auf der Seite.
Warum finde ich einen Begriff nicht mehr, den es früher gab?
Beim Umzug auf das neue System wurden eng verwandte Einträge zusammengeführt – etwa Overfitting und Underfitting. Die alten Adressen leiten dauerhaft auf den zusammengeführten Eintrag weiter, es geht also nichts verloren.