Was ist eine Halluzination bei Sprachmodellen?
Hallucination
Als Halluzination bezeichnet man eine Modellantwort, die sprachlich sicher und plausibel wirkt, inhaltlich aber falsch oder frei erfunden ist, etwa eine erfundene Paragrafenangabe, eine nicht existierende Quelle oder eine Funktion, die es in der Software nie gab.
Die gefährlichsten Fehler eines Sprachmodells sind die, die gut aussehen: die erfundene Paragrafenangabe mitten in einem ansonsten korrekten Text.
KI-generiertDieses Bild wurde mit KI erzeugt · Yves Hoppe / KI / cmt
- Erkennbar an
- Selbstsicherem Ton bei falschem Inhalt
- Häufig bei
- Zahlen, Zitaten, Paragrafen, Produktfunktionen
- Hilft dagegen
- Belege aus eigenen Quellen und Stichproben
- Verwechselt mit
- Veralteten Trainingsdaten
Warum ein Modell erfindet
Ein Sprachmodell sagt das jeweils wahrscheinlichste nächste Textstück voraus. Es gleicht seine Antwort mit keiner Datenbank ab und hat keinen Mechanismus, der zwischen gelernter Tatsache und gut klingender Fortsetzung unterscheidet. Wo die Trainingsdaten eine Lücke lassen, füllt das Modell sie mit dem Muster, das an dieser Stelle üblich ist.
Genau deshalb sehen Halluzinationen so echt aus. Eine Quellenangabe hat ein bekanntes Format: Nachname, Titel, Jahr, Zeitschrift. Das Modell erzeugt dieses Format fehlerfrei, auch wenn es die Arbeit dahinter nie gegeben hat. Sicheres Auftreten ist eine Eigenschaft der Sprache und kein Hinweis auf Wissen. Genau daran stolpern die meisten.
Wo es im Arbeitsalltag teuer wird
Kritisch sind alle Stellen, an denen eine Zahl oder ein Verweis später jemand anderes übernimmt: Paragrafen und Fristen in einem Schreiben, Beträge in einer Zusammenfassung, Literaturangaben in einem Bericht, Funktionsaufrufe in Programmcode, die es in der Bibliothek gar nicht gibt.
Besonders unangenehm ist die Mischform: Neun Angaben stimmen, die zehnte nicht. Wer den Text nur überfliegt, findet keinen Anhaltspunkt zum Misstrauen, weil ringsum alles korrekt ist. Deshalb ist die Frage nicht, ob du Antworten prüfst, sondern welche Stellen du gezielt prüfst.
Was tatsächlich hilft
Am wirksamsten ist es, dem Modell die Grundlage mitzugeben, statt aus dem Gedächtnis antworten zu lassen. Wenn die Antwort aus einem beigefügten Dokument stammen muss und jede Aussage mit einer Fundstelle daraus belegt wird, schrumpft der Raum für Erfindungen deutlich. Verlange dabei wörtliche Zitate, keine Zusammenfassung: Ein Zitat kannst du im Dokument suchen, eine Paraphrase nicht.
Zweitens hilft es, den Ausweg zu erlauben. Formuliere die Aufgabe so, dass eine leere Antwort zulässig ist, etwa mit dem Hinweis, dass das Modell im Zweifel schreiben soll, dass die Unterlage dazu nichts hergibt. Ohne diese Erlaubnis wird es irgendetwas liefern, weil eine Antwort die wahrscheinlichere Fortsetzung ist als ein Eingeständnis.
Drittens bleiben zwei Handgriffe unersetzlich: Links und Quellenangaben tatsächlich aufrufen, und alles, was rechtlich oder finanziell bindet, von einem Menschen gegenzeichnen lassen.
KI-generiertDieses Bild wurde mit KI erzeugt · Yves Hoppe / KI / cmt
Halluzination und was oft damit gleichgesetzt wird
Antworten können falsch sein, weil das Trainingsmaterial einen bestimmten Stand hat und seither Gesetze oder Produkte sich geändert haben. Das ist keine Erfindung, sondern ein Aktualitätsproblem, und es lässt sich durch Zugriff auf aktuelle Quellen lösen.
Bei einer Halluzination irrt das Modell von sich aus. Bei einer Prompt Injection wird es gezielt von außen manipuliert. Die falsche Ausgabe sieht ähnlich aus, die Gegenmaßnahmen sind völlig andere.
KI-generiertDieses Bild wurde mit KI erzeugt · Yves Hoppe / KI / cmt
Teuer wird es dort, wo niemand mehr nachschaut
Die klassischen Stellen sind Zahlen und Belege: eine Paragrafenangabe in einem sonst sauberen Schreiben, ein Preis in einem Angebot, ein Funktionsname in einem Codebeispiel, den es in der Bibliothek nie gab. Alles drumherum stimmt, deshalb fällt die eine falsche Angabe beim Überfliegen nicht auf.
Der eigentliche Schaden entsteht durch Gewöhnung. Wer wochenlang brauchbare Entwürfe bekommt, prüft irgendwann nur noch den Tonfall. Genau deshalb gehört die Kontrolle in den Ablauf und nicht in die Selbstdisziplin: Zahlen aus dem Quellsystem einsetzen statt aus dem Modell übernehmen, Zitate nur mit Fundstelle gelten lassen, bei Verträgen und Rechtstexten eine zweite Person darüberschauen lassen.
Was zusätzlich hilft, ist, dem Modell die Quelle mitzugeben und die Antwort ausdrücklich auf diese Quelle zu verpflichten. Die Zahl der erfundenen Angaben sinkt damit deutlich, auf null geht sie nicht, denn ein Modell kann auch einen mitgelieferten Text falsch zusammenfassen.
Halluzination lernen
Woran du eine erfundene Quelle erkennst und wie du Ergebnisse systematisch gegenprüfst, üben die Kurse zum kritischen Prüfen von KI-Antworten .
Wer die Fehlerquote messen statt nur bemerken möchte, ist bei den Trainings zur Messung von Modellqualität richtig.
Sitzt Halluzination schon?
Lesen fühlt sich schnell nach Können an. Ein kurzer Test zeigt dir, was davon schon sitzt und wo sich ein Kurs lohnt. Kostenlos, ohne Anmeldung, mit einer Erklärung zu jeder Antwort.
Häufige Fragen
Kann man Halluzinationen ganz abstellen?
Hilft es, im Prompt zu schreiben, das Modell soll nicht halluzinieren?
Woran erkenne ich eine erfundene Quelle?
Deine Ansprechpartner
Du willst das Thema nicht nur nachschlagen, sondern anwenden können? Wir beraten dich persönlich und kostenlos.
Yves Hoppe
Weiterbildung & Beratung
Ordnet mit dir ein, welcher Kurs zu deinem Vorwissen passt.
Norbert Jansen
Beratung & Inhouse
Plant Inhouse-Trainings, die an euren eigenen Daten und Abläufen ansetzen.
Halluzination im Kurs statt im Lexikon
Nachschlagen bringt dich bis zum Verstehen. Anwenden lernst du an echten Aufgaben.