KI schreibt schnell und klingt sicher. Das heißt nicht, dass es stimmt. Eine falsche Angabe, die die KI selbst erfunden hat, nennt man Halluzination. Auf dieser Seite findest du eine kurze Routine, mit der du jedes Ergebnis prüfst, bevor es an einen Kunden geht.
Die Prüfroutine
Nimm dir für jedes KI-Ergebnis diese fünf Schritte vor. Das Original liegt dabei neben dir: die Kundenmail, die Preisliste, der Kalender.
- Zahlen abgleichen. Jeder Preis, jede Menge, jede Summe kommt aus dem Original. Rechne Summen selbst nach.
- Fristen und Termine abgleichen. Steht in der Mail „Mittwoch 12 Uhr“, muss im Ergebnis auch Mittwoch 12 Uhr stehen.
- Namen und Adressen abgleichen. Stimmt der Kunde, stimmt die Baustelle, stimmt das Objekt?
- Nach der Quelle fragen. Frag die KI: „Aus welcher Stelle in meinen Unterlagen stammt diese Angabe?“ Dann schau selbst an dieser Stelle nach. Findest du sie nicht, streich die Angabe.
- Du entscheidest. Die KI liefert einen Entwurf. Versenden, bestellen oder zusagen tust du selbst.
Auch die Anbieter selbst raten dazu. Microsoft nennt Entwürfe und Zusammenfassungen den Zweck seines Copilot und empfiehlt, sie vor dem Versand zu prüfen (Microsoft Learn).
Ein Beispiel aus dem Bau, mit erfundenen Daten: Die KI fasst drei Anfragen zusammen und schreibt „Dachrinne Hofseite, 14 Meter“. In der Mail des Kunden stehen 12 Meter. Ohne Abgleich landet die falsche Länge im Angebot.
Warnzeichen für falsche Antworten
Diese fünf Zeichen sollten dich stutzig machen. Dann prüfst du besonders genau.
1. Eine Zahl ohne Quelle, oder die Quelle sagt es gar nicht
Eine Zahl ohne Beleg ist verdächtig. Aber auch eine Quellenangabe hilft nur, wenn die Quelle die Aussage wirklich enthält. In einer Studie der Europäischen Rundfunkunion und der BBC hatten 31 % der geprüften Antworten erhebliche Probleme mit ihren Quellen. Getestet wurden die kostenlosen Versionen von ChatGPT, Copilot, Gemini und Perplexity (EBU/BBC, veröffentlicht am 21.10.2025).
2. Keine Rückfrage, kein Zögern
Du hast eine unklare Frage gestellt, und die KI antwortet trotzdem glatt und sicher. Das ist ein Warnzeichen. OpenAI schreibt selbst, dass Training und Tests der Sprachmodelle das Raten belohnen und nicht das Eingeständnis von Unsicherheit (OpenAI, 05.09.2025). In einem Test des Tow Center sollte ChatGPT Nachrichtenartikel ihrer Quelle zuordnen. Es lag in 134 von 200 Fällen falsch. Unsicherheit zeigte es nur 15-mal (Tow Center, 06.03.2025).
3. Im neuen Chat kommt etwas anderes heraus
Stell dieselbe Frage in einem neuen Chat. Kommt eine andere Antwort, ist mindestens eine davon falsch. Laut OpenAI gab ein Chatbot auf die Frage nach einem Geburtstag drei verschiedene falsche Daten. Forscher nutzen genau solche schwankenden Antworten, um Erfindungen zu erkennen (Farquhar u. a., Nature 2024).
4. Verdächtig genaue Details
Aktenzeichen, Paragrafen, Datum, Seitenzahl, eine Prozentzahl mit Komma: Solche Einzelheiten wirken glaubwürdig. Gerade seltene Einzelfakten erfindet die KI aber leicht. Vor Gericht sind schon Schriftsätze mit erfundenen Fundstellen aufgefallen, zum Beispiel beim Amtsgericht Köln (Beschluss vom 02.07.2025, 312 F 130/25) und in den USA im Fall Mata gegen Avianca (22.06.2023). Die erfundenen Angaben hatten genaue Fundstellen.
5. Die KI gibt dir auffällig recht
Stimmt die KI allem zu, was du sagst, sei vorsichtig. OpenAI hat im April 2025 ein Update von ChatGPT zurückgenommen, weil es übertrieben zustimmte und schmeichelte (OpenAI, 29.04.2025).
Faustregel
Bei Recht, Steuern, Geld und Gesundheit prüfst du immer das Original. Hier sind Fehler am teuersten.
Prüfkarte
Die Prüfkarte ist eine Übung vom KI-Abend des Unternehmen 16356 e.V. am 30.09.2026. Du kannst sie genauso allein oder im Team machen. Alle Daten auf der Karte sind erfunden.
Das Beispiel stammt aus einem Heizungs- und Sanitärbetrieb. Auf der Karte stehen drei Kästen:
- Aus den Kundenmails: Frau Musterfrau möchte eine Dusche statt der Wanne und bittet um Rückmeldung bis Mittwoch 12 Uhr. Eine Hausverwaltung möchte für zwei Objekte je ein Wartungspaket Gewerbe und je ein Dokumentationspaket. Sie schreibt, ein Kollege habe 10 % Nachlass zugesagt.
- Aus der Preisliste 2026: Wartungspaket Gewerbe 780 € je Objekt, Dokumentationspaket 120 € je Objekt, Anfahrt 45 € je Einsatz und Objekt. Nachlass nur mit Freigabe, derzeit keiner freigegeben.
- KI-Ergebnis: eine Frist für Frau Musterfrau und ein Angebot für die Hausverwaltung.
Im KI-Ergebnis stecken genau zwei Fehler. Lade dir die Prüfkarte als PDF herunter und such die Fehler, bevor du weiterliest. Wenn du hängst: Ein Fehler steckt in einer Frist, einer in einem Preis.
Auflösung: Erstens nennt die KI als Frist „Rückmeldung bis Freitag“. In der Mail steht Mittwoch 12 Uhr. Wer sich auf Freitag verlässt, ist zwei Tage zu spät. Zweitens rechnet die KI das Dokumentationspaket mit 95 € je Objekt. Das ist der Preis aus der alten Preisliste 2025. Richtig sind 120 € je Objekt, also 240 € statt 190 €. Die Summe netto ist damit 1.890 € und nicht 1.840 €. Wer „die Summe stimmt nicht“ gefunden hat, hat denselben Fehler gefunden. Der Rest stimmt: Wartungspaket 2 × 780 € = 1.560 €, Anfahrt 2 × 45 € = 90 €, und der Nachlass ist richtig als unbestätigt markiert und nicht eingerechnet. Beide Fehler findest du nur, wenn du die Quelle danebenlegst. Die KI schreibt sauber und sicher, auch wenn sie danebenliegt.
Weiter geht es mit den Prompts zum Prüfen und den Arbeitsanweisungen. Wenn du gerade erst anfängst, lies Erste Schritte.