KI-Suchmaschinen können sicher klingen, während sie tote oder minderwertige Quellen zitieren – ein kurzer Test zeigt dies
Eine einfache Überprüfung der Herkunft bei drei populären KI-gestützten Suchwerkzeugen ergab, dass zwei von ihnen entweder auf tote Links verwiesen oder ihre Antworten mit Quellen geringer Glaubwürdigkeit untermauerten, obwohl alle drei denselben selbstbewussten Schreibstil und eine Reihe von Quellen-„Chips“ anzeigten.
Der Test, der die Überraschung auslöste
Ich stellte eine sachliche, aktuelle Frage: „Was hat sich 2026 im EU AI Act geändert?“ Die Antwort steht im offiziellen Änderungstext, sie ist also entweder vorhanden oder nicht. Ich gab die Anfrage an drei KI-Suchmaschinen weiter, die Zitate ausgeben: Perplexity, Googles KI-Modus und Brave Search.
Alle drei lieferten identische Fakten – dieselben Daten, dieselbe Beschreibung – sie lagen also in Bezug auf die reine Korrektheit gleichauf. Die Abweichungen zeigten sich erst, als ich die zitierten Quellen untersuchte.
Wie ich die Quellenqualität beurteilte
Ich habe ein dreistufiges Bewertungsschema erstellt, das jede Zitation nach dem Typ des Hosts gewichtet:
- Primär (Gewichtung 3) – die Website, die das Gesetz tatsächlich veröffentlicht (z. B. das offizielle EU-Register).
- Offiziell (Gewichtung 2) – die Institution, die das Gesetz erlässt oder beaufsichtigt (Regierungsdomänen, Behördenseiten).
- Nutzergenerierte Inhalte (UGC, Gewichtung 0) – Plattformen wie YouTube oder Reddit.
Der Gesamtwert jeder Suchmaschine ist das Durchschnittsgewicht der von ihr angezeigten URLs.
| Suchmaschine | Angegebene Quellen | Score |
|---|---|---|
| Perplexity | Offizielle Regierungsdomänen | 2.00 |
| Google KI-Modus | Beratungsunternehmen und ein YouTube-Video | 1.00 |
| Brave Search | Primärquelle | 3.00 |
Auf dem Papier sah Brave perfekt aus, Perplexity war ordentlich und Google blieb zurück.
Das versteckte Versagen: tote Links
Die Klassifizierung betrachtet nur den Domainnamen; sie prüft nicht, ob die verlinkte Seite tatsächlich lädt. Ich bin jedem URL gefolgt. Die „primäre“ Zitation von Brave lieferte einen leeren Inhalt – der Link war tot. Die Suchmaschine behauptete, auf das Gesetz zu verweisen, lieferte aber nichts.
Perplexity nutzte offizielle Regierungsdomänen.
Google nutzte Beratungsunternehmen und ein YouTube-Video.
Zwei deutliche Probleme traten auf:
- Eine hochwertige Domain garantiert keine erreichbare Seite.
- Eine gut formulierte Zusammenfassung kann durch Quellen mit geringer Glaubwürdigkeit gestützt werden.
Die Benutzeroberfläche verbirgt beide Probleme. Alle drei Tools präsentieren denselben selbstbewussten Absatz und eine einheitliche Reihe von Quellen-Chips, ohne jeglichen visuellen Hinweis darauf, dass ein Chip zu einer toten Seite führt oder ein anderer auf ein YouTube-Tutorial statt auf den Gesetzestext verweist.
Warum die Herkunft für Entwickler wichtig ist
Entwickler können die Herkunft in eine testbare Metrik umwandeln:
- Bewerten Sie jede Antwort mithilfe einer abgestuften Gewichtung, ähnlich der oben genannten.
- Validieren Sie die Link-Integrität automatisch; markieren Sie leere Antworten oder HTTP-Fehler.
- Lösen Sie Warnmeldungen aus, wenn der Herkunftswert einer Antwort unter einen konfigurierbaren Schwellenwert fällt.
Dieser Ansatz ist konkreter, als „Halluzinationen“ zu jagen – das Modell mag einen plausiblen Satz generieren, aber die Überprüfung der Herkunft sagt Ihnen genau, welche Zitation (oder deren Fehlen) das Problem verursacht hat, was eine gezielte Behebung ermöglicht.
Fazit
Ein kurzer Herkunftstest zeigt, dass KI-Suchmaschinen autoritär erscheinen können, während sie tote oder minderwertige Quellen zitieren. Entwickler, die sich auf diese Suchmaschinen verlassen, sollten die Qualität der Zitate als messbare Eigenschaft und nicht als vorausgesetzte Garantie behandeln und automatisierte Prüfungen in ihre Pipelines integrieren. Die Verifizierung, dass eine „primäre“ Quelle tatsächlich lädt, kann der Unterschied zwischen einer vertrauenswürdigen Antwort und einer lautlosen Fehlinformationsfalle sein.
