Start/Blog/QUELLEN
QUELLEN

585 Websites entscheiden mit, was die KI über Ihre Marke sagt

Eine KI-Kaufempfehlung entsteht nicht aus dem Nichts. Sie destilliert aus Quellen. Im Analysefall waren das 5.387 Belege aus 585 verschiedenen Websites, und die Verteilung ist alles andere als gleichmäßig.

Felix Zeh·19. August 2026·6 Min. Lesezeit·KI-unterstützt erstellt
25%50%75%100%EIGENE HERSTELLERDOMAIN23,0 %REDDIT13,7 %583 WEITERE DOMAINS63,3 %
Das nehmen Sie aus diesem Artikel mit
  • Wie viele und welche Quellen hinter einer KI-Antwort stehen
  • Warum wenige Domains einen unverhältnismäßig großen Teil tragen
  • Wie Sie die Quellen finden, die für Ihre Kategorie wirklich zählen
  • Was Sie mit dieser Liste konkret anfangen können
585verschiedene Domains
5.387einzelne Quellenangaben
33Belege pro Antwort im Schnitt
23,0%Anteil der stärksten Einzelquelle

Es gibt eine verbreitete Vorstellung, KI-Antworten entstünden aus einer Art diffusem Sprachwissen. Bei Systemen mit Websuche stimmt das nicht. Sie rufen Seiten ab, lesen sie und bauen daraus eine Antwort. Wer auf diesen Seiten vorkommt, prägt das Ergebnis mit.

Wie viele Quellen stecken in einer Antwort?

Über 162 ausgewertete Antworten einer Erhebung zählten wir 5.387 einzelne Quellenangaben, verteilt auf 585 verschiedene Domains. Das sind im Schnitt gut 33 Belege pro Antwort.

Diese Zahl überrascht die meisten. Eine KI-Antwort, die aus fünf Absätzen besteht, kann auf mehrere Dutzend Seiten zurückgreifen. Ein Argument dafür, warum das Ranking auf Position eins an Bedeutung verliert: Die KI liest nicht das erste Ergebnis, sie liest viele.

Welche Arten von Quellen gibt es?

585 Domains sind roh nicht auswertbar. Wir sortieren sie deshalb in Kategorien, und zwar für alle Marken und alle Erhebungen nach demselben Schema:

Erst diese Sortierung macht die interessante Frage beantwortbar: In welcher Kategorie kommt meine Marke gar nicht vor? Denn das ist ein unbesetzter Kanal, in dem Meinung über die eigene Kategorie entsteht, ohne dass man beteiligt ist.

Wie ungleich ist die Verteilung?

Sehr. Die Herstellerdomain der untersuchten Marke war mit 23,0 Prozent aller Quellenangaben die meistzitierte Einzelquelle, Reddit folgte mit 13,7 Prozent. Zwei Domains decken also mehr als ein Drittel aller Belege ab, während sich die restlichen 583 den Rest teilen.

Das ist praktisch eine gute Nachricht. Sie müssen nicht 585 Websites bespielen. Sie müssen die zwanzig kennen, die den größten Teil tragen, und dort präsent oder zumindest korrekt dargestellt sein.

Warum Quellenlisten schnell veralten

Ein Punkt, den wir uns selbst als Regel gesetzt haben: Jede Prozentangabe zu Quellen bekommt ein Erhebungsdatum, und vor jedem neuen Projekt wird nachgeprüft statt übernommen.

Der Grund ist, dass die Quellenmischung an Lizenz- und Rechtsverhältnissen zwischen Plattformen hängt, nicht nur an inhaltlicher Relevanz. Nach der Klage von Reddit gegen Perplexity im Oktober 2025 brachen die Reddit-Zitate dort deutlich ein. Wer mit einer älteren Zahl aus einer Studie arbeitet, plant an der Realität vorbei.

Daraus folgt auch: Keine Drittquellenstrategie sollte auf einer einzelnen Plattform ruhen. Eine Vertragsänderung kann diesen Kanal über Nacht schließen.

So erstellen Sie Ihre eigene Quellenkarte

  1. Fragen stellen und Quellen mitschreiben

    Zwanzig kategorietypische Fragen ohne Markennamen, jede in einem frischen Chat, und zu jeder Antwort alle angegebenen Quellen notieren. Das ist Fleißarbeit und liefert die Datengrundlage, um die es hier geht.

  2. Domains normalisieren

    Alles auf Kleinschreibung, www-Präfix und Pfade entfernen. Sonst zählen Sie dieselbe Website mehrfach und verzerren die Verteilung.

  3. Nach Kategorie sortieren

    Mit dem oben genannten Schema oder einem eigenen. Wichtig ist nur, dass Sie es konsequent gleich anwenden, auch bei der nächsten Messung.

  4. Nach Häufigkeit sortieren und bei zwanzig abschneiden

    Quellen, die nur ein- oder zweimal auftauchen, sind Einzelfälle ohne Aussagekraft. Die Top zwanzig sind Ihre Arbeitsliste.

  5. Je Quelle prüfen, wie Sie dort dargestellt werden

    Kommen Sie vor? Korrekt? Aktuell? Oder stehen dort nur Wettbewerber? Besonders aufschlussreich sind Quellen, die regelmäßig neben Wettbewerbern auftauchen und nie neben Ihnen.

  6. Nach Beeinflussbarkeit priorisieren

    Die eigene Website haben Sie in der Hand. Fachpresse und Verbände sind über klassische PR erreichbar. Foren und Communities brauchen echte Beteiligung über Monate. Testportale erreichen Sie über gute Produkte und Testteilnahme.

Was diese Liste nicht ist

Sie ist keine Anleitung zum Platzieren von Erwähnungen. Wer versucht, in Foren gekaufte Empfehlungen zu streuen, riskiert nicht nur den Rauswurf, sondern auch rechtliche Probleme wegen Schleichwerbung.

Der Wert der Liste liegt darin, zu wissen, wo über Ihre Kategorie gesprochen wird und ob das, was dort steht, überhaupt stimmt. Eine veraltete Produktangabe auf einem stark zitierten Fachportal richtet mehr Schaden an als zehn fehlende Erwähnungen.

Häufige Fragen

Kann ich beeinflussen, welche Quellen die KI heranzieht?

Nur indirekt. Sie können dafür sorgen, dass Ihre eigenen Inhalte zitierfähig sind, dass Fachmedien und Verbände korrekt über Sie berichten und dass Sachfehler in stark zitierten Quellen korrigiert werden. Die Auswahl selbst trifft das System.

Sind Foren wirklich so wichtig, wie oft behauptet wird?

Sie sind ein erheblicher Teil der Quellen, in unserer Messung war Reddit die zweitstärkste Einzelquelle. Wichtig ist die Einschränkung: Diese Anteile schwanken stark zwischen Plattformen und über die Zeit, unter anderem aus rechtlichen Gründen. Eine Strategie, die nur auf Foren setzt, ist deshalb riskant.

Wie gehe ich mit falschen Angaben in fremden Quellen um?

Zuerst dokumentieren: welche Quelle, welche Aussage, wie oft zitiert. Dann den Betreiber kontaktieren, sachlich und mit Beleg. Parallel die korrekte Information auf der eigenen Domain klar und zitierfähig bereitstellen, damit es eine belastbare Gegenquelle gibt.

Lohnt sich Wikipedia-Arbeit für die KI-Sichtbarkeit?

Wikipedia ist in vielen Auswertungen eine stark zitierte Quelle, gerade bei ChatGPT. Wichtig ist der Hinweis, dass Sie dort nicht selbst über sich schreiben sollten, das verstößt gegen die Richtlinien und fliegt zuverlässig auf. Der legitime Weg führt über belastbare Belege in unabhängigen Medien, auf die sich ein Artikel dann stützen kann.

So wurde gemessen

585 eindeutige Domains, normalisiert auf Kleinschreibung ohne www-Präfix, klassifiziert nach einer festen Kategorie-Systematik, die in allen Erhebungen identisch angewandt wurde. Grundlage: 5.387 Quellenangaben aus 162 KI-Antworten, Erhebung 26.07.2026 mit gpt-5.6-terra. Gezählt werden Quellenangaben, nicht Antworten; eine Domain kann in derselben Antwort mehrfach vorkommen.

Transparenzhinweis · KI-generierter Inhalt

Hinweis zu diesem Beitrag: Recherche, Auswertung und Text wurden mit Unterstützung von KI-Systemen erstellt (Ex Tenebris Agenten-Team) und von Felix Zeh redaktionell geprüft. Alle genannten Zahlen stammen aus einer echten LUX-/GEO-Analyse; die analysierte Marke ist zum Schutz der Kundenbeziehung anonymisiert.

FZ
Felix Zeh
Gründer Ex Tenebris · Stuttgart

Arbeitet seit über zehn Jahren an der Schnittstelle von Marketing, Daten und Analytik und misst mit LUX, wie Marken in den Antworten von ChatGPT, Claude, Gemini und Perplexity vorkommen. Fragen oder Widerspruch zu diesem Artikel? kontakt@extenebris.de

Kontakt

Wie sichtbar ist Ihre Marke heute in der KI-Antwort?

Die Methodik hinter diesem Artikel ist dieselbe, die wir für jede Standortbestimmung einsetzen — auf Ihre Kategorie, Ihre Wettbewerber, Ihre Bedarfsgruppen zugeschnitten.