Zitierte Seiten in ChatGPT: 59,6 % der Zitationen sind für Marketer unerreichbar

Porträt von Louise Linehan

Nach Autor Louise Linehan

Content Marketer bei Ahrefs

September 28, 202614 Min. Lesezeit

Die drei meistzitierten Quellen von ChatGPT in Deutschland sind adac.de, verbraucherzentrale.de und gesetze-im-internet.de. An keine davon kommst du als klassischer Marketer heran.

Wir haben die 1.000 meistzitierten Seiten für Deutschland ausgewertet, der Snapshot ist vom 21. September 2026 aus dem Ahrefs Brand Radar. Jede Seite haben wir danach eingeordnet, ob ein Unternehmen sie überhaupt beeinflussen kann.

566 der 1.000 Seiten liegen außer Reichweite. Auf sie entfallen 59,6 % aller Zitationen.

Nur 267 Seiten liegen auf Websites, die du selbst kontrollierst. Es sind Preislisten, Modellübersichten und Serviceseiten.

Die 1.000 meistzitierten Seiten nach Zugänglichkeit. Klasse D sind Staat, Recht, Wissenschaft und unabhängige Prüfinstitute.

1. 566 der 1.000 meistzitierten Seiten sind außer Reichweite

Wir haben jede der 1.000 Seiten einer von fünf Klassen zugeordnet. Entscheidend war dabei eine Frage: Ist dieser Seitentyp für Marketingarbeit grundsätzlich zugänglich? Ob eine bestimmte Marke die Seite besetzen kann, spielt für die Einordnung keine Rolle.

Unerreichbar heißt in dieser Auswertung: Gesetzestexte, Behördenangebote, Forschungsdatenbanken, wissenschaftliche Fachgesellschaften und unabhängige Prüforganisationen. Dazu zählen Stiftung Warentest und ÖKO-TEST, aber auch der ADAC und Finanztip. Sie alle erstellen ihre Tests und Ratgeber selbst und vergeben dort keine Platzierungen.

Auf diese Gruppe entfallen 59,6 % der Zitationen.

An der Spitze der Liste wird das Bild noch deutlicher. Die neun meistzitierten Domains gehören ausnahmslos in diese Gruppe. Platz 10 steht zum Vergleich mit in der Tabelle.

#
Domain
Seiten in den Top 1.000
Anteil an allen Zitationen
1
adac.de
87
9,43 %
2
verbraucherzentrale.de
85
8,72 %
3
gesetze-im-internet.de
42
6,17 %
4
test.de
57
5,42 %
5
gesund.bund.de
40
4,03 %
6
dge.de
26
3,71 %
7
bfr.bund.de
22
2,42 %
8
finanztip.de
24
2,41 %
9
kindergesundheit-info.de
16
2,21 %
10
faz.net
24
1,94 %

Diese neun Domains kommen zusammen auf 44,5 % aller Zitationen der Top 1.000.

Erst auf Platz 10 steht mit faz.net die erste Domain, an die du über Pressearbeit überhaupt herankommst.

Die neun meistzitierten Domains gehören alle zur Klasse D. Die erste über Pressearbeit erreichbare Domain steht auf Platz 10.

Randbemerkung


Die Zahlen beschreiben einen Snapshot vom 21. September 2026, keinen Zeitraum. Dahinter liegt ein gleitendes Fenster, dessen Länge nicht dokumentiert ist. Belastbar sind die Reihenfolge und die Anteile innerhalb desselben Snapshots.

2. Nur 267 der 1.000 Seiten kannst du mit eigenem Content besetzen

Zwei Klassen reichen für die Praxis nicht. Deshalb haben wir feiner getrennt.

Klasse
Was darunter fällt
Seiten
Anteil Zitationen
Eigene Fläche
Websites von Unternehmen über die eigenen Angelegenheiten
267
24,7 %
Wikipedia
Wikimedia-Projekte
13
1,2 %
Offene Plattform
Reddit, Idealo, Trustpilot, Marktplätze, Bewertungsportale
21
2,3 %
Redaktionelle Fläche
Medien, die Pressearbeit und Expertenzitate annehmen
132
12,0 %
Unerreichbar
Staat, Recht, Wissenschaft, Prüfinstitutionen
566
59,6 %
Nicht klassifizierbar
1 technische Domain
1
0,1 %

Jede Klasse hat einen anderen Hebel. Auf deiner eigenen Website entscheidest du selbst, was dort steht. Bei offenen Plattformen legst du ein Profil an oder pflegst Bewertungen. Ein Fachmedium nimmt deine Studie auf oder lässt es bleiben. Das entscheidest nicht du.

Behörden und Prüforganisationen bieten gar keinen Hebel. In einen Gesetzestext kommst du nicht hinein, und in einen Warentest nur über ein besseres Produkt.

Zieh die eigene Fläche ab, und es bleiben 733 Seiten übrig, die du nicht mit eigenem Content besetzen kannst. Das sind 75,3 % der Zitationen.

Randbemerkung


Wir weichen hier von unserer englischsprachigen Auswertung vom Oktober 2025 ab. Dort zählen Startseiten von Unternehmen gemeinsam mit Wikipedia und App-Store-Seiten als „dead citations“. Für den Betreiber selbst ist die eigene Startseite allerdings die am besten beeinflussbare Seite überhaupt. Sie fällt bei uns deshalb in die Klasse „eigene Fläche“. Ein direkter Zahlenvergleich zwischen beiden Studien funktioniert daher nur eingeschränkt.

3. 17 % der meistzitierten Seiten haben keine organische Sichtbarkeit

170 der 1.000 Seiten haben keinen einzigen geschätzten Besucher aus der organischen Suche. Das sind 17,0 %. Auf diese 170 Seiten entfallen 17,5 % aller Zitationen.

Die Hälfte der Seiten kommt auf weniger als 513 geschätzte Besuche im Monat. 337 Seiten liegen unter 100.

Suchsichtbarkeit und Zitierbarkeit sind also zwei verschiedene Dinge.

Drei Beispiele aus dem Datensatz:

Die Seite „Sicher schlafen“ auf kindergesundheit-info.de wird in 220 KI-Antworten zitiert. Sie hat laut unserer Daten keinen nennenswerten organischen Traffic.

Die FAQ zu Nahrungsergänzungsmitteln der Deutschen Gesellschaft für Ernährung kommt auf 170 Zitationen, ebenfalls ohne nennenswerten Suchtraffic.

Und dann ist da ein PDF. Auf ifkom.de liegt eine Abkürzungsliste als Datei. Domain Rating 27, kaum organischer Traffic, 168 Zitationen.

Woran liegt das? Die Daten selbst geben darauf keine Antwort. Naheliegend sind sehr spitze Themen ohne nennenswerte Suchnachfrage und eine Auswahllogik, die anders funktioniert als die klassische Suche. Das ist unsere Deutung, kein Messergebnis.

Dass eine Seite bei Google unsichtbar ist, sagt also nichts darüber, ob ChatGPT sie zitiert. 105 der 170 Seiten ohne Sichtbarkeit sind Behörden- und Institutionsangebote.

Eine Voraussetzung gilt allerdings für beide Richtungen. Ob deine Seite für KI-Crawler überhaupt erreichbar ist, entscheidest du in der robots.txt. Wie verbreitet Sperren im DACH-Raum sind, haben wir in einer eigenen Auswertung untersucht.

4. Behörden und Gesetze ziehen jede vierte Zitation

223 der 1.000 meistzitierten Seiten gehören staatlichen Stellen, Behörden oder öffentlichen Forschungseinrichtungen. Auf sie entfallen 24,0 % der Zitationen.

45 davon sind reine Gesetzes- und Verordnungstexte.

Die stärksten Einzelquellen:

Domain
Seiten in den Top 1.000
gesetze-im-internet.de
42
gesund.bund.de
40
bfr.bund.de
22
kindergesundheit-info.de
16
umweltbundesamt.de
13
bundesgesundheitsministerium.de
9

Auffällig ist der Anteil ausländischer Behörden in einer deutschen Auswertung. In der Liste stehen pubmed.ncbi.nlm.nih.gov, pmc.ncbi.nlm.nih.gov, nccih.nih.gov, ods.od.nih.gov, who.int, cdc.gov, fda.gov und nhs.uk.

Das Muster betrifft vor allem Gesundheit, Recht und Finanzen. Bei diesen Themen zitiert ChatGPT in Deutschland überwiegend amtliche und wissenschaftliche Quellen. Deine realistische Fläche liegt dort, wo keine Behörde zuständig ist: bei konkreten Produkt-, Preis- und Verfahrensfragen aus deinem eigenen Angebot. Wie sich das von Googles AI Overviews unterscheidet, zeigt unser Quellenvergleich beider Systeme.

Wer in einem dieser Felder arbeitet, konkurriert in ChatGPT mit dem Bundesinstitut für Risikobewertung.

5. Zitierte Seiten mit Suchtraffic haben im Median DR 88

Die zitierten Seiten stammen überwiegend von starken Domains.

Der Median des Domain Rating liegt bei 88. 70,7 % der Seiten haben DR 81 oder höher. Nur 5,5 % liegen unter DR 60.

Auf Seitenebene sieht es anders aus. Der Median des URL Rating liegt bei 7. Die Domains sind also stark, die einzelnen Seiten darauf sind es nicht. ChatGPT greift innerhalb einer starken Domain auch zu Seiten, auf die kaum jemand verlinkt.

Bei den Seiten mit organischem Traffic bleibt der Median des Domain Rating ebenfalls bei 88.

Ein hoher DR ist trotzdem keine Bedingung. Im Datensatz stehen Seiten wie:

Seite
DR
Zitationen
netzwerk-rauchen.de, Tabakwerte Zigaretten 2026
20
129
ifkom.de, Abkürzungsliste als PDF
27
168
tathood.com, Was kostet ein Tattoo
27
72
masstisch.de, Optimale Sitzbank-Höhe nach DIN-Norm
28
42

Alle vier beantworten eine eng umrissene Frage mit einer konkreten Angabe.

6. ChatGPT zitiert in Deutschland alte Seiten, die gepflegt werden

Für 790 der 1.000 Seiten konnten wir ein Veröffentlichungsdatum ermitteln. Das sind 79 %.

Der Median der Erstveröffentlichung liegt beim 28. Februar 2022.

Nur 28,6 % der datierten Seiten wurden in den letzten zwei Jahren erstveröffentlicht. In den letzten zwölf Monaten waren es 16,2 %.

Der Datensatz enthält ein zweites Datum: den jüngsten Stand, der im Inhalt selbst auftaucht. Damit dreht sich das Bild.

Zeitraum
erstveröffentlicht
Inhaltsdatum
letzte 12 Monate
16,2 %
36,7 %
letzte 2 Jahre
28,6 %
50,9 %
letzte 5 Jahre
53,5 %
69,1 %

238 Seiten tragen ein Inhaltsdatum, das jünger ist als ihre Erstveröffentlichung. Das entspricht 30,1 % der datierten Seiten.

137 Seiten sind älter als drei Jahre und tragen trotzdem ein Inhaltsdatum aus den letzten zwölf Monaten.

Vier Beispiele:

Seite
veröffentlicht
Inhaltsdatum
test.de, Matratzen im Test
12. Oktober 2013
19. August 2026
test.de, Staubsauger im Test
28. April 2014
25. August 2026
test.de, Wäschetrockner im Test
28. August 2014
8. September 2026
adac.de, Motorradführerschein
17. Februar 2018
15. Mai 2026

Für dich heißt das: Pflege deine bestehenden Seiten, bevor du neue produzierst. 30,1 % der datierten Seiten in diesem Datensatz tragen ein Inhaltsdatum, das jünger ist als ihre Erstveröffentlichung.

Der Abstand zwischen blauem und grünem Balken ist der gepflegte Bestand: alte Seiten mit jungem Inhaltsdatum.

7. Was das für dich heißt

Setz auf nachprüfbare Fakten über dein eigenes Angebot

Schau dir an, welche Unternehmensseiten es in die Top 1.000 geschafft haben:

Seite
Zitationen
dhl.de, Preise und Produkte für den nationalen Versand
163
mercedes-benz.de, Konfigurator und Preise
148
dm.de, Fotoservice im Markt
118
dazn.com, Pläne und Preise
96
ber.berlin-airport.de, aktuelle Reiseziele
91
dyson.de, Modelle im Vergleich
90
bmw.de, alle Modelle entdecken
84

Unter diesen sieben ist kein Blogartikel. Es sind Preislisten, Modellübersichten und Serviceseiten.

Das Muster hält auch über alle 267 Seiten der eigenen Fläche. Nur 23 davon liegen auf einem Blog-, Magazin- oder Ratgeberpfad, also 8,6 %. Die übrigen 244 sind Produkt-, Service- und Übersichtsseiten.

Alle sieben machen eine nachprüfbare Angabe über das eigene Angebot. Was kostet der Versand? Welche Modelle gibt es?

Die höchsten Zitationsraten haben Frage-Antwort-Seiten

Ahrefs Brand Radar unterscheidet zwei Werte. „Gefunden in“ zählt jede KI-Antwort, in der eine Seite auftaucht, auch wenn sie nur im Hintergrund abgerufen wurde. „Zitiert in“ zählt die Antworten mit echter Quellenangabe.

Der Quotient aus beiden ist die Zitationsrate. Die mediane Zitationsrate über alle 1.000 Seiten liegt bei 54,7 %.

Die höchsten Einzelwerte im Datensatz erreichen Frage-Antwort-Formate:

Seite
Zitationsrate
bfr.bund.de, Ätherische Öle, Fragen und Antworten
84,2 %
wunschgutschein.de, Hilfe und Kontakt
83,1 %
vabali.de, FAQ
82,6 %
samsung.com, Unterschied zwischen Galaxy S26 Ultra und Vorgängern
76,1 %

Als Gruppe betrachtet fällt der Vorsprung allerdings klein aus. 113 Seiten im Datensatz tragen FAQ-, Hilfe- oder Service-Merkmale. Ihre mediane Zitationsrate liegt bei 56,7 %, gegenüber 54,3 % bei allen übrigen Seiten. Das sind gut zwei Prozentpunkte, kein Hebel, der allein etwas bewegt.

Der Wert einer FAQ-Seite liegt woanders. Sie ist eine der wenigen Flächen, die du vollständig kontrollierst.

Randbemerkung


Eine Erwartung haben die Daten nicht bestätigt. Wir hatten vermutet, dass gut zugängliche Seiten zuverlässiger zitiert werden. Über die fünf Klassen hinweg liegt die Zitationsrate aber fast gleichauf, zwischen 53,6 % und 58,3 %. Wie zugänglich eine Fläche ist, sagt nichts darüber, wie oft ChatGPT sie nennt, wenn es sie abgerufen hat.

Social Media wird gelesen und fast nie genannt

Der auffälligste Befund steht in der Domainauswertung. Diese Werte zählen auf Domainebene, nicht auf Seitenebene, und stammen aus einer zweiten Erhebung über die 1.000 meistzitierten deutschen Domains.

Domain
Gefunden in
Zitiert in
Zitationsrate
facebook.com
3.521
203
5,8 %
instagram.com
3.335
240
7,2 %
youtube.com
8.855
1.238
14,0 %
gutefrage.net
4.859
929
19,1 %
linkedin.com
3.307
863
26,1 %
de.linkedin.com
4.978
1.567
31,5 %
reddit.com
21.061
9.079
43,1 %

Die mediane Zitationsrate über alle 1.000 deutschen Domains liegt bei 50,1 %.

Facebook wird in 3.521 KI-Antworten abgerufen und in 203 davon als Quelle genannt.

Reddit kommt als einzige Community-Plattform in die Nähe des Medians und bleibt trotzdem darunter.

Dasselbe Muster gilt in Österreich und der Schweiz. Facebook kommt dort auf 2,9 % und 3,4 %, Instagram auf 3,2 % und 2,4 %, YouTube auf 8,2 % und 8,0 %.

Der blaue Teil ist der Anteil der Abrufe, die zu einer Nennung führen. Der helle Rest wird gelesen und nicht genannt.

Für deine Arbeit heißt das: Reichweite auf Social Media ist kein Weg in ChatGPT-Antworten. Die Plattformen fehlen in den Zitationen nicht, weil ChatGPT sie nicht liest. Sie fehlen, weil es sie liest und nicht nennt.

Eine Sache sagen diese Daten nicht. Wie wahrscheinlich es ist, dass eine einzelne Maßnahme wirkt, geht aus ihnen nicht hervor. Sie zeigen nur, welche Flächen überhaupt offenstehen.

Randbemerkung


So prüfst du deine eigene Domain

Die Zahlen oben sind Durchschnittswerte. Für deine Entscheidung zählt, wie ChatGPT mit deinen Seiten umgeht. Das siehst du in vier Schritten:

  1. Öffne den Brand Radar und stell das Land auf Deutschland.
  2. Setz den Plattformfilter auf ChatGPT.
  3. Öffne den Bericht „Zitierte Seiten“ und filter auf deine eigene Domain.
  4. Vergleich die Spalten „Gefunden in“ und „Zitiert in“.
So sieht das für dhl.de aus. Die orangen Rahmen markieren oben die Einstellung für Land und Plattform, darunter den Filter auf die eigene Domain. 334 Seiten der Domain tauchen in ChatGPT-Antworten auf.
Der orange Rahmen markiert die beiden Spalten, auf die es ankommt. Die Preisseite wird in 339 Antworten gefunden und in 163 zitiert. Das sind 48,1 %.

Der letzte Schritt ist der wichtigste. Liegt deine Zitationsrate deutlich unter 54,7 %, wird deine Seite abgerufen und selten genannt. Prüf dann, ob die Seite eine Aussage enthält, die für sich allein stehen kann.

Taucht deine Domain gar nicht auf, dreh die Frage um. Schau nach, welche Seiten in deiner Nische zitiert werden, und prüf, welche dieser Flächen dir offensteht. Mit Prompt-Tracking siehst du zusätzlich, welche Fragen deine Marke überhaupt auslösen.

Wenn du in Österreich oder der Schweiz sitzt

Dann gilt für dich noch etwas anderes. Wir haben dieselbe Auswertung auf Domainebene für beide Länder gezogen, mit demselben Snapshot.

In der Schweiz stammen nur 18,6 % der Zitationen der Top 50 von Schweizer Domains. Deutsche Quellen kommen dort auf 22,5 %. In Österreich stehen 29,4 % heimische Quellen 25,5 % deutschen gegenüber. Zum Vergleich: In Deutschland liegt der Anteil eigener Quellen bei 56,0 %.

Das erste rein österreichische Angebot steht an achter Stelle, das erste schweizerische an zwölfter. Davor stehen jedes Mal Wikipedia, Duden, der ADAC, Stiftung Warentest und die FAZ.

In der Schweiz stehen deutsche Quellen damit vor den schweizerischen. In Österreich liegen die heimischen knapp vorn, aber jede vierte Zitation geht trotzdem nach Deutschland.

Was bleibt

Drei Viertel der Zitationen in Deutschland liegen auf Flächen, die du nicht mit eigenem Content besetzen kannst. Das ist die schlechte Nachricht.

Die gute steckt in den 267 Seiten, die es trotzdem geschafft haben. Es sind Preislisten, Modellübersichten und FAQ-Seiten. Das sind genau die Inhalte, die in vielen Unternehmen seit Jahren unbearbeitet herumliegen.

Fang dort an, bevor du den nächsten Ratgeber schreibst.

8. Methodik

Alle Zahlen in diesem Artikel stammen aus einer eigenen Auswertung mit dem Ahrefs Brand Radar.

Datenbasis. Bericht „Zitierte Seiten“, Land Deutschland, Modell ChatGPT, ohne Marken- und sonstige Filter. Snapshot vom 21. September 2026. Die Grundgesamtheit umfasst an diesem Tag 3.698.476 zitierte Seiten. Ausgewertet haben wir die 1.000 meistzitierten davon, also 0,027 % der Grundgesamtheit. Sie verteilen sich auf 306 Domains.

Zweite Erhebung auf Domainebene. Für den Abschnitt zur Zitationsrate und für den Vergleich mit Österreich und der Schweiz haben wir zusätzlich die 1.000 meistzitierten Domains je Land ausgewertet, gleicher Snapshot, gleiche Methode. Diese Auswertung zählt auf Domainebene. Ihre Werte lassen sich nicht mit den Seitenwerten verrechnen.

Zwei Kennzahlen. „Gefunden in“ ist die Anzahl der KI-Antworten, in denen eine Seite erschienen ist, entweder als Quelle zitiert oder nur im Hintergrund abgerufen. „Zitiert in“ ist die Anzahl der Antworten, in denen sie als Quelle zitiert wurde. Wenn wir von Zitationen sprechen, meinen wir den zweiten Wert.

Auswahl der 1.000 Seiten. Die Schnittstelle sortiert nach Vorkommen und bietet keinen Sortierparameter. Wir haben deshalb bis Offset 10.000 paginiert, 3.826 Seiten gesammelt und anschließend nach Zitationen neu sortiert. Aus den letzten 3.000 geprüften Zeilen kam jeweils nur noch eine einzige Seite in die Liste.

Klassifikation. Fünf Klassen nach Zugänglichkeit, nicht nach Seitentyp. Wir haben die URL klassifiziert, mit einem Standardwert je Domain. Die Regeln in Kurzform: Staat, Recht, Hochschulen und unabhängige Prüforganisationen sind unerreichbar. Wikimedia-Projekte bilden eine eigene Klasse. Plattformen, auf denen jeder ohne redaktionelle Freigabe veröffentlichen oder ein Produkt listen kann, gelten als offen. Medien, die Pressearbeit annehmen, sind redaktionelle Fläche. Websites von Unternehmen über die eigenen Angelegenheiten sind eigene Fläche.

Wir haben jede Domain zweimal unabhängig klassifiziert. Die Übereinstimmung lag bei 94,1 % der Domains und bei 93,7 % nach Zitationsvolumen. Abweichungen haben wir einzeln entschieden. Nicht klassifizierbar blieb eine einzige Domain.

Grenzen der Studie

Die Werte sind ein Snapshot, kein Zeitraum. Dahinter liegt ein gleitendes Fenster, dessen Länge nicht dokumentiert ist. Eine Seite kann in einem älteren Snapshot deutlich höhere Werte haben. Absolute Zitationszahlen taugen deshalb nicht als „Zitate pro Monat“.

Die untere Kante der Liste liegt bei 26 Zitationen, der Median bei 36. Bei einer so flachen Verteilung können am unteren Rand Seiten fehlen, die selten vorkommen, aber häufig zitiert werden. Für die Spitze der Liste ist das unerheblich.

210 Seiten tragen kein Veröffentlichungsdatum. Das betrifft überwiegend Behörden- und Werkzeugseiten. Alle Altersangaben beziehen sich auf die übrigen 790 Seiten.

Wir haben nur zitierte Seiten ausgewertet. Eine Kontrollgruppe nicht zitierter Seiten gibt es nicht. Ob sich ein Median-DR von 88 oder ein Medianalter von 2022 vom deutschen Web insgesamt unterscheidet, geht aus diesen Daten nicht hervor.

Das Schema misst Zugänglichkeit, nicht Erfolgswahrscheinlichkeit. Dass eine Fläche redaktionell erreichbar ist, heißt nicht, dass Pressearbeit dort funktioniert. Kosten bewertet das Schema ebenfalls nicht.

Ausgewertet haben wir nur ChatGPT und nur Deutschland.

Abgrenzung zu unserer Domain-Serie. Wir veröffentlichen monatlich die 50 meistzitierten Domains in ChatGPT in Deutschland. Diese Auswertung zählt auf Domainebene und nutzt einen anderen Snapshot. Die Zahlen sind deshalb nicht deckungsgleich. Der Unterschied ist inhaltlich interessant: Wikipedia führt die Domainliste an, taucht in der Seitenliste aber nur 13-mal auf. Die Zitationen verteilen sich dort auf 1.731 verschiedene Artikel. ADAC und Verbraucherzentrale machen das Gegenteil. Sie haben weniger Zitationen insgesamt, konzentriert auf wenige starke Ratgeberseiten. Beide Wege führen in KI-Antworten, aber sie lassen sich nicht vermischen.

Porträt von Louise Linehan
Verfasst vonLouise Linehan

Louise ist Content Marketerin bei Ahrefs. In den vergangenen zehn Jahren hatte sie leitende Content-Positionen bei SaaS-Marken wie Pi Datametrics, BuzzSumo und Cision inne. Tagsüber schreibt sie über Content und SEO – abends findet man sie auf dem Fußballplatz oder beim Karaoke, wo sie ins Mikro schmettert.