Kurzantwort

Das SEOryon-Observatorium sucht nicht „die wahre Zahl" der KI-Suche: Es macht Messungen vergleichbar, die nicht dasselbe erfassen. Eine Panelstudie verfolgt Menschen, eine Keyword-Studie beobachtet SERPs, Google beschreibt sein Produkt, und ein Sichtbarkeits-Tool zieht eine Stichprobe von Prompts. Das nutzbare Ergebnis ist deshalb ein Register, in dem jede Zahl ihre Stichprobe, ihren Zeitraum, ihre Geografie, ihre Analyseeinheit und ihre Einschränkungen behält. Ohne diese fünf Elemente ist ein beeindruckender Prozentsatz keine Entscheidungsgrundlage.

Das Wichtigste in Kürze

  • „Zero-Click", ein CTR-Rückgang, eine KI-Zitation, eine Markenerwähnung und ein Referral-Besuch sind fünf verschiedene Kennzahlen.
  • Zwei scheinbar widersprüchliche Ergebnisse können beide innerhalb ihrer Population und ihres Zeitraums gültig sein.
  • Offizielle Dokumentation belegt das erklärte Verhalten einer Oberfläche, nicht den kausalen Effekt einer Optimierung.
  • Relative Zahlen müssen immer in Prozentpunkte und erwartete Volumina übersetzt werden.
  • Die richtige Entscheidung entsteht aus einem reproduzierbaren Protokoll für deinen Markt, nicht aus dem Durchschnitt eines Anbieters.

Das Belegmodell des Observatoriums

Wir ordnen jede Behauptung einer von vier Kategorien zu. Diese Einordnung verhindert, dass eine offizielle Regel und die Meinung eines Praktikers gleich viel Gewicht bekommen.

Ebene Was sie enthält Was sie zu schreiben erlaubt Beispiel
Offizielles Verhalten Dokumentation der Suchmaschine, Definition einer Kennzahl, Richtlinie „Google gibt an, dass…" Google beschreibt Query Fan-out und die Eligibilitätsbedingungen
Beobachtetes Verhalten Panel, Analytics-Daten oder gemessenes Experiment „In dieser Stichprobe und diesem Zeitraum…" Pew beobachtet die Klicks von 900 US-Erwachsenen
Schätzung oder Modell Projektion, geschätzter Traffic, berechnetes Kontrafaktum „Das Modell schätzt… unter diesen Annahmen" Ahrefs schätzt eine kontrafaktische CTR ohne AI Overview
Arbeitshypothese Plausible Erklärung, die zu testen ist „Wir werden testen, ob…" Erhöht eine präzisere Antwort die Zitationen?

Eine Studie kann mehrere Ebenen belegen. Googles Dokumentation zu KI-Funktionen belegt, dass Google über Query Fan-out mehrere verwandte Suchanfragen starten kann. Sie belegt nicht, dass zehn zusätzliche Zwischenüberschriften die Zitationswahrscheinlichkeit einer Seite erhöhen. Diese zweite Aussage ist eine Hypothese, sofern sie nicht in einem kontrollierten Protokoll geprüft wird.

Vergleichsregister der wichtigsten Studien

Die folgende Tabelle hält die Analyseeinheit neben dem Ergebnis fest. Das ist das Minimum, bevor du zwei Zahlen nebeneinanderstellst.

Quelle Population, Zeitraum und Gebiet Einheit und Methode Nützliches Ergebnis Einschränkung, die die Interpretation verändert
SparkToro / Similarweb, Zero-Click 2026 Mobile- und Desktop-Web-Panel in den USA, Januar bis April 2026 Pfade nach einer Google-Suche; Gewichtung auf zwei Drittel Mobile geschätzt 68,01 % der beobachteten Suchanfragen enden ohne Klick Die Google-App ist ausgeschlossen, mobile Anzeigenklicks sind geschätzt, und die Panelgröße wird im Artikel nicht veröffentlicht
Pew Research Center 900 US-Erwachsene, 68.879 Google-Suchen im März 2025 Gemessene Navigation; SERPs vom 7. bis 17. April nachgestellt 8 % Klicks auf ein klassisches Ergebnis bei vorhandener KI-Zusammenfassung, gegenüber 15 % ohne Die SERP wurde nach dem Besuch erfasst und konnte sich geändert haben
Ahrefs, AI-Overviews-CTR 300.000 Keywords, Daten von Dezember 2023 und 2025, Desktop Zwei Kohorten und aggregierte GSC-Daten; modelliertes Kontrafaktum CTR auf Position 1 beobachtet bei 1,57 % gegenüber 3,73 % geschätzt ohne AIO, relativ rund 58 % niedriger Korrelation und Modell, kein randomisiertes Experiment; nur Desktop
Seer Interactive 53 Marken, 5,47 Millionen Anfragen und 2,43 Milliarden Impressionen, Januar 2025 bis Februar 2026 Vollständige Kohorte, Intentionen klassifiziert; jüngster AIO-Status rückwirkend angewandt AIO-CTR von 1,3 % im Dezember 2025 auf 2,4 % im Februar 2026 Eine Kundenstichprobe; ein statisches AIO-Label; keine Saisonbereinigung
Semrush / Datos, AIO-Studie Mehr als 10 Millionen Keywords; Januar bis November 2025 Keyword-Datenbank, 200.000 Begriffe für Zero-Click, Vorher-Nachher-Kohorte In der Kohorte der Begriffe, die eine AIO erhielten, sinkt Zero-Click von 33,75 % auf 31,53 % Volumenschwelle über 100 und proprietäre Klassifikationen; andere SERP-Veränderungen nicht kontrolliert
Ahrefs, Zitationen und Top 10 863.000 SERPs und 4 Millionen zitierte URLs, Studie veröffentlicht im März 2026 Dieselbe URL in der AIO und im klassischen Ergebnis derselben Anfrage 37,1 % der Zitationen ranken in den Top 10; 36,7 % sind nicht in den Top 100 Das Parsing hat sich seit der Studie 2025 geändert; Momentaufnahme eines volatilen Systems
Adobe Digital Insights Mehr als eine Billion Besuche auf US-Handelswebsites; Januar bis März 2026, mit einer Befragung von mehr als 5.000 Amerikanern Adobe-Analytics-Transaktionen und eine separate Umfrage Im März konvertieren KI-Besuche in diesem Bereich 42 % besser als Nicht-KI-Traffic Nur US-Handel; die detaillierte Definition der Quellen und die absoluten Raten fehlen im Artikel
Semrush, Reddit und KI-Suche 217.000 Prompts und 248.000 Reddit-URLs; Daten aktualisiert im Oktober 2025 Öffentliche Ausgaben von Google AI Mode, Perplexity und ChatGPT Search Reddit erscheint je nach Plattform in 13 %, 4 % und 9 % der Antworten; mehr als die Hälfte der Zitationen sind Q&A-Threads Prompts stammen vom Anbieter und die Plattformen befinden sich in einem datierten Zustand; keine Kausalität mit Votes

Dieses Register soll keine Siegerstudie küren. Es soll helfen, diejenige zu wählen, deren Population der geprüften Entscheidung am ähnlichsten ist. Um organische Klicks für ein Anfragen-Portfolio zu prognostizieren, liegt eine Kohorte aus Anfragen plus GSC näher am Problem als eine Umfrage. Um zu verstehen, was Menschen nach einer Suche tun, ist ein Navigationspanel relevanter als eine Keyword-Datenbank.

Verfahren: eine Zahl in sieben Schritten prüfen

  1. Schreibe die Entscheidung vor der Zahl auf. Zum Beispiel: „Sollen wir die Klickprognose für informationsorientierte Anfragen senken, die eine AIO auslösen?"
  2. Identifiziere den Nenner. Suchanfragen, Impressionen, Sitzungen, Nutzer, KI-Antworten und Zitationen sind nicht austauschbar.
  3. Erfasse die Population. Notiere Sprache, Land, Gerät, Branche, Rekrutierungsquelle und Ausschlüsse.
  4. Lege den Zeitraum fest. Oberflächen und Modelle ändern sich schnell; ein Wert ohne Beobachtungsmonat altert schlecht.
  5. Qualifiziere das Studiendesign. Beobachtung, Kohortenvergleich, Vorher-Nachher, deklarative Umfrage, Modell oder Experiment.
  6. Berechne den absoluten Effekt. Rechne den relativen Prozentsatz in Klicks, Leads oder Euro innerhalb deiner eigenen Volumina um.
  7. Halte die entscheidende Einschränkung fest. Kein generischer Satz: die Einschränkung, die deine Entscheidung umkehren könnte.

Durchgerechnetes Beispiel: „58 % niedriger" in ein Szenario übersetzen

Eine Agentur verwaltet 120.000 monatliche Impressionen auf einer Gruppe von Anfragen, bei denen Position 1 historisch 4 % CTR erzielte, also 4.800 Klicks. Ein relativer Rückgang von 58 % mechanisch angewandt ergibt:

Szenario-CTR = 4 % × (1 - 0,58) = 1,68 %

Szenario-Klicks = 120.000 × 1,68 % = 2.016

Der modellierte Verlust beträgt 2.784 Klicks, aber das ist keine ausreichende Prognose. Die Ahrefs-Studie umfasste informationsorientierte Anfragen, auf Desktop, im Dezember 2025, mit einem Kontrafaktum. Die Agentur sollte mindestens drei Szenarien erstellen (relative Rückgänge von 25 %, 40 % und 58 %), dann nach Intention segmentieren und prüfen, welche Begriffe tatsächlich eine AIO auslösen. Sind nur 45 % der Impressionen betroffen, wird das obere Szenario zu 54.000 × 1,68 % + 66.000 × 4 % = 3.547 Klicks, nicht 2.016.

Wie man widersprüchliche Ergebnisse in Einklang bringt

Ahrefs, Pew, Seer und Semrush stellen nicht dieselbe Frage. Pew vergleicht Besuche mit und ohne KI-Zusammenfassung in einem Panel echter Menschen. Ahrefs schätzt die CTR-Differenz der ersten Position über Keyword-Kohorten. Seer verfolgt Marken und beobachtet Anfang 2026 eine Erholung. Semrush/Datos verfolgt dieselbe Begriffsmenge vor und nach dem Erscheinen einer AIO und stellt einen leichten Rückgang beim Zero-Click fest.

Der Widerspruch schrumpft, sobald man acht Spalten angleicht: Zeitraum, Gebiet, Gerät, Intention, Anfragenauswahl, Definition der Exposition, Definition eines Klicks und Studiendesign. Was nach dem Abgleich bleibt, ist echte Unsicherheit. Sie sollte zu einer Szenario-Bandbreite werden, nicht hinter einem Durchschnitt verschwinden.

Was die Daten belegen und nicht belegen

Die Quellen sind sich in einem Punkt einig: Generierte Antworten verändern die Verteilung der Klicks und machen es nötig, mehr als die Position zu messen. Sie zeigen außerdem eine starke Heterogenität nach Intention, Plattform und Zeitpunkt.

Sie belegen nicht, dass eine KI-Zitation einen Verkauf verursacht, dass jeder KI-Traffic besser konvertiert, dass jede AIO 58 % der Klicks entzieht oder dass Reddit durch ein besonderes algorithmisches Signal bevorzugt wird. Sie erlauben auch nicht, einen allgemeinen Traffic-Rückgang einer einzelnen Funktion zuzuschreiben. Ein Update, die Nachfrage, die Saison, eine Rankingänderung oder der Gerätemix können gleichzeitig wirken.

Häufige Fehler und Abbruchkriterien

  • Gefolgte Zitationen über verschiedene Plattformen addieren, ohne die Anzahl der Prompts zu normalisieren.
  • Eine Rate pro Antwort mit einer Rate pro zitierter URL vergleichen.
  • Einen Anstieg von 1 % auf 2 % als „+1 %" darstellen statt als +1 Punkt und +100 % relativ.
  • Einen US-Wert ohne lokalen Test für einen französischen Markt wiederverwenden.
  • Eine Projektion für 2028 als Beobachtung behandeln.
  • Die Analyse abbrechen, wenn die Quelle weder Nenner noch Zeitraum veröffentlicht: Die Zahl darf als Behauptung erwähnt werden, nicht als Benchmark.

Wiederverwendbares Asset: das Belegregister

Lade das SEOryon-Belegregister herunter oder kopiere es. Trage für jede Behauptung ein: claim_id, exakte Formulierung, URL, Herausgeber, Veröffentlichungsdatum, Datenzeitraum, Gebiet, Stichprobe, Einheit, Methode, Ergebnis, Einschränkung, Prüfdatum und die nutzende Seite. Ergänze zwei Entscheidungsfelder: anwendbar_ja_nein und begruendung.

Die Validierungsregel ist einfach: Eine Zahl geht nur dann in die Veröffentlichung, wenn die Felder Zeitraum, Population, Methode und Einschränkung ausgefüllt sind. Dokumentation ohne Statistik darf mit dem Hinweis „offizielle Quelle: erklärtes Verhalten" durchgehen.

So bringt sich SEOryon ein

SEOryon kann Beobachtungen aus Search Console, verfolgten Seiten und Sichtbarkeitstests bündeln, sofern diese Funktionen im Produkt aktiviert sind. Die relevante Rolle besteht hier darin, datierte Zeitreihen und vergleichbare Segmente zu bewahren, nicht darin, einen universellen Score zu fabrizieren. Drittanbieterdaten müssen ihre Herkunft und ihre Einschränkungen behalten. Prüfe vor jeder werblichen Aussage über eine Funktion, ob sie tatsächlich öffentlich auf seoryon.com dokumentiert und im betreffenden Tarif verfügbar ist.

Messbare Übung

Wähle eine Behauptung aus einem Kundenreport, zum Beispiel „AIOs haben unseren Traffic gesenkt". Liefere ein einseitiges Blatt mit: angestrebter Entscheidung, Nenner, Zeitraum, Land und Gerät, drei alternativen Ursachen, zwei widersprüchlichen Quellen und einem Test mit deinen eigenen Daten. Die Übung gelingt, wenn ein zweiter Analyst die Berechnung reproduzieren und genau benennen kann, was die Hypothese widerlegen würde.

FAQ

Welche Zahl misst die KI-Suche am besten?

Es gibt keine einzelne Zahl. Nutze Impressionen und Klicks für die Akquise, Erwähnungen und Zitationen je Prompt für die Sichtbarkeit, dann Conversions und Umsatz für den Wert. Halte die Nenner getrennt.

Kann man zwei GEO-Tracking-Tools vergleichen?

Ja, sofern du dieselbe Prompt-Menge, dieselbe Sprache, dieselbe Region, dasselbe Modell, denselben Tag und mehrere Wiederholungen verwendest. Vergleiche dann Reproduzierbarkeit und Abdeckung, nicht nur die rohe Zahl der Zitationen.

Ist eine Anbieterstudie unbrauchbar?

Nein. Sie kann sehr nützlich sein, wenn Stichprobe und Methode veröffentlicht sind. Weise auf das kommerzielle Interesse hin und vermeide es, ihre Ergebnisse über die beobachtete Population hinaus auszudehnen.

Wie oft sollte dieses Observatorium aktualisiert werden?

Offizielle Dokumentation und Messoberflächen sollten monatlich geprüft werden. Benchmarks können quartalsweise geprüft werden, mit sofortigem Hinweis, sobald eine Quelle ihre Methode ändert.

Empfohlener Weg durch das Observatorium

Beginne mit dem, was Zero-Click 2026 misst, und vergleiche dann die CTR-Studien zu AI Overviews. Zur Quellenauswahl geht es weiter mit KI-Zitationen und Google-Rankings. Verbinde anschließend die Sichtbarkeit mit der Conversion von KI-Traffic und untersuche Reddit, Foren und UGC. Die benachbarten Rahmenwerke sind der Leitfaden zur KI-Suche und die Methode der Autorität über Links.

Quellen

Methoden- und Aktualisierungshinweis

Überprüft am 16. Juli 2026, übersetzt und redigiert am 22. Juli 2026. Die Zahlen werden mit ihrer Population und ihrem Studiendesign wiedergegeben, wie veröffentlicht. Produktlinks, Parsing-Methoden und Plattformumfänge können sich ändern; jede Überarbeitung muss den alten Wert erhalten und jeden Bruch in der Zeitreihe erklären.