AI Influence
Die Ansicht AI Influence zeigt, wie KI-Oberflächen mit Ihrer Website interagieren. Sie umfasst zwei Dinge, die Sie heute tatsächlich messen können:
- KI-Crawler-Zugriff — welche der 29 nachverfolgten KI-Bots Ihre
robots.txt-,llms.txt- undContent-Signal-Deklarationen erlauben oder blockieren. - KI-Referrals — welche KI-Produkte Ihnen menschliche Besucher senden (ChatGPT, Claude, Perplexity, Gemini, Copilot, DeepSeek und 20+ weitere).
Diese werden auf drei Registerkarten dargestellt: Overview (Zusammenfassung der Posture + robots/Signals-Überprüfung), Crawlers (die vollständige schreibgeschützte Katalog-Tabelle) und Metrics (KI-Referral-Analytics).
Zwei weitere Ebenen — Citation (wo Ihre Marke in KI-Antworten erscheint) und Assist (probabilistischer Uplift in markenbezogener Suche nach KI-Exposition) — werden auf V2 verschoben, da sie entweder einen Anbieter oder risikoberücksichtigende probabilistische Modellierung erfordern. Wir veröffentlichen keine Eitelkeitsmetriken, die wir nicht streng messen können.
Sie finden AI Influence, indem Sie Domains öffnen, Ihre Website auswählen und die Registerkarte AI Influence wählen (in der Behavior-Gruppe).
AI Influence ist in jedem Plan verfügbar, einschließlich Free. KI-Traffic-Sichtbarkeit ist ein grundlegendes Akquise-Signal — kein kostenpflichtiges Feature.
KI als Umsatzkanal. Diese Seite zeigt KI-Traffic. Wenn ein als KI identifizierter Besucher konvertiert, wird diese Konversion auch einem Erst-Klasse-AI-Kanal im Abschnitt Attribution by Channel der Registerkarte Revenue gutgeschrieben, mit derselben Aufschlüsselung pro Produkt — plus einem Bucket Likely AI (unspecified) für heuristisch erkannte Besuche, die ohne Referrer ankommen. Verwenden Sie diese Seite für Traffic; verwenden Sie Attribution bei Revenue für Konversionen. (Revenue-Attribution wird auf dem authentifizierten Dashboard angezeigt, nicht auf öffentlichen oder gemeinsamen Dashboards.)
Overview-Registerkarte
Die Overview beantwortet eine Frage auf einen Blick:
"Kann ChatGPT (oder Claude, oder Perplexity, …) meine Website crawlen? Habe ich versehentlich etwas blockiert?"
Sie zeigt eine kompakte Summary (wie viele der 29 nachverfolgten Bots Sie crawlen können, wie viele am Root blockiert sind, KI-Menschenbesuche) und eine Karte Robots & Signals, die das Urteil überprüfbar macht — direkte "View raw"-Links zu Ihrer robots.txt und llms.txt, die geparste Content-Signal-Deklaration und die explizite Liste der am Root blockierten Bots.
Content-Signal
Zenovay parsed die Content-Signal-Direktive, die Cloudflares "Managed robots.txt" und eine wachsende Zahl von Websites nun ausgeben. Sie drückt die KI-Nutzungsabsicht unabhängig vom Crawl-Zugriff aus:
search— darf Ihr Inhalt zum Aufbau eines Suchindex verwendet werden?ai-input— darf er als Echtzeit-Input für eine generative Antwort verwendet werden (RAG/Grounding)?ai-train— darf er zum Trainieren oder Feinabstimmen eines Modells verwendet werden?
Jeder wird als yes, no oder unset angezeigt. Dies ist die moderne, inhaltsspezifische KI-Zustimmungserklärung — unterschiedlich von einem pauschalen Disallow.
Crawlers-Registerkarte
Eine schreibgeschützte Tabelle aller 29 nachverfolgten KI-Crawler mit dem konfigurierten Zugriff jedes Bots auf Ihrer Website. Sie ist bewusst kein Kontrollpanel — Zenovay liest robots.txt; es setzt Blockierungen nicht am Edge durch. Es meldet, was Ihre robots.txt deklariert.
Die 29 Bots sind in 5 Kategorien gruppiert:
- Live AI Assistants — rufen Seiten auf Anfrage ab, um Benutzerfragen zu beantworten: ChatGPT-User, Perplexity-User, ClaudeBot, Bingbot (Copilot), Applebot-Extended.
- Model Training — sammeln Inhalte für Trainingskorpora: GPTBot, Google-Extended, anthropic-ai, Common Crawl (CCBot), Meta-ExternalAgent, Bytespider, Amazonbot.
- AI Browser Agents — autonome Aufgaben-Agenten, die im Namen eines Benutzers browsen: ChatGPT-Operator, Claude-Computer-Use, You.com Agent.
- Commercial Scrapers — Data-Mining-Feeds, die an KI-Labs verkauft werden: DataForSEO Bot, PetalBot, Webz.io.
- Search with AI Overlays — primäre Suchindizes, deren Ergebnisse KI-Antworten antreiben: Googlebot (AI Overviews).
Was das Urteil bedeutet
Für ein KI-Content-Zugriffs-Tool ist die einzige relevante Frage: "Kann dieser Bot meinen Inhalt erreichen?". Das Urteil wird daher in drei Zuständen gemeldet:
- Allowed — der Bot ist am Site-Root zugelassen. Dies schließt Bots ein, die am Root zugelassen, aber von generischen Infrastruktur-Pfaden (
/api,/_next,/e, …) ausgeschlossen sind — diese Ausschlüsse werden als Bildunterschrift angezeigt, nicht als Alarm, da sie den Inhalt nicht einschränken. - Blocked — der Bot ist am Site-Root durch
robots.txtverboten. - Unknown — wir konnten Ihre
robots.txtnicht lesen (Netzwerkfehler, 5xx, fehlerhaft) oder die Website hatte ihre erste Überprüfung noch nicht (neue Websites werden innerhalb von 24 Stunden überprüft).
RFC 9309 Gruppenkombination (wichtig, wenn Sie Cloudflare Managed robots.txt verwenden)
Wir folgen RFC 9309. UA-Tokens werden case-insensitiv als Substrings abgeglichen (sodass ClaudeBot Anthropic-ClaudeBot trifft). Wichtig: alle User-agent-Gruppen, die einen Bot treffen, werden kombiniert, dann wird die Longest-Match-Präzedenz angewendet, wobei Allow Unentschieden gewinnt.
Das ist wichtig, da Cloudflares Managed robots.txt einen verwalteten Block ausgibt, der viele KI-Bots mit Disallow: / sperrt, und Website-Besitzer häufig eine spätere benutzerdefinierte Gruppe hinzufügen, die die für KI-Sichtbarkeit gewünschten Bots wieder mit Allow: / zulässt. Ein naiver First-Match-Parser würde diese wieder zugelassenen Bots fälschlich als Blocked melden. Zenovay kombiniert die Gruppen und meldet den effektiven Zugriff des Bots — entsprechend dem, was ein konformer Crawler tatsächlich tut.
Die Schaltfläche "Re-check now"
Der Header enthält eine Schaltfläche Re-check now. Sie holt Ihre robots.txt + llms.txt erneut, wertet den vollständigen 29-Bot-Katalog neu aus und feuert 5 Live-HTTP-HEAD-Anfragen ab (einen repräsentativen Bot pro Kategorie), um Runtime-Blockierungen (Cloudflare WAF, CDN-Bot-Filter, Geo-Beschränkungen) zu erkennen. Rate-limitiert auf einmal pro Minute pro Website.
Der ehrliche Vorbehalt
robots.txt ist beratend, nicht erzwingend.
Seriöse Crawler (OpenAI, Anthropic, Google, Perplexity, Microsoft) respektieren robots.txt. Weniger seriöse ignorieren es. Ein "Blocked"-Urteil bedeutet, dass der Bot höflich gebeten wurde, sich fernzuhalten — Ihr Server muss es dennoch durchsetzen, wenn Sie echten Schutz möchten. Zum aktiven Durchsetzen: Cloudflare-AI-Bot-Regeln, eine WAF-/Rate-Limit-Regel, die auf User-Agent abgleicht, oder ein serverseitiger Beacon (Zenovay V1.5 — misst echte Crawl-Ereignisse statt konfiguriertem Zugriff).
Metrics-Registerkarte
Die Registerkarte Metrics ist KI-Referral-Analytics — menschliche Besucher, die von KI-Produkten kamen. Ein Besuch wird anhand von vier Signalen in Prioritätsreihenfolge als KI-originär klassifiziert:
- Client-seitige KI-Quelle — der Tracker liest einen Hinweis aus dem In-App-Browser des KI-Produkts, falls vorhanden.
- Referrer-Domain-Match —
document.referrertrifft einen bekannten KI-Host (chat.openai.com, claude.ai, perplexity.ai, gemini.google.com, copilot.microsoft.com, deepseek.com, you.com, phind.com, t3.chat, kimi.com, +15 weitere). - UTM-Source-Match — die Kampagnen-URL trägt
utm_source=chatgpt,utm_source=claude, usw. (44 bekannte Varianten). - User-Agent-Match — der Besuch kam aus dem In-App-Browser eines KI-Produkts.
Jede erkannte KI-Quelle wird aufgeführt (nicht gekürzt). Jeder Besuch speichert seine ai_source und die ai_detection_method, die ihn klassifiziert hat, mit einem Confidence-Score von 0,0–1,0, sodass das Panel Detection method distribution exakt mit der Quellenaufschlüsselung übereinstimmt.
Dark AI
Ein großer Teil des KI-generierten Traffics trägt keinen Referrer — der Benutzer hat Ihren Link aus einem Chat-Fenster in einen neuen Tab eingefügt, oder die KI-Oberfläche hat den Referrer entfernt. Eine tägliche Verhaltens-Heuristik erfasst diesen "Dark AI"-Traffic über Direct-Traffic-Besucher:
- Deep Content Landing (Einstieg auf einer Long-Tail-URL, nicht
/) - Fokussiertes Single-Page Reading (30–300 Sekunden, Scroll-Tiefe > 70%)
- Neuer Besucher mit niedriger Click-Interaktion
- Ankunft während Geschäftszeiten
Ein Score ≥ 60 markiert den Besuch als is_ai_traffic=true mit ai_detection_method='behavioral_heuristic' und einem Confidence von 0,5–0,95. Erkennungsmethode und Confidence werden pro Besuch gespeichert, damit Sie ehrlich filtern, exportieren und auditieren können.
Was auf V2 verschoben wurde
- Citation — Messung, wann Ihre Marke oder Seiten in KI-Antworten erscheinen. Erfordert einen Prompt-Monitoring-Anbieter oder einen eigenen Crawler. Wir veröffentlichen keine Zahlen, die wir nicht belegen können.
- Assist — probabilistische Schätzung des Downstream-Uplifts in markenbezogener Suche nach KI-Exposition. Wird nur angezeigt, sobald wir Confidence ehrlich kennzeichnen können.
Wenn V2 ausgeliefert wird, trägt jede Metrik ein explizites measured vs. inferred-Label.
Compliance
- GPC (Global Privacy Control) wird respektiert — Besucher mit
Sec-GPC: 1werden nicht für KI-Verhaltens-Heuristiken verwendet. - IP-Adressen werden mit einem täglich rotierenden Salt gehasht — niemals im Klartext gespeichert.
- Keine Cookies werden durch AI Influence eingeführt — der bestehende Cookie-lose Tracker bleibt das einzige erforderliche Skript.
API
GET /api/analytics/ai-influence?websiteId={id}&period={7d|30d|...}
Gibt zurück:
{
"crawl": {
"summary": {
"total": 29, "allowed": 6, "partial": 19, "blocked": 4,
"indeterminate": 0, "never_checked": 0,
"robots_txt_present": true, "llms_txt_present": true,
"hostname": "example.com", "last_checked_at": "2026-05-16T08:14:23Z",
"blocked_bots": ["Amazonbot", "Bytespider", "CCBot", "Meta-ExternalAgent"],
"content_signals": { "search": true, "ai_train": false, "raw": "search=yes,ai-train=no" }
},
"crawlers": [{ "ua_token": "GPTBot", "vendor": "OpenAI", "category": "training", "verdict": "allowed", "restricted_paths": [], "...": "..." }]
},
"referral": { "summary": { "ai_visitors": 1247, "known_ai_visitors": 1100, "dark_ai_visitors": 147, "...": "..." }, "sources": [...], "trend": [...], "top_pages": [...] }
}
Hinweis:
verdictist im Roh-Payload einer vonallowed/partial/blocked/indeterminate/never_checked; die Benutzeroberfläche fasstallowed+partialzu einem einzelnen Allowed-Zustand zusammen (siehe Was das Urteil bedeutet).
POST /api/analytics/ai-influence-probe?websiteId={id}
Löst einen synchronen Re-Fetch + Parse + 5 Live-HTTP-HEAD-Probes aus. Rate-limitiert auf 1 Anfrage pro Minute pro Website.
Verwandte Artikel
- Page Flows — visualisiert emergente Besuchernavigation.
- Visitor Value Scoring — ordnet Besuche nach prognostiziertem Lifetime-Wert.
- Data Export — exportieren Sie KI-Traffic-Daten programmatisch.