Definition und User-Agents
Perplexity dokumentiert zwei getrennte Zugriffs-Arten:
- PerplexityBot: der Index-Crawler, der Inhalte für die Suche einsammelt; User-Agent-String mit
PerplexityBotund Verifikations-URL, veröffentlichte IP-Bereiche. - Perplexity-User: Live-Abrufe, wenn ein Nutzer eine konkrete Frage stellt oder URL öffnet — nutzerinitiiert und laut Dokumentation auch dann ausgeführt, wenn der Index-Crawler ausgesperrt ist.
Perplexity ist als RAG-System konzipiert: Jede Antwort synthetisiert aus Retrieval-Treffern und weist die Quellen sichtbar aus. Die dokumentierten Citation-Raten liegen dort höher als in jedem anderen generativen System — 2 bis 8 Prozent für Domain-Autoritäten auf Fach-Queries (Arbeitswerte aus laufenden Messungen).
Die Crawling-Kontroverse
Zur ehrlichen Einordnung gehört die Vorgeschichte: 2024 dokumentierten mehrere Publisher und Infrastruktur-Anbieter Abrufe von Perplexity-Diensten außerhalb des deklarierten Crawlers, die robots.txt-Sperren umgingen — es folgten öffentliche Auseinandersetzungen und rechtliche Konflikte mit Verlagen. Perplexity hat seitdem die User-Agent-Dokumentation ausgebaut, Publisher-Programme gestartet und die Trennung von Index-Crawling und nutzerinitiierten Abrufen präzisiert. Wer den Zugriff wirklich kontrollieren will, sollte sich nicht auf die robots.txt allein verlassen, sondern Logfiles und veröffentlichte IP-Bereiche prüfen.
Steuerung und Praxis
# Perplexity-Index erlauben User-agent: PerplexityBot Allow: /
- Sichtbarkeits-Abwägung: Perplexity zitiert prominent und verlinkt klickbar — für die meisten Fach- und B2B-Marken überwiegt der Sichtbarkeits-Nutzen.
- Logfile-Check: echte PerplexityBot-Zugriffe per IP-Verifikation bestätigen; 403/429-Muster in WAF-Regeln aufspüren.
- Zitations-Monitoring: eigene Citation Rate in Perplexity regelmäßig gegen Wettbewerber messen — das System reagiert vergleichsweise schnell auf frische, strukturierte Quellen.
Verwandte Begriffe
PerplexityBot steht neben GPTBot, OAI-SearchBot und ClaudeBot in der Crawler-Policy des Retrieval-Layers. Die Optimierungs-Analyse für das System: Perplexity SEO.
Das zitierfreudigste System hat eigene Regeln
Perplexity zitiert mehr Quellen pro Antwort als jedes andere System — und hat eine dokumentierte Crawling-Vorgeschichte. Wer Sichtbarkeit will, öffnet den Crawler; wer Kontrolle will, prüft Logs statt nur robots.txt.
FAQ zu PerplexityBot
Was ist der Unterschied zwischen PerplexityBot und Perplexity-User? ▾
PerplexityBot ist der Index-Crawler für die Suche. Perplexity-User ruft Seiten live ab, wenn ein Nutzer eine konkrete Frage stellt oder URL öffnet — laut Dokumentation auch dann, wenn PerplexityBot per robots.txt ausgesperrt ist, weil der Abruf als nutzerinitiiert gilt.
Warum ist Perplexity für GEO besonders relevant? ▾
Weil es das zitierfreudigste generative System ist: Jede Antwort weist Quellen sichtbar und klickbar aus, die gemessenen Citation-Raten liegen über denen von ChatGPT und AI Overviews. Für Fach- und B2B-Marken ist Perplexity oft der schnellste Nachweis-Kanal für GEO-Wirkung.
Respektiert Perplexity die robots.txt? ▾
Für den deklarierten PerplexityBot: ja, laut Dokumentation. 2024 dokumentierten Publisher und Infrastruktur-Anbieter allerdings Abrufe außerhalb des deklarierten Crawlers; seitdem hat Perplexity Dokumentation und Publisher-Programme ausgebaut. Verlässliche Kontrolle entsteht aus Logfile-Analyse plus IP-Verifikation, nicht aus der robots.txt allein.
Wie steigert man Zitationen in Perplexity? ▾
Mit derselben Mechanik wie bei allen RAG-Systemen, nur schneller sichtbar: frische, datierte Inhalte, passage-genau strukturierte Antworten, klare Autor-Entity und uneingeschränkter Crawler-Zugriff. Fortschritt über die eigene Citation Rate gegen Wettbewerber messen.