Definition und User-Agents

Perplexity dokumentiert zwei getrennte Zugriffs-Arten:

Perplexity ist als RAG-System konzipiert: Jede Antwort synthetisiert aus Retrieval-Treffern und weist die Quellen sichtbar aus. Die dokumentierten Citation-Raten liegen dort höher als in jedem anderen generativen System — 2 bis 8 Prozent für Domain-Autoritäten auf Fach-Queries (Arbeitswerte aus laufenden Messungen).

Die Crawling-Kontroverse

Zur ehrlichen Einordnung gehört die Vorgeschichte: 2024 dokumentierten mehrere Publisher und Infrastruktur-Anbieter Abrufe von Perplexity-Diensten außerhalb des deklarierten Crawlers, die robots.txt-Sperren umgingen — es folgten öffentliche Auseinandersetzungen und rechtliche Konflikte mit Verlagen. Perplexity hat seitdem die User-Agent-Dokumentation ausgebaut, Publisher-Programme gestartet und die Trennung von Index-Crawling und nutzerinitiierten Abrufen präzisiert. Wer den Zugriff wirklich kontrollieren will, sollte sich nicht auf die robots.txt allein verlassen, sondern Logfiles und veröffentlichte IP-Bereiche prüfen.

Steuerung und Praxis

# Perplexity-Index erlauben
User-agent: PerplexityBot
Allow: /

Verwandte Begriffe

PerplexityBot steht neben GPTBot, OAI-SearchBot und ClaudeBot in der Crawler-Policy des Retrieval-Layers. Die Optimierungs-Analyse für das System: Perplexity SEO.

Kern-Aussage

Das zitierfreudigste System hat eigene Regeln

Perplexity zitiert mehr Quellen pro Antwort als jedes andere System — und hat eine dokumentierte Crawling-Vorgeschichte. Wer Sichtbarkeit will, öffnet den Crawler; wer Kontrolle will, prüft Logs statt nur robots.txt.


FAQ zu PerplexityBot

Was ist der Unterschied zwischen PerplexityBot und Perplexity-User?

PerplexityBot ist der Index-Crawler für die Suche. Perplexity-User ruft Seiten live ab, wenn ein Nutzer eine konkrete Frage stellt oder URL öffnet — laut Dokumentation auch dann, wenn PerplexityBot per robots.txt ausgesperrt ist, weil der Abruf als nutzerinitiiert gilt.

Warum ist Perplexity für GEO besonders relevant?

Weil es das zitierfreudigste generative System ist: Jede Antwort weist Quellen sichtbar und klickbar aus, die gemessenen Citation-Raten liegen über denen von ChatGPT und AI Overviews. Für Fach- und B2B-Marken ist Perplexity oft der schnellste Nachweis-Kanal für GEO-Wirkung.

Respektiert Perplexity die robots.txt?

Für den deklarierten PerplexityBot: ja, laut Dokumentation. 2024 dokumentierten Publisher und Infrastruktur-Anbieter allerdings Abrufe außerhalb des deklarierten Crawlers; seitdem hat Perplexity Dokumentation und Publisher-Programme ausgebaut. Verlässliche Kontrolle entsteht aus Logfile-Analyse plus IP-Verifikation, nicht aus der robots.txt allein.

Wie steigert man Zitationen in Perplexity?

Mit derselben Mechanik wie bei allen RAG-Systemen, nur schneller sichtbar: frische, datierte Inhalte, passage-genau strukturierte Antworten, klare Autor-Entity und uneingeschränkter Crawler-Zugriff. Fortschritt über die eigene Citation Rate gegen Wettbewerber messen.