Cómo selecciona Perplexity sus fuentes
Perplexity no tiene un rastreador, tiene dos, y siguen reglas distintas. PerplexityBot construye el índice de búsqueda y está documentado como no destinado a recoger contenido para modelos base, mientras que Perplexity-User visita una página porque alguien acaba de preguntar e ignora robots.txt por lo general. Cuál de los dos llega a su web decide si está en el índice o si solo le citan una vez.

Dos rastreadores, dos acuerdos
La mayoría de los responsables tratan a los rastreadores de IA como un solo grupo y escriben una regla para todos. Perplexity divide el trabajo en dos en su propia documentación, y esa división pesa más que los nombres.
PerplexityBot se describe como el agente que hace visibles y enlaza webs en los resultados de búsqueda, y no se usa para recoger contenido destinado a modelos base de IA. Decide si sus páginas están en el índice. Quien lo bloquea se retira del conjunto entre el que se elige, y esa es una decisión que conviene tomar a conciencia, no copiando un robots.txt de un foro.
Perplexity-User es la otra mitad. Atiende acciones del usuario: alguien pregunta, el sistema visita una página para responder con precisión y la enlaza. Perplexity escribe con claridad que este recolector ignora las reglas de robots.txt por lo general, porque la consulta la pidió una persona. Una prohibición general no produce el silencio que muchos esperan.
Las cifras que hacen práctica la distinción
2 agentes documentados, 2 listas de IP publicadas y 1 de los dos respeta robots.txt. Ese es todo el acuerdo, y cabe en tres líneas de un archivo de configuración.
El lado comercial merece la misma atención. En una cuenta medida entre el 1 de octubre de 2024 y el 30 de abril de 2025, el tráfico de Perplexity convirtió al 10,5 por ciento frente al 1,76 por ciento de la búsqueda orgánica, con ChatGPT en el 15,9 por ciento, Claude en el 5 por ciento y Gemini en el 3 por ciento. El volumen detrás de esas tasas es pequeño, y por eso las tasas son lo interesante: pocas visitas que ya saben lo que quieren.
Del lado de la demanda, el 45 por ciento de los consumidores usó una herramienta de IA para encontrar un negocio local en 2026, frente al 6 por ciento un año antes, y consultan de media seis webs de reseñas. Una fuente que aparece en varias de esas seis es la que un asistente puede repetir sin riesgo.
Nuestra propia medición de 187 hosts en activo en esta red encontró 25 sin robots.txt, 6 con llms.txt y 0 con un rastreador de IA bloqueado. El negocio típico no tiene postura sobre nada de esto, y eso significa en la práctica que se le indexa.
| Agente | Función | robots.txt |
|---|---|---|
| PerplexityBot | Muestra y enlaza webs en los resultados, sin entrenar modelos | Se respeta, se recomienda permitirlo |
| Perplexity-User | Visita una página para responder a una pregunta en curso | Se ignora por lo general, porque la consulta la pidió un usuario |
Qué hacer con las dos reglas
Decida una vez, y por escrito, si quiere estar en el índice. Si la respuesta es sí, permita PerplexityBot de forma explícita en lugar de confiar en un comodín que alguien podría estrechar más adelante. Si es no, cuente con que Perplexity-User recogerá la página igualmente cuando alguien pregunte por usted, y prepare la página para ser leída.
Y compruebe en lugar de suponer. Ambos agentes publican sus rangos de IP en JSON, así que una línea del registro que dice ser PerplexityBot se puede contrastar con la lista publicada. Falsificar una identificación es barato, coincidir con los rangos de IP no lo es.
Preguntas y respuestas
¿Bloquear PerplexityBot me deja fuera de las respuestas?
¿Se usa mi contenido para entrenar un modelo?
¿Cómo confirmo que una visita fue real?
¿Vale algo ese tráfico?
Fuentes
- Perplexity, documentación de rastreadores Los dos agentes, sus funciones y el comportamiento ante robots.txt
- Seer Interactive, estudio de conversión del tráfico de IA Tasas de conversión por fuente del 1 de octubre de 2024 al 30 de abril de 2025
- BrightLocal, Local Consumer Review Survey 2026 Uso de IA para recomendaciones locales y la media de seis webs de reseñas


