7insider
ES
Búsqueda con IA

Cómo selecciona Perplexity sus fuentes

Perplexity no tiene un rastreador, tiene dos, y siguen reglas distintas. PerplexityBot construye el índice de búsqueda y está documentado como no destinado a recoger contenido para modelos base, mientras que Perplexity-User visita una página porque alguien acaba de preguntar e ignora robots.txt por lo general. Cuál de los dos llega a su web decide si está en el índice o si solo le citan una vez.

Última comprobación: 2026-08-064 min de lectura

Una etiqueta numerada de latón colgada de un cordón sobre lino marfil

Dos rastreadores, dos acuerdos

La mayoría de los responsables tratan a los rastreadores de IA como un solo grupo y escriben una regla para todos. Perplexity divide el trabajo en dos en su propia documentación, y esa división pesa más que los nombres.

PerplexityBot se describe como el agente que hace visibles y enlaza webs en los resultados de búsqueda, y no se usa para recoger contenido destinado a modelos base de IA. Decide si sus páginas están en el índice. Quien lo bloquea se retira del conjunto entre el que se elige, y esa es una decisión que conviene tomar a conciencia, no copiando un robots.txt de un foro.

Perplexity-User es la otra mitad. Atiende acciones del usuario: alguien pregunta, el sistema visita una página para responder con precisión y la enlaza. Perplexity escribe con claridad que este recolector ignora las reglas de robots.txt por lo general, porque la consulta la pidió una persona. Una prohibición general no produce el silencio que muchos esperan.

Las cifras que hacen práctica la distinción

2 agentes documentados, 2 listas de IP publicadas y 1 de los dos respeta robots.txt. Ese es todo el acuerdo, y cabe en tres líneas de un archivo de configuración.

El lado comercial merece la misma atención. En una cuenta medida entre el 1 de octubre de 2024 y el 30 de abril de 2025, el tráfico de Perplexity convirtió al 10,5 por ciento frente al 1,76 por ciento de la búsqueda orgánica, con ChatGPT en el 15,9 por ciento, Claude en el 5 por ciento y Gemini en el 3 por ciento. El volumen detrás de esas tasas es pequeño, y por eso las tasas son lo interesante: pocas visitas que ya saben lo que quieren.

Del lado de la demanda, el 45 por ciento de los consumidores usó una herramienta de IA para encontrar un negocio local en 2026, frente al 6 por ciento un año antes, y consultan de media seis webs de reseñas. Una fuente que aparece en varias de esas seis es la que un asistente puede repetir sin riesgo.

Nuestra propia medición de 187 hosts en activo en esta red encontró 25 sin robots.txt, 6 con llms.txt y 0 con un rastreador de IA bloqueado. El negocio típico no tiene postura sobre nada de esto, y eso significa en la práctica que se le indexa.

Los dos agentes documentados de Perplexity
AgenteFunciónrobots.txt
PerplexityBotMuestra y enlaza webs en los resultados, sin entrenar modelosSe respeta, se recomienda permitirlo
Perplexity-UserVisita una página para responder a una pregunta en cursoSe ignora por lo general, porque la consulta la pidió un usuario
Ambos publican sus rangos de IP en un archivo JSON, la única forma fiable de comprobar una visita. Fuente: documentación de rastreadores de Perplexity.

Qué hacer con las dos reglas

Decida una vez, y por escrito, si quiere estar en el índice. Si la respuesta es sí, permita PerplexityBot de forma explícita en lugar de confiar en un comodín que alguien podría estrechar más adelante. Si es no, cuente con que Perplexity-User recogerá la página igualmente cuando alguien pregunte por usted, y prepare la página para ser leída.

Y compruebe en lugar de suponer. Ambos agentes publican sus rangos de IP en JSON, así que una línea del registro que dice ser PerplexityBot se puede contrastar con la lista publicada. Falsificar una identificación es barato, coincidir con los rangos de IP no lo es.

Preguntas y respuestas

¿Bloquear PerplexityBot me deja fuera de las respuestas?
Le deja fuera del índice que alimenta los resultados. No detiene a Perplexity-User, que recoge una página cuando alguien pregunta e ignora robots.txt por lo general.
¿Se usa mi contenido para entrenar un modelo?
Perplexity documenta que PerplexityBot no se usa para recoger contenido destinado a modelos base de IA. Esa afirmación cubre a este agente, no a todos los productos del mercado.
¿Cómo confirmo que una visita fue real?
Contraste la IP solicitante con el archivo JSON de rangos que Perplexity publica para ese agente. La cadena de identificación por sí sola no prueba nada.
¿Vale algo ese tráfico?
En la cuenta medida convirtió al 10,5 por ciento frente al 1,76 por ciento de la búsqueda orgánica. El volumen es pequeño, así que trátelo como visitas cualificadas y no como un canal que sustituya a la búsqueda.

Fuentes

  1. Perplexity, documentación de rastreadores Los dos agentes, sus funciones y el comportamiento ante robots.txt
  2. Seer Interactive, estudio de conversión del tráfico de IA Tasas de conversión por fuente del 1 de octubre de 2024 al 30 de abril de 2025
  3. BrightLocal, Local Consumer Review Survey 2026 Uso de IA para recomendaciones locales y la media de seis webs de reseñas

Seguir leyendo

Todos los artículos