Rastreador web · SwebingBot/1.0
SwebingBot
Si has llegado hasta aquí es porque has visto SwebingBot en los registros de tu servidor. Ésta es la página a la que apunta su User-Agent: quiénes somos, por qué hemos visitado tu web, qué guardamos y cómo excluirte.
Lo primero, por si tienes prisa
Cómo excluirte del rastreo
Añade esta regla a tu robots.txt y no volveremos a visitar tu sitio:
User-agent: SwebingBot
Disallow: /La respetamos por completo. No hace falta que nos escribas para que dejemos de rastrear tu sitio: robots.txt es suficiente y es la vía preferente. Detalle de cómo interpretamos tu robots.txt.
En una ficha
- Rastreador
SwebingBot/1.0- User-Agent del rastreador
SwebingBot/1.0 (+https://ainure.com/swebing-bot)- Quién lo opera
- Ainure, el estudio de software que publica esta web. Swebing es un producto de Ainure, no una empresa aparte.
- Frecuencia
- Rastreo puntual y único. No mantenemos un índice de tu sitio ni lo revisitamos periódicamente.
- Qué guardamos
- Una copia temporal del contenido público que rastreamos, borrada a los 30 días de la visita.
- Cómo excluirte
- Dos líneas en tu
robots.txt— ver arriba. - Contacto
- ainure@ainure.com
Quiénes somos
Ainure es el estudio de software que publica esta web. Swebing es uno de nuestros productos: un servicio de generación de demostraciones comerciales de sitios web. Swebing es un producto, no una entidad independiente; quien opera el rastreador y responde de este tratamiento es Ainure.
Para preparar una propuesta comercial no solicitada dirigida a un negocio, visitamos puntualmente su web pública con un rastreador propio, identificado como tal.
Por qué rastreamos tu sitio
SwebingBot no es un rastreador de indexación continua. No mantenemos un índice de tu sitio, no lo revisitamos periódicamente y no vendemos ni cedemos tu contenido a terceros con fines propios de esos terceros. Cada visita es un rastreo puntual y único, ligado a la elaboración de una propuesta comercial concreta para el titular de ese sitio.
Si el negocio nunca responde, no hay una segunda visita: nuestra política de no-recontacto identifica cada sitio por su dominio y evita volver a rastrearlo mientras exista un veredicto reciente sobre él (90 días) o se nos haya indicado que ya fue contactado o que rechazó la propuesta.
Qué hacemos, y qué no, al rastrear y auditar
El rastreador se identifica siempre
Todas sus peticiones —a páginas,
robots.txt, sitemaps e imágenes— envían elUser-AgentSwebingBot/1.0 (+https://ainure.com/swebing-bot). El rastreador nunca se hace pasar por un navegador ni fabrica una cabeceraRefererque no corresponda a cómo llegó de verdad a una URL.La auditoría se comporta como un visitante real
La auditoría técnica posterior es un proceso distinto y no usa la identidad del rastreador. Lighthouse emula su propio navegador móvil y Playwright usa el
User-Agentestándar de Chromium: medir el rendimiento real exige comportarse como un visitante real. UnUser-Agentde bot podría provocar una respuesta anti-bot distinta y haría que midiéramos otra página.Leemos robots.txt antes de nada
Antes de visitar cualquier página, leemos y respetamos
robots.txt. Si tu sitio prohíbe el acceso aSwebingBot(o a todos los rastreadores,User-agent: *) en una ruta, no la visitamos ni descargamos nada de ella. Sirobots.txtprohíbe la raíz del sitio, no rastreamos nada en absoluto.401 y 403 también significan «no»
Si tu servidor responde 401 o 403 a una petición de
robots.txt, lo tratamos como una prohibición, aunque el estándar permita lo contrario. Aplicamos deliberadamente el criterio más favorable para el webmaster: si el servidor rechaza el acceso, no lo interpretamos como permiso para rastrear o auditar.La auditoría vuelve a comprobar si falta el veredicto
Antes de medir, lee de
site_analysis.jsonel veredicto de raíz obtenido por el rastreador paraSwebingBot. Si esdisallowed, no audita; tampoco vuelve a filtrar cada subrecurso. Si el artefacto falta, no puede leerse o no contiene un veredicto legible, vuelve a pedirrobots.txtconSwebingBot, después de comprobar que esta página de identificación responde y antes de iniciar Lighthouse o Playwright. Un resultadoabsent—incluidos un 404 y los 4xx distintos de 401 y 403 sin una política utilizable— permite continuar. Un 401, un 403 o una política legible que prohíbe la raíz hacen que se omita la auditoría. Ante un fallo de red, un 5xx o una respuesta ilegible, se cancela sin medir ni escribir un artefacto.Respetamos Crawl-delay sin techo
Si tu
robots.txtdeclara unCrawl-delay, lo aplicamos sin límite superior: si pides un ritmo más lento que el nuestro por defecto, usamos el tuyo, por alto que sea. A falta deCrawl-delay, esperamos al menos un segundo entre peticiones al mismo host.No sorteamos bloqueos
Ni el rastreador ni la auditoría sortean muros anti-bot, interstitials, CAPTCHAs ni ninguna otra medida que tu sitio use para bloquear el acceso. Para ejecutar axe, Playwright desactiva la Content Security Policy dentro de su propio contexto; eso permite inyectar el analizador de accesibilidad, pero no resuelve desafíos ni atraviesa protecciones del sitio. Si una protección nos bloquea, no intentamos eludirla.
Cómo interpretamos tu robots.txt
Puedes dirigirte a nuestro rastreador por su nombre, SwebingBot, o excluir a cualquier rastreador con *. Ambas formas nos valen:
User-agent: SwebingBot
Disallow: /Ten en cuenta la semántica estándar de robots.txt: si declaras un grupo específico para SwebingBot además de un grupo *, aplicamos únicamente el grupo específico de SwebingBot — no se suman ambos, el específico sustituye al general.
Respetamos por completo lo que declares, incluido cualquier Crawl-delay.
Qué guardamos, y durante cuánto tiempo
Del contenido público que rastreamos —texto, y en algunos casos imágenes— conservamos una copia temporal para elaborar la propuesta comercial. Se borra a los 30 días de la visita, salvo que el negocio se convierta en cliente (en cuyo caso pasa a regirse por el contrato).
El plazo de 30 días es un compromiso firme; el mecanismo que lo cumple hoy es un procedimiento de purga semanal operado por una persona, no un borrado automático.
Las fotografías en las que detectamos personas quedan excluidas de poder usarse como activo de la demostración; para el residuo que esa detección no pueda descartar con certeza, el régimen de maqueta (noindex, URL no adivinable, banner visible, retirada en 24 h) acota la exposición.
El criterio completo de por qué tratamos estos datos, bajo qué base jurídica y con qué salvaguardas está en nuestro test de ponderación de interés legítimo, que te enviamos si lo pides en ainure@ainure.com.
Información conforme al artículo 14 RGPD
Como no nos diste tus datos directamente, el art. 14 RGPD nos obliga a explicarte esto de forma clara. En resumen:
- Responsable
- Ainure, el estudio de software que opera
SwebingBoty publica esta web. Swebing es un producto de Ainure. Puedes escribirnos a ainure@ainure.com. - Origen de tus datos
- Tu propia web pública, visitada por
SwebingBot. - Finalidad
- Elaborar una demostración y una propuesta comercial no solicitada.
- Base jurídica
- Interés legítimo en la prospección B2B (art. 6.1.f RGPD). El test de ponderación completo está documentado y disponible a petición: pídelo en ainure@ainure.com.
- Destinatarios
- Ninguna cesión a terceros con fines propios de esos terceros. Cuando la demostración incluye análisis automatizado de imágenes de tu web, usamos un encargado de tratamiento en Estados Unidos (OpenAI) únicamente para ese análisis.
- Plazo de conservación
- 30 días desde la visita — ver el detalle.
- Cómo oponerte
- Por
robots.txtpara el rastreo, o escribiendo a ainure@ainure.com para la oposición del art. 21 RGPD.
Retirada y oposición
Si ya te hemos enviado una propuesta o hemos publicado una maqueta de demostración basada en tu sitio y quieres que la retiremos, o si te opones a que tratemos tus datos para este fin (art. 21 RGPD), escribe a ainure@ainure.com.
Cualquier maqueta publicada se retira en un máximo de 24 horas desde la recepción de la solicitud, y tus datos se eliminan de nuestros sistemas en un máximo de 30 días.