Saltar al contenido principal

Rastreador web · SwebingBot/1.0

SwebingBot

Si has llegado hasta aquí es porque has visto SwebingBot en los registros de tu servidor. Ésta es la página a la que apunta su User-Agent: quiénes somos, por qué hemos visitado tu web, qué guardamos y cómo excluirte.

Lo primero, por si tienes prisa

Cómo excluirte del rastreo

Añade esta regla a tu robots.txt y no volveremos a visitar tu sitio:

User-agent: SwebingBot
Disallow: /

La respetamos por completo. No hace falta que nos escribas para que dejemos de rastrear tu sitio: robots.txt es suficiente y es la vía preferente. Detalle de cómo interpretamos tu robots.txt.

En una ficha

Rastreador
SwebingBot/1.0
User-Agent del rastreador
SwebingBot/1.0 (+https://ainure.com/swebing-bot)
Quién lo opera
Ainure, el estudio de software que publica esta web. Swebing es un producto de Ainure, no una empresa aparte.
Frecuencia
Rastreo puntual y único. No mantenemos un índice de tu sitio ni lo revisitamos periódicamente.
Qué guardamos
Una copia temporal del contenido público que rastreamos, borrada a los 30 días de la visita.
Cómo excluirte
Dos líneas en tu robots.txt ver arriba.

Quiénes somos

Ainure es el estudio de software que publica esta web. Swebing es uno de nuestros productos: un servicio de generación de demostraciones comerciales de sitios web. Swebing es un producto, no una entidad independiente; quien opera el rastreador y responde de este tratamiento es Ainure.

Para preparar una propuesta comercial no solicitada dirigida a un negocio, visitamos puntualmente su web pública con un rastreador propio, identificado como tal.

Por qué rastreamos tu sitio

SwebingBot no es un rastreador de indexación continua. No mantenemos un índice de tu sitio, no lo revisitamos periódicamente y no vendemos ni cedemos tu contenido a terceros con fines propios de esos terceros. Cada visita es un rastreo puntual y único, ligado a la elaboración de una propuesta comercial concreta para el titular de ese sitio.

Si el negocio nunca responde, no hay una segunda visita: nuestra política de no-recontacto identifica cada sitio por su dominio y evita volver a rastrearlo mientras exista un veredicto reciente sobre él (90 días) o se nos haya indicado que ya fue contactado o que rechazó la propuesta.

Qué hacemos, y qué no, al rastrear y auditar

  • El rastreador se identifica siempre

    Todas sus peticiones —a páginas, robots.txt, sitemaps e imágenes— envían el User-Agent SwebingBot/1.0 (+https://ainure.com/swebing-bot). El rastreador nunca se hace pasar por un navegador ni fabrica una cabecera Referer que no corresponda a cómo llegó de verdad a una URL.

  • La auditoría se comporta como un visitante real

    La auditoría técnica posterior es un proceso distinto y no usa la identidad del rastreador. Lighthouse emula su propio navegador móvil y Playwright usa el User-Agent estándar de Chromium: medir el rendimiento real exige comportarse como un visitante real. Un User-Agent de bot podría provocar una respuesta anti-bot distinta y haría que midiéramos otra página.

  • Leemos robots.txt antes de nada

    Antes de visitar cualquier página, leemos y respetamos robots.txt. Si tu sitio prohíbe el acceso a SwebingBot (o a todos los rastreadores, User-agent: *) en una ruta, no la visitamos ni descargamos nada de ella. Si robots.txt prohíbe la raíz del sitio, no rastreamos nada en absoluto.

  • 401 y 403 también significan «no»

    Si tu servidor responde 401 o 403 a una petición de robots.txt, lo tratamos como una prohibición, aunque el estándar permita lo contrario. Aplicamos deliberadamente el criterio más favorable para el webmaster: si el servidor rechaza el acceso, no lo interpretamos como permiso para rastrear o auditar.

  • La auditoría vuelve a comprobar si falta el veredicto

    Antes de medir, lee de site_analysis.json el veredicto de raíz obtenido por el rastreador para SwebingBot. Si es disallowed, no audita; tampoco vuelve a filtrar cada subrecurso. Si el artefacto falta, no puede leerse o no contiene un veredicto legible, vuelve a pedir robots.txt con SwebingBot, después de comprobar que esta página de identificación responde y antes de iniciar Lighthouse o Playwright. Un resultado absent —incluidos un 404 y los 4xx distintos de 401 y 403 sin una política utilizable— permite continuar. Un 401, un 403 o una política legible que prohíbe la raíz hacen que se omita la auditoría. Ante un fallo de red, un 5xx o una respuesta ilegible, se cancela sin medir ni escribir un artefacto.

  • Respetamos Crawl-delay sin techo

    Si tu robots.txt declara un Crawl-delay, lo aplicamos sin límite superior: si pides un ritmo más lento que el nuestro por defecto, usamos el tuyo, por alto que sea. A falta de Crawl-delay, esperamos al menos un segundo entre peticiones al mismo host.

  • No sorteamos bloqueos

    Ni el rastreador ni la auditoría sortean muros anti-bot, interstitials, CAPTCHAs ni ninguna otra medida que tu sitio use para bloquear el acceso. Para ejecutar axe, Playwright desactiva la Content Security Policy dentro de su propio contexto; eso permite inyectar el analizador de accesibilidad, pero no resuelve desafíos ni atraviesa protecciones del sitio. Si una protección nos bloquea, no intentamos eludirla.

Cómo interpretamos tu robots.txt

Puedes dirigirte a nuestro rastreador por su nombre, SwebingBot, o excluir a cualquier rastreador con *. Ambas formas nos valen:

User-agent: SwebingBot
Disallow: /

Ten en cuenta la semántica estándar de robots.txt: si declaras un grupo específico para SwebingBot además de un grupo *, aplicamos únicamente el grupo específico de SwebingBot — no se suman ambos, el específico sustituye al general.

Respetamos por completo lo que declares, incluido cualquier Crawl-delay.

Qué guardamos, y durante cuánto tiempo

Del contenido público que rastreamos —texto, y en algunos casos imágenes— conservamos una copia temporal para elaborar la propuesta comercial. Se borra a los 30 días de la visita, salvo que el negocio se convierta en cliente (en cuyo caso pasa a regirse por el contrato).

El plazo de 30 días es un compromiso firme; el mecanismo que lo cumple hoy es un procedimiento de purga semanal operado por una persona, no un borrado automático.

Las fotografías en las que detectamos personas quedan excluidas de poder usarse como activo de la demostración; para el residuo que esa detección no pueda descartar con certeza, el régimen de maqueta (noindex, URL no adivinable, banner visible, retirada en 24 h) acota la exposición.

El criterio completo de por qué tratamos estos datos, bajo qué base jurídica y con qué salvaguardas está en nuestro test de ponderación de interés legítimo, que te enviamos si lo pides en ainure@ainure.com.

Información conforme al artículo 14 RGPD

Como no nos diste tus datos directamente, el art. 14 RGPD nos obliga a explicarte esto de forma clara. En resumen:

Responsable
Ainure, el estudio de software que opera SwebingBot y publica esta web. Swebing es un producto de Ainure. Puedes escribirnos a ainure@ainure.com.
Origen de tus datos
Tu propia web pública, visitada por SwebingBot.
Finalidad
Elaborar una demostración y una propuesta comercial no solicitada.
Base jurídica
Interés legítimo en la prospección B2B (art. 6.1.f RGPD). El test de ponderación completo está documentado y disponible a petición: pídelo en ainure@ainure.com.
Destinatarios
Ninguna cesión a terceros con fines propios de esos terceros. Cuando la demostración incluye análisis automatizado de imágenes de tu web, usamos un encargado de tratamiento en Estados Unidos (OpenAI) únicamente para ese análisis.
Plazo de conservación
30 días desde la visita — ver el detalle.
Cómo oponerte
Por robots.txt para el rastreo, o escribiendo a ainure@ainure.com para la oposición del art. 21 RGPD.

Retirada y oposición

Si ya te hemos enviado una propuesta o hemos publicado una maqueta de demostración basada en tu sitio y quieres que la retiremos, o si te opones a que tratemos tus datos para este fin (art. 21 RGPD), escribe a ainure@ainure.com.

Cualquier maqueta publicada se retira en un máximo de 24 horas desde la recepción de la solicitud, y tus datos se eliminan de nuestros sistemas en un máximo de 30 días.