DanceGroveBot — qué es y cómo controlarlo
Si encontraste DanceGroveBot en tu registro de accesos, esta página es para ti. Todo lo que sigue describe lo que nuestro rastreador hace hoy.
DanceGroveBot — qué es y cómo controlarlo
Quién lo opera
DanceGroveBot lo opera DanceGrove, un directorio de estudios de danza, profesores, clases, eventos y competencias. Lo usamos para mantener las fichas al día — un horario que cambió, una clase que se mudó, un evento que ya pasó — para que nadie llegue a una puerta cerrada.
Cómo identificarnos
Estas son las cadenas exactas que enviamos. El token es lo que pones en un grupo User-agent de robots.txt para gobernarnos, y es el token que enviamos al pedir tu robots.txt.
- Token de robots.txtDanceGroveBot
- User-agent completoDanceGroveBot/1.0 (+https://www.dancegrove.com/bots)
- Contacto[email protected]
Una salvedad honesta: cuando leemos el sitio web público de un estudio para actualizar su propia ficha, la petición de la página sale actualmente con un user-agent de navegador de escritorio normal, aunque antes pedimos y respetamos tu robots.txt bajo el token DanceGroveBot. Si necesitas que todas nuestras peticiones lleven el token, escríbenos y lo configuramos para tu servidor.
Desde dónde rastreamos
Todo nuestro rastreo sale de una única dirección de servidor fija: no rotamos direcciones y nunca cambiamos de dirección para esquivar un bloqueo. Eso significa que puedes limitarnos o incluirnos en tu lista de permitidos a nivel de red y seguirá funcionando.
Damos la dirección exacta a quien administre el sitio y la pida: escribe a la dirección de arriba y te la enviamos.
Pedimos y respetamos robots.txt
Antes de leer nada en un servidor pedimos su robots.txt y lo aplicamos:
- Aplicamos primero las reglas del token DanceGroveBot y, si no hay, las del grupo comodín.
- Guardamos tu robots.txt en caché en vez de volver a pedirlo en cada descarga.
- Si no podemos obtener o leer tu robots.txt, no descargamos la página: preferimos perder una ficha antes que suponer.
- Respetamos Crawl-delay y nunca rastreamos más rápido de lo que pide.
Para que vayamos más lento, o para dejarnos fuera del todo:
User-agent: DanceGroveBot
Crawl-delay: 30
Disallow: /members/
User-agent: DanceGroveBot
Disallow: /
El primer grupo nos ralentiza y cierra una sección; el segundo nos deja fuera del sitio por completo. Cualquiera de los dos surte efecto la próxima vez que leamos tu robots.txt.
Pedirnos que bajemos el ritmo
robots.txt es la vía más rápida, pero no hace falta editar un archivo para hablar con nosotros:
- Escríbenos indicando un ritmo, una franja horaria o las rutas que quieres que dejemos en paz: lo aplicamos.
- Dinos si aparecemos a una hora mala y movemos nuestro horario.
- Si te estamos causando carga ahora mismo, dínoslo y dejamos de rastrear tu servidor mientras lo resolvemos.
Qué hacemos con lo que leemos
Una declaración breve y clara, para que no haya ambigüedad:
- Guardamos los datos que necesita un directorio: nombre, dirección, contacto, horarios, calendarios de clases y eventos, precios cuando están publicados y los estilos que se enseñan.
- No revendemos tus páginas, no las republicamos íntegras ni las usamos para entrenar un modelo.
- Damos crédito y enlazamos a la fuente, y las fuentes de datos abiertos conservan su licencia: OpenStreetMap con ODbL, Wikidata con CC0.
- No recogemos datos personales de tus visitantes ni intentamos acceder a nada que esté detrás de un inicio de sesión.
Retirar algo
Si una ficha sobre ti está mal, o quieres que desaparezca, no hace falta bloquear al rastreador para arreglarlo: mándanos una solicitud y una persona la atenderá.
Solicitar retirada o corrección · Política de contenido y datos · [email protected]
Esta página describe lo que el rastreador hace hoy, no lo que pretendemos que haga. Si ves que se comporta de otra manera, dínoslo: eso es un fallo nuestro y queremos saberlo.