Questa pagina è tradotta automaticamente e non è stata revisionata in modo indipendente. I termini giuridici, i numeri di direttiva e il testo di legge citato restano nella forma originale. In caso di dubbio prevale la versione inglese. English
Crawler
Informazioni su CosmeticlaimBot
Se hai trovato questo indirizzo nei log del tuo server, questa pagina spiega di che richiesta si trattava.
CosmeticlaimBot recupera pagine pubbliche quando qualcuno chiede al nostro scanner di controllare un sito. È attivato da una persona che incolla un URL — non esegue scansioni programmate e non scopre siti da solo.
Si identifica come:
CosmeticlaimBot/1.0 (+https://cosmeticlaim.eu/bot)
Che cosa fa
- Richiede prima il tuo robots.txt — prima di qualsiasi pagina, compresa quella che ci hai indicato — e rispetta le regole
Disallowper*e perCosmeticlaimBot. Se la pagina iniziale è vietata ci fermiamo e restituiamo un errore invece di un rapporto. Leggiamo le prime 1000 regole di un robots.txt; se il tuo è più lungo, le regole oltre la millesima non vengono applicate, e faresti bene a dircelo. - Legge al massimo 10 pagine per analisi, al massimo 2 MB ciascuna, entro un budget di 45 secondi.
- Segue al massimo 3 reindirizzamenti, e solo verso indirizzi http o https pubblici.
- Richiede le pagine una alla volta. Assomiglia più a una persona che naviga che a un crawler.
Che cosa non fa
- Non esegue JavaScript, non invia moduli e non segue link dietro un login.
- Non memorizza le tue pagine. Il testo è analizzato in memoria e scartato quando la risposta viene inviata.
- Non indicizza il tuo sito e non ne pubblica nulla.
Una precisazione, perché la frase che stava qui era troppo netta: le frasi delle tue pagine che corrispondono a un termine soggetto a restrizioni vengono inviate a un modello linguistico — un gateway privato su ai-gw.nurme.eu — che decide se la corrispondenza è una dichiarazione di marketing o un commento ordinario. Si tratta al massimo della frase corrispondente e del percorso della pagina, mai dell’intera pagina, e nulla di ciò viene conservato. La pagina sulla privacy indica esattamente che cosa viene trasmesso.
Bloccarlo
Aggiungi questo al tuo robots.txt e si fermerà:
User-agent: CosmeticlaimBot
Disallow: /
Bloccare per user agent al bordo funziona altrettanto bene. Se preferisci che non raggiunga mai la tua origine, è del tutto ragionevole — lo scanner segnalerà che le pagine sono state saltate, invece di fingere che fossero pulite. Il nostro crawler arriva da 157.180.65.81, quindi può bloccarlo per indirizzo oltre che per nome; se le serve parlare con una persona, scriva a tere@cosmeticlaim.eu.