RevisebergBot

RevisebergBot ist der Crawler hinter den Prüfungen von Reviseberg zu Barrierefreiheit, Qualität und Suchmaschinen. Wenn Sie diese Seite über Ihre Server-Logs gefunden haben: Er hat Ihre Website besucht, weil jemand uns um eine Prüfung gebeten hat – eine Kundin oder ein Kunde, die bzw. der die Website im eigenen Konto angelegt hat, oder jemand, der den kostenlosen Test für eine Seite gestartet hat. Steht in Ihren Logs RevisebergBot-Index, war es die Index-Messung, die unten beschrieben ist.

So weist er sich aus

Jede Anfrage trägt diesen User-Agent:

RevisebergBot/1.0 (+https://reviseberg.com/bot)

Das Token, mit dem robots.txt abgeglichen wird, lautet RevisebergBot.

Was er tut

  • Er lädt Seiten in einem echten Browser (Chromium), so wie ein Besucher, und führt automatische Barrierefreiheitsprüfungen auf dem Ergebnis aus.
  • Auf den Seiten einer Strecke, die ein Kunde benennt, drückt er Tab, Umschalt+Tab und Escape, um die Tastaturbedienung zu prüfen. Er füllt keine Formulare aus, meldet sich nicht an (außer die Betreiberin oder der Betreiber hat ihm im eigenen Konto einen Zugang hinterlegt), bestellt nichts und bezahlt nichts.
  • Er folgt Links innerhalb der Website bis zur Seitengrenze des gebuchten Pakets. Der kostenlose Test prüft eine Seite.
  • Er prüft, ob die Links auf einer geprüften Seite noch funktionieren, mit einer Anfrage pro Link.

So begrenzen oder sperren Sie ihn

RevisebergBot liest vor dem Crawlen die robots.txt und befolgt die Gruppe, die RevisebergBot nennt, sonst die *-Gruppe; die längste passende Regel gewinnt. Crawl-delay beachtet er bis zu 10 Sekunden zwischen zwei Seiten. Antwortet schon die robots.txt mit 401 oder 403, gilt die ganze Website als gesperrt.

So schließen Sie ihn vollständig aus:

User-agent: RevisebergBot
Disallow: /

Die Index-Messung: RevisebergBot-Index

Es gibt eine Messung, um die niemand auf der Website gebeten hat: die für den BFSG-Index, einen geplanten Vergleich automatisch erkennbarer Barrieren auf den Websites großer Anbieter für Verbraucher in Deutschland – Onlineshops, Banken, Energieversorger und Reiseportale. Veröffentlicht ist daraus noch nichts. Sie läuft unter eigenem Namen, damit Sie sie ablehnen können, ohne Prüfungen abzulehnen, um die jemand gebeten hat:

RevisebergBot-Index/1.0 (+https://reviseberg.com/bot/)
  • Sie arbeitet eine feste Liste großer Organisationen ab, ausgewählt nach veröffentlichten Kriterien; Kleinstunternehmen und öffentliche Stellen stehen nie darauf.
  • Je Website lädt sie die Startseite und einen festen Korb öffentlich verlinkter Seiten – nie mehr als 15 – und folgt keinen Links. Auf der Startseite drückt sie höchstens 30-mal Tab, um Fokus und Skip-Link zu prüfen.
  • Sie lädt höchstens eine Seite alle 5 Sekunden je Website, seltener, wenn die robots.txt ein längeres Crawl-delay verlangt, und hört beim ersten HTTP 429 oder 503 auf.
  • Sie blockiert jede Anfrage außer GET, HEAD und OPTIONS – auch die, die Skripte Ihrer Seiten selbst senden wollen –, füllt keine Formulare aus, meldet sich nirgends an und umgeht keinen Bot-Schutz. Ein Cookie-Banner bleibt, wie er erscheint.
  • Sie befolgt eine robots.txt-Gruppe für RevisebergBot-Index, eine für RevisebergBot und sonst *. Eine Website, deren robots.txt sie ausschließt, wird als „nicht geprüft“ geführt, ohne Score.

So schließen Sie nur die Index-Messung aus:

User-agent: RevisebergBot-Index
Disallow: /

Sie können auch an hello@reviseberg.com schreiben, um von der Messung ausgenommen oder statt unter Ihrem Namen unter einem Pseudonym geführt zu werden.

Fragen

Wenn der Crawler auf Ihrer Website ein Problem verursacht hat oder Sie wissen möchten, wer eine Prüfung angefordert hat, schreiben Sie an hello@reviseberg.com. Sicherheitsmeldungen an security@reviseberg.com.

Häufige Fragen

Warum hat RevisebergBot meine Website besucht?

Weil jemand darum gebeten hat: eine Reviseberg-Kundin oder ein Kunde, die bzw. der eine eigene Website prüft, oder jemand, der den kostenlosen Test für eine Seite gestartet hat. Die einzige Ausnahme ist die Index-Messung, die sich als RevisebergBot-Index ausweist und oben beschrieben ist.

Verändert er etwas auf meiner Website?

Nein. Er liest Seiten, drückt Tasten, um den Fokus zu bewegen, und prüft Links. Er sendet keine Formulare ab und fügt nie ein Skript in eine Website ein.

Beachtet er die robots.txt?

Ja, einschließlich Crawl-delay bis zu 10 Sekunden zwischen zwei Seiten.

Sehen Sie, was ein Scan auf Ihrer Website findet

Eine Seite in rund 30 Sekunden, ohne E-Mail. Der vollständige Bericht umfasst bis zu 100 Seiten und einen Tastatur-Durchlauf.