Cette page en français · This page in English

BetfrikaBot, der Webcrawler von Betfrika

Sie haben BetfrikaBot in den Logdateien Ihres Servers gesehen? Diese Seite erklärt, wer wir sind, was dieser Crawler tut, wie Sie ihn sperren und wie Sie uns erreichen.

Wer wir sind

BetfrikaBot ist der Crawler des Vereins Betfrika ASBL/e.V., einer gemeinnützigen Organisation mit Präsenz in Europa und Afrika.

Er liest öffentliche Seiten von Organisationen (Kirchengemeinden, Vereine, Gebrauchtwarenhäuser, Unternehmen…), um ihre offiziellen Kontaktdaten und eine kurze Beschreibung ihrer Tätigkeit zu finden und ihnen eine Partnerschaft anzubieten: Bücher, Sammelaktionen, Spenden.

Er gibt sich immer mit diesem User-Agent zu erkennen:

BetfrikaBot/1.0 (+https://www.betfrika.org/bot)

Was er tut

  • Er liest nur wenige Seiten pro Website, zum Beispiel die Startseite, das Impressum, die Kontaktseite und die Seite „Über uns“. Er kann Ihre Sitemap nutzen, um sie zu finden, und liest sie regelmäßig erneut, um die Kontaktdaten aktuell zu halten.
  • Er liest eine Seite nach der anderen, mit einer Pause von mindestens einigen Sekunden zwischen zwei Seiten derselben Website.
  • Er beachtet Ihre robots.txt: die Regeln für User-agent: BetfrikaBot oder, falls es keine gibt, für User-agent: *, sowie Crawl-delay.
  • Er beachtet Content-Signal: BetfrikaBot gibt den Text Ihrer Seiten an kein KI-Modell weiter, wenn Ihre Website dies untersagt (ai-input=no).

Was er nie tut

  • Eine Ablehnung umgehen: eine Antwort 401, 403 oder 429, ein Captcha oder eine Anti-Bot-Seite, eine Disallow-Regel.
  • Sich als Browser oder als anderer Crawler ausgeben.
  • Ein Konto anlegen, ein Formular ausfüllen oder eine Bezahlschranke umgehen.
  • Fotos speichern.

Was wir speichern und wie lange

Er erfasst insbesondere die geschäftlichen Kontaktdaten der Organisation (allgemeine E-Mail-Adresse, Telefonnummer, Postanschrift, Website), ihre Rechtsform und Registernummer, ihre Social-Media-Konten, die Sprachen ihrer Website, eine kurze Beschreibung ihrer Tätigkeit und, je nach Art der Organisation, was die Website über die Organisation selbst veröffentlicht, zum Beispiel die Konfession einer Kirchengemeinde oder die Herkunft ihrer Gemeinschaft. Diese Angaben betreffen die Organisation, nie eine Person.

Die gelesenen Seiten und die Zwischenergebnisse unserer Werkzeuge werden höchstens 90 Tage gespeichert (der HTML-Code der Seiten 14 Tage), um zu prüfen, was aus ihnen übernommen wurde.

Die Kontaktdaten der Organisation werden gespeichert, solange sie unserer Beziehung zu ihr dienen. Sie werden regelmäßig erneut geprüft und auf Anfrage gelöscht.

Eine personenbezogene Adresse oder Nummer, die auf einer Seite steht, wird als solche markiert, nie verwendet, um Sie zu kontaktieren, und mit den Seiten spätestens nach 90 Tagen gelöscht.

Rechtsgrundlage: das berechtigte Interesse des Vereins, einer Organisation eine Partnerschaft anzubieten (Art. 6 Abs. 1 lit. f DSGVO).

Woher diese Daten stammen

  • Die öffentlichen Seiten der Website der Organisation.
  • Öffentliche Verzeichnisse, zum Beispiel die von Kirchenverbänden.
  • Suchdienste, um die Adresse der Website zu finden.
  • Was wir bereits über die Organisation wussten (unsere Unterlagen, eine Begegnung, ein Austausch).

Wer sie erhält

  • Unsere Server in der Europäischen Union (Microsoft Azure, in Deutschland und Irland).
  • Die Suchdienste Serper und Google erhalten den Namen und den Ort der Organisation sowie ein Wort, das ihre Art angibt (zum Beispiel „Kirche“), um ihre Website zu finden, nie den Inhalt der Seiten.
  • Anthropic (USA) erhält den Text einiger Seiten, um die Organisation zu beschreiben: ihre Tätigkeit und, je nach Art, ihre Konfession oder die Herkunft ihrer Gemeinschaft. Zuvor entfernen wir daraus E-Mail-Adressen, Telefonnummern und, soweit möglich, Namen von Personen. Nie, wenn die Website dies untersagt (ai-input=no).

So sperren Sie ihn

Fügen Sie diese zwei Zeilen in die Datei robots.txt Ihrer Website ein:

User-agent: BetfrikaBot
Disallow: /

BetfrikaBot liest Ihre robots.txt, bevor er Ihre Website liest, und ruft sie danach spätestens nach 24 Stunden erneut ab: Die Regel gilt ab diesem neuen Abruf. Für einen schnellstmöglichen Stopp schreiben Sie uns (siehe unten).

Kontakt, Widerspruch und Löschung

Auskunft, Berichtigung, Löschung, Einschränkung, Widerspruch: privacy@betfrika.org

Eine Frage zum Crawler: info@betfrika.org

Bitte nennen Sie in Ihrer Nachricht die Adresse Ihrer Website.

Wir erfassen Ihren Widerspruch: BetfrikaBot liest Ihre Website nicht mehr, und Ihre Organisation wird aus unseren Kontaktaufnahmen entfernt. Sie können auch Auskunft über die von uns erfassten Kontaktdaten, ihre Berichtigung, ihre Löschung oder die Einschränkung ihrer Verarbeitung verlangen.

Sie können sich außerdem bei einer Datenschutzaufsichtsbehörde beschweren, zum Beispiel bei der Ihres Landes.

Ihre Rechte und wie wir Daten verarbeiten: Datenschutzrichtlinie