Anubis AI Scraper Firewall: Bots stoppen, Ihre Website schützen, Hosting-Kosten senken
Warum kleinere öffentliche Websites jetzt auf Anubis schauen
Wenn Sie eine öffentliche Dokumentations-Website, einen Blog, ein Forum oder eine kleine Web-App betreiben, tritt das Problem nicht immer mit dramatischen Ausfallzeiten auf. Häufiger zeigt es sich als stetiger Strom von Browser-ähnlichem automatisiertem Traffic. Diese Anfragen ziehen ständig Inhalte und zwingen Ihren Origin, Arbeit für Besucher zu leisten, die eigentlich gar keine Besucher sind. Die Website kann online bleiben, aber CPU-Zeit wird verschwendet, die Cache-Effizienz sinkt und Origin-Anfragen steigen für die falsche Zielgruppe. Mit der Zeit schwindet die Geduld der Betreiber.

Diese Art von Druck ist für verschiedene Leser aus verschiedenen Gründen wichtig.
- Entwickler spüren es als verschwendete Backend-Arbeit.
- Self-Hoster spüren es als Kontrollverlust über die öffentliche Eingangstür.
- Geschäftsführer und Website-Betreiber spüren es als höhere Hosting-Kosten, weniger stabile Performance und eine schlechtere Erfahrung für echte Besucher, wenn das Hintergrund-Rauschen zunimmt.
Die Schlüsselveränderung ist einfach: Scraping-Druck ist nicht mehr nur ein Problem von Hyperscale-Unternehmen. Auch kleinere öffentliche Websites können es spüren.
Deshalb ist Anubis interessant geworden. Es ist eine fokussierte Front-Gate-Schicht für Menschen, die missbräuchlichen Zugriff teurer machen möchten, ohne so zu tun, als würden sie eine komplette Sicherheitsplattform kaufen. Dieser Artikel ist eine fundierte Erklärung. Er behandelt, was Anubis ist, wie es funktioniert, welchen Wert es bietet und wann es passt.
Schnelle Schlüsselbegriffe, bevor wir beginnen

Sie benötigen nicht viel Vokabular, um dem Rest dieses Artikels zu folgen, aber einige Begriffe helfen, die Erklärung sauber zu halten. Der Punkt hier ist nicht, ein riesiges Sicherheitsglossar zu erstellen. Es geht darum, sicherzustellen, dass sich die späteren Abschnitte nicht schwieriger anfühlen als nötig.
| Begriff | Bedeutung in einfachem Deutsch |
|---|---|
| 🔄🖥️ reverse proxy | Ein Front-Door-Server, der zwischen Besuchern und Ihrer eigentlichen Website oder App sitzt und Anfragen verarbeitet, bevor sie den Origin erreichen. |
| 🤖 scraper bot | Ein automatisierter Client, der Seiten oder Endpunkte im großen Maßstab besucht, um Inhalte oder Daten zu sammeln. |
| ❓🛡️ challenge | Ein zusätzlicher Kontrollpunkt, den ein Client passieren muss, bevor er fortfahren kann; bei Anubis bedeutet das normalerweise Proof of Work, nicht automatisch ein CAPTCHA. |
| ⚡proof of work | Eine kleine Rechenaufgabe, die der Client ausführt, um zu zeigen, dass er Aufwand betreiben kann, bevor er durchkommt. |
| 🍪✍️ signed pass cookie | Ein temporärer, manipulationssicherer Besucherausweis, der im Browser gespeichert ist, damit der Client die Challenge nicht auf jeder Seite wiederholen muss. |
| 📜⚖️ policy rule | Eine Bedingung, die Anubis anweist, eine Anfrage zuzulassen, zu verweigern, herauszufordern oder zu bewerten. |
| ⚖️📊 request weight | Ein Verdachtswert in einfacher Sprache, der Anubis zu leichteren oder stärkeren Maßnahmen bewegt. |
| 🔥🛡️ WAF | Eine Web Application Firewall, die HTTP/HTTPS-Anfragen auf Web-App-Bedrohungen filtert; verwandt mit Anubis, aber nicht in der gleichen Kategorie. |
Was Anubis wirklich ist — und was nicht

Anubis ist eine Open-Source-AI-Scraper-Firewall. Genauer gesagt ist es ein Anti-Scraper-Reverse-Proxy, der sich vor einer Website oder Web-App befindet. Er entscheidet, ob eingehender Traffic passieren, herausgefordert oder abgelehnt werden soll, bevor die Origin die aufwändige Arbeit leistet. In Stack-Begriffen ist die Platzierung einfach:
visitor -> Anubis -> origin site/appDiese Platzierung ist der ganze Sinn. Anubis schützt Upstream-Ressourcen, indem es eine Entscheidungsebene an der Haustür platziert.
Der einfachste Weg, seine Rolle richtig zu verstehen, ist ein Vergleich mit den Ebenen, mit denen es am häufigsten verwechselt wird. Die Tabelle unten ist die praktische Version der Anubis vs WAF Frage.
| Ebene | Wo sie sich befindet | Was sie hauptsächlich handhabt | Was sie nicht ersetzt |
|---|---|---|---|
| Anubis | Vor einer Website oder Web-App als Anti-Scraper-Reverse-Proxy | Browser-ähnlicher oder verdächtiger Traffic, der passieren, herausgefordert oder abgelehnt werden soll, bevor die Origin mehr Aufwand betreibt | Sichere Anwendungsgestaltung, Patching, vollständige WAF-Aufgaben oder Upstream-Volumetrie-DDoS-Mitigation |
| WAF | Vor HTTP/HTTPS-Anwendungen | Web-Layer-Inspektion und Filterung basierend auf Pfaden, Headern, Payload-Mustern und häufigem Anwendungsangriffsverhalten | Host-Härtung, allgemeine Anti-Scraper-Wirtschaft oder Network-Layer-Mitigation |
| CDN / Edge-DDoS-Ebene | Bei dem Provider oder Network-Edge, bevor Traffic vollständig Ihren Host erreicht | Caching, Verteilung und breitere Edge-Filterung oder Traffic-Absorption | Anwendungssicherheit, Host-Level-Regeln oder Origin-seitige Richtlinienentscheidungen, die auf Ihre App zugeschnitten sind |
Deshalb ist es besonders relevant für Betreiber, die ihren eigenen Stack kontrollieren. Wenn Sie öffentliche Workloads auf einem VPS oder dedizierten Server hinter Ihrem eigenen Reverse-Proxy ausführen, ist Anubis leicht mental einzuordnen:
- es wird zu einem weiteren vom Betreiber kontrollierten Checkpoint vor der Origin.
- Es passt natürlich für Personen, die mehr Kontrolle über Route-Verhalten und Browser-ähnlichen Traffic möchten.
- Es eignet sich auch für Betreiber, die vertrauenswürdige Ausnahmen selbst verwalten möchten, anstatt das ganze Problem an ein verwaltetes Edge-Produkt abzugeben.
📝 Hinweis: Anubis ist keine klassische WAF, kein CDN und kein vollständiger DDoS-Service. Es ist ein fokussierter Reverse-Proxy-Checkpoint, der Upstream-Ressourcen vor Scraper-Druck schützen soll.
Genauso wichtig ist, dass viele Websites es überhaupt nicht brauchen. Dieser Satz sollte blunt bleiben, weil er wahr ist. Anubis ist nützlich, wenn Scraper-Druck real ist und der Betreiber eine fokussierte Front-Door-Ebene möchte. Es ist nicht etwas, das jede öffentliche Website installieren sollte, nur weil der Name das Wort „Firewall” enthält.
Wie Anubis funktioniert, Schritt für Schritt
Auf der einfachsten Ebene funktioniert Anubis wie ein Eingangstor mit einer Mautstelle. Eine Anfrage kommt an, Anubis hat das erste Wort, und der Ursprung wartet dahinter. Wenn die Anfrage unter der aktiven Richtlinie in Ordnung aussieht, kann sie weitergehen. Wenn sie einem strengeren Pfad entspricht, kann sie herausgefordert werden, bevor die eigentliche Website oder App mehr Arbeit leistet.
Der Anfragfluss sieht wie folgt aus:
visitor request
↓
Anubis
├─ allow straight through
├─ deny
└─ challenge when policy says so
↓
client solves proof of work
↓
Anubis verifies cheaply
↓
temporary signed badge cookie
↓
origin site/appDas wichtige Detail ist, dass Anubis richtliniengesteuert ist. Eingehende Anfragen werden gegen Regeln überprüft, die sie ALLOW, DENY, CHALLENGE oder WEIGH können. In einfachen Worten bedeutet das, dass das Tor etwas durchlassen, ablehnen, zusätzliche Anstrengungen erfordern oder seinen Verdachtswert erhöhen kann, bevor eine endgültige Entscheidung getroffen wird. Deshalb ist es irreführend, sich Anubis als „fordert jede Anfrage für immer heraus” vorzustellen. Nicht übereinstimmender Datenverkehr kann durchgelassen werden, während Browser-ähnlicher oder verdächtigerer Datenverkehr aggressiver behandelt werden kann.
📝 Hinweis: Anubis ist nicht eine riesige hartcodierte Herausforderungsseite. Es folgt Richtlinienregeln, und nicht jede Anfrage muss herausgefordert werden, damit das Tool seine Aufgabe erfüllt.

Wenn eine Herausforderung verwendet wird, ist die Hauptidee ein Arbeitsnachweis. Stellen Sie sich das als kleine Maut vor. Der Client muss eine bescheidene Menge an Berechnung durchführen, bevor er durchkommt, während Anubis das Ergebnis nur günstig überprüfen muss. Für einen normalen Besucher ist diese zusätzliche Arbeit normalerweise höchstens ein kleines Ärgernis. Für einen Scraper, der versucht, den Prozess über große Mengen an Datenverkehr zu wiederholen, beginnt sich die Wirtschaft zu ändern. Das Ziel ist nicht, das Scraping mathematisch unmöglich zu machen. Das Ziel ist, es nicht mehr billig und reibungslos zu machen.
Sobald ein Besucher durchkommt, kann Anubis ein signiertes Pass-Cookie ausstellen. Die einfachste Art, sich dieses Cookie vorzustellen, ist als temporärer Besucherausweis. Der Besucher hat das Tor bereits passiert, daher muss er die Maut nicht bei jedem einzelnen Seitenladevorgang erneut zahlen. Das reduziert wiederholte Reibung für legitimes Browsing, während die Kontrolle vor dem Ursprung erhalten bleibt. Der Ausweis ist absichtlich temporär: Er hilft dem System, sich daran zu erinnern, dass ein Client kürzlich durchgekommen ist, ohne einen Erfolg in permanentes Vertrauen umzuwandeln.

Moderne Anubis-Richtlinien können auch differenzierter sein als eine einfache Pass-oder-Challenge-Aufteilung. Request Weighting ermöglicht es Regeln, Verdacht hinzuzufügen oder zu entfernen, sodass verschiedene Schwellenwerte leichtere oder stärkere Behandlung auslösen können. Vertrauenswürdige Ausnahmen, sichere Pfade und bekannte Automatisierung können anders behandelt werden als generischer Browser-ähnlicher Datenverkehr. Einige Bereitstellungen überprüfen den Datenverkehr auch von Zeit zu Zeit erneut, anstatt anzunehmen, dass ein früherer Pass für immer anhalten sollte. Diese Abstimmungsebene ist wichtig, aber das Kernmodell ist immer noch das gleiche Eingangstor plus Mautstelle.
Eine letzte Nuance ist erwähnenswert: Das Bestehen einer Herausforderung beweist nicht, dass ein Besucher menschlich ist. Es beweist, dass der Client das konfigurierte Tor passiert hat. Einige Bereitstellungen können auch nicht-JavaScript-Challenge-Modi verwenden, aber die Hauptgeschichte von Anubis ist immer noch Arbeitsnachweis plus ein temporärer Pass. Sobald Sie es so sehen, wird der praktische Wert viel leichter zu beurteilen.
Was Anubis praktisch für Sie tun kann

Der praktische Wert von Anubis liegt nicht in magischer Bot-Klassifizierung. Es geht um Kostenverlagerung. Wenn großflächiges Scraping an der Eingangstür mehr Arbeit leisten muss, leistet Ihr Origin weniger unnötige Arbeit dahinter. Das kann weniger verschwendete Origin-Anfragen und weniger sinnlose Backend-Verarbeitung bedeuten. Es kann auch mehr Platz für echte Besucher schaffen, wenn missbräuchlicher Traffic die Website belastet.
Das ist am wichtigsten auf Websites und Apps, bei denen der Inhalt öffentlich und leicht wiederholt anzusteuern ist.
- Dokumentationsportale
- Blogs, Foren
- Dashboards
- selbstgehostete Web-Tools
- kleine SaaS-Front-Ends
- Code- oder Web-Schnittstellen
Dynamische Seiten und Backend-Ressourcen profitieren besonders, da sie oft teurer zu bedienen sind als ein statisches Asset. Selbst wenn die Website nicht „ausfällt”, kann die Reduzierung vermeidbarer Arbeit an der Eingangstür die Reaktionsfähigkeit dort schützen, wo Benutzer sie spüren.

Eine andere Möglichkeit, den Vorteil zu rahmen, ist Atemraum. Dieser Atemraum zeigt sich auf konkrete Weise: weniger unnötige App-Aufweckungen, weniger Cache-Churn und weniger Momente, in denen legitime Benutzer eine Verlangsamung spüren, obwohl technisch nichts kaputt ist. Anubis macht einen Server nicht schneller; es reduziert, wie oft Low-Value-Traffic eine vollständige Runde im Backend erhält.
Es gibt auch einen Kontrollavorteil. Mit Anubis kann der Betreiber das Verhalten gestalten, anstatt jede Anfrage identisch zu behandeln.
- Einige Routen können leicht zugänglich sein.
- Einige vertrauenswürdige Bots oder Automatisierungspfade können auf die Allowlist gesetzt werden.
- Einiger Browser-ähnlicher Traffic kann aggressiver herausgefordert werden.
Das ist der echte operative Gewinn: nicht eine mystische Fähigkeit zu wissen, wer gut oder schlecht ist, sondern ein nutzbarer Satz von Traffic-Handling-Entscheidungen, die damit übereinstimmen, wie die Website verwendet werden soll.
Für Leser, die sich das bereits in Hosting-Begriffen vorstellen, ist die Platzierung unkompliziert. Wenn Sie öffentliche Dienste hinter Nginx oder Caddy auf einem AlexHost VPS oder dedizierten Server betreiben, bedeutet das normalerweise, Anubis vor dem App-Pfad zu platzieren, den Sie bereits verwalten, damit generischer Web-Traffic gefiltert wird, bevor er das Backend aufweckt. Der Rest des Stacks bleibt gleich; der Unterschied besteht darin, dass Ihr Origin nicht mehr jede Anfrage gleich behandelt.
Die Grenzen und Kompromisse, die Sie kennen sollten
Der schnellste Weg, Anubis falsch zu verstehen, ist, “Firewall” zu lesen und totalen Schutz anzunehmen. Das Tool hat eine engere Aufgabe. Es patcht keinen anfälligen Code und schließt keine exponierten Services. Es absorbiert keinen gesättigten Uplink und ersetzt keine WAF, CDN oder DDoS-Service. Wenn Ihr Hauptproblem auf einer dieser Ebenen liegt, ist Anubis nicht das Tool, das es behebt.

Es lässt auch entschlossene Automatisierung nicht verschwinden. Fortgeschrittene Headless-Browser können JavaScript ausführen. Sie können auch Cookies speichern, Anfragen erneut versuchen und Arbeit lösen. Die Erfolgsbedingung ist einfach anders: Scraping wird teurer, weniger praktisch und weniger sanft auf der Seite des Angreifers als zuvor.
⚠️ Warnung: No-JS-Zugriff ist eine Kompromisszone. Die aktuelle Anubis-Dokumentation enthält eine No-JS-metarefresh-Option, aber sie ist nicht der Standard-Pfad und weniger diskriminierend, daher sollte sie als Kompatibilitätskompromiss behandelt werden, nicht als Hauptschutzgeschichte.
Dieser Kompromiss ist wichtig, weil einige legitime Besucher gehärtete Datenschutz-Setups oder absichtlich begrenzte Browser verwenden. Ein JavaScript-gestützter Challenge-Pfad kann sie frustrieren, auch wenn sie nichts Missbräuchliches tun. Die No-JS-Option hilft in einigen Fällen. Aber sie schwächt auch die Diskriminierungsgeschichte, weil moderne Scraper bereits wie echte Browser agieren können. Mit anderen Worten: Barrierefreiheit und Reibung sollten ehrlich beurteilt werden, anstatt sie zu ignorieren.

Discovery und Automatisierung bringen einen zweiten Kompromiss mit sich:
- Suchmaschinen und Archivierungs-Bots müssen möglicherweise auf die Allowlist gesetzt werden.
- Feeds, Monitoring und andere legitime Automatisierung benötigen möglicherweise eine sorgfältigere Richtlinienbehandlung.
Wenn Sie unvorsichtig sind, können Sie es Ihrer Website schwerer machen, indexiert oder archiviert zu werden. Sie können es auch schwerer machen, sich mit Tools zu integrieren, die tatsächlich nützlich sind. Das macht Anubis nicht zu einem schlechten Tool. Es bedeutet, dass der Betreiber entscheiden muss, welcher Traffic einen einfachen Pfad verdient und welcher Traffic einen schwierigeren verdient.
Und manchmal ist die sauberste Antwort, es zu überspringen. Eine Website mit niedriger Exposition oder ein nur intern zugänglicher Service können mehr Reibung als Wert aus dem Hinzufügen von Anubis bekommen. Das Gleiche kann für ein Team gelten, das bereits mit einer verwalteten Edge-Plattform zufrieden ist. Es gilt auch, wenn das eigentliche Problem unsicherer Anwendungscode oder gesättigte Upstream-Bandbreite ist. Wenn das Problem anderswo liegt, fügt das Hinzufügen eines Scraper-Gates nur zusätzliche Komplexität um den falschen Engpass hinzu.
Wenn Anubis Sinn macht — und wann es Overkill ist
Anubis macht am meisten Sinn, wenn drei Dinge gleichzeitig wahr sind:
- 🌍🔓 der Service ist öffentlich
- 🤖⚠️ der Scraper-Druck ist real genug, um operativ störend zu sein
- 🔄🖥️ der Betreiber möchte die Kontrolle über die Reverse-Proxy-Schicht an der Eingangstür
Öffentliche Dokumentationen, Foren, Blogs, selbst gehostete Apps und kleine SaaS-Oberflächen sind starke Beispiele. Sie stellen Inhalte offen zur Verfügung, hängen aber immer noch von Origin-Ressourcen ab, die es wert sind, geschützt zu werden.
Die Entscheidung wird einfacher, wenn man sie auf einige häufige Situationen reduziert:
| Situation | Beste Lösung | Warum |
|---|---|---|
| Ihre öffentliche Dokumentations-Website, Ihr Forum, Blog oder selbst gehostete App sieht bereits Browser-ähnliches Scraping, und Sie kontrollieren den Front-End-Proxy | Erwägen Sie es | Anubis ist genau für diese Art von Front-Door-Kostenverschiebung und Ressourcenschutz gebaut |
| Ihre öffentliche App benötigt auch umfassendere App-Sicherheit, CDN/Edge-Kontrollen oder vorgelagerte DDoS-Behandlung | Kombinieren Sie es | Anubis kann bei Scraper-Druck helfen, gehört aber immer noch neben WAF-Regeln, App-Härtung und vorgelagerter Mitigation, wo nötig |
| Ihre Website hat niedrige Exposition, ist nur intern, wird bereits gut von einer verwalteten Edge-Plattform bedient, oder leidet hauptsächlich unter anfälligem Code oder gesättigter Bandbreite | Wahrscheinlich überspringen | Die zusätzliche Reibung und Policy-Komplexität passen nicht zum echten Problem |
Die beste Passung setzt auch Betreiber-Bereitschaft voraus. Anubis ist konzeptionell einfach, fügt aber immer noch Policy-Ownership auf der Proxy-Schicht hinzu. Jemand muss entscheiden, was leicht passieren soll und was herausgefordert werden soll. Sie müssen auch entscheiden, welche Bots oder Feeds Ausnahmen verdienen, und wie viel Reibung das Publikum tolerieren wird. Wenn niemand im Team diese Entscheidungen treffen möchte, kann eine technisch relevante Schicht immer noch zu operativem Ballast werden.

Die mittlere Kategorie ist wichtig, weil viele echte Umgebungen von Natur aus geschichtet sind. Wenn Scraper-Druck nur ein Teil des Bildes ist, kann Anubis immer noch einen Platz verdienen, braucht aber nur einen Job: Browser-ähnlichen Traffic mit hohen Kosten filtern, bevor er die App erreicht. Andere Kontrollen kümmern sich immer noch um ihre eigenen Jobs — sichere Codierung, anwendungsorientierte Filterung, Traffic-Verteilung und Netzwerk-Scale-Schutz.
💡 Tipp:Der einfachere Test ist dieser: Wenn Scraper-Traffic keinen messbaren operativen Widerstand erzeugt, ist Anubis wahrscheinlich nicht die Schicht, die das Ergebnis ändert. Das Gleiche gilt, wenn Ihr echtes Problem von anfälligem Code oder vorgelagerter Sättigung kommt. Wenn Scraper-Kosten wirklich in Ihren Logs und im Host-Verhalten auftauchen, wird es zu einem vernünftigen, fokussierten Tool, das man in Betracht ziehen sollte.
Anubis ist eine fokussierte Schicht, die echte Probleme löst

Wenn Sie zum Eröffnungsszenario zurückgehen, wird der echte Reiz von Anubis deutlich. Es ist für die öffentliche Website, die nicht spektakulär zusammenbricht, sondern Tag für Tag stillschweigend Scraper-Kosten aufnimmt. In dieser Situation lohnt es sich, Anubis zu verstehen, da es Ihnen eine Reverse-Proxy-Schicht bietet, die missbräuchliche Zugriffe verlangsamen kann, bevor der Origin weiterhin dafür bezahlen muss.
Die dauerhafte Erkenntnis ist einfach: Anubis erhöht die Kosten für großflächiges Scraping und hilft, Origin-Ressourcen zu schützen, gehört aber immer noch in einen breiteren, realitätsgestützten Schutzstapel. Wenn Sie Ihren eigenen VPS, dedizierten Server oder Reverse-Proxy-Pfad kontrollieren, ist es normalerweise einfacher, zu verstehen, wo eine solche Schicht passt, bevor Scraper-Druck zur Frage wird, die die Entscheidung erzwingt.
bei allen Hosting-Diensten