Tony Wang4 Min. LesezeitBrave Search scrapen 2026 (API & Python)
Drei Wege, Brave Search 2026 zu scrapen — DIY-Python, No-Code-Tools oder strukturierte API für Web-, News- und Video-Ergebnisse, samt Rechtsgrundlagen.
Der schnellste Weg, Brave Search 2026 zu scrapen, ist der Aufruf einer strukturierten Such-API, die normalisiertes JSON zurückgibt — organische Ergebnisse mit Titeln, URLs, Snippets und Ranking-Positionen, dazu News-, Video- und Diskussions-Module — statt selbst einen Headless-Browser durch Braves Anti-Bot-Abwehr zu steuern. Du kannst zwar weiterhin einen DIY-Scraper in Python bauen, aber Braves sich ändernde Markup-Struktur und die Rate-Limits machen es teuer, ihn am Laufen zu halten, und Braves eigene API rechnet pro Query ab.
Brave betreibt einen eigenen, unabhängigen Suchindex — kein Google- oder Bing-Reseller — und genau deshalb sammeln Teams ihn: Er liefert Abdeckung jenseits von Google und Bing für Rank-Tracking, Quellenvielfalt und AI-Grounding-Workflows.
Ist es legal, Brave Search zu scrapen?
Das Scrapen öffentlicher Suchergebnisse wird in der Regel anders behandelt als der Zugriff auf private oder Paywall-geschützte Daten, aber "öffentlich" ist kein Freibrief. Die praktischen Faustregeln:
- Sammle nur öffentliche Ergebnisseiten — keine Logins, keine persönlichen Konten.
- Respektiere Rate-Limits und beeinträchtige den Dienst nicht.
- Prüfe Braves Nutzungsbedingungen und dein lokales Recht vor kommerzieller Nutzung; du bist dafür verantwortlich, wie du die Daten verwendest.
- Speichere und verarbeite Ergebnisse rechtskonform, besonders alles, was personenbezogene Daten sein könnten.
Nichts davon ist eine Rechtsberatung — siehe Ist Web Scraping 2026 legal? für die ausführliche Fassung, inklusive des Kontexts zu hiQ v. LinkedIn und dem CFAA.
Option 1: DIY in Python (und warum es scheitert)
Ein naiver Ansatz ruft die Ergebnisseite ab und parst das HTML:
import requests
from bs4 import BeautifulSoup
resp = requests.get(
"https://search.brave.com/search",
params={"q": "ai agents"},
headers={"User-Agent": "Mozilla/5.0", "Accept-Language": "en-US,en;q=0.9"},
)
soup = BeautifulSoup(resp.text, "html.parser")
# Brave's result blocks are unlabeled and shift often — reverse-engineer selectors per block,
# normalize to a stable shape, then export (e.g. with csv.DictWriter(...).writerows(rows))
Das funktioniert einmal und geht dann kaputt. Die wiederkehrenden Kosten:
- Anti-Bot-Abwehr markiert Rechenzentrums-IPs und ungewöhnliche Request-Muster, du brauchst also rotierende Proxys.
- Markup-Drift — Ergebnis-Container und Klassennamen ändern sich, und deine Selektoren liefern stillschweigend nichts mehr zurück.
- Modulvielfalt — News, Videos, Diskussionen und Knowledge-Cards brauchen jeweils einen eigenen Parser.
- Keine Struktur — du musst weiterhin alles selbst in ein stabiles Schema normalisieren.
Der größte Teil der Kosten ist nicht der erste Scrape — es ist, ihn über Layout- und Anti-Bot-Änderungen hinweg am Leben zu halten.
Option 2: No-Code- und fertige Tools
Browser-Erweiterungen und Point-and-Click-Scraper eignen sich für einen einmaligen Export, aber in einer Daten-Pipeline sind sie unpraktisch: Sie lassen sich schwer planen, schwer versionieren und gehen weiterhin kaputt, wenn sich die Seite ändert. Für wiederkehrende Sammlung, die ein Produkt oder Dashboard speist, passt eine API besser.
Option 3: Eine strukturierte Brave Search API
Crawloras Brave Search API kapselt Request-Handling, Proxy-Routing, Parsing und Normalisierung hinter einem dokumentierten Endpoint. Du sendest eine Query und bekommst normalisiertes JSON zurück.
curl -G "https://api.crawlora.net/api/v1/brave/search" \
-H "x-api-key: $CRAWLORA_API_KEY" \
--data-urlencode "q=ai agents" \
--data-urlencode "country=us" \
--data-urlencode "lang=en-us"
import requests
resp = requests.get(
"https://api.crawlora.net/api/v1/brave/search",
headers={"x-api-key": "YOUR_API_KEY"},
params={"q": "ai agents", "country": "us", "lang": "en-us"},
)
for row in resp.json()["data"]["results"]:
print(row["position"], row["title"], row["url"])
Eine Response ist normalisiertes JSON, das du direkt speichern kannst (die gezeigten Felder sind exemplarisch — prüfe die Docs für das aktuelle Schema):
{
"code": 200,
"msg": "OK",
"data": {
"query": "ai agents",
"results": [
{
"position": 1,
"title": "Example result title",
"url": "https://example.com/",
"hostname": "example.com",
"description": "Snippet text shown under the result."
}
],
"news": [],
"videos": []
}
}
Derselbe Key deckt alle Ergebnistypen ab — paginiere mit offset oder rufe die News-, Video- und Image-Endpoints auf:
news = requests.get("https://api.crawlora.net/api/v1/brave/news",
headers={"x-api-key": "YOUR_API_KEY"}, params={"q": "ai agents"}).json()["data"]
videos = requests.get("https://api.crawlora.net/api/v1/brave/videos",
headers={"x-api-key": "YOUR_API_KEY"}, params={"q": "ai agents"}).json()["data"]
Ein Crawlora-API-Key ruft jeden Endpoint auf — kein Azure-artiges Projekt und keine Abrechnung pro Query, die du einplanen musst.
Was du sammeln kannst
- Organische Web-Ergebnisse: Position, Titel, URL, Hostname und Description-Snippet
- Verwandte Suchanfragen und Diskussionsergebnisse, wo Brave sie zurückgibt
- News-, Video- und Image-Module über ihre dedizierten Endpoints
- Pagination über
offsetund Länder-/Sprachlokalisierung übercountryundlang
Einschränkungen und typische Herausforderungen
- Braves eigene API rechnet ab. Brave bietet eine offizielle Search API, aber Anfang 2026 gibt es keinen klassischen Free-Tier — neue Nutzer bekommen etwa $5 an monatlichen Credits (~1.000 Queries) und zahlen darüber hinaus pro Query. Crawloras Brave-Endpoint ist Credit-basiert über denselben Key wie Google und Bing.
- Unabhängiger Index, andere Ergebnisse. Braves Index mit ~30 Milliarden Seiten rankt anders als Google und Bing — das ist gerade der Punkt, aber erwarte abweichende Abdeckung und Reihenfolge und tracke es daher als eigene Reihe.
- Anti-Bot bei DIY. Direktes Scrapen stößt auf Rechenzentrums-IP-Markierungen und wechselndes, nicht gekennzeichnetes Markup; eine strukturierte API übernimmt Proxys, Rendering und Normalisierung hinter einem Key.
- Parsing pro Modul. News-, Video-, Image- und Diskussionsblöcke haben jeweils ihr eigenes Format; nutze die dedizierten Endpoints statt eines einzigen riesigen Parsers.
Quellen
Wo das hineinpasst
Probier es zuerst kostenlos aus: Schick eine beliebige öffentliche URL durch den Free Web Scraper oder prüfe mit dem Anti-Bot Checker, ob eine Seite Bots blockiert — ohne Anmeldung.
Brave ist am nützlichsten als zweite oder dritte Engine neben Google und Bing. Schickst du dieselben Keywords durch jede, erkennst du, ob eine Ranking-Bewegung seitenweit oder engine-spezifisch ist — siehe wie SERP-Monitoring-APIs funktionieren und den Use Case SERP-Monitoring. Für engine-übergreifendes Rank-Tracking kombiniere es mit der Bing Search API und der Google Search API; die Response-Formate sind einheitlich, sodass derselbe Code alle drei gleichzeitig erfasst. Um zu beurteilen, ob sich eine Ranking-Bewegung lohnt, stelle die Engine-Ergebnisse neben die Suchnachfrage — siehe wie man Google Trends scrapt. Ist die Query lokal statt web-weit, wechsle zu Ortsergebnissen mit wie man Google Maps scrapt. Für einen breiteren Tool-Vergleich siehe die besten SERP APIs 2026.
Leg los, indem du den Endpoint im Playground testest, das Request- und Response-Schema in den API-Docs liest und die Credit-Kosten auf der Preisseite prüfst.
Häufig gestellte Fragen
Kann ich Brave Search scrapen, ohne blockiert zu werden?
Crawlora übernimmt Proxy-Routing, Request-Pacing und Retries hinter der API und gibt dokumentierte Fehler statt kaputtem HTML zurück, wenn eine Seite nicht verfügbar ist. Du rufst einen Endpoint auf und bekommst normalisiertes JSON.
Hat Brave eine offizielle Such-API?
Ja, aber sie rechnet ab: Anfang 2026 gibt es keinen klassischen Free-Tier — neue Nutzer bekommen etwa $5 an monatlichen Credits (~1.000 Queries) und zahlen darüber hinaus pro Query. Crawloras Brave-Search-Endpoint ist eine Credit-basierte Alternative, die Web-, News-, Video-, Image- und Suggestion-Ergebnisse als normalisiertes JSON über einen einzigen, mit Google und Bing geteilten Key zurückgibt.
Wie unterscheidet sich Brave Search von Google und Bing?
Brave betreibt einen eigenen, unabhängigen Index (~30 Milliarden Seiten, kein Google- oder Bing-Reseller), rankt Ergebnisse also anders und deckt Bereiche jenseits von Google und Bing für Rank-Tracking, Quellenvielfalt und AI-Grounding ab. Tracke es als eigene Reihe neben den anderen Engines.
Welche Daten gibt die Brave Search API zurück?
Organische Ergebnisse mit Position, Titel, URL, Hostname und Snippet, dazu verwandte Suchanfragen sowie News-, Video- und Image-Module, wo Brave sie einbindet. Nutze offset zum Paginieren und country und lang zum Lokalisieren.
Kann ich es für Rank-Tracking nutzen?
Ja. Jede Response enthält Ranking-Positionen und URLs, sodass ihr regelmäßiges Erfassen einen Brave-Rank-Tracker aufbaut. Schicke dieselben Keywords durch Google und Bing für den engine-übergreifenden Vergleich.
Wie oft kann ich die Daten aktualisieren?
So oft, wie es die Credits deines Plans erlauben. Jede Response spiegelt Brave zum Zeitpunkt der Anfrage wider, plane also wiederkehrende Snapshots, um Änderungen zu überwachen.