Zum Hauptinhalt springen

SE::Rambler - Rambler SERP Parser

img

Übersicht des Parsers

Parser für die Rambler-Suchergebnisse. Dank des Rambler-Parsers können Sie große Datenbanken mit Links erstellen, die für die weitere Verwendung bereit sind. Sie können Abfragen in derselben Form verwenden, wie Sie sie in die Rambler-Suchzeile eingeben, einschließlich Suchoperatoren (site usw.).

Die Funktionalität von A-Parser ermöglicht es Ihnen, die Datenerfassung-Einstellungen des Rambler-Parsers für die spätere Verwendung zu speichern (Presets), Zeitpläne für die Datenerfassung festzulegen und vieles mehr. Sie können die automatische Abfragevervielfältigung, die Ersetzung von Unterabfragen aus Dateien, das Durchlaufen von alphanumerischen Kombinationen und Listen nutzen, um die maximal mögliche Anzahl an Ergebnissen zu erzielen.

Das Speichern der Ergebnisse ist in der von Ihnen benötigten Form und Struktur möglich, dank des integrierten leistungsstarken Vorlagensystems Template Toolkit, das es ermöglicht, zusätzliche Logik auf die Ergebnisse anzuwenden und Daten in verschiedenen Formaten auszugeben, einschließlich JSON, SQL und CSV.

Gesammelte Daten

  • $totalcount — Anzahl der Ergebnisse in der Ausgabe. Nur von der ersten Seite; wenn keine Zahl vorhanden ist — leer
  • $serp.$i.link, $serp.$i.anchor, $serp.$i.snippet — Link, Anker, Snippet
  • $hints.$i.hint — verwandte Keywords. Nur von der ersten Seite; wenn keine Hinweise vorhanden sind — leer

Welche Daten der SE::Rambler-Parser sammelt

Funktionen

  • Unterstützung von Suchoperatoren von Rambler (url:, site:, inurl:, host:, rhost:, domain:)
  • Bis zu 25 Seiten, nicht mehr als ~250 Ergebnisse
  • Verwandte Keywords ($hints.$i.hint)
  • Ausgabe-Gerät: Desktop, mobiles Android oder mobiles iOS

Anwendungsfälle

  • Erstellung von Link-Datenbanken
  • Bewertung des Wettbewerbs für Keywords
  • Suche nach Backlinks (Erwähnungen) von Websites
  • Alle Fälle, in denen Rambler-Suchergebnisse extrahiert werden müssen

Abfragen

Geben Sie Abfragen so an, wie in der Rambler-Suche. Angenommen, es werden nur Links von einer Website benötigt. Geben Sie im Abfragefeld ein:

"türen kaufen" site:http://kp.ru

Abfrage-Ersetzungen

Sie können integrierte Makros zur Abfragevervielfältigung verwenden. Wenn wir beispielsweise eine sehr große Datenbank mit Foren erhalten möchten, geben wir einige Hauptabfragen in verschiedenen Sprachen an:

forum
forum
foro
论坛

Im Abfrageformat geben wir den Durchlauf von Zeichen von a bis zzzz an. Diese Methode ermöglicht eine maximale Rotation der Suchergebnisse und den Erhalt vieler neuer eindeutiger Ergebnisse:

$query {az:a:zzzz}

Dieser Makro erstellt 475254 zusätzliche Abfragen für jede ursprüngliche Suchanfrage, was insgesamt 4 x 475254 = 1901016 Suchanfragen ergibt. Diese beeindruckende Zahl ist für A-Parser absolut kein Problem. Bei einer Geschwindigkeit von 2000 Abfragen pro Minute wird eine solche Aufgabe in nur 16 Stunden verarbeitet.

Verwendung von Operatoren

Sie können Suchoperatoren im Abfrageformat verwenden, sodass diese automatisch zu jeder Abfrage aus Ihrer Liste hinzugefügt werden:

site:$query

Ausgabebeispiele

A-Parser unterstützt eine flexible Formatierung der Ergebnisse dank des integrierten Ergebnis-Builders, was es ermöglicht, Ergebnisse in beliebiger Form sowie strukturiert wie CSV oder JSON auszugeben.

Export der Linkliste

Ähnlich wie bei SE::Google.

Ähnlich wie bei SE::Google.

Ähnlich wie bei SE::Google.

Ergebnisformat:

$hints.format('$hint\n')

Ergebnisbeispiel:

habrahabr
habr
habrahabr ru
xabra
livebusiness
eureka
elektronischer buchhalter
insel elba
elba elektronischer buchhalter
habrahabr
...

Speichern im SQL-Format

Ähnlich wie bei SE::Google.

Ergebnis-Dump in JSON

Ähnlich wie bei SE::Google.

Ergebnisverarbeitung

A-Parser ermöglicht die Verarbeitung von Ergebnissen direkt während der Datenerfassung. In diesem Abschnitt haben wir die beliebtesten Anwendungsfälle für den Rambler-Parser zusammengestellt

Ähnlich wie bei SE::Google.

Ähnlich wie bei SE::Google.

Extraktion von Domains

Ähnlich wie bei SE::Google.

Entfernen von Tags aus Ankern und Snippets

Ähnlich wie bei SE::Google.

Ähnlich wie bei SE::Google.

Mögliche Einstellungen

ParameternameStandardwertBeschreibung
DeviceDesktopAusgabegerät: Desktop, mobiles Android oder mobiles iOS
Wait for soft captcha, sec (0 = ban)25Wie viele Sekunden auf das Bestehen des Soft-Captchas gewartet werden soll. 0 — Proxy sofort sperren
Page load timeout, sec20Zeitüberschreitung beim Laden der Seite
Pages count5Anzahl der zu scrapenden Seiten, 1–25. Rambler liefert nicht mehr als ~250 Ergebnisse, daher hängt die maximale Seitenzahl von Links per page ab: 10 Ergebnisse → 25 Seiten, 15 → 17 Seiten, 30 → 8 Seiten, 50 → 5 Seiten.
Links per page10Ergebnisse pro Seite: 10 / 15 / 30 / 50
Rambler region IDRegions-ID. IP nicht aus der GUS — Moskau. IP aus der GUS — Ausgabe nach IP oder nach dieser ID, falls angegeben. Wie man die ID herausfindet — hier
SortSites by relevanceSortierung: Pages by relevance, Pages by date, Sites by relevance, Sites by date
Results filteringModerateFilter: Unrestricted, Moderate, Family search
Results languageAny languageSprache der Ergebnisse: beliebig oder Belarusian, English, German, French, Kazakh, Russian, Tatar, Turkish, Ukrainian
Serp timeAnytimeZeitraum: Anytime, Past 24 hours, Past week, Past month
Results typeAny formatDokumenttyp: beliebig oder pdf, doc, rtf, xls, ppt, swf, odt, ods, odp, odg
Exact matchExakte Übereinstimmung mit der Abfrage
Disable autocorrectDeaktiviert die Autokorrektur, extrahiert Ergebnisse für die angegebene Abfrage
Max concurrent browser pages10Wie viele Browser-Tabs der Parser gleichzeitig offen hält. Bei einer hohen Anzahl von Threads vorsichtig erhöhen — die Belastung von Speicher und CPU steigt
Use sessionsSpeichert gute Sitzungen, weniger Fehler, schnellere Datenerfassung
Headless browserBrowser ohne Fenster. Zur Fehlerbehebung das Häkchen entfernen