Passer au contenu principal

Shop::Wildberries::ProductInfo - scraper de page produit Wildberries

img

Présentation du scraper

En utilisant le scraper de produits Wildberries, vous pouvez obtenir les données de la fiche produit via des liens vers les produits ou par NM ID.

La fonctionnalité d'A-Parser permet de sauvegarder les paramètres de collecte de données pour une utilisation ultérieure (présélections), de définir un calendrier de collecte de données et bien plus encore. Vous pouvez utiliser la multiplication automatique des requêtes, la substitution de sous-requêtes à partir de fichiers, l'itération de combinaisons alphanumériques et de listes pour obtenir le maximum de résultats possible.

Données collectées

img

Principales

  • Nom du produit ($title)
  • Chemin de la catégorie sur WB ($category)
  • Marque ($brand)
  • Lien vers la marque/catégorie sur WB ($brandSubUrl)
  • Article, nm ID ($sku). Si le produit n'existe pas — seul $sku est rempli
  • Description ($description)
  • Pays de fabrication ($country)
  • Couleurs, séparées par ; ($colors)

Prix et stock

  • Ancien prix, barré sur le site ($price) — hors livraison
  • Prix avec remise ($discountPrice) — hors livraison
  • Livraison séparée ($logisticsPrice) ; si absente — 0
  • Prix avec WB Wallet ($walletPrice) — uniquement avec Currency = RUB ; remise d'environ 2% sur $discountPrice, hors livraison ; pas pour tous les produits — sinon 0
  • Stock restant ($qty) — n'est pas le nombre de ventes

Calculez vous-même le prix final « comme sur le site » dans le gabarit, par exemple $discountPrice + $logisticsPrice (sur la vitrine WB, la somme peut dépendre du point de retrait, le scraper fournit les composants séparément).

Vendeur

  • Nom du vendeur ($seller)
  • Lien vers le vendeur ($sellerUrl)
  • Nom légal de l'entreprise ($sellerLegalName)
  • INN ($inn)
  • OGRN ($ogrn)
  • Marque commerciale ($trademark)
  • Adresse légale ($legalAddress)

Avis

  • Nombre d'avis ($comments)
  • Note du produit ($rating)

Tableaux

  • Photos ($photos.$i.url) — liens vers les images du produit
  • Historique des prix ($prices.$i.date, $prices.$i.price) — nombre de dates variable selon les produits ; l'historique peut être absent pour certains produits
  • Tags de recherche WB ($tags.$i.tag) — « Les clients ont aussi recherché »

Cas d'utilisation

  • Suivi de la dynamique des prix des produits
  • Évaluation des produits par note, avis et disponibilité
  • Collecte de toutes les images des produits

Requêtes

En tant que requêtes — lien vers la fiche (n'importe quelle zone wildberries.*) ou card=<NM ID> :

https://www.wildberries.ru/catalog/13823047/detail.aspx
https://www.wildberries.ru/catalog/12622014/detail.aspx?targetUrl=MI
https://www.wildberries.ru/catalog/4068082/detail.aspx?targetUrl=MI
card=4068082

Substitutions de requêtes

Vous pouvez utiliser les macros intégrées de substitution de requêtes. Par exemple, nous voulons que le scraper insère automatiquement et successivement le numéro d'article dans le lien du produit de 1 à 100 000. Pour cela, on peut appliquer la macro {num:START:END}. Comme requête, indiquons le lien vers n'importe quel produit et à la place de l'article, inscrivons la macro :

https://www.wildberries.ru/catalog/{num:1:100000}/detail.aspx

Cette méthode permet de collecter les données des produits Wildberries très facilement et automatiquement, même sans connaître leurs articles. A-Parser insérera lui-même le numéro dans l'ordre, se rendra sur la page et collectera les données si elles existent.

Paramètres possibles

ParamètreValeur par défautDescription
CurrencyRUBDevise des prix dans les résultats : RUB, BYN, KZT, KGS, AMD, UZS, TJS, ETB, GEL. $walletPrice est rempli uniquement pour RUB
AddressMoscouAdresse du point de retrait ; définit la région avec les coordonnées et influence les prix
Latitude55.753737Latitude du point de retrait
Longitude37.6201Longitude du point de retrait
Max concurrent browser pages10Nombre de pages Chrome que le scraper peut ouvrir simultanément. À augmenter avec prudence en cas de grand nombre de threads — la charge sur la mémoire et le CPU augmente
Chrome HeadlessLancement du navigateur en arrière-plan
Use sessionsEnregistre les sessions de travail. Si la session convient, le navigateur ne se lance pas pour cette requête
note

Par défaut, Wildberries affiche les résultats pour Moscou. Dans le scraper, il est possible de définir un point de retrait et la liste des résultats sera liée à un emplacement spécifique. Pour ce faire, vous devez redéfinir 3 paramètres : Address, Longitude et Latitude. Vous pouvez obtenir les valeurs nécessaires pour ces paramètres dans le navigateur :

1. Choisissez le point de retrait souhaité, après avoir ouvert les Outils de développement (dans Chrome, touche F12)

img

2. Dans l'onglet « Réseau », recherchez la requête show et copiez les données dans les paramètres du scraper

Après avoir choisi le point de retrait, ouvrez l'onglet Réseau (en anglais dans Chrome — Network). Recherchez la requête show, dans la réponse (Preview), copiez address, coordinates dans les champs Address, Latitude et Longitude du scraper respectivement.

img