Pular para o conteúdo principal

SE::Rutube - scraper de busca de vídeos do Rutube

Rutube

Visão geral do scraper

Scraper de resultados de busca do Rutube. Permite coletar vídeos por palavras-chave da maior plataforma de vídeo russa rutube.ru. Usando o scraper, é possível obter links de vídeos, títulos, descrições, informações sobre canais, visualizações, duração e data de publicação.

A funcionalidade do A-Parser permite salvar as configurações de extração de dados para uso futuro (presetes), definir agendamentos de extração de dados e muito mais. A gravação dos resultados é possível no formato e estrutura que você desejar, graças ao poderoso motor de modelos integrado Template Toolkit.

Dados coletados

Os dados são coletados do serviço https://rutube.ru/.

Dados coletados Rutube

  • Link para o vídeo
  • Título do vídeo
  • Descrição do vídeo
  • Nome do canal
  • Link para o canal
  • Link para a prévia (thumbnail)
  • Número de visualizações
  • Duração do vídeo (em segundos)
  • Data de publicação

Consultas

Como consultas, é necessário indicar frases de pesquisa, por exemplo:

notícias
futebol
culinária
viagens pela Rússia
tecnologias 2026

Opções de exibição de resultados

Lista de links (padrão)

Formato do resultado:

$serp.format('$link \t $title')

Links + título + canal + visualizações + data

Formato do resultado:

$serp.format('$link $title $channel $views $duration $date\n')

Exemplo de resultado:

https://rutube.ru/video/abc123/ Notícias 20 de julho de 2026 MIR 24 4703 773 2026-07-20
https://rutube.ru/video/def456/ Principais notícias do dia NTV 11068 1754 2026-07-20

Saída em CSV

Formato do resultado:

[% FOREACH item IN p1.serp; tools.CSVline(item.link, item.title, item.channel, item.views, item.date); END %]

Texto inicial:

Link,Título,Canal,Visualizações,Data

Dump em JSON

Formato do resultado:

[% FOREACH item IN p1.serp; '{"link":"' _ item.link _ '","title":"' _ item.title _ '","views":' _ item.views _ '}\n'; END %]

Configurações possíveis

Nome do parâmetroValor padrãoDescrição
Pages count1Número de páginas para extração de dados (de 1 a 20)
LanguageruIdioma da busca