Possibilidades Ilimitadas no A-Parser
Reunimos todos os benefícios em uma única página; informações detalhadas sobre cada recurso podem ser encontradas na documentação.

Editor de Tarefas
Use até 20 scrapers em uma única tarefa, distribuindo os threads uniformemente para reduzir bloqueios de proxy e aumentar a velocidade de extração de dados.
Inúmeras configurações para cada scraper podem ser salvas em predefinições separadas e reutilizadas em várias tarefas.
A separação dos dados de entrada permite que você altere o formato da consulta e escreva dados relacionados adicionais nos resultados.
Um formato de consulta separado para cada scraper dentro de uma tarefa, com controle sobre a ordem de execução da formatação.
Se você não tiver certeza sobre os dados de entrada, o A-Parser garante que nenhum trabalho redundante seja feito.
Expansão automática de consultas, substituição de subconsultas de arquivos e iteração através de combinações alfanuméricas e listas.
O poderoso Template Toolkit permite aplicar lógica adicional aos resultados e gerar dados em vários formatos, incluindo JSON, SQL e CSV.
Recursos avançados de desduplicação garantem a exclusividade das strings, links e domínios que você recebe.
Salve apenas os dados que atendem aos seus critérios: correspondências de substring, comparações numéricas ou expressões regulares.
Use formatos diferentes para arquivos diferentes e aplique condições e filtros adicionais, tudo dentro de uma única tarefa para economizar recursos de extração de dados.
Um log detalhado para cada thread e cada consulta permite a depuração rápida e conveniente da tarefa.
Expanda a lógica do A-Parser executando automaticamente diferentes tarefas em sequência, passando os resultados de uma tarefa como consultas para a próxima.
Construindo bancos de dados a partir de várias tarefas? O salvamento dos bancos de dados de desduplicação garante que você sempre obtenha apenas novos resultados.
Ao executar cada tarefa com um número especificado de threads, você pode garantir que o A-Parser não ultrapassará o limite do seu plano de proxy nem os recursos do seu servidor.
Use o depurador para verificar rapidamente a operação de uma tarefa durante sua criação, com execução rápida e uma exibição clara do log.
Fila de Tarefas e Agendador
A fila de tarefas livra você da espera pelo término de uma tarefa. Adicione um número ilimitado de tarefas independentes.
Controle o número de tarefas em execução simultânea, reduzindo significativamente o tempo total para obter os resultados.
Inicie, pause, edite ou exclua tarefas. Retome tarefas de onde pararam; o A-Parser continuará coletando informações.
Com uma grande fila de tarefas, é crucial controlar quais tarefas começam antes das outras.
Defina um limite global de threads para todas as tarefas, e o A-Parser distribuirá automaticamente os threads entre as tarefas ativas.
Acesse um histórico completo de tarefas concluídas, veja estatísticas e adicione novamente tarefas para outra execução.
Execute tarefas recorrentes usando o agendador de tarefas com configurações flexíveis para intervalos de repetição.
Verificadores de Proxy e Gerenciamento de Proxy
O A-Parser funciona com todos os protocolos de proxy, e o verificador de proxy pode testar todos os tipos simultaneamente.
Adicione verificadores de proxy separados para diferentes fontes de proxy, cada um com suas próprias configurações de verificação.
Gerencie o número de threads de verificação e download separadamente para cada verificador de proxy.
Especifique as credenciais de acesso ao proxy nas configurações do verificador de proxy ou em listas de proxy com dados de autorização separados.
O A-Parser verifica os proxies quanto ao suporte ao método POST, anonimato, tempo de resposta e outros parâmetros.
Se você tem certeza de que seus proxies estão funcionando, pode desativar a verificação para economizar recursos.
Para cada tarefa, você pode selecionar fontes de proxy específicas, permitindo uma alocação flexível de recursos.
Para ainda mais flexibilidade, use diferentes proxies em uma única tarefa, como proxies separados para os scrapers do Google e do Yandex.
Se um serviço banir um proxy, o A-Parser deixará de usá-lo por um tempo especificado, reduzindo as solicitações malsucedidas.
Você pode limitar o número máximo de threads por proxy para evitar o uso excessivo de seus recursos.
Por padrão, o A-Parser usa um proxy exclusivo para cada tentativa de download de dados, mas esse comportamento pode ser alterado.
Este recurso permite excluir certos proxies do uso geral e atribuí-los apenas a tarefas específicas.
Configurações Flexíveis
Salve grupos de configurações em diferentes predefinições e reutilize-os em várias tarefas.
Por exemplo, o scraper do Google permite especificar o número de páginas, resultados por página, configurações de idioma, geolocalização e muito mais.
Exporte suas configurações e scrapers para compartilhar com outros, ou importe tarefas prontas do nosso catálogo.
Multithreading e Desempenho
O A-Parser é construído sobre uma arquitetura totalmente assíncrona, capaz de executar até 3.000 threads assíncronos concorrentes.
O A-Parser emprega muitas otimizações para melhor desempenho, e nós constantemente analisamos o desempenho e melhoramos nosso código.
Não há limites para o número de consultas, o tamanho dos arquivos de consulta ou o número de resultados.
A maioria das tarefas é executada sem problemas em qualquer computador de escritório ou doméstico padrão, bem como em qualquer VDS de nível de entrada.
Atualmente, o A-Parser pode usar eficientemente até 4 núcleos de processador. Uma licença com suporte ilimitado a núcleos será lançada em breve.
Reconhecimento de Captcha
O software de reconhecimento de CAPTCHA mais popular suporta muitos tipos de CAPTCHAs, incluindo reCAPTCHA v2.
Suportamos a integração com a grande maioria dos serviços, incluindo Anti-Captcha, RuCaptcha, CapMonster.cloud, 2Captcha e outros.
O suporte ao reconhecimento de captcha está integrado em todos os scrapers populares. Você também pode usá-lo em seus próprios scrapers JavaScript personalizados.
Desenvolvimento de Predefinições Baseadas em Expressões Regulares
Aplique expressões regulares a dados obtidos do scraper Net::HTTP ou do spider HTML::LinkExtractor.
Colete pontos de dados únicos em variáveis ou blocos repetidos (listas, tabelas) em arrays. Apresente os dados em um formato conveniente usando o motor de templates.
Você pode aplicar processamento adicional aos dados de origem de todos os scrapers integrados (por exemplo, resultados de pesquisa do Google).
Use expressões regulares para encontrar links para a próxima página da paginação, e o A-Parser navegará automaticamente por todas as páginas.
Use expressões regulares para validar conteúdo, verificar bloqueios de proxy ou detectar captchas. O A-Parser tentará novamente automaticamente com outro proxy em caso de falha.
Com o construtor de resultados, você pode realizar operações de busca e substituição usando expressões regulares em quaisquer resultados de scraping.
Desenvolvimento de Scrapers em JavaScript
Código linear e síncrono usando async/await, que o A-Parser executará em um ambiente multithread.
O A-Parser permite que você se concentre em escrever o código de extração e transformação de dados, lidando com todo o gerenciamento de proxies e tentativas automaticamente.
Escreva em JavaScript moderno (ES2020+) ou use TypeScript para tipagem forte e destaque de sintaxe.
O vasto catálogo de módulos NPMJS permite que você estenda ilimitadamente as capacidades de extração e processamento de dados do A-Parser.
O A-Parser adiciona suporte a proxy à popular biblioteca Puppeteer, permitindo o uso automático de diferentes proxies para diferentes abas.
Você pode enviar solicitações para quaisquer scrapers integrados ou outros scrapers JavaScript, permitindo a criação de lógicas arbitrariamente complexas.
Automação e API
Envie solicitações HTTP de seus próprios programas e scripts, ou use nossas bibliotecas prontas para Node.js, Python, PHP e Perl.
Adicione tarefas pelo nome da predefinição ou fornecendo uma estrutura JSON completa com configurações detalhadas.
Obtenha controle total sobre a fila de tarefas, acompanhe o status das tarefas e baixe os resultados.
Envie uma solicitação HTTP e receba os resultados imediatamente após a conclusão da coleta de dados.
Nossa solução para projetos de alta carga. Conecte um número ilimitado de instâncias do A-Parser para processar solicitações de API em uma fila Redis com latência mínima.
Para automação completa, uma atualização remota do A-Parser está disponível através de uma chamada de API.
Melhorias Contínuas e Suporte
A evolução constante do A-Parser oferece aos nossos usuários novas capacidades ano após ano.
Testamos todos os scrapers integrados diariamente e automaticamente, o que nos permite lançar atualizações prontamente em resposta a quaisquer alterações de layout ou resultados.
O suporte técnico gratuito está disponível para todos os nossos usuários e é considerado por eles o melhor entre produtos similares.
Lançamos regularmente materiais educacionais, exemplos de predefinições e scrapers, bem como vídeos tutoriais em nosso canal do YouTube.
A maioria dos novos recursos e scrapers são desenvolvidos com base nas solicitações de nossos usuários.
Podemos economizar seu tempo oferecendo o desenvolvimento de scrapers personalizados em nossa plataforma, bem como a integração com sua lógica de negócios e bancos de dados.
Escolha a licença certa
Licença vitalícia, atualizações são adquiridas separadamente
A-Parser Lite
Scrapers básicos do Google e do Yandex
- Inclui scrapers do Google e do Yandex
- 3 meses de atualizações
- Proxies bônus: 20 threads por 2 semanas
- Suporte
A-Parser Pro
Acesso a todos os scrapers
- Conjunto completo de mais de 110 scrapers
- Crie seus próprios scrapers em JavaScript
- 6 meses de atualizações
- Proxies bônus: 50 threads por um mês
- Inclui todos os recursos do plano Lite
A-Parser Enterprise
Acesso a todos os scrapers e à API
- Controle via API
- Processamento em múltiplas threads
- Integração com Redis
- Inclui todos os recursos do plano Pro
Atualizações: $49 por 3 meses, $149 por 1 ano ou $399 por uma licença vitalícia
Soluções Pagas
Desenvolvimento Personalizado de Scrapers
Acreditamos que quaisquer dados podem ser extraídos.
