Para extrair dados de produtos da Sainsbury's sem código, forneça ao AI Scraping Agent da Datablist o URL de uma categoria, descreva os campos de que precisa e teste uma página antes de ampliar a execução. O resultado mais útil é uma tabela com os URLs dos produtos e preços claramente identificados, que pode exportar ou comparar com um snapshot posterior.

Recomendo manter o preço normal, o preço Nectar e o preço por unidade em colunas separadas. Tratar todos os valores aparentemente reduzidos como preços promocionais torna as comparações pouco fiáveis: uma oferta de fidelização e um preço por quilograma respondem a questões diferentes.

📌 Resumo do processo

Input: o URL de uma categoria e um prompt para extração de produtos.

Output: nome e URL do produto, preço normal, preço Nectar, preço por unidade, texto da promoção e URL da listagem de origem.

Antes de aumentar a escala: compare a primeira página com o site, verifique a paginação e registe os créditos utilizados.

Para monitorização: guarde um snapshot com data em cada execução, para preservar o histórico de preços dos produtos repetidos.

O que este guia aborda

Escolha um snapshot de produtos fácil de gerir

Comece por uma categoria que consiga analisar, como a listagem de peixe e marisco da Sainsbury's. Os cartões de produto podem apresentar preços normais, ofertas Nectar, preços por unidade e condições promocionais. As instruções de extração devem distinguir esses campos.

Defina um orçamento para o teste

O scraping com IA consome créditos pelo uso do modelo e pela navegação. Uma execução pequena permite verificar o resultado e o custo antes de avançar para várias categorias. Não pressuponha um custo fixo por produto com base no exemplo de outro retalhista.

Como extrair produtos da Sainsbury's - Custo de scrapers personalizados
Como extrair produtos da Sainsbury's - Custo de scrapers personalizados

Defina o output antes de ampliar a extração

O template Retail Product Scraper fornece um prompt e campos de output iniciais. Adapte esses campos aos preços da Sainsbury's e analise uma amostra de uma página. O tempo necessário depende do conteúdo da página e do trabalho de pesquisa; um limite de páginas não garante uma extração completa.

Como extrair produtos da Sainsbury's - Tempo necessário para criar um scraper
Como extrair produtos da Sainsbury's - Tempo necessário para criar um scraper

Volte a verificar os resultados quando a página mudar

O scraping com IA consegue interpretar conteúdo sem precisar de um seletor CSS fixo para cada campo. Ainda assim, pode ignorar um produto, confundir a identificação de um preço ou deparar-se com uma restrição de acesso. Repita a verificação da amostra sempre que o layout ou o formato das promoções mudar.

Como extrair produtos da Sainsbury's com o AI Agent da Datablist

O AI Scraping Agent recebe um URL e instruções e, em seguida, devolve registos através dos campos de output configurados.

O que é o AI Scraping Agent da Datablist?

Use o template Retail Product Scraper como ponto de partida. Atualmente, o template configura a renderização de HTML e a paginação e utiliza o GPT-5 mini. Os templates podem mudar, por isso confirme as definições carregadas. A escolha do modelo não dispensa a validação do output.

Comece por uma página de categoria ou marca

Eu começaria por uma categoria específica, em vez da página inicial ou de uma pesquisa muito abrangente. Assim, terá um conjunto definido de produtos para comparar com as linhas devolvidas. Uma página extensa pode ser truncada ou difícil de analisar, pelo que deve dividir categorias abrangentes quando necessário.

Guarde no snapshot o URL da listagem e qualquer contexto visível sobre localização ou entrega. Os resultados descrevem aquilo que o agent conseguiu ler nessa sessão de navegação; não comprovam a cobertura total do catálogo nem a disponibilidade de stock para todas as moradas.

Que dados pode extrair da Sainsbury's

Configure estes outputs para criar um snapshot de preços:

  • Nome do produto e URL do produto: identificam o artigo apresentado e o tamanho da embalagem.
  • Preço normal: o preço do produto apresentado em GBP, excluindo ofertas de fidelização identificadas separadamente.
  • Preço Nectar: um preço Nectar identificado separadamente, caso seja apresentado.
  • Preço por unidade: o preço de comparação, incluindo a respetiva unidade, como £/kg.
  • Texto da promoção: condições ou datas da oferta apresentadas com o produto.
  • Disponibilidade: apenas uma indicação explícita de stock ou disponibilidade; não deduza que existe stock apenas porque o cartão está presente.
  • URL da listagem: a página de categoria ou listagem onde o registo foi lido.

Use outputs do tipo Number para os dois preços do produto e Text para o preço por unidade e o texto da promoção. Deixe vazios os preços numéricos em falta. O campo Sale Price do template genérico não é suficiente para descrever todas as ofertas; altere o nome e atualize a descrição de acordo com este prompt.

Extrair produtos da Sainsbury's: passo a passo

Prepare o URL de uma categoria e decida de que campos precisa. Limite a primeira execução a uma página para facilitar a verificação dos resultados.

Passo 1: crie uma conta e uma Collection

Registe-se em Datablist.com e crie uma New Collection.

Como extrair produtos da Sainsbury’s - Página inicial da Datablist
Como extrair produtos da Sainsbury’s - Página inicial da Datablist
Como extrair produtos da Sainsbury’s - New Collection
Como extrair produtos da Sainsbury’s - New Collection

Passo 2: aceda ao AI Scraping Agent

Clique em See all sources e selecione AI Scraping Agent (Site Scraper).

Como extrair produtos da Sainsbury's - See All Sources
Como extrair produtos da Sainsbury's - See All Sources
Como extrair produtos da Sainsbury's - Seleção do AI Agent
Como extrair produtos da Sainsbury's - Seleção do AI Agent

A configuração inclui o URL, o prompt, a paginação e as definições avançadas.

Como extrair produtos da Sainsbury's - Definições da fonte
Como extrair produtos da Sainsbury's - Definições da fonte

Passo 3: selecione o template Retail Product Scraper e cole um URL da Sainsbury's

  1. Carregue o template Retail Product Scraper.
Como extrair produtos da Sainsbury's - Seleção do template
Como extrair produtos da Sainsbury's - Seleção do template
  1. Cole o URL atual de uma categoria, por exemplo, https://www.sainsburys.co.uk/groceries/browse/frozen/fish-and-seafood/c:1019924. Comece pela primeira página, em vez de utilizar um link guardado para a segunda página.
Como extrair produtos da Sainsbury's - Configuração do URL
Como extrair produtos da Sainsbury's - Configuração do URL
  1. Substitua as instruções genéricas pelo prompt abaixo. O URL deve ser inserido no campo de URL da source; o prompt define as regras de extração.
Snapshot de produtos e preços da Sainsbury's

Extraia um registo por cada cartão de produto da listagem da Sainsbury's fornecida. Leia em conjunto os nomes e preços para garantir que os valores permanecem associados ao produto correto.

Devolva Nome do produto, URL do produto, Preço normal, Preço Nectar, Preço por unidade, Texto da promoção, Disponibilidade e URL da listagem. Utilize URLs absolutos completos. O Preço normal e o Preço Nectar devem ser valores numéricos em GBP sem o símbolo da moeda. Mantenha o Preço por unidade como texto, tal como é apresentado, incluindo a unidade.

Coloque os preços identificados separadamente como Nectar no campo Preço Nectar. Não substitua o preço do produto por um preço comparativo por quilograma, litro ou artigo. Copie as condições da oferta para o campo Texto da promoção; não calcule o preço de um único artigo quando uma promoção de compra múltipla for ambígua. Deixe vazios os valores em falta. Não deduza a existência de stock nem invente preços.

Exclua banners, recomendações e conteúdo que não corresponda a produtos. Siga o link para a página seguinte apenas quando a paginação estiver ativada. Não apresente uma página de acesso negado, login ou verificação como se fosse uma categoria de produtos vazia. Preserve o URL exato da listagem utilizado em cada registo.

  1. Ative Enable Pagination e defina o limite de páginas como 1 para o teste. Depois de verificar a amostra, aumente Max Pages apenas se for possível ler a página seguinte da categoria.
Como extrair produtos da Sainsbury's - Definições de paginação
Como extrair produtos da Sainsbury's - Definições de paginação

Mantenha Website Scraper Option: Render HTML ativado quando a listagem precisar de renderização JavaScript. Confirme o modelo e o valor de Max iterations nas definições avançadas e clique em Continue. Aumentar o limite de iterações permite mais pesquisa e pode elevar o custo, mas não garante a extração de mais produtos.

Como extrair produtos da Sainsbury's - Definições avançadas
Como extrair produtos da Sainsbury's - Definições avançadas

Passo 4: configure os outputs

Faça corresponder os nomes e as descrições dos outputs ao prompt. Adicione Preço Nectar, Preço por unidade, Texto da promoção e URL da listagem caso estejam em falta. Altere Sale Price para Nectar Price, em vez de manter descrições incompatíveis, e utilize outputs do tipo Number para ambos os preços do produto.

Remova os outputs de que não precisa através dos X Icons. Cada campo que pretende incluir na tabela deve ter uma propriedade de output correspondente.

Como extrair produtos da Sainsbury's - Configuração dos outputs
Como extrair produtos da Sainsbury's - Configuração dos outputs

Passo 5: execute a extração

Clique em Run Import Now para iniciar o teste.

Como extrair produtos da Sainsbury's - Executar a importação
Como extrair produtos da Sainsbury's - Executar a importação

A imagem abaixo ilustra a estrutura da tabela de output; não comprova os resultados de uma extração efetivamente realizada na Sainsbury's.

Como extrair produtos da Sainsbury's - Visão geral dos resultados
Como extrair produtos da Sainsbury's - Visão geral dos resultados

Antes de ampliar a execução:

  • Compare várias linhas com os respetivos cartões, incluindo um produto com uma oferta Nectar e outro sem oferta.
  • Confirme que o preço normal e o preço por unidade não foram trocados e que os preços Nectar em falta ficaram vazios.
  • Verifique os tamanhos das embalagens e os URLs e, depois, procure URLs de produto duplicados na mesma execução.
  • Compare as linhas devolvidas com a listagem visível e analise uma página posterior depois de aumentar a paginação.
  • Registe os créditos e as páginas bloqueadas ou incompletas. Não trate um resultado parcial como se fosse uma categoria completa.

Utilize as opções de exportação da Datablist para criar um snapshot em CSV. Mantenha os campos de preço e os URLs de origem juntos. Para fazer comparações recorrentes, o guia de scraping para sites de retalhistas explica por que motivo um produto ausente da listagem não prova a inexistência de stock e como preservar observações com data.

Preserve o histórico de preços em extrações recorrentes

Um URL de produto único identifica produtos repetidos, mas impedir URLs duplicados numa Collection utilizada a longo prazo pode eliminar observações posteriores. Isso não cria um histórico de preços.

Recomendo guardar cada execução numa Collection separada e identificada pela data ou numa exportação com data. Adicione o timestamp real da recolha antes de comparar o resultado com outro snapshot. Faça a correspondência dos registos através do URL do produto e compare campos equivalentes: preço normal com preço normal e preço Nectar com preço Nectar. Guarde o tamanho da embalagem e o preço por unidade para detetar alterações de tamanho.

Se combinar snapshots, preserve o URL do produto e o timestamp da recolha. Remova produtos duplicados apenas dentro do mesmo snapshot; mantenha as linhas do mesmo produto quando pertencerem a datas diferentes.

O AI Agent da Datablist também extrai dados de outros retalhistas

Pode adaptar o template a outro retalhista, mas deve analisar separadamente os respetivos rótulos e a paginação. Estes guias apresentam processos que pode utilizar como ponto de partida:

  1. Extrair produtos da Morrisons
  2. Extrair produtos da Tesco
  3. Extrair produtos da Asda

Principais conclusões

  1. Comece por uma categoria e por uma amostra de uma página.
  2. Separe o preço normal, o preço Nectar e o preço por unidade no prompt e nos outputs.
  3. Verifique a cobertura e o custo antes de aumentar a paginação.
  4. Preserve snapshots com data quando comparar preços ao longo do tempo.

Perguntas frequentes sobre a extração de dados da Sainsbury's

Quanto custa extrair produtos da Sainsbury's?

O custo depende da utilização do modelo e do trabalho de navegação, incluindo a renderização e o número de páginas processadas. Verifique os créditos consumidos por um teste de uma página antes de estimar uma execução maior. Consulte como funcionam os créditos da Datablist.

Quanto tempo demora extrair todo o catálogo da Sainsbury's?

Um teste numa categoria não permite determinar a duração nem a cobertura de uma extração de todo o catálogo. Defina as categorias de que precisa, verifique a paginação de cada uma e registe as páginas concluídas e incompletas. As categorias sobrepostas podem incluir o mesmo produto, por isso elimine duplicados dentro de cada snapshot com data antes de calcular a cobertura.

Porquê extrair uma categoria da Sainsbury's em vez de todos os produtos?

Uma categoria específica oferece um conjunto de produtos que consegue analisar. As listagens extensas podem ultrapassar o volume que o agent consegue ler de uma só vez. Divida-as em categorias menores e verifique os outputs, em vez de partir do princípio de que todos os artigos foram recolhidos.

Posso extrair preços promocionais e promoções da Sainsbury's?

Peça os preços Nectar identificados separadamente e o texto promocional, juntamente com o preço normal. Analise as condições antes de comparar os valores. O preço por unidade é uma medida comparativa; uma oferta de fidelização condicional ou de compra múltipla não deve substituir silenciosamente o preço normal do produto.

Este processo não determina se tem autorização para recolher ou reutilizar os dados. Leia os termos atuais da Sainsbury's e confirme se a utilização pretendida é permitida antes de executar a extração. O facto de uma página ser pública ou de a extração ser bem-sucedida não responde, por si só, a essa questão.

A Sainsbury's bloqueia scrapers?

Uma execução pode encontrar restrições de acesso ou uma página sem conteúdo de produto legível. Analise a falha antes de tentar novamente. A renderização de HTML ajuda a processar conteúdo JavaScript, mas não garante o acesso. Não contabilize uma página bloqueada como uma categoria com zero produtos.

Posso agendar extrações para monitorizar preços da Sainsbury's?

Antes de automatizar execuções recorrentes, valide um snapshot e decida como cada execução será guardada com o respetivo timestamp de recolha. Consulte a abordagem ao histórico de preços acima. Uma regra que impeça duplicados apenas com base no URL do produto não consegue preservar a evolução dos preços entre execuções.

Posso extrair dados da Sainsbury's sem saber programar?

Sim. Carregue o template, introduza o URL, adapte o prompt e os outputs e execute uma pequena amostra. A configuração é no-code, mas os resultados continuam a precisar de revisão.

Que categorias da Sainsbury's são melhores para scraping?

Comece por uma categoria específica de mercearia que consiga analisar. Utilize o URL atual do site, em vez de um link de paginação antigo. Verifique os campos visíveis e as condições de acesso antes de reutilizar as definições noutra categoria.

O AI Agent processa automaticamente a paginação da Sainsbury's?

Com Enable Pagination ativado, a source pode seguir as páginas seguintes que encontrar até atingir o valor de Max Pages. Atualmente, o valor predefinido é 10 e o limite máximo configurável é 5.000. Estes são limites de configuração, não uma garantia de que todas as páginas estarão acessíveis ou de que todos os produtos serão devolvidos.

O que é scraping com IA?

O scraping com IA utiliza um modelo de linguagem para transformar o conteúdo de uma página nos campos descritos pelo seu prompt. Neste processo, os rótulos dos preços e as regras de identificação dos produtos são tão importantes como o URL.

Qual é a diferença entre scraping com IA e web scraping tradicional?

A extração tradicional utiliza frequentemente seletores fixos. A extração com IA interpreta o conteúdo através de instruções, o que pode facilitar a adaptação dos campos recolhidos. Ambas as abordagens exigem acesso à página e verificações de valores em falta ou interpretados incorretamente.