Tescoには公開商品APIがありません。そのため、Tescoの商品をスクレイピングしようとする多くのチームは、フリーランスの開発者に£2,000以上を支払うか、数日で動かなくなるApify scraperを組み込むかの二択になっています。
しかし、あまり知られていない第三の選択肢があります。それがAI scrapingです。AIが人間のようにページを読み取るため、同じ設定でTescoのカテゴリページ、ブランド一覧、セールページに対応できます。従来型scraperが動かなくなるようなレイアウト変更にも強いのが特徴です。
本ガイドでは、Tesco商品向けのカスタムscraperに費用をかけるべきでない理由、きれいなデータを取得しやすいTescoページ、そしてDatablist's AI Scraping Agentを使った具体的な手順を解説します。
📌 お急ぎの方向けの要約
この記事では、Datablist's AI Scraping Agentを使ってTescoの商品データをスクレイピングする方法をご紹介します。
課題: Tescoには公開商品APIがなく、既製のscraperはレイアウト変更のたびに数週間で動かなくなります。カスタム開発には£2,000以上かかり、継続的なメンテナンスも必要です。
解決策: TescoのURLを1つ指定し、シンプルな英語のpromptを入力するだけで、Datablist's AI Scraping Agentが商品をスクレイピングします。
本ガイドでわかること:
- Tesco向けカスタムscraperにコストをかけるべきでない理由
- きれいなデータを取得しやすいTescoページ
- 10分以内に任意のTescoカテゴリをスクレイピングする5ステップ
Datablistを選ぶ理由:
- AI scrapingはHTMLではなく意味を読み取るため、Tescoのレイアウト変更にも対応できます
- ページネーションは自動処理されます(1回の実行で最大5,000ページ)
- コードもAPI keyも不要で、必要なのはTescoのURLとpromptだけです
このガイドで解説する内容
- Tesco向けカスタムscraperをおすすめしない理由
- DatablistのAI AgentでTesco商品をスクレイピングする方法
- Tescoスクレイピングの詳しい手順
- Tescoスクレイピングに関するよくある質問
Tesco向けカスタムscraperはコストの無駄
Tesco向けscraperの自社開発を検討しているなら、費用を投じる前に見直すべき理由が3つあります。
開発費が高額になる
安定して動くTesco scraperは、週末だけで完成するようなプロジェクトではありません。Tesco.comの商品グリッドはJavaScriptで動的に読み込まれ、数百ものカテゴリページに分割されています。さらにレイアウトも頻繁に更新されるため、ルールベースのscraperには継続的な修正が必要です。
多くのチームが試す方法と、それぞれが行き詰まる理由は次のとおりです。
- フリーランスの開発者に依頼する:初期開発だけで£2,000以上。Tescoが商品グリッドを更新するたびに追加費用が発生します
- ApifyやGitHubの既製Tesco product scraperを購入する:導入直後は動いても、次のレイアウト変更から数週間以内に使えなくなります
- PuppeteerやPlaywrightのscriptをVibe Codingで作る:Tescoのページネーション、JavaScript rendering、形式が統一されていない商品カードによって、すぐに不具合が生じます
一度限りのデータ取得であれば、フリーランスへの依頼でも問題ないかもしれません。しかし、Tescoの最新データを定期的に取得したい場合(価格モニタリング、FMCG分析、小売アービトラージなど)、メンテナンス費用は毎月積み上がっていきます。
開発に時間がかかる
経験豊富な開発者が担当しても、精度の高いTesco scraperの完成には数週間かかります。すべてのカテゴリページを把握し、rendering後のHTMLを処理し、ページ分割された商品グリッド用のロジックを実装しなければなりません。さらに、セール価格が「N/A」になるケースや、年齢確認の背後に商品が隠れるケースにも対応する必要があります。
Datablist's AI Scraping Agentなら、この開発工程をすべて省略できます。TescoのURLを貼り付けるだけで、10分以内に構造化された商品データを取得できます。 仕様書の作成も、例外処理に関する何度ものやり取りも、v2の完成を待つ必要もありません。
頻繁に動かなくなる
Tesco向けscraperで本当に負担となるのは、商品グリッドが頻繁に更新されることです。新しいカテゴリtemplateが導入されたり、価格要素の位置が変わったりするたびに、カスタムscraperは動かなくなります。
その場合、開発者に再度費用を支払うか、ご自身で午後の時間を使ってdebugするしかありません。
AI scrapingなら、この問題を回避できます。AI AgentはHTML構造ではなくページの意味を読み取るため、Tescoが価格の周囲にあるCSS classを変更しても、価格は価格として認識されます。
💡 本質的な違い
従来型scraperは、「.product-priceというclassを持つ要素を探し、そのtextを抽出する」というルールに従います。AI scraperは、「このTescoページから商品の価格を見つける」という意味に基づいて処理します。
そのため、現在Tescoで機能する設定は、翌月に商品グリッドが変更されても利用できます。サイトごとのコードを書かなくても、Morrisons、Sainsbury's、Asdaへスムーズに展開できるのも同じ理由です。
DatablistのAI AgentでTesco商品をスクレイピングする方法
具体的な手順に入る前に、AI Scraping Agentとは何か、どのTescoページならきれいな結果を得られるのか、どのようなデータを取得できるのか、そしてどこに制限があるのかを簡単にご説明します。
Datablist's AI Scraping Agentとは
Datablistはworkflow automation platformで、Lead listの作成、data enrichment、scraping workflowの実行に利用できます。Datablistには60種類以上のsourcesとenrichmentsが用意されており、小売サイトから商品データを抽出するときに使うのがAI Scraping Agentです。
Agentは3つの要素を組み合わせて動作します。 対象URL、抽出内容を記述したprompt、そして人間のようにページを読み取るlanguage modelです。
Tescoをスクレイピングする際は、promptをご自身で作成する必要もありません。Datablistには、promptと出力列があらかじめ設定されたRetail Product Scraper templateがあります。TescoのURLを貼り付ければ、残りはtemplateが処理します。
AgentがTescoを処理するうえで、特に重要なポイントは次の3つです。
- デフォルトでは、AI scrapingの費用対効果に優れたLLMであるOpenAI GPT 4.1 miniを使用
- Tescoの商品グリッドはJavaScriptで読み込まれるため、必須となるRender HTMLに対応
- 1回の実行につき最大5,000ページまでの自動ページネーション
このため、設定を変更せずに英国のほかのスーパーマーケットにも展開できます。同じAgent、同じtemplate、同じ設定で、Morrisons、Sainsbury's、Asdaにも対応します。変更するのはURLだけです。
最重要ルール:ブランド・カテゴリページのみを使う
必ずTescoのカテゴリページまたはブランドページをスクレイピングしてください。 ホームページや「全商品」ページは使用しないでください。大規模なリストはAI Agentのcontext windowを超えるため、途中で処理が止まり、再開もできません。その結果、creditsが無駄になります。
AI AgentがTescoで安定して処理できるページは次のとおりです。
- ✅ tesco.com/
/...のカテゴリページ - ✅ ブランドページ(特定メーカーの商品一覧)
- ✅ セール・特売ページ
避けるべきページは次のとおりです。
- ❌ Tescoのホームページ
- ❌ 「全商品」ページやサイト全体の検索結果
- ❌ 1つのinfinite scrollに数千件の商品を読み込むページ
Tescoから取得できる商品データ
Tescoで1回実行するだけで、価格モニタリング、競合調査、既存カタログのdata enrichmentに必要な商品情報を取得できます。
- Product Name:TescoのWebサイトに表示されている完全な商品名
- Product URL:tesco.comの商品ページへ直接アクセスできるlink
- Brand Name:商品のメーカー名
- Price:£記号を含む現在のGBP価格
- Sale Price:Tescoのpromotion実施中は割引価格、対象外なら「N/A」
- Product Category:商品が属する売り場または部門
- Availability:在庫あり、在庫切れ、または残りわずか
- Rating:Tescoに表示されている場合のcustomer rating
- Image URL:メイン商品画像への直接link
- SKU:Tesco内部の商品ID
実行前に必要なoutputsを選択しておけば、実際に使用する列だけをexportできます。
Tescoスクレイピングの手順
Tesco scrapingの設定は、5つのステップで完了します。始める前に、次のものをご用意ください。
- TescoのカテゴリまたはブランドURL(ホームページ以外)
- 取得したい商品項目のおおまかなリスト
ステップ1:登録してCollectionを作成する
まず、Datablist.comに登録します。
次に、New Collectionを作成します。
ステップ2:AI Scraping Agentを開く
- See all sourcesをクリックします
- 下へスクロールし、***AI Scraping Agent (Site Scraper)***を選択します。
次のようなsource設定画面が表示されます。
ステップ3:Retail Product Scraper templateを選びTescoのURLを貼り付ける
- Template Drop-Downをクリックし、「Retail Product Scraper」を選択します
- URL fieldにTescoのカテゴリURLを貼り付けます。例:
https://www.tesco.com/groceries/en-GB/shop/fresh-food/all
❗️ ブランド・カテゴリページのみを使用してください(再確認)
Tescoのホームページや「全商品」のURLは貼り付けないでください。大規模なリストはAI Agentのcontext windowを超えます。Tescoはカテゴリごとにスクレイピングしてください。
- スクレイピングするページ数を設定します(Tescoでは通常、1ページに約36商品が表示されるため、200商品のカテゴリならおよそ3~4ページが必要です)
- 下へスクロールし、Continueをクリックします
💡 Continueをクリックする前にAdvanced Settingsをご確認ください
次の項目が有効になっていることをご確認ください。
- LLM:OpenAI GPT 4.1 mini(費用対効果が最も高い設定)
- Max Iterations:10
- Website Scraper Option: Render HTML(Tescoの商品グリッドはJavaScriptで動的に読み込まれるため必須)
ステップ4:Outputsを設定する
Datablistがoutput propertiesを自動的に作成します。
不要なoutputはX Iconsをクリックして削除してください(Tescoの価格だけをスクレイピングする場合は、Ratingを削除するなど)。
ステップ5:実行する
outputsの設定が完了したら、Run Import NowをクリックしてTesco scrapingを開始します。
数分後、Tescoの取得結果が次のように表示されます。ここからDatablistのworkflow automation featuresを使って、データのcleaning、重複排除、exportを実行できます。
💡 Tescoを繰り返し取得するときの重複を防ぐ方法
後日、同じTescoカテゴリを再度スクレイピングする場合は、次のように設定してください。
- 一意の識別子となる列を選択します(Product URLが最適です)
- 列のheader → Rename - Settings - Deleteをクリックします
- Do not allow duplicate valuesにチェックを入れます
- Save Propertyをクリックします
Morrisons、Sainsbury's、Asdaのデータも同じファイルに取得する場合は、CSVファイルから重複を削除する方法で、小売サイトをまたいだ重複排除の手順をご確認いただけます。
DatablistのAI Agentはほかの小売サイトにも対応
この設定はTesco専用ではありません。同じAI Scraping AgentとRetail Product Scraper templateを、当社が検証した英国の各スーパーマーケットで利用できます。変更するのはURLだけです。
類似する小売サイトからも商品データを取得する場合は、次のガイドをご覧ください。
重要ポイントのまとめ
- Tesco向けカスタム商品scraperはコストの無駄になりがちです。 初期開発費は£2,000以上で、別途メンテナンス費用もかかります。さらにTescoのレイアウト変更によって定期的に動かなくなります。
- AI scrapingはHTMLではなく意味を読み取ります。 そのため、商品グリッドが変わってもTesco商品の取得を続けられます。サイトごとのコードなしでMorrisons、Sainsbury's、Asdaにも展開できます。
- ホームページではなく、必ずブランドまたはカテゴリページをスクレイピングしてください。 大規模なリストはAgentのcontext windowを超え、実行が無駄になります。
- 設定は5分以内で完了します。 Template、URL、outputsを指定して実行するだけです。
Tescoスクレイピングに関するよくある質問
Tesco商品のスクレイピング費用はいくらですか
Datablist's AI Agentは、使用量ベースのcredit systemを採用しています。Tescoを1回実行する費用は、Agentが処理する商品数とページ数によって異なります。Datablistのplanは月額$25からで、5,000 free creditsが含まれます。追加packは20,000 creditsあたり$20からで、大容量packageには最大35%のvolume discountが適用されます。
Tescoの全商品を取得するにはどのくらいかかりますか
50~200商品を掲載する一般的なTescoカテゴリページなら、5~10分でスクレイピングできます。ページ分割された複数カテゴリを対象とする大規模な実行(500商品以上)には、10~20分ほどかかる場合があります。初回設定には追加で2~3分必要です。
全商品ではなくTescoのカテゴリページを使うべき理由は何ですか
Tescoの「全商品」ページでは、数千件の商品が1つのrendering済みページに読み込まれます。その結果、AI Agentのcontext windowを超えて処理が途中で止まります。再開機能もないため、途中までの実行が無駄になります。カテゴリページやブランドページなら安全な範囲内に収まり、安定して取得できます。全商品を網羅したい場合は、後から1つのCollectionに統合できます。
Tescoのセール価格やpromotionも取得できますか
はい。Retail Product Scraper templateにはSale Price outputが含まれています。Tescoでpromotionが実施されている場合は割引価格を取得し、対象外の場合は「N/A」を返します。カテゴリを横断してpromotionの有無をfilteringするときにも便利です。
英国でTescoをスクレイピングするのは合法ですか
一般公開されているTescoの商品データ(商品名、価格、在庫状況など)のスクレイピングには、英国におけるほかの公開Webデータと同様の原則が適用され、通常は合法と考えられます。ただし、Tescoの利用規約をご確認のうえ、個人データの取得を避け、適切なrequest数を守ってください。商用利用の場合は、法務担当者にもご相談ください。
Tescoはscraperをブロックしますか
一般公開されている小売サイトとしては、Tescoのbot対策は比較的穏やかです。特にRender HTMLを有効にすれば、DatablistによるTescoのscrapingは初回で成功するケースがほとんどです。カテゴリページからデータを取得できない場合は、ページ数を減らして再試行するか、対象をより細かなサブカテゴリに分割してください。
Tescoの価格モニタリングを定期実行できますか
はい。Datablistのworkflow automation featuresを使えば、定期実行を設定できます。一意の識別子となる列(Product URLが最適です)と重複防止設定を組み合わせることで、既存商品の重複を作らず、新しい商品だけを追加できます。
コーディング経験がなくてもTescoをスクレイピングできますか
コーディング経験は一切不要です。Retail Product Scraper templateを選択し、TescoのURLを貼り付け、outputsを選んで実行するだけのno-code workflowです。文章を1文書ければ、DatablistでTescoをスクレイピングできます。
スクレイピングに適したTescoカテゴリはどれですか
tesco.comの標準的な食品・日用品カテゴリが、最もきれいなデータを返します。たとえば生鮮食品、冷凍食品、ベーカリー、飲料、家庭用品です。ブランドページも安定しています。Promotionや「Last chance」ページは商品カードの形式が混在するため多少noiseが増えますが、AI Agentなら実用的なデータを取得できます。
AI AgentはTescoのページネーションを自動処理できますか
はい。Enable Paginationを有効にすると、AI Agentが設定した上限までTescoカテゴリの各ページを巡回します(デフォルト10、最大5,000)。1ページに36商品を表示するTescoカテゴリから240商品を取得する場合は、ページネーションを10に設定すれば、Agentが全商品を取得します。
AI scrapingとは何ですか
AI scrapingとは、固定されたHTMLルールの代わりにlanguage modelを使い、Webサイトから構造化データを取得する方法です。Agentがページへアクセスして内容を読み取り、シンプルな英語で指定した項目を返します。Tescoのようにレイアウトが頻繁に変わるサイトでも安定して使えるのは、この仕組みがあるためです。
AI scrapingと従来型Web scrapingの違いは何ですか
従来型scraperは、CSS selectorやXPathなどの固定ルールに従います。サイトが変更されると、そのルールは機能しなくなります。AI scrapingはページの意味を読み取るため、markupが変更されてもTescoの価格を価格として認識できます。そのため、Datablistの同じ設定を、サイト別のコードなしでMorrisons、Sainsbury's、Asdaにも利用できます。















