> ## Documentation Index
> Fetch the complete documentation index at: https://docs.wisepim.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Web-Scraping-Import

> Verwandle jeden öffentlichen Webshop in Produkte: füge eine URL ein, lass die AI crawlen und die Daten extrahieren, sieh dir ein Produkt in der Vorschau an und importiere dann das Ganze. Keine Datei, keine API, keine Integration.

<img className="block dark:hidden" src="https://mintcdn.com/swiftsyncai/wZlqETH_cVKLiwzd/images/marketing-screenshots/products/products-import-scrape-step-light-branded.webp?fit=max&auto=format&n=wZlqETH_cVKLiwzd&q=85&s=a164167cceec3d6bb993ee1e95bba193" alt="WISEPIM web scraping import configuring a source URL and previewing extracted products" width="1972" height="1548" data-path="images/marketing-screenshots/products/products-import-scrape-step-light-branded.webp" />

<img className="hidden dark:block" src="https://mintcdn.com/swiftsyncai/wZlqETH_cVKLiwzd/images/marketing-screenshots/products/products-import-scrape-step-dark-branded.webp?fit=max&auto=format&n=wZlqETH_cVKLiwzd&q=85&s=eeae888645706ee04921f09cbb5f21d3" alt="WISEPIM web scraping import configuring a source URL and previewing extracted products" width="1972" height="1548" data-path="images/marketing-screenshots/products/products-import-scrape-step-dark-branded.webp" />

Manchmal liegen die gewünschten Daten auf einer Website und nicht in einem Feed: der Katalog eines Lieferanten, dein eigener Store auf einer anderen Plattform oder ein Referenzsortiment, das du nachbilden möchtest. Der **Web-Scraping-Import** crawlt eine öffentliche Website, nutzt die AI, um jedes Produkt zu extrahieren (Name, SKU, Marke, Preis, Bilder, Attribute), und importiert sie in WISEPIM. Es gibt keine Datei vorzubereiten und keine API zu verbinden.

**Was es dir bringt:** Du holst einen Lieferanten oder einen bestehenden Storefront in Minuten an Bord, statt nach einem Feed zu fragen, und bringst Produkte nach WISEPIM, wo du sie anreichern, übersetzen und veröffentlichen kannst.

<Info>
  Der Web-Scraping-Import funktioniert auf jeder öffentlichen Website, ohne API-Schlüssel oder Einrichtung. Er zeigt dir vor dem Festlegen immer eine Live-Vorschau eines extrahierten Produkts, damit du zuerst bestätigen kannst, dass die Daten korrekt aussehen.
</Info>

## So funktioniert es

<Steps>
  <Step title="Wähle einen Quellmodus">
    **Kategorieseite** durchläuft eine Listenseite und ihre Seitennummerierung, um jedes Produkt zu finden (am besten für den Katalog eines Lieferanten oder Mitbewerbers). **Sitemap** startet von einer Produkt-URL und findet ähnliche Seiten auf der gesamten Website. **Manuelle Liste** nimmt eine Liste von Produkt-URLs, die du einfügst, eine pro Zeile.
  </Step>

  <Step title="Füge die URL und Begrenzungen hinzu">
    Füge die Start-URL ein. Lege optional ein URL-Muster fest (um nur die richtigen Seiten einzubeziehen) sowie Obergrenzen dafür, wie viele Listenseiten und Produkte abgerufen werden, damit ein erster Durchlauf klein bleibt.
  </Step>

  <Step title="Sieh dir ein Produkt in der Vorschau an">
    Starte die Vorschau. WISEPIM meldet, wie viele Produkt-URLs es gefunden hat, das erkannte Muster, einige Beispiel-URLs und ein vollständig extrahiertes Produkt, sodass du prüfen kannst, ob die Felder korrekt übernommen wurden.
  </Step>

  <Step title="Importieren">
    Zufrieden mit der Vorschau? Starte den Import. Er läuft im Hintergrund, sodass du die Seite verlassen und den Fortschritt im Process Tracker verfolgen kannst. Wenn er fertig ist, sind die Produkte in deinem Katalog und einsatzbereit.
  </Step>
</Steps>

<Tip>
  Halte deinen ersten Durchlauf klein. Setze die Obergrenzen **Max. Produkte** und **Max. Listenseiten** niedrig, sieh dir das Ergebnis in der Vorschau an und bestätige, dass die Daten korrekt aussehen, bevor du den gesamten Katalog abrufen lässt.
</Tip>

## Einstellungen, die du festlegen kannst

Du gestaltest jeden Scrape mit ein paar optionalen Überschreibungen. Die Standardwerte funktionieren für die meisten Websites, greife also nur dann zu diesen, wenn ein Durchlauf einen Anstoß braucht:

* **Sitemap-URL überschreiben**: Verweise WISEPIM auf die richtige Sitemap, wenn eine Website keine in ihrer `robots.txt` angibt. Nutze dies, wenn der Sitemap-Modus die Produkt-URLs nicht von selbst finden kann.
* **Produkt-URL-Muster überschreiben**: Sage WISEPIM, welche URLs als Produkte gelten (zum Beispiel `/p/` oder `/products/`), wenn das automatisch erkannte Muster die falschen Seiten erfasst.
* **Max. Listenseiten**: wie viele Seitennummerierungs-Seiten einer Kategorie durchlaufen werden. Erhöhe den Wert für große Kataloge, halte ihn für einen schnellen Test niedrig.
* **Max. Produkte**: eine Obergrenze dafür, wie viele Produkte ein Durchlauf importiert. Eine Sicherheitsgrenze, die einen ersten Durchlauf klein und vorhersehbar hält.

## Die Vorschau lesen

Die Vorschau gibt es, damit du nie blind importierst:

* **Anzahl der gefundenen URLs** zeigt dir, ob der Crawl ungefähr die erwartete Produktanzahl gefunden hat. Null oder viel zu wenige bedeutet, dass das Muster oder die Start-URL angepasst werden muss.
* **Das erkannte Muster** zeigt, welche URLs als Produkte behandelt werden. Wenn es Kategorie- oder Blog-Seiten erfasst, schränke das Muster mit der Überschreibung des Produkt-URL-Musters ein.
* **Das extrahierte Beispiel** ist der eigentliche Test: Prüfe, dass Name, Preis, Bilder und wichtige Attribute korrekt zugeordnet wurden, bevor du dich auf den vollständigen Durchlauf festlegst.

<Warning>
  Wenn WISEPIM aus der ersten URL kein Produkt extrahieren kann, zeigt es eine klare Warnung an, statt stillschweigend zu scheitern. Der Import kann auf den anderen Seiten dennoch funktionieren, daher lohnt es sich, noch einmal eine Vorschau zu machen oder den Durchlauf zu starten und die Ergebnisse zu prüfen. Wenn das Beispiel leer bleibt, passe die Start-URL oder das Muster an und mach erneut eine Vorschau.
</Warning>

## Handle nach deinen Erkenntnissen

<AccordionGroup>
  <Accordion title="Die Vorschau hat 0 (oder viel zu wenige) Produkte gefunden">
    Die Start-URL oder das Muster stimmt nicht. Bei einer Kategorieseite vergewissere dich, dass du die Listenseite eingefügt hast (nicht ein einzelnes Produkt); im Sitemap-Modus füge eine echte Produkt-URL ein, damit WISEPIM das Muster lernen kann. Passe die Muster-Überschreibung an und mach erneut eine Vorschau. **Ergebnis:** Der Crawl findet das vollständige Sortiment, bevor du einen Importlauf dafür aufwendest.
  </Accordion>

  <Accordion title="Beim Beispielprodukt fehlen Felder">
    Manche Websites verstecken Daten in Skripten oder Bildern. Mach erneut eine Vorschau, um zu bestätigen, dass es durchgängig ist, importiere, was sauber extrahiert wird, und fülle dann die Lücken mit [Produkte anreichern](/de/essentials/enriching-products) (die AI kann die Produktbilder lesen, um Attribute wiederherzustellen). **Ergebnis:** ein vollständiger Katalog, selbst wenn die Quellseite dünn war.
  </Accordion>

  <Accordion title="Du wirst erneut von derselben Website importieren">
    Notiere dir die Einstellungen, die funktioniert haben: den Quellmodus, die Start- oder Kategorie-URL und alle Muster- oder Sitemap-Überschreibungen. Wenn der Lieferant das nächste Mal aktualisiert, gib dieselben Werte ein, um die Änderungen abzurufen. Für Quellen, die du häufig erneut importierst, ist ein strukturierter [Feed](/de/essentials/feed-hub) die zuverlässigere Langzeitoption, sofern einer verfügbar ist. **Ergebnis:** wiederholbares Lieferanten-Onboarding.
  </Accordion>

  <Accordion title="Du brauchst einen Feed, keinen Scrape">
    Wenn die Quelle dir einen XML- oder CSV-Feed bereitstellen kann, bevorzuge den [Feed-Hub-Import](/de/essentials/feed-hub) oder den [Dateiimport](/de/essentials/importing-products): Strukturierte Feeds sind schneller und zuverlässiger als das Crawlen. Nutze das Scraping, wenn kein Feed verfügbar ist. **Ergebnis:** das richtige Werkzeug für jede Quelle.
  </Accordion>
</AccordionGroup>

## Der Vergleich

|                   | Web-Scraping-Import             | Datei-/Feed-Import                                     | Web-Recherche                                       |
| ----------------- | ------------------------------- | ------------------------------------------------------ | --------------------------------------------------- |
| **Eingabe**       | Eine Live-Website-URL           | Eine XML-/CSV-/JSON-Datei oder ein Feed                | Eine Suchanfrage oder Mitbewerber-URL               |
| **Am besten für** | Websites ohne verfügbaren Feed  | Lieferanten und Kanäle, die einen Feed veröffentlichen | Fakten sammeln, um bestehende Produkte anzureichern |
| **Die AI macht**  | Extrahiert Felder von der Seite | Ordnet Spalten den Feldern zu                          | Sucht und fasst zusammen                            |
| **Ausgabe**       | Produkte in deinem Katalog      | Produkte in deinem Katalog                             | Recherche, die du auf Inhalte anwendest             |

## Verwandtes

<CardGroup cols={2}>
  <Card title="Produkte importieren" icon="upload" href="/de/essentials/importing-products">
    Dateibasierter Import (CSV, Excel), wenn du strukturierte Daten hast.
  </Card>

  <Card title="Feed Hub" icon="rss" href="/de/essentials/feed-hub">
    Aus XML-/Feed-Quellen importieren und in sie veröffentlichen.
  </Card>

  <Card title="Web-Recherche" icon="globe" href="/de/ai/web-research">
    Recherchiere Produkte im Web, um das anzureichern, was du bereits hast.
  </Card>

  <Card title="Produkte anreichern" icon="sparkles" href="/de/essentials/enriching-products">
    Fülle die Lücken, die der Scrape hinterlassen hat, mit AI.
  </Card>
</CardGroup>
