> ## Documentation Index
> Fetch the complete documentation index at: https://www.octoparse.com/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Auto-Erkennung

> Mit der Auto-Erkennung kann Octoparse Seitendaten erkennen und automatisch einen ersten Extraktionsworkflow erstellen.

Die Auto-Erkennung scannt eine Webseite, erkennt wiederkehrende Datenmuster und erzeugt einen ersten Extraktionsworkflow – einschließlich Datenfeldern und Paginierungslogik. Hinsichtlich Aufwand und Flexibilität liegt sie zwischen [Vorlagen](/docs/de/platform/templates) (am schnellsten, aber auf unterstützte Websites beschränkt) und dem [No-Code-Builder](/docs/de/platform/no-code-builder) (vollständige manuelle Kontrolle).

## Wann Sie die Auto-Erkennung verwenden sollten

Verwenden Sie die Auto-Erkennung, wenn:

* die Seite wiederkehrende Elemente wie Produkte, Einträge, Bewertungen oder Suchergebnisse enthält
* Sie schnell einen ersten Workflow benötigen
* Sie nicht sicher sind, welche Elemente Sie manuell auswählen sollen
* Octoparse Felder und Paginierungslogik vorschlagen soll
* Sie schnell eine Vorschau der von einer Zielwebsite extrahierbaren Daten erhalten möchten, bevor Sie eine vollständige Konfiguration vornehmen
* Sie den erzeugten Workflow anschließend prüfen und anpassen möchten

Die Auto-Erkennung ist ein Ausgangspunkt, keine Garantie dafür, dass jedes Feld oder jede Aktion korrekt ist.

## So funktioniert die Auto-Erkennung

Die Auto-Erkennung analysiert die DOM-Struktur und das visuelle Layout der Seite, lokalisiert mithilfe von Ähnlichkeitsberechnungen und Merkmalskombinationen wiederkehrende Datenbereiche und erzeugt automatisch Extraktionsregeln.

<Steps>
  <Step title="Zielseite öffnen">
    Beginnen Sie mit der Seite, die die zu extrahierenden Daten enthält.
  </Step>

  <Step title="Auto-Erkennung ausführen">
    Octoparse scannt die Seite, erkennt wiederkehrende Datenbereiche und erzeugt Extraktionsfelder. Zudem versucht es, Paginierungs- oder „Nächste Seite“-Schaltflächen zu erkennen, damit die Aufgabe automatisch mehrere Ergebnisseiten durchlaufen kann.
  </Step>

  <Step title="Erkannte Felder prüfen">
    Prüfen Sie, ob die vorgeschlagenen Felder den benötigten Daten entsprechen.
  </Step>

  <Step title="Seitennavigation bestätigen">
    Prüfen Sie Paginierung, Scrollen oder Aktionen für die nächste Seite. Die Auto-Erkennung kann eine „Nächste Seite“-Schaltfläche oder ein Endlos-Scrollmuster erkennen – vergewissern Sie sich vor einer Ausführung im großen Umfang, dass es richtig funktioniert.
  </Step>

  <Step title="Aufgabe testen">
    Führen Sie einen Test aus und prüfen Sie die Ausgabe, bevor Sie die Extraktion skalieren.
  </Step>
</Steps>

## Was Sie nach der Erkennung prüfen sollten

Nachdem die Auto-Erkennung einen Workflow erzeugt hat, prüfen Sie Folgendes:

| Bereich        | Zu prüfen                                              | Behebung                                                                |
| -------------- | ------------------------------------------------------ | ----------------------------------------------------------------------- |
| Felder         | Werden die richtigen Werte erfasst?                    | Element erneut auswählen oder XPath im Bereich „Datenvorschau“ anpassen |
| Feldnamen      | Sind die Spaltennamen klar und aussagekräftig?         | Felder vor dem Export umbenennen                                        |
| Paginierung    | Wechselt die Aufgabe korrekt zur nächsten Seite?       | Schaltfläche für die nächste Seite oder Scrollaktion manuell festlegen  |
| Detailseiten   | Öffnet der Workflow bei Bedarf die Elementdetails?     | Klickaktion zum Öffnen von Detailseiten hinzufügen                      |
| Duplikate      | Sind wiederholte oder unerwünschte Elemente enthalten? | Unerwünschte Felder oder Zeilen im Bereich „Datenvorschau“ löschen      |
| Fehlende Werte | Fehlen in manchen Zeilen wichtige Felder?              | Felder im Bereich „Datenvorschau“ manuell hinzufügen                    |

## Bekannte Einschränkungen

Die Auto-Erkennung funktioniert am besten auf Seiten mit klaren, wiederkehrenden Datenstrukturen. In bestimmten Situationen kann sie unvollständige oder ungenaue Ergebnisse erzeugen:

| Situation                                                     | Mögliche Folge                                                                                                    |
| ------------------------------------------------------------- | ----------------------------------------------------------------------------------------------------------------- |
| Nicht standardmäßiges oder unregelmäßiges Seitenlayout        | Felder werden möglicherweise falsch erkannt oder fehlen                                                           |
| Mit JavaScript gerenderte dynamische Inhalte                  | Daten, die erst nach dem ersten Rendering geladen werden, werden möglicherweise nicht erkannt                     |
| Websites mit Anti-Scraping-Maßnahmen (z. B. Indeed, LinkedIn) | Die Auto-Erkennung kann die Seite möglicherweise nicht laden oder analysieren                                     |
| Komplexe verschachtelte Strukturen                            | Die erkannte Liste kann falsche oder doppelte Elemente enthalten                                                  |
| Falsches Feld erfasst                                         | Das System kann Werbetext statt des tatsächlichen Werts erfassen (z. B. ein Rabattlabel statt des echten Preises) |

Ein häufiger Laufzeitfehler nach der Auto-Erkennung lautet **„\[Loop Item] failed to find current loop item, exiting loop now“**. Dies bedeutet meist, dass der erzeugte XPath nicht mehr mit den tatsächlichen Seitenelementen übereinstimmt. Eine erneute Auto-Erkennung oder die manuelle Anpassung des Selektors im No-Code-Builder behebt das Problem normalerweise.

## Wann eine manuelle Bearbeitung erforderlich ist

Manuelle Anpassungen können nötig sein, wenn:

* das Seitenlayout unregelmäßig ist
* wichtige Felder außerhalb der erkannten Liste liegen
* die Website Inhalte dynamisch lädt
* die Paginierung nicht richtig erkannt wird
* die Seite eine Anmeldung, Filter, Pop-ups oder Benutzerinteraktionen erfordert
* Sie Daten aus Detailseiten extrahieren müssen

Verfeinern Sie den erzeugten Workflow mit dem No-Code-Builder.

<Warning>
  Gehen Sie nicht davon aus, dass die Ausgabe der Auto-Erkennung produktionsbereit ist. Prüfen Sie stets die Felder, führen Sie einen Test aus und kontrollieren Sie die exportierten Daten.
</Warning>

## Verwandte Seiten

<Columns cols={3}>
  <Card title="Vorlagen" href="/docs/de/platform/templates">
    Beginnen Sie mit einem vorgefertigten Workflow für gängige Websites.
  </Card>

  <Card title="No-Code-Builder" href="/docs/de/platform/no-code-builder">
    Passen Sie Workflows nach der Auto-Erkennung manuell an oder erstellen Sie sie selbst.
  </Card>

  <Card title="Daten verfeinern" href="/docs/de/platform/refine-data">
    Bereinigen und formatieren Sie extrahierte Felder vor dem Export neu.
  </Card>
</Columns>
