> ## Documentation Index
> Fetch the complete documentation index at: https://www.octoparse.com/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Aufgaben aus einer URL erstellen

> Prüfen Sie mit octoparse detect eine URL, wählen Sie einen Datenbereich aus und erstellen Sie lokal eine Aufgabendatei – automatisch, manuell oder per KI-Agent.

`octoparse detect` öffnet den Octoparse-Erweiterungsbrowser, untersucht die Seite und erstellt eine lokale Aufgabendatei. Verwenden Sie den Befehl, um ohne die Octoparse-Desktop-App eine Aufgabe aus einer URL zu erstellen.

<Note>
  Seit v0.1.32 lehnt detect CAPTCHA-, zugriffsbeschränkte, Sicherheitsprüfungs- und Dienstfehlerseiten vor der Aufgabenerstellung ab. Die Kandidatenbewertung weist schwache Bereiche und Navigationsgerüste ganzer Seiten ebenfalls konsequenter zurück. Komplexe Seiten und Anmeldeabläufe können weiterhin eine manuelle Prüfung erfordern.
</Note>

Drei Modi sind verfügbar:

| Modus                | Verwendungszweck                                                                    |
| -------------------- | ----------------------------------------------------------------------------------- |
| `--auto`             | Die CLI soll automatisch den besten Datenbereich auswählen                          |
| `--manual`           | Sie müssen sich einloggen, eine Paywall schließen oder den Bereich selbst auswählen |
| KI-Agent (`--agent`) | Ein LLM oder Automatisierungstool steuert den Workflow                              |

Verwenden Sie für KI-Agenten `--agent` oder den Workflow „Vorbereiten/Vorschau/Anwenden“ statt `--auto`. Der automatische Modus ist für die direkte Auswahl durch die CLI vorgesehen.

<Note>
  `detect` erfordert ein gültiges Octoparse-Konto und gültige Anmeldedaten. Außerdem ist lokales Chrome erforderlich. `detect` unterstützt Linux arm64 nicht. Plattformanforderungen finden Sie unter [Installation](../quick-start/installation#supported-platforms-for-local-extraction).
</Note>

## Automatischer Modus

Die CLI wählt den besten geeigneten Datenbereich aus und erstellt eine Aufgabendatei:

```bash theme={null}
octoparse detect <url> --auto --output task.json
```

Übergeben Sie in natürlicher Sprache, was Sie extrahieren möchten:

```bash theme={null}
octoparse detect <url> --auto --goal "Extract product titles and prices" --output task.json
```

Suchen Sie vor der Erkennung nach einem Stichwort. Dies ist für Suchergebnisseiten nützlich:

```bash theme={null}
octoparse detect <url> --auto --query "keyword" --goal "Extract search results" --output task.json
```

Verwenden Sie `--json` für eine strukturierte Antwort:

```bash theme={null}
octoparse detect <url> --auto --goal "..." --output task.json --json
```

Wenn `--output` fehlt, wird automatisch die Datei `detected_<host>.json` erstellt.

## Browsermodus auswählen

Verwenden Sie unabhängiges Chrome for Testing oder nutzen Sie ein angemeldetes Systembrowserprofil erneut:

```bash theme={null}
octoparse detect <url> --browser independent --auto
octoparse detect <url> --browser user --browser-id chrome --profile "Default" --manual
```

Der Browsermodus folgt der von `octoparse browser --help` dokumentierten gemeinsamen Priorität: Befehls-Flag, `OCTOPARSE_BROWSER`, gespeicherte Einstellung von `octoparse browser use`, dann `independent`. Der Benutzermodus ist unter Windows und macOS verfügbar.

## Manueller Modus

Der manuelle Modus öffnet ein Browser-Overlay, in dem Sie die Anmeldung abschließen, Pop-ups schließen und den Datenbereich selbst auswählen können:

```bash theme={null}
octoparse detect <url> --manual
octoparse detect <url> --manual --goal "Get article titles and links"
```

Speichern Sie mit `--save-session` Cookies für Websites, die eine Anmeldung erfordern, damit künftige lokale Läufe die Sitzung wiederverwenden können:

```bash theme={null}
octoparse detect <url> --manual --save-session --session-name my-session --output task.json
```

<Note>
  Cookie-Sitzungen decken nicht jede Website ab. Das gilt insbesondere für Seiten, die localStorage, Gerätebindung oder eine erneute Verifizierung erfordern.
</Note>

## Generierte Aufgabe validieren

Validieren Sie die Aufgabendatei nach der Erstellung, bevor Sie sie ausführen:

```bash theme={null}
octoparse task validate <taskId> --task-file task.json
```

Führen Sie anschließend lokal einen Probelauf aus:

```bash theme={null}
octoparse run <taskId> --task-file task.json --max-rows 10 --headless
```

Exportieren Sie die Ergebnisse des Probelaufs:

```bash theme={null}
octoparse data export <taskId> --source local --format xlsx
```

## Workflow für KI-Agenten

Verwenden Sie für LLM-gesteuerte oder automatisierte Workflows den Agentenvertrag statt `--auto`. Lesen Sie zunächst den Funktionsumfang aus:

```bash theme={null}
octoparse capabilities --json
```

Die Antwort enthält `machineContract.recipes.createTaskFromUrlWithAgent` – den empfohlenen Workflow für Agenten.

### In einem Durchgang (am schnellsten)

Verwenden Sie `--agent` mit einem vertrauenswürdigen lokalen Runner, der eine Kontextdatei lesen und einen Plan schreiben kann:

```bash theme={null}
octoparse detect <url> \
  --agent \
  --agent-command "path/to/your/agent-runner" \
  --goal "Extract search results" \
  --output task.json \
  --yes \
  --run-sample 5 \
  --json
```

Die Antwort ist ein einzelner JSON-Umschlag mit der generierten Aufgabe, dem Vorschauergebnis und der Ausgabe des Probelaufs.

### Überprüfbar und schrittweise

Verwenden Sie für Prüf- oder Reparaturszenarien die Abfolge „Vorbereiten/Vorschau/Anwenden“, statt die Aufgabe in einem Schritt zu erstellen.

<Steps>
  <Step title="Agentenkontext vorbereiten">
    Exportieren Sie den Webseitenkontext für die Planung durch den Agenten.

    ```bash theme={null}
    octoparse detect <url> \
      --prepare-agent \
      --goal "Extract product titles and prices" \
      --output context.json \
      --json
    ```

    Dadurch wird `context.json` mit geeigneten Datenbereichen, Feldbeispielen, visuellen Screenshots und einer `decisionSummary` erstellt.
  </Step>

  <Step title="Plan schreiben">
    Erstellen Sie auf Grundlage von `context.json` eine Datei `plan.json`.

    Verwenden Sie das Schema `octopus.detect.agent-plan.v1`. Öffnen Sie den Pfad des annotierten Screenshots unter `context.visualArtifacts.annotatedScreenshotPath`, bevor Sie Felder auswählen, und nehmen Sie `visualReview`-Nachweise in den Plan auf.
  </Step>

  <Step title="Planvorschau anzeigen">
    Validieren Sie den Plan, bevor Sie die endgültige Aufgabendatei erstellen.

    ```bash theme={null}
    octoparse detect \
      --preview-agent-plan plan.json \
      --agent-context context.json \
      --json
    ```

    Wenn `data.pass` den Wert false hat, überarbeiten Sie den Plan vor dem Anwenden.
  </Step>

  <Step title="Plan anwenden">
    Erstellen Sie die endgültige lokale Aufgabendatei.

    ```bash theme={null}
    octoparse detect \
      --apply-agent-plan plan.json \
      --agent-context context.json \
      --output task.json
    ```

    Die generierte Datei `task.json` kann anschließend geprüft, validiert oder für einen lokalen CLI-Lauf verwendet werden.
  </Step>
</Steps>

## Fehlerbehebung für detect

| Problem                                       | Zu prüfen                                                                                                                                          |
| --------------------------------------------- | -------------------------------------------------------------------------------------------------------------------------------------------------- |
| Chrome startet nicht                          | Führen Sie `octoparse doctor` aus und prüfen Sie den Eintrag `chrome`. Versuchen Sie `--chrome-path /path/to/chrome`                               |
| `LINUX_ARM64_UNSUPPORTED`                     | Wechseln Sie zu einer Linux-x64-Umgebung oder verwenden Sie die Cloud-Extraktion                                                                   |
| `LOGIN_SESSION_REQUIRED`                      | Melden Sie sich mit `--manual` an und speichern Sie die Sitzung mit `--save-session`                                                               |
| Planvorschau gibt `pass: false` zurück        | Überarbeiten Sie `candidateId` oder die Feldauswahl in `plan.json` und führen Sie die Vorschau erneut aus                                          |
| Aufgabe liefert leere oder falsche Ergebnisse | Prüfen Sie `context.resultValidationPolicy` im Agentenkontext; einzelne fehlende Felder in Anzeigen oder uneinheitlichen Zeilen sind häufig normal |

## Wie geht es weiter?

<CardGroup cols={2}>
  <Card title="Erste Aufgabe ausführen" href="../quick-start/run-your-first-task">
    Führen Sie eine generierte Aufgabe lokal aus, prüfen Sie den Status und exportieren Sie Ergebnisse.
  </Card>

  <Card title="Befehlsübersicht" href="../reference/command-cheatsheet">
    Vollständige Übersicht der Befehle für detect, run, cloud, data und auth.
  </Card>
</CardGroup>
