octoparse detect ouvre le navigateur de l’Extension Octoparse, inspecte la page et génère un fichier de Tâche local. Utilisez-la pour créer une Tâche depuis une URL sans l’application de bureau Octoparse.
Depuis v0.1.32, detect rejette avant la génération les pages de CAPTCHA, accès restreint, défi de sécurité et erreur de service. Le classement écarte aussi plus strictement les zones faibles et les enveloppes de navigation couvrant toute la page. Les pages complexes et parcours de connexion peuvent toujours exiger une vérification manuelle.
Pour les agents IA, utilisez
--agent ou le flux prepare / preview / apply plutôt que --auto, réservé à une sélection directe par la CLI.
detect exige un compte Octoparse valide, des identifiants et Chrome local. Linux arm64 n’est pas pris en charge. Consultez les plateformes d’Extraction locale prises en charge.Mode automatique
La CLI choisit la meilleure zone candidate et génère un fichier :--json :
--output, un fichier detected_<host>.json est créé automatiquement.
Choisir un mode de navigateur
Utilisez Chrome for Testing indépendant ou un profil système connecté :octoparse browser --help est : option de commande, OCTOPARSE_BROWSER, réglage octoparse browser use enregistré, puis independent. Le mode utilisateur existe sous Windows et macOS.
Mode manuel
Il ouvre une surcouche de navigateur permettant de se connecter, fermer les fenêtres et choisir la zone :--save-session pour stocker les Cookies des sites exigeant une connexion et les réutiliser lors des exécutions locales :
Les sessions de Cookies ne couvrent pas tous les sites, notamment ceux exigeant localStorage, une liaison à l’appareil ou une nouvelle vérification.
Valider la Tâche générée
Flux de travail d’agent IA
Pour les flux pilotés par LLM ou automatisés, utilisez le contrat agent au lieu de--auto. Commencez par lire les capacités :
machineContract.recipes.createTaskFromUrlWithAgent, le flux recommandé pour les agents.
En une seule opération (le plus rapide)
Utilisez--agent avec un runner local fiable capable de lire un fichier de contexte et d’écrire un plan :
Procédure auditable étape par étape
Pour les audits ou réparations, utilisez la séquence prepare / preview / apply.1
Préparer le contexte agent
Exportez le contexte de la page pour la planification.
context.json contient les zones candidates, échantillons de champs, captures visuelles et un decisionSummary.2
Écrire un plan
Créez
plan.json depuis context.json avec le schéma octopus.detect.agent-plan.v1. Ouvrez la capture annotée située dans context.visualArtifacts.annotatedScreenshotPath avant de choisir les champs, puis ajoutez les preuves visualReview au plan.3
Prévisualiser le plan
Validez-le avant la génération finale.Si
data.pass vaut false, corrigez le plan avant de l’appliquer.4
Appliquer le plan
Générez le fichier local final.Vous pouvez ensuite inspecter et valider
task.json, ou l’utiliser dans une exécution CLI locale.Dépanner detect
Étape suivante
Exécuter votre première Tâche
Exécutez localement, vérifiez l’état et exportez les résultats.
Aide-mémoire des commandes
Référence complète des commandes detect, run, cloud, data et auth.