Skip to main content
El constructor sin código te permite crear flujos de trabajo de extracción personalizados mediante la interacción visual con un sitio web. En lugar de escribir código para el scraper, seleccionas elementos de la página y agregas acciones al flujo de trabajo, como hacer clic, recorrer en bucle, Paginar, desplazar, esperar y Extraer datos. Úsalo cuando las Plantillas o la Auto-detección no se ajusten por completo al sitio web objetivo o a tus requisitos de datos.

Escenarios que gestiona

Extraer listas repetidas

Extrae elementos repetidos de resultados de búsqueda, directorios, cuadrículas de productos o tablas.

Profundizar en páginas de detalle

Haz clic en cada elemento, recopila campos adicionales y vuelve a la lista.

Navegar por varias páginas

Recorre páginas, carga más resultados o desplázate para mostrar contenido dinámico.

Personalizar los valores de los campos

Selecciona campos manualmente y refina los valores extraídos antes de exportarlos.
Usa el constructor sin código cuando:
  • No exista una Plantilla adecuada
  • La Auto-detección omita campos o acciones de la página
  • El flujo de trabajo requiera páginas de detalle
  • El sitio web use una Paginación personalizada o desplazamiento infinito
  • Necesites gestionar ventanas emergentes, menús, pestañas o pasos de inicio de sesión
  • Necesites limpiar los campos antes de exportarlos

Flujo de trabajo básico

1

Abrir la página

Empieza con la URL que contiene los datos que quieres recopilar.
2

Seleccionar elementos

Haz clic en los Campos de datos, botones, enlaces o elementos de lista que definen el flujo de trabajo de extracción.
3

Elegir acciones

Agrega acciones como Extraer datos, hacer clic, recorrer elementos en bucle, Paginar, desplazar o esperar.
4

Revisar el flujo de trabajo

Comprueba la secuencia de acciones y asegúrate de que la tarea siga la ruta prevista por las páginas.
5

Realizar una prueba

Ejecuta una muestra pequeña y revisa los resultados antes de ejecutar la tarea completa.

Acciones habituales

Editar selectores manualmente

Cuando la selección de elementos predeterminada no capture los datos correctos, puedes editar directamente el XPath subyacente. Esto resulta útil cuando:
  • El selector generado automáticamente es demasiado amplio o demasiado limitado
  • Necesitas seleccionar un atributo específico, por ejemplo, href, src o data-price, en lugar del texto visible
  • La estructura de la página cambia ligeramente entre elementos y el selector predeterminado omite algunas filas
Para editar un selector, haz clic en un campo del flujo de trabajo y cambia al modo de edición de XPath. Puedes probar el selector modificado en la página activa antes de guardarlo.

Resolución de problemas

Prácticas recomendadas

  • Empieza con una muestra pequeña antes de ejecutar la tarea completa.
  • Usa nombres de campo claros.
  • Comprueba si los valores se capturan de texto visible, enlaces, imágenes, atributos o HTML.
  • Agrega esperas cuando el contenido se cargue dinámicamente.
  • Mantén el flujo de trabajo lo más sencillo posible.
  • Vuelve a realizar pruebas después de que cambie el sitio web objetivo.
El constructor sin código crea un flujo de trabajo repetible basado en la estructura del sitio web. Si el sitio cambia de forma considerable, puede que tengas que ajustar la tarea.

Páginas relacionadas

Plantillas

Empieza con un flujo de trabajo preconfigurado para sitios web habituales.

Auto-detección

Deja que Octoparse analice una página y genere automáticamente un flujo de trabajo inicial.

Refinar datos

Limpia y cambia el formato de los campos extraídos antes de exportarlos.