Skip to main content
Tabelog es la mayor plataforma de reseñas de restaurantes y gastronomía de Japón. Reúne información estructurada de establecimientos, valoraciones, reseñas y disponibilidad de reservas, por lo que suele utilizarse para crear listas de leads de restaurantes, monitorear competidores, realizar investigaciones de mercado por zonas y analizar reseñas. Esta guía explica qué puedes extraer de Tabelog y cómo navegar por la estructura de sus páginas. Para saber si es legal extraer datos de Tabelog, consulta ¿Es legal el web scraping?.

Qué puedes extraer de Tabelog

Los campos disponibles dependen del tipo de página, así que decide qué necesitas antes de elegir las páginas que visitarás. Páginas de resultados de búsqueda (listados): filtradas por zona y género, reúnen los datos básicos de muchos restaurantes: nombre, género, zona y estación más cercana, valoración, número de reseñas, intervalo de precios (almuerzo/cena) y URL de cada establecimiento. Páginas de detalles del establecimiento: perfil completo de un restaurante, con dirección, teléfono, acceso, horario, días de cierre, número de asientos, disponibilidad de salas privadas y métodos de pago. Páginas de reseñas: texto de la reseña, autor, puntuación y periodo de la visita. El texto de las reseñas cuenta con una elevada protección de derechos de autor, por lo que debes tratarlo con cuidado después de recopilarlo. Calendario de disponibilidad/reservas: disponibilidad por fecha. Por lo general, esta sección se representa mediante JavaScript y no aparece en una solicitud HTML sencilla.

Paso 1: recopilar el listado de los resultados de búsqueda

Empieza acotando el objetivo por zona y género. Las condiciones de búsqueda de Tabelog se reflejan en los parámetros de la URL; preparar una URL para cada combinación mantiene el alcance explícito y manejable. En el listado, recopila los campos básicos —nombre, valoración y presupuesto— junto con el enlace a la página de detalles.

Paso 2: acceder a las páginas de detalles

Recorre en bucle las URL recopiladas y extrae los campos detallados: dirección, teléfono, horario, número de asientos, etc. Decidir de antemano si basta con el listado o si también necesitas los detalles evita transiciones innecesarias y reduce la carga sobre el sitio.

Paso 3: recopilar reseñas cuando sean necesarias

Extrae reseñas solo cuando el análisis de opinión o tendencias lo requiera. Los listados suelen cargar más entradas mediante un botón «mostrar más» o Paginación, por lo que la recopilación exige interacción. Consulta Cómo gestionar la Paginación.

Gestionar contenido representado mediante JavaScript

Elementos como el calendario de disponibilidad no existen en el HTML al abrir la página: solo aparecen después de que se ejecute JavaScript. Un scraper que únicamente recupere el HTML sin procesar encontrará esas partes vacías. La solución es representar la página en un navegador real que ejecute JavaScript y extraer datos del DOM completo. Extracción de páginas representadas mediante JavaScript explica por qué se necesita un navegador y qué alternativas existen, como llamar directamente a la API subyacente o detectar SSR. En código, Playwright y herramientas similares funcionan de la misma forma.
Espera a que aparezca el elemento concreto que necesitas, como una fecha del calendario, en lugar de esperar a que la página «termine» de cargarse. El evento de carga y el fin de la representación del contenido no ocurren al mismo tiempo.

Controles anti-bot y extracción responsable

Tabelog aplica controles contra el acceso automatizado. Muchas solicitudes en un periodo breve facilitan la detección del scraper. Mantener una frecuencia, un volumen y unos tiempos moderados —sin alejarse demasiado de la navegación humana— es esencial para recopilar datos de forma fiable.
En lugar de intentar eludir técnicamente los controles, prioriza un diseño que evite generar carga. Tabelog puede establecer Disallow en algunas rutas de robots.txt; comprueba las condiciones y robots.txt para cada URL. El texto de las reseñas está muy protegido por derechos de autor: poder recopilarlo no implica que puedas volver a publicarlo o distribuirlo. Consulta ¿Es legal el web scraping?.

Extraer datos con Octoparse

Octoparse representa las páginas en un navegador real con interfaz, por lo que puede gestionar contenido con JavaScript, como el calendario de disponibilidad, sin escribir código. Los bucles entre listados y detalles y la espera del contenido de carga diferida se configuran en el editor visual. Para obtener datos de forma continua, la Extracción en la nube se ejecuta según una programación aunque tu equipo esté apagado. Puedes empezar con la Plantilla para extraer datos de establecimientos de Tabelog, que permite partir de una URL y obtener una vista previa de los campos.

Casos de uso

  • Listas de leads de restaurantes: organiza por zona y género los establecimientos para crear una lista de contacto.
  • Monitoreo de competidores: sigue la evolución de valoraciones y reseñas en una zona.
  • Investigación de mercado por zonas: analiza la distribución de géneros, precios y densidad de establecimientos.
  • Análisis de turismo y reseñas: agrega tendencias para detectar demanda y oportunidades de mejora.
La extracción de Tabelog funciona mejor con un objetivo acotado. Decide primero qué recopilarás: la lista de campos será menor, el sitio recibirá menos carga y los resultados serán más fiables.