ワークフロー概要
1
作成
URL、テンプレート、またはカスタムタスクから開始します。取得するフィールドを選び、クリック、スクロール、ページネーション、詳細ページを開くなどのアクションを定義します。
2
テスト
小さなサンプルを実行し、Octoparseが正しいフィールド、レコード、ページ順序を取得できるか確認します。
3
実行
テストではローカルで、本番・スケジュール・無人・大規模抽出ではクラウドでタスクを実行します。
4
エクスポート
抽出結果をファイル、スプレッドシート、データベース、クラウドストレージ、その他の接続先システムへ送ります。
タスクを作成する
タスクは、OctoparseがWebサイトとどうやり取りするかを定義します。 タスクは次の方法で作成できます。- テンプレートを使う
- 自動検出でページデータを自動識別する
- ノーコードビルダーで要素を手動選択する
- クリック、スクロール、ループ、ページネーション、待機などのアクションを追加する
- エクスポート前にフィールド値を整形する
抽出ロジックをテストする
大規模に実行する前に、小さなサンプルでテストしてください。 次の点を確認します。ローカルまたはクラウドで実行する
Octoparseは、タスクとプランに応じて複数の実行オプションに対応しています。
最適な選択は、Webサイト、タスクの複雑さ、必要な実行頻度、PCをオフにしてもタスクを実行し続ける必要があるかによって異なります。
データをエクスポートする
タスク実行後、Octoparseは抽出結果を構造化レコードとして保存します。 一般的なエクスポート先は次のとおりです。- CSV
- Excel
- JSON
- HTML
- XML
- Google Sheets
- データベース
- クラウドストレージ
関連ページ
ローカル抽出とクラウド抽出
実行環境を比較し、適切な実行モードを選びます。
エクスポート形式
Octoparseが対応する出力形式を確認します。