Firecrawl - サイトをクロールアクション ​

このページは機械翻訳により提供されています。翻訳内容と英語版に相違がある場合は、英語版が優先されます。

サイトをクロールアクションは、Firecrawlでドメインのクロールを開始し、検出した各ページをスクレイピングします。

完了を待機

デフォルトでは、このアクションはクロールを送信し、ジョブのステータスがcompletedまたはfailedになるまで60秒ごとにポーリングします。代わりにジョブIDをすぐに返すには、Wait for completionでNoを選択し、後でGet crawl job statusアクションを使用して確認します。

入力 ​

次の入力フィールドは最もよく使用されます。入力項目の完全なリストについては、FirecrawlのCrawl APIドキュメントを参照してください。

入力フィールド説明
URLクロールする絶対URLを入力します(例:https://docs.firecrawl.dev)。
プロンプト任意です。クローラーオプションを生成するための自然言語を入力します。設定した明示的な項目は、生成された値より優先されます。
制限任意です。クロールするページの最大数を入力します。 1ページにつき1クレジットを消費します。コネクターのデフォルトは10です。 Firecrawl APIのデフォルトは10000です。 Limitが残りのクレジット数を上回る場合、Firecrawlは402エラーを返します。
パスを含める任意です。クロールに含めるパス名の正規表現パターンを入力します(例:blog/.*)。
パスを除外する任意です。クロールから除外するパス名の正規表現パターンを入力します(例:admin/.*)。
ドメイン全体をクロール任意です。子リンクだけでなく、同階層および親の内部リンクもたどるには、YesまたはNoを選択します。
スクレイピングオプション任意です。 Only main contentやSkip TLS verificationなど、形式とスクレイピングオプションを設定します。これは、クロールがスクレイピングするすべてのページに適用されます。スクレイピングオプションでは、Scrape a pageアクションと同じオプションを使用します。
完了を待機任意です。ジョブが完了して結果を返すまでポーリングするには、YesまたはNoを選択します。デフォルトはYesです。
最大ポーリング時間(分)任意です。ポーリングする最大分数を入力します。有効な値は1~60です。デフォルトは10です。このフィールドは、Wait for completionがYesの場合にのみ使用できます。
カスタム出力フィールド任意です。デフォルト出力に含まれないページデータのデータピルを作成する項目を追加します。

出力 ​

出力フィールド説明
成功リクエストが成功したかどうかを示すtrueまたはfalseのブール応答。
Statusジョブのステータス。オプションはscraping、completed、またはfailedです。
完了これまでにクロールされたページ数。
合計検出されたページの合計数。
使用済みクレジットジョブが使用したクレジット数。
Expires atジョブの結果の有効期限が切れる日時。
データクロールされたページのデータ(1ページにつき1エントリ)。
作成日時ジョブが作成された日時。
完了日時ジョブが終了した日時。
次へクロールが完了していない場合、またはレスポンスが10 MBを超える場合に、次の結果チャンクを取得するためのURL。このURLから、Get crawl job statusアクションのSkip項目の値を抽出します。

最終更新日: