Firecrawl - Extract dataアクション
Extract dataアクションは、FirecrawlでAgent抽出ジョブを実行します。プロンプトは必須です。また、抽出データをさらに制約するJSONスキーマを任意で追加できます。 URLsは任意です。 URLsを空白のままにすると、Agentが自動的にWebを検索して移動します。
完了を待機
このアクションはデフォルトでジョブを送信し、その後ジョブのステータスがcompletedまたはfailedになるまで60秒ごとにポーリングします。ジョブIDをすぐに返すには、Wait for completionでNoを選択します。その後、Get extract job statusアクションを使用して後で確認します。
入力
次の入力フィールドは最もよく使用されます。入力フィールドの完全なリストについては、FirecrawlのAgent APIドキュメントを参照してください。
| 入力フィールド | 説明 |
|---|---|
| プロンプト | 抽出するデータの自然言語による説明を入力します。最大10,000文字です。 |
| JSONスキーマ | 任意です。抽出するデータを記述するJSONスキーマを入力します。このスキーマはFirecrawlにのみ送信されます。抽出データのデータピルを取得するには、Custom output fieldsに一致するフィールドを追加します。 |
| URL | 任意です。 Agentが注目するURLsを入力します。 |
| Web検索を有効化 | 任意です。 YesまたはNoを選択します。 Agentを指定したURLsのみに限定するには、Noを選択します。デフォルトはYesです。 |
| 最大クレジット | 任意です。この実行のクレジット上限を入力します。上限に達すると、データなしでジョブが失敗します。このコネクターのデフォルトは100です。 Firecrawl APIのデフォルトは2500です。 |
| モデル | 任意です。使用するモデルを選択します。オプションはSpark 2、Spark 1 Mini、またはSpark 1 Proです。デフォルトはSpark 2です。 FirecrawlはSpark 1オプションを受け入れますが、クロールリクエストはSpark 2にルーティングします。 |
| Effort | 任意です。 Spark 2の推論バジェットを選択します。オプションはLow、Medium、またはHighです。 |
| 完了を待機 | 任意です。ジョブが完了して結果を返すまでポーリングするには、YesまたはNoを選択します。デフォルトはYesです。 |
| 最大ポーリング時間(分) | 任意です。ポーリングする最大分数を入力します。有効な値は1~60です。デフォルトは10です。このフィールドは、Wait for completionがYesの場合にのみ使用できます。 |
| カスタム出力フィールド | 任意です。デフォルト出力に含まれない抽出データフィールドのデータピルを作成するには、フィールドを追加します。 |
出力
| 出力フィールド | 説明 |
|---|---|
| 成功 | リクエストが成功したかどうかを示すtrueまたはfalseのブール応答。 |
| Status | ジョブのステータス。オプションはprocessing、completed、またはfailedです。キャンセルされたジョブもfailedを報告します。 |
| モデル | ジョブに使用されたモデル。 |
| Effort | ジョブに使用された推論バジェット。 |
| モード | ジョブに使用されたAgentモード(例:extract)。 |
| Expires at | ジョブの結果の有効期限が切れる日時。 |
| エラー | ジョブが失敗した場合のエラーメッセージ。 |
| メッセージ | ジョブの結果を説明するメッセージ。 |
| データ | プロンプトまたはスキーマに一致する抽出データ。 |
| 作成日時 | ジョブが作成された日時。 |
最終更新日: