- AIによるフィルタリングと 自然言語
- APIを介したリアルタイムデータ配信
- 必要なデータのみを支払う
- すぐに使えるコード例 7言語以上で利用可能
世界中の20,000+人のお客様から信頼されています。
単一のプロンプトで大規模データセットをフィルタリングする
必要な内容を平易な英語で正確に記述し、AIが最適なフィルターを自動適用します。関連データのみを取得することでコスト削減を実現します。
- 自然言語フィルタリング - コーディング不要
- AIが正確なフィルターを自動的に適用します
- 数十億件の記録から重要な情報のみを抽出する
- 任意のフィールドでフィルタリング: 所在地、業種、職種、日付
- フィルタリングされたデータをJSON、CSV、またはParquet形式でエクスポートする
あらゆる業界向けリアルタイムデータAPI
強力なフィルターAPIを介して120以上のドメインから構造化され検証済みのデータにアクセス。必要なデータのみをリアルタイムでアプリケーションに配信します。
- 120以上のドメイン
- 190以上のデータセットAPI
- 数十億件の記録
Data Feeds Pricing
- クリーンで検証済み
- 毎月更新
- JSON/CSV/Parquet
Flexible delivery to fit your workflow
APIレスポンス、Webhook、S3、Snowflake、Azure、または直接ダウンロード経由でフィルタリングされたデータを受信する
curl --request POST
--url https://api.brightdata.com/データセット/filter
--header 'Authorization: Bearer'
--header 'Content-Type: application/json'
--data '{
"dataset_id": "gd_l1viktl72bvl7bjuj0",
"records_limit": 100,
"filter": {
"name": "job_title",
"operator": "=",
"value": "Software Engineer"
}
}'
import requests
url = "https://api.brightdata.com/データセット/filter"
headers = {"Authorization": "Bearer"}
payload = {
"データセット_id": "gd_l1viktl72bvl7bjuj0",
"records_limit": 100,
"filter": {
"name": "job_title",
"operator": "=",
"value": "Software Engineer"
}
}
"filter": ^{
"name": "job_title",
"operator": "=",
"value": "Software Engineer"
}
}
response = requests.post(url, json=payload, headers=headers)
print(response.json())
const url = 'https://api.brightdata.com/データセット/filter';
const options = {
method: 'POST',
headers: {
'Authorization': 'Bearer',
'Content-Type': 'application/json'
},
body: JSON.stringify({
dataset_id: 'gd_l1viktl72bvl7bjuj0',
records_limit: 100,
filter: {
name: 'job_title',
operator: '=',
value: 'Software Engineer'
}
})
};
try {
const response = await fetch(url, options);
const data = await response.json();
console.log(data);
} catch (error) {
console.error(error);
}
HttpResponse response = Unirest.post("https://api.brightdata.com/データセット/フィルター")
.header("Authorization", "Bearer")
.header("Content-Type", "application/json")
.body("{"dataset_id":"gd_l1viktl72bvl7bjuj0","records_limit":100,"filter":{"name":"job_title","operator":"=","value":"Software Engineer"}}")
.asString();
シンプルなAPI呼び出しでデータをフィルタリングおよび取得
なぜデータフィードAPIなのか?
AIによるフィルタリング
シンプルなJSON演算子で精密なフィルターを構築。複雑なスクレイピングロジックは不要です。
リアルタイムAPIアクセス
RESTful APIを介してフィルタリングされたデータをアプリケーションに直接取得し、即時応答を実現します。
構造化されクリーンなデータ
事前検証済みで重複排除されたデータは一貫したスキーマを持ち、アプリケーションで即時利用可能です。
柔軟な納品オプション
API、Webhook、S3、Snowflake経由、または直接ダウンロードで、JSON、CSV、Parquet形式で取得可能。
開発者向け
Python、Node.js、cURL、PHP、Go、Java、Ruby のコード例を含む完全な API ドキュメント。
使った分だけお支払いください
数十億件の記録から必要な情報だけを抽出。不要なデータに費用を払う必要はありません。
戦略的なコスト削減で価値を最大化する
レコードごとの支払い
取得した正確なレコード分のみを支払います。数十億件から数千件に絞り込み、使用した分だけ支払います。
スマートデータ更新
「新規レコード」または「更新レコード」のみを購読し、変更のないデータの再ダウンロードは避けてください。
ボリュームディスカウント
大規模なリクエストやサブスクリプションで大幅なコスト削減を実現し、データアクセスを拡張してください。
API効率性
事前フィルタリング済みのデータを直接取得してください。大量のファイルをローカルにダウンロードして処理する必要はありません。
データAPIがどのように役立つかをご覧ください
ターゲットデータを駆使して販売パイプラインを強化
LinkedInプロフィールを職種、企業、所在地、スキルでフィルタリング。正確な見込み客リストを作成し、リードスコアリングを自動化。
リアルタイムの競合分析で常に一歩先を行く
競合他社の価格設定を監視し、製品発売を追跡し、eコマースおよびソーシャルプラットフォーム全体でのレビューと感情を分析する。
モデルには高品質で構造化されたデータを提供してください
AIモデルのトレーニング、LLMの強化、インテリジェントアプリケーションの構築に、数百万件のテキスト、画像、構造化データレコードにアクセスできます。
データに基づいた投資判断を行う
企業の成長指標、資金調達ラウンド、経営陣の変更、市場動向を追跡し、投資機会を特定する。
市場データで不動産投資機会を発見
複数の市場における物件情報、価格動向、賃貸相場、物件特徴を監視し、機会を特定する。
データフィードAPIに関するよくある質問
データフィードAPIとは何ですか?
データフィードAPIはRESTful APIであり、データセットをフィルタリングし、必要なデータのみを含むスナップショットを作成できます。Filter Dataset APIエンドポイントは非同期ジョブを開始し、選択したデータセットをフィルタリングして指定条件に基づくスナップショットを作成します。このスナップショットはダウンロードまたはプログラム経由でアクセス可能です。
フィルタリングプロセスはどのように機能しますか?
Filter DataSet APIを呼び出すと、フィルターを適用してスナップショットを生成する非同期ジョブが作成されます。このプロセスの最大タイムアウトは5分です。完了すると、フィルター処理されたデータにアクセスするためのsnapshot_idが発行されます。課金対象となるのは、レコード単価に基づくスナップショットのサイズのみです。
どのようなフィルタ演算子を使用できますか?
APIは多様な演算子をサポートします:= (等しい)、!= (等しくない)、< と > (より小さい/より大きい)、<= と >= (以下/以上)、 'in' および 'not_in'(値一致)、'includes' および 'not_includes'(部分文字列/配列内含有)、'array_includes' および 'not_array_includes'(配列完全一致)、空値チェック用の 'is_null' / 'is_not_null'。異なる演算子は異なるフィールドタイプ(テキスト、数値、日付、配列)に適用されます。
複数のフィルターを組み合わせることはできますか?
はい。フィルターグループ内で論理演算子「and」または「or」を使用して複数のフィルターを組み合わせることができます。APIは最大3階層までのネストをサポートしています。オブジェクトの配列の場合、「combine_nested_fields」パラメーターを使用すると、配列全体ではなく単一のオブジェクト内で全てのフィルターが一致することを保証できます。
大規模な値リストでフィルタリングするにはどうすればよいですか?
APIは2つのモードをサポートします:標準フィルタリング用のJSONモードと、フィルタ値を含むCSVまたはJSONファイルをアップロードするためのMultipart/Form-Dataモードです。Multipartモードでは、queryパラメータとしてdataset_idとrecords_limitを送信し、フィルタ定義とファイルをフォームデータ本文に含めます。これは数百~数千の値によるフィルタリングに最適です。
APIを利用するにはどのような認証情報が必要ですか?
必要なものは2つだけです:データセットID(データセット詳細ページに記載)とBright Data APIキーです。APIキーはBearerトークンとしてAuthorizationヘッダーに含めてください。データセットフィルタリングにはプロキシ、パスワード、追加の認証情報は不要です。
どのようなデータ形式がサポートされていますか?
フィルタリング済みスナップショットは、JSON、NDJSON、CSV、Parquet形式で利用可能です。スナップショットのダウンロード時または配信方法の設定時に、ご希望の形式を指定できます。
フィルタリングしたデータを取得するにはどうすればよいですか?
APIがsnapshot_idを返した後、フィルタリングされたデータは直接ダウンロード、APIレスポンス、Webhookコールバック、Amazon S3、Google Cloud Storage、Snowflake、Azure、SFTP、またはメール経由で取得できます。ワークフローに最適な配信方法を選択してください。
フィルターがどのレコードにも一致しない場合はどうなりますか?
APIは「指定されたフィルターがどのレコードにも一致しませんでした」というメッセージと共に422エラーを返します。フィルター構文と値がデータセット内のデータと一致しているか確認してください。フィルタリング前にコントロールパネルでデータセットのフィールドとサンプルデータをプレビューできます。
実行できるフィルタジョブの数に制限はありますか?
はい。各データセットには最大100件の並列ジョブ制限があります。この制限を超えると429エラーが発生します。新規ジョブを開始する前に既存ジョブの完了を待つか、制限値の引き上げが必要な大量利用ケースについては営業部門にお問い合わせください。
資金が不足している場合はどうすればよいですか?
フィルタリングされたスナップショットを処理するのにアカウント残高が不足している場合、必要な金額を示す402エラーが発生します。再度試行する前に、アカウントに資金を追加するか、レコード数を減らすようフィルタを調整してください。
コードの例はどこで見つけられますか?
cURL、Python、JavaScript、Java用の完全なコード例はAPIドキュメントで確認できます。各例では認証方法、フィルターリクエストの構造化、レスポンスの処理方法を示しています。また、コントロールパネルでUIにフィルターを適用し「Filter API」をクリックすることで、フィルター構文を直接生成することも可能です。