パイプラインをビルドする

データの読み込みと変換、データ品質チェックの適用、ターゲット テーブルへの結果の書き込みによって、Lakeflow パイプラインを構築します。 次のトピックでは、パイプラインの構築と実行に関連するタスクについて説明します。

パイプラインの背後にある宣言型の概念 (データセット、フロー、パイプライン グラフ) については、「 Lakeflow パイプラインとは」を参照してください。 詳細なチュートリアルについては、「 チュートリアル: 変更データ キャプチャを使用して ETL パイプラインを構築する」を参照してください。

トピック 説明
Lakeflow パイプライン エディターでの開発 パイプライン グラフ、データ プレビュー、選択的実行を使用して、エディターでパイプラインを作成、実行、デバッグします。
パイプライン開発に Genie Code を使用する エディターで Genie Code Agent モードを使用して、1 つのプロンプトからパイプライン コードを生成、編集、デバッグします。
ID と特権を管理する パイプラインを実行する ID と、パイプラインとその出力を作成、実行、更新、および表示できるユーザーを制御します。
データの読み込み クラウド オブジェクト ストレージとストリーミング メッセージ バスからパイプラインにデータを取り込みます。
データの変換 変換、結合、集計を適用して、派生データセットを構築します。
ストリーミング テーブルの完全更新 すべてのソース データを再処理して、ストリーミング テーブルを再構築します。
データ品質 期待どおりにレコードを検証し、レコードが失敗したときの動作を制御します。
データセットを書き込む Apache Kafka や Azure Event Hubs などのシンクにパイプラインの結果を書き込み、フローを使用してストリーミング ターゲットに書き込みます。

その他のリソース