メトリック ビュー定義では、標準の YAML 構文を使用して、ソース、結合、フィールド、メジャー、フィルター、ウィンドウ メジャー、具体化を宣言します。 以降のセクションでは、それぞれの文法全体について説明します。
各機能の最小ランタイムおよび YAML 仕様バージョンの要件については、 メトリック ビュー機能の可用性に関するページを参照してください。
YAML 仕様の詳細については、 YAML 仕様 1.2.2 のドキュメントを参照してください。
メトリック ビュー エディターで YAML を編集する
このページで説明されている YAML は、メトリック ビュー エディターで直接作成および編集できます。 カタログ エクスプローラーでメトリック ビューを開き、 <> ボタンをクリックして定義を編集します。 代わりに自然言語の説明から YAML を生成するには、エディターから Genie Code を開きます。 エディターの完全なチュートリアルについては、「 メトリック ビューの作成」を参照してください。
最上位の YAML フィールド
メトリック ビューの YAML 定義には、次の最上位レベルのフィールドが含まれています。
| フィールド | タイプ | Description |
|---|---|---|
version |
String | 必須。
1.1など、定義で使用されるメトリック ビュー YAML 仕様のバージョン。 これは仕様形式のバージョンであり、独自の定義に割り当てるリビジョン番号ではありません。 サポートされている仕様バージョンのいずれかを使用します。
YAML 仕様のバージョンを参照してください。 |
comment |
String | オプション。 メトリック ビューの説明。 |
source |
String | 必須。 メトリック ビューのソース データ。 メトリック ビューや SQL クエリなど、テーブルに似た任意の Unity カタログ資産を指定できます。 ソースを参照してください。 |
parameters |
Array | オプション。 呼び出し元がメトリック ビューにテーブル値関数としてクエリを実行するときに渡す名前付き値。 「パラメーター」を参照してください。 |
filter |
String | オプション。 すべてのクエリに適用される SQL ブール式。 フィルターを参照してください。 |
joins |
Array | オプション。 スター スキーマとスノーフレーク スキーマの結合。 「結合」を参照してください。 |
fields |
Array | 条件付きの。 名前、式、およびオプションのセマンティック メタデータを含むフィールド定義。
measuresが指定されていない場合は必須。
「フィールド」を参照してください。
dimensions キーワードは、下位互換性のためのシノニムとして受け入れられます。 |
measures |
Array | 条件付きの。 名前、集計式、オプションのセマンティック メタデータなどのメジャー定義。
fieldsが指定されていない場合は必須。 「 メジャー」を参照してください。 |
materialization |
オブジェクト | オプション。 具体化されたビューを使用してクエリを高速化するための構成。 更新スケジュールと具体化されたビュー定義が含まれます。 具体化を参照してください。 |
情報源
source フィールドは、メトリック ビューのデータ ソースを指定します。 サポートされているソースには、テーブル、ビュー、メトリック ビュー、SQL クエリが含まれます。 構成可能性は、メトリック ビュー全体に適用されます。 メトリック ビューをソースとして使用する場合は、新しいメトリック ビューでそのフィールドとメジャーを参照できます。
コンポーザビリティを参照してください。
テーブルに似た資産ソース
3 部構成の名前を使用して、テーブルのような資産を参照します。
source: catalog.schema.source_table
SQL クエリ ソース
SQL クエリを使用するには、クエリ テキストを YAML に直接記述します。
source: SELECT * FROM samples.tpch.orders o
LEFT JOIN samples.tpch.customer c
ON o.o_custkey = c.c_custkey
Note
JOIN句を含むソースとして SQL クエリを使用する場合は、基になるテーブルに主キー制約と外部キー制約を設定し、RELY オプションを使用してクエリのパフォーマンスを最適化します。 詳細については、「主キー、外部キー、および一意制約を宣言する」および「主キー制約と一意制約を使用したクエリの最適化」を参照してください。
パラメーター
parameters ブロックは、呼び出し元がメトリック ビューにテーブル値関数としてクエリを実行するときに渡す名前付き値を定義します。 パラメーター化されたメトリック ビューのクエリなど、パラメーターを使用するタイミングと方法については、「メトリック ビュー でパラメーターを使用する」を参照してください。
各パラメーター定義には、次のフィールドが含まれています。
| フィールド | タイプ | Description |
|---|---|---|
name |
String | 必須。 パラメーター名。 フィールド式とメジャー式でこの名前でパラメーターを参照し、メトリック ビューのクエリを実行するときに名前付き引数として渡します。 |
data_type |
String | 必須。 パラメーターの SQL データ型 ( double、 int、 string、 dateなど)。 |
default |
場合により異なる | オプション。 呼び出し元がパラメーターを渡さない場合に使用される値。 既定値は data_typeにキャスト可能である必要があり、別のパラメーターを参照したり、サブクエリを含めたりすることはできません。 1 つのパラメーターに既定値を設定する場合は、それに続くすべてのパラメーターにも既定値が必要です。 |
次の例では、 discount パラメーターを定義し、メジャー式で参照します。
version: 1.1
source: main.default.sales
parameters:
- name: discount
data_type: double
default: 0
fields:
- name: product
expr: product
measures:
- name: discountedSales
expr: SUM((1 - discount) * amount)
Filter
YAML 定義のフィルターは、メトリック ビューを参照するすべてのクエリに適用されます。 フィルターを SQL ブール式として書き込みます。
# Single condition filter
filter: o_orderdate > '2024-01-01'
# Multiple conditions with AND
filter: o_orderdate > '2024-01-01' AND o_orderstatus = 'F'
# Multiple conditions with OR
filter: o_orderpriority = '1-URGENT' OR o_orderpriority = '2-HIGH'
# Complex filter with IN clause
filter: o_orderstatus IN ('F', 'P') AND o_orderdate >= '2024-01-01'
# Filter with NOT
filter: o_orderstatus != 'O' AND o_totalprice > 1000.00
# Filter with LIKE pattern matching
filter: o_comment LIKE '%express%' AND o_orderdate > '2024-01-01'
Joins
メトリック ビューでの結合では、ファクト テーブルからディメンション テーブル (スター スキーマ) への直接結合と、正規化されたディメンション テーブル (スノーフレーク スキーマ) 間のマルチホップ結合の両方がサポートされます。
SELECT ステートメントを使用して SQL クエリに結合することもできます。
ソースとして SQL クエリを使用するを参照してください。
Note
結合テーブルには、 MAP 型の列を含めることはできません。
MAP型の列から値をアンパックするには、「マップまたは配列から入れ子になった要素を分解する」を参照してください。
各結合定義には、次のフィールドが含まれています。
| フィールド | タイプ | Description |
|---|---|---|
name |
String | 必須。 結合テーブルまたは SQL クエリの別名。 フィールドまたはメジャーで結合テーブルの列を参照する場合は、このエイリアスを使用します。 |
source |
String | 必須。 結合するテーブルの 3 部構成の名前。 SQL クエリにすることもできます。 |
on |
String | 条件付きの。 結合条件を定義するブール式。
using が指定されていない場合は必須です。 |
using |
Array | 条件付きの。 親テーブルと結合テーブルの両方に存在する列名の一覧。
on が指定されていない場合は必須です。 |
cardinality |
String | オプション。 既定値は many_to_one です。 ソースと結合テーブルの間のリレーションシップ。 ソース行ごとに複数の一致する行を持つテーブルを個別のファクト ソースとして集計するには、 one_to_many に設定します。
一対多結合を参照してください。 |
joins |
Array | オプション。 スノーフレーク スキーマ モデリング用の入れ子になった結合定義の一覧。 最小ランタイム要件については、 メトリック ビュー機能の可用性 に関する記事を参照してください。 |
rely |
Map | オプション。 より効率的なクエリ プランを生成するためにアナライザーが依存できる結合に関する約束。 「relyを使用して結合を最適化する」を参照してください。 |
スター スキーマ結合
スター スキーマでは、 source はファクト テーブルであり、 LEFT OUTER JOINを使用して 1 つ以上のディメンション テーブルと結合します。 メトリック ビューは、選択した列に基づいて、特定のクエリに必要なファクト テーブルとディメンション テーブルを結合します。
ON句または USING 句を使用して結合列を指定します。
-
ON句: ブール式を使用して結合条件を定義します。 -
USING句: 親テーブルと結合テーブルの両方で同じ名前の列を一覧表示します。
結合は、多対一リレーションシップに従う必要があります。 多対多の場合、結合されたディメンション テーブルから最初に一致する行が選択されます。
version: 1.1
source: samples.tpch.lineitem
joins:
- name: orders
source: samples.tpch.orders
on: source.l_orderkey = orders.o_orderkey
- name: part
source: samples.tpch.part
on: source.l_partkey = part.p_partkey
fields:
- name: Order Status
expr: orders.o_orderstatus
- name: Part Name
expr: part.p_name
measures:
- name: Total Revenue
expr: SUM(l_extendedprice * (1 - l_discount))
- name: Line Item Count
expr: COUNT(1)
Note
source名前空間はメトリック ビューのソースの列を参照しますが、結合のnameはその結合テーブルの列を参照します。 たとえば、 source.l_orderkey = orders.o_orderkeyでは、 source は lineitem を参照し、 orders は結合テーブルを参照します。
on句にプレフィックスが指定されていない場合、参照は既定で結合テーブルに設定されます。
Snowflake スキーマ結合
スノーフレーク スキーマは、ディメンション テーブルを正規化してサブディメンションに接続することで、スター スキーマを拡張します。 これにより、複数レベルの結合構造が作成されます。 最小ランタイム要件については、 メトリック ビュー機能の可用性 に関する記事を参照してください。
スノーフレーク スキーマを定義するには、親結合定義内に joins を入れ子にします。
version: 1.1
source: samples.tpch.orders
joins:
- name: customer
source: samples.tpch.customer
'on': o_custkey = c_custkey
joins:
- name: nation
source: samples.tpch.nation
'on': c_nationkey = n_nationkey
fields:
- name: customer_nation
expr: customer.nation.n_name
一対多結合
cardinality フィールドは、ソーステーブルと結合テーブルの間のリレーションシップを設定します。 既定の many_to_oneでは、結合されたテーブルがディメンション参照として扱われます。 結合テーブルをファクト ソースとして扱う cardinality: one_to_many 設定すると、エンジンはソース グレインで個別に集計されます。これにより、1 つのソース行が結合テーブル内の複数の行と一致します。 一対多結合には、Databricks Runtime 18.1 以降と YAML 仕様バージョン 1.1 が必要です。
メトリック ビュー機能の可用性に関する記事を参照してください。
一対多結合には、次の規則が適用されます。
- フィールドはソース行ごとに 1 つの値に解決する必要があるため、
fields定義では 1 対多の列を使用できません。 - 1 つの集計関数は、1 つのソースの列を参照する必要があります。
count(orders.order_id) / count(*)など、個別の集計の結果に算術演算を適用できます。 - 一対多結合のすべての子孫も
one_to_manyする必要があります。 最上位の兄弟結合では、カーディナリティを混在させることができます。 -
orders.order_items.item_idなど、入れ子になった結合内の列を、結合名の完全なドット パスで参照します。
Note
メトリック ビューで one_to_many 結合を使用する場合、その具体化は完全一致のみに限定されます。 ロールアップの一致は使用できません。
ロールアップの一致を参照してください。
次の例では、注文メジャーが顧客の行を複製せずに集計されるように、ordersを使用してcustomers ソースにcardinality: one_to_manyを結合します。
version: 1.1
source: main.sales.customers
joins:
- name: orders
source: main.sales.orders
on: orders.customer_id = source.customer_id
cardinality: one_to_many
fields:
- name: customer_name
expr: customer_name
measures:
- name: customer_count
expr: count(*)
- name: order_count
expr: count(orders.order_id)
- name: total_order_revenue
expr: sum(orders.amount)
概念の詳細と入れ子になった結合と兄弟結合の例については、「 結合カーディナリティ」を参照してください。
で結合を最適化する rely
結合の rely フィールドを使用して、クエリの計画時にクエリ アナライザーが使用するリレーションシップに関する保証を宣言します。 これらの保証により、特に結合テーブルのフィールドがフィルターで参照されている場合に、エンジンはクエリをより効率的に計画し、スキャンされるデータを減らすことができます。
rely マップでは、次のフィールドがサポートされています。
| フィールド | タイプ | Description |
|---|---|---|
at_most_one_match |
ブール値 | オプション。 既定値は false です。
true場合、結合テーブル内の最大 1 行がソースの各行と一致することを宣言します (ファンアウトしない多対一リレーションシップ)。 |
Warning
結合が多対一の場合にのみ、 at_most_one_match: true を設定します。 このリレーションシップは実行時には検証されません。 結合テーブル内の複数の行が 1 つのソース行と一致する場合、メジャー ( SUM や COUNTなど) は正しくない結果を返します。
次の例では、at_most_one_matchからordersへの多対一結合のcustomerを有効にします。 顧客属性でフィルター処理またはグループ化するクエリは、最もメリットがあります。
version: 1.1
source: samples.tpch.orders
joins:
- name: customer
source: samples.tpch.customer
on: source.o_custkey = customer.c_custkey
rely:
at_most_one_match: true
fields:
- name: Customer name
expr: customer.c_name
- name: Customer market segment
expr: customer.c_mktsegment
measures:
- name: Total revenue
expr: SUM(o_totalprice)
フィールド
Note
fields と dimensions は、メトリック ビュー定義内の同等のキーワードです。
fields は推奨される用語であり、このドキュメント全体で使用されます。 カタログ エクスプローラーのローコード エディターでは、これらの列 にフィールドのラベルが付けられますが、生成される YAML では dimensions キーワードが使用されます。
dimensionsを使用する既存のメトリック ビューは引き続き機能し、両方のキーワードが新規または更新された定義で受け入れられます。
フィールドは、クエリ時に SELECT、 WHERE、および GROUP BY 句で使用されるメトリック ビュー列です。 各式はスカラー値を返さなければなりません。 フィールドは、メトリック ビューのソース データまたは以前に定義されたフィールドの列を参照できます。
フィールドには、次のいずれかを指定できます。
- カテゴリ列またはグループ化列 (地域、状態、部署など)。
- 年齢、価格、数量など、集計されていない数値列。 数値フィールドは、
SUMやAVGなどの SQL 関数を使用してクエリ時に集計できます。
各フィールド定義には、次のプロパティが含まれています。
| Property | タイプ | Description |
|---|---|---|
name |
String | 明示的な列式に必要です。 フィールドの列の別名。 ワイルドカード式の場合は省略します。ここで、Azure Databricksはソースから名前を派生させます。 ワイルドカードを使用したフィールドとメジャーの一括インポートを参照してください。 |
expr |
String | 必須。 ソース データまたは以前に定義されたフィールドの列を参照できる SQL 式。 ソーステーブルまたは結合テーブルからすべての列をインポートするワイルドカードを使用できます。 ワイルドカードを使用したフィールドとメジャーの一括インポートを参照してください。 |
comment |
String | オプション。 フィールドの説明。 Unity カタログとドキュメント ツールに表示されます。 |
display_name |
String | オプション。 視覚化ツールに表示されるラベル。 上限は 255 文字です。 YAML 仕様 1.1 が必要です。 メトリック ビュー機能の可用性に関する記事を参照してください。 |
format |
Map | オプション。 値の表示方法の書式指定。 YAML 仕様 1.1 が必要です。 形式の 仕様を参照してください。 |
synonyms |
Array | オプション。 フィールドを検出するための AI ツールと BI ツールの代替名。 最大 10 個のシノニム。それぞれ 255 文字に制限されています。 YAML 仕様 1.1 が必要です。 シノニムを参照してください。 |
Warning
ソース列がSTRINGまたはCHARされている場合でも、文字列のようなメトリック ビュー フィールドは常にVARCHARされます。 スペースパディング CHAR(n) 失われるため、比較によって異なる結果が返される可能性があります。 たとえば、 column = 'COLLEGE' はソース テーブルの CHAR(10) 値 (スペース埋め込み) と一致しますが、メトリック ビュー フィールドには一致しません。
Example:
fields:
# Basic field
- name: order_date
expr: o_orderdate
comment: 'Date the order was placed'
display_name: 'Order Date'
# Field with SQL expression
- name: order_month
expr: DATE_TRUNC('MONTH', o_orderdate)
display_name: 'Order Month'
# Field with synonyms
- name: order_status
expr: CASE
WHEN o_orderstatus = 'O' THEN 'Open'
WHEN o_orderstatus = 'P' THEN 'Processing'
WHEN o_orderstatus = 'F' THEN 'Fulfilled'
END
display_name: 'Order Status'
synonyms: ['status', 'fulfillment status']
対策
測定基準は、事前に決定された集計レベルなしで結果を生成する式です。 集計関数を使用して表現する必要があります。 クエリでメジャーを参照するには、 MEASURE 関数を使用します。 メジャーは、ソース データ内のベース列、前に定義されたフィールド、または前に定義されたメジャーを参照できます。
各メジャー定義には、次のフィールドが含まれています。
| フィールド | タイプ | Description |
|---|---|---|
name |
String | 明示的なメジャー式に必要です。 メジャーのエイリアス。 ワイルドカード式の場合は省略します。ここで、Azure Databricksはソースから名前を派生させます。 ワイルドカードを使用したフィールドとメジャーの一括インポートを参照してください。 |
expr |
String | 必須。 1 つ以上の集計関数を含む SQL 式。 メトリック ビュー ソースからすべてのメジャーをインポートするワイルドカードを指定できます。 ワイルドカードを使用したフィールドとメジャーの一括インポートを参照してください。 |
comment |
String | オプション。 測定の説明。 Unity カタログとドキュメント ツールに表示されます。 |
display_name |
String | オプション。 視覚化ツールに表示されるラベル。 上限は 255 文字です。 YAML 仕様 1.1 が必要です。 メトリック ビュー機能の可用性に関する記事を参照してください。 |
format |
Map | オプション。 値の表示方法の書式指定。 YAML 仕様 1.1 が必要です。 形式の 仕様を参照してください。 |
synonyms |
Array | オプション。 メジャーを検出するための AI ツールと BI ツールの代替名。 最大 10 個のシノニム。それぞれ 255 文字に制限されています。 YAML 仕様 1.1 が必要です。 メトリック ビュー機能の可用性に関する記事を参照してください。 |
window |
Array | オプション。 ウィンドウ集計、累積集計、または準加法集計のウィンドウ仕様。 指定しない場合、メジャーは標準集計として動作します。 「ウィンドウの寸法」を参照してください。 |
集計関数の一覧については、集計関数を参照してください。
Example:
measures:
# Simple count measure
- name: order_count
expr: COUNT(1)
display_name: 'Order Count'
# Sum aggregation measure with synonyms
- name: total_revenue
expr: SUM(o_totalprice)
comment: 'Gross revenue from all orders'
display_name: 'Total Revenue'
synonyms: ['revenue', 'total sales']
# Distinct count measure
- name: unique_customers
expr: COUNT(DISTINCT o_custkey)
display_name: 'Unique Customers'
# Calculated measure combining multiple aggregations
- name: avg_order_value
expr: SUM(o_totalprice) / COUNT(DISTINCT o_orderkey)
display_name: 'Avg Order Value'
synonyms: ['AOV', 'average order']
# Filtered measure with WHERE condition
- name: open_order_revenue
expr: SUM(o_totalprice) FILTER (WHERE o_orderstatus = 'O')
display_name: 'Open Order Revenue'
synonyms: ['backlog', 'outstanding revenue']
ワイルドカードを使用してフィールドとメジャーを一括インポートする
適用対象: YAML 仕様 1.1 を使用した Databricks Runtime 18.2 以降
fieldsまたはmeasures定義では、* フィールドのワイルドカード (expr) を使用して、ソースまたは結合されたテーブルから各列を一覧表示せずにすべての列をインポートできます。 これは、標準ビューの SELECT * と同様に、メトリック ビューでアップストリームアセットのすべての列を公開する場合に便利です。 Azure Databricksメトリック ビューを作成または置換するときにワイルドカードを具象列に展開し、ソース列名から各列名を派生させます。
明示的な列定義と同様に、メトリック ビューを作成するとワイルドカード式が展開されます。 後でソースに追加された列を取得するには、 CREATE OR REPLACE または ALTERを使用してメトリック ビューを再作成します。
ワイルドカードでは、次の形式がサポートされます。
| 構文 | Description |
|---|---|
source.* |
メトリック ビュー ソースからすべての列をインポートします。 |
<join>.* |
結合されたテーブルから、その結合名で参照されているすべての列をインポートします。 入れ子になった結合では、 customer.nation.*などの完全なドット パスが使用されます。 |
<target>.* EXCEPT (col1, col2, ...) |
一覧に含まれていないすべての列をターゲットからインポートします。 |
<target>.<struct>.* |
STRUCT列のフィールドを個別の列に展開します。 |
ワイルドカード式には、次の規則が適用されます。
-
nameフィールドを省略します。 Azure Databricksはソースから列名を派生させます。そのため、ワイルドカード式ではnameは使用できません。 - ワイルドカード式ではセマンティック メタデータは使用できません。 ワイルドカードに
comment、display_name、format、またはsynonymsを設定しないでください。 特定の列にメタデータを追加するには、EXCEPTを使用してワイルドカードから除外し、明示的に定義します。 -
measures定義では、ワイルドカードはメトリック ビュー ソースからのみメジャーをインポートします。 ベース テーブルにはメジャーがないため、ソースがベース テーブルの場合、ワイルドカードはメジャーに展開されません。 - ワイルドカードインポートされた列は、後の
fieldsまたはmeasures式の派生名で参照することはできません。 代わりに、完全なパスを使用してソース列を参照します。
名前の競合を解決する
ワイルドカードを使用して複数のソースから列をインポートすると、名前を共有する列 ( id や dateなど) が競合し、定義を保存するときにエラーが発生します。 競合を解決するには、 EXCEPTを含む各ワイルドカードから列を除外し、一意の名前で明示的に定義します。
fields:
- expr: source.* EXCEPT (id)
- expr: customer.* EXCEPT (id)
- name: source_id
expr: source.id
- name: customer_id
expr: customer.id
ワイルドカードの例
次の定義では、ソースと結合テーブルからすべての列をインポートし、2 つの列を除外し、メタデータを追加するために 1 つの列を明示的に定義します。
version: 1.1
source: samples.tpch.orders
joins:
- name: customer
source: samples.tpch.customer
on: source.o_custkey = customer.c_custkey
joins:
- name: nation
source: samples.tpch.nation
on: customer.c_nationkey = nation.n_nationkey
fields:
# Import all columns from the source
- expr: source.*
# Import all columns from a joined table, excluding two
- expr: customer.nation.* EXCEPT (n_name, n_comment)
# Define a specific column explicitly to add metadata
- name: nation_name
expr: customer.nation.n_name
comment: "Customer's nation"
display_name: 'Nation Name'
ウィンドウ メジャー
window フィールドは、メジャーのウィンドウ集計、累積集計、または準加法集計を定義します。 ウィンドウ メジャーとユース ケースの詳細については、「 ウィンドウ メジャー」を参照してください。
各ウィンドウの仕様には、次のフィールドが含まれています。
| フィールド | タイプ | Description |
|---|---|---|
order |
String | 必須。 ウィンドウの順序を決定するフィールド。 (1) |
range |
String | 必須。 ウィンドウの範囲。
サポートされているrange値を参照してください。
trailingまたはleadingの範囲内の数値値はリテラルではなく整数パラメータで使えるため、呼び出し者はクエリ時にウィンドウサイズを渡します。 パラメータ として「ウィンドウサイズを渡す」を参照してください。 |
semiadditive |
String | 必須。 集計メソッド。 サポートされる値: first または last。 |
offset |
String | オプション。 Databricks Runtime 18.1 および YAML 仕様バージョン 1.1 以降が必要です。 ウィンドウ フレームを、 order フィールドに沿って固定間隔で前後にシフトします。 この値は <n> <period>形式で、 n は符号付き整数 (負の値は後方、正は前方に見えます)、 period は day、 days、 month、 months、 year、または yearsのいずれかです。 例: -12 month、1 year、-3 days、7 day。
orderフィールドは、日付またはタイムスタンプの列である必要があります。
offset は、 range: allには影響しません。 シフトされたフレームが使用可能なデータの外側にある場合、メジャーは NULL評価されます。 符号付き整数はリテラルではなく整数パラメータとして使えるため、呼び出し者はクエリ時にオフセットを渡します。 符号はパラメータの値の一部でなければならず、パラメータ名の前に書かれてはいけません。 パラメータ として「ウィンドウサイズを渡す」を参照してください。 使用方法と作業例については、「 ウィンドウ フレームをシフト offset 方法」を参照してください。 |
(1) 参照されるフィールドは決定論的である必要があります。
rand()、uuid()、current_timestamp()などの非決定論的な式では、予期しないウィンドウ順序が生成され、集計結果が正しくない可能性があります。
サポートされている range 値
-
current: ウィンドウ順序の値がアンカー行の値と等しい行。 -
cumulative: ウィンドウ順序の値がアンカー行の値以下であるすべての行。 -
trailing <value> <unit> [inclusive | exclusive]: アンカー行の行が、指定した時間単位 (たとえば、trailing 7 day) で後方に移動します。 省略可能なinclusiveまたはexclusive修飾子には、Databricks Runtime 18.1 および YAML 仕様バージョン 1.1 以降が必要であり、アンカー行をウィンドウに含めるかどうかを制御します。 既定値はexclusiveです。 アンカー行を含めるまたは除外するを参照してください。 -
leading <value> <unit> [inclusive | exclusive]: アンカー行の行 (たとえば、leading 3 monthなど)、指定した時間単位で進みます。 省略可能なinclusiveまたはexclusive修飾子には、Databricks Runtime 18.1 および YAML 仕様バージョン 1.1 以降が必要であり、アンカー行をウィンドウに含めるかどうかを制御します。 既定値はexclusiveです。 アンカー行を含めるまたは除外するを参照してください。 -
all: ウィンドウの順序の値に関係なく、すべての行。
ウィンドウ メジャーの例
次の例では、一意の顧客のローリング 7 日間のカウントを計算します。
version: 1.1
source: samples.tpch.orders
fields:
- name: order_date
expr: o_orderdate
measures:
- name: rolling_7day_customers
expr: COUNT(DISTINCT o_custkey)
display_name: '7-Day Rolling Customers'
window:
- order: order_date
range: trailing 7 day
semiadditive: last
パラメータとしてウィンドウサイズを渡します
数値を trailing や leadingrange 、あるいは offsetにハードコーディングする代わりに、 パラメータを参照できるようになり、呼び出し元がメトリクスビューを問い合わせる際にウィンドウサイズを渡すことができます。 これにはDatabricks Runtime 18.2以上のSQLウェアハウスやその他の計算リソースが必要です。
ウィンドウサイズとして使われるパラメータには以下のルールが適用されます。
- パラメータの
data_typeはint、smallint、bigintなど整数でなければなりません。 - 値は単純なパラメータ名でなければならず、式ではありません。 たとえば、
trailing window_size dayではなくtrailing window_size + 1 dayを使用します。 また、-window_sizeのoffsetのようにパラメータ名の前に記号を書くこともできません。 負のオフセットを通すには、符号をパラメータの内側に入れます。 - パラメータは、範囲型(
trailing、leading)、ピリオド(day、month、year)、包括性キーワード(inclusive、exclusive)、offsetなどのウィンドウキーワード名を付けられることはできません。 - ユニットは文字通りのままです。 数値の大きさのみをパラメータ化でき、周期は設定できません。
以下の例は window_size パラメータを定義し、 trailing の範囲で参照しているため、各発信者はローリングウィンドウの日数を選択できます。
version: 1.1
source: samples.tpch.orders
parameters:
- name: window_size
data_type: int
default: 7
fields:
- name: order_date
expr: o_orderdate
measures:
- name: rolling_customers
expr: COUNT(DISTINCT o_custkey)
display_name: 'Rolling Customers'
window:
- order: order_date
range: trailing window_size day
semiadditive: last
パラメータを定義するメトリックビューをクエリするには、「 パラメータ付きメトリックビューをクエリ」を参照してください。
具体化
materialization フィールドは、具体化されたビューを使用して自動クエリ アクセラレーションを構成します。 具体化のしくみ、要件、ベスト プラクティスの詳細については、 メトリック ビューの具体化を参照してください。
Note
パラメーターを定義するメトリック ビューを具体化することはできません。
materialization フィールドには、次の最上位レベルのフィールドが含まれています。
| フィールド | タイプ | Description |
|---|---|---|
schedule |
String | オプション。 更新スケジュール。
具体化されたビューの schedule 句と同じ構文を使用します。 省略した場合、具体化は手動でのみ更新されます。 手動更新をトリガーするには、「 手動更新」を参照してください。
TRIGGER ON UPDATE 句はサポートされていません。 |
mode |
String | 必須。
relaxedに設定する必要があります。 |
materialized_views |
Array | 必須。 具体化する具体化されたビューの一覧。 各エントリには、以下で説明するフィールドが必要です。 |
materialized_viewsの各エントリには、次のフィールドがあります。
| フィールド | タイプ | Description |
|---|---|---|
name |
String | 必須。 具体化の名前。 |
type |
String | 必須。 具体化の種類。 サポートされる値: aggregated ( dimensions、 measures、またはその両方が必要) または unaggregated。 メトリック ビューごとに許可される unaggregated エントリは 1 つだけです。 Unaggregated エントリでは、 dimensions または measures フィールドは使用されません。 |
dimensions |
Array | 条件付きの。 最上位の定義でdimensionsを使用している場合でも、fields キーワードを使用して、具体化するフィールド名の一覧。
typeがaggregatedであり、measuresが指定されていない場合は必須です。 |
measures |
Array | 条件付きの。 具体化するメジャー名の一覧。
typeがaggregatedであり、dimensionsが指定されていない場合は必須です。 |
cluster_by |
オブジェクト | オプション。 具体化されたビューの CLUSTER BY 句 と同等の、具体化の列をクラスタリングします。 列名の一覧を含む cols を指定するか、databricks がクラスタリング列を自動的に選択できるように auto: true を設定します。 |
partition_by |
Array | オプション。 具体化されたビューの PARTITION BY 句 に相当する、具体化をパーティション分割する列の一覧。 |
Note
具体化ブロックでは、dimensions:ではなく fields: キーワードが使用されます。 最上位レベルの定義でdimensions:を使用している場合でも、具体化するフィールドを一覧表示する場合は、fields:を使用します。
具体化の例
次の例では、複数の具体化を使用してメトリック ビューを定義します。
version: 1.1
source: prod.operations.orders_enriched_view
filter: revenue > 0
# filter, fields, and measures can't use invoker-dependent expressions: no current_user(), is_member(), etc.
# source can't have RLS, column masking, or ABAC policies
joins:
- name: customers
source: prod.operations.customers
on: source.customer_id = customers.id
# if one-to-many, all materializations below drop to exact match only
fields:
- name: category
expr: substring(category, 5)
- name: order_date
expr: order_date
measures:
- name: total_revenue
expr: SUM(revenue)
- name: number_of_suppliers
expr: COUNT(DISTINCT supplier_id)
- name: revenue_for_open_orders
expr: SUM(revenue) FILTER (WHERE status = 'O')
- name: blended_margin
expr: SUM(revenue) - SUM(cost)
- name: rolling_7day_customers
expr: COUNT(DISTINCT customer_id)
window:
- order: order_date
range: trailing 7 day
semiadditive: last
materialization:
schedule: every 6 hours
mode: relaxed
materialized_views:
- name: baseline
type: unaggregated
# only one allowed per metric view; doesn't use dimensions or measures keys
# no benefit if source is an unfiltered direct table reference
- name: daily_status_metrics
type: aggregated
dimensions:
- order_date
- category # avoid overly granular dimensions, such as millisecond timestamps
measures:
- total_revenue # rollup-eligible
- number_of_suppliers # exact match only (non-additive)
- revenue_for_open_orders # rollup-eligible (deterministic filter)
- blended_margin # exact match only (multiple aggregates)
- rolling_7day_customers # exact match only (window measure)
cluster_by:
cols:
- order_date
- category
partition_by:
- order_date
列名の参照
YAML 式でスペースまたは特殊文字を含む列名を参照する場合は、列名をバックティックで囲みます。 式がバックティックで始まり、YAML 値として直接使用される場合は、式全体を二重引用符で囲みます。 有効なYAMLの値はバックティックで始めることができません。
書式設定の例
次の例を使用して、一般的なシナリオで YAML を正しく書式設定する方法について説明します。
列名を参照する
次の例では、含まれる文字に応じて列参照の書式を設定する方法を示します。
スペースは使用できません
ソース列: revenue
expr: "revenue"
expr: 'revenue'
expr: revenue
列名の前後には二重引用符、一重引用符、または引用符を使用しません。
スペースを含む列名
ソース列: `First Name`
expr: '`First Name`'
スペースをエスケープするためにバックティックを使用します。 式全体を二重引用符で囲みます。
SQL 式にスペースを含む列名
ソース列: `First Name`、 `Last Name`
expr: CONCAT(`First Name`, ' ', `Last Name`)
式がバッククォートで始まらない場合は、二重引用符は必要ありません。
引用符を含む列名
ソース列: "name"
expr: '`"name"`'
列名の二重引用符をエスケープするには、バッククォートを使用します。 式を一重引用符で囲みます。
コロンを含む式
expr: "CASE WHEN `Customer Tier` = 'Enterprise: Premium' THEN 1 ELSE 0 END"
Note
YAML は、引用符で囲まれていないコロンをキーと値の区切り記号として解釈します。 常に、コロンを含む式を二重引用符で囲みます。
複数行式
expr: |
CASE WHEN
revenue > 100 THEN 'High'
ELSE 'Low'
END
Note
複数行式の|の後に、expr: ブロック スカラーを使用します。 正しい解析を行うには、すべての行に expr キーを超えるスペースを少なくとも 2 つインデントする必要があります。
YAML 1.1 へのアップグレード
コメントは以前のバージョンとは異なる方法で処理されるため、メトリック ビューを YAML 仕様バージョン 1.1 にアップグレードするには注意が必要です。
コメントの種類
-
YAML コメント (
#): YAML ファイルに直接書き込まれたインラインまたは 1 行のコメント。 - Unity カタログのコメント: メトリック ビューまたはその列の Unity カタログに格納されているコメント。 これらは YAML コメントとは別です。
アップグレードに関する考慮事項
メトリック ビューでのコメントの処理方法に一致するアップグレード パスを選択します。
オプション 1: ノートブックまたは SQL エディターを使用して YAML コメントを保持する
メトリック ビューに保持する YAML コメント (#) が含まれている場合は、次の手順を使用します。
- ノートブックまたは SQL エディターで
ALTER VIEWコマンドを使用します。 -
$$..$$した後、元の YAML 定義をASセクションにコピーします。versionの値を1.1に変更します。 - メトリック ビューを保存します。
ALTER VIEW metric_view_name AS
$$
# The notebook preserves inline comments
version: 1.1
source: samples.tpch.orders
fields:
- name: order_date # The notebook preserves inline comments
expr: o_orderdate
measures:
# The notebook preserves commented out definitions
# - name: total_orders
# expr: COUNT(o_orderid)
- name: total_revenue
expr: SUM(o_totalprice)
$$
Warning
ALTER VIEWを実行すると、YAML 定義のcomment フィールドに明示的に含まれていない限り、Unity カタログのコメントが削除されます。 Unity カタログに表示されているコメントを保持するには、 オプション 2 を参照してください。
オプション 2: Unity カタログのコメントを保持する
Note
次のガイダンスは、ノートブックまたは SQL エディターで ALTER VIEW コマンドを使用する場合にのみ適用されます。 YAML エディター UI を使用してメトリック ビューをバージョン 1.1 にアップグレードすると、YAML エディター UI によって Unity カタログのコメントが自動的に保持されます。
- YAML 定義内の適切な
commentフィールドにすべての Unity カタログ コメントをコピーします。versionの値を1.1に変更します。 - メトリック ビューを保存します。
ALTER VIEW metric_view_name AS
$$
version: 1.1
source: samples.tpch.orders
comment: "Metric view of order (Updated comment)"
fields:
- name: order_date
expr: o_orderdate
comment: "Date of order - Copied from Unity Catalog"
measures:
- name: total_revenue
expr: SUM(o_totalprice)
comment: "Total revenue"
$$
YAML 仕様のバージョン履歴と各機能の最小ランタイム要件については、 メトリック ビューの機能の可用性に関するページを参照してください。