メインコンテンツまでスキップ

タスクフロー

最終更新 2026/10/03

タスクフロー(flow)の概要​

データウェアハウスでは、通常2種類のデータ処理の業務フローがあります。タスクフローとアドホッククエリです。タスクフローは安定したデータモデルのデータ更新に使われ、アドホッククエリは柔軟なデータクエリやデータ処理に使われます。

アドホッククエリと比べて、タスクフローの計算には、通常は周期的に繰り返し実行され、できるだけ増分で処理・更新されるという特徴があります。計算プロセスでは階層と階層間の依存関係が設計され、計算時には中間層の結果が永続化されて、下流の計算タスクで利用されます。これは主に、指標定義の一貫性や同時期データの一貫性を保ち、計算コストを節約するためです。

タスクフローの多層パスと多分岐は、その複雑さの主な表れです。そのため、データ開発の実装では、業務データモデルを複数のflowに分割します。あるflowは特定のデータソースの取り込みとクレンジングに使われ、別のflowは複数のソースのデータを統合して多次元の業務ワイドテーブルを形成するために使われます。このように分割することで、保守の複雑さが下がり、分担もしやすくなるうえ、部分的なリファクタリングやデバッグも容易になります。

AEデータ開発プラットフォームは、先進的なビジュアルWorkflowによるバッチ処理タスクフローの構築に対応しています。この章では、タスクフローの使い方を詳しく紹介します。

各セクションの内容は次のとおりです:

このページは役に立ちましたか?