注: 以下の翻訳の正確性は検証されていません。AIPを利用して英語版の原文から機械的に翻訳されたものです。
このページでは、Palantir プラットフォームで時系列に補間がどのように使用されるか、およびユースケースに合わせて補間の設定をカスタマイズする方法を説明します。
補間は、既知のデータポイント間の欠損値を推定するために、時系列分析で一般的に使用される手法です。既存のデータポイントを使用することで、特定の時刻に測定値が記録されていなくても、時系列を連続的かつ完全に表現できます。
Palantir プラットフォームで利用可能な内部補間のオプションは次のとおりです。
LINEAR:前後の既知のデータポイントを直線で結び、値を推定します。数値時系列にのみ適用できます。NEAREST:最も近いポイントの値を使用します。PREVIOUS:直前のポイントの値を使用します。NEXT:直後のポイントの値を使用します。NONE:そのタイムスタンプにポイントがない場合、値を推定しません。外部補間(最初のポイントより前、または最後のポイントより後)で有効な設定は次のとおりです。
NEAREST:最も近いポイントの値を使用します。NONE:そのタイムスタンプにポイントがない場合、値を推定しません。内部補間が NONE 以外に設定されている時系列は、補間が定義されているとみなされます。
オントロジー内の時系列プロパティでは、時系列の書式設定を使用して、時系列に必要な内部補間を指定できます。デフォルトでは、数値時系列は LINEAR 補間を使用し、カテゴリカル時系列は PREVIOUS を使用します。
複数の時系列を組み合わせる際、出力時系列の構築に使用されるポイントは、入力時系列それぞれの補間に依存します。すべての時系列に補間が定義されている場合、結果の時系列は、すべての時系列のすべてのポイントの和集合から作成されます。つまり、あるタイムスタンプに1つの時系列にしかポイントがない場合でも、実際に該当する結合を行う前に、補間を使用してそのタイムスタンプにおけるほかのすべての時系列の値を特定します。
一方、1つ以上の時系列に補間が定義されていない場合、操作は、補間が定義されていないすべての入力時系列の積集合によって作成されるポイントの集合に対してのみ反復処理を行います。
たとえば、3つの時系列 A、B、C があり、A、B、C のいずれにも補間が定義されていないとします。
| タイムスタンプ | 時系列 A | 時系列 B | 時系列 C | A + B + C の期待値 |
|---|---|---|---|---|
| 2025/02/02 00:00:00 | 1 | 2 | 0 | 3 |
| 2025/02/03 00:00:00 | 2 | 1 | ||
| 2025/02/04 00:00:00 | 3 | 2 | ||
| 2025/02/05 00:00:00 | 4 | 2 | 3 | 9 |
| 2025/02/06 00:00:00 | 5 | 2 |
どの時系列にも補間が定義されていない場合、それらを結合した結果は、すべての時系列にポイントが定義されているタイムスタンプでのみ計算されます。この場合、結合(時系列の値を加算すること)は、1番目と4番目のポイントでのみ行われます。

すべての時系列に補間が定義されている場合、結果の時系列は次のようになります。

ただし、時系列 C の最後のポイントは時系列 A と B のどちらの最後のポイントよりも前にあり、時系列 C には外部補間(最初のポイントより前、または最後のポイントより後)が設定されていないため、最後のタイムスタンプの値は計算できません。時系列 C に NEAREST の外部補間を適用すると、次のようになります。

最後に、時系列 A には補間が定義されているものの、時系列 B と C には定義されていない、混在したシナリオを考えます。出力時系列のタイムスタンプの集合は、補間が定義されていない時系列の積集合を取ることで決まり、次の結果になります。
