集約 アクションセット: 構文
1 つ以上の変数の値を集約するアクションを提供します
aggregate アクション
選択した変数の集計を実行します。
| 例: | 選択した列のデータを集計 |
| 選択した列のデータをグループ別に集計 | |
| 選択した列のデータを日付間隔で集計 | |
| ローリングウィンドウ集計の実行 |
CASL 構文
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametertable |
— |
テーブル名、caslib、他の共通パラメータを指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
出力テーブルの設定を指定します。 |
パラメーターの説明
align="BEGINNING" | "ENDING" | "MIDDLE"
bin={double-1 <, double-2, ...>}
sビンの最小および最大値を指定します。例えば、ID 変数の値が 0 から 100 までの範囲で、bin = {5, 15} を指定した場合、アクションは 11 個のビンを持つ時系列を構築します。最初のビンは [-5, 5] で、最後のビンは [95, 105] です。ビンの上限の境界の値は、このビンに属します。ビンの下限の境界の値は、隣接する下のビンに属します。このパラメータは、ID 変数も指定しない限り無視されます。
casOut={casouttable}
出力テーブルの設定を指定します。
casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
contribute="variable-name"
doESP パラメータが True の場合、各集計間隔内の値が記録されている変数を指定できます。この値は、集計された間隔に対する各行の寄与を理解するために、元のテーブルと結合するためのキーとして使用できます。
contributeColumnLabel="string"
寄与変数から変数ラベルを上書きする値を指定します。デフォルトでは、寄与変数のラベルが結果に表示されます。
contributeColumnName="string"
寄与変数から変数名を上書きする値を指定します。デフォルトでは、寄与変数の名前が結果に表示されます。
contributeDelimiter="string"
寄与変数の連結値間で使用される区切り文字を指定します。
| 別名 | delimiter |
|---|---|
| デフォルト | "," |
contributeTrim=TRUE | FALSE
True に設定すると、寄与変数のフォーマットされた値から先頭と末尾の空白が削除されます。contributionUnroll パラメータが True に設定されている場合、このパラメータは無視されます。
| デフォルト | FALSE |
|---|
contributeUnroll=TRUE | FALSE
デフォルトでは、contrib 変数のフォーマットされた値は、結果テーブルに対して 1 つの行に連結されます。True に設定すると、contrib 変数の各未加工値が結果テーブルに行を追加します。
| 別名 | unroll |
|---|---|
| デフォルト | FALSE |
copyVars={"variable-name-1" <, "variable-name-2", ...>}
入力テーブルから出力テーブルにコピーする変数を指定します。未加工値は出力に保持されます。入力テーブルに groupBy パラメータも指定しないかぎり、このパラメータは無視されます。1 つのグループに複数のレコードが存在する場合、最小の未加工値がコピーされます。
| 別名 | copyVar |
|---|
doESP=TRUE | FALSE
True に設定すると、アクションは入力テーブルのパーティション分割と並べ替えを利用できます。入力テーブルの groupBy パラメータを指定する必要があります。ID 変数は、最後の groupBy パラメータと orderBy パラメータで指定する必要があります。このパラメータを True に設定すると、keepRecord パラメータを True に設定されます。False (デフォルト値) に設定すると、keepRecordId、excludeSelf、contribute、contributeColumnName、contributeTrim、contributeDelimiter、contributeUnroll の各パラメータは無視されます。
| 別名 | partAndOrder |
|---|---|
| デフォルト | FALSE |
edgeId="variable-name"
FIRST、LAST、FNE、LNE アグリゲーターを使用する各 varSpecs 仕様の値を順序付けるために使用される数値変数を指定します。このパラメータは、edgeId サブパラメータを含む varSpecs 仕様でオーバーライドできます。
exclnpwgt=TRUE | FALSE
True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。
| 別名 | excludeNonPositiveWeight |
|---|---|
| デフォルト | FALSE |
excludeSelf=TRUE | FALSE
True に設定され、doESP パラメータが True の場合、集計は現在のオブザベーションの寄与を除外します。
| デフォルト | FALSE |
|---|
freq="variable-name"
値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠損値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。
| 別名 | frequency |
|---|
freqStrict=TRUE | FALSE
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と10進値が使用されます。欠損値はまだ除外されています。
| デフォルト | TRUE |
|---|
groupByLimit=64-bit-integer
Group-by セットのレベルの最大数を指定します。サーバーがこのレベル数を測定すると、サーバーは停止し結果を返しません。Group-by 操作で大規模な結果セットが作成されないようにするには、このパラメータを指定します。
| 最小値 | 1 |
|---|
groupedIntervalOutput=TRUE | FALSE
True に設定すると、最後の ID 値に関する同じ集計間隔の 1 つだけを保存します。'doESP' が False に設定されている場合、このオプションは無視されます。
| デフォルト | FALSE |
|---|
id="variable-name"
入力テーブル内の各オブザベーションに関連付けられているタイムスタンプを識別する数値変数を指定します。値は、通常SAS DATE、TIME、DATETIME の値ですが、必須ではありません。指定した変数は、入力テーブルの groupBy パラメータでも指定する必要があります。
idEnd=double
分析で考慮する ID 変数の包括的な最大値を指定します。 ID 変数の最大値が idEnd 値より小さい場合、系列は欠損値で拡張されます。最後の ID 変数の値が idEnd の値より大きい場合、系列は切り捨てられます。このパラメータは、ID変数も指定しない限り無視されます。
idOutputName="string"
出力テーブルの ID 変数の新しい名前を指定します。
idRange={double-1 <, double-2, ...>}
分析で考慮する ID 変数の包括的な最小値と最大値を指定します。これは、idStart と idEnd の両方を指定することと同じです。
idStart=double
分析で考慮する ID 変数の包括的な最小値を指定します。ID 変数の最小値が idStart 値より大きい場合、系列には欠損値の接頭辞が付加されます。最初の ID 変数の値が idStart の値より小さい場合、系列は切り捨てられます。このパラメータは、ID 変数も指定しない限り無視されます。
includeEmptyInterval=TRUE | FALSE
デフォルトでは、ID 変数の値が欠落している間隔が出力に含まれます。False に設定すると、これらの間隔は出力から除外されます。
| 別名 | includeMissInterval |
|---|---|
| includeMissingInterval | |
| デフォルト | TRUE |
includeMissing=TRUE | FALSE
デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。
| 別名 | includeMiss |
|---|---|
| incMissing | |
| incMiss | |
| デフォルト | TRUE |
inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}
分析に使用する入力変数を指定します。未加工の数値変数の場合、デフォルトのアグリゲーターは SUMMARY です。その他の状況では、デフォルトのアグリゲーターは N です。このパラメータに変数を指定するか、varSpecs パラメータを指定してより多くの制御を行うことはできますが、両方を使用することはできません。
inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | input |
|---|
interval="string"
オブザベーションの累積時間を指定します。例えば、interval='MONTH' を指定すると、アクションは月次間隔でオブザベーションを要約します。このパラメータは、ID 変数も指定しない限り無視されます。
jumpingWindow=TRUE | FALSE
True に設定すると、複数の間隔を含むことができるタイムウィンドウで集計が行われ、指定された時間範囲が経過すると集計がリセットされることを指定します。デフォルトでは、ウィンドウは常に同じ複数の間隔を保持します。
| 別名 | tumblingWindow |
|---|---|
| デフォルト | FALSE |
keepRecord=TRUE | FALSE
True に設定すると、ID 変数の各オブザベーションの元の値は間隔の配置を行わずに保持されます。
| デフォルト | FALSE |
|---|
keepRecordId=TRUE | FALSE
True に設定され、doESP パラメータが True の場合、各オブザベーションの元の ID 値は間隔の配置を実行せずに保持されます。
| デフォルト | FALSE |
|---|
modeSingle=TRUE | FALSE
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。
| デフォルト | FALSE |
|---|
offset=integer
各間隔のオフセットを指定します。offset=-1 を指定すると、データセットから派生したすべての間隔は 1 つ後方にシフトされます。例えば、3月1日のタイムスタンプ値は、2月1日になるようにデータセットから取得されます。
| 別名 | intOffset |
|---|---|
| dif | |
| intDif | |
| intOff | |
| デフォルト | 0 |
partKey={"string-1" <, "string-2", ...>}
テーブルがパーティション化され、partition パラメータを指定する場合は、パーティションのみの結果が計算されるようにパーティションキーを指定することができます。
pctlDef=integer
UNIVARIATE プロシジャのドキュメントで説明されているように、分位点統計量 (パーセンタイル) を計算する方法を指定します。
| デフォルト | 5 |
|---|---|
| 範囲 | 1–5 |
pti=double
間隔またはビン内の集計が終了したときの時間値を指定します。例えば、interval='MONTH' と partialToInterval='10FEB98'd を指定した場合、アクションは各月の最初の10日間のレコードのみを集計します。
| 別名 | ptd |
|---|---|
| partialToDate | |
| partialToInterval | |
| デフォルト | 0 |
| 最小値 | 0 |
ptw=double
各ウィンドウ間隔に関するサブ間隔を指定します。例えば、windowInterval='MONTH' と partialToWindow='08FEB98'd を指定した場合、各年のウィンドウ間隔 2月、...、12月の集計時に、アクションは 1月から最初の 8日間、2月から最初の 8日間だけをカウントします。このパラメータは、開始時間がスライディングウィンドウ (非ジャンプウィンドウ) によって異なるため、jumpingWindow パラメータも指定しない限り無視されます。
| 別名 | partialToWindow |
|---|---|
| デフォルト | 0 |
| 最小値 | 0 |
raw=TRUE | FALSE
True に設定すると、入力パラメータの変数の未加工値が使用されます。
| デフォルト | FALSE |
|---|
saveGroupbyFormat=TRUE | FALSE
デフォルトでは、groupBy 変数のフォーマットされた値が入力テーブルから結果にコピーされます。False に設定すると、フォーマットされた値はコピーされません。
| 別名 | saveGbyFmt |
|---|---|
| デフォルト | TRUE |
saveGroupbyRaw=TRUE | FALSE
デフォルトでは、groupBy 変数の未加工値が入力テーブルから結果にコピーされます。False に設定すると、未加工値はコピーされません。
| 別名 | saveGbyRaw |
|---|---|
| デフォルト | TRUE |
saveVariableColumn=TRUE | FALSE
デフォルトでは、各分析変数の変数名が結果に含まれます。結果テーブルには、'Column' という名前の列に名前が含まれています。False に設定すると、この列は結果に含まれません。
| 別名 | saveVarCol |
|---|---|
| デフォルト | TRUE |
saveVariableSpecification=TRUE | FALSE
デフォルトでは、結果には、'Variable Specification' という名前の列が含まれ、結果を生成した varSpecs 指定を識別します。False に設定すると、この列は結果に含まれません。
| 別名 | saveVarSpec |
|---|---|
| デフォルト | TRUE |
subBinOffset=double
ビンの先頭からのオフセットを指定します。値は正でビン幅以下でなければなりません。指定した値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID 変数とビンパラメータを指定しない限り無視されます。
subBinWidth=double
ビン内のサブビンの幅を指定します。例えば、ID変数の値が 0 から 100 までの範囲で、bin={5, 15}、subBinOffset=2、subBinWidth=5 を指定した場合、アクションは [-2, 3], [8, 13], [18, 23], ..., [98, 103] に分類される ID 変数値を持つオブザベーションだけを要約します。指定された値は正でなければならず、subBinOffset 値と subBinWidth 値の合計はビン幅以下でなければなりません。値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID変数とビンパラメータも指定しない限り無視されます。
| 最小値 | 0 |
|---|
subInterval="string"
より小さい間隔を指定して、オブザベーションの集計のための各間隔内の時間間隔の配置を制御します。
| 別名 | subInt |
|---|
* table={castable}
テーブル名、caslib、他の共通パラメータを指定します。
table パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。
varSpecs={{tkcasagg_varspecs-1} <, {tkcasagg_varspecs-2}, ...>}
集計する変数とアグリゲーターの設定を指定します。
tkcasagg_varspecs の値は次のいずれかになります:
agg="FIRST" | "FIRSTNOTEMPTY" | "LAST" | "LASTNOTEMPTY" | "MAXIMUM" | "MINIMUM" | "MODE" | "N" | "NDISTINCT" | "NMISS" | "NTOTAL" | "PERCENT" | "PERCENTILE" | "PGT" | "PLT" | "Q1" | "Q2" | "Q3" | "SUMMARY"
分析変数に適用するアグリゲーターを指定します。
ciAlpha=double
100*(1-ciAlpha)% 信頼区間の有意水準を指定します。デフォルト値 0.05 の場合、95% の信頼区間になります。
| デフォルト | 0.05 |
|---|---|
| 範囲 | (0, 1) |
ciType="LOWER" | "TWOSIDED" | "UPPER"
columnNames={"string-1" <, "string-2", ...>}
結果に使用する置換列名を指定します。デフォルトでは、分析変数の名前は結果テーブルの列名として使用されます。
| 別名 | colName |
|---|---|
| colNames | |
| 要件 | 指定した値は重複できません。 |
edgeId="variable-name"
分析変数の値を順序付けるために使用される数値変数を指定します。このパラメータは、FIRST、LAST、FNE、LNE アグリゲーターに適用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
exclnpwgt=TRUE | FALSE
True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 別名 | excludeNonPositiveWeight |
|---|---|
| デフォルト | FALSE |
format="string"
分析変数の一時出力形式を指定します。
formats={"string-1" <, "string-2", ...>}
分析変数の一時出力形式を指定します。
freq="variable-name"
値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠落値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 別名 | frequency |
|---|
freqStrict=TRUE | FALSE
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と小数値が使用されます。欠損値はまだ除外されています。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| デフォルト | TRUE |
|---|
includeMissing=TRUE | FALSE
デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 別名 | includeMiss |
|---|---|
| incMissing | |
| incMiss | |
| デフォルト | TRUE |
k=integer
MODE アグリゲーターに対して収集する最も頻度の高いアイテムの数を指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | 1–MACINT |
missDbl=double
欠損値の置き換えに使用する数値を指定します。
missStr="string"
欠損値の置き換えに使用する文字値を指定します。
modeSingle=TRUE | FALSE
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| デフォルト | FALSE |
|---|
name="variable-name"
分析変数名を指定します。
| 別名 | var |
|---|
names={"variable-name-1" <, "variable-name-2", ...>}
分析変数名を指定します。
| 別名 | vars |
|---|
pctlDef=integer
UNIVARIATE プロシジャのドキュメントで説明されているように、分位統計 (パーセンタイル) を計算する方法を指定します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 範囲 | 1–5 |
|---|
percentile={double-1 <, double-2, ...>}
アグリゲーターが PERCENTILE に設定されている場合に計算するパーセント点を指定します。
| 別名 | percentiles |
|---|---|
| pctl | |
| pctls | |
| 要件 | 指定した値は重複できません。 |
pN=double
数値変数の PGT と PLT アグリゲーターに数値しきい値を指定します。
pRange={double-1 <, double-2, ...>}
数値変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pRangeMin と pRangeMax の両方のパラメータを指定するのと同じです。
pRangeMax=double
数値変数の PIN アグリゲーターに包括的な最大値を指定します。
| デフォルト | MACBIG |
|---|
pRangeMin=double
数値変数の PIN アグリゲーターに包括的な最小値を指定します。
| デフォルト | -MACBIG |
|---|
pStrN="string"
文字変数の PGT と PLT アグリゲーターに文字しきい値を指定します。
pStrRange={"string-1" <, "string-2", ...>}
文字変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pStrRangeMin と pStrRangeMax の両方のパラメータを指定するのと同じです。
pStrRangeMax="string"
文字変数の PIN アグリゲーターに包括的な最大値を指定します。
pStrRangeMin="string"
文字変数の PIN アグリゲーターに包括的な最小値を指定します。
range={double-1 <, double-2, ...>}
集計で考慮する数値変数の包括的な最小値と最大値を指定します。これは、rangeMin と rangeMax の両方のパラメータを指定するのと同じです。
rangeMax=double
集計で考慮する数値変数の包括的な最小値を指定します。
| デフォルト | MACBIG |
|---|
rangeMin=double
集計で考慮する数値変数の包括的な最小値を指定します。
| デフォルト | -MACBIG |
|---|
strRange={"string-1" <, "string-2", ...>}
集計で考慮する文字変数の包括的な最小値と最大値を指定します。strRangeMin と strRangeMax の両方のパラメータを指定するのと同じです。
strRangeMax="string"
集計で考慮する文字変数の包括的な最大値を指定します。
strRangeMin="string"
集計で考慮する文字変数の包括的な最小値を指定します。
summarySubset={"CSS", "CV", "KURT", "KURTOSIS", "MAX", "MAXIMUM", "MEAN", "MIN", "MINIMUM", "N", "NMISS", "PROBT", "SKEW", "SKEWNESS", "STD", "STDERR", "SUM", "T", "TSTAT", "USS", "VAR"}
生成する要約統計量を指定します。デフォルトでは、要約統計量の列の順序は、指定した順序に関係なく、MIN, MAX, NOBS, MEAN, SUM, STD, STDERR, CV, NMISS, VAR, USS, CSS, TVALUE, PROBT, SKEWNESS, KURTOSIS です。列を特定の順序で返す場合は、columnNames パラメータを使用して各結果列の名前を指定します。
| 別名 | statistics |
|---|---|
| subSet | |
| 要件 | 指定した値は重複できません。 |
weight="variable-name"
アグリゲーターが SUMMARY の場合、数値分析変数値の重みとして使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
weight="variable-name"
アグリゲーターが SUMMARY の場合の数値分析変数値の重みとして値が使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。
windowBin={double-1 <, double-2, ...>}
ウィンドウビンの最小値と最大数を指定します。仕様と概念はビンが間隔に適用される点を除いて、ビンパラメータに似ています。
windowInt="string"
各時間間隔に関するオブザベーションの累積のための時間ウィンドウを指定します。例えば、interval='MONTH' と windowInt='YEAR' を指定した場合、アクションは月次間隔で 1 年間のオブザベーションを要約します。
| 別名 | winInt |
|---|---|
| windowInterval |
windowOffset=integer
各ウィンドウ間隔のオフセットを指定します。この効果は、オフセットパラメータが間隔パラメータの値にどのように影響するかに似ています。
| 別名 | windowIntOffset |
|---|---|
| winDif | |
| winIntDif | |
| winIntOff | |
| windowIntervalOffset | |
| デフォルト | 0 |
windowSubBinOffset=double
レコード値が集計されるウィンドウビン内の開始点を指定します。例えば、windowBin={0, 10} と windowSubBinOffset=2 を指定した場合、interval [0, 2) の ID 変数値を持つレコードは無視されます。指定された値は、ウィンドウのビン幅より大きくすることはできません。
| 別名 | winSubBinOffset |
|---|
windowSubBinWidth=double
各 windowBin 内のサブビンの幅を指定します。許容可能な最小値は 0 で、ウィンドウは無効になります。例えば、windowBin={0, 10}、windowSubBinOffset=2、windowSubBinWidth=5 を指定した場合、intervals [0, 2) と [7, 10) の ID 変数値を持つレコードは無視されます。
| 別名 | winSubBinWidth |
|---|---|
| 最小値 | 0 |
windowSubInt="string"
このパラメータは、サブ間隔に似ています。より小さい間隔を指定して、オブザベーションの集計のための各ウィンドウ間隔内のサブ時間間隔の配置を制御することができます。
| 別名 | winSubInterval |
|---|---|
| winSubInt | |
| windowSubInterval |
aggregate アクション
選択した変数の集計を実行します。
| 例: | 選択した列のデータを集計 |
| 選択した列のデータをグループ別に集計 | |
| 選択した列のデータを日付間隔で集計 | |
| ローリングウィンドウ集計の実行 |
Lua 構文
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametertable |
— |
テーブル名、caslib、他の共通パラメータを指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
出力テーブルの設定を指定します。 |
パラメーターの説明
align="BEGINNING" | "ENDING" | "MIDDLE"
bin={double-1 <, double-2, ...>}
sビンの最小および最大値を指定します。例えば、ID 変数の値が 0 から 100 までの範囲で、bin = {5, 15} を指定した場合、アクションは 11 個のビンを持つ時系列を構築します。最初のビンは [-5, 5] で、最後のビンは [95, 105] です。ビンの上限の境界の値は、このビンに属します。ビンの下限の境界の値は、隣接する下のビンに属します。このパラメータは、ID 変数も指定しない限り無視されます。
casOut={casouttable}
出力テーブルの設定を指定します。
casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
contribute="variable-name"
doESP パラメータが True の場合、各集計間隔内の値が記録されている変数を指定できます。この値は、集計された間隔に対する各行の寄与を理解するために、元のテーブルと結合するためのキーとして使用できます。
contributeColumnLabel="string"
寄与変数から変数ラベルを上書きする値を指定します。デフォルトでは、寄与変数のラベルが結果に表示されます。
contributeColumnName="string"
寄与変数から変数名を上書きする値を指定します。デフォルトでは、寄与変数の名前が結果に表示されます。
contributeDelimiter="string"
寄与変数の連結値間で使用される区切り文字を指定します。
| 別名 | delimiter |
|---|---|
| デフォルト | "," |
contributeTrim=true | false
True に設定すると、寄与変数のフォーマットされた値から先頭と末尾の空白が削除されます。contributionUnroll パラメータが True に設定されている場合、このパラメータは無視されます。
| デフォルト | false |
|---|
contributeUnroll=true | false
デフォルトでは、contrib 変数のフォーマットされた値は、結果テーブルに対して 1 つの行に連結されます。True に設定すると、contrib 変数の各未加工値が結果テーブルに行を追加します。
| 別名 | unroll |
|---|---|
| デフォルト | false |
copyVars={"variable-name-1" <, "variable-name-2", ...>}
入力テーブルから出力テーブルにコピーする変数を指定します。未加工値は出力に保持されます。入力テーブルに groupBy パラメータも指定しないかぎり、このパラメータは無視されます。1 つのグループに複数のレコードが存在する場合、最小の未加工値がコピーされます。
| 別名 | copyVar |
|---|
doESP=true | false
True に設定すると、アクションは入力テーブルのパーティション分割と並べ替えを利用できます。入力テーブルの groupBy パラメータを指定する必要があります。ID 変数は、最後の groupBy パラメータと orderBy パラメータで指定する必要があります。このパラメータを True に設定すると、keepRecord パラメータを True に設定されます。False (デフォルト値) に設定すると、keepRecordId、excludeSelf、contribute、contributeColumnName、contributeTrim、contributeDelimiter、contributeUnroll の各パラメータは無視されます。
| 別名 | partAndOrder |
|---|---|
| デフォルト | false |
edgeId="variable-name"
FIRST、LAST、FNE、LNE アグリゲーターを使用する各 varSpecs 仕様の値を順序付けるために使用される数値変数を指定します。このパラメータは、edgeId サブパラメータを含む varSpecs 仕様でオーバーライドできます。
exclnpwgt=true | false
True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。
| 別名 | excludeNonPositiveWeight |
|---|---|
| デフォルト | false |
excludeSelf=true | false
True に設定され、doESP パラメータが True の場合、集計は現在のオブザベーションの寄与を除外します。
| デフォルト | false |
|---|
freq="variable-name"
値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠損値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。
| 別名 | frequency |
|---|
freqStrict=true | false
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と10進値が使用されます。欠損値はまだ除外されています。
| デフォルト | true |
|---|
groupByLimit=64-bit-integer
Group-by セットのレベルの最大数を指定します。サーバーがこのレベル数を測定すると、サーバーは停止し結果を返しません。Group-by 操作で大規模な結果セットが作成されないようにするには、このパラメータを指定します。
| 最小値 | 1 |
|---|
groupedIntervalOutput=true | false
True に設定すると、最後の ID 値に関する同じ集計間隔の 1 つだけを保存します。'doESP' が False に設定されている場合、このオプションは無視されます。
| デフォルト | false |
|---|
id="variable-name"
入力テーブル内の各オブザベーションに関連付けられているタイムスタンプを識別する数値変数を指定します。値は、通常SAS DATE、TIME、DATETIME の値ですが、必須ではありません。指定した変数は、入力テーブルの groupBy パラメータでも指定する必要があります。
idEnd=double
分析で考慮する ID 変数の包括的な最大値を指定します。 ID 変数の最大値が idEnd 値より小さい場合、系列は欠損値で拡張されます。最後の ID 変数の値が idEnd の値より大きい場合、系列は切り捨てられます。このパラメータは、ID変数も指定しない限り無視されます。
idOutputName="string"
出力テーブルの ID 変数の新しい名前を指定します。
idRange={double-1 <, double-2, ...>}
分析で考慮する ID 変数の包括的な最小値と最大値を指定します。これは、idStart と idEnd の両方を指定することと同じです。
idStart=double
分析で考慮する ID 変数の包括的な最小値を指定します。ID 変数の最小値が idStart 値より大きい場合、系列には欠損値の接頭辞が付加されます。最初の ID 変数の値が idStart の値より小さい場合、系列は切り捨てられます。このパラメータは、ID 変数も指定しない限り無視されます。
includeEmptyInterval=true | false
デフォルトでは、ID 変数の値が欠落している間隔が出力に含まれます。False に設定すると、これらの間隔は出力から除外されます。
| 別名 | includeMissInterval |
|---|---|
| includeMissingInterval | |
| デフォルト | true |
includeMissing=true | false
デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。
| 別名 | includeMiss |
|---|---|
| incMissing | |
| incMiss | |
| デフォルト | true |
inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}
分析に使用する入力変数を指定します。未加工の数値変数の場合、デフォルトのアグリゲーターは SUMMARY です。その他の状況では、デフォルトのアグリゲーターは N です。このパラメータに変数を指定するか、varSpecs パラメータを指定してより多くの制御を行うことはできますが、両方を使用することはできません。
inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | input |
|---|
interval="string"
オブザベーションの累積時間を指定します。例えば、interval='MONTH' を指定すると、アクションは月次間隔でオブザベーションを要約します。このパラメータは、ID 変数も指定しない限り無視されます。
jumpingWindow=true | false
True に設定すると、複数の間隔を含むことができるタイムウィンドウで集計が行われ、指定された時間範囲が経過すると集計がリセットされることを指定します。デフォルトでは、ウィンドウは常に同じ複数の間隔を保持します。
| 別名 | tumblingWindow |
|---|---|
| デフォルト | false |
keepRecord=true | false
True に設定すると、ID 変数の各オブザベーションの元の値は間隔の配置を行わずに保持されます。
| デフォルト | false |
|---|
keepRecordId=true | false
True に設定され、doESP パラメータが True の場合、各オブザベーションの元の ID 値は間隔の配置を実行せずに保持されます。
| デフォルト | false |
|---|
modeSingle=true | false
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。
| デフォルト | false |
|---|
offset=integer
各間隔のオフセットを指定します。offset=-1 を指定すると、データセットから派生したすべての間隔は 1 つ後方にシフトされます。例えば、3月1日のタイムスタンプ値は、2月1日になるようにデータセットから取得されます。
| 別名 | intOffset |
|---|---|
| dif | |
| intDif | |
| intOff | |
| デフォルト | 0 |
partKey={"string-1" <, "string-2", ...>}
テーブルがパーティション化され、partition パラメータを指定する場合は、パーティションのみの結果が計算されるようにパーティションキーを指定することができます。
pctlDef=integer
UNIVARIATE プロシジャのドキュメントで説明されているように、分位点統計量 (パーセンタイル) を計算する方法を指定します。
| デフォルト | 5 |
|---|---|
| 範囲 | 1–5 |
pti=double
間隔またはビン内の集計が終了したときの時間値を指定します。例えば、interval='MONTH' と partialToInterval='10FEB98'd を指定した場合、アクションは各月の最初の10日間のレコードのみを集計します。
| 別名 | ptd |
|---|---|
| partialToDate | |
| partialToInterval | |
| デフォルト | 0 |
| 最小値 | 0 |
ptw=double
各ウィンドウ間隔に関するサブ間隔を指定します。例えば、windowInterval='MONTH' と partialToWindow='08FEB98'd を指定した場合、各年のウィンドウ間隔 2月、...、12月の集計時に、アクションは 1月から最初の 8日間、2月から最初の 8日間だけをカウントします。このパラメータは、開始時間がスライディングウィンドウ (非ジャンプウィンドウ) によって異なるため、jumpingWindow パラメータも指定しない限り無視されます。
| 別名 | partialToWindow |
|---|---|
| デフォルト | 0 |
| 最小値 | 0 |
raw=true | false
True に設定すると、入力パラメータの変数の未加工値が使用されます。
| デフォルト | false |
|---|
saveGroupbyFormat=true | false
デフォルトでは、groupBy 変数のフォーマットされた値が入力テーブルから結果にコピーされます。False に設定すると、フォーマットされた値はコピーされません。
| 別名 | saveGbyFmt |
|---|---|
| デフォルト | true |
saveGroupbyRaw=true | false
デフォルトでは、groupBy 変数の未加工値が入力テーブルから結果にコピーされます。False に設定すると、未加工値はコピーされません。
| 別名 | saveGbyRaw |
|---|---|
| デフォルト | true |
saveVariableColumn=true | false
デフォルトでは、各分析変数の変数名が結果に含まれます。結果テーブルには、'Column' という名前の列に名前が含まれています。False に設定すると、この列は結果に含まれません。
| 別名 | saveVarCol |
|---|---|
| デフォルト | true |
saveVariableSpecification=true | false
デフォルトでは、結果には、'Variable Specification' という名前の列が含まれ、結果を生成した varSpecs 指定を識別します。False に設定すると、この列は結果に含まれません。
| 別名 | saveVarSpec |
|---|---|
| デフォルト | true |
subBinOffset=double
ビンの先頭からのオフセットを指定します。値は正でビン幅以下でなければなりません。指定した値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID 変数とビンパラメータを指定しない限り無視されます。
subBinWidth=double
ビン内のサブビンの幅を指定します。例えば、ID変数の値が 0 から 100 までの範囲で、bin={5, 15}、subBinOffset=2、subBinWidth=5 を指定した場合、アクションは [-2, 3], [8, 13], [18, 23], ..., [98, 103] に分類される ID 変数値を持つオブザベーションだけを要約します。指定された値は正でなければならず、subBinOffset 値と subBinWidth 値の合計はビン幅以下でなければなりません。値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID変数とビンパラメータも指定しない限り無視されます。
| 最小値 | 0 |
|---|
subInterval="string"
より小さい間隔を指定して、オブザベーションの集計のための各間隔内の時間間隔の配置を制御します。
| 別名 | subInt |
|---|
* table={castable}
テーブル名、caslib、他の共通パラメータを指定します。
table パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。
varSpecs={{tkcasagg_varspecs-1} <, {tkcasagg_varspecs-2}, ...>}
集計する変数とアグリゲーターの設定を指定します。
tkcasagg_varspecs の値は次のいずれかになります:
agg="FIRST" | "FIRSTNOTEMPTY" | "LAST" | "LASTNOTEMPTY" | "MAXIMUM" | "MINIMUM" | "MODE" | "N" | "NDISTINCT" | "NMISS" | "NTOTAL" | "PERCENT" | "PERCENTILE" | "PGT" | "PLT" | "Q1" | "Q2" | "Q3" | "SUMMARY"
分析変数に適用するアグリゲーターを指定します。
ciAlpha=double
100*(1-ciAlpha)% 信頼区間の有意水準を指定します。デフォルト値 0.05 の場合、95% の信頼区間になります。
| デフォルト | 0.05 |
|---|---|
| 範囲 | (0, 1) |
ciType="LOWER" | "TWOSIDED" | "UPPER"
columnNames={"string-1" <, "string-2", ...>}
結果に使用する置換列名を指定します。デフォルトでは、分析変数の名前は結果テーブルの列名として使用されます。
| 別名 | colName |
|---|---|
| colNames | |
| 要件 | 指定した値は重複できません。 |
edgeId="variable-name"
分析変数の値を順序付けるために使用される数値変数を指定します。このパラメータは、FIRST、LAST、FNE、LNE アグリゲーターに適用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
exclnpwgt=true | false
True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 別名 | excludeNonPositiveWeight |
|---|---|
| デフォルト | false |
format="string"
分析変数の一時出力形式を指定します。
formats={"string-1" <, "string-2", ...>}
分析変数の一時出力形式を指定します。
freq="variable-name"
値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠落値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 別名 | frequency |
|---|
freqStrict=true | false
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と小数値が使用されます。欠損値はまだ除外されています。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| デフォルト | true |
|---|
includeMissing=true | false
デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 別名 | includeMiss |
|---|---|
| incMissing | |
| incMiss | |
| デフォルト | true |
k=integer
MODE アグリゲーターに対して収集する最も頻度の高いアイテムの数を指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | 1–MACINT |
missDbl=double
欠損値の置き換えに使用する数値を指定します。
missStr="string"
欠損値の置き換えに使用する文字値を指定します。
modeSingle=true | false
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| デフォルト | false |
|---|
name="variable-name"
分析変数名を指定します。
| 別名 | var |
|---|
names={"variable-name-1" <, "variable-name-2", ...>}
分析変数名を指定します。
| 別名 | vars |
|---|
pctlDef=integer
UNIVARIATE プロシジャのドキュメントで説明されているように、分位統計 (パーセンタイル) を計算する方法を指定します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 範囲 | 1–5 |
|---|
percentile={double-1 <, double-2, ...>}
アグリゲーターが PERCENTILE に設定されている場合に計算するパーセント点を指定します。
| 別名 | percentiles |
|---|---|
| pctl | |
| pctls | |
| 要件 | 指定した値は重複できません。 |
pN=double
数値変数の PGT と PLT アグリゲーターに数値しきい値を指定します。
pRange={double-1 <, double-2, ...>}
数値変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pRangeMin と pRangeMax の両方のパラメータを指定するのと同じです。
pRangeMax=double
数値変数の PIN アグリゲーターに包括的な最大値を指定します。
| デフォルト | MACBIG |
|---|
pRangeMin=double
数値変数の PIN アグリゲーターに包括的な最小値を指定します。
| デフォルト | -MACBIG |
|---|
pStrN="string"
文字変数の PGT と PLT アグリゲーターに文字しきい値を指定します。
pStrRange={"string-1" <, "string-2", ...>}
文字変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pStrRangeMin と pStrRangeMax の両方のパラメータを指定するのと同じです。
pStrRangeMax="string"
文字変数の PIN アグリゲーターに包括的な最大値を指定します。
pStrRangeMin="string"
文字変数の PIN アグリゲーターに包括的な最小値を指定します。
range={double-1 <, double-2, ...>}
集計で考慮する数値変数の包括的な最小値と最大値を指定します。これは、rangeMin と rangeMax の両方のパラメータを指定するのと同じです。
rangeMax=double
集計で考慮する数値変数の包括的な最小値を指定します。
| デフォルト | MACBIG |
|---|
rangeMin=double
集計で考慮する数値変数の包括的な最小値を指定します。
| デフォルト | -MACBIG |
|---|
strRange={"string-1" <, "string-2", ...>}
集計で考慮する文字変数の包括的な最小値と最大値を指定します。strRangeMin と strRangeMax の両方のパラメータを指定するのと同じです。
strRangeMax="string"
集計で考慮する文字変数の包括的な最大値を指定します。
strRangeMin="string"
集計で考慮する文字変数の包括的な最小値を指定します。
summarySubset={"CSS", "CV", "KURT", "KURTOSIS", "MAX", "MAXIMUM", "MEAN", "MIN", "MINIMUM", "N", "NMISS", "PROBT", "SKEW", "SKEWNESS", "STD", "STDERR", "SUM", "T", "TSTAT", "USS", "VAR"}
生成する要約統計量を指定します。デフォルトでは、要約統計量の列の順序は、指定した順序に関係なく、MIN, MAX, NOBS, MEAN, SUM, STD, STDERR, CV, NMISS, VAR, USS, CSS, TVALUE, PROBT, SKEWNESS, KURTOSIS です。列を特定の順序で返す場合は、columnNames パラメータを使用して各結果列の名前を指定します。
| 別名 | statistics |
|---|---|
| subSet | |
| 要件 | 指定した値は重複できません。 |
weight="variable-name"
アグリゲーターが SUMMARY の場合、数値分析変数値の重みとして使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
weight="variable-name"
アグリゲーターが SUMMARY の場合の数値分析変数値の重みとして値が使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。
windowBin={double-1 <, double-2, ...>}
ウィンドウビンの最小値と最大数を指定します。仕様と概念はビンが間隔に適用される点を除いて、ビンパラメータに似ています。
windowInt="string"
各時間間隔に関するオブザベーションの累積のための時間ウィンドウを指定します。例えば、interval='MONTH' と windowInt='YEAR' を指定した場合、アクションは月次間隔で 1 年間のオブザベーションを要約します。
| 別名 | winInt |
|---|---|
| windowInterval |
windowOffset=integer
各ウィンドウ間隔のオフセットを指定します。この効果は、オフセットパラメータが間隔パラメータの値にどのように影響するかに似ています。
| 別名 | windowIntOffset |
|---|---|
| winDif | |
| winIntDif | |
| winIntOff | |
| windowIntervalOffset | |
| デフォルト | 0 |
windowSubBinOffset=double
レコード値が集計されるウィンドウビン内の開始点を指定します。例えば、windowBin={0, 10} と windowSubBinOffset=2 を指定した場合、interval [0, 2) の ID 変数値を持つレコードは無視されます。指定された値は、ウィンドウのビン幅より大きくすることはできません。
| 別名 | winSubBinOffset |
|---|
windowSubBinWidth=double
各 windowBin 内のサブビンの幅を指定します。許容可能な最小値は 0 で、ウィンドウは無効になります。例えば、windowBin={0, 10}、windowSubBinOffset=2、windowSubBinWidth=5 を指定した場合、intervals [0, 2) と [7, 10) の ID 変数値を持つレコードは無視されます。
| 別名 | winSubBinWidth |
|---|---|
| 最小値 | 0 |
windowSubInt="string"
このパラメータは、サブ間隔に似ています。より小さい間隔を指定して、オブザベーションの集計のための各ウィンドウ間隔内のサブ時間間隔の配置を制御することができます。
| 別名 | winSubInterval |
|---|---|
| winSubInt | |
| windowSubInterval |
aggregate アクション
選択した変数の集計を実行します。
| 例: | 選択した列のデータを集計 |
| 選択した列のデータをグループ別に集計 | |
| 選択した列のデータを日付間隔で集計 | |
| ローリングウィンドウ集計の実行 |
Python 構文
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametertable |
— |
テーブル名、caslib、他の共通パラメータを指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
出力テーブルの設定を指定します。 |
パラメーターの説明
align="BEGINNING" | "ENDING" | "MIDDLE"
bin=[double-1 <, double-2, ...>]
sビンの最小および最大値を指定します。例えば、ID 変数の値が 0 から 100 までの範囲で、bin = {5, 15} を指定した場合、アクションは 11 個のビンを持つ時系列を構築します。最初のビンは [-5, 5] で、最後のビンは [95, 105] です。ビンの上限の境界の値は、このビンに属します。ビンの下限の境界の値は、隣接する下のビンに属します。このパラメータは、ID 変数も指定しない限り無視されます。
casOut={casouttable}
出力テーブルの設定を指定します。
casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
contribute="variable-name"
doESP パラメータが True の場合、各集計間隔内の値が記録されている変数を指定できます。この値は、集計された間隔に対する各行の寄与を理解するために、元のテーブルと結合するためのキーとして使用できます。
contributeColumnLabel="string"
寄与変数から変数ラベルを上書きする値を指定します。デフォルトでは、寄与変数のラベルが結果に表示されます。
contributeColumnName="string"
寄与変数から変数名を上書きする値を指定します。デフォルトでは、寄与変数の名前が結果に表示されます。
contributeDelimiter="string"
寄与変数の連結値間で使用される区切り文字を指定します。
| 別名 | delimiter |
|---|---|
| デフォルト | "," |
contributeTrim=True | False
True に設定すると、寄与変数のフォーマットされた値から先頭と末尾の空白が削除されます。contributionUnroll パラメータが True に設定されている場合、このパラメータは無視されます。
| デフォルト | False |
|---|
contributeUnroll=True | False
デフォルトでは、contrib 変数のフォーマットされた値は、結果テーブルに対して 1 つの行に連結されます。True に設定すると、contrib 変数の各未加工値が結果テーブルに行を追加します。
| 別名 | unroll |
|---|---|
| デフォルト | False |
copyVars=["variable-name-1" <, "variable-name-2", ...>]
入力テーブルから出力テーブルにコピーする変数を指定します。未加工値は出力に保持されます。入力テーブルに groupBy パラメータも指定しないかぎり、このパラメータは無視されます。1 つのグループに複数のレコードが存在する場合、最小の未加工値がコピーされます。
| 別名 | copyVar |
|---|
doESP=True | False
True に設定すると、アクションは入力テーブルのパーティション分割と並べ替えを利用できます。入力テーブルの groupBy パラメータを指定する必要があります。ID 変数は、最後の groupBy パラメータと orderBy パラメータで指定する必要があります。このパラメータを True に設定すると、keepRecord パラメータを True に設定されます。False (デフォルト値) に設定すると、keepRecordId、excludeSelf、contribute、contributeColumnName、contributeTrim、contributeDelimiter、contributeUnroll の各パラメータは無視されます。
| 別名 | partAndOrder |
|---|---|
| デフォルト | False |
edgeId="variable-name"
FIRST、LAST、FNE、LNE アグリゲーターを使用する各 varSpecs 仕様の値を順序付けるために使用される数値変数を指定します。このパラメータは、edgeId サブパラメータを含む varSpecs 仕様でオーバーライドできます。
exclnpwgt=True | False
True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。
| 別名 | excludeNonPositiveWeight |
|---|---|
| デフォルト | False |
excludeSelf=True | False
True に設定され、doESP パラメータが True の場合、集計は現在のオブザベーションの寄与を除外します。
| デフォルト | False |
|---|
freq="variable-name"
値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠損値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。
| 別名 | frequency |
|---|
freqStrict=True | False
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と10進値が使用されます。欠損値はまだ除外されています。
| デフォルト | True |
|---|
groupByLimit=64-bit-integer
Group-by セットのレベルの最大数を指定します。サーバーがこのレベル数を測定すると、サーバーは停止し結果を返しません。Group-by 操作で大規模な結果セットが作成されないようにするには、このパラメータを指定します。
| 最小値 | 1 |
|---|
groupedIntervalOutput=True | False
True に設定すると、最後の ID 値に関する同じ集計間隔の 1 つだけを保存します。'doESP' が False に設定されている場合、このオプションは無視されます。
| デフォルト | False |
|---|
id="variable-name"
入力テーブル内の各オブザベーションに関連付けられているタイムスタンプを識別する数値変数を指定します。値は、通常SAS DATE、TIME、DATETIME の値ですが、必須ではありません。指定した変数は、入力テーブルの groupBy パラメータでも指定する必要があります。
idEnd=double
分析で考慮する ID 変数の包括的な最大値を指定します。 ID 変数の最大値が idEnd 値より小さい場合、系列は欠損値で拡張されます。最後の ID 変数の値が idEnd の値より大きい場合、系列は切り捨てられます。このパラメータは、ID変数も指定しない限り無視されます。
idOutputName="string"
出力テーブルの ID 変数の新しい名前を指定します。
idRange=[double-1 <, double-2, ...>]
分析で考慮する ID 変数の包括的な最小値と最大値を指定します。これは、idStart と idEnd の両方を指定することと同じです。
idStart=double
分析で考慮する ID 変数の包括的な最小値を指定します。ID 変数の最小値が idStart 値より大きい場合、系列には欠損値の接頭辞が付加されます。最初の ID 変数の値が idStart の値より小さい場合、系列は切り捨てられます。このパラメータは、ID 変数も指定しない限り無視されます。
includeEmptyInterval=True | False
デフォルトでは、ID 変数の値が欠落している間隔が出力に含まれます。False に設定すると、これらの間隔は出力から除外されます。
| 別名 | includeMissInterval |
|---|---|
| includeMissingInterval | |
| デフォルト | True |
includeMissing=True | False
デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。
| 別名 | includeMiss |
|---|---|
| incMissing | |
| incMiss | |
| デフォルト | True |
inputs=[{casinvardesc-1} <, {casinvardesc-2}, ...>]
分析に使用する入力変数を指定します。未加工の数値変数の場合、デフォルトのアグリゲーターは SUMMARY です。その他の状況では、デフォルトのアグリゲーターは N です。このパラメータに変数を指定するか、varSpecs パラメータを指定してより多くの制御を行うことはできますが、両方を使用することはできません。
inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | input |
|---|
interval="string"
オブザベーションの累積時間を指定します。例えば、interval='MONTH' を指定すると、アクションは月次間隔でオブザベーションを要約します。このパラメータは、ID 変数も指定しない限り無視されます。
jumpingWindow=True | False
True に設定すると、複数の間隔を含むことができるタイムウィンドウで集計が行われ、指定された時間範囲が経過すると集計がリセットされることを指定します。デフォルトでは、ウィンドウは常に同じ複数の間隔を保持します。
| 別名 | tumblingWindow |
|---|---|
| デフォルト | False |
keepRecord=True | False
True に設定すると、ID 変数の各オブザベーションの元の値は間隔の配置を行わずに保持されます。
| デフォルト | False |
|---|
keepRecordId=True | False
True に設定され、doESP パラメータが True の場合、各オブザベーションの元の ID 値は間隔の配置を実行せずに保持されます。
| デフォルト | False |
|---|
modeSingle=True | False
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。
| デフォルト | False |
|---|
offset=integer
各間隔のオフセットを指定します。offset=-1 を指定すると、データセットから派生したすべての間隔は 1 つ後方にシフトされます。例えば、3月1日のタイムスタンプ値は、2月1日になるようにデータセットから取得されます。
| 別名 | intOffset |
|---|---|
| dif | |
| intDif | |
| intOff | |
| デフォルト | 0 |
partKey=["string-1" <, "string-2", ...>]
テーブルがパーティション化され、partition パラメータを指定する場合は、パーティションのみの結果が計算されるようにパーティションキーを指定することができます。
pctlDef=integer
UNIVARIATE プロシジャのドキュメントで説明されているように、分位点統計量 (パーセンタイル) を計算する方法を指定します。
| デフォルト | 5 |
|---|---|
| 範囲 | 1–5 |
pti=double
間隔またはビン内の集計が終了したときの時間値を指定します。例えば、interval='MONTH' と partialToInterval='10FEB98'd を指定した場合、アクションは各月の最初の10日間のレコードのみを集計します。
| 別名 | ptd |
|---|---|
| partialToDate | |
| partialToInterval | |
| デフォルト | 0 |
| 最小値 | 0 |
ptw=double
各ウィンドウ間隔に関するサブ間隔を指定します。例えば、windowInterval='MONTH' と partialToWindow='08FEB98'd を指定した場合、各年のウィンドウ間隔 2月、...、12月の集計時に、アクションは 1月から最初の 8日間、2月から最初の 8日間だけをカウントします。このパラメータは、開始時間がスライディングウィンドウ (非ジャンプウィンドウ) によって異なるため、jumpingWindow パラメータも指定しない限り無視されます。
| 別名 | partialToWindow |
|---|---|
| デフォルト | 0 |
| 最小値 | 0 |
raw=True | False
True に設定すると、入力パラメータの変数の未加工値が使用されます。
| デフォルト | False |
|---|
saveGroupbyFormat=True | False
デフォルトでは、groupBy 変数のフォーマットされた値が入力テーブルから結果にコピーされます。False に設定すると、フォーマットされた値はコピーされません。
| 別名 | saveGbyFmt |
|---|---|
| デフォルト | True |
saveGroupbyRaw=True | False
デフォルトでは、groupBy 変数の未加工値が入力テーブルから結果にコピーされます。False に設定すると、未加工値はコピーされません。
| 別名 | saveGbyRaw |
|---|---|
| デフォルト | True |
saveVariableColumn=True | False
デフォルトでは、各分析変数の変数名が結果に含まれます。結果テーブルには、'Column' という名前の列に名前が含まれています。False に設定すると、この列は結果に含まれません。
| 別名 | saveVarCol |
|---|---|
| デフォルト | True |
saveVariableSpecification=True | False
デフォルトでは、結果には、'Variable Specification' という名前の列が含まれ、結果を生成した varSpecs 指定を識別します。False に設定すると、この列は結果に含まれません。
| 別名 | saveVarSpec |
|---|---|
| デフォルト | True |
subBinOffset=double
ビンの先頭からのオフセットを指定します。値は正でビン幅以下でなければなりません。指定した値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID 変数とビンパラメータを指定しない限り無視されます。
subBinWidth=double
ビン内のサブビンの幅を指定します。例えば、ID変数の値が 0 から 100 までの範囲で、bin={5, 15}、subBinOffset=2、subBinWidth=5 を指定した場合、アクションは [-2, 3], [8, 13], [18, 23], ..., [98, 103] に分類される ID 変数値を持つオブザベーションだけを要約します。指定された値は正でなければならず、subBinOffset 値と subBinWidth 値の合計はビン幅以下でなければなりません。値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID変数とビンパラメータも指定しない限り無視されます。
| 最小値 | 0 |
|---|
subInterval="string"
より小さい間隔を指定して、オブザベーションの集計のための各間隔内の時間間隔の配置を制御します。
| 別名 | subInt |
|---|
* table={castable}
テーブル名、caslib、他の共通パラメータを指定します。
table パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。
varSpecs=[{tkcasagg_varspecs-1} <, {tkcasagg_varspecs-2}, ...>]
集計する変数とアグリゲーターの設定を指定します。
tkcasagg_varspecs の値は次のいずれかになります:
"agg":"FIRST" | "FIRSTNOTEMPTY" | "LAST" | "LASTNOTEMPTY" | "MAXIMUM" | "MINIMUM" | "MODE" | "N" | "NDISTINCT" | "NMISS" | "NTOTAL" | "PERCENT" | "PERCENTILE" | "PGT" | "PLT" | "Q1" | "Q2" | "Q3" | "SUMMARY"
分析変数に適用するアグリゲーターを指定します。
"ciAlpha":double
100*(1-ciAlpha)% 信頼区間の有意水準を指定します。デフォルト値 0.05 の場合、95% の信頼区間になります。
| デフォルト | 0.05 |
|---|---|
| 範囲 | (0, 1) |
"ciType":"LOWER" | "TWOSIDED" | "UPPER"
"columnNames":["string-1" <, "string-2", ...>]
結果に使用する置換列名を指定します。デフォルトでは、分析変数の名前は結果テーブルの列名として使用されます。
| 別名 | colName |
|---|---|
| colNames | |
| 要件 | 指定した値は重複できません。 |
"edgeId":"variable-name"
分析変数の値を順序付けるために使用される数値変数を指定します。このパラメータは、FIRST、LAST、FNE、LNE アグリゲーターに適用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
"exclnpwgt":True | False
True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 別名 | excludeNonPositiveWeight |
|---|---|
| デフォルト | False |
"format":"string"
分析変数の一時出力形式を指定します。
"formats":["string-1" <, "string-2", ...>]
分析変数の一時出力形式を指定します。
"freq":"variable-name"
値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠落値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 別名 | frequency |
|---|
"freqStrict":True | False
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と小数値が使用されます。欠損値はまだ除外されています。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| デフォルト | True |
|---|
"includeMissing":True | False
デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 別名 | includeMiss |
|---|---|
| incMissing | |
| incMiss | |
| デフォルト | True |
"k":integer
MODE アグリゲーターに対して収集する最も頻度の高いアイテムの数を指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | 1–MACINT |
"missDbl":double
欠損値の置き換えに使用する数値を指定します。
"missStr":"string"
欠損値の置き換えに使用する文字値を指定します。
"modeSingle":True | False
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| デフォルト | False |
|---|
"name":"variable-name"
分析変数名を指定します。
| 別名 | var |
|---|
"names":["variable-name-1" <, "variable-name-2", ...>]
分析変数名を指定します。
| 別名 | vars |
|---|
"pctlDef":integer
UNIVARIATE プロシジャのドキュメントで説明されているように、分位統計 (パーセンタイル) を計算する方法を指定します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 範囲 | 1–5 |
|---|
"percentile":[double-1 <, double-2, ...>]
アグリゲーターが PERCENTILE に設定されている場合に計算するパーセント点を指定します。
| 別名 | percentiles |
|---|---|
| pctl | |
| pctls | |
| 要件 | 指定した値は重複できません。 |
"pN":double
数値変数の PGT と PLT アグリゲーターに数値しきい値を指定します。
"pRange":[double-1 <, double-2, ...>]
数値変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pRangeMin と pRangeMax の両方のパラメータを指定するのと同じです。
"pRangeMax":double
数値変数の PIN アグリゲーターに包括的な最大値を指定します。
| デフォルト | MACBIG |
|---|
"pRangeMin":double
数値変数の PIN アグリゲーターに包括的な最小値を指定します。
| デフォルト | -MACBIG |
|---|
"pStrN":"string"
文字変数の PGT と PLT アグリゲーターに文字しきい値を指定します。
"pStrRange":["string-1" <, "string-2", ...>]
文字変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pStrRangeMin と pStrRangeMax の両方のパラメータを指定するのと同じです。
"pStrRangeMax":"string"
文字変数の PIN アグリゲーターに包括的な最大値を指定します。
"pStrRangeMin":"string"
文字変数の PIN アグリゲーターに包括的な最小値を指定します。
"range":[double-1 <, double-2, ...>]
集計で考慮する数値変数の包括的な最小値と最大値を指定します。これは、rangeMin と rangeMax の両方のパラメータを指定するのと同じです。
"rangeMax":double
集計で考慮する数値変数の包括的な最小値を指定します。
| デフォルト | MACBIG |
|---|
"rangeMin":double
集計で考慮する数値変数の包括的な最小値を指定します。
| デフォルト | -MACBIG |
|---|
"strRange":["string-1" <, "string-2", ...>]
集計で考慮する文字変数の包括的な最小値と最大値を指定します。strRangeMin と strRangeMax の両方のパラメータを指定するのと同じです。
"strRangeMax":"string"
集計で考慮する文字変数の包括的な最大値を指定します。
"strRangeMin":"string"
集計で考慮する文字変数の包括的な最小値を指定します。
"summarySubset":["CSS", "CV", "KURT", "KURTOSIS", "MAX", "MAXIMUM", "MEAN", "MIN", "MINIMUM", "N", "NMISS", "PROBT", "SKEW", "SKEWNESS", "STD", "STDERR", "SUM", "T", "TSTAT", "USS", "VAR"]
生成する要約統計量を指定します。デフォルトでは、要約統計量の列の順序は、指定した順序に関係なく、MIN, MAX, NOBS, MEAN, SUM, STD, STDERR, CV, NMISS, VAR, USS, CSS, TVALUE, PROBT, SKEWNESS, KURTOSIS です。列を特定の順序で返す場合は、columnNames パラメータを使用して各結果列の名前を指定します。
| 別名 | statistics |
|---|---|
| subSet | |
| 要件 | 指定した値は重複できません。 |
"weight":"variable-name"
アグリゲーターが SUMMARY の場合、数値分析変数値の重みとして使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
weight="variable-name"
アグリゲーターが SUMMARY の場合の数値分析変数値の重みとして値が使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。
windowBin=[double-1 <, double-2, ...>]
ウィンドウビンの最小値と最大数を指定します。仕様と概念はビンが間隔に適用される点を除いて、ビンパラメータに似ています。
windowInt="string"
各時間間隔に関するオブザベーションの累積のための時間ウィンドウを指定します。例えば、interval='MONTH' と windowInt='YEAR' を指定した場合、アクションは月次間隔で 1 年間のオブザベーションを要約します。
| 別名 | winInt |
|---|---|
| windowInterval |
windowOffset=integer
各ウィンドウ間隔のオフセットを指定します。この効果は、オフセットパラメータが間隔パラメータの値にどのように影響するかに似ています。
| 別名 | windowIntOffset |
|---|---|
| winDif | |
| winIntDif | |
| winIntOff | |
| windowIntervalOffset | |
| デフォルト | 0 |
windowSubBinOffset=double
レコード値が集計されるウィンドウビン内の開始点を指定します。例えば、windowBin={0, 10} と windowSubBinOffset=2 を指定した場合、interval [0, 2) の ID 変数値を持つレコードは無視されます。指定された値は、ウィンドウのビン幅より大きくすることはできません。
| 別名 | winSubBinOffset |
|---|
windowSubBinWidth=double
各 windowBin 内のサブビンの幅を指定します。許容可能な最小値は 0 で、ウィンドウは無効になります。例えば、windowBin={0, 10}、windowSubBinOffset=2、windowSubBinWidth=5 を指定した場合、intervals [0, 2) と [7, 10) の ID 変数値を持つレコードは無視されます。
| 別名 | winSubBinWidth |
|---|---|
| 最小値 | 0 |
windowSubInt="string"
このパラメータは、サブ間隔に似ています。より小さい間隔を指定して、オブザベーションの集計のための各ウィンドウ間隔内のサブ時間間隔の配置を制御することができます。
| 別名 | winSubInterval |
|---|---|
| winSubInt | |
| windowSubInterval |
aggregate アクション
選択した変数の集計を実行します。
| 例: | 選択した列のデータを集計 |
| 選択した列のデータをグループ別に集計 | |
| 選択した列のデータを日付間隔で集計 | |
| ローリングウィンドウ集計の実行 |
R 構文
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametertable |
— |
テーブル名、caslib、他の共通パラメータを指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
出力テーブルの設定を指定します。 |
パラメーターの説明
align="BEGINNING" | "ENDING" | "MIDDLE"
bin=list(double-1 <, double-2, ...>)
sビンの最小および最大値を指定します。例えば、ID 変数の値が 0 から 100 までの範囲で、bin = {5, 15} を指定した場合、アクションは 11 個のビンを持つ時系列を構築します。最初のビンは [-5, 5] で、最後のビンは [95, 105] です。ビンの上限の境界の値は、このビンに属します。ビンの下限の境界の値は、隣接する下のビンに属します。このパラメータは、ID 変数も指定しない限り無視されます。
casOut=list(casouttable)
出力テーブルの設定を指定します。
casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
contribute="variable-name"
doESP パラメータが True の場合、各集計間隔内の値が記録されている変数を指定できます。この値は、集計された間隔に対する各行の寄与を理解するために、元のテーブルと結合するためのキーとして使用できます。
contributeColumnLabel="string"
寄与変数から変数ラベルを上書きする値を指定します。デフォルトでは、寄与変数のラベルが結果に表示されます。
contributeColumnName="string"
寄与変数から変数名を上書きする値を指定します。デフォルトでは、寄与変数の名前が結果に表示されます。
contributeDelimiter="string"
寄与変数の連結値間で使用される区切り文字を指定します。
| 別名 | delimiter |
|---|---|
| デフォルト | "," |
contributeTrim=TRUE | FALSE
True に設定すると、寄与変数のフォーマットされた値から先頭と末尾の空白が削除されます。contributionUnroll パラメータが True に設定されている場合、このパラメータは無視されます。
| デフォルト | FALSE |
|---|
contributeUnroll=TRUE | FALSE
デフォルトでは、contrib 変数のフォーマットされた値は、結果テーブルに対して 1 つの行に連結されます。True に設定すると、contrib 変数の各未加工値が結果テーブルに行を追加します。
| 別名 | unroll |
|---|---|
| デフォルト | FALSE |
copyVars=list("variable-name-1" <, "variable-name-2", ...>)
入力テーブルから出力テーブルにコピーする変数を指定します。未加工値は出力に保持されます。入力テーブルに groupBy パラメータも指定しないかぎり、このパラメータは無視されます。1 つのグループに複数のレコードが存在する場合、最小の未加工値がコピーされます。
| 別名 | copyVar |
|---|
doESP=TRUE | FALSE
True に設定すると、アクションは入力テーブルのパーティション分割と並べ替えを利用できます。入力テーブルの groupBy パラメータを指定する必要があります。ID 変数は、最後の groupBy パラメータと orderBy パラメータで指定する必要があります。このパラメータを True に設定すると、keepRecord パラメータを True に設定されます。False (デフォルト値) に設定すると、keepRecordId、excludeSelf、contribute、contributeColumnName、contributeTrim、contributeDelimiter、contributeUnroll の各パラメータは無視されます。
| 別名 | partAndOrder |
|---|---|
| デフォルト | FALSE |
edgeId="variable-name"
FIRST、LAST、FNE、LNE アグリゲーターを使用する各 varSpecs 仕様の値を順序付けるために使用される数値変数を指定します。このパラメータは、edgeId サブパラメータを含む varSpecs 仕様でオーバーライドできます。
exclnpwgt=TRUE | FALSE
True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。
| 別名 | excludeNonPositiveWeight |
|---|---|
| デフォルト | FALSE |
excludeSelf=TRUE | FALSE
True に設定され、doESP パラメータが True の場合、集計は現在のオブザベーションの寄与を除外します。
| デフォルト | FALSE |
|---|
freq="variable-name"
値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠損値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。
| 別名 | frequency |
|---|
freqStrict=TRUE | FALSE
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と10進値が使用されます。欠損値はまだ除外されています。
| デフォルト | TRUE |
|---|
groupByLimit=64-bit-integer
Group-by セットのレベルの最大数を指定します。サーバーがこのレベル数を測定すると、サーバーは停止し結果を返しません。Group-by 操作で大規模な結果セットが作成されないようにするには、このパラメータを指定します。
| 最小値 | 1 |
|---|
groupedIntervalOutput=TRUE | FALSE
True に設定すると、最後の ID 値に関する同じ集計間隔の 1 つだけを保存します。'doESP' が False に設定されている場合、このオプションは無視されます。
| デフォルト | FALSE |
|---|
id="variable-name"
入力テーブル内の各オブザベーションに関連付けられているタイムスタンプを識別する数値変数を指定します。値は、通常SAS DATE、TIME、DATETIME の値ですが、必須ではありません。指定した変数は、入力テーブルの groupBy パラメータでも指定する必要があります。
idEnd=double
分析で考慮する ID 変数の包括的な最大値を指定します。 ID 変数の最大値が idEnd 値より小さい場合、系列は欠損値で拡張されます。最後の ID 変数の値が idEnd の値より大きい場合、系列は切り捨てられます。このパラメータは、ID変数も指定しない限り無視されます。
idOutputName="string"
出力テーブルの ID 変数の新しい名前を指定します。
idRange=list(double-1 <, double-2, ...>)
分析で考慮する ID 変数の包括的な最小値と最大値を指定します。これは、idStart と idEnd の両方を指定することと同じです。
idStart=double
分析で考慮する ID 変数の包括的な最小値を指定します。ID 変数の最小値が idStart 値より大きい場合、系列には欠損値の接頭辞が付加されます。最初の ID 変数の値が idStart の値より小さい場合、系列は切り捨てられます。このパラメータは、ID 変数も指定しない限り無視されます。
includeEmptyInterval=TRUE | FALSE
デフォルトでは、ID 変数の値が欠落している間隔が出力に含まれます。False に設定すると、これらの間隔は出力から除外されます。
| 別名 | includeMissInterval |
|---|---|
| includeMissingInterval | |
| デフォルト | TRUE |
includeMissing=TRUE | FALSE
デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。
| 別名 | includeMiss |
|---|---|
| incMissing | |
| incMiss | |
| デフォルト | TRUE |
inputs=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
分析に使用する入力変数を指定します。未加工の数値変数の場合、デフォルトのアグリゲーターは SUMMARY です。その他の状況では、デフォルトのアグリゲーターは N です。このパラメータに変数を指定するか、varSpecs パラメータを指定してより多くの制御を行うことはできますが、両方を使用することはできません。
inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | input |
|---|
interval="string"
オブザベーションの累積時間を指定します。例えば、interval='MONTH' を指定すると、アクションは月次間隔でオブザベーションを要約します。このパラメータは、ID 変数も指定しない限り無視されます。
jumpingWindow=TRUE | FALSE
True に設定すると、複数の間隔を含むことができるタイムウィンドウで集計が行われ、指定された時間範囲が経過すると集計がリセットされることを指定します。デフォルトでは、ウィンドウは常に同じ複数の間隔を保持します。
| 別名 | tumblingWindow |
|---|---|
| デフォルト | FALSE |
keepRecord=TRUE | FALSE
True に設定すると、ID 変数の各オブザベーションの元の値は間隔の配置を行わずに保持されます。
| デフォルト | FALSE |
|---|
keepRecordId=TRUE | FALSE
True に設定され、doESP パラメータが True の場合、各オブザベーションの元の ID 値は間隔の配置を実行せずに保持されます。
| デフォルト | FALSE |
|---|
modeSingle=TRUE | FALSE
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。
| デフォルト | FALSE |
|---|
offset=integer
各間隔のオフセットを指定します。offset=-1 を指定すると、データセットから派生したすべての間隔は 1 つ後方にシフトされます。例えば、3月1日のタイムスタンプ値は、2月1日になるようにデータセットから取得されます。
| 別名 | intOffset |
|---|---|
| dif | |
| intDif | |
| intOff | |
| デフォルト | 0 |
partKey=list("string-1" <, "string-2", ...>)
テーブルがパーティション化され、partition パラメータを指定する場合は、パーティションのみの結果が計算されるようにパーティションキーを指定することができます。
pctlDef=integer
UNIVARIATE プロシジャのドキュメントで説明されているように、分位点統計量 (パーセンタイル) を計算する方法を指定します。
| デフォルト | 5 |
|---|---|
| 範囲 | 1–5 |
pti=double
間隔またはビン内の集計が終了したときの時間値を指定します。例えば、interval='MONTH' と partialToInterval='10FEB98'd を指定した場合、アクションは各月の最初の10日間のレコードのみを集計します。
| 別名 | ptd |
|---|---|
| partialToDate | |
| partialToInterval | |
| デフォルト | 0 |
| 最小値 | 0 |
ptw=double
各ウィンドウ間隔に関するサブ間隔を指定します。例えば、windowInterval='MONTH' と partialToWindow='08FEB98'd を指定した場合、各年のウィンドウ間隔 2月、...、12月の集計時に、アクションは 1月から最初の 8日間、2月から最初の 8日間だけをカウントします。このパラメータは、開始時間がスライディングウィンドウ (非ジャンプウィンドウ) によって異なるため、jumpingWindow パラメータも指定しない限り無視されます。
| 別名 | partialToWindow |
|---|---|
| デフォルト | 0 |
| 最小値 | 0 |
raw=TRUE | FALSE
True に設定すると、入力パラメータの変数の未加工値が使用されます。
| デフォルト | FALSE |
|---|
saveGroupbyFormat=TRUE | FALSE
デフォルトでは、groupBy 変数のフォーマットされた値が入力テーブルから結果にコピーされます。False に設定すると、フォーマットされた値はコピーされません。
| 別名 | saveGbyFmt |
|---|---|
| デフォルト | TRUE |
saveGroupbyRaw=TRUE | FALSE
デフォルトでは、groupBy 変数の未加工値が入力テーブルから結果にコピーされます。False に設定すると、未加工値はコピーされません。
| 別名 | saveGbyRaw |
|---|---|
| デフォルト | TRUE |
saveVariableColumn=TRUE | FALSE
デフォルトでは、各分析変数の変数名が結果に含まれます。結果テーブルには、'Column' という名前の列に名前が含まれています。False に設定すると、この列は結果に含まれません。
| 別名 | saveVarCol |
|---|---|
| デフォルト | TRUE |
saveVariableSpecification=TRUE | FALSE
デフォルトでは、結果には、'Variable Specification' という名前の列が含まれ、結果を生成した varSpecs 指定を識別します。False に設定すると、この列は結果に含まれません。
| 別名 | saveVarSpec |
|---|---|
| デフォルト | TRUE |
subBinOffset=double
ビンの先頭からのオフセットを指定します。値は正でビン幅以下でなければなりません。指定した値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID 変数とビンパラメータを指定しない限り無視されます。
subBinWidth=double
ビン内のサブビンの幅を指定します。例えば、ID変数の値が 0 から 100 までの範囲で、bin={5, 15}、subBinOffset=2、subBinWidth=5 を指定した場合、アクションは [-2, 3], [8, 13], [18, 23], ..., [98, 103] に分類される ID 変数値を持つオブザベーションだけを要約します。指定された値は正でなければならず、subBinOffset 値と subBinWidth 値の合計はビン幅以下でなければなりません。値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID変数とビンパラメータも指定しない限り無視されます。
| 最小値 | 0 |
|---|
subInterval="string"
より小さい間隔を指定して、オブザベーションの集計のための各間隔内の時間間隔の配置を制御します。
| 別名 | subInt |
|---|
* table=list(castable)
テーブル名、caslib、他の共通パラメータを指定します。
table パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。
varSpecs=list( list(tkcasagg_varspecs-1) <, list(tkcasagg_varspecs-2), ...>)
集計する変数とアグリゲーターの設定を指定します。
tkcasagg_varspecs の値は次のいずれかになります:
agg="FIRST" | "FIRSTNOTEMPTY" | "LAST" | "LASTNOTEMPTY" | "MAXIMUM" | "MINIMUM" | "MODE" | "N" | "NDISTINCT" | "NMISS" | "NTOTAL" | "PERCENT" | "PERCENTILE" | "PGT" | "PLT" | "Q1" | "Q2" | "Q3" | "SUMMARY"
分析変数に適用するアグリゲーターを指定します。
ciAlpha=double
100*(1-ciAlpha)% 信頼区間の有意水準を指定します。デフォルト値 0.05 の場合、95% の信頼区間になります。
| デフォルト | 0.05 |
|---|---|
| 範囲 | (0, 1) |
ciType="LOWER" | "TWOSIDED" | "UPPER"
columnNames=list("string-1" <, "string-2", ...>)
結果に使用する置換列名を指定します。デフォルトでは、分析変数の名前は結果テーブルの列名として使用されます。
| 別名 | colName |
|---|---|
| colNames | |
| 要件 | 指定した値は重複できません。 |
edgeId="variable-name"
分析変数の値を順序付けるために使用される数値変数を指定します。このパラメータは、FIRST、LAST、FNE、LNE アグリゲーターに適用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
exclnpwgt=TRUE | FALSE
True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 別名 | excludeNonPositiveWeight |
|---|---|
| デフォルト | FALSE |
format="string"
分析変数の一時出力形式を指定します。
formats=list("string-1" <, "string-2", ...>)
分析変数の一時出力形式を指定します。
freq="variable-name"
値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠落値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 別名 | frequency |
|---|
freqStrict=TRUE | FALSE
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と小数値が使用されます。欠損値はまだ除外されています。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| デフォルト | TRUE |
|---|
includeMissing=TRUE | FALSE
デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 別名 | includeMiss |
|---|---|
| incMissing | |
| incMiss | |
| デフォルト | TRUE |
k=integer
MODE アグリゲーターに対して収集する最も頻度の高いアイテムの数を指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | 1–MACINT |
missDbl=double
欠損値の置き換えに使用する数値を指定します。
missStr="string"
欠損値の置き換えに使用する文字値を指定します。
modeSingle=TRUE | FALSE
このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| デフォルト | FALSE |
|---|
name="variable-name"
分析変数名を指定します。
| 別名 | var |
|---|
names=list("variable-name-1" <, "variable-name-2", ...>)
分析変数名を指定します。
| 別名 | vars |
|---|
pctlDef=integer
UNIVARIATE プロシジャのドキュメントで説明されているように、分位統計 (パーセンタイル) を計算する方法を指定します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
| 範囲 | 1–5 |
|---|
percentile=list(double-1 <, double-2, ...>)
アグリゲーターが PERCENTILE に設定されている場合に計算するパーセント点を指定します。
| 別名 | percentiles |
|---|---|
| pctl | |
| pctls | |
| 要件 | 指定した値は重複できません。 |
pN=double
数値変数の PGT と PLT アグリゲーターに数値しきい値を指定します。
pRange=list(double-1 <, double-2, ...>)
数値変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pRangeMin と pRangeMax の両方のパラメータを指定するのと同じです。
pRangeMax=double
数値変数の PIN アグリゲーターに包括的な最大値を指定します。
| デフォルト | MACBIG |
|---|
pRangeMin=double
数値変数の PIN アグリゲーターに包括的な最小値を指定します。
| デフォルト | -MACBIG |
|---|
pStrN="string"
文字変数の PGT と PLT アグリゲーターに文字しきい値を指定します。
pStrRange=list("string-1" <, "string-2", ...>)
文字変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pStrRangeMin と pStrRangeMax の両方のパラメータを指定するのと同じです。
pStrRangeMax="string"
文字変数の PIN アグリゲーターに包括的な最大値を指定します。
pStrRangeMin="string"
文字変数の PIN アグリゲーターに包括的な最小値を指定します。
range=list(double-1 <, double-2, ...>)
集計で考慮する数値変数の包括的な最小値と最大値を指定します。これは、rangeMin と rangeMax の両方のパラメータを指定するのと同じです。
rangeMax=double
集計で考慮する数値変数の包括的な最小値を指定します。
| デフォルト | MACBIG |
|---|
rangeMin=double
集計で考慮する数値変数の包括的な最小値を指定します。
| デフォルト | -MACBIG |
|---|
strRange=list("string-1" <, "string-2", ...>)
集計で考慮する文字変数の包括的な最小値と最大値を指定します。strRangeMin と strRangeMax の両方のパラメータを指定するのと同じです。
strRangeMax="string"
集計で考慮する文字変数の包括的な最大値を指定します。
strRangeMin="string"
集計で考慮する文字変数の包括的な最小値を指定します。
summarySubset=list("CSS", "CV", "KURT", "KURTOSIS", "MAX", "MAXIMUM", "MEAN", "MIN", "MINIMUM", "N", "NMISS", "PROBT", "SKEW", "SKEWNESS", "STD", "STDERR", "SUM", "T", "TSTAT", "USS", "VAR")
生成する要約統計量を指定します。デフォルトでは、要約統計量の列の順序は、指定した順序に関係なく、MIN, MAX, NOBS, MEAN, SUM, STD, STDERR, CV, NMISS, VAR, USS, CSS, TVALUE, PROBT, SKEWNESS, KURTOSIS です。列を特定の順序で返す場合は、columnNames パラメータを使用して各結果列の名前を指定します。
| 別名 | statistics |
|---|---|
| subSet | |
| 要件 | 指定した値は重複できません。 |
weight="variable-name"
アグリゲーターが SUMMARY の場合、数値分析変数値の重みとして使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。
weight="variable-name"
アグリゲーターが SUMMARY の場合の数値分析変数値の重みとして値が使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。
windowBin=list(double-1 <, double-2, ...>)
ウィンドウビンの最小値と最大数を指定します。仕様と概念はビンが間隔に適用される点を除いて、ビンパラメータに似ています。
windowInt="string"
各時間間隔に関するオブザベーションの累積のための時間ウィンドウを指定します。例えば、interval='MONTH' と windowInt='YEAR' を指定した場合、アクションは月次間隔で 1 年間のオブザベーションを要約します。
| 別名 | winInt |
|---|---|
| windowInterval |
windowOffset=integer
各ウィンドウ間隔のオフセットを指定します。この効果は、オフセットパラメータが間隔パラメータの値にどのように影響するかに似ています。
| 別名 | windowIntOffset |
|---|---|
| winDif | |
| winIntDif | |
| winIntOff | |
| windowIntervalOffset | |
| デフォルト | 0 |
windowSubBinOffset=double
レコード値が集計されるウィンドウビン内の開始点を指定します。例えば、windowBin={0, 10} と windowSubBinOffset=2 を指定した場合、interval [0, 2) の ID 変数値を持つレコードは無視されます。指定された値は、ウィンドウのビン幅より大きくすることはできません。
| 別名 | winSubBinOffset |
|---|
windowSubBinWidth=double
各 windowBin 内のサブビンの幅を指定します。許容可能な最小値は 0 で、ウィンドウは無効になります。例えば、windowBin={0, 10}、windowSubBinOffset=2、windowSubBinWidth=5 を指定した場合、intervals [0, 2) と [7, 10) の ID 変数値を持つレコードは無視されます。
| 別名 | winSubBinWidth |
|---|---|
| 最小値 | 0 |
windowSubInt="string"
このパラメータは、サブ間隔に似ています。より小さい間隔を指定して、オブザベーションの集計のための各ウィンドウ間隔内のサブ時間間隔の配置を制御することができます。
| 別名 | winSubInterval |
|---|---|
| winSubInt | |
| windowSubInterval |