集約 アクションセット: 構文

1 つ以上の変数の値を集約するアクションを提供します

aggregate アクション

選択した変数の集計を実行します。

選択した列のデータを集計
選択した列のデータをグループ別に集計
選択した列のデータを日付間隔で集計
ローリングウィンドウ集計の実行

CASL 構文

aggregation.aggregate <result=results> <status=rc> /
bin={double-1 <, double-2, ...>},
casOut={
caslib="string",
compress=TRUE | FALSE,
indexVars={"variable-name-1" <, "variable-name-2", ...>},
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
onDemand=TRUE | FALSE,
promote=TRUE | FALSE,
replace=TRUE | FALSE,
replication=integer,
threadBlockSize=64-bit-integer,
timeStamp="string",
where={"string-1" <, "string-2", ...>}
},
contribute="variable-name",
contributeTrim=TRUE | FALSE,
contributeUnroll=TRUE | FALSE,
copyVars={"variable-name-1" <, "variable-name-2", ...>},
doESP=TRUE | FALSE,
edgeId="variable-name",
exclnpwgt=TRUE | FALSE,
excludeSelf=TRUE | FALSE,
freq="variable-name",
freqStrict=TRUE | FALSE,
groupByLimit=64-bit-integer,
groupedIntervalOutput=TRUE | FALSE,
id="variable-name",
idEnd=double,
idOutputName="string",
idRange={double-1 <, double-2, ...>},
idStart=double,
includeEmptyInterval=TRUE | FALSE,
includeMissing=TRUE | FALSE,
inputs={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
interval="string",
jumpingWindow=TRUE | FALSE,
keepRecord=TRUE | FALSE,
keepRecordId=TRUE | FALSE,
modeSingle=TRUE | FALSE,
offset=integer,
partKey={"string-1" <, "string-2", ...>},
pctlDef=integer,
pti=double,
ptw=double,
raw=TRUE | FALSE,
saveGroupbyFormat=TRUE | FALSE,
saveGroupbyRaw=TRUE | FALSE,
saveVariableColumn=TRUE | FALSE,
subBinOffset=double,
subBinWidth=double,
subInterval="string",
required parameter table={
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
computedVarsProgram="string",
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
groupBy={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
groupByMode="NOSORT" | "REDISTRIBUTE",
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
onDemand=TRUE | FALSE,
orderBy={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
singlePass=TRUE | FALSE,
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
varSpecs={{
ciAlpha=double,
columnNames={"string-1" <, "string-2", ...>},
edgeId="variable-name",
exclnpwgt=TRUE | FALSE,
format="string",
formats={"string-1" <, "string-2", ...>},
freq="variable-name",
freqStrict=TRUE | FALSE,
includeMissing=TRUE | FALSE,
k=integer,
missDbl=double,
missStr="string",
modeSingle=TRUE | FALSE,
name="variable-name",
names={"variable-name-1" <, "variable-name-2", ...>},
pctlDef=integer,
percentile={double-1 <, double-2, ...>},
pN=double,
pRange={double-1 <, double-2, ...>},
pRangeMax=double,
pRangeMin=double,
pStrN="string",
pStrRange={"string-1" <, "string-2", ...>},
pStrRangeMax="string",
pStrRangeMin="string",
range={double-1 <, double-2, ...>},
rangeMax=double,
rangeMin=double,
strRange={"string-1" <, "string-2", ...>},
strRangeMax="string",
strRangeMin="string",
summarySubset={"CSS", "CV", "KURT", "KURTOSIS", "MAX", "MAXIMUM", "MEAN", "MIN", "MINIMUM", "N", "NMISS", "PROBT", "SKEW", "SKEWNESS", "STD", "STDERR", "SUM", "T", "TSTAT", "USS", "VAR"},
weight="variable-name"
}, {...}},
weight="variable-name",
windowBin={double-1 <, double-2, ...>},
windowInt="string",
windowOffset=integer,
windowSubInt="string"
;
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

テーブル名、caslib、他の共通パラメータを指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 casOut

—

出力テーブルの設定を指定します。

パラメーターの説明

align="BEGINNING" | "ENDING" | "MIDDLE"

間隔またはビン対する代表値の配置を指定します。

BEGINNING

間隔またはビンの先頭に配置することを指定します。例えば、月の最初の日は間隔の先頭です。

別名B
BEG
LEFT
ENDING

間隔またはビンの最後の値に整列することを指定します。

別名E
END
RIGHT
MIDDLE

間隔またはビンの中央に配置することを指定します。

別名M
MID

bin={double-1 <, double-2, ...>}

sビンの最小および最大値を指定します。例えば、ID 変数の値が 0 から 100 までの範囲で、bin = {5, 15} を指定した場合、アクションは 11 個のビンを持つ時系列を構築します。最初のビンは [-5, 5] で、最後のビンは [95, 105] です。ビンの上限の境界の値は、このビンに属します。ビンの下限の境界の値は、隣接する下のビンに属します。このパラメータは、ID 変数も指定しない限り無視されます。

casOut={casouttable}

出力テーブルの設定を指定します。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

contribute="variable-name"

doESP パラメータが True の場合、各集計間隔内の値が記録されている変数を指定できます。この値は、集計された間隔に対する各行の寄与を理解するために、元のテーブルと結合するためのキーとして使用できます。

contributeColumnLabel="string"

寄与変数から変数ラベルを上書きする値を指定します。デフォルトでは、寄与変数のラベルが結果に表示されます。

contributeColumnName="string"

寄与変数から変数名を上書きする値を指定します。デフォルトでは、寄与変数の名前が結果に表示されます。

contributeDelimiter="string"

寄与変数の連結値間で使用される区切り文字を指定します。

別名delimiter
デフォルト","

contributeTrim=TRUE | FALSE

True に設定すると、寄与変数のフォーマットされた値から先頭と末尾の空白が削除されます。contributionUnroll パラメータが True に設定されている場合、このパラメータは無視されます。

デフォルトFALSE

contributeUnroll=TRUE | FALSE

デフォルトでは、contrib 変数のフォーマットされた値は、結果テーブルに対して 1 つの行に連結されます。True に設定すると、contrib 変数の各未加工値が結果テーブルに行を追加します。

別名unroll
デフォルトFALSE

copyVars={"variable-name-1" <, "variable-name-2", ...>}

入力テーブルから出力テーブルにコピーする変数を指定します。未加工値は出力に保持されます。入力テーブルに groupBy パラメータも指定しないかぎり、このパラメータは無視されます。1 つのグループに複数のレコードが存在する場合、最小の未加工値がコピーされます。

別名copyVar

doESP=TRUE | FALSE

True に設定すると、アクションは入力テーブルのパーティション分割と並べ替えを利用できます。入力テーブルの groupBy パラメータを指定する必要があります。ID 変数は、最後の groupBy パラメータと orderBy パラメータで指定する必要があります。このパラメータを True に設定すると、keepRecord パラメータを True に設定されます。False (デフォルト値) に設定すると、keepRecordId、excludeSelf、contribute、contributeColumnName、contributeTrim、contributeDelimiter、contributeUnroll の各パラメータは無視されます。

別名partAndOrder
デフォルトFALSE

edgeId="variable-name"

FIRST、LAST、FNE、LNE アグリゲーターを使用する各 varSpecs 仕様の値を順序付けるために使用される数値変数を指定します。このパラメータは、edgeId サブパラメータを含む varSpecs 仕様でオーバーライドできます。

exclnpwgt=TRUE | FALSE

True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。

別名excludeNonPositiveWeight
デフォルトFALSE

excludeSelf=TRUE | FALSE

True に設定され、doESP パラメータが True の場合、集計は現在のオブザベーションの寄与を除外します。

デフォルトFALSE

freq="variable-name"

値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠損値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。

別名frequency

freqStrict=TRUE | FALSE

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と10進値が使用されます。欠損値はまだ除外されています。

デフォルトTRUE

groupByLimit=64-bit-integer

Group-by セットのレベルの最大数を指定します。サーバーがこのレベル数を測定すると、サーバーは停止し結果を返しません。Group-by 操作で大規模な結果セットが作成されないようにするには、このパラメータを指定します。

最小値1

groupedIntervalOutput=TRUE | FALSE

True に設定すると、最後の ID 値に関する同じ集計間隔の 1 つだけを保存します。'doESP' が False に設定されている場合、このオプションは無視されます。

デフォルトFALSE

id="variable-name"

入力テーブル内の各オブザベーションに関連付けられているタイムスタンプを識別する数値変数を指定します。値は、通常SAS DATE、TIME、DATETIME の値ですが、必須ではありません。指定した変数は、入力テーブルの groupBy パラメータでも指定する必要があります。

idEnd=double

分析で考慮する ID 変数の包括的な最大値を指定します。 ID 変数の最大値が idEnd 値より小さい場合、系列は欠損値で拡張されます。最後の ID 変数の値が idEnd の値より大きい場合、系列は切り捨てられます。このパラメータは、ID変数も指定しない限り無視されます。

idOutputName="string"

出力テーブルの ID 変数の新しい名前を指定します。

idRange={double-1 <, double-2, ...>}

分析で考慮する ID 変数の包括的な最小値と最大値を指定します。これは、idStart と idEnd の両方を指定することと同じです。

idStart=double

分析で考慮する ID 変数の包括的な最小値を指定します。ID 変数の最小値が idStart 値より大きい場合、系列には欠損値の接頭辞が付加されます。最初の ID 変数の値が idStart の値より小さい場合、系列は切り捨てられます。このパラメータは、ID 変数も指定しない限り無視されます。

includeEmptyInterval=TRUE | FALSE

デフォルトでは、ID 変数の値が欠落している間隔が出力に含まれます。False に設定すると、これらの間隔は出力から除外されます。

別名includeMissInterval
includeMissingInterval
デフォルトTRUE

includeMissing=TRUE | FALSE

デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。

別名includeMiss
incMissing
incMiss
デフォルトTRUE

inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}

分析に使用する入力変数を指定します。未加工の数値変数の場合、デフォルトのアグリゲーターは SUMMARY です。その他の状況では、デフォルトのアグリゲーターは N です。このパラメータに変数を指定するか、varSpecs パラメータを指定してより多くの制御を行うことはできますが、両方を使用することはできません。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名input

interval="string"

オブザベーションの累積時間を指定します。例えば、interval='MONTH' を指定すると、アクションは月次間隔でオブザベーションを要約します。このパラメータは、ID 変数も指定しない限り無視されます。

jumpingWindow=TRUE | FALSE

True に設定すると、複数の間隔を含むことができるタイムウィンドウで集計が行われ、指定された時間範囲が経過すると集計がリセットされることを指定します。デフォルトでは、ウィンドウは常に同じ複数の間隔を保持します。

別名tumblingWindow
デフォルトFALSE

keepRecord=TRUE | FALSE

True に設定すると、ID 変数の各オブザベーションの元の値は間隔の配置を行わずに保持されます。

デフォルトFALSE

keepRecordId=TRUE | FALSE

True に設定され、doESP パラメータが True の場合、各オブザベーションの元の ID 値は間隔の配置を実行せずに保持されます。

デフォルトFALSE

modeSingle=TRUE | FALSE

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。

デフォルトFALSE

offset=integer

各間隔のオフセットを指定します。offset=-1 を指定すると、データセットから派生したすべての間隔は 1 つ後方にシフトされます。例えば、3月1日のタイムスタンプ値は、2月1日になるようにデータセットから取得されます。

別名intOffset
dif
intDif
intOff
デフォルト0

partKey={"string-1" <, "string-2", ...>}

テーブルがパーティション化され、partition パラメータを指定する場合は、パーティションのみの結果が計算されるようにパーティションキーを指定することができます。

pctlDef=integer

UNIVARIATE プロシジャのドキュメントで説明されているように、分位点統計量 (パーセンタイル) を計算する方法を指定します。

デフォルト5
範囲1–5

pti=double

間隔またはビン内の集計が終了したときの時間値を指定します。例えば、interval='MONTH' と partialToInterval='10FEB98'd を指定した場合、アクションは各月の最初の10日間のレコードのみを集計します。

別名ptd
partialToDate
partialToInterval
デフォルト0
最小値0

ptw=double

各ウィンドウ間隔に関するサブ間隔を指定します。例えば、windowInterval='MONTH' と partialToWindow='08FEB98'd を指定した場合、各年のウィンドウ間隔 2月、...、12月の集計時に、アクションは 1月から最初の 8日間、2月から最初の 8日間だけをカウントします。このパラメータは、開始時間がスライディングウィンドウ (非ジャンプウィンドウ) によって異なるため、jumpingWindow パラメータも指定しない限り無視されます。

別名partialToWindow
デフォルト0
最小値0

raw=TRUE | FALSE

True に設定すると、入力パラメータの変数の未加工値が使用されます。

デフォルトFALSE

saveGroupbyFormat=TRUE | FALSE

デフォルトでは、groupBy 変数のフォーマットされた値が入力テーブルから結果にコピーされます。False に設定すると、フォーマットされた値はコピーされません。

別名saveGbyFmt
デフォルトTRUE

saveGroupbyRaw=TRUE | FALSE

デフォルトでは、groupBy 変数の未加工値が入力テーブルから結果にコピーされます。False に設定すると、未加工値はコピーされません。

別名saveGbyRaw
デフォルトTRUE

saveVariableColumn=TRUE | FALSE

デフォルトでは、各分析変数の変数名が結果に含まれます。結果テーブルには、'Column' という名前の列に名前が含まれています。False に設定すると、この列は結果に含まれません。

別名saveVarCol
デフォルトTRUE

saveVariableSpecification=TRUE | FALSE

デフォルトでは、結果には、'Variable Specification' という名前の列が含まれ、結果を生成した varSpecs 指定を識別します。False に設定すると、この列は結果に含まれません。

別名saveVarSpec
デフォルトTRUE

subBinOffset=double

ビンの先頭からのオフセットを指定します。値は正でビン幅以下でなければなりません。指定した値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID 変数とビンパラメータを指定しない限り無視されます。

subBinWidth=double

ビン内のサブビンの幅を指定します。例えば、ID変数の値が 0 から 100 までの範囲で、bin={5, 15}、subBinOffset=2、subBinWidth=5 を指定した場合、アクションは [-2, 3], [8, 13], [18, 23], ..., [98, 103] に分類される ID 変数値を持つオブザベーションだけを要約します。指定された値は正でなければならず、subBinOffset 値と subBinWidth 値の合計はビン幅以下でなければなりません。値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID変数とビンパラメータも指定しない限り無視されます。

最小値0

subInterval="string"

より小さい間隔を指定して、オブザベーションの集計のための各間隔内の時間間隔の配置を制御します。

別名subInt

* table={castable}

テーブル名、caslib、他の共通パラメータを指定します。

table パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。

varSpecs={{tkcasagg_varspecs-1} <, {tkcasagg_varspecs-2}, ...>}

集計する変数とアグリゲーターの設定を指定します。

tkcasagg_varspecs の値は次のいずれかになります:

agg="FIRST" | "FIRSTNOTEMPTY" | "LAST" | "LASTNOTEMPTY" | "MAXIMUM" | "MINIMUM" | "MODE" | "N" | "NDISTINCT" | "NMISS" | "NTOTAL" | "PERCENT" | "PERCENTILE" | "PGT" | "PLT" | "Q1" | "Q2" | "Q3" | "SUMMARY"

分析変数に適用するアグリゲーターを指定します。

FIRST

edgeId 変数の最小値を返します。

FIRSTNOTEMPTY

edgeId 変数の最小の non-empty 値を返します。

別名FNE
LAST

edgeId 変数の最大値を返します。

LASTNOTEMPTY

edgeId 変数の最大の non-empty 値を返します。

別名LNE
MAXIMUM

最大の非欠損値を返します。

別名MAX
MINIMUM

最小の非欠損値を返します。

別名MIN
MODE

最頻値を返します。k パラメータを指定すると、最頻値以上を返すことができます。

N

欠損値を除くオブザベーション数を返します。

NDISTINCT

重複しない値の数を返します。これは、出力形式を持つ文字変数と数値変数のデフォルトアグリゲーターです。

別名NDIST
NMISS

欠損値の数を返します。

NTOTAL

欠損値を含むオブザベーション数を返します。

別名NTTL
PERCENT

rpRange または pStrRange パラメータで指定された範囲内の値の割合を返します。

別名PIN
PCIN
PERCENTILE

percentiles パラメータで指定された統計量を返します。

PGT

pN または pStrN パラメータで指定されたしきい値を超える値のパーセントを戻します。

別名PCGT
PLT

pN または pStrL パラメータで指定されたしきい値よりも小さい値のパーセントを返します。

別名PCLT
Q1

25 パーセント点に最も近い値を返します。

Q2

50 パーセント点に最も近い値を返します。

別名MED
MEDIAN
Q3

75 パーセント点に最も近い値を返します。

SUMMARY

MIN、MAX、NOBS、MEAN、SUM、STD、STDERR、CV、NMISS、VAR、USS、CSS、TVALUE、PROBT、SKEWNESS、KURTOSIS を含む数値変数の要約統計量を返します。これは未加工の数値変数のデフォルトアグリゲーターです。

ciAlpha=double

100*(1-ciAlpha)% 信頼区間の有意水準を指定します。デフォルト値 0.05 の場合、95% の信頼区間になります。

デフォルト0.05
範囲(0, 1)
ciType="LOWER" | "TWOSIDED" | "UPPER"

信頼区間のタイプを指定します。

デフォルトTWOSIDED
LOWER

指定された信頼度で、真の母集団平均が存在すると予想される下限を使用するように指定します。

別名LEFT
TWOSIDED

指定された信頼度で、真の母集団平均が存在すると予想される両側信頼区間を使用するように指定します。

UPPER

指定された信頼度で、真の母集団平均が存在すると予想される上限を使用するように指定します。

別名RIGHT
columnNames={"string-1" <, "string-2", ...>}

結果に使用する置換列名を指定します。デフォルトでは、分析変数の名前は結果テーブルの列名として使用されます。

別名colName
colNames
要件指定した値は重複できません。
edgeId="variable-name"

分析変数の値を順序付けるために使用される数値変数を指定します。このパラメータは、FIRST、LAST、FNE、LNE アグリゲーターに適用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

exclnpwgt=TRUE | FALSE

True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

別名excludeNonPositiveWeight
デフォルトFALSE
format="string"

分析変数の一時出力形式を指定します。

formats={"string-1" <, "string-2", ...>}

分析変数の一時出力形式を指定します。

freq="variable-name"

値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠落値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

別名frequency
freqStrict=TRUE | FALSE

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と小数値が使用されます。欠損値はまだ除外されています。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

デフォルトTRUE
includeMissing=TRUE | FALSE

デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

別名includeMiss
incMissing
incMiss
デフォルトTRUE
k=integer

MODE アグリゲーターに対して収集する最も頻度の高いアイテムの数を指定します。

デフォルト1
範囲1–MACINT
missDbl=double

欠損値の置き換えに使用する数値を指定します。

missStr="string"

欠損値の置き換えに使用する文字値を指定します。

modeSingle=TRUE | FALSE

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

デフォルトFALSE
name="variable-name"

分析変数名を指定します。

別名var
names={"variable-name-1" <, "variable-name-2", ...>}

分析変数名を指定します。

別名vars
pctlDef=integer

UNIVARIATE プロシジャのドキュメントで説明されているように、分位統計 (パーセンタイル) を計算する方法を指定します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

範囲1–5
percentile={double-1 <, double-2, ...>}

アグリゲーターが PERCENTILE に設定されている場合に計算するパーセント点を指定します。

別名percentiles
pctl
pctls
要件指定した値は重複できません。
pN=double

数値変数の PGT と PLT アグリゲーターに数値しきい値を指定します。

pRange={double-1 <, double-2, ...>}

数値変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pRangeMin と pRangeMax の両方のパラメータを指定するのと同じです。

pRangeMax=double

数値変数の PIN アグリゲーターに包括的な最大値を指定します。

デフォルトMACBIG
pRangeMin=double

数値変数の PIN アグリゲーターに包括的な最小値を指定します。

デフォルト-MACBIG
pStrN="string"

文字変数の PGT と PLT アグリゲーターに文字しきい値を指定します。

pStrRange={"string-1" <, "string-2", ...>}

文字変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pStrRangeMin と pStrRangeMax の両方のパラメータを指定するのと同じです。

pStrRangeMax="string"

文字変数の PIN アグリゲーターに包括的な最大値を指定します。

pStrRangeMin="string"

文字変数の PIN アグリゲーターに包括的な最小値を指定します。

range={double-1 <, double-2, ...>}

集計で考慮する数値変数の包括的な最小値と最大値を指定します。これは、rangeMin と rangeMax の両方のパラメータを指定するのと同じです。

rangeMax=double

集計で考慮する数値変数の包括的な最小値を指定します。

デフォルトMACBIG
rangeMin=double

集計で考慮する数値変数の包括的な最小値を指定します。

デフォルト-MACBIG
strRange={"string-1" <, "string-2", ...>}

集計で考慮する文字変数の包括的な最小値と最大値を指定します。strRangeMin と strRangeMax の両方のパラメータを指定するのと同じです。

strRangeMax="string"

集計で考慮する文字変数の包括的な最大値を指定します。

strRangeMin="string"

集計で考慮する文字変数の包括的な最小値を指定します。

summarySubset={"CSS", "CV", "KURT", "KURTOSIS", "MAX", "MAXIMUM", "MEAN", "MIN", "MINIMUM", "N", "NMISS", "PROBT", "SKEW", "SKEWNESS", "STD", "STDERR", "SUM", "T", "TSTAT", "USS", "VAR"}

生成する要約統計量を指定します。デフォルトでは、要約統計量の列の順序は、指定した順序に関係なく、MIN, MAX, NOBS, MEAN, SUM, STD, STDERR, CV, NMISS, VAR, USS, CSS, TVALUE, PROBT, SKEWNESS, KURTOSIS です。列を特定の順序で返す場合は、columnNames パラメータを使用して各結果列の名前を指定します。

別名statistics
subSet
要件指定した値は重複できません。
weight="variable-name"

アグリゲーターが SUMMARY の場合、数値分析変数値の重みとして使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

weight="variable-name"

アグリゲーターが SUMMARY の場合の数値分析変数値の重みとして値が使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。

windowBin={double-1 <, double-2, ...>}

ウィンドウビンの最小値と最大数を指定します。仕様と概念はビンが間隔に適用される点を除いて、ビンパラメータに似ています。

windowInt="string"

各時間間隔に関するオブザベーションの累積のための時間ウィンドウを指定します。例えば、interval='MONTH' と windowInt='YEAR' を指定した場合、アクションは月次間隔で 1 年間のオブザベーションを要約します。

別名winInt
windowInterval

windowOffset=integer

各ウィンドウ間隔のオフセットを指定します。この効果は、オフセットパラメータが間隔パラメータの値にどのように影響するかに似ています。

別名windowIntOffset
winDif
winIntDif
winIntOff
windowIntervalOffset
デフォルト0

windowSubBinOffset=double

レコード値が集計されるウィンドウビン内の開始点を指定します。例えば、windowBin={0, 10} と windowSubBinOffset=2 を指定した場合、interval [0, 2) の ID 変数値を持つレコードは無視されます。指定された値は、ウィンドウのビン幅より大きくすることはできません。

別名winSubBinOffset

windowSubBinWidth=double

各 windowBin 内のサブビンの幅を指定します。許容可能な最小値は 0 で、ウィンドウは無効になります。例えば、windowBin={0, 10}、windowSubBinOffset=2、windowSubBinWidth=5 を指定した場合、intervals [0, 2) と [7, 10) の ID 変数値を持つレコードは無視されます。

別名winSubBinWidth
最小値0

windowSubInt="string"

このパラメータは、サブ間隔に似ています。より小さい間隔を指定して、オブザベーションの集計のための各ウィンドウ間隔内のサブ時間間隔の配置を制御することができます。

別名winSubInterval
winSubInt
windowSubInterval

aggregate アクション

選択した変数の集計を実行します。

選択した列のデータを集計
選択した列のデータをグループ別に集計
選択した列のデータを日付間隔で集計
ローリングウィンドウ集計の実行

Lua 構文

results, info = s:aggregation_aggregate{
bin={double-1 <, double-2, ...>},
casOut={
caslib="string",
compress=true | false,
indexVars={"variable-name-1" <, "variable-name-2", ...>},
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
onDemand=true | false,
promote=true | false,
replace=true | false,
replication=integer,
threadBlockSize=64-bit-integer,
timeStamp="string",
where={"string-1" <, "string-2", ...>}
},
contribute="variable-name",
contributeTrim=true | false,
contributeUnroll=true | false,
copyVars={"variable-name-1" <, "variable-name-2", ...>},
doESP=true | false,
edgeId="variable-name",
exclnpwgt=true | false,
excludeSelf=true | false,
freq="variable-name",
freqStrict=true | false,
groupByLimit=64-bit-integer,
groupedIntervalOutput=true | false,
id="variable-name",
idEnd=double,
idOutputName="string",
idRange={double-1 <, double-2, ...>},
idStart=double,
includeEmptyInterval=true | false,
includeMissing=true | false,
inputs={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
interval="string",
jumpingWindow=true | false,
keepRecord=true | false,
keepRecordId=true | false,
modeSingle=true | false,
offset=integer,
partKey={"string-1" <, "string-2", ...>},
pctlDef=integer,
pti=double,
ptw=double,
raw=true | false,
saveGroupbyFormat=true | false,
saveGroupbyRaw=true | false,
saveVariableColumn=true | false,
subBinOffset=double,
subBinWidth=double,
subInterval="string",
required parameter table={
caslib="string",
computedOnDemand=true | false,
computedVars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
computedVarsProgram="string",
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
groupBy={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
groupByMode="NOSORT" | "REDISTRIBUTE",
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
onDemand=true | false,
orderBy={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
singlePass=true | false,
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
varSpecs={{
ciAlpha=double,
columnNames={"string-1" <, "string-2", ...>},
edgeId="variable-name",
exclnpwgt=true | false,
format="string",
formats={"string-1" <, "string-2", ...>},
freq="variable-name",
freqStrict=true | false,
includeMissing=true | false,
k=integer,
missDbl=double,
missStr="string",
modeSingle=true | false,
name="variable-name",
names={"variable-name-1" <, "variable-name-2", ...>},
pctlDef=integer,
percentile={double-1 <, double-2, ...>},
pN=double,
pRange={double-1 <, double-2, ...>},
pRangeMax=double,
pRangeMin=double,
pStrN="string",
pStrRange={"string-1" <, "string-2", ...>},
pStrRangeMax="string",
pStrRangeMin="string",
range={double-1 <, double-2, ...>},
rangeMax=double,
rangeMin=double,
strRange={"string-1" <, "string-2", ...>},
strRangeMax="string",
strRangeMin="string",
summarySubset={"CSS", "CV", "KURT", "KURTOSIS", "MAX", "MAXIMUM", "MEAN", "MIN", "MINIMUM", "N", "NMISS", "PROBT", "SKEW", "SKEWNESS", "STD", "STDERR", "SUM", "T", "TSTAT", "USS", "VAR"},
weight="variable-name"
}, {...}},
weight="variable-name",
windowBin={double-1 <, double-2, ...>},
windowInt="string",
windowOffset=integer,
windowSubInt="string"
}
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

テーブル名、caslib、他の共通パラメータを指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 casOut

—

出力テーブルの設定を指定します。

パラメーターの説明

align="BEGINNING" | "ENDING" | "MIDDLE"

間隔またはビン対する代表値の配置を指定します。

BEGINNING

間隔またはビンの先頭に配置することを指定します。例えば、月の最初の日は間隔の先頭です。

別名B
BEG
LEFT
ENDING

間隔またはビンの最後の値に整列することを指定します。

別名E
END
RIGHT
MIDDLE

間隔またはビンの中央に配置することを指定します。

別名M
MID

bin={double-1 <, double-2, ...>}

sビンの最小および最大値を指定します。例えば、ID 変数の値が 0 から 100 までの範囲で、bin = {5, 15} を指定した場合、アクションは 11 個のビンを持つ時系列を構築します。最初のビンは [-5, 5] で、最後のビンは [95, 105] です。ビンの上限の境界の値は、このビンに属します。ビンの下限の境界の値は、隣接する下のビンに属します。このパラメータは、ID 変数も指定しない限り無視されます。

casOut={casouttable}

出力テーブルの設定を指定します。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

contribute="variable-name"

doESP パラメータが True の場合、各集計間隔内の値が記録されている変数を指定できます。この値は、集計された間隔に対する各行の寄与を理解するために、元のテーブルと結合するためのキーとして使用できます。

contributeColumnLabel="string"

寄与変数から変数ラベルを上書きする値を指定します。デフォルトでは、寄与変数のラベルが結果に表示されます。

contributeColumnName="string"

寄与変数から変数名を上書きする値を指定します。デフォルトでは、寄与変数の名前が結果に表示されます。

contributeDelimiter="string"

寄与変数の連結値間で使用される区切り文字を指定します。

別名delimiter
デフォルト","

contributeTrim=true | false

True に設定すると、寄与変数のフォーマットされた値から先頭と末尾の空白が削除されます。contributionUnroll パラメータが True に設定されている場合、このパラメータは無視されます。

デフォルトfalse

contributeUnroll=true | false

デフォルトでは、contrib 変数のフォーマットされた値は、結果テーブルに対して 1 つの行に連結されます。True に設定すると、contrib 変数の各未加工値が結果テーブルに行を追加します。

別名unroll
デフォルトfalse

copyVars={"variable-name-1" <, "variable-name-2", ...>}

入力テーブルから出力テーブルにコピーする変数を指定します。未加工値は出力に保持されます。入力テーブルに groupBy パラメータも指定しないかぎり、このパラメータは無視されます。1 つのグループに複数のレコードが存在する場合、最小の未加工値がコピーされます。

別名copyVar

doESP=true | false

True に設定すると、アクションは入力テーブルのパーティション分割と並べ替えを利用できます。入力テーブルの groupBy パラメータを指定する必要があります。ID 変数は、最後の groupBy パラメータと orderBy パラメータで指定する必要があります。このパラメータを True に設定すると、keepRecord パラメータを True に設定されます。False (デフォルト値) に設定すると、keepRecordId、excludeSelf、contribute、contributeColumnName、contributeTrim、contributeDelimiter、contributeUnroll の各パラメータは無視されます。

別名partAndOrder
デフォルトfalse

edgeId="variable-name"

FIRST、LAST、FNE、LNE アグリゲーターを使用する各 varSpecs 仕様の値を順序付けるために使用される数値変数を指定します。このパラメータは、edgeId サブパラメータを含む varSpecs 仕様でオーバーライドできます。

exclnpwgt=true | false

True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。

別名excludeNonPositiveWeight
デフォルトfalse

excludeSelf=true | false

True に設定され、doESP パラメータが True の場合、集計は現在のオブザベーションの寄与を除外します。

デフォルトfalse

freq="variable-name"

値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠損値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。

別名frequency

freqStrict=true | false

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と10進値が使用されます。欠損値はまだ除外されています。

デフォルトtrue

groupByLimit=64-bit-integer

Group-by セットのレベルの最大数を指定します。サーバーがこのレベル数を測定すると、サーバーは停止し結果を返しません。Group-by 操作で大規模な結果セットが作成されないようにするには、このパラメータを指定します。

最小値1

groupedIntervalOutput=true | false

True に設定すると、最後の ID 値に関する同じ集計間隔の 1 つだけを保存します。'doESP' が False に設定されている場合、このオプションは無視されます。

デフォルトfalse

id="variable-name"

入力テーブル内の各オブザベーションに関連付けられているタイムスタンプを識別する数値変数を指定します。値は、通常SAS DATE、TIME、DATETIME の値ですが、必須ではありません。指定した変数は、入力テーブルの groupBy パラメータでも指定する必要があります。

idEnd=double

分析で考慮する ID 変数の包括的な最大値を指定します。 ID 変数の最大値が idEnd 値より小さい場合、系列は欠損値で拡張されます。最後の ID 変数の値が idEnd の値より大きい場合、系列は切り捨てられます。このパラメータは、ID変数も指定しない限り無視されます。

idOutputName="string"

出力テーブルの ID 変数の新しい名前を指定します。

idRange={double-1 <, double-2, ...>}

分析で考慮する ID 変数の包括的な最小値と最大値を指定します。これは、idStart と idEnd の両方を指定することと同じです。

idStart=double

分析で考慮する ID 変数の包括的な最小値を指定します。ID 変数の最小値が idStart 値より大きい場合、系列には欠損値の接頭辞が付加されます。最初の ID 変数の値が idStart の値より小さい場合、系列は切り捨てられます。このパラメータは、ID 変数も指定しない限り無視されます。

includeEmptyInterval=true | false

デフォルトでは、ID 変数の値が欠落している間隔が出力に含まれます。False に設定すると、これらの間隔は出力から除外されます。

別名includeMissInterval
includeMissingInterval
デフォルトtrue

includeMissing=true | false

デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。

別名includeMiss
incMissing
incMiss
デフォルトtrue

inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}

分析に使用する入力変数を指定します。未加工の数値変数の場合、デフォルトのアグリゲーターは SUMMARY です。その他の状況では、デフォルトのアグリゲーターは N です。このパラメータに変数を指定するか、varSpecs パラメータを指定してより多くの制御を行うことはできますが、両方を使用することはできません。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名input

interval="string"

オブザベーションの累積時間を指定します。例えば、interval='MONTH' を指定すると、アクションは月次間隔でオブザベーションを要約します。このパラメータは、ID 変数も指定しない限り無視されます。

jumpingWindow=true | false

True に設定すると、複数の間隔を含むことができるタイムウィンドウで集計が行われ、指定された時間範囲が経過すると集計がリセットされることを指定します。デフォルトでは、ウィンドウは常に同じ複数の間隔を保持します。

別名tumblingWindow
デフォルトfalse

keepRecord=true | false

True に設定すると、ID 変数の各オブザベーションの元の値は間隔の配置を行わずに保持されます。

デフォルトfalse

keepRecordId=true | false

True に設定され、doESP パラメータが True の場合、各オブザベーションの元の ID 値は間隔の配置を実行せずに保持されます。

デフォルトfalse

modeSingle=true | false

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。

デフォルトfalse

offset=integer

各間隔のオフセットを指定します。offset=-1 を指定すると、データセットから派生したすべての間隔は 1 つ後方にシフトされます。例えば、3月1日のタイムスタンプ値は、2月1日になるようにデータセットから取得されます。

別名intOffset
dif
intDif
intOff
デフォルト0

partKey={"string-1" <, "string-2", ...>}

テーブルがパーティション化され、partition パラメータを指定する場合は、パーティションのみの結果が計算されるようにパーティションキーを指定することができます。

pctlDef=integer

UNIVARIATE プロシジャのドキュメントで説明されているように、分位点統計量 (パーセンタイル) を計算する方法を指定します。

デフォルト5
範囲1–5

pti=double

間隔またはビン内の集計が終了したときの時間値を指定します。例えば、interval='MONTH' と partialToInterval='10FEB98'd を指定した場合、アクションは各月の最初の10日間のレコードのみを集計します。

別名ptd
partialToDate
partialToInterval
デフォルト0
最小値0

ptw=double

各ウィンドウ間隔に関するサブ間隔を指定します。例えば、windowInterval='MONTH' と partialToWindow='08FEB98'd を指定した場合、各年のウィンドウ間隔 2月、...、12月の集計時に、アクションは 1月から最初の 8日間、2月から最初の 8日間だけをカウントします。このパラメータは、開始時間がスライディングウィンドウ (非ジャンプウィンドウ) によって異なるため、jumpingWindow パラメータも指定しない限り無視されます。

別名partialToWindow
デフォルト0
最小値0

raw=true | false

True に設定すると、入力パラメータの変数の未加工値が使用されます。

デフォルトfalse

saveGroupbyFormat=true | false

デフォルトでは、groupBy 変数のフォーマットされた値が入力テーブルから結果にコピーされます。False に設定すると、フォーマットされた値はコピーされません。

別名saveGbyFmt
デフォルトtrue

saveGroupbyRaw=true | false

デフォルトでは、groupBy 変数の未加工値が入力テーブルから結果にコピーされます。False に設定すると、未加工値はコピーされません。

別名saveGbyRaw
デフォルトtrue

saveVariableColumn=true | false

デフォルトでは、各分析変数の変数名が結果に含まれます。結果テーブルには、'Column' という名前の列に名前が含まれています。False に設定すると、この列は結果に含まれません。

別名saveVarCol
デフォルトtrue

saveVariableSpecification=true | false

デフォルトでは、結果には、'Variable Specification' という名前の列が含まれ、結果を生成した varSpecs 指定を識別します。False に設定すると、この列は結果に含まれません。

別名saveVarSpec
デフォルトtrue

subBinOffset=double

ビンの先頭からのオフセットを指定します。値は正でビン幅以下でなければなりません。指定した値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID 変数とビンパラメータを指定しない限り無視されます。

subBinWidth=double

ビン内のサブビンの幅を指定します。例えば、ID変数の値が 0 から 100 までの範囲で、bin={5, 15}、subBinOffset=2、subBinWidth=5 を指定した場合、アクションは [-2, 3], [8, 13], [18, 23], ..., [98, 103] に分類される ID 変数値を持つオブザベーションだけを要約します。指定された値は正でなければならず、subBinOffset 値と subBinWidth 値の合計はビン幅以下でなければなりません。値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID変数とビンパラメータも指定しない限り無視されます。

最小値0

subInterval="string"

より小さい間隔を指定して、オブザベーションの集計のための各間隔内の時間間隔の配置を制御します。

別名subInt

* table={castable}

テーブル名、caslib、他の共通パラメータを指定します。

table パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。

varSpecs={{tkcasagg_varspecs-1} <, {tkcasagg_varspecs-2}, ...>}

集計する変数とアグリゲーターの設定を指定します。

tkcasagg_varspecs の値は次のいずれかになります:

agg="FIRST" | "FIRSTNOTEMPTY" | "LAST" | "LASTNOTEMPTY" | "MAXIMUM" | "MINIMUM" | "MODE" | "N" | "NDISTINCT" | "NMISS" | "NTOTAL" | "PERCENT" | "PERCENTILE" | "PGT" | "PLT" | "Q1" | "Q2" | "Q3" | "SUMMARY"

分析変数に適用するアグリゲーターを指定します。

FIRST

edgeId 変数の最小値を返します。

FIRSTNOTEMPTY

edgeId 変数の最小の non-empty 値を返します。

別名FNE
LAST

edgeId 変数の最大値を返します。

LASTNOTEMPTY

edgeId 変数の最大の non-empty 値を返します。

別名LNE
MAXIMUM

最大の非欠損値を返します。

別名MAX
MINIMUM

最小の非欠損値を返します。

別名MIN
MODE

最頻値を返します。k パラメータを指定すると、最頻値以上を返すことができます。

N

欠損値を除くオブザベーション数を返します。

NDISTINCT

重複しない値の数を返します。これは、出力形式を持つ文字変数と数値変数のデフォルトアグリゲーターです。

別名NDIST
NMISS

欠損値の数を返します。

NTOTAL

欠損値を含むオブザベーション数を返します。

別名NTTL
PERCENT

rpRange または pStrRange パラメータで指定された範囲内の値の割合を返します。

別名PIN
PCIN
PERCENTILE

percentiles パラメータで指定された統計量を返します。

PGT

pN または pStrN パラメータで指定されたしきい値を超える値のパーセントを戻します。

別名PCGT
PLT

pN または pStrL パラメータで指定されたしきい値よりも小さい値のパーセントを返します。

別名PCLT
Q1

25 パーセント点に最も近い値を返します。

Q2

50 パーセント点に最も近い値を返します。

別名MED
MEDIAN
Q3

75 パーセント点に最も近い値を返します。

SUMMARY

MIN、MAX、NOBS、MEAN、SUM、STD、STDERR、CV、NMISS、VAR、USS、CSS、TVALUE、PROBT、SKEWNESS、KURTOSIS を含む数値変数の要約統計量を返します。これは未加工の数値変数のデフォルトアグリゲーターです。

ciAlpha=double

100*(1-ciAlpha)% 信頼区間の有意水準を指定します。デフォルト値 0.05 の場合、95% の信頼区間になります。

デフォルト0.05
範囲(0, 1)
ciType="LOWER" | "TWOSIDED" | "UPPER"

信頼区間のタイプを指定します。

デフォルトTWOSIDED
LOWER

指定された信頼度で、真の母集団平均が存在すると予想される下限を使用するように指定します。

別名LEFT
TWOSIDED

指定された信頼度で、真の母集団平均が存在すると予想される両側信頼区間を使用するように指定します。

UPPER

指定された信頼度で、真の母集団平均が存在すると予想される上限を使用するように指定します。

別名RIGHT
columnNames={"string-1" <, "string-2", ...>}

結果に使用する置換列名を指定します。デフォルトでは、分析変数の名前は結果テーブルの列名として使用されます。

別名colName
colNames
要件指定した値は重複できません。
edgeId="variable-name"

分析変数の値を順序付けるために使用される数値変数を指定します。このパラメータは、FIRST、LAST、FNE、LNE アグリゲーターに適用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

exclnpwgt=true | false

True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

別名excludeNonPositiveWeight
デフォルトfalse
format="string"

分析変数の一時出力形式を指定します。

formats={"string-1" <, "string-2", ...>}

分析変数の一時出力形式を指定します。

freq="variable-name"

値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠落値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

別名frequency
freqStrict=true | false

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と小数値が使用されます。欠損値はまだ除外されています。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

デフォルトtrue
includeMissing=true | false

デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

別名includeMiss
incMissing
incMiss
デフォルトtrue
k=integer

MODE アグリゲーターに対して収集する最も頻度の高いアイテムの数を指定します。

デフォルト1
範囲1–MACINT
missDbl=double

欠損値の置き換えに使用する数値を指定します。

missStr="string"

欠損値の置き換えに使用する文字値を指定します。

modeSingle=true | false

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

デフォルトfalse
name="variable-name"

分析変数名を指定します。

別名var
names={"variable-name-1" <, "variable-name-2", ...>}

分析変数名を指定します。

別名vars
pctlDef=integer

UNIVARIATE プロシジャのドキュメントで説明されているように、分位統計 (パーセンタイル) を計算する方法を指定します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

範囲1–5
percentile={double-1 <, double-2, ...>}

アグリゲーターが PERCENTILE に設定されている場合に計算するパーセント点を指定します。

別名percentiles
pctl
pctls
要件指定した値は重複できません。
pN=double

数値変数の PGT と PLT アグリゲーターに数値しきい値を指定します。

pRange={double-1 <, double-2, ...>}

数値変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pRangeMin と pRangeMax の両方のパラメータを指定するのと同じです。

pRangeMax=double

数値変数の PIN アグリゲーターに包括的な最大値を指定します。

デフォルトMACBIG
pRangeMin=double

数値変数の PIN アグリゲーターに包括的な最小値を指定します。

デフォルト-MACBIG
pStrN="string"

文字変数の PGT と PLT アグリゲーターに文字しきい値を指定します。

pStrRange={"string-1" <, "string-2", ...>}

文字変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pStrRangeMin と pStrRangeMax の両方のパラメータを指定するのと同じです。

pStrRangeMax="string"

文字変数の PIN アグリゲーターに包括的な最大値を指定します。

pStrRangeMin="string"

文字変数の PIN アグリゲーターに包括的な最小値を指定します。

range={double-1 <, double-2, ...>}

集計で考慮する数値変数の包括的な最小値と最大値を指定します。これは、rangeMin と rangeMax の両方のパラメータを指定するのと同じです。

rangeMax=double

集計で考慮する数値変数の包括的な最小値を指定します。

デフォルトMACBIG
rangeMin=double

集計で考慮する数値変数の包括的な最小値を指定します。

デフォルト-MACBIG
strRange={"string-1" <, "string-2", ...>}

集計で考慮する文字変数の包括的な最小値と最大値を指定します。strRangeMin と strRangeMax の両方のパラメータを指定するのと同じです。

strRangeMax="string"

集計で考慮する文字変数の包括的な最大値を指定します。

strRangeMin="string"

集計で考慮する文字変数の包括的な最小値を指定します。

summarySubset={"CSS", "CV", "KURT", "KURTOSIS", "MAX", "MAXIMUM", "MEAN", "MIN", "MINIMUM", "N", "NMISS", "PROBT", "SKEW", "SKEWNESS", "STD", "STDERR", "SUM", "T", "TSTAT", "USS", "VAR"}

生成する要約統計量を指定します。デフォルトでは、要約統計量の列の順序は、指定した順序に関係なく、MIN, MAX, NOBS, MEAN, SUM, STD, STDERR, CV, NMISS, VAR, USS, CSS, TVALUE, PROBT, SKEWNESS, KURTOSIS です。列を特定の順序で返す場合は、columnNames パラメータを使用して各結果列の名前を指定します。

別名statistics
subSet
要件指定した値は重複できません。
weight="variable-name"

アグリゲーターが SUMMARY の場合、数値分析変数値の重みとして使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

weight="variable-name"

アグリゲーターが SUMMARY の場合の数値分析変数値の重みとして値が使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。

windowBin={double-1 <, double-2, ...>}

ウィンドウビンの最小値と最大数を指定します。仕様と概念はビンが間隔に適用される点を除いて、ビンパラメータに似ています。

windowInt="string"

各時間間隔に関するオブザベーションの累積のための時間ウィンドウを指定します。例えば、interval='MONTH' と windowInt='YEAR' を指定した場合、アクションは月次間隔で 1 年間のオブザベーションを要約します。

別名winInt
windowInterval

windowOffset=integer

各ウィンドウ間隔のオフセットを指定します。この効果は、オフセットパラメータが間隔パラメータの値にどのように影響するかに似ています。

別名windowIntOffset
winDif
winIntDif
winIntOff
windowIntervalOffset
デフォルト0

windowSubBinOffset=double

レコード値が集計されるウィンドウビン内の開始点を指定します。例えば、windowBin={0, 10} と windowSubBinOffset=2 を指定した場合、interval [0, 2) の ID 変数値を持つレコードは無視されます。指定された値は、ウィンドウのビン幅より大きくすることはできません。

別名winSubBinOffset

windowSubBinWidth=double

各 windowBin 内のサブビンの幅を指定します。許容可能な最小値は 0 で、ウィンドウは無効になります。例えば、windowBin={0, 10}、windowSubBinOffset=2、windowSubBinWidth=5 を指定した場合、intervals [0, 2) と [7, 10) の ID 変数値を持つレコードは無視されます。

別名winSubBinWidth
最小値0

windowSubInt="string"

このパラメータは、サブ間隔に似ています。より小さい間隔を指定して、オブザベーションの集計のための各ウィンドウ間隔内のサブ時間間隔の配置を制御することができます。

別名winSubInterval
winSubInt
windowSubInterval

aggregate アクション

選択した変数の集計を実行します。

選択した列のデータを集計
選択した列のデータをグループ別に集計
選択した列のデータを日付間隔で集計
ローリングウィンドウ集計の実行

Python 構文

results= s.aggregation.aggregate(
bin=[double-1 <, double-2, ...>],
casOut={
"caslib":"string",
"compress":True | False,
"indexVars":["variable-name-1" <, "variable-name-2", ...>],
"label":"string",
"lifetime":64-bit-integer,
"maxMemSize":64-bit-integer,
"memoryFormat":"DVR" | "INHERIT" | "STANDARD",
"name":"table-name",
"onDemand":True | False,
"promote":True | False,
"replace":True | False,
"replication":integer,
"threadBlockSize":64-bit-integer,
"timeStamp":"string",
"where":["string-1" <, "string-2", ...>]
},
contribute="variable-name",
contributeTrim=True | False,
contributeUnroll=True | False,
copyVars=["variable-name-1" <, "variable-name-2", ...>],
doESP=True | False,
edgeId="variable-name",
exclnpwgt=True | False,
excludeSelf=True | False,
freq="variable-name",
freqStrict=True | False,
groupByLimit=64-bit-integer,
groupedIntervalOutput=True | False,
id="variable-name",
idEnd=double,
idOutputName="string",
idRange=[double-1 <, double-2, ...>],
idStart=double,
includeEmptyInterval=True | False,
includeMissing=True | False,
inputs=[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
interval="string",
jumpingWindow=True | False,
keepRecord=True | False,
keepRecordId=True | False,
modeSingle=True | False,
offset=integer,
partKey=["string-1" <, "string-2", ...>],
pctlDef=integer,
pti=double,
ptw=double,
raw=True | False,
saveGroupbyFormat=True | False,
saveGroupbyRaw=True | False,
saveVariableColumn=True | False,
subBinOffset=double,
subBinWidth=double,
subInterval="string",
required parameter table={
"caslib":"string",
"computedOnDemand":True | False,
"computedVars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"computedVarsProgram":"string",
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>},
"groupBy":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"groupByMode":"NOSORT" | "REDISTRIBUTE",
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter "name":"table-name",
"onDemand":True | False,
"orderBy":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"singlePass":True | False,
"vars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"where":"where-expression",
"whereTable":{
"casLib":"string"
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter "name":"table-name"
"vars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>]
"where":"where-expression"
}
},
varSpecs=[{
"ciAlpha":double,
"columnNames":["string-1" <, "string-2", ...>],
"edgeId":"variable-name",
"exclnpwgt":True | False,
"format":"string",
"formats":["string-1" <, "string-2", ...>],
"freq":"variable-name",
"freqStrict":True | False,
"includeMissing":True | False,
"k":integer,
"missDbl":double,
"missStr":"string",
"modeSingle":True | False,
"name":"variable-name",
"names":["variable-name-1" <, "variable-name-2", ...>],
"pctlDef":integer,
"percentile":[double-1 <, double-2, ...>],
"pN":double,
"pRange":[double-1 <, double-2, ...>],
"pRangeMax":double,
"pRangeMin":double,
"pStrN":"string",
"pStrRange":["string-1" <, "string-2", ...>],
"pStrRangeMax":"string",
"pStrRangeMin":"string",
"range":[double-1 <, double-2, ...>],
"rangeMax":double,
"rangeMin":double,
"strRange":["string-1" <, "string-2", ...>],
"strRangeMax":"string",
"strRangeMin":"string",
"summarySubset":["CSS", "CV", "KURT", "KURTOSIS", "MAX", "MAXIMUM", "MEAN", "MIN", "MINIMUM", "N", "NMISS", "PROBT", "SKEW", "SKEWNESS", "STD", "STDERR", "SUM", "T", "TSTAT", "USS", "VAR"],
"weight":"variable-name"
}<, {...}>],
weight="variable-name",
windowBin=[double-1 <, double-2, ...>],
windowInt="string",
windowOffset=integer,
windowSubInt="string"
)
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

テーブル名、caslib、他の共通パラメータを指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 casOut

—

出力テーブルの設定を指定します。

パラメーターの説明

align="BEGINNING" | "ENDING" | "MIDDLE"

間隔またはビン対する代表値の配置を指定します。

BEGINNING

間隔またはビンの先頭に配置することを指定します。例えば、月の最初の日は間隔の先頭です。

別名B
BEG
LEFT
ENDING

間隔またはビンの最後の値に整列することを指定します。

別名E
END
RIGHT
MIDDLE

間隔またはビンの中央に配置することを指定します。

別名M
MID

bin=[double-1 <, double-2, ...>]

sビンの最小および最大値を指定します。例えば、ID 変数の値が 0 から 100 までの範囲で、bin = {5, 15} を指定した場合、アクションは 11 個のビンを持つ時系列を構築します。最初のビンは [-5, 5] で、最後のビンは [95, 105] です。ビンの上限の境界の値は、このビンに属します。ビンの下限の境界の値は、隣接する下のビンに属します。このパラメータは、ID 変数も指定しない限り無視されます。

casOut={casouttable}

出力テーブルの設定を指定します。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

contribute="variable-name"

doESP パラメータが True の場合、各集計間隔内の値が記録されている変数を指定できます。この値は、集計された間隔に対する各行の寄与を理解するために、元のテーブルと結合するためのキーとして使用できます。

contributeColumnLabel="string"

寄与変数から変数ラベルを上書きする値を指定します。デフォルトでは、寄与変数のラベルが結果に表示されます。

contributeColumnName="string"

寄与変数から変数名を上書きする値を指定します。デフォルトでは、寄与変数の名前が結果に表示されます。

contributeDelimiter="string"

寄与変数の連結値間で使用される区切り文字を指定します。

別名delimiter
デフォルト","

contributeTrim=True | False

True に設定すると、寄与変数のフォーマットされた値から先頭と末尾の空白が削除されます。contributionUnroll パラメータが True に設定されている場合、このパラメータは無視されます。

デフォルトFalse

contributeUnroll=True | False

デフォルトでは、contrib 変数のフォーマットされた値は、結果テーブルに対して 1 つの行に連結されます。True に設定すると、contrib 変数の各未加工値が結果テーブルに行を追加します。

別名unroll
デフォルトFalse

copyVars=["variable-name-1" <, "variable-name-2", ...>]

入力テーブルから出力テーブルにコピーする変数を指定します。未加工値は出力に保持されます。入力テーブルに groupBy パラメータも指定しないかぎり、このパラメータは無視されます。1 つのグループに複数のレコードが存在する場合、最小の未加工値がコピーされます。

別名copyVar

doESP=True | False

True に設定すると、アクションは入力テーブルのパーティション分割と並べ替えを利用できます。入力テーブルの groupBy パラメータを指定する必要があります。ID 変数は、最後の groupBy パラメータと orderBy パラメータで指定する必要があります。このパラメータを True に設定すると、keepRecord パラメータを True に設定されます。False (デフォルト値) に設定すると、keepRecordId、excludeSelf、contribute、contributeColumnName、contributeTrim、contributeDelimiter、contributeUnroll の各パラメータは無視されます。

別名partAndOrder
デフォルトFalse

edgeId="variable-name"

FIRST、LAST、FNE、LNE アグリゲーターを使用する各 varSpecs 仕様の値を順序付けるために使用される数値変数を指定します。このパラメータは、edgeId サブパラメータを含む varSpecs 仕様でオーバーライドできます。

exclnpwgt=True | False

True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。

別名excludeNonPositiveWeight
デフォルトFalse

excludeSelf=True | False

True に設定され、doESP パラメータが True の場合、集計は現在のオブザベーションの寄与を除外します。

デフォルトFalse

freq="variable-name"

値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠損値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。

別名frequency

freqStrict=True | False

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と10進値が使用されます。欠損値はまだ除外されています。

デフォルトTrue

groupByLimit=64-bit-integer

Group-by セットのレベルの最大数を指定します。サーバーがこのレベル数を測定すると、サーバーは停止し結果を返しません。Group-by 操作で大規模な結果セットが作成されないようにするには、このパラメータを指定します。

最小値1

groupedIntervalOutput=True | False

True に設定すると、最後の ID 値に関する同じ集計間隔の 1 つだけを保存します。'doESP' が False に設定されている場合、このオプションは無視されます。

デフォルトFalse

id="variable-name"

入力テーブル内の各オブザベーションに関連付けられているタイムスタンプを識別する数値変数を指定します。値は、通常SAS DATE、TIME、DATETIME の値ですが、必須ではありません。指定した変数は、入力テーブルの groupBy パラメータでも指定する必要があります。

idEnd=double

分析で考慮する ID 変数の包括的な最大値を指定します。 ID 変数の最大値が idEnd 値より小さい場合、系列は欠損値で拡張されます。最後の ID 変数の値が idEnd の値より大きい場合、系列は切り捨てられます。このパラメータは、ID変数も指定しない限り無視されます。

idOutputName="string"

出力テーブルの ID 変数の新しい名前を指定します。

idRange=[double-1 <, double-2, ...>]

分析で考慮する ID 変数の包括的な最小値と最大値を指定します。これは、idStart と idEnd の両方を指定することと同じです。

idStart=double

分析で考慮する ID 変数の包括的な最小値を指定します。ID 変数の最小値が idStart 値より大きい場合、系列には欠損値の接頭辞が付加されます。最初の ID 変数の値が idStart の値より小さい場合、系列は切り捨てられます。このパラメータは、ID 変数も指定しない限り無視されます。

includeEmptyInterval=True | False

デフォルトでは、ID 変数の値が欠落している間隔が出力に含まれます。False に設定すると、これらの間隔は出力から除外されます。

別名includeMissInterval
includeMissingInterval
デフォルトTrue

includeMissing=True | False

デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。

別名includeMiss
incMissing
incMiss
デフォルトTrue

inputs=[{casinvardesc-1} <, {casinvardesc-2}, ...>]

分析に使用する入力変数を指定します。未加工の数値変数の場合、デフォルトのアグリゲーターは SUMMARY です。その他の状況では、デフォルトのアグリゲーターは N です。このパラメータに変数を指定するか、varSpecs パラメータを指定してより多くの制御を行うことはできますが、両方を使用することはできません。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名input

interval="string"

オブザベーションの累積時間を指定します。例えば、interval='MONTH' を指定すると、アクションは月次間隔でオブザベーションを要約します。このパラメータは、ID 変数も指定しない限り無視されます。

jumpingWindow=True | False

True に設定すると、複数の間隔を含むことができるタイムウィンドウで集計が行われ、指定された時間範囲が経過すると集計がリセットされることを指定します。デフォルトでは、ウィンドウは常に同じ複数の間隔を保持します。

別名tumblingWindow
デフォルトFalse

keepRecord=True | False

True に設定すると、ID 変数の各オブザベーションの元の値は間隔の配置を行わずに保持されます。

デフォルトFalse

keepRecordId=True | False

True に設定され、doESP パラメータが True の場合、各オブザベーションの元の ID 値は間隔の配置を実行せずに保持されます。

デフォルトFalse

modeSingle=True | False

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。

デフォルトFalse

offset=integer

各間隔のオフセットを指定します。offset=-1 を指定すると、データセットから派生したすべての間隔は 1 つ後方にシフトされます。例えば、3月1日のタイムスタンプ値は、2月1日になるようにデータセットから取得されます。

別名intOffset
dif
intDif
intOff
デフォルト0

partKey=["string-1" <, "string-2", ...>]

テーブルがパーティション化され、partition パラメータを指定する場合は、パーティションのみの結果が計算されるようにパーティションキーを指定することができます。

pctlDef=integer

UNIVARIATE プロシジャのドキュメントで説明されているように、分位点統計量 (パーセンタイル) を計算する方法を指定します。

デフォルト5
範囲1–5

pti=double

間隔またはビン内の集計が終了したときの時間値を指定します。例えば、interval='MONTH' と partialToInterval='10FEB98'd を指定した場合、アクションは各月の最初の10日間のレコードのみを集計します。

別名ptd
partialToDate
partialToInterval
デフォルト0
最小値0

ptw=double

各ウィンドウ間隔に関するサブ間隔を指定します。例えば、windowInterval='MONTH' と partialToWindow='08FEB98'd を指定した場合、各年のウィンドウ間隔 2月、...、12月の集計時に、アクションは 1月から最初の 8日間、2月から最初の 8日間だけをカウントします。このパラメータは、開始時間がスライディングウィンドウ (非ジャンプウィンドウ) によって異なるため、jumpingWindow パラメータも指定しない限り無視されます。

別名partialToWindow
デフォルト0
最小値0

raw=True | False

True に設定すると、入力パラメータの変数の未加工値が使用されます。

デフォルトFalse

saveGroupbyFormat=True | False

デフォルトでは、groupBy 変数のフォーマットされた値が入力テーブルから結果にコピーされます。False に設定すると、フォーマットされた値はコピーされません。

別名saveGbyFmt
デフォルトTrue

saveGroupbyRaw=True | False

デフォルトでは、groupBy 変数の未加工値が入力テーブルから結果にコピーされます。False に設定すると、未加工値はコピーされません。

別名saveGbyRaw
デフォルトTrue

saveVariableColumn=True | False

デフォルトでは、各分析変数の変数名が結果に含まれます。結果テーブルには、'Column' という名前の列に名前が含まれています。False に設定すると、この列は結果に含まれません。

別名saveVarCol
デフォルトTrue

saveVariableSpecification=True | False

デフォルトでは、結果には、'Variable Specification' という名前の列が含まれ、結果を生成した varSpecs 指定を識別します。False に設定すると、この列は結果に含まれません。

別名saveVarSpec
デフォルトTrue

subBinOffset=double

ビンの先頭からのオフセットを指定します。値は正でビン幅以下でなければなりません。指定した値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID 変数とビンパラメータを指定しない限り無視されます。

subBinWidth=double

ビン内のサブビンの幅を指定します。例えば、ID変数の値が 0 から 100 までの範囲で、bin={5, 15}、subBinOffset=2、subBinWidth=5 を指定した場合、アクションは [-2, 3], [8, 13], [18, 23], ..., [98, 103] に分類される ID 変数値を持つオブザベーションだけを要約します。指定された値は正でなければならず、subBinOffset 値と subBinWidth 値の合計はビン幅以下でなければなりません。値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID変数とビンパラメータも指定しない限り無視されます。

最小値0

subInterval="string"

より小さい間隔を指定して、オブザベーションの集計のための各間隔内の時間間隔の配置を制御します。

別名subInt

* table={castable}

テーブル名、caslib、他の共通パラメータを指定します。

table パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。

varSpecs=[{tkcasagg_varspecs-1} <, {tkcasagg_varspecs-2}, ...>]

集計する変数とアグリゲーターの設定を指定します。

tkcasagg_varspecs の値は次のいずれかになります:

"agg":"FIRST" | "FIRSTNOTEMPTY" | "LAST" | "LASTNOTEMPTY" | "MAXIMUM" | "MINIMUM" | "MODE" | "N" | "NDISTINCT" | "NMISS" | "NTOTAL" | "PERCENT" | "PERCENTILE" | "PGT" | "PLT" | "Q1" | "Q2" | "Q3" | "SUMMARY"

分析変数に適用するアグリゲーターを指定します。

FIRST

edgeId 変数の最小値を返します。

FIRSTNOTEMPTY

edgeId 変数の最小の non-empty 値を返します。

別名FNE
LAST

edgeId 変数の最大値を返します。

LASTNOTEMPTY

edgeId 変数の最大の non-empty 値を返します。

別名LNE
MAXIMUM

最大の非欠損値を返します。

別名MAX
MINIMUM

最小の非欠損値を返します。

別名MIN
MODE

最頻値を返します。k パラメータを指定すると、最頻値以上を返すことができます。

N

欠損値を除くオブザベーション数を返します。

NDISTINCT

重複しない値の数を返します。これは、出力形式を持つ文字変数と数値変数のデフォルトアグリゲーターです。

別名NDIST
NMISS

欠損値の数を返します。

NTOTAL

欠損値を含むオブザベーション数を返します。

別名NTTL
PERCENT

rpRange または pStrRange パラメータで指定された範囲内の値の割合を返します。

別名PIN
PCIN
PERCENTILE

percentiles パラメータで指定された統計量を返します。

PGT

pN または pStrN パラメータで指定されたしきい値を超える値のパーセントを戻します。

別名PCGT
PLT

pN または pStrL パラメータで指定されたしきい値よりも小さい値のパーセントを返します。

別名PCLT
Q1

25 パーセント点に最も近い値を返します。

Q2

50 パーセント点に最も近い値を返します。

別名MED
MEDIAN
Q3

75 パーセント点に最も近い値を返します。

SUMMARY

MIN、MAX、NOBS、MEAN、SUM、STD、STDERR、CV、NMISS、VAR、USS、CSS、TVALUE、PROBT、SKEWNESS、KURTOSIS を含む数値変数の要約統計量を返します。これは未加工の数値変数のデフォルトアグリゲーターです。

"ciAlpha":double

100*(1-ciAlpha)% 信頼区間の有意水準を指定します。デフォルト値 0.05 の場合、95% の信頼区間になります。

デフォルト0.05
範囲(0, 1)
"ciType":"LOWER" | "TWOSIDED" | "UPPER"

信頼区間のタイプを指定します。

デフォルトTWOSIDED
LOWER

指定された信頼度で、真の母集団平均が存在すると予想される下限を使用するように指定します。

別名LEFT
TWOSIDED

指定された信頼度で、真の母集団平均が存在すると予想される両側信頼区間を使用するように指定します。

UPPER

指定された信頼度で、真の母集団平均が存在すると予想される上限を使用するように指定します。

別名RIGHT
"columnNames":["string-1" <, "string-2", ...>]

結果に使用する置換列名を指定します。デフォルトでは、分析変数の名前は結果テーブルの列名として使用されます。

別名colName
colNames
要件指定した値は重複できません。
"edgeId":"variable-name"

分析変数の値を順序付けるために使用される数値変数を指定します。このパラメータは、FIRST、LAST、FNE、LNE アグリゲーターに適用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

"exclnpwgt":True | False

True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

別名excludeNonPositiveWeight
デフォルトFalse
"format":"string"

分析変数の一時出力形式を指定します。

"formats":["string-1" <, "string-2", ...>]

分析変数の一時出力形式を指定します。

"freq":"variable-name"

値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠落値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

別名frequency
"freqStrict":True | False

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と小数値が使用されます。欠損値はまだ除外されています。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

デフォルトTrue
"includeMissing":True | False

デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

別名includeMiss
incMissing
incMiss
デフォルトTrue
"k":integer

MODE アグリゲーターに対して収集する最も頻度の高いアイテムの数を指定します。

デフォルト1
範囲1–MACINT
"missDbl":double

欠損値の置き換えに使用する数値を指定します。

"missStr":"string"

欠損値の置き換えに使用する文字値を指定します。

"modeSingle":True | False

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

デフォルトFalse
"name":"variable-name"

分析変数名を指定します。

別名var
"names":["variable-name-1" <, "variable-name-2", ...>]

分析変数名を指定します。

別名vars
"pctlDef":integer

UNIVARIATE プロシジャのドキュメントで説明されているように、分位統計 (パーセンタイル) を計算する方法を指定します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

範囲1–5
"percentile":[double-1 <, double-2, ...>]

アグリゲーターが PERCENTILE に設定されている場合に計算するパーセント点を指定します。

別名percentiles
pctl
pctls
要件指定した値は重複できません。
"pN":double

数値変数の PGT と PLT アグリゲーターに数値しきい値を指定します。

"pRange":[double-1 <, double-2, ...>]

数値変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pRangeMin と pRangeMax の両方のパラメータを指定するのと同じです。

"pRangeMax":double

数値変数の PIN アグリゲーターに包括的な最大値を指定します。

デフォルトMACBIG
"pRangeMin":double

数値変数の PIN アグリゲーターに包括的な最小値を指定します。

デフォルト-MACBIG
"pStrN":"string"

文字変数の PGT と PLT アグリゲーターに文字しきい値を指定します。

"pStrRange":["string-1" <, "string-2", ...>]

文字変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pStrRangeMin と pStrRangeMax の両方のパラメータを指定するのと同じです。

"pStrRangeMax":"string"

文字変数の PIN アグリゲーターに包括的な最大値を指定します。

"pStrRangeMin":"string"

文字変数の PIN アグリゲーターに包括的な最小値を指定します。

"range":[double-1 <, double-2, ...>]

集計で考慮する数値変数の包括的な最小値と最大値を指定します。これは、rangeMin と rangeMax の両方のパラメータを指定するのと同じです。

"rangeMax":double

集計で考慮する数値変数の包括的な最小値を指定します。

デフォルトMACBIG
"rangeMin":double

集計で考慮する数値変数の包括的な最小値を指定します。

デフォルト-MACBIG
"strRange":["string-1" <, "string-2", ...>]

集計で考慮する文字変数の包括的な最小値と最大値を指定します。strRangeMin と strRangeMax の両方のパラメータを指定するのと同じです。

"strRangeMax":"string"

集計で考慮する文字変数の包括的な最大値を指定します。

"strRangeMin":"string"

集計で考慮する文字変数の包括的な最小値を指定します。

"summarySubset":["CSS", "CV", "KURT", "KURTOSIS", "MAX", "MAXIMUM", "MEAN", "MIN", "MINIMUM", "N", "NMISS", "PROBT", "SKEW", "SKEWNESS", "STD", "STDERR", "SUM", "T", "TSTAT", "USS", "VAR"]

生成する要約統計量を指定します。デフォルトでは、要約統計量の列の順序は、指定した順序に関係なく、MIN, MAX, NOBS, MEAN, SUM, STD, STDERR, CV, NMISS, VAR, USS, CSS, TVALUE, PROBT, SKEWNESS, KURTOSIS です。列を特定の順序で返す場合は、columnNames パラメータを使用して各結果列の名前を指定します。

別名statistics
subSet
要件指定した値は重複できません。
"weight":"variable-name"

アグリゲーターが SUMMARY の場合、数値分析変数値の重みとして使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

weight="variable-name"

アグリゲーターが SUMMARY の場合の数値分析変数値の重みとして値が使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。

windowBin=[double-1 <, double-2, ...>]

ウィンドウビンの最小値と最大数を指定します。仕様と概念はビンが間隔に適用される点を除いて、ビンパラメータに似ています。

windowInt="string"

各時間間隔に関するオブザベーションの累積のための時間ウィンドウを指定します。例えば、interval='MONTH' と windowInt='YEAR' を指定した場合、アクションは月次間隔で 1 年間のオブザベーションを要約します。

別名winInt
windowInterval

windowOffset=integer

各ウィンドウ間隔のオフセットを指定します。この効果は、オフセットパラメータが間隔パラメータの値にどのように影響するかに似ています。

別名windowIntOffset
winDif
winIntDif
winIntOff
windowIntervalOffset
デフォルト0

windowSubBinOffset=double

レコード値が集計されるウィンドウビン内の開始点を指定します。例えば、windowBin={0, 10} と windowSubBinOffset=2 を指定した場合、interval [0, 2) の ID 変数値を持つレコードは無視されます。指定された値は、ウィンドウのビン幅より大きくすることはできません。

別名winSubBinOffset

windowSubBinWidth=double

各 windowBin 内のサブビンの幅を指定します。許容可能な最小値は 0 で、ウィンドウは無効になります。例えば、windowBin={0, 10}、windowSubBinOffset=2、windowSubBinWidth=5 を指定した場合、intervals [0, 2) と [7, 10) の ID 変数値を持つレコードは無視されます。

別名winSubBinWidth
最小値0

windowSubInt="string"

このパラメータは、サブ間隔に似ています。より小さい間隔を指定して、オブザベーションの集計のための各ウィンドウ間隔内のサブ時間間隔の配置を制御することができます。

別名winSubInterval
winSubInt
windowSubInterval

aggregate アクション

選択した変数の集計を実行します。

選択した列のデータを集計
選択した列のデータをグループ別に集計
選択した列のデータを日付間隔で集計
ローリングウィンドウ集計の実行

R 構文

results <– cas.aggregation.aggregate(s,
bin=list(double-1 <, double-2, ...>),
casOut=list(
caslib="string",
compress=TRUE | FALSE,
indexVars=list("variable-name-1" <, "variable-name-2", ...>),
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
onDemand=TRUE | FALSE,
promote=TRUE | FALSE,
replace=TRUE | FALSE,
replication=integer,
threadBlockSize=64-bit-integer,
timeStamp="string",
where=list("string-1" <, "string-2", ...>)
),
contribute="variable-name",
contributeTrim=TRUE | FALSE,
contributeUnroll=TRUE | FALSE,
copyVars=list("variable-name-1" <, "variable-name-2", ...>),
doESP=TRUE | FALSE,
edgeId="variable-name",
exclnpwgt=TRUE | FALSE,
excludeSelf=TRUE | FALSE,
freq="variable-name",
freqStrict=TRUE | FALSE,
groupByLimit=64-bit-integer,
groupedIntervalOutput=TRUE | FALSE,
id="variable-name",
idEnd=double,
idOutputName="string",
idRange=list(double-1 <, double-2, ...>),
idStart=double,
includeEmptyInterval=TRUE | FALSE,
includeMissing=TRUE | FALSE,
inputs=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
interval="string",
jumpingWindow=TRUE | FALSE,
keepRecord=TRUE | FALSE,
keepRecordId=TRUE | FALSE,
modeSingle=TRUE | FALSE,
offset=integer,
partKey=list("string-1" <, "string-2", ...>),
pctlDef=integer,
pti=double,
ptw=double,
raw=TRUE | FALSE,
saveGroupbyFormat=TRUE | FALSE,
saveGroupbyRaw=TRUE | FALSE,
saveVariableColumn=TRUE | FALSE,
subBinOffset=double,
subBinWidth=double,
subInterval="string",
required parameter table=list(
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
computedVarsProgram="string",
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>),
groupBy=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
groupByMode="NOSORT" | "REDISTRIBUTE",
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters),
required parameter name="table-name",
onDemand=TRUE | FALSE,
orderBy=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
singlePass=TRUE | FALSE,
vars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
where="where-expression",
whereTable=list(
casLib="string"
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameterslist)
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
required parameter name="table-name"
vars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>)
where="where-expression"
)
),
varSpecs=list( list(
ciAlpha=double,
columnNames=list("string-1" <, "string-2", ...>),
edgeId="variable-name",
exclnpwgt=TRUE | FALSE,
format="string",
formats=list("string-1" <, "string-2", ...>),
freq="variable-name",
freqStrict=TRUE | FALSE,
includeMissing=TRUE | FALSE,
k=integer,
missDbl=double,
missStr="string",
modeSingle=TRUE | FALSE,
name="variable-name",
names=list("variable-name-1" <, "variable-name-2", ...>),
pctlDef=integer,
percentile=list(double-1 <, double-2, ...>),
pN=double,
pRange=list(double-1 <, double-2, ...>),
pRangeMax=double,
pRangeMin=double,
pStrN="string",
pStrRange=list("string-1" <, "string-2", ...>),
pStrRangeMax="string",
pStrRangeMin="string",
range=list(double-1 <, double-2, ...>),
rangeMax=double,
rangeMin=double,
strRange=list("string-1" <, "string-2", ...>),
strRangeMax="string",
strRangeMin="string",
summarySubset=list("CSS", "CV", "KURT", "KURTOSIS", "MAX", "MAXIMUM", "MEAN", "MIN", "MINIMUM", "N", "NMISS", "PROBT", "SKEW", "SKEWNESS", "STD", "STDERR", "SUM", "T", "TSTAT", "USS", "VAR"),
weight="variable-name"
) <, list(...)>),
weight="variable-name",
windowBin=list(double-1 <, double-2, ...>),
windowInt="string",
windowOffset=integer,
windowSubInt="string"
)
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

テーブル名、caslib、他の共通パラメータを指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 casOut

—

出力テーブルの設定を指定します。

パラメーターの説明

align="BEGINNING" | "ENDING" | "MIDDLE"

間隔またはビン対する代表値の配置を指定します。

BEGINNING

間隔またはビンの先頭に配置することを指定します。例えば、月の最初の日は間隔の先頭です。

別名B
BEG
LEFT
ENDING

間隔またはビンの最後の値に整列することを指定します。

別名E
END
RIGHT
MIDDLE

間隔またはビンの中央に配置することを指定します。

別名M
MID

bin=list(double-1 <, double-2, ...>)

sビンの最小および最大値を指定します。例えば、ID 変数の値が 0 から 100 までの範囲で、bin = {5, 15} を指定した場合、アクションは 11 個のビンを持つ時系列を構築します。最初のビンは [-5, 5] で、最後のビンは [95, 105] です。ビンの上限の境界の値は、このビンに属します。ビンの下限の境界の値は、隣接する下のビンに属します。このパラメータは、ID 変数も指定しない限り無視されます。

casOut=list(casouttable)

出力テーブルの設定を指定します。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

contribute="variable-name"

doESP パラメータが True の場合、各集計間隔内の値が記録されている変数を指定できます。この値は、集計された間隔に対する各行の寄与を理解するために、元のテーブルと結合するためのキーとして使用できます。

contributeColumnLabel="string"

寄与変数から変数ラベルを上書きする値を指定します。デフォルトでは、寄与変数のラベルが結果に表示されます。

contributeColumnName="string"

寄与変数から変数名を上書きする値を指定します。デフォルトでは、寄与変数の名前が結果に表示されます。

contributeDelimiter="string"

寄与変数の連結値間で使用される区切り文字を指定します。

別名delimiter
デフォルト","

contributeTrim=TRUE | FALSE

True に設定すると、寄与変数のフォーマットされた値から先頭と末尾の空白が削除されます。contributionUnroll パラメータが True に設定されている場合、このパラメータは無視されます。

デフォルトFALSE

contributeUnroll=TRUE | FALSE

デフォルトでは、contrib 変数のフォーマットされた値は、結果テーブルに対して 1 つの行に連結されます。True に設定すると、contrib 変数の各未加工値が結果テーブルに行を追加します。

別名unroll
デフォルトFALSE

copyVars=list("variable-name-1" <, "variable-name-2", ...>)

入力テーブルから出力テーブルにコピーする変数を指定します。未加工値は出力に保持されます。入力テーブルに groupBy パラメータも指定しないかぎり、このパラメータは無視されます。1 つのグループに複数のレコードが存在する場合、最小の未加工値がコピーされます。

別名copyVar

doESP=TRUE | FALSE

True に設定すると、アクションは入力テーブルのパーティション分割と並べ替えを利用できます。入力テーブルの groupBy パラメータを指定する必要があります。ID 変数は、最後の groupBy パラメータと orderBy パラメータで指定する必要があります。このパラメータを True に設定すると、keepRecord パラメータを True に設定されます。False (デフォルト値) に設定すると、keepRecordId、excludeSelf、contribute、contributeColumnName、contributeTrim、contributeDelimiter、contributeUnroll の各パラメータは無視されます。

別名partAndOrder
デフォルトFALSE

edgeId="variable-name"

FIRST、LAST、FNE、LNE アグリゲーターを使用する各 varSpecs 仕様の値を順序付けるために使用される数値変数を指定します。このパラメータは、edgeId サブパラメータを含む varSpecs 仕様でオーバーライドできます。

exclnpwgt=TRUE | FALSE

True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。

別名excludeNonPositiveWeight
デフォルトFALSE

excludeSelf=TRUE | FALSE

True に設定され、doESP パラメータが True の場合、集計は現在のオブザベーションの寄与を除外します。

デフォルトFALSE

freq="variable-name"

値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠損値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。

別名frequency

freqStrict=TRUE | FALSE

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と10進値が使用されます。欠損値はまだ除外されています。

デフォルトTRUE

groupByLimit=64-bit-integer

Group-by セットのレベルの最大数を指定します。サーバーがこのレベル数を測定すると、サーバーは停止し結果を返しません。Group-by 操作で大規模な結果セットが作成されないようにするには、このパラメータを指定します。

最小値1

groupedIntervalOutput=TRUE | FALSE

True に設定すると、最後の ID 値に関する同じ集計間隔の 1 つだけを保存します。'doESP' が False に設定されている場合、このオプションは無視されます。

デフォルトFALSE

id="variable-name"

入力テーブル内の各オブザベーションに関連付けられているタイムスタンプを識別する数値変数を指定します。値は、通常SAS DATE、TIME、DATETIME の値ですが、必須ではありません。指定した変数は、入力テーブルの groupBy パラメータでも指定する必要があります。

idEnd=double

分析で考慮する ID 変数の包括的な最大値を指定します。 ID 変数の最大値が idEnd 値より小さい場合、系列は欠損値で拡張されます。最後の ID 変数の値が idEnd の値より大きい場合、系列は切り捨てられます。このパラメータは、ID変数も指定しない限り無視されます。

idOutputName="string"

出力テーブルの ID 変数の新しい名前を指定します。

idRange=list(double-1 <, double-2, ...>)

分析で考慮する ID 変数の包括的な最小値と最大値を指定します。これは、idStart と idEnd の両方を指定することと同じです。

idStart=double

分析で考慮する ID 変数の包括的な最小値を指定します。ID 変数の最小値が idStart 値より大きい場合、系列には欠損値の接頭辞が付加されます。最初の ID 変数の値が idStart の値より小さい場合、系列は切り捨てられます。このパラメータは、ID 変数も指定しない限り無視されます。

includeEmptyInterval=TRUE | FALSE

デフォルトでは、ID 変数の値が欠落している間隔が出力に含まれます。False に設定すると、これらの間隔は出力から除外されます。

別名includeMissInterval
includeMissingInterval
デフォルトTRUE

includeMissing=TRUE | FALSE

デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。

別名includeMiss
incMissing
incMiss
デフォルトTRUE

inputs=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

分析に使用する入力変数を指定します。未加工の数値変数の場合、デフォルトのアグリゲーターは SUMMARY です。その他の状況では、デフォルトのアグリゲーターは N です。このパラメータに変数を指定するか、varSpecs パラメータを指定してより多くの制御を行うことはできますが、両方を使用することはできません。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名input

interval="string"

オブザベーションの累積時間を指定します。例えば、interval='MONTH' を指定すると、アクションは月次間隔でオブザベーションを要約します。このパラメータは、ID 変数も指定しない限り無視されます。

jumpingWindow=TRUE | FALSE

True に設定すると、複数の間隔を含むことができるタイムウィンドウで集計が行われ、指定された時間範囲が経過すると集計がリセットされることを指定します。デフォルトでは、ウィンドウは常に同じ複数の間隔を保持します。

別名tumblingWindow
デフォルトFALSE

keepRecord=TRUE | FALSE

True に設定すると、ID 変数の各オブザベーションの元の値は間隔の配置を行わずに保持されます。

デフォルトFALSE

keepRecordId=TRUE | FALSE

True に設定され、doESP パラメータが True の場合、各オブザベーションの元の ID 値は間隔の配置を実行せずに保持されます。

デフォルトFALSE

modeSingle=TRUE | FALSE

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。

デフォルトFALSE

offset=integer

各間隔のオフセットを指定します。offset=-1 を指定すると、データセットから派生したすべての間隔は 1 つ後方にシフトされます。例えば、3月1日のタイムスタンプ値は、2月1日になるようにデータセットから取得されます。

別名intOffset
dif
intDif
intOff
デフォルト0

partKey=list("string-1" <, "string-2", ...>)

テーブルがパーティション化され、partition パラメータを指定する場合は、パーティションのみの結果が計算されるようにパーティションキーを指定することができます。

pctlDef=integer

UNIVARIATE プロシジャのドキュメントで説明されているように、分位点統計量 (パーセンタイル) を計算する方法を指定します。

デフォルト5
範囲1–5

pti=double

間隔またはビン内の集計が終了したときの時間値を指定します。例えば、interval='MONTH' と partialToInterval='10FEB98'd を指定した場合、アクションは各月の最初の10日間のレコードのみを集計します。

別名ptd
partialToDate
partialToInterval
デフォルト0
最小値0

ptw=double

各ウィンドウ間隔に関するサブ間隔を指定します。例えば、windowInterval='MONTH' と partialToWindow='08FEB98'd を指定した場合、各年のウィンドウ間隔 2月、...、12月の集計時に、アクションは 1月から最初の 8日間、2月から最初の 8日間だけをカウントします。このパラメータは、開始時間がスライディングウィンドウ (非ジャンプウィンドウ) によって異なるため、jumpingWindow パラメータも指定しない限り無視されます。

別名partialToWindow
デフォルト0
最小値0

raw=TRUE | FALSE

True に設定すると、入力パラメータの変数の未加工値が使用されます。

デフォルトFALSE

saveGroupbyFormat=TRUE | FALSE

デフォルトでは、groupBy 変数のフォーマットされた値が入力テーブルから結果にコピーされます。False に設定すると、フォーマットされた値はコピーされません。

別名saveGbyFmt
デフォルトTRUE

saveGroupbyRaw=TRUE | FALSE

デフォルトでは、groupBy 変数の未加工値が入力テーブルから結果にコピーされます。False に設定すると、未加工値はコピーされません。

別名saveGbyRaw
デフォルトTRUE

saveVariableColumn=TRUE | FALSE

デフォルトでは、各分析変数の変数名が結果に含まれます。結果テーブルには、'Column' という名前の列に名前が含まれています。False に設定すると、この列は結果に含まれません。

別名saveVarCol
デフォルトTRUE

saveVariableSpecification=TRUE | FALSE

デフォルトでは、結果には、'Variable Specification' という名前の列が含まれ、結果を生成した varSpecs 指定を識別します。False に設定すると、この列は結果に含まれません。

別名saveVarSpec
デフォルトTRUE

subBinOffset=double

ビンの先頭からのオフセットを指定します。値は正でビン幅以下でなければなりません。指定した値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID 変数とビンパラメータを指定しない限り無視されます。

subBinWidth=double

ビン内のサブビンの幅を指定します。例えば、ID変数の値が 0 から 100 までの範囲で、bin={5, 15}、subBinOffset=2、subBinWidth=5 を指定した場合、アクションは [-2, 3], [8, 13], [18, 23], ..., [98, 103] に分類される ID 変数値を持つオブザベーションだけを要約します。指定された値は正でなければならず、subBinOffset 値と subBinWidth 値の合計はビン幅以下でなければなりません。値が範囲外の場合、このパラメータは無視されます。このパラメータは、ID変数とビンパラメータも指定しない限り無視されます。

最小値0

subInterval="string"

より小さい間隔を指定して、オブザベーションの集計のための各間隔内の時間間隔の配置を制御します。

別名subInt

* table=list(castable)

テーブル名、caslib、他の共通パラメータを指定します。

table パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。

varSpecs=list( list(tkcasagg_varspecs-1) <, list(tkcasagg_varspecs-2), ...>)

集計する変数とアグリゲーターの設定を指定します。

tkcasagg_varspecs の値は次のいずれかになります:

agg="FIRST" | "FIRSTNOTEMPTY" | "LAST" | "LASTNOTEMPTY" | "MAXIMUM" | "MINIMUM" | "MODE" | "N" | "NDISTINCT" | "NMISS" | "NTOTAL" | "PERCENT" | "PERCENTILE" | "PGT" | "PLT" | "Q1" | "Q2" | "Q3" | "SUMMARY"

分析変数に適用するアグリゲーターを指定します。

FIRST

edgeId 変数の最小値を返します。

FIRSTNOTEMPTY

edgeId 変数の最小の non-empty 値を返します。

別名FNE
LAST

edgeId 変数の最大値を返します。

LASTNOTEMPTY

edgeId 変数の最大の non-empty 値を返します。

別名LNE
MAXIMUM

最大の非欠損値を返します。

別名MAX
MINIMUM

最小の非欠損値を返します。

別名MIN
MODE

最頻値を返します。k パラメータを指定すると、最頻値以上を返すことができます。

N

欠損値を除くオブザベーション数を返します。

NDISTINCT

重複しない値の数を返します。これは、出力形式を持つ文字変数と数値変数のデフォルトアグリゲーターです。

別名NDIST
NMISS

欠損値の数を返します。

NTOTAL

欠損値を含むオブザベーション数を返します。

別名NTTL
PERCENT

rpRange または pStrRange パラメータで指定された範囲内の値の割合を返します。

別名PIN
PCIN
PERCENTILE

percentiles パラメータで指定された統計量を返します。

PGT

pN または pStrN パラメータで指定されたしきい値を超える値のパーセントを戻します。

別名PCGT
PLT

pN または pStrL パラメータで指定されたしきい値よりも小さい値のパーセントを返します。

別名PCLT
Q1

25 パーセント点に最も近い値を返します。

Q2

50 パーセント点に最も近い値を返します。

別名MED
MEDIAN
Q3

75 パーセント点に最も近い値を返します。

SUMMARY

MIN、MAX、NOBS、MEAN、SUM、STD、STDERR、CV、NMISS、VAR、USS、CSS、TVALUE、PROBT、SKEWNESS、KURTOSIS を含む数値変数の要約統計量を返します。これは未加工の数値変数のデフォルトアグリゲーターです。

ciAlpha=double

100*(1-ciAlpha)% 信頼区間の有意水準を指定します。デフォルト値 0.05 の場合、95% の信頼区間になります。

デフォルト0.05
範囲(0, 1)
ciType="LOWER" | "TWOSIDED" | "UPPER"

信頼区間のタイプを指定します。

デフォルトTWOSIDED
LOWER

指定された信頼度で、真の母集団平均が存在すると予想される下限を使用するように指定します。

別名LEFT
TWOSIDED

指定された信頼度で、真の母集団平均が存在すると予想される両側信頼区間を使用するように指定します。

UPPER

指定された信頼度で、真の母集団平均が存在すると予想される上限を使用するように指定します。

別名RIGHT
columnNames=list("string-1" <, "string-2", ...>)

結果に使用する置換列名を指定します。デフォルトでは、分析変数の名前は結果テーブルの列名として使用されます。

別名colName
colNames
要件指定した値は重複できません。
edgeId="variable-name"

分析変数の値を順序付けるために使用される数値変数を指定します。このパラメータは、FIRST、LAST、FNE、LNE アグリゲーターに適用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

exclnpwgt=TRUE | FALSE

True に設定され、重み変数が指定されている場合、非正の重み値を持つオブザベーションは分析から除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

別名excludeNonPositiveWeight
デフォルトFALSE
format="string"

分析変数の一時出力形式を指定します。

formats=list("string-1" <, "string-2", ...>)

分析変数の一時出力形式を指定します。

freq="variable-name"

値が分析変数値の頻度として使用される数値変数を指定します。このパラメータは、アグリゲーターが SUMMARY、Q1、Q2、Q3、PERCENTILE、PLT、PIN、PGT、MODE の場合に効果があります。MODE を除いて、欠落値または 1 未満の頻度値を持つレコードは、分析から除外されます。頻度値の整数部分のみが使用されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

別名frequency
freqStrict=TRUE | FALSE

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、欠損値または 1 未満の頻度値を持つオブザベーションは除外され、10進値の整数部分のみが使用されます。False に設定すると、負の値と小数値が使用されます。欠損値はまだ除外されています。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

デフォルトTRUE
includeMissing=TRUE | FALSE

デフォルトでは、欠損値が分析に含まれます。False に設定すると、欠損値のあるオブザベーションは除外されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

別名includeMiss
incMissing
incMiss
デフォルトTRUE
k=integer

MODE アグリゲーターに対して収集する最も頻度の高いアイテムの数を指定します。

デフォルト1
範囲1–MACINT
missDbl=double

欠損値の置き換えに使用する数値を指定します。

missStr="string"

欠損値の置き換えに使用する文字値を指定します。

modeSingle=TRUE | FALSE

このパラメータは、MODE アグリゲーターの使用に関連しています。デフォルトでは、すべての重複しない値の頻度が 1 の場合、最頻値は 'missing' です。True に設定すると、これらの重複しない値の最小値が最頻値に返されます。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

デフォルトFALSE
name="variable-name"

分析変数名を指定します。

別名var
names=list("variable-name-1" <, "variable-name-2", ...>)

分析変数名を指定します。

別名vars
pctlDef=integer

UNIVARIATE プロシジャのドキュメントで説明されているように、分位統計 (パーセンタイル) を計算する方法を指定します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

範囲1–5
percentile=list(double-1 <, double-2, ...>)

アグリゲーターが PERCENTILE に設定されている場合に計算するパーセント点を指定します。

別名percentiles
pctl
pctls
要件指定した値は重複できません。
pN=double

数値変数の PGT と PLT アグリゲーターに数値しきい値を指定します。

pRange=list(double-1 <, double-2, ...>)

数値変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pRangeMin と pRangeMax の両方のパラメータを指定するのと同じです。

pRangeMax=double

数値変数の PIN アグリゲーターに包括的な最大値を指定します。

デフォルトMACBIG
pRangeMin=double

数値変数の PIN アグリゲーターに包括的な最小値を指定します。

デフォルト-MACBIG
pStrN="string"

文字変数の PGT と PLT アグリゲーターに文字しきい値を指定します。

pStrRange=list("string-1" <, "string-2", ...>)

文字変数の PIN アグリゲーターに包括的な最小値と最大値を指定します。これは、pStrRangeMin と pStrRangeMax の両方のパラメータを指定するのと同じです。

pStrRangeMax="string"

文字変数の PIN アグリゲーターに包括的な最大値を指定します。

pStrRangeMin="string"

文字変数の PIN アグリゲーターに包括的な最小値を指定します。

range=list(double-1 <, double-2, ...>)

集計で考慮する数値変数の包括的な最小値と最大値を指定します。これは、rangeMin と rangeMax の両方のパラメータを指定するのと同じです。

rangeMax=double

集計で考慮する数値変数の包括的な最小値を指定します。

デフォルトMACBIG
rangeMin=double

集計で考慮する数値変数の包括的な最小値を指定します。

デフォルト-MACBIG
strRange=list("string-1" <, "string-2", ...>)

集計で考慮する文字変数の包括的な最小値と最大値を指定します。strRangeMin と strRangeMax の両方のパラメータを指定するのと同じです。

strRangeMax="string"

集計で考慮する文字変数の包括的な最大値を指定します。

strRangeMin="string"

集計で考慮する文字変数の包括的な最小値を指定します。

summarySubset=list("CSS", "CV", "KURT", "KURTOSIS", "MAX", "MAXIMUM", "MEAN", "MIN", "MINIMUM", "N", "NMISS", "PROBT", "SKEW", "SKEWNESS", "STD", "STDERR", "SUM", "T", "TSTAT", "USS", "VAR")

生成する要約統計量を指定します。デフォルトでは、要約統計量の列の順序は、指定した順序に関係なく、MIN, MAX, NOBS, MEAN, SUM, STD, STDERR, CV, NMISS, VAR, USS, CSS, TVALUE, PROBT, SKEWNESS, KURTOSIS です。列を特定の順序で返す場合は、columnNames パラメータを使用して各結果列の名前を指定します。

別名statistics
subSet
要件指定した値は重複できません。
weight="variable-name"

アグリゲーターが SUMMARY の場合、数値分析変数値の重みとして使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。このパラメータを varSpec パラメータに指定すると、アクションの設定が上書きされます。

weight="variable-name"

アグリゲーターが SUMMARY の場合の数値分析変数値の重みとして値が使用される数値変数を指定します。このパラメータは、SUMMARY アグリゲーターでのみ意味があります。欠損値のオブザベーションは分析から除外されます。デフォルトでは、重み変数の負の値は 0 として扱われます。この動作を変更するには、excludeNonPositiveWeight パラメータを使用します。

windowBin=list(double-1 <, double-2, ...>)

ウィンドウビンの最小値と最大数を指定します。仕様と概念はビンが間隔に適用される点を除いて、ビンパラメータに似ています。

windowInt="string"

各時間間隔に関するオブザベーションの累積のための時間ウィンドウを指定します。例えば、interval='MONTH' と windowInt='YEAR' を指定した場合、アクションは月次間隔で 1 年間のオブザベーションを要約します。

別名winInt
windowInterval

windowOffset=integer

各ウィンドウ間隔のオフセットを指定します。この効果は、オフセットパラメータが間隔パラメータの値にどのように影響するかに似ています。

別名windowIntOffset
winDif
winIntDif
winIntOff
windowIntervalOffset
デフォルト0

windowSubBinOffset=double

レコード値が集計されるウィンドウビン内の開始点を指定します。例えば、windowBin={0, 10} と windowSubBinOffset=2 を指定した場合、interval [0, 2) の ID 変数値を持つレコードは無視されます。指定された値は、ウィンドウのビン幅より大きくすることはできません。

別名winSubBinOffset

windowSubBinWidth=double

各 windowBin 内のサブビンの幅を指定します。許容可能な最小値は 0 で、ウィンドウは無効になります。例えば、windowBin={0, 10}、windowSubBinOffset=2、windowSubBinWidth=5 を指定した場合、intervals [0, 2) と [7, 10) の ID 変数値を持つレコードは無視されます。

別名winSubBinWidth
最小値0

windowSubInt="string"

このパラメータは、サブ間隔に似ています。より小さい間隔を指定して、オブザベーションの集計のための各ウィンドウ間隔内のサブ時間間隔の配置を制御することができます。

別名winSubInterval
winSubInt
windowSubInterval
最終更新: 2022/10/04