ロバスト PCA アクションセット: 構文
ロバスト主成分分析 (RPCA) と移動窓主成分分析 (MWPCA) のアクションを提供します
robustpca アクション
ロバスト主成分分析を実行します。
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametertable |
— |
入力テーブルの設定を指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
casOut |
SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。 | |
|
— |
入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。 | |
|
lowRankMat, sparseMat, errMat |
ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。 | |
|
pcLoadings, pcScores |
主成分分析の出力テーブルのパラメーターのリストを指定します。 | |
|
svdDiag, svdLeft, svdRight |
特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。 | |
|
names |
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。 | |
|
— |
aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。 |
パラメーターの説明
anomalyDetection=TRUE | FALSE
True に設定すると、異常検出に後続のスコアアクションが使用されます。
| 別名 | anomaly |
|---|---|
| AD | |
| デフォルト | FALSE |
anomalyDetectionMethod=integer
異常検出方法を指定します。この値を 0 に設定すると、異常検出に SIGVARS 法が使用されます。この値を 1 に設定すると、異常検出に R4S 法が使用されます。この値を 2 に設定すると、異常検出に ICA-SIGVARS 法が使用されます。この値を 3 に設定すると、異常検出に ICA-NORMS 法が使用されます。これらの異常検出方法の詳細については、詳細セクションを参照してください。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_ANOMALYDETECTION_METHOD を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| 別名 | ADMethod |
|---|---|
| デフォルト | 0 |
| 範囲 | 0–3 |
attributes={{casinvardesc-1} <, {casinvardesc-2}, ...>}
このアクションで使用される変数の属性を変更します。現在、入力および名義パラメーターで指定された属性は無視されます。
attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | attribute |
|---|---|
| attr |
center=TRUE | FALSE
True に設定すると、数値変数を各列の平均で中心化します。
| 別名 | centering |
|---|---|
| デフォルト | FALSE |
code={rpcaCodegen}
SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。
rpcaCodegen の値は次のいずれかになります:
casOut={casouttable}
出力テーブルの設定を指定します。
casouttable の値は次のいずれかになります:
caslib="string"
出力テーブルの caslib の名前を指定します。
compress=TRUE | FALSE
True に設定すると、テーブルにデータ圧縮が適用されます。
| デフォルト | FALSE |
|---|
indexVars={"variable-name-1" <, "variable-name-2", ...>}
出力データにインデックスを作成する変数のリストを指定します。
label="string"
テーブルに関連付ける説明ラベルを指定します。
lifetime=64-bit-integer
最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
maxMemSize=64-bit-integer
メモリマップされたファイルに変換する前に、各スレッドがインメモリブロックに割り当てる必要があるメモリの最大容量をバイト単位で指定します。ファイルは、CAS_DISK_CACHE 環境変数で指定されたディレクトリに書き込まれます。
| ヒント | 値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。 |
|---|
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
出力テーブルの名前を指定します。
promote=TRUE | FALSE
True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。
| デフォルト | FALSE |
|---|
replace=TRUE | FALSE
True に設定すると、同じ名前の既存のテーブルは上書きされます。
| デフォルト | FALSE |
|---|
replication=integer
フォールトトレランスのために作成するテーブルのコピー数を指定します。値を大きくすると、パフォーマンスが低下し、より多くのメモリが使用されますが、ノードに障害が発生した場合のデータの可用性が向上します。データの冗長性は、分散サーバーにのみ適用されます。
| デフォルト | 1 |
|---|---|
| 最小値 | 0 |
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
出力テーブルのブロックに使用するバイト数を指定します。ブロックはスレッドによって読み取られます。数百万行または数十億行の大きなテーブルがあり、パフォーマンスを調整している場合は、この値を徐々に増やします。値を大きくすると、インデックス付きテーブルのパフォーマンスが向上します。ただし、値が大きすぎる場合、スレッドが動作するためのブロックが少なすぎるため、スレッド不足が発生する可能性があります。
| 別名 | blockSize |
|---|---|
| デフォルト | 1048576 |
| 最小値 | 0 |
| ヒント | 値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。 |
timeStamp="string"
タイムスタンプ列をテーブルに追加することを指定します。timeStamp のサポートはアクション固有です。セッションロケールに適した形式で値を指定します。
where={"string-1" <, "string-2", ...>}
出力データをサブセット化する 1 つ以上の式を指定します。複数の式が指定された場合、式は AND を使用して効果的に結合され、最終的な出力フィルタが形成されます。式に引用符で囲まれた値が含まれている場合は、ネストした引用符を使用します。
comment=TRUE | FALSE
True に設定すると、DATA ステップコードにコメントが追加されます。
| デフォルト | FALSE |
|---|
fmtWdth=integer
DATA ステップコードでのパラメーター推定値などの派生数の書式設定に使用する幅を指定します。
| 別名 | fmtWidth |
|---|---|
| デフォルト | 20 |
| 範囲 | 0–32 |
indentSize=integer
各レベルの DATA ステップコードをインデントするスペースの数を指定します。
| デフォルト | 3 |
|---|---|
| 範囲 | 0–10 |
labelId=integer
DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。
lineSize=integer
生成されたコードの行サイズを指定します。
| デフォルト | 120 |
|---|---|
| 範囲 | 64–254 |
noTrim=TRUE | FALSE
True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。
| デフォルト | FALSE |
|---|
projectionType="LRS" | "PCA"
tabForm=TRUE | FALSE
True に設定すると、テーブルの格納に適した方法でコードが生成されます。
| 別名 | tableForm |
|---|---|
| デフォルト | FALSE |
colStatistics={casouttable}
入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。
colStatistics パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
cumEigPctTol=double
低ランク行列のランクを決定する固有値の有意水準を指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | (0–1] |
decomp="NONE" | "PCA" | "SVD"
display={displayTables}
クライアントに表示するために送信する結果テーブルのリストを指定します。
display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。
fixedMu=TRUE | FALSE
True に設定すると、加速近接勾配法の各反復で mu が修正されます。それ以外の場合、mu は各反復で動的に更新されます。
| デフォルト | FALSE |
|---|
freq="variable-name"
各オブザベーションの発生頻度を含む数値変数を指定します。
icaMaxiter=integer
学習時の Infomax ICA の最大反復回数を指定します。
| デフォルト | 100 |
|---|---|
| 範囲 | 1–500 |
icaMethod="FOBI" | "GEOD" | "SYMM" | "UNCON"
id={"variable-name-1" <, "variable-name-2", ...>}
レコード識別子として使用する変数名を指定します。
image="variable-name"
JPG、PNG、TIF、WIDE としてエンコードされた画像バイナリを含む列の名前を指定します。このパラメーターは inputs パラメーターと一緒に指定できません。
| 別名 | imageVar |
|---|
inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}
分析する数値変数を指定します。このパラメーターを省略すると、他のパラメーターで指定されていないすべての数値変数が分析されます。このパラメーターを画像パラメーターと同時に指定することはできません。
inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | input |
|---|---|
| vars | |
| var |
lambda=double
目的関数の疎行列の L1 ノルムで乗算される、目的関数 (ラムダ) の係数の値を指定します。デフォルト値は、1 をオブザベーション数の平方根または入力テーブル内の変数の数のいずれか大きい方で割った値として計算されます。
| 範囲 | (0–10000000000] |
|---|
lambdaWeight=double
ラムダの重みを指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | (0–10000000000] |
maxIter=integer
ロバストな主成分分析アルゴリズムの最大反復回数を指定します。
| デフォルト | 1000 |
|---|---|
| 最小値 | 0 |
method="ALM" | "APG"
mu=double
加速近接勾配法の目的関数で mu の初期値を指定します。
| デフォルト | 0.001 |
|---|---|
| 範囲 | 0–10000000000 |
nThreads=integer
各計算ノードで使用するスレッドの最大数を指定します。
| デフォルト | 16 |
|---|---|
| 範囲 | 0–1024 |
numSigVars=integer
SIGVARS 法と ICA-SIGVARS 法によって異常と見なされるために、オブザベーション内の重要な変数の最小数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_NUMSIGVARS を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| デフォルト | 1 |
|---|---|
| 最小値 | 1 |
outMat={outRpcaTabs}
ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。
outRpcaTabs の値は次のいずれかになります:
errMat={casouttable}
lowRankMat={casouttable}
低ランク行列の出力テーブルの名前を指定します。
lowRankMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
| 別名 | outLowRank |
|---|
sparseMat={casouttable}
outPca={outPcaTabs}
主成分分析の出力テーブルのパラメーターのリストを指定します。
outPcaTabs の値は次のいずれかになります:
pcLoadings={casouttable}
主成分負荷量の出力テーブルの名前を指定します。
pcLoadings パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
pcScores={casouttable}
主成分スコアの出力テーブルの名前を指定します。
pcScores パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
outputTables={outputTables}
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。
outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。
| 別名 | displayOut |
|---|
outSvd={outSvdTabs}
特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。
outSvdTabs の値は次のいずれかになります:
svdDiag={casouttable}
四角形の対角行列の対角ベクトルの出力テーブルの名前を指定します。
svdDiag パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
svdLeft={casouttable}
左特異ベクトルの出力テーブルの名前を指定します。
svdLeft パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
svdRight={casouttable}
右特異ベクトルの出力テーブルの名前を指定します。
svdRight パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
pcPrefix="string"
主成分の名前を付ける接頭辞を指定します。
| デフォルト | "Prin" |
|---|
saveState={casouttable}
aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。
saveState パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
scale=TRUE | FALSE
True に設定すると、数値変数を各列の標準偏差で尺度化します。
| 別名 | scaling |
|---|---|
| デフォルト | FALSE |
sigmaCoef=double
異常検出のための SIGVARS 法の標準化された疎値のしきい値、または R4S 法のしきい値に適用される係数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_SIGMACOEF を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| デフォルト | 1 |
|---|---|
| 最小値 | 1E-10 |
svdMaxRank=integer
特異値分解ソルバーで考慮されるランクの最大値を指定します。デフォルト値は、オブザベーションの数と入力テーブルの変数の数の小さい方です。
| 最小値 | 1 |
|---|
svdMethod="EIGEN" | "ITERATIVE" | "RANDOM"
svdRand={randomizedSvd}
svdMethod パラメーターの値が RANDOM の場合に使用するパラメーターのリストを指定します。
randomizedSvd の値は次のいずれかになります:
power=integer
パラメーター power を指定します。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
randSeed=integer
シード値を指定します。
| デフォルト | 0 |
|---|---|
| 最小値 | 1 |
* table={castable}
入力テーブルの設定を指定します。
| 長い形式 | table={name="table-name"} |
|---|---|
| 短い形式 | table="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=TRUE | FALSE
True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | FALSE |
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメーターに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
orderBy={{casinvardesc-1} <, {casinvardesc-2}, ...>}
パーティション内でオブザベーションの並べ替えに使用する変数を指定します。このパラメーターは、パーティション化されたテーブルに適用されるか、groupByMode パラメーターの値が REDISTRIBUTE に設定されている場合に、groupBy パラメーターで指定された変数と組み合わせることができます。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
singlePass=TRUE | FALSE
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | FALSE |
|---|
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable={groupbytable}
WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルターテーブルの名前を指定します。
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
フィルターテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルターテーブルからデータをサブセット化する式を指定します。
tolerance=double
ロバストな主成分分析アルゴリズムの収束基準を指定します。
| 別名 | stopcriterion |
|---|---|
| デフォルト | 1E-07 |
| 最小値 | 1E-10 |
useMatrix=TRUE | FALSE
True に設定すると、異常検出法 SIGVARS と R4S におけるスコアリングオブザベーションの疎部分を標準化するために、疎行列の列の標準偏差を使用します。False に設定すると、アクションはその目的のために元の入力データの列の標準偏差を使用します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_USEMATRIX を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| デフォルト | FALSE |
|---|
robustpca アクション
ロバスト主成分分析を実行します。
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametertable |
— |
入力テーブルの設定を指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
casOut |
SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。 | |
|
— |
入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。 | |
|
lowRankMat, sparseMat, errMat |
ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。 | |
|
pcLoadings, pcScores |
主成分分析の出力テーブルのパラメーターのリストを指定します。 | |
|
svdDiag, svdLeft, svdRight |
特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。 | |
|
names |
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。 | |
|
— |
aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。 |
パラメーターの説明
anomalyDetection=true | false
True に設定すると、異常検出に後続のスコアアクションが使用されます。
| 別名 | anomaly |
|---|---|
| AD | |
| デフォルト | false |
anomalyDetectionMethod=integer
異常検出方法を指定します。この値を 0 に設定すると、異常検出に SIGVARS 法が使用されます。この値を 1 に設定すると、異常検出に R4S 法が使用されます。この値を 2 に設定すると、異常検出に ICA-SIGVARS 法が使用されます。この値を 3 に設定すると、異常検出に ICA-NORMS 法が使用されます。これらの異常検出方法の詳細については、詳細セクションを参照してください。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_ANOMALYDETECTION_METHOD を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| 別名 | ADMethod |
|---|---|
| デフォルト | 0 |
| 範囲 | 0–3 |
attributes={{casinvardesc-1} <, {casinvardesc-2}, ...>}
このアクションで使用される変数の属性を変更します。現在、入力および名義パラメーターで指定された属性は無視されます。
attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | attribute |
|---|---|
| attr |
center=true | false
True に設定すると、数値変数を各列の平均で中心化します。
| 別名 | centering |
|---|---|
| デフォルト | false |
code={rpcaCodegen}
SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。
rpcaCodegen の値は次のいずれかになります:
casOut={casouttable}
出力テーブルの設定を指定します。
casouttable の値は次のいずれかになります:
caslib="string"
出力テーブルの caslib の名前を指定します。
compress=true | false
True に設定すると、テーブルにデータ圧縮が適用されます。
| デフォルト | false |
|---|
indexVars={"variable-name-1" <, "variable-name-2", ...>}
出力データにインデックスを作成する変数のリストを指定します。
label="string"
テーブルに関連付ける説明ラベルを指定します。
lifetime=64-bit-integer
最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
maxMemSize=64-bit-integer
メモリマップされたファイルに変換する前に、各スレッドがインメモリブロックに割り当てる必要があるメモリの最大容量をバイト単位で指定します。ファイルは、CAS_DISK_CACHE 環境変数で指定されたディレクトリに書き込まれます。
| ヒント | 値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。 |
|---|
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
出力テーブルの名前を指定します。
promote=true | false
True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。
| デフォルト | false |
|---|
replace=true | false
True に設定すると、同じ名前の既存のテーブルは上書きされます。
| デフォルト | false |
|---|
replication=integer
フォールトトレランスのために作成するテーブルのコピー数を指定します。値を大きくすると、パフォーマンスが低下し、より多くのメモリが使用されますが、ノードに障害が発生した場合のデータの可用性が向上します。データの冗長性は、分散サーバーにのみ適用されます。
| デフォルト | 1 |
|---|---|
| 最小値 | 0 |
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
出力テーブルのブロックに使用するバイト数を指定します。ブロックはスレッドによって読み取られます。数百万行または数十億行の大きなテーブルがあり、パフォーマンスを調整している場合は、この値を徐々に増やします。値を大きくすると、インデックス付きテーブルのパフォーマンスが向上します。ただし、値が大きすぎる場合、スレッドが動作するためのブロックが少なすぎるため、スレッド不足が発生する可能性があります。
| 別名 | blockSize |
|---|---|
| デフォルト | 1048576 |
| 最小値 | 0 |
| ヒント | 値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。 |
timeStamp="string"
タイムスタンプ列をテーブルに追加することを指定します。timeStamp のサポートはアクション固有です。セッションロケールに適した形式で値を指定します。
where={"string-1" <, "string-2", ...>}
出力データをサブセット化する 1 つ以上の式を指定します。複数の式が指定された場合、式は AND を使用して効果的に結合され、最終的な出力フィルタが形成されます。式に引用符で囲まれた値が含まれている場合は、ネストした引用符を使用します。
comment=true | false
True に設定すると、DATA ステップコードにコメントが追加されます。
| デフォルト | false |
|---|
fmtWdth=integer
DATA ステップコードでのパラメーター推定値などの派生数の書式設定に使用する幅を指定します。
| 別名 | fmtWidth |
|---|---|
| デフォルト | 20 |
| 範囲 | 0–32 |
indentSize=integer
各レベルの DATA ステップコードをインデントするスペースの数を指定します。
| デフォルト | 3 |
|---|---|
| 範囲 | 0–10 |
labelId=integer
DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。
lineSize=integer
生成されたコードの行サイズを指定します。
| デフォルト | 120 |
|---|---|
| 範囲 | 64–254 |
noTrim=true | false
True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。
| デフォルト | false |
|---|
projectionType="LRS" | "PCA"
tabForm=true | false
True に設定すると、テーブルの格納に適した方法でコードが生成されます。
| 別名 | tableForm |
|---|---|
| デフォルト | false |
colStatistics={casouttable}
入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。
colStatistics パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
cumEigPctTol=double
低ランク行列のランクを決定する固有値の有意水準を指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | (0–1] |
decomp="NONE" | "PCA" | "SVD"
display={displayTables}
クライアントに表示するために送信する結果テーブルのリストを指定します。
display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。
fixedMu=true | false
True に設定すると、加速近接勾配法の各反復で mu が修正されます。それ以外の場合、mu は各反復で動的に更新されます。
| デフォルト | false |
|---|
freq="variable-name"
各オブザベーションの発生頻度を含む数値変数を指定します。
icaMaxiter=integer
学習時の Infomax ICA の最大反復回数を指定します。
| デフォルト | 100 |
|---|---|
| 範囲 | 1–500 |
icaMethod="FOBI" | "GEOD" | "SYMM" | "UNCON"
id={"variable-name-1" <, "variable-name-2", ...>}
レコード識別子として使用する変数名を指定します。
image="variable-name"
JPG、PNG、TIF、WIDE としてエンコードされた画像バイナリを含む列の名前を指定します。このパラメーターは inputs パラメーターと一緒に指定できません。
| 別名 | imageVar |
|---|
inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}
分析する数値変数を指定します。このパラメーターを省略すると、他のパラメーターで指定されていないすべての数値変数が分析されます。このパラメーターを画像パラメーターと同時に指定することはできません。
inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | input |
|---|---|
| vars | |
| var |
lambda=double
目的関数の疎行列の L1 ノルムで乗算される、目的関数 (ラムダ) の係数の値を指定します。デフォルト値は、1 をオブザベーション数の平方根または入力テーブル内の変数の数のいずれか大きい方で割った値として計算されます。
| 範囲 | (0–10000000000] |
|---|
lambdaWeight=double
ラムダの重みを指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | (0–10000000000] |
maxIter=integer
ロバストな主成分分析アルゴリズムの最大反復回数を指定します。
| デフォルト | 1000 |
|---|---|
| 最小値 | 0 |
method="ALM" | "APG"
mu=double
加速近接勾配法の目的関数で mu の初期値を指定します。
| デフォルト | 0.001 |
|---|---|
| 範囲 | 0–10000000000 |
nThreads=integer
各計算ノードで使用するスレッドの最大数を指定します。
| デフォルト | 16 |
|---|---|
| 範囲 | 0–1024 |
numSigVars=integer
SIGVARS 法と ICA-SIGVARS 法によって異常と見なされるために、オブザベーション内の重要な変数の最小数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_NUMSIGVARS を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| デフォルト | 1 |
|---|---|
| 最小値 | 1 |
outMat={outRpcaTabs}
ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。
outRpcaTabs の値は次のいずれかになります:
errMat={casouttable}
lowRankMat={casouttable}
低ランク行列の出力テーブルの名前を指定します。
lowRankMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
| 別名 | outLowRank |
|---|
sparseMat={casouttable}
outPca={outPcaTabs}
主成分分析の出力テーブルのパラメーターのリストを指定します。
outPcaTabs の値は次のいずれかになります:
pcLoadings={casouttable}
主成分負荷量の出力テーブルの名前を指定します。
pcLoadings パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
pcScores={casouttable}
主成分スコアの出力テーブルの名前を指定します。
pcScores パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
outputTables={outputTables}
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。
outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。
| 別名 | displayOut |
|---|
outSvd={outSvdTabs}
特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。
outSvdTabs の値は次のいずれかになります:
svdDiag={casouttable}
四角形の対角行列の対角ベクトルの出力テーブルの名前を指定します。
svdDiag パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
svdLeft={casouttable}
左特異ベクトルの出力テーブルの名前を指定します。
svdLeft パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
svdRight={casouttable}
右特異ベクトルの出力テーブルの名前を指定します。
svdRight パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
pcPrefix="string"
主成分の名前を付ける接頭辞を指定します。
| デフォルト | "Prin" |
|---|
saveState={casouttable}
aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。
saveState パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
scale=true | false
True に設定すると、数値変数を各列の標準偏差で尺度化します。
| 別名 | scaling |
|---|---|
| デフォルト | false |
sigmaCoef=double
異常検出のための SIGVARS 法の標準化された疎値のしきい値、または R4S 法のしきい値に適用される係数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_SIGMACOEF を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| デフォルト | 1 |
|---|---|
| 最小値 | 1E-10 |
svdMaxRank=integer
特異値分解ソルバーで考慮されるランクの最大値を指定します。デフォルト値は、オブザベーションの数と入力テーブルの変数の数の小さい方です。
| 最小値 | 1 |
|---|
svdMethod="EIGEN" | "ITERATIVE" | "RANDOM"
svdRand={randomizedSvd}
svdMethod パラメーターの値が RANDOM の場合に使用するパラメーターのリストを指定します。
randomizedSvd の値は次のいずれかになります:
power=integer
パラメーター power を指定します。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
randSeed=integer
シード値を指定します。
| デフォルト | 0 |
|---|---|
| 最小値 | 1 |
* table={castable}
入力テーブルの設定を指定します。
| 長い形式 | table={name="table-name"} |
|---|---|
| 短い形式 | table="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=true | false
True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | false |
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメーターに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
orderBy={{casinvardesc-1} <, {casinvardesc-2}, ...>}
パーティション内でオブザベーションの並べ替えに使用する変数を指定します。このパラメーターは、パーティション化されたテーブルに適用されるか、groupByMode パラメーターの値が REDISTRIBUTE に設定されている場合に、groupBy パラメーターで指定された変数と組み合わせることができます。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
singlePass=true | false
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | false |
|---|
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable={groupbytable}
WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルターテーブルの名前を指定します。
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
フィルターテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルターテーブルからデータをサブセット化する式を指定します。
tolerance=double
ロバストな主成分分析アルゴリズムの収束基準を指定します。
| 別名 | stopcriterion |
|---|---|
| デフォルト | 1E-07 |
| 最小値 | 1E-10 |
useMatrix=true | false
True に設定すると、異常検出法 SIGVARS と R4S におけるスコアリングオブザベーションの疎部分を標準化するために、疎行列の列の標準偏差を使用します。False に設定すると、アクションはその目的のために元の入力データの列の標準偏差を使用します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_USEMATRIX を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| デフォルト | false |
|---|
robustpca アクション
ロバスト主成分分析を実行します。
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametertable |
— |
入力テーブルの設定を指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
casOut |
SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。 | |
|
— |
入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。 | |
|
lowRankMat, sparseMat, errMat |
ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。 | |
|
pcLoadings, pcScores |
主成分分析の出力テーブルのパラメーターのリストを指定します。 | |
|
svdDiag, svdLeft, svdRight |
特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。 | |
|
names |
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。 | |
|
— |
aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。 |
パラメーターの説明
anomalyDetection=True | False
True に設定すると、異常検出に後続のスコアアクションが使用されます。
| 別名 | anomaly |
|---|---|
| AD | |
| デフォルト | False |
anomalyDetectionMethod=integer
異常検出方法を指定します。この値を 0 に設定すると、異常検出に SIGVARS 法が使用されます。この値を 1 に設定すると、異常検出に R4S 法が使用されます。この値を 2 に設定すると、異常検出に ICA-SIGVARS 法が使用されます。この値を 3 に設定すると、異常検出に ICA-NORMS 法が使用されます。これらの異常検出方法の詳細については、詳細セクションを参照してください。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_ANOMALYDETECTION_METHOD を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| 別名 | ADMethod |
|---|---|
| デフォルト | 0 |
| 範囲 | 0–3 |
attributes=[{casinvardesc-1} <, {casinvardesc-2}, ...>]
このアクションで使用される変数の属性を変更します。現在、入力および名義パラメーターで指定された属性は無視されます。
attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | attribute |
|---|---|
| attr |
center=True | False
True に設定すると、数値変数を各列の平均で中心化します。
| 別名 | centering |
|---|---|
| デフォルト | False |
code={rpcaCodegen}
SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。
rpcaCodegen の値は次のいずれかになります:
"casOut":{casouttable}
出力テーブルの設定を指定します。
casouttable の値は次のいずれかになります:
"caslib":"string"
出力テーブルの caslib の名前を指定します。
"compress":True | False
True に設定すると、テーブルにデータ圧縮が適用されます。
| デフォルト | False |
|---|
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
出力データにインデックスを作成する変数のリストを指定します。
"label":"string"
テーブルに関連付ける説明ラベルを指定します。
"lifetime":64-bit-integer
最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
"maxMemSize":64-bit-integer
メモリマップされたファイルに変換する前に、各スレッドがインメモリブロックに割り当てる必要があるメモリの最大容量をバイト単位で指定します。ファイルは、CAS_DISK_CACHE 環境変数で指定されたディレクトリに書き込まれます。
| ヒント | 値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。 |
|---|
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"
"name":"table-name"
出力テーブルの名前を指定します。
"promote":True | False
True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。
| デフォルト | False |
|---|
"replace":True | False
True に設定すると、同じ名前の既存のテーブルは上書きされます。
| デフォルト | False |
|---|
"replication":integer
フォールトトレランスのために作成するテーブルのコピー数を指定します。値を大きくすると、パフォーマンスが低下し、より多くのメモリが使用されますが、ノードに障害が発生した場合のデータの可用性が向上します。データの冗長性は、分散サーバーにのみ適用されます。
| デフォルト | 1 |
|---|---|
| 最小値 | 0 |
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"
"threadBlockSize":64-bit-integer
出力テーブルのブロックに使用するバイト数を指定します。ブロックはスレッドによって読み取られます。数百万行または数十億行の大きなテーブルがあり、パフォーマンスを調整している場合は、この値を徐々に増やします。値を大きくすると、インデックス付きテーブルのパフォーマンスが向上します。ただし、値が大きすぎる場合、スレッドが動作するためのブロックが少なすぎるため、スレッド不足が発生する可能性があります。
| 別名 | blockSize |
|---|---|
| デフォルト | 1048576 |
| 最小値 | 0 |
| ヒント | 値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。 |
"timeStamp":"string"
タイムスタンプ列をテーブルに追加することを指定します。timeStamp のサポートはアクション固有です。セッションロケールに適した形式で値を指定します。
"where":["string-1" <, "string-2", ...>]
出力データをサブセット化する 1 つ以上の式を指定します。複数の式が指定された場合、式は AND を使用して効果的に結合され、最終的な出力フィルタが形成されます。式に引用符で囲まれた値が含まれている場合は、ネストした引用符を使用します。
"comment":True | False
True に設定すると、DATA ステップコードにコメントが追加されます。
| デフォルト | False |
|---|
"fmtWdth":integer
DATA ステップコードでのパラメーター推定値などの派生数の書式設定に使用する幅を指定します。
| 別名 | fmtWidth |
|---|---|
| デフォルト | 20 |
| 範囲 | 0–32 |
"indentSize":integer
各レベルの DATA ステップコードをインデントするスペースの数を指定します。
| デフォルト | 3 |
|---|---|
| 範囲 | 0–10 |
"labelId":integer
DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。
"lineSize":integer
生成されたコードの行サイズを指定します。
| デフォルト | 120 |
|---|---|
| 範囲 | 64–254 |
"noTrim":True | False
True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。
| デフォルト | False |
|---|
"projectionType":"LRS" | "PCA"
"tabForm":True | False
True に設定すると、テーブルの格納に適した方法でコードが生成されます。
| 別名 | tableForm |
|---|---|
| デフォルト | False |
colStatistics={casouttable}
入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。
colStatistics パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
cumEigPctTol=double
低ランク行列のランクを決定する固有値の有意水準を指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | (0–1] |
decomp="NONE" | "PCA" | "SVD"
display={displayTables}
クライアントに表示するために送信する結果テーブルのリストを指定します。
display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。
fixedMu=True | False
True に設定すると、加速近接勾配法の各反復で mu が修正されます。それ以外の場合、mu は各反復で動的に更新されます。
| デフォルト | False |
|---|
freq="variable-name"
各オブザベーションの発生頻度を含む数値変数を指定します。
icaMaxiter=integer
学習時の Infomax ICA の最大反復回数を指定します。
| デフォルト | 100 |
|---|---|
| 範囲 | 1–500 |
icaMethod="FOBI" | "GEOD" | "SYMM" | "UNCON"
id=["variable-name-1" <, "variable-name-2", ...>]
レコード識別子として使用する変数名を指定します。
image="variable-name"
JPG、PNG、TIF、WIDE としてエンコードされた画像バイナリを含む列の名前を指定します。このパラメーターは inputs パラメーターと一緒に指定できません。
| 別名 | imageVar |
|---|
inputs=[{casinvardesc-1} <, {casinvardesc-2}, ...>]
分析する数値変数を指定します。このパラメーターを省略すると、他のパラメーターで指定されていないすべての数値変数が分析されます。このパラメーターを画像パラメーターと同時に指定することはできません。
inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | input |
|---|---|
| vars | |
| var |
lambda_=double
目的関数の疎行列の L1 ノルムで乗算される、目的関数 (ラムダ) の係数の値を指定します。デフォルト値は、1 をオブザベーション数の平方根または入力テーブル内の変数の数のいずれか大きい方で割った値として計算されます。
| 範囲 | (0–10000000000] |
|---|
lambdaWeight=double
ラムダの重みを指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | (0–10000000000] |
maxIter=integer
ロバストな主成分分析アルゴリズムの最大反復回数を指定します。
| デフォルト | 1000 |
|---|---|
| 最小値 | 0 |
method="ALM" | "APG"
mu=double
加速近接勾配法の目的関数で mu の初期値を指定します。
| デフォルト | 0.001 |
|---|---|
| 範囲 | 0–10000000000 |
nThreads=integer
各計算ノードで使用するスレッドの最大数を指定します。
| デフォルト | 16 |
|---|---|
| 範囲 | 0–1024 |
numSigVars=integer
SIGVARS 法と ICA-SIGVARS 法によって異常と見なされるために、オブザベーション内の重要な変数の最小数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_NUMSIGVARS を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| デフォルト | 1 |
|---|---|
| 最小値 | 1 |
outMat={outRpcaTabs}
ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。
outRpcaTabs の値は次のいずれかになります:
"errMat":{casouttable}
"lowRankMat":{casouttable}
低ランク行列の出力テーブルの名前を指定します。
lowRankMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
| 別名 | outLowRank |
|---|
"sparseMat":{casouttable}
outPca={outPcaTabs}
主成分分析の出力テーブルのパラメーターのリストを指定します。
outPcaTabs の値は次のいずれかになります:
"pcLoadings":{casouttable}
主成分負荷量の出力テーブルの名前を指定します。
pcLoadings パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
"pcScores":{casouttable}
主成分スコアの出力テーブルの名前を指定します。
pcScores パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
outputTables={outputTables}
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。
outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。
| 別名 | displayOut |
|---|
outSvd={outSvdTabs}
特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。
outSvdTabs の値は次のいずれかになります:
"svdDiag":{casouttable}
四角形の対角行列の対角ベクトルの出力テーブルの名前を指定します。
svdDiag パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
"svdLeft":{casouttable}
左特異ベクトルの出力テーブルの名前を指定します。
svdLeft パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
"svdRight":{casouttable}
右特異ベクトルの出力テーブルの名前を指定します。
svdRight パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
pcPrefix="string"
主成分の名前を付ける接頭辞を指定します。
| デフォルト | "Prin" |
|---|
saveState={casouttable}
aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。
saveState パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
scale=True | False
True に設定すると、数値変数を各列の標準偏差で尺度化します。
| 別名 | scaling |
|---|---|
| デフォルト | False |
sigmaCoef=double
異常検出のための SIGVARS 法の標準化された疎値のしきい値、または R4S 法のしきい値に適用される係数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_SIGMACOEF を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| デフォルト | 1 |
|---|---|
| 最小値 | 1E-10 |
svdMaxRank=integer
特異値分解ソルバーで考慮されるランクの最大値を指定します。デフォルト値は、オブザベーションの数と入力テーブルの変数の数の小さい方です。
| 最小値 | 1 |
|---|
svdMethod="EIGEN" | "ITERATIVE" | "RANDOM"
svdRand={randomizedSvd}
svdMethod パラメーターの値が RANDOM の場合に使用するパラメーターのリストを指定します。
randomizedSvd の値は次のいずれかになります:
"power":integer
パラメーター power を指定します。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
"randSeed":integer
シード値を指定します。
| デフォルト | 0 |
|---|---|
| 最小値 | 1 |
* table={castable}
入力テーブルの設定を指定します。
| 長い形式 | table={"name":"table-name"} |
|---|---|
| 短い形式 | table="table-name" |
castable の値は次のいずれかになります:
"caslib":"string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
"computedOnDemand":True | False
True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | False |
"computedVars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"computedVarsProgram":"string"
computedVars パラメーターに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import_ |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* "name":"table-name"
入力テーブルの名前を指定します。
"orderBy":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
パーティション内でオブザベーションの並べ替えに使用する変数を指定します。このパラメーターは、パーティション化されたテーブルに適用されるか、groupByMode パラメーターの値が REDISTRIBUTE に設定されている場合に、groupBy パラメーターで指定された変数と組み合わせることができます。
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"singlePass":True | False
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | False |
|---|
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"where":"where-expression"
入力データをサブセット化する式を指定します。
"whereTable":{groupbytable}
WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
"casLib":"string"
フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import_ |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* "name":"table-name"
フィルターテーブルの名前を指定します。
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
フィルターテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"where":"where-expression"
フィルターテーブルからデータをサブセット化する式を指定します。
tolerance=double
ロバストな主成分分析アルゴリズムの収束基準を指定します。
| 別名 | stopcriterion |
|---|---|
| デフォルト | 1E-07 |
| 最小値 | 1E-10 |
useMatrix=True | False
True に設定すると、異常検出法 SIGVARS と R4S におけるスコアリングオブザベーションの疎部分を標準化するために、疎行列の列の標準偏差を使用します。False に設定すると、アクションはその目的のために元の入力データの列の標準偏差を使用します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_USEMATRIX を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| デフォルト | False |
|---|
robustpca アクション
ロバスト主成分分析を実行します。
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametertable |
— |
入力テーブルの設定を指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
casOut |
SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。 | |
|
— |
入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。 | |
|
lowRankMat, sparseMat, errMat |
ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。 | |
|
pcLoadings, pcScores |
主成分分析の出力テーブルのパラメーターのリストを指定します。 | |
|
svdDiag, svdLeft, svdRight |
特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。 | |
|
names |
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。 | |
|
— |
aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。 |
パラメーターの説明
anomalyDetection=TRUE | FALSE
True に設定すると、異常検出に後続のスコアアクションが使用されます。
| 別名 | anomaly |
|---|---|
| AD | |
| デフォルト | FALSE |
anomalyDetectionMethod=integer
異常検出方法を指定します。この値を 0 に設定すると、異常検出に SIGVARS 法が使用されます。この値を 1 に設定すると、異常検出に R4S 法が使用されます。この値を 2 に設定すると、異常検出に ICA-SIGVARS 法が使用されます。この値を 3 に設定すると、異常検出に ICA-NORMS 法が使用されます。これらの異常検出方法の詳細については、詳細セクションを参照してください。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_ANOMALYDETECTION_METHOD を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| 別名 | ADMethod |
|---|---|
| デフォルト | 0 |
| 範囲 | 0–3 |
attributes=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
このアクションで使用される変数の属性を変更します。現在、入力および名義パラメーターで指定された属性は無視されます。
attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | attribute |
|---|---|
| attr |
center=TRUE | FALSE
True に設定すると、数値変数を各列の平均で中心化します。
| 別名 | centering |
|---|---|
| デフォルト | FALSE |
code=list(rpcaCodegen)
SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。
rpcaCodegen の値は次のいずれかになります:
casOut=list(casouttable)
出力テーブルの設定を指定します。
casouttable の値は次のいずれかになります:
caslib="string"
出力テーブルの caslib の名前を指定します。
compress=TRUE | FALSE
True に設定すると、テーブルにデータ圧縮が適用されます。
| デフォルト | FALSE |
|---|
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
出力データにインデックスを作成する変数のリストを指定します。
label="string"
テーブルに関連付ける説明ラベルを指定します。
lifetime=64-bit-integer
最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
maxMemSize=64-bit-integer
メモリマップされたファイルに変換する前に、各スレッドがインメモリブロックに割り当てる必要があるメモリの最大容量をバイト単位で指定します。ファイルは、CAS_DISK_CACHE 環境変数で指定されたディレクトリに書き込まれます。
| ヒント | 値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。 |
|---|
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
出力テーブルの名前を指定します。
promote=TRUE | FALSE
True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。
| デフォルト | FALSE |
|---|
replace=TRUE | FALSE
True に設定すると、同じ名前の既存のテーブルは上書きされます。
| デフォルト | FALSE |
|---|
replication=integer
フォールトトレランスのために作成するテーブルのコピー数を指定します。値を大きくすると、パフォーマンスが低下し、より多くのメモリが使用されますが、ノードに障害が発生した場合のデータの可用性が向上します。データの冗長性は、分散サーバーにのみ適用されます。
| デフォルト | 1 |
|---|---|
| 最小値 | 0 |
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
出力テーブルのブロックに使用するバイト数を指定します。ブロックはスレッドによって読み取られます。数百万行または数十億行の大きなテーブルがあり、パフォーマンスを調整している場合は、この値を徐々に増やします。値を大きくすると、インデックス付きテーブルのパフォーマンスが向上します。ただし、値が大きすぎる場合、スレッドが動作するためのブロックが少なすぎるため、スレッド不足が発生する可能性があります。
| 別名 | blockSize |
|---|---|
| デフォルト | 1048576 |
| 最小値 | 0 |
| ヒント | 値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。 |
timeStamp="string"
タイムスタンプ列をテーブルに追加することを指定します。timeStamp のサポートはアクション固有です。セッションロケールに適した形式で値を指定します。
where=list("string-1" <, "string-2", ...>)
出力データをサブセット化する 1 つ以上の式を指定します。複数の式が指定された場合、式は AND を使用して効果的に結合され、最終的な出力フィルタが形成されます。式に引用符で囲まれた値が含まれている場合は、ネストした引用符を使用します。
comment=TRUE | FALSE
True に設定すると、DATA ステップコードにコメントが追加されます。
| デフォルト | FALSE |
|---|
fmtWdth=integer
DATA ステップコードでのパラメーター推定値などの派生数の書式設定に使用する幅を指定します。
| 別名 | fmtWidth |
|---|---|
| デフォルト | 20 |
| 範囲 | 0–32 |
indentSize=integer
各レベルの DATA ステップコードをインデントするスペースの数を指定します。
| デフォルト | 3 |
|---|---|
| 範囲 | 0–10 |
labelId=integer
DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。
lineSize=integer
生成されたコードの行サイズを指定します。
| デフォルト | 120 |
|---|---|
| 範囲 | 64–254 |
noTrim=TRUE | FALSE
True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。
| デフォルト | FALSE |
|---|
projectionType="LRS" | "PCA"
tabForm=TRUE | FALSE
True に設定すると、テーブルの格納に適した方法でコードが生成されます。
| 別名 | tableForm |
|---|---|
| デフォルト | FALSE |
colStatistics=list(casouttable)
入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。
colStatistics パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
cumEigPctTol=double
低ランク行列のランクを決定する固有値の有意水準を指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | (0–1] |
decomp="NONE" | "PCA" | "SVD"
display=list(displayTables)
クライアントに表示するために送信する結果テーブルのリストを指定します。
display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。
fixedMu=TRUE | FALSE
True に設定すると、加速近接勾配法の各反復で mu が修正されます。それ以外の場合、mu は各反復で動的に更新されます。
| デフォルト | FALSE |
|---|
freq="variable-name"
各オブザベーションの発生頻度を含む数値変数を指定します。
icaMaxiter=integer
学習時の Infomax ICA の最大反復回数を指定します。
| デフォルト | 100 |
|---|---|
| 範囲 | 1–500 |
icaMethod="FOBI" | "GEOD" | "SYMM" | "UNCON"
id=list("variable-name-1" <, "variable-name-2", ...>)
レコード識別子として使用する変数名を指定します。
image="variable-name"
JPG、PNG、TIF、WIDE としてエンコードされた画像バイナリを含む列の名前を指定します。このパラメーターは inputs パラメーターと一緒に指定できません。
| 別名 | imageVar |
|---|
inputs=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
分析する数値変数を指定します。このパラメーターを省略すると、他のパラメーターで指定されていないすべての数値変数が分析されます。このパラメーターを画像パラメーターと同時に指定することはできません。
inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | input |
|---|---|
| vars | |
| var |
lambda=double
目的関数の疎行列の L1 ノルムで乗算される、目的関数 (ラムダ) の係数の値を指定します。デフォルト値は、1 をオブザベーション数の平方根または入力テーブル内の変数の数のいずれか大きい方で割った値として計算されます。
| 範囲 | (0–10000000000] |
|---|
lambdaWeight=double
ラムダの重みを指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | (0–10000000000] |
maxIter=integer
ロバストな主成分分析アルゴリズムの最大反復回数を指定します。
| デフォルト | 1000 |
|---|---|
| 最小値 | 0 |
method="ALM" | "APG"
mu=double
加速近接勾配法の目的関数で mu の初期値を指定します。
| デフォルト | 0.001 |
|---|---|
| 範囲 | 0–10000000000 |
nThreads=integer
各計算ノードで使用するスレッドの最大数を指定します。
| デフォルト | 16 |
|---|---|
| 範囲 | 0–1024 |
numSigVars=integer
SIGVARS 法と ICA-SIGVARS 法によって異常と見なされるために、オブザベーション内の重要な変数の最小数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_NUMSIGVARS を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| デフォルト | 1 |
|---|---|
| 最小値 | 1 |
outMat=list(outRpcaTabs)
ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。
outRpcaTabs の値は次のいずれかになります:
errMat=list(casouttable)
lowRankMat=list(casouttable)
低ランク行列の出力テーブルの名前を指定します。
lowRankMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
| 別名 | outLowRank |
|---|
sparseMat=list(casouttable)
outPca=list(outPcaTabs)
主成分分析の出力テーブルのパラメーターのリストを指定します。
outPcaTabs の値は次のいずれかになります:
pcLoadings=list(casouttable)
主成分負荷量の出力テーブルの名前を指定します。
pcLoadings パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
pcScores=list(casouttable)
主成分スコアの出力テーブルの名前を指定します。
pcScores パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
outputTables=list(outputTables)
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。
outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。
| 別名 | displayOut |
|---|
outSvd=list(outSvdTabs)
特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。
outSvdTabs の値は次のいずれかになります:
svdDiag=list(casouttable)
四角形の対角行列の対角ベクトルの出力テーブルの名前を指定します。
svdDiag パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
svdLeft=list(casouttable)
左特異ベクトルの出力テーブルの名前を指定します。
svdLeft パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
svdRight=list(casouttable)
右特異ベクトルの出力テーブルの名前を指定します。
svdRight パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
pcPrefix="string"
主成分の名前を付ける接頭辞を指定します。
| デフォルト | "Prin" |
|---|
saveState=list(casouttable)
aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。
saveState パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
scale=TRUE | FALSE
True に設定すると、数値変数を各列の標準偏差で尺度化します。
| 別名 | scaling |
|---|---|
| デフォルト | FALSE |
sigmaCoef=double
異常検出のための SIGVARS 法の標準化された疎値のしきい値、または R4S 法のしきい値に適用される係数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_SIGMACOEF を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| デフォルト | 1 |
|---|---|
| 最小値 | 1E-10 |
svdMaxRank=integer
特異値分解ソルバーで考慮されるランクの最大値を指定します。デフォルト値は、オブザベーションの数と入力テーブルの変数の数の小さい方です。
| 最小値 | 1 |
|---|
svdMethod="EIGEN" | "ITERATIVE" | "RANDOM"
svdRand=list(randomizedSvd)
svdMethod パラメーターの値が RANDOM の場合に使用するパラメーターのリストを指定します。
randomizedSvd の値は次のいずれかになります:
power=integer
パラメーター power を指定します。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
randSeed=integer
シード値を指定します。
| デフォルト | 0 |
|---|---|
| 最小値 | 1 |
* table=list(castable)
入力テーブルの設定を指定します。
| 長い形式 | table=list(name="table-name") |
|---|---|
| 短い形式 | table="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=TRUE | FALSE
True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | FALSE |
computedVars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメーターに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>)
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
orderBy=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
パーティション内でオブザベーションの並べ替えに使用する変数を指定します。このパラメーターは、パーティション化されたテーブルに適用されるか、groupByMode パラメーターの値が REDISTRIBUTE に設定されている場合に、groupBy パラメーターで指定された変数と組み合わせることができます。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
singlePass=TRUE | FALSE
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | FALSE |
|---|
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable=list(groupbytable)
WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルターテーブルの名前を指定します。
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
フィルターテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルターテーブルからデータをサブセット化する式を指定します。
tolerance=double
ロバストな主成分分析アルゴリズムの収束基準を指定します。
| 別名 | stopcriterion |
|---|---|
| デフォルト | 1E-07 |
| 最小値 | 1E-10 |
useMatrix=TRUE | FALSE
True に設定すると、異常検出法 SIGVARS と R4S におけるスコアリングオブザベーションの疎部分を標準化するために、疎行列の列の標準偏差を使用します。False に設定すると、アクションはその目的のために元の入力データの列の標準偏差を使用します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_USEMATRIX を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。
| デフォルト | FALSE |
|---|