ロバスト PCA アクションセット: 構文

ロバスト主成分分析 (RPCA) と移動窓主成分分析 (MWPCA) のアクションを提供します

robustpca アクション

ロバスト主成分分析を実行します。

robustPca.robustpca <result=results> <status=rc> /
anomalyDetection=TRUE | FALSE,
attributes
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
center=TRUE | FALSE,
code
={
casOut
={
caslib="string"
compress=TRUE | FALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
comment=TRUE | FALSE,
fmtWdth=integer,
indentSize=integer,
labelId=integer,
lineSize=integer,
noTrim=TRUE | FALSE,
tabForm=TRUE | FALSE
},
colStatistics
={
caslib="string",
compress=TRUE | FALSE,
indexVars={"variable-name-1" <, "variable-name-2", ...>},
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
promote=TRUE | FALSE,
replace=TRUE | FALSE,
replication=integer,
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE",
threadBlockSize=64-bit-integer,
timeStamp="string",
where={"string-1" <, "string-2", ...>}
},
cumEigPctTol=double,
display
={
caseSensitive=TRUE | FALSE,
exclude=TRUE | FALSE,
excludeAll=TRUE | FALSE,
keyIsPath=TRUE | FALSE,
names={"string-1" <, "string-2", ...>},
pathType="LABEL" | "NAME",
traceNames=TRUE | FALSE
},
fixedMu=TRUE | FALSE,
freq="variable-name",
icaMaxiter=integer,
id={"variable-name-1" <, "variable-name-2", ...>},
image="variable-name",
inputs
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
lambda=double,
lambdaWeight=double,
maxIter=integer,
mu=double,
nThreads=integer,
numSigVars=integer,
outMat
={
errMat
={
caslib="string"
compress=TRUE | FALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
lowRankMat
={
caslib="string"
compress=TRUE | FALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
sparseMat
={
caslib="string"
compress=TRUE | FALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
}
},
outPca
={
pcLoadings
={
caslib="string"
compress=TRUE | FALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
pcScores
={
caslib="string"
compress=TRUE | FALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
}
},
outputTables
={
groupByVarsRaw=TRUE | FALSE,
includeAll=TRUE | FALSE,
names={"string-1" <, "string-2", ...>} | {key-1={casouttable-1} <, key-2={casouttable-2}, ...>},
repeated=TRUE | FALSE,
replace=TRUE | FALSE
},
outSvd
={
svdDiag
={
caslib="string"
compress=TRUE | FALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
svdLeft
={
caslib="string"
compress=TRUE | FALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
svdRight
={
caslib="string"
compress=TRUE | FALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
}
},
pcPrefix="string",
saveState
={
caslib="string",
compress=TRUE | FALSE,
indexVars={"variable-name-1" <, "variable-name-2", ...>},
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
promote=TRUE | FALSE,
replace=TRUE | FALSE,
replication=integer,
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE",
threadBlockSize=64-bit-integer,
timeStamp="string",
where={"string-1" <, "string-2", ...>}
},
scale=TRUE | FALSE,
sigmaCoef=double,
svdMaxRank=integer,
svdRand
={
power=integer,
randSeed=integer
},
required parameter table
={
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
orderBy
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
singlePass=TRUE | FALSE,
vars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable
={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
tolerance=double,
useMatrix=TRUE | FALSE
;
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

入力テーブルの設定を指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 code

casOut

SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。

 colStatistics

—

入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。

 outMat

lowRankMat, sparseMat, errMat

ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。

 outPca

pcLoadings, pcScores

主成分分析の出力テーブルのパラメーターのリストを指定します。

 outSvd

svdDiag, svdLeft, svdRight

特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。

 outputTables

names

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

 saveState

—

aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。

パラメーターの説明

anomalyDetection=TRUE | FALSE

True に設定すると、異常検出に後続のスコアアクションが使用されます。

別名anomaly
AD
デフォルトFALSE

anomalyDetectionMethod=integer

異常検出方法を指定します。この値を 0 に設定すると、異常検出に SIGVARS 法が使用されます。この値を 1 に設定すると、異常検出に R4S 法が使用されます。この値を 2 に設定すると、異常検出に ICA-SIGVARS 法が使用されます。この値を 3 に設定すると、異常検出に ICA-NORMS 法が使用されます。これらの異常検出方法の詳細については、詳細セクションを参照してください。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_ANOMALYDETECTION_METHOD を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

別名ADMethod
デフォルト0
範囲0–3

attributes={{casinvardesc-1} <, {casinvardesc-2}, ...>}

このアクションで使用される変数の属性を変更します。現在、入力および名義パラメーターで指定された属性は無視されます。

attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名attribute
attr

center=TRUE | FALSE

True に設定すると、数値変数を各列の平均で中心化します。

別名centering
デフォルトFALSE

code={rpcaCodegen}

SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。

rpcaCodegen の値は次のいずれかになります:

casOut={casouttable}

出力テーブルの設定を指定します。

casouttable の値は次のいずれかになります:

caslib="string"

出力テーブルの caslib の名前を指定します。

compress=TRUE | FALSE

True に設定すると、テーブルにデータ圧縮が適用されます。

デフォルトFALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}

出力データにインデックスを作成する変数のリストを指定します。

label="string"

テーブルに関連付ける説明ラベルを指定します。

lifetime=64-bit-integer

最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。

デフォルト0
最小値0
maxMemSize=64-bit-integer

メモリマップされたファイルに変換する前に、各スレッドがインメモリブロックに割り当てる必要があるメモリの最大容量をバイト単位で指定します。ファイルは、CAS_DISK_CACHE 環境変数で指定されたディレクトリに書き込まれます。

ヒント値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。
memoryFormat="DVR" | "INHERIT" | "STANDARD"

出力テーブルのメモリフォーマットを指定します。

デフォルトINHERIT
DVR

重複値削減メモリフォーマットを使用します。このメモリフォーマットでは、入力データに重複する値が含まれている場合に、メモリの消費量とファイルサイズを削減できます。

INHERIT

サーバーに設定されているデフォルトのメモリフォーマットを使用します。デフォルトでは、サーバーは標準のメモリフォーマットを使用します。管理者が CAS_DEFAULT_MEMORY_FORMAT 環境変数を DVR に設定した場合、DVR メモリフォーマットがサーバーのデフォルトとして設定されます。

STANDARD

標準メモリフォーマットを使用します。

name="table-name"

出力テーブルの名前を指定します。

promote=TRUE | FALSE

True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。

デフォルトFALSE
replace=TRUE | FALSE

True に設定すると、同じ名前の既存のテーブルは上書きされます。

デフォルトFALSE
replication=integer

フォールトトレランスのために作成するテーブルのコピー数を指定します。値を大きくすると、パフォーマンスが低下し、より多くのメモリが使用されますが、ノードに障害が発生した場合のデータの可用性が向上します。データの冗長性は、分散サーバーにのみ適用されます。

デフォルト1
最小値0
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"

実行中の CAS サーバー上でワーカーポッドの数が増加した場合のテーブル再配布ポリシーを指定します。

DEFER

再配布ポリシーの選択を上位レベルのエンティティに延期します。

NOREDIST

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータを再配布しません。

REBALANCE

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータをリバランスします。

threadBlockSize=64-bit-integer

出力テーブルのブロックに使用するバイト数を指定します。ブロックはスレッドによって読み取られます。数百万行または数十億行の大きなテーブルがあり、パフォーマンスを調整している場合は、この値を徐々に増やします。値を大きくすると、インデックス付きテーブルのパフォーマンスが向上します。ただし、値が大きすぎる場合、スレッドが動作するためのブロックが少なすぎるため、スレッド不足が発生する可能性があります。

別名blockSize
デフォルト1048576
最小値0
ヒント値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。
timeStamp="string"

タイムスタンプ列をテーブルに追加することを指定します。timeStamp のサポートはアクション固有です。セッションロケールに適した形式で値を指定します。

where={"string-1" <, "string-2", ...>}

出力データをサブセット化する 1 つ以上の式を指定します。複数の式が指定された場合、式は AND を使用して効果的に結合され、最終的な出力フィルタが形成されます。式に引用符で囲まれた値が含まれている場合は、ネストした引用符を使用します。

comment=TRUE | FALSE

True に設定すると、DATA ステップコードにコメントが追加されます。

デフォルトFALSE
fmtWdth=integer

DATA ステップコードでのパラメーター推定値などの派生数の書式設定に使用する幅を指定します。

別名fmtWidth
デフォルト20
範囲0–32
indentSize=integer

各レベルの DATA ステップコードをインデントするスペースの数を指定します。

デフォルト3
範囲0–10
labelId=integer

DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。

lineSize=integer

生成されたコードの行サイズを指定します。

デフォルト120
範囲64–254
noTrim=TRUE | FALSE

True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。

デフォルトFALSE
projectionType="LRS" | "PCA"

スコアリングのタイプを指定します。

デフォルトPCA
LRS

スコアリングオブザベーションを低ランク空間に投影します。

PCA

スコアリングオブザベーションを主成分に投影します。

tabForm=TRUE | FALSE

True に設定すると、テーブルの格納に適した方法でコードが生成されます。

別名tableForm
デフォルトFALSE

colStatistics={casouttable}

入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。

colStatistics パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

cumEigPctTol=double

低ランク行列のランクを決定する固有値の有意水準を指定します。

デフォルト1
範囲(0–1]

decomp="NONE" | "PCA" | "SVD"

低ランク行列の分解方法を指定します。maxiter パラメーターの値が 0 の場合、分解は低ランク行列ではなく元の入力データに適用されます。

デフォルトNONE
NONE

主成分分析も特異値分解も実行しません。

PCA

主成分分析を実行します。

SVD

特異値分解を実行します。

display={displayTables}

クライアントに表示するために送信する結果テーブルのリストを指定します。

display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。

fixedMu=TRUE | FALSE

True に設定すると、加速近接勾配法の各反復で mu が修正されます。それ以外の場合、mu は各反復で動的に更新されます。

デフォルトFALSE

freq="variable-name"

各オブザベーションの発生頻度を含む数値変数を指定します。

icaMaxiter=integer

学習時の Infomax ICA の最大反復回数を指定します。

デフォルト100
範囲1–500

icaMethod="FOBI" | "GEOD" | "SYMM" | "UNCON"

RPCA-ICA 異常検出の ICA 方法を指定します。

デフォルトFOBI
FOBI

ICA の Fourth Order Blind Identification 法を実行します。

GEOD

ICA の Geodesic Infomax 法を実行します。

SYMM

ICA の Symmetric Orthogonalized Infomax 法を実行します。

UNCON

ICA の unconstrained Infomax 法を実行します。

id={"variable-name-1" <, "variable-name-2", ...>}

レコード識別子として使用する変数名を指定します。

image="variable-name"

JPG、PNG、TIF、WIDE としてエンコードされた画像バイナリを含む列の名前を指定します。このパラメーターは inputs パラメーターと一緒に指定できません。

別名imageVar

inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}

分析する数値変数を指定します。このパラメーターを省略すると、他のパラメーターで指定されていないすべての数値変数が分析されます。このパラメーターを画像パラメーターと同時に指定することはできません。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名input
vars
var

lambda=double

目的関数の疎行列の L1 ノルムで乗算される、目的関数 (ラムダ) の係数の値を指定します。デフォルト値は、1 をオブザベーション数の平方根または入力テーブル内の変数の数のいずれか大きい方で割った値として計算されます。

範囲(0–10000000000]

lambdaWeight=double

ラムダの重みを指定します。

デフォルト1
範囲(0–10000000000]

maxIter=integer

ロバストな主成分分析アルゴリズムの最大反復回数を指定します。

デフォルト1000
最小値0

method="ALM" | "APG"

ロバスト主成分分析を実行するために使用する方法を指定します。

デフォルトALM
ALM

拡張 Lagrange 乗数法を使用します。

APG

加速近接勾配法を使用します。

mu=double

加速近接勾配法の目的関数で mu の初期値を指定します。

デフォルト0.001
範囲0–10000000000

nThreads=integer

各計算ノードで使用するスレッドの最大数を指定します。

デフォルト16
範囲0–1024

numSigVars=integer

SIGVARS 法と ICA-SIGVARS 法によって異常と見なされるために、オブザベーション内の重要な変数の最小数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_NUMSIGVARS を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

デフォルト1
最小値1

outMat={outRpcaTabs}

ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。

outRpcaTabs の値は次のいずれかになります:

errMat={casouttable}

誤差行列の出力テーブルの名前を指定します。

errMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

別名outError
lowRankMat={casouttable}

低ランク行列の出力テーブルの名前を指定します。

lowRankMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

別名outLowRank
sparseMat={casouttable}

疎行列の出力テーブルの名前を指定します。

sparseMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

別名outSparse

outPca={outPcaTabs}

主成分分析の出力テーブルのパラメーターのリストを指定します。

outPcaTabs の値は次のいずれかになります:

pcLoadings={casouttable}

主成分負荷量の出力テーブルの名前を指定します。

pcLoadings パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

pcScores={casouttable}

主成分スコアの出力テーブルの名前を指定します。

pcScores パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

outputTables={outputTables}

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。

別名displayOut

outSvd={outSvdTabs}

特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。

outSvdTabs の値は次のいずれかになります:

svdDiag={casouttable}

四角形の対角行列の対角ベクトルの出力テーブルの名前を指定します。

svdDiag パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

svdLeft={casouttable}

左特異ベクトルの出力テーブルの名前を指定します。

svdLeft パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

svdRight={casouttable}

右特異ベクトルの出力テーブルの名前を指定します。

svdRight パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

pcPrefix="string"

主成分の名前を付ける接頭辞を指定します。

デフォルト"Prin"

saveState={casouttable}

aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。

saveState パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

scale=TRUE | FALSE

True に設定すると、数値変数を各列の標準偏差で尺度化します。

別名scaling
デフォルトFALSE

sigmaCoef=double

異常検出のための SIGVARS 法の標準化された疎値のしきい値、または R4S 法のしきい値に適用される係数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_SIGMACOEF を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

デフォルト1
最小値1E-10

svdMaxRank=integer

特異値分解ソルバーで考慮されるランクの最大値を指定します。デフォルト値は、オブザベーションの数と入力テーブルの変数の数の小さい方です。

最小値1

svdMethod="EIGEN" | "ITERATIVE" | "RANDOM"

特異値分解ソルバーのタイプを指定します。

デフォルトEIGEN
EIGEN

固有値分解法を使用します。

ITERATIVE

反復特異値分解法を使用します。

RANDOM

ランダム化特異値分解法を使用します。

svdRand={randomizedSvd}

svdMethod パラメーターの値が RANDOM の場合に使用するパラメーターのリストを指定します。

randomizedSvd の値は次のいずれかになります:

power=integer

パラメーター power を指定します。

デフォルト0
最小値0
randSeed=integer

シード値を指定します。

デフォルト0
最小値1

* table={castable}

入力テーブルの設定を指定します。

長い形式table={name="table-name"}
短い形式table="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=TRUE | FALSE

True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。

別名compOnDemand
デフォルトFALSE
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメーターに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}

データソースオプションを指定します。

別名options
dataSource
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

orderBy={{casinvardesc-1} <, {casinvardesc-2}, ...>}

パーティション内でオブザベーションの並べ替えに使用する変数を指定します。このパラメーターは、パーティション化されたテーブルに適用されるか、groupByMode パラメーターの値が REDISTRIBUTE に設定されている場合に、groupBy パラメーターで指定された変数と組み合わせることができます。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

singlePass=TRUE | FALSE

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFALSE
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable={groupbytable}

WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルターテーブルの名前を指定します。

vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

フィルターテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルターテーブルからデータをサブセット化する式を指定します。

tolerance=double

ロバストな主成分分析アルゴリズムの収束基準を指定します。

別名stopcriterion
デフォルト1E-07
最小値1E-10

useMatrix=TRUE | FALSE

True に設定すると、異常検出法 SIGVARS と R4S におけるスコアリングオブザベーションの疎部分を標準化するために、疎行列の列の標準偏差を使用します。False に設定すると、アクションはその目的のために元の入力データの列の標準偏差を使用します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_USEMATRIX を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

デフォルトFALSE

robustpca アクション

ロバスト主成分分析を実行します。

results, info = s:robustPca_robustpca{
anomalyDetection=true | false,
attributes
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
center=true | false,
code
={
casOut
={
caslib="string"
compress=true | false
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
name="table-name"
promote=true | false
replace=true | false
replication=integer
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
comment=true | false,
fmtWdth=integer,
indentSize=integer,
labelId=integer,
lineSize=integer,
noTrim=true | false,
tabForm=true | false
},
colStatistics
={
caslib="string",
compress=true | false,
indexVars={"variable-name-1" <, "variable-name-2", ...>},
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
promote=true | false,
replace=true | false,
replication=integer,
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE",
threadBlockSize=64-bit-integer,
timeStamp="string",
where={"string-1" <, "string-2", ...>}
},
cumEigPctTol=double,
display
={
caseSensitive=true | false,
exclude=true | false,
excludeAll=true | false,
keyIsPath=true | false,
names={"string-1" <, "string-2", ...>},
pathType="LABEL" | "NAME",
traceNames=true | false
},
fixedMu=true | false,
freq="variable-name",
icaMaxiter=integer,
id={"variable-name-1" <, "variable-name-2", ...>},
image="variable-name",
inputs
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
lambda=double,
lambdaWeight=double,
maxIter=integer,
mu=double,
nThreads=integer,
numSigVars=integer,
outMat
={
errMat
={
caslib="string"
compress=true | false
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=true | false
replace=true | false
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
lowRankMat
={
caslib="string"
compress=true | false
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=true | false
replace=true | false
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
sparseMat
={
caslib="string"
compress=true | false
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=true | false
replace=true | false
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
}
},
outPca
={
pcLoadings
={
caslib="string"
compress=true | false
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=true | false
replace=true | false
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
pcScores
={
caslib="string"
compress=true | false
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=true | false
replace=true | false
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
}
},
outputTables
={
groupByVarsRaw=true | false,
includeAll=true | false,
names={"string-1" <, "string-2", ...>} | {key-1={casouttable-1} <, key-2={casouttable-2}, ...>},
repeated=true | false,
replace=true | false
},
outSvd
={
svdDiag
={
caslib="string"
compress=true | false
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=true | false
replace=true | false
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
svdLeft
={
caslib="string"
compress=true | false
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=true | false
replace=true | false
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
svdRight
={
caslib="string"
compress=true | false
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=true | false
replace=true | false
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
}
},
pcPrefix="string",
saveState
={
caslib="string",
compress=true | false,
indexVars={"variable-name-1" <, "variable-name-2", ...>},
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
promote=true | false,
replace=true | false,
replication=integer,
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE",
threadBlockSize=64-bit-integer,
timeStamp="string",
where={"string-1" <, "string-2", ...>}
},
scale=true | false,
sigmaCoef=double,
svdMaxRank=integer,
svdRand
={
power=integer,
randSeed=integer
},
required parameter table
={
caslib="string",
computedOnDemand=true | false,
computedVars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
orderBy
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
singlePass=true | false,
vars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable
={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
tolerance=double,
useMatrix=true | false
}
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

入力テーブルの設定を指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 code

casOut

SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。

 colStatistics

—

入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。

 outMat

lowRankMat, sparseMat, errMat

ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。

 outPca

pcLoadings, pcScores

主成分分析の出力テーブルのパラメーターのリストを指定します。

 outSvd

svdDiag, svdLeft, svdRight

特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。

 outputTables

names

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

 saveState

—

aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。

パラメーターの説明

anomalyDetection=true | false

True に設定すると、異常検出に後続のスコアアクションが使用されます。

別名anomaly
AD
デフォルトfalse

anomalyDetectionMethod=integer

異常検出方法を指定します。この値を 0 に設定すると、異常検出に SIGVARS 法が使用されます。この値を 1 に設定すると、異常検出に R4S 法が使用されます。この値を 2 に設定すると、異常検出に ICA-SIGVARS 法が使用されます。この値を 3 に設定すると、異常検出に ICA-NORMS 法が使用されます。これらの異常検出方法の詳細については、詳細セクションを参照してください。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_ANOMALYDETECTION_METHOD を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

別名ADMethod
デフォルト0
範囲0–3

attributes={{casinvardesc-1} <, {casinvardesc-2}, ...>}

このアクションで使用される変数の属性を変更します。現在、入力および名義パラメーターで指定された属性は無視されます。

attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名attribute
attr

center=true | false

True に設定すると、数値変数を各列の平均で中心化します。

別名centering
デフォルトfalse

code={rpcaCodegen}

SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。

rpcaCodegen の値は次のいずれかになります:

casOut={casouttable}

出力テーブルの設定を指定します。

casouttable の値は次のいずれかになります:

caslib="string"

出力テーブルの caslib の名前を指定します。

compress=true | false

True に設定すると、テーブルにデータ圧縮が適用されます。

デフォルトfalse
indexVars={"variable-name-1" <, "variable-name-2", ...>}

出力データにインデックスを作成する変数のリストを指定します。

label="string"

テーブルに関連付ける説明ラベルを指定します。

lifetime=64-bit-integer

最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。

デフォルト0
最小値0
maxMemSize=64-bit-integer

メモリマップされたファイルに変換する前に、各スレッドがインメモリブロックに割り当てる必要があるメモリの最大容量をバイト単位で指定します。ファイルは、CAS_DISK_CACHE 環境変数で指定されたディレクトリに書き込まれます。

ヒント値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。
memoryFormat="DVR" | "INHERIT" | "STANDARD"

出力テーブルのメモリフォーマットを指定します。

デフォルトINHERIT
DVR

重複値削減メモリフォーマットを使用します。このメモリフォーマットでは、入力データに重複する値が含まれている場合に、メモリの消費量とファイルサイズを削減できます。

INHERIT

サーバーに設定されているデフォルトのメモリフォーマットを使用します。デフォルトでは、サーバーは標準のメモリフォーマットを使用します。管理者が CAS_DEFAULT_MEMORY_FORMAT 環境変数を DVR に設定した場合、DVR メモリフォーマットがサーバーのデフォルトとして設定されます。

STANDARD

標準メモリフォーマットを使用します。

name="table-name"

出力テーブルの名前を指定します。

promote=true | false

True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。

デフォルトfalse
replace=true | false

True に設定すると、同じ名前の既存のテーブルは上書きされます。

デフォルトfalse
replication=integer

フォールトトレランスのために作成するテーブルのコピー数を指定します。値を大きくすると、パフォーマンスが低下し、より多くのメモリが使用されますが、ノードに障害が発生した場合のデータの可用性が向上します。データの冗長性は、分散サーバーにのみ適用されます。

デフォルト1
最小値0
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"

実行中の CAS サーバー上でワーカーポッドの数が増加した場合のテーブル再配布ポリシーを指定します。

DEFER

再配布ポリシーの選択を上位レベルのエンティティに延期します。

NOREDIST

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータを再配布しません。

REBALANCE

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータをリバランスします。

threadBlockSize=64-bit-integer

出力テーブルのブロックに使用するバイト数を指定します。ブロックはスレッドによって読み取られます。数百万行または数十億行の大きなテーブルがあり、パフォーマンスを調整している場合は、この値を徐々に増やします。値を大きくすると、インデックス付きテーブルのパフォーマンスが向上します。ただし、値が大きすぎる場合、スレッドが動作するためのブロックが少なすぎるため、スレッド不足が発生する可能性があります。

別名blockSize
デフォルト1048576
最小値0
ヒント値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。
timeStamp="string"

タイムスタンプ列をテーブルに追加することを指定します。timeStamp のサポートはアクション固有です。セッションロケールに適した形式で値を指定します。

where={"string-1" <, "string-2", ...>}

出力データをサブセット化する 1 つ以上の式を指定します。複数の式が指定された場合、式は AND を使用して効果的に結合され、最終的な出力フィルタが形成されます。式に引用符で囲まれた値が含まれている場合は、ネストした引用符を使用します。

comment=true | false

True に設定すると、DATA ステップコードにコメントが追加されます。

デフォルトfalse
fmtWdth=integer

DATA ステップコードでのパラメーター推定値などの派生数の書式設定に使用する幅を指定します。

別名fmtWidth
デフォルト20
範囲0–32
indentSize=integer

各レベルの DATA ステップコードをインデントするスペースの数を指定します。

デフォルト3
範囲0–10
labelId=integer

DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。

lineSize=integer

生成されたコードの行サイズを指定します。

デフォルト120
範囲64–254
noTrim=true | false

True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。

デフォルトfalse
projectionType="LRS" | "PCA"

スコアリングのタイプを指定します。

デフォルトPCA
LRS

スコアリングオブザベーションを低ランク空間に投影します。

PCA

スコアリングオブザベーションを主成分に投影します。

tabForm=true | false

True に設定すると、テーブルの格納に適した方法でコードが生成されます。

別名tableForm
デフォルトfalse

colStatistics={casouttable}

入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。

colStatistics パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

cumEigPctTol=double

低ランク行列のランクを決定する固有値の有意水準を指定します。

デフォルト1
範囲(0–1]

decomp="NONE" | "PCA" | "SVD"

低ランク行列の分解方法を指定します。maxiter パラメーターの値が 0 の場合、分解は低ランク行列ではなく元の入力データに適用されます。

デフォルトNONE
NONE

主成分分析も特異値分解も実行しません。

PCA

主成分分析を実行します。

SVD

特異値分解を実行します。

display={displayTables}

クライアントに表示するために送信する結果テーブルのリストを指定します。

display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。

fixedMu=true | false

True に設定すると、加速近接勾配法の各反復で mu が修正されます。それ以外の場合、mu は各反復で動的に更新されます。

デフォルトfalse

freq="variable-name"

各オブザベーションの発生頻度を含む数値変数を指定します。

icaMaxiter=integer

学習時の Infomax ICA の最大反復回数を指定します。

デフォルト100
範囲1–500

icaMethod="FOBI" | "GEOD" | "SYMM" | "UNCON"

RPCA-ICA 異常検出の ICA 方法を指定します。

デフォルトFOBI
FOBI

ICA の Fourth Order Blind Identification 法を実行します。

GEOD

ICA の Geodesic Infomax 法を実行します。

SYMM

ICA の Symmetric Orthogonalized Infomax 法を実行します。

UNCON

ICA の unconstrained Infomax 法を実行します。

id={"variable-name-1" <, "variable-name-2", ...>}

レコード識別子として使用する変数名を指定します。

image="variable-name"

JPG、PNG、TIF、WIDE としてエンコードされた画像バイナリを含む列の名前を指定します。このパラメーターは inputs パラメーターと一緒に指定できません。

別名imageVar

inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}

分析する数値変数を指定します。このパラメーターを省略すると、他のパラメーターで指定されていないすべての数値変数が分析されます。このパラメーターを画像パラメーターと同時に指定することはできません。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名input
vars
var

lambda=double

目的関数の疎行列の L1 ノルムで乗算される、目的関数 (ラムダ) の係数の値を指定します。デフォルト値は、1 をオブザベーション数の平方根または入力テーブル内の変数の数のいずれか大きい方で割った値として計算されます。

範囲(0–10000000000]

lambdaWeight=double

ラムダの重みを指定します。

デフォルト1
範囲(0–10000000000]

maxIter=integer

ロバストな主成分分析アルゴリズムの最大反復回数を指定します。

デフォルト1000
最小値0

method="ALM" | "APG"

ロバスト主成分分析を実行するために使用する方法を指定します。

デフォルトALM
ALM

拡張 Lagrange 乗数法を使用します。

APG

加速近接勾配法を使用します。

mu=double

加速近接勾配法の目的関数で mu の初期値を指定します。

デフォルト0.001
範囲0–10000000000

nThreads=integer

各計算ノードで使用するスレッドの最大数を指定します。

デフォルト16
範囲0–1024

numSigVars=integer

SIGVARS 法と ICA-SIGVARS 法によって異常と見なされるために、オブザベーション内の重要な変数の最小数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_NUMSIGVARS を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

デフォルト1
最小値1

outMat={outRpcaTabs}

ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。

outRpcaTabs の値は次のいずれかになります:

errMat={casouttable}

誤差行列の出力テーブルの名前を指定します。

errMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

別名outError
lowRankMat={casouttable}

低ランク行列の出力テーブルの名前を指定します。

lowRankMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

別名outLowRank
sparseMat={casouttable}

疎行列の出力テーブルの名前を指定します。

sparseMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

別名outSparse

outPca={outPcaTabs}

主成分分析の出力テーブルのパラメーターのリストを指定します。

outPcaTabs の値は次のいずれかになります:

pcLoadings={casouttable}

主成分負荷量の出力テーブルの名前を指定します。

pcLoadings パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

pcScores={casouttable}

主成分スコアの出力テーブルの名前を指定します。

pcScores パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

outputTables={outputTables}

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。

別名displayOut

outSvd={outSvdTabs}

特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。

outSvdTabs の値は次のいずれかになります:

svdDiag={casouttable}

四角形の対角行列の対角ベクトルの出力テーブルの名前を指定します。

svdDiag パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

svdLeft={casouttable}

左特異ベクトルの出力テーブルの名前を指定します。

svdLeft パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

svdRight={casouttable}

右特異ベクトルの出力テーブルの名前を指定します。

svdRight パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

pcPrefix="string"

主成分の名前を付ける接頭辞を指定します。

デフォルト"Prin"

saveState={casouttable}

aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。

saveState パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

scale=true | false

True に設定すると、数値変数を各列の標準偏差で尺度化します。

別名scaling
デフォルトfalse

sigmaCoef=double

異常検出のための SIGVARS 法の標準化された疎値のしきい値、または R4S 法のしきい値に適用される係数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_SIGMACOEF を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

デフォルト1
最小値1E-10

svdMaxRank=integer

特異値分解ソルバーで考慮されるランクの最大値を指定します。デフォルト値は、オブザベーションの数と入力テーブルの変数の数の小さい方です。

最小値1

svdMethod="EIGEN" | "ITERATIVE" | "RANDOM"

特異値分解ソルバーのタイプを指定します。

デフォルトEIGEN
EIGEN

固有値分解法を使用します。

ITERATIVE

反復特異値分解法を使用します。

RANDOM

ランダム化特異値分解法を使用します。

svdRand={randomizedSvd}

svdMethod パラメーターの値が RANDOM の場合に使用するパラメーターのリストを指定します。

randomizedSvd の値は次のいずれかになります:

power=integer

パラメーター power を指定します。

デフォルト0
最小値0
randSeed=integer

シード値を指定します。

デフォルト0
最小値1

* table={castable}

入力テーブルの設定を指定します。

長い形式table={name="table-name"}
短い形式table="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=true | false

True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。

別名compOnDemand
デフォルトfalse
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメーターに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}

データソースオプションを指定します。

別名options
dataSource
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

orderBy={{casinvardesc-1} <, {casinvardesc-2}, ...>}

パーティション内でオブザベーションの並べ替えに使用する変数を指定します。このパラメーターは、パーティション化されたテーブルに適用されるか、groupByMode パラメーターの値が REDISTRIBUTE に設定されている場合に、groupBy パラメーターで指定された変数と組み合わせることができます。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

singlePass=true | false

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトfalse
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable={groupbytable}

WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルターテーブルの名前を指定します。

vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

フィルターテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルターテーブルからデータをサブセット化する式を指定します。

tolerance=double

ロバストな主成分分析アルゴリズムの収束基準を指定します。

別名stopcriterion
デフォルト1E-07
最小値1E-10

useMatrix=true | false

True に設定すると、異常検出法 SIGVARS と R4S におけるスコアリングオブザベーションの疎部分を標準化するために、疎行列の列の標準偏差を使用します。False に設定すると、アクションはその目的のために元の入力データの列の標準偏差を使用します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_USEMATRIX を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

デフォルトfalse

robustpca アクション

ロバスト主成分分析を実行します。

results=s.robustPca.robustpca(
anomalyDetection=True | False,
attributes
=[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
center=True | False,
code
={
"casOut"
:{
"caslib":"string"
"compress":True | False
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
"label":"string"
"lifetime":64-bit-integer
"maxMemSize":64-bit-integer
"name":"table-name"
"promote":True | False
"replace":True | False
"replication":integer
"threadBlockSize":64-bit-integer
"timeStamp":"string"
"where":["string-1" <, "string-2", ...>]
},
"comment":True | False,
"fmtWdth":integer,
"indentSize":integer,
"labelId":integer,
"lineSize":integer,
"noTrim":True | False,
"tabForm":True | False
},
colStatistics
={
"caslib":"string",
"compress":True | False,
"indexVars":["variable-name-1" <, "variable-name-2", ...>],
"label":"string",
"lifetime":64-bit-integer,
"maxMemSize":64-bit-integer,
"memoryFormat":"DVR" | "INHERIT" | "STANDARD",
"name":"table-name",
"promote":True | False,
"replace":True | False,
"replication":integer,
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE",
"threadBlockSize":64-bit-integer,
"timeStamp":"string",
"where":["string-1" <, "string-2", ...>]
},
cumEigPctTol=double,
display
={
"caseSensitive":True | False,
"exclude":True | False,
"excludeAll":True | False,
"keyIsPath":True | False,
"names":["string-1" <, "string-2", ...>],
"pathType":"LABEL" | "NAME",
"traceNames":True | False
},
fixedMu=True | False,
freq="variable-name",
icaMaxiter=integer,
id=["variable-name-1" <, "variable-name-2", ...>],
image="variable-name",
inputs
=[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
lambda_=double,
lambdaWeight=double,
maxIter=integer,
mu=double,
nThreads=integer,
numSigVars=integer,
outMat
={
"errMat"
:{
"caslib":"string"
"compress":True | False
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
"label":"string"
"lifetime":64-bit-integer
"maxMemSize":64-bit-integer
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"
"name":"table-name"
"promote":True | False
"replace":True | False
"replication":integer
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"
"threadBlockSize":64-bit-integer
"timeStamp":"string"
"where":["string-1" <, "string-2", ...>]
},
"lowRankMat"
:{
"caslib":"string"
"compress":True | False
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
"label":"string"
"lifetime":64-bit-integer
"maxMemSize":64-bit-integer
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"
"name":"table-name"
"promote":True | False
"replace":True | False
"replication":integer
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"
"threadBlockSize":64-bit-integer
"timeStamp":"string"
"where":["string-1" <, "string-2", ...>]
},
"sparseMat"
:{
"caslib":"string"
"compress":True | False
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
"label":"string"
"lifetime":64-bit-integer
"maxMemSize":64-bit-integer
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"
"name":"table-name"
"promote":True | False
"replace":True | False
"replication":integer
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"
"threadBlockSize":64-bit-integer
"timeStamp":"string"
"where":["string-1" <, "string-2", ...>]
}
},
outPca
={
"pcLoadings"
:{
"caslib":"string"
"compress":True | False
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
"label":"string"
"lifetime":64-bit-integer
"maxMemSize":64-bit-integer
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"
"name":"table-name"
"promote":True | False
"replace":True | False
"replication":integer
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"
"threadBlockSize":64-bit-integer
"timeStamp":"string"
"where":["string-1" <, "string-2", ...>]
},
"pcScores"
:{
"caslib":"string"
"compress":True | False
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
"label":"string"
"lifetime":64-bit-integer
"maxMemSize":64-bit-integer
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"
"name":"table-name"
"promote":True | False
"replace":True | False
"replication":integer
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"
"threadBlockSize":64-bit-integer
"timeStamp":"string"
"where":["string-1" <, "string-2", ...>]
}
},
outputTables
={
"groupByVarsRaw":True | False,
"includeAll":True | False,
"names":["string-1" <, "string-2", ...>] | {"key-1":{casouttable-1} <, "key-2":{casouttable-2}, ...>},
"repeated":True | False,
"replace":True | False
},
outSvd
={
"svdDiag"
:{
"caslib":"string"
"compress":True | False
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
"label":"string"
"lifetime":64-bit-integer
"maxMemSize":64-bit-integer
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"
"name":"table-name"
"promote":True | False
"replace":True | False
"replication":integer
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"
"threadBlockSize":64-bit-integer
"timeStamp":"string"
"where":["string-1" <, "string-2", ...>]
},
"svdLeft"
:{
"caslib":"string"
"compress":True | False
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
"label":"string"
"lifetime":64-bit-integer
"maxMemSize":64-bit-integer
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"
"name":"table-name"
"promote":True | False
"replace":True | False
"replication":integer
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"
"threadBlockSize":64-bit-integer
"timeStamp":"string"
"where":["string-1" <, "string-2", ...>]
},
"svdRight"
:{
"caslib":"string"
"compress":True | False
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
"label":"string"
"lifetime":64-bit-integer
"maxMemSize":64-bit-integer
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"
"name":"table-name"
"promote":True | False
"replace":True | False
"replication":integer
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"
"threadBlockSize":64-bit-integer
"timeStamp":"string"
"where":["string-1" <, "string-2", ...>]
}
},
pcPrefix="string",
saveState
={
"caslib":"string",
"compress":True | False,
"indexVars":["variable-name-1" <, "variable-name-2", ...>],
"label":"string",
"lifetime":64-bit-integer,
"maxMemSize":64-bit-integer,
"memoryFormat":"DVR" | "INHERIT" | "STANDARD",
"name":"table-name",
"promote":True | False,
"replace":True | False,
"replication":integer,
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE",
"threadBlockSize":64-bit-integer,
"timeStamp":"string",
"where":["string-1" <, "string-2", ...>]
},
scale=True | False,
sigmaCoef=double,
svdMaxRank=integer,
svdRand
={
"power":integer,
"randSeed":integer
},
required parameter table
={
"caslib":"string",
"computedOnDemand":True | False,
"computedVars"
:[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>},
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter "name":"table-name",
"orderBy"
:[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"singlePass":True | False,
"vars"
:[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"where":"where-expression",
"whereTable"
:{
"casLib":"string"
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter "name":"table-name"
"vars"
:[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>]
"where":"where-expression"
}
},
tolerance=double,
useMatrix=True | False
)
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

入力テーブルの設定を指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 code

casOut

SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。

 colStatistics

—

入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。

 outMat

lowRankMat, sparseMat, errMat

ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。

 outPca

pcLoadings, pcScores

主成分分析の出力テーブルのパラメーターのリストを指定します。

 outSvd

svdDiag, svdLeft, svdRight

特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。

 outputTables

names

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

 saveState

—

aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。

パラメーターの説明

anomalyDetection=True | False

True に設定すると、異常検出に後続のスコアアクションが使用されます。

別名anomaly
AD
デフォルトFalse

anomalyDetectionMethod=integer

異常検出方法を指定します。この値を 0 に設定すると、異常検出に SIGVARS 法が使用されます。この値を 1 に設定すると、異常検出に R4S 法が使用されます。この値を 2 に設定すると、異常検出に ICA-SIGVARS 法が使用されます。この値を 3 に設定すると、異常検出に ICA-NORMS 法が使用されます。これらの異常検出方法の詳細については、詳細セクションを参照してください。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_ANOMALYDETECTION_METHOD を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

別名ADMethod
デフォルト0
範囲0–3

attributes=[{casinvardesc-1} <, {casinvardesc-2}, ...>]

このアクションで使用される変数の属性を変更します。現在、入力および名義パラメーターで指定された属性は無視されます。

attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名attribute
attr

center=True | False

True に設定すると、数値変数を各列の平均で中心化します。

別名centering
デフォルトFalse

code={rpcaCodegen}

SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。

rpcaCodegen の値は次のいずれかになります:

"casOut":{casouttable}

出力テーブルの設定を指定します。

casouttable の値は次のいずれかになります:

"caslib":"string"

出力テーブルの caslib の名前を指定します。

"compress":True | False

True に設定すると、テーブルにデータ圧縮が適用されます。

デフォルトFalse
"indexVars":["variable-name-1" <, "variable-name-2", ...>]

出力データにインデックスを作成する変数のリストを指定します。

"label":"string"

テーブルに関連付ける説明ラベルを指定します。

"lifetime":64-bit-integer

最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。

デフォルト0
最小値0
"maxMemSize":64-bit-integer

メモリマップされたファイルに変換する前に、各スレッドがインメモリブロックに割り当てる必要があるメモリの最大容量をバイト単位で指定します。ファイルは、CAS_DISK_CACHE 環境変数で指定されたディレクトリに書き込まれます。

ヒント値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"

出力テーブルのメモリフォーマットを指定します。

デフォルトINHERIT
DVR

重複値削減メモリフォーマットを使用します。このメモリフォーマットでは、入力データに重複する値が含まれている場合に、メモリの消費量とファイルサイズを削減できます。

INHERIT

サーバーに設定されているデフォルトのメモリフォーマットを使用します。デフォルトでは、サーバーは標準のメモリフォーマットを使用します。管理者が CAS_DEFAULT_MEMORY_FORMAT 環境変数を DVR に設定した場合、DVR メモリフォーマットがサーバーのデフォルトとして設定されます。

STANDARD

標準メモリフォーマットを使用します。

"name":"table-name"

出力テーブルの名前を指定します。

"promote":True | False

True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。

デフォルトFalse
"replace":True | False

True に設定すると、同じ名前の既存のテーブルは上書きされます。

デフォルトFalse
"replication":integer

フォールトトレランスのために作成するテーブルのコピー数を指定します。値を大きくすると、パフォーマンスが低下し、より多くのメモリが使用されますが、ノードに障害が発生した場合のデータの可用性が向上します。データの冗長性は、分散サーバーにのみ適用されます。

デフォルト1
最小値0
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"

実行中の CAS サーバー上でワーカーポッドの数が増加した場合のテーブル再配布ポリシーを指定します。

DEFER

再配布ポリシーの選択を上位レベルのエンティティに延期します。

NOREDIST

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータを再配布しません。

REBALANCE

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータをリバランスします。

"threadBlockSize":64-bit-integer

出力テーブルのブロックに使用するバイト数を指定します。ブロックはスレッドによって読み取られます。数百万行または数十億行の大きなテーブルがあり、パフォーマンスを調整している場合は、この値を徐々に増やします。値を大きくすると、インデックス付きテーブルのパフォーマンスが向上します。ただし、値が大きすぎる場合、スレッドが動作するためのブロックが少なすぎるため、スレッド不足が発生する可能性があります。

別名blockSize
デフォルト1048576
最小値0
ヒント値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。
"timeStamp":"string"

タイムスタンプ列をテーブルに追加することを指定します。timeStamp のサポートはアクション固有です。セッションロケールに適した形式で値を指定します。

"where":["string-1" <, "string-2", ...>]

出力データをサブセット化する 1 つ以上の式を指定します。複数の式が指定された場合、式は AND を使用して効果的に結合され、最終的な出力フィルタが形成されます。式に引用符で囲まれた値が含まれている場合は、ネストした引用符を使用します。

"comment":True | False

True に設定すると、DATA ステップコードにコメントが追加されます。

デフォルトFalse
"fmtWdth":integer

DATA ステップコードでのパラメーター推定値などの派生数の書式設定に使用する幅を指定します。

別名fmtWidth
デフォルト20
範囲0–32
"indentSize":integer

各レベルの DATA ステップコードをインデントするスペースの数を指定します。

デフォルト3
範囲0–10
"labelId":integer

DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。

"lineSize":integer

生成されたコードの行サイズを指定します。

デフォルト120
範囲64–254
"noTrim":True | False

True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。

デフォルトFalse
"projectionType":"LRS" | "PCA"

スコアリングのタイプを指定します。

デフォルトPCA
LRS

スコアリングオブザベーションを低ランク空間に投影します。

PCA

スコアリングオブザベーションを主成分に投影します。

"tabForm":True | False

True に設定すると、テーブルの格納に適した方法でコードが生成されます。

別名tableForm
デフォルトFalse

colStatistics={casouttable}

入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。

colStatistics パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

cumEigPctTol=double

低ランク行列のランクを決定する固有値の有意水準を指定します。

デフォルト1
範囲(0–1]

decomp="NONE" | "PCA" | "SVD"

低ランク行列の分解方法を指定します。maxiter パラメーターの値が 0 の場合、分解は低ランク行列ではなく元の入力データに適用されます。

デフォルトNONE
NONE

主成分分析も特異値分解も実行しません。

PCA

主成分分析を実行します。

SVD

特異値分解を実行します。

display={displayTables}

クライアントに表示するために送信する結果テーブルのリストを指定します。

display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。

fixedMu=True | False

True に設定すると、加速近接勾配法の各反復で mu が修正されます。それ以外の場合、mu は各反復で動的に更新されます。

デフォルトFalse

freq="variable-name"

各オブザベーションの発生頻度を含む数値変数を指定します。

icaMaxiter=integer

学習時の Infomax ICA の最大反復回数を指定します。

デフォルト100
範囲1–500

icaMethod="FOBI" | "GEOD" | "SYMM" | "UNCON"

RPCA-ICA 異常検出の ICA 方法を指定します。

デフォルトFOBI
FOBI

ICA の Fourth Order Blind Identification 法を実行します。

GEOD

ICA の Geodesic Infomax 法を実行します。

SYMM

ICA の Symmetric Orthogonalized Infomax 法を実行します。

UNCON

ICA の unconstrained Infomax 法を実行します。

id=["variable-name-1" <, "variable-name-2", ...>]

レコード識別子として使用する変数名を指定します。

image="variable-name"

JPG、PNG、TIF、WIDE としてエンコードされた画像バイナリを含む列の名前を指定します。このパラメーターは inputs パラメーターと一緒に指定できません。

別名imageVar

inputs=[{casinvardesc-1} <, {casinvardesc-2}, ...>]

分析する数値変数を指定します。このパラメーターを省略すると、他のパラメーターで指定されていないすべての数値変数が分析されます。このパラメーターを画像パラメーターと同時に指定することはできません。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名input
vars
var

lambda_=double

目的関数の疎行列の L1 ノルムで乗算される、目的関数 (ラムダ) の係数の値を指定します。デフォルト値は、1 をオブザベーション数の平方根または入力テーブル内の変数の数のいずれか大きい方で割った値として計算されます。

範囲(0–10000000000]

lambdaWeight=double

ラムダの重みを指定します。

デフォルト1
範囲(0–10000000000]

maxIter=integer

ロバストな主成分分析アルゴリズムの最大反復回数を指定します。

デフォルト1000
最小値0

method="ALM" | "APG"

ロバスト主成分分析を実行するために使用する方法を指定します。

デフォルトALM
ALM

拡張 Lagrange 乗数法を使用します。

APG

加速近接勾配法を使用します。

mu=double

加速近接勾配法の目的関数で mu の初期値を指定します。

デフォルト0.001
範囲0–10000000000

nThreads=integer

各計算ノードで使用するスレッドの最大数を指定します。

デフォルト16
範囲0–1024

numSigVars=integer

SIGVARS 法と ICA-SIGVARS 法によって異常と見なされるために、オブザベーション内の重要な変数の最小数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_NUMSIGVARS を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

デフォルト1
最小値1

outMat={outRpcaTabs}

ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。

outRpcaTabs の値は次のいずれかになります:

"errMat":{casouttable}

誤差行列の出力テーブルの名前を指定します。

errMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

別名outError
"lowRankMat":{casouttable}

低ランク行列の出力テーブルの名前を指定します。

lowRankMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

別名outLowRank
"sparseMat":{casouttable}

疎行列の出力テーブルの名前を指定します。

sparseMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

別名outSparse

outPca={outPcaTabs}

主成分分析の出力テーブルのパラメーターのリストを指定します。

outPcaTabs の値は次のいずれかになります:

"pcLoadings":{casouttable}

主成分負荷量の出力テーブルの名前を指定します。

pcLoadings パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

"pcScores":{casouttable}

主成分スコアの出力テーブルの名前を指定します。

pcScores パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

outputTables={outputTables}

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。

別名displayOut

outSvd={outSvdTabs}

特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。

outSvdTabs の値は次のいずれかになります:

"svdDiag":{casouttable}

四角形の対角行列の対角ベクトルの出力テーブルの名前を指定します。

svdDiag パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

"svdLeft":{casouttable}

左特異ベクトルの出力テーブルの名前を指定します。

svdLeft パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

"svdRight":{casouttable}

右特異ベクトルの出力テーブルの名前を指定します。

svdRight パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

pcPrefix="string"

主成分の名前を付ける接頭辞を指定します。

デフォルト"Prin"

saveState={casouttable}

aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。

saveState パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

scale=True | False

True に設定すると、数値変数を各列の標準偏差で尺度化します。

別名scaling
デフォルトFalse

sigmaCoef=double

異常検出のための SIGVARS 法の標準化された疎値のしきい値、または R4S 法のしきい値に適用される係数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_SIGMACOEF を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

デフォルト1
最小値1E-10

svdMaxRank=integer

特異値分解ソルバーで考慮されるランクの最大値を指定します。デフォルト値は、オブザベーションの数と入力テーブルの変数の数の小さい方です。

最小値1

svdMethod="EIGEN" | "ITERATIVE" | "RANDOM"

特異値分解ソルバーのタイプを指定します。

デフォルトEIGEN
EIGEN

固有値分解法を使用します。

ITERATIVE

反復特異値分解法を使用します。

RANDOM

ランダム化特異値分解法を使用します。

svdRand={randomizedSvd}

svdMethod パラメーターの値が RANDOM の場合に使用するパラメーターのリストを指定します。

randomizedSvd の値は次のいずれかになります:

"power":integer

パラメーター power を指定します。

デフォルト0
最小値0
"randSeed":integer

シード値を指定します。

デフォルト0
最小値1

* table={castable}

入力テーブルの設定を指定します。

長い形式table={"name":"table-name"}
短い形式table="table-name"

castable の値は次のいずれかになります:

"caslib":"string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

"computedOnDemand":True | False

True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。

別名compOnDemand
デフォルトFalse
"computedVars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"computedVarsProgram":"string"

computedVars パラメーターに含める各計算変数の式を指定します。

別名compPgm
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>}

データソースオプションを指定します。

別名options
dataSource
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import_

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* "name":"table-name"

入力テーブルの名前を指定します。

"orderBy":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

パーティション内でオブザベーションの並べ替えに使用する変数を指定します。このパラメーターは、パーティション化されたテーブルに適用されるか、groupByMode パラメーターの値が REDISTRIBUTE に設定されている場合に、groupBy パラメーターで指定された変数と組み合わせることができます。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"singlePass":True | False

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFalse
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"where":"where-expression"

入力データをサブセット化する式を指定します。

"whereTable":{groupbytable}

WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

"casLib":"string"

フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。

"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import_

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* "name":"table-name"

フィルターテーブルの名前を指定します。

"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

フィルターテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"where":"where-expression"

フィルターテーブルからデータをサブセット化する式を指定します。

tolerance=double

ロバストな主成分分析アルゴリズムの収束基準を指定します。

別名stopcriterion
デフォルト1E-07
最小値1E-10

useMatrix=True | False

True に設定すると、異常検出法 SIGVARS と R4S におけるスコアリングオブザベーションの疎部分を標準化するために、疎行列の列の標準偏差を使用します。False に設定すると、アクションはその目的のために元の入力データの列の標準偏差を使用します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_USEMATRIX を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

デフォルトFalse

robustpca アクション

ロバスト主成分分析を実行します。

results <– cas.robustPca.robustpca(s,
anomalyDetection=TRUE | FALSE,
attributes
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
center=TRUE | FALSE,
code
=list(
casOut
=list(
caslib="string"
compress=TRUE | FALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
threadBlockSize=64-bit-integer
timeStamp="string"
where=list("string-1" <, "string-2", ...>)
),
comment=TRUE | FALSE,
fmtWdth=integer,
indentSize=integer,
labelId=integer,
lineSize=integer,
noTrim=TRUE | FALSE,
tabForm=TRUE | FALSE
),
colStatistics
=list(
caslib="string",
compress=TRUE | FALSE,
indexVars=list("variable-name-1" <, "variable-name-2", ...>),
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
promote=TRUE | FALSE,
replace=TRUE | FALSE,
replication=integer,
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE",
threadBlockSize=64-bit-integer,
timeStamp="string",
where=list("string-1" <, "string-2", ...>)
),
cumEigPctTol=double,
display
=list(
caseSensitive=TRUE | FALSE,
exclude=TRUE | FALSE,
excludeAll=TRUE | FALSE,
keyIsPath=TRUE | FALSE,
names=list("string-1" <, "string-2", ...>),
pathType="LABEL" | "NAME",
traceNames=TRUE | FALSE
),
fixedMu=TRUE | FALSE,
freq="variable-name",
icaMaxiter=integer,
id=list("variable-name-1" <, "variable-name-2", ...>),
image="variable-name",
inputs
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
lambda=double,
lambdaWeight=double,
maxIter=integer,
mu=double,
nThreads=integer,
numSigVars=integer,
outMat
=list(
errMat
=list(
caslib="string"
compress=TRUE | FALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where=list("string-1" <, "string-2", ...>)
),
lowRankMat
=list(
caslib="string"
compress=TRUE | FALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where=list("string-1" <, "string-2", ...>)
),
sparseMat
=list(
caslib="string"
compress=TRUE | FALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where=list("string-1" <, "string-2", ...>)
)
),
outPca
=list(
pcLoadings
=list(
caslib="string"
compress=TRUE | FALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where=list("string-1" <, "string-2", ...>)
),
pcScores
=list(
caslib="string"
compress=TRUE | FALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where=list("string-1" <, "string-2", ...>)
)
),
outputTables
=list(
groupByVarsRaw=TRUE | FALSE,
includeAll=TRUE | FALSE,
names=list("string-1" <, "string-2", ...>) | list(key-1=list(casouttable-1) <, key-2=list(casouttable-2), ...>),
repeated=TRUE | FALSE,
replace=TRUE | FALSE
),
outSvd
=list(
svdDiag
=list(
caslib="string"
compress=TRUE | FALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where=list("string-1" <, "string-2", ...>)
),
svdLeft
=list(
caslib="string"
compress=TRUE | FALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where=list("string-1" <, "string-2", ...>)
),
svdRight
=list(
caslib="string"
compress=TRUE | FALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where=list("string-1" <, "string-2", ...>)
)
),
pcPrefix="string",
saveState
=list(
caslib="string",
compress=TRUE | FALSE,
indexVars=list("variable-name-1" <, "variable-name-2", ...>),
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
promote=TRUE | FALSE,
replace=TRUE | FALSE,
replication=integer,
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE",
threadBlockSize=64-bit-integer,
timeStamp="string",
where=list("string-1" <, "string-2", ...>)
),
scale=TRUE | FALSE,
sigmaCoef=double,
svdMaxRank=integer,
svdRand
=list(
power=integer,
randSeed=integer
),
required parameter table
=list(
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>),
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters),
required parameter name="table-name",
orderBy
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
singlePass=TRUE | FALSE,
vars
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
where="where-expression",
whereTable
=list(
casLib="string"
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
required parameter name="table-name"
vars
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>)
where="where-expression"
)
),
tolerance=double,
useMatrix=TRUE | FALSE
)
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

入力テーブルの設定を指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 code

casOut

SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。

 colStatistics

—

入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。

 outMat

lowRankMat, sparseMat, errMat

ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。

 outPca

pcLoadings, pcScores

主成分分析の出力テーブルのパラメーターのリストを指定します。

 outSvd

svdDiag, svdLeft, svdRight

特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。

 outputTables

names

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

 saveState

—

aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。

パラメーターの説明

anomalyDetection=TRUE | FALSE

True に設定すると、異常検出に後続のスコアアクションが使用されます。

別名anomaly
AD
デフォルトFALSE

anomalyDetectionMethod=integer

異常検出方法を指定します。この値を 0 に設定すると、異常検出に SIGVARS 法が使用されます。この値を 1 に設定すると、異常検出に R4S 法が使用されます。この値を 2 に設定すると、異常検出に ICA-SIGVARS 法が使用されます。この値を 3 に設定すると、異常検出に ICA-NORMS 法が使用されます。これらの異常検出方法の詳細については、詳細セクションを参照してください。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_ANOMALYDETECTION_METHOD を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

別名ADMethod
デフォルト0
範囲0–3

attributes=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

このアクションで使用される変数の属性を変更します。現在、入力および名義パラメーターで指定された属性は無視されます。

attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名attribute
attr

center=TRUE | FALSE

True に設定すると、数値変数を各列の平均で中心化します。

別名centering
デフォルトFALSE

code=list(rpcaCodegen)

SAS スコアコードを生成します。image パラメーターを指定すると、このパラメーターは無効になります。

rpcaCodegen の値は次のいずれかになります:

casOut=list(casouttable)

出力テーブルの設定を指定します。

casouttable の値は次のいずれかになります:

caslib="string"

出力テーブルの caslib の名前を指定します。

compress=TRUE | FALSE

True に設定すると、テーブルにデータ圧縮が適用されます。

デフォルトFALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)

出力データにインデックスを作成する変数のリストを指定します。

label="string"

テーブルに関連付ける説明ラベルを指定します。

lifetime=64-bit-integer

最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。

デフォルト0
最小値0
maxMemSize=64-bit-integer

メモリマップされたファイルに変換する前に、各スレッドがインメモリブロックに割り当てる必要があるメモリの最大容量をバイト単位で指定します。ファイルは、CAS_DISK_CACHE 環境変数で指定されたディレクトリに書き込まれます。

ヒント値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。
memoryFormat="DVR" | "INHERIT" | "STANDARD"

出力テーブルのメモリフォーマットを指定します。

デフォルトINHERIT
DVR

重複値削減メモリフォーマットを使用します。このメモリフォーマットでは、入力データに重複する値が含まれている場合に、メモリの消費量とファイルサイズを削減できます。

INHERIT

サーバーに設定されているデフォルトのメモリフォーマットを使用します。デフォルトでは、サーバーは標準のメモリフォーマットを使用します。管理者が CAS_DEFAULT_MEMORY_FORMAT 環境変数を DVR に設定した場合、DVR メモリフォーマットがサーバーのデフォルトとして設定されます。

STANDARD

標準メモリフォーマットを使用します。

name="table-name"

出力テーブルの名前を指定します。

promote=TRUE | FALSE

True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。

デフォルトFALSE
replace=TRUE | FALSE

True に設定すると、同じ名前の既存のテーブルは上書きされます。

デフォルトFALSE
replication=integer

フォールトトレランスのために作成するテーブルのコピー数を指定します。値を大きくすると、パフォーマンスが低下し、より多くのメモリが使用されますが、ノードに障害が発生した場合のデータの可用性が向上します。データの冗長性は、分散サーバーにのみ適用されます。

デフォルト1
最小値0
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"

実行中の CAS サーバー上でワーカーポッドの数が増加した場合のテーブル再配布ポリシーを指定します。

DEFER

再配布ポリシーの選択を上位レベルのエンティティに延期します。

NOREDIST

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータを再配布しません。

REBALANCE

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータをリバランスします。

threadBlockSize=64-bit-integer

出力テーブルのブロックに使用するバイト数を指定します。ブロックはスレッドによって読み取られます。数百万行または数十億行の大きなテーブルがあり、パフォーマンスを調整している場合は、この値を徐々に増やします。値を大きくすると、インデックス付きテーブルのパフォーマンスが向上します。ただし、値が大きすぎる場合、スレッドが動作するためのブロックが少なすぎるため、スレッド不足が発生する可能性があります。

別名blockSize
デフォルト1048576
最小値0
ヒント値を引用符で囲み、B、K、M、G または T を接尾辞として指定して単位を示せます。たとえば、"8M" は 8 MB を示します。
timeStamp="string"

タイムスタンプ列をテーブルに追加することを指定します。timeStamp のサポートはアクション固有です。セッションロケールに適した形式で値を指定します。

where=list("string-1" <, "string-2", ...>)

出力データをサブセット化する 1 つ以上の式を指定します。複数の式が指定された場合、式は AND を使用して効果的に結合され、最終的な出力フィルタが形成されます。式に引用符で囲まれた値が含まれている場合は、ネストした引用符を使用します。

comment=TRUE | FALSE

True に設定すると、DATA ステップコードにコメントが追加されます。

デフォルトFALSE
fmtWdth=integer

DATA ステップコードでのパラメーター推定値などの派生数の書式設定に使用する幅を指定します。

別名fmtWidth
デフォルト20
範囲0–32
indentSize=integer

各レベルの DATA ステップコードをインデントするスペースの数を指定します。

デフォルト3
範囲0–10
labelId=integer

DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。

lineSize=integer

生成されたコードの行サイズを指定します。

デフォルト120
範囲64–254
noTrim=TRUE | FALSE

True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。

デフォルトFALSE
projectionType="LRS" | "PCA"

スコアリングのタイプを指定します。

デフォルトPCA
LRS

スコアリングオブザベーションを低ランク空間に投影します。

PCA

スコアリングオブザベーションを主成分に投影します。

tabForm=TRUE | FALSE

True に設定すると、テーブルの格納に適した方法でコードが生成されます。

別名tableForm
デフォルトFALSE

colStatistics=list(casouttable)

入力データセットの変数に関する単純統計量を含める出力テーブルの名前を指定します。image パラメーターを指定すると、このパラメーターは無効になります。

colStatistics パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

cumEigPctTol=double

低ランク行列のランクを決定する固有値の有意水準を指定します。

デフォルト1
範囲(0–1]

decomp="NONE" | "PCA" | "SVD"

低ランク行列の分解方法を指定します。maxiter パラメーターの値が 0 の場合、分解は低ランク行列ではなく元の入力データに適用されます。

デフォルトNONE
NONE

主成分分析も特異値分解も実行しません。

PCA

主成分分析を実行します。

SVD

特異値分解を実行します。

display=list(displayTables)

クライアントに表示するために送信する結果テーブルのリストを指定します。

display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。

fixedMu=TRUE | FALSE

True に設定すると、加速近接勾配法の各反復で mu が修正されます。それ以外の場合、mu は各反復で動的に更新されます。

デフォルトFALSE

freq="variable-name"

各オブザベーションの発生頻度を含む数値変数を指定します。

icaMaxiter=integer

学習時の Infomax ICA の最大反復回数を指定します。

デフォルト100
範囲1–500

icaMethod="FOBI" | "GEOD" | "SYMM" | "UNCON"

RPCA-ICA 異常検出の ICA 方法を指定します。

デフォルトFOBI
FOBI

ICA の Fourth Order Blind Identification 法を実行します。

GEOD

ICA の Geodesic Infomax 法を実行します。

SYMM

ICA の Symmetric Orthogonalized Infomax 法を実行します。

UNCON

ICA の unconstrained Infomax 法を実行します。

id=list("variable-name-1" <, "variable-name-2", ...>)

レコード識別子として使用する変数名を指定します。

image="variable-name"

JPG、PNG、TIF、WIDE としてエンコードされた画像バイナリを含む列の名前を指定します。このパラメーターは inputs パラメーターと一緒に指定できません。

別名imageVar

inputs=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

分析する数値変数を指定します。このパラメーターを省略すると、他のパラメーターで指定されていないすべての数値変数が分析されます。このパラメーターを画像パラメーターと同時に指定することはできません。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名input
vars
var

lambda=double

目的関数の疎行列の L1 ノルムで乗算される、目的関数 (ラムダ) の係数の値を指定します。デフォルト値は、1 をオブザベーション数の平方根または入力テーブル内の変数の数のいずれか大きい方で割った値として計算されます。

範囲(0–10000000000]

lambdaWeight=double

ラムダの重みを指定します。

デフォルト1
範囲(0–10000000000]

maxIter=integer

ロバストな主成分分析アルゴリズムの最大反復回数を指定します。

デフォルト1000
最小値0

method="ALM" | "APG"

ロバスト主成分分析を実行するために使用する方法を指定します。

デフォルトALM
ALM

拡張 Lagrange 乗数法を使用します。

APG

加速近接勾配法を使用します。

mu=double

加速近接勾配法の目的関数で mu の初期値を指定します。

デフォルト0.001
範囲0–10000000000

nThreads=integer

各計算ノードで使用するスレッドの最大数を指定します。

デフォルト16
範囲0–1024

numSigVars=integer

SIGVARS 法と ICA-SIGVARS 法によって異常と見なされるために、オブザベーション内の重要な変数の最小数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_NUMSIGVARS を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

デフォルト1
最小値1

outMat=list(outRpcaTabs)

ロバストな主成分分析法の出力テーブルのパラメーターのリストを指定します。

outRpcaTabs の値は次のいずれかになります:

errMat=list(casouttable)

誤差行列の出力テーブルの名前を指定します。

errMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

別名outError
lowRankMat=list(casouttable)

低ランク行列の出力テーブルの名前を指定します。

lowRankMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

別名outLowRank
sparseMat=list(casouttable)

疎行列の出力テーブルの名前を指定します。

sparseMat パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

別名outSparse

outPca=list(outPcaTabs)

主成分分析の出力テーブルのパラメーターのリストを指定します。

outPcaTabs の値は次のいずれかになります:

pcLoadings=list(casouttable)

主成分負荷量の出力テーブルの名前を指定します。

pcLoadings パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

pcScores=list(casouttable)

主成分スコアの出力テーブルの名前を指定します。

pcScores パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

outputTables=list(outputTables)

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。

別名displayOut

outSvd=list(outSvdTabs)

特異値分解の出力テーブルのパラメーターのリストを指定します。image パラメーターを指定すると、このパラメーターは無効になります。

outSvdTabs の値は次のいずれかになります:

svdDiag=list(casouttable)

四角形の対角行列の対角ベクトルの出力テーブルの名前を指定します。

svdDiag パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

svdLeft=list(casouttable)

左特異ベクトルの出力テーブルの名前を指定します。

svdLeft パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

svdRight=list(casouttable)

右特異ベクトルの出力テーブルの名前を指定します。

svdRight パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

pcPrefix="string"

主成分の名前を付ける接頭辞を指定します。

デフォルト"Prin"

saveState=list(casouttable)

aStore アクションセットのスコアアクションで使用されるスコアリング結果を保存する出力データテーブルを指定します。スコアアクションのオプションパラメーターで RPCA_PROJECTION_TYPE サブパラメーターを指定できます: 値 0 はスコアリングオブザベーションを主成分空間に投影します; 値 1 はスコアリングオブザベーションを低ランクのサブスペースに投影します; 値 2 はスコアリングオブザベーションを低ランクのサブスペースに投影しますが、スコアリングデータの疎部分はスコアリング結果テーブルに格納されます。image パラメーターを使用してテーブルを生成する場合、値 0 は使用できません。

saveState パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

scale=TRUE | FALSE

True に設定すると、数値変数を各列の標準偏差で尺度化します。

別名scaling
デフォルトFALSE

sigmaCoef=double

異常検出のための SIGVARS 法の標準化された疎値のしきい値、または R4S 法のしきい値に適用される係数を指定します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_SIGMACOEF を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

デフォルト1
最小値1E-10

svdMaxRank=integer

特異値分解ソルバーで考慮されるランクの最大値を指定します。デフォルト値は、オブザベーションの数と入力テーブルの変数の数の小さい方です。

最小値1

svdMethod="EIGEN" | "ITERATIVE" | "RANDOM"

特異値分解ソルバーのタイプを指定します。

デフォルトEIGEN
EIGEN

固有値分解法を使用します。

ITERATIVE

反復特異値分解法を使用します。

RANDOM

ランダム化特異値分解法を使用します。

svdRand=list(randomizedSvd)

svdMethod パラメーターの値が RANDOM の場合に使用するパラメーターのリストを指定します。

randomizedSvd の値は次のいずれかになります:

power=integer

パラメーター power を指定します。

デフォルト0
最小値0
randSeed=integer

シード値を指定します。

デフォルト0
最小値1

* table=list(castable)

入力テーブルの設定を指定します。

長い形式table=list(name="table-name")
短い形式table="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=TRUE | FALSE

True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。

別名compOnDemand
デフォルトFALSE
computedVars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメーターに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>)

データソースオプションを指定します。

別名options
dataSource
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

orderBy=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

パーティション内でオブザベーションの並べ替えに使用する変数を指定します。このパラメーターは、パーティション化されたテーブルに適用されるか、groupByMode パラメーターの値が REDISTRIBUTE に設定されている場合に、groupBy パラメーターで指定された変数と組み合わせることができます。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

singlePass=TRUE | FALSE

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFALSE
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable=list(groupbytable)

WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルターテーブルの名前を指定します。

vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

フィルターテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルターテーブルからデータをサブセット化する式を指定します。

tolerance=double

ロバストな主成分分析アルゴリズムの収束基準を指定します。

別名stopcriterion
デフォルト1E-07
最小値1E-10

useMatrix=TRUE | FALSE

True に設定すると、異常検出法 SIGVARS と R4S におけるスコアリングオブザベーションの疎部分を標準化するために、疎行列の列の標準偏差を使用します。False に設定すると、アクションはその目的のために元の入力データの列の標準偏差を使用します。スコアアクションのオプションパラメーターの各サブパラメーターに次の値を指定することにより、このパラメーターをオーバーライドできます。RPCA_USEMATRIX を名前サブパラメーターの値として指定し、値サブパラメーターのオーバーライド値を指定します。

デフォルトFALSE
最終更新: 2026年3月26日