モデルに基づくクラスタリング アクションセット: 構文

モデルに基づくクラスタリングを実行するアクションを提供します

mbcFit アクション

EM アルゴリズムを使用してモデルに基づくクラスタリングを実行します。

mbc.mbcFit <result=results> <status=rc> /
attributes
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
convergenceTest="AITKEN" | "LOGL",
covStruct="ALL" | "ALLGMIX" | "ALLPGMIX" | "CCC" | "CCU" | "CUC" | "CUU" | "EEE" | "EEI" | "EEV" | "EII" | "EVI" | "EVV" | "UCC" | "UCU" | "UUC" | "UUU" | "VII" | "VVI" | "VVV" | {"ALL", "ALLGMIX", "ALLPGMIX", "CCC", "CCU", "CUC", "CUU", "EEE", "EEI", "EEV", "EII", "EVI", "EVV", "UCC", "UCU", "UUC", "UUU", "VII", "VVI", "VVV"},
criterion="AIC" | "AICC" | "BIC" | "LOGL" | "NONE",
display
={
caseSensitive=TRUE | FALSE,
exclude=TRUE | FALSE,
excludeAll=TRUE | FALSE,
keyIsPath=TRUE | FALSE,
names={"string-1" <, "string-2", ...>},
pathType="LABEL" | "NAME",
traceNames=TRUE | FALSE
},
emEpsilon=double,
factorDetails=TRUE | FALSE,
groupByLimit=64-bit-integer,
initMethod="KMEANS" | "RANDOM",
maxIter=integer,
required parameter model
={
depVars
={{
name="variable-name"
}, {...}},
effects
={{
interaction="BAR" | "CROSS" | "NONE",
maxInteract=integer,
nest={"string-1" <, "string-2", ...>},
required parameter vars={"string-1" <, "string-2", ...>}
}, {...}}
},
nClusters=64-bit-integer | {64-bit-integer-1 <, 64-bit-integer-2, ...>},
nFactors=64-bit-integer | {64-bit-integer-1 <, 64-bit-integer-2, ...>},
noise="N" | "Y" | {"N", "Y"},
output
={
allstats=TRUE | FALSE,
casOut
={
caslib="string"
compress=TRUE | FALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
copyVars="ALL" | "ALL_MODEL" | "ALL_NUMERIC" | {"variable-name-1" <, "variable-name-2", ...>},
currClus="string",
loglik="string",
maxpost="string",
nextClus="string",
pred="string",
role="string"
},
outputTables
={
groupByVarsRaw=TRUE | FALSE,
includeAll=TRUE | FALSE,
names={"string-1" <, "string-2", ...>} | {key-1={casouttable-1} <, key-2={casouttable-2}, ...>},
repeated=TRUE | FALSE,
replace=TRUE | FALSE
},
seed=integer,
store
={
caslib="string",
label="string",
lifetime=64-bit-integer,
name="table-name",
promote=TRUE | FALSE,
replace=TRUE | FALSE,
},
required parameter table
={
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
computedVarsProgram="string",
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
groupBy
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
groupByMode="NOSORT" | "REDISTRIBUTE",
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
orderBy
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
singlePass=TRUE | FALSE,
vars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable
={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
technique="CEM" | "EM",
topModels=64-bit-integer
;
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

入力データテーブルを指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 output

required parametercasOut

observationwise クラスターメンバーシップの確率の推定値を含むテーブルを作成します。

 outputTables

names

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

 store

—

モデルを BLOB (バイナリラージオブジェクト) に格納します。

パラメーターの説明

attributes={{casinvardesc-1} <, {casinvardesc-2}, ...>}

このアクションで使用される変数の属性を変更します。現在、入力および名義パラメーターで指定された属性は無視されます。

attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名attribute
attr

convergenceTest="AITKEN" | "LOGL"

使用する収束判定を指定します。

デフォルトLOGL

covStruct="ALL" | "ALLGMIX" | "ALLPGMIX" | "CCC" | "CCU" | "CUC" | "CUU" | "EEE" | "EEI" | "EEV" | "EII" | "EVI" | "EVV" | "UCC" | "UCU" | "UUC" | "UUU" | "VII" | "VVI" | "VVV" | {"ALL", "ALLGMIX", "ALLPGMIX", "CCC", "CCU", "CUC", "CUU", "EEE", "EEI", "EEV", "EII", "EVI", "EVV", "UCC", "UCU", "UUC", "UUU", "VII", "VVI", "VVV"}

共分散モデルを指定します。

別名covModel
covType

criterion="AIC" | "AICC" | "BIC" | "LOGL" | "NONE"

モデルの選択基準を指定します。

デフォルトBIC

display={displayTables}

クライアントに表示するために送信する結果テーブルのリストを指定します。

display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。

emEpsilon=double

期待値最大化 (EM) アルゴリズムで対数尤度の収束基準を指定します。

別名emEps
convergence
conv
デフォルト1E-05
範囲0–1

factorDetails=TRUE | FALSE

True に設定すると、因子パターンと独自分散がパラメーター推定値テーブルに追加されます。

デフォルトFALSE

groupByLimit=64-bit-integer

BY グループの数が指定された値を超えた場合、分析を抑制します。

最小値1

initMethod="KMEANS" | "RANDOM"

初期化変数が指定されていない場合に使用する初期化メソッドを指定します。

デフォルトRANDOM

itHist="DETAILS" | "NONE" | "SUMMARY"

含める反復履歴の詳細レベルを指定します。

デフォルトNONE
DETAILS

詳細な反復履歴が含まれます。

NONE

反復履歴を生成しません。

SUMMARY

要約の反復履歴が含まれます。

maxIter=integer

期待値最大化 (EM) アルゴリズムの最大反復回数を指定します。

デフォルト500
範囲0–MACINT

* model={modelStatement}

分析に使用する変数 (効果) と初期クラスターメンバーシップ確率変数 (従属) を指定します。

modelStatement の値は次のいずれかになります:

depVars={{responsevar-1} <, {responsevar-2}, ...>}

モデルの応答変数として使用する 1 つ以上の変数を指定します。すべてのモデルが複数の応答変数をサポートしているわけではありません。

別名depVar
target
name="variable-name"

応答変数に名前を指定します。

effects={{effect-1} <, {effect-2}, ...>}

モデルを定義する効果のリストを指定します。このリストの各項は、vars パラメーターで指定された変数とその交互作用 (NONE、CROSS、BAR) で構成されます。交互作用が BAR の場合、maxInteract パラメーターによって制限されます。

effect の値は次のいずれかになります:

interaction="BAR" | "CROSS" | "NONE"

変数の交互作用の種類を指定します。

別名interact
デフォルトNONE
maxInteract=integer

BAR の交互作用と組み合わせて使用すると、指定した整数値よりも次数が高い交互作用の効果を排除します。

nest={"string-1" <, "string-2", ...>}

vars パラメーターによって定義された項内でネストされる変数を指定します。BAR または CROSS 交互作用の項では、ネストは vars パラメーターの最後の変数に対応します。交互作用のない項については、ネストは vars パラメーターにリストされているすべての変数に分散されます。

* vars={"string-1" <, "string-2", ...>}

効果の項を定義する際に使用する変数を指定します。少なくとも 1 つの変数を指定する必要があります。

nClusters=64-bit-integer | {64-bit-integer-1 <, 64-bit-integer-2, ...>}

ガウシアンクラスター数を指定します。

nFactors=64-bit-integer | {64-bit-integer-1 <, 64-bit-integer-2, ...>}

倹約的なガウシアン混合モデルで使用する因子の数を指定します。

noise="N" | "Y" | {"N", "Y"}

モデルにノイズクラスターを含めるかどうかを指定します。

別名hasNoiseCluster

output={mbcOutput}

observationwise クラスターメンバーシップの確率の推定値を含むテーブルを作成します。

mbcOutput の値は次のいずれかになります:

allstats=TRUE | FALSE

True に設定すると、すべての統計量が出力テーブルに追加されます。

デフォルトFALSE
* casOut={casouttable}

出力テーブルの設定を指定します。

casOut パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

copyVars="ALL" | "ALL_MODEL" | "ALL_NUMERIC" | {"variable-name-1" <, "variable-name-2", ...>}

入力テーブルから出力テーブルにコピーされる 1 つ以上の変数のリストを指定します。代わりに、すべての変数、モデリングで使用されるすべての変数、またはすべての数値変数を入力テーブルから出力テーブルにコピーする値 ALL、ALL_MODEL、またはALL_NUMERIC を指定することもできます。

currClus="string"

最終最大化 (M) ステップで平均および共分散の推定値を生成した期待値 (E) ステップからクラスターメンバーシップの確率推定値の名前付けに接頭部を指定します。

loglik="string"

クラスター対数尤度の名前を付ける接頭辞を指定します。

maxpost="string"

最大事後確率クラスターの名前を付ける接頭辞を指定します。

nextClus="string"

最終最大化 (M) ステップからの平均および共分散推定値を使用する追加の期待値 (E) ステップからのクラスターメンバーシップ確率推定値の名前付けに接頭部を指定します。

デフォルト"NEXT"
pred="string"

白色化変数の名前を付ける接頭辞を指定します。

role="string"

オブザベーションの役割を含む列の名前を指定します。

outputTables={outputTables}

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。

parameterEpsilon=double

混合重量がゼロとして扱われる、以下のバインドを指定します。

別名parmEps
デフォルト1E-08
範囲1E-15–1

seed=integer

初期クラスターメンバーシップが指定されていない場合に、初期クラスターメンバーシップを生成するために使用するシードを指定します。

最小値1

singularEpsilon=double

共分散行列の特異点の基準を指定します。

別名singEps
デフォルト1E-08
範囲1E-15–1

store={casouttable}

モデルを BLOB (バイナリラージオブジェクト) に格納します。

別名savestate
長い形式store={name="table-name"}
短い形式store="table-name"

casouttable の値は次のいずれかになります:

caslib="string"

出力テーブルの caslib の名前を指定します。

label="string"

テーブルに関連付ける説明ラベルを指定します。

lifetime=64-bit-integer

最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。

デフォルト0
最小値0
memoryFormat="DVR" | "INHERIT" | "STANDARD"

出力テーブルのメモリフォーマットを指定します。

デフォルトINHERIT
DVR

重複値削減メモリフォーマットを使用します。このメモリフォーマットでは、入力データに重複する値が含まれている場合に、メモリの消費量とファイルサイズを削減できます。

INHERIT

サーバーに設定されているデフォルトのメモリフォーマットを使用します。デフォルトでは、サーバーは標準のメモリフォーマットを使用します。管理者が CAS_DEFAULT_MEMORY_FORMAT 環境変数を DVR に設定した場合、DVR メモリフォーマットがサーバーのデフォルトとして設定されます。

STANDARD

標準メモリフォーマットを使用します。

name="table-name"

出力テーブルの名前を指定します。

promote=TRUE | FALSE

True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。

デフォルトFALSE
replace=TRUE | FALSE

True に設定すると、同じ名前の既存のテーブルは上書きされます。

デフォルトFALSE
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"

実行中の CAS サーバー上でワーカーポッドの数が増加した場合のテーブル再配布ポリシーを指定します。

DEFER

再配布ポリシーの選択を上位レベルのエンティティに延期します。

NOREDIST

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータを再配布しません。

REBALANCE

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータをリバランスします。

* table={castable}

入力データテーブルを指定します。

table パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。

technique="CEM" | "EM"

使用する期待値最大化 (EM) 手法を指定します。CEM は分類 EM 手法を指します。

デフォルトEM

topModels=64-bit-integer

モデル選択後に要約テーブルに表示する当てはめモデルの数を指定します。

デフォルト10
最小値1

mbcFit アクション

EM アルゴリズムを使用してモデルに基づくクラスタリングを実行します。

results, info = s:mbc_mbcFit{
attributes
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
convergenceTest="AITKEN" | "LOGL",
covStruct="ALL" | "ALLGMIX" | "ALLPGMIX" | "CCC" | "CCU" | "CUC" | "CUU" | "EEE" | "EEI" | "EEV" | "EII" | "EVI" | "EVV" | "UCC" | "UCU" | "UUC" | "UUU" | "VII" | "VVI" | "VVV" | {"ALL", "ALLGMIX", "ALLPGMIX", "CCC", "CCU", "CUC", "CUU", "EEE", "EEI", "EEV", "EII", "EVI", "EVV", "UCC", "UCU", "UUC", "UUU", "VII", "VVI", "VVV"},
criterion="AIC" | "AICC" | "BIC" | "LOGL" | "NONE",
display
={
caseSensitive=true | false,
exclude=true | false,
excludeAll=true | false,
keyIsPath=true | false,
names={"string-1" <, "string-2", ...>},
pathType="LABEL" | "NAME",
traceNames=true | false
},
emEpsilon=double,
factorDetails=true | false,
groupByLimit=64-bit-integer,
initMethod="KMEANS" | "RANDOM",
maxIter=integer,
required parameter model
={
depVars
={{
name="variable-name"
}, {...}},
effects
={{
interaction="BAR" | "CROSS" | "NONE",
maxInteract=integer,
nest={"string-1" <, "string-2", ...>},
required parameter vars={"string-1" <, "string-2", ...>}
}, {...}}
},
nClusters=64-bit-integer | {64-bit-integer-1 <, 64-bit-integer-2, ...>},
nFactors=64-bit-integer | {64-bit-integer-1 <, 64-bit-integer-2, ...>},
noise="N" | "Y" | {"N", "Y"},
output
={
allstats=true | false,
casOut
={
caslib="string"
compress=true | false
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=true | false
replace=true | false
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
copyVars="ALL" | "ALL_MODEL" | "ALL_NUMERIC" | {"variable-name-1" <, "variable-name-2", ...>},
currClus="string",
loglik="string",
maxpost="string",
nextClus="string",
pred="string",
role="string"
},
outputTables
={
groupByVarsRaw=true | false,
includeAll=true | false,
names={"string-1" <, "string-2", ...>} | {key-1={casouttable-1} <, key-2={casouttable-2}, ...>},
repeated=true | false,
replace=true | false
},
seed=integer,
store
={
caslib="string",
label="string",
lifetime=64-bit-integer,
name="table-name",
promote=true | false,
replace=true | false,
},
required parameter table
={
caslib="string",
computedOnDemand=true | false,
computedVars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
computedVarsProgram="string",
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
groupBy
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
groupByMode="NOSORT" | "REDISTRIBUTE",
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
orderBy
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
singlePass=true | false,
vars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable
={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
technique="CEM" | "EM",
topModels=64-bit-integer
}
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

入力データテーブルを指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 output

required parametercasOut

observationwise クラスターメンバーシップの確率の推定値を含むテーブルを作成します。

 outputTables

names

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

 store

—

モデルを BLOB (バイナリラージオブジェクト) に格納します。

パラメーターの説明

attributes={{casinvardesc-1} <, {casinvardesc-2}, ...>}

このアクションで使用される変数の属性を変更します。現在、入力および名義パラメーターで指定された属性は無視されます。

attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名attribute
attr

convergenceTest="AITKEN" | "LOGL"

使用する収束判定を指定します。

デフォルトLOGL

covStruct="ALL" | "ALLGMIX" | "ALLPGMIX" | "CCC" | "CCU" | "CUC" | "CUU" | "EEE" | "EEI" | "EEV" | "EII" | "EVI" | "EVV" | "UCC" | "UCU" | "UUC" | "UUU" | "VII" | "VVI" | "VVV" | {"ALL", "ALLGMIX", "ALLPGMIX", "CCC", "CCU", "CUC", "CUU", "EEE", "EEI", "EEV", "EII", "EVI", "EVV", "UCC", "UCU", "UUC", "UUU", "VII", "VVI", "VVV"}

共分散モデルを指定します。

別名covModel
covType

criterion="AIC" | "AICC" | "BIC" | "LOGL" | "NONE"

モデルの選択基準を指定します。

デフォルトBIC

display={displayTables}

クライアントに表示するために送信する結果テーブルのリストを指定します。

display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。

emEpsilon=double

期待値最大化 (EM) アルゴリズムで対数尤度の収束基準を指定します。

別名emEps
convergence
conv
デフォルト1E-05
範囲0–1

factorDetails=true | false

True に設定すると、因子パターンと独自分散がパラメーター推定値テーブルに追加されます。

デフォルトfalse

groupByLimit=64-bit-integer

BY グループの数が指定された値を超えた場合、分析を抑制します。

最小値1

initMethod="KMEANS" | "RANDOM"

初期化変数が指定されていない場合に使用する初期化メソッドを指定します。

デフォルトRANDOM

itHist="DETAILS" | "NONE" | "SUMMARY"

含める反復履歴の詳細レベルを指定します。

デフォルトNONE
DETAILS

詳細な反復履歴が含まれます。

NONE

反復履歴を生成しません。

SUMMARY

要約の反復履歴が含まれます。

maxIter=integer

期待値最大化 (EM) アルゴリズムの最大反復回数を指定します。

デフォルト500
範囲0–MACINT

* model={modelStatement}

分析に使用する変数 (効果) と初期クラスターメンバーシップ確率変数 (従属) を指定します。

modelStatement の値は次のいずれかになります:

depVars={{responsevar-1} <, {responsevar-2}, ...>}

モデルの応答変数として使用する 1 つ以上の変数を指定します。すべてのモデルが複数の応答変数をサポートしているわけではありません。

別名depVar
target
name="variable-name"

応答変数に名前を指定します。

effects={{effect-1} <, {effect-2}, ...>}

モデルを定義する効果のリストを指定します。このリストの各項は、vars パラメーターで指定された変数とその交互作用 (NONE、CROSS、BAR) で構成されます。交互作用が BAR の場合、maxInteract パラメーターによって制限されます。

effect の値は次のいずれかになります:

interaction="BAR" | "CROSS" | "NONE"

変数の交互作用の種類を指定します。

別名interact
デフォルトNONE
maxInteract=integer

BAR の交互作用と組み合わせて使用すると、指定した整数値よりも次数が高い交互作用の効果を排除します。

nest={"string-1" <, "string-2", ...>}

vars パラメーターによって定義された項内でネストされる変数を指定します。BAR または CROSS 交互作用の項では、ネストは vars パラメーターの最後の変数に対応します。交互作用のない項については、ネストは vars パラメーターにリストされているすべての変数に分散されます。

* vars={"string-1" <, "string-2", ...>}

効果の項を定義する際に使用する変数を指定します。少なくとも 1 つの変数を指定する必要があります。

nClusters=64-bit-integer | {64-bit-integer-1 <, 64-bit-integer-2, ...>}

ガウシアンクラスター数を指定します。

nFactors=64-bit-integer | {64-bit-integer-1 <, 64-bit-integer-2, ...>}

倹約的なガウシアン混合モデルで使用する因子の数を指定します。

noise="N" | "Y" | {"N", "Y"}

モデルにノイズクラスターを含めるかどうかを指定します。

別名hasNoiseCluster

output={mbcOutput}

observationwise クラスターメンバーシップの確率の推定値を含むテーブルを作成します。

mbcOutput の値は次のいずれかになります:

allstats=true | false

True に設定すると、すべての統計量が出力テーブルに追加されます。

デフォルトfalse
* casOut={casouttable}

出力テーブルの設定を指定します。

casOut パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

copyVars="ALL" | "ALL_MODEL" | "ALL_NUMERIC" | {"variable-name-1" <, "variable-name-2", ...>}

入力テーブルから出力テーブルにコピーされる 1 つ以上の変数のリストを指定します。代わりに、すべての変数、モデリングで使用されるすべての変数、またはすべての数値変数を入力テーブルから出力テーブルにコピーする値 ALL、ALL_MODEL、またはALL_NUMERIC を指定することもできます。

currClus="string"

最終最大化 (M) ステップで平均および共分散の推定値を生成した期待値 (E) ステップからクラスターメンバーシップの確率推定値の名前付けに接頭部を指定します。

loglik="string"

クラスター対数尤度の名前を付ける接頭辞を指定します。

maxpost="string"

最大事後確率クラスターの名前を付ける接頭辞を指定します。

nextClus="string"

最終最大化 (M) ステップからの平均および共分散推定値を使用する追加の期待値 (E) ステップからのクラスターメンバーシップ確率推定値の名前付けに接頭部を指定します。

デフォルト"NEXT"
pred="string"

白色化変数の名前を付ける接頭辞を指定します。

role="string"

オブザベーションの役割を含む列の名前を指定します。

outputTables={outputTables}

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。

parameterEpsilon=double

混合重量がゼロとして扱われる、以下のバインドを指定します。

別名parmEps
デフォルト1E-08
範囲1E-15–1

seed=integer

初期クラスターメンバーシップが指定されていない場合に、初期クラスターメンバーシップを生成するために使用するシードを指定します。

最小値1

singularEpsilon=double

共分散行列の特異点の基準を指定します。

別名singEps
デフォルト1E-08
範囲1E-15–1

store={casouttable}

モデルを BLOB (バイナリラージオブジェクト) に格納します。

別名savestate
長い形式store={name="table-name"}
短い形式store="table-name"

casouttable の値は次のいずれかになります:

caslib="string"

出力テーブルの caslib の名前を指定します。

label="string"

テーブルに関連付ける説明ラベルを指定します。

lifetime=64-bit-integer

最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。

デフォルト0
最小値0
memoryFormat="DVR" | "INHERIT" | "STANDARD"

出力テーブルのメモリフォーマットを指定します。

デフォルトINHERIT
DVR

重複値削減メモリフォーマットを使用します。このメモリフォーマットでは、入力データに重複する値が含まれている場合に、メモリの消費量とファイルサイズを削減できます。

INHERIT

サーバーに設定されているデフォルトのメモリフォーマットを使用します。デフォルトでは、サーバーは標準のメモリフォーマットを使用します。管理者が CAS_DEFAULT_MEMORY_FORMAT 環境変数を DVR に設定した場合、DVR メモリフォーマットがサーバーのデフォルトとして設定されます。

STANDARD

標準メモリフォーマットを使用します。

name="table-name"

出力テーブルの名前を指定します。

promote=true | false

True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。

デフォルトfalse
replace=true | false

True に設定すると、同じ名前の既存のテーブルは上書きされます。

デフォルトfalse
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"

実行中の CAS サーバー上でワーカーポッドの数が増加した場合のテーブル再配布ポリシーを指定します。

DEFER

再配布ポリシーの選択を上位レベルのエンティティに延期します。

NOREDIST

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータを再配布しません。

REBALANCE

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータをリバランスします。

* table={castable}

入力データテーブルを指定します。

table パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。

technique="CEM" | "EM"

使用する期待値最大化 (EM) 手法を指定します。CEM は分類 EM 手法を指します。

デフォルトEM

topModels=64-bit-integer

モデル選択後に要約テーブルに表示する当てはめモデルの数を指定します。

デフォルト10
最小値1

mbcFit アクション

EM アルゴリズムを使用してモデルに基づくクラスタリングを実行します。

results=s.mbc.mbcFit(
attributes
=[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
convergenceTest="AITKEN" | "LOGL",
covStruct="ALL" | "ALLGMIX" | "ALLPGMIX" | "CCC" | "CCU" | "CUC" | "CUU" | "EEE" | "EEI" | "EEV" | "EII" | "EVI" | "EVV" | "UCC" | "UCU" | "UUC" | "UUU" | "VII" | "VVI" | "VVV" | ["ALL", "ALLGMIX", "ALLPGMIX", "CCC", "CCU", "CUC", "CUU", "EEE", "EEI", "EEV", "EII", "EVI", "EVV", "UCC", "UCU", "UUC", "UUU", "VII", "VVI", "VVV"],
criterion="AIC" | "AICC" | "BIC" | "LOGL" | "NONE",
display
={
"caseSensitive":True | False,
"exclude":True | False,
"excludeAll":True | False,
"keyIsPath":True | False,
"names":["string-1" <, "string-2", ...>],
"pathType":"LABEL" | "NAME",
"traceNames":True | False
},
emEpsilon=double,
factorDetails=True | False,
groupByLimit=64-bit-integer,
initMethod="KMEANS" | "RANDOM",
maxIter=integer,
required parameter model
={
"depVars"
:[{
"name":"variable-name"
}<, {...}>],
"effects"
:[{
"interaction":"BAR" | "CROSS" | "NONE",
"maxInteract":integer,
"nest":["string-1" <, "string-2", ...>],
required parameter "vars":["string-1" <, "string-2", ...>]
}<, {...}>]
},
nClusters=64-bit-integer | [64-bit-integer-1 <, 64-bit-integer-2, ...>],
nFactors=64-bit-integer | [64-bit-integer-1 <, 64-bit-integer-2, ...>],
noise="N" | "Y" | ["N", "Y"],
output
={
"allstats":True | False,
"casOut"
:{
"caslib":"string"
"compress":True | False
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
"label":"string"
"lifetime":64-bit-integer
"maxMemSize":64-bit-integer
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"
"name":"table-name"
"promote":True | False
"replace":True | False
"replication":integer
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"
"threadBlockSize":64-bit-integer
"timeStamp":"string"
"where":["string-1" <, "string-2", ...>]
},
"copyVars":"ALL" | "ALL_MODEL" | "ALL_NUMERIC" | ["variable-name-1" <, "variable-name-2", ...>],
"currClus":"string",
"loglik":"string",
"maxpost":"string",
"nextClus":"string",
"pred":"string",
"role":"string"
},
outputTables
={
"groupByVarsRaw":True | False,
"includeAll":True | False,
"names":["string-1" <, "string-2", ...>] | {"key-1":{casouttable-1} <, "key-2":{casouttable-2}, ...>},
"repeated":True | False,
"replace":True | False
},
seed=integer,
store
={
"caslib":"string",
"label":"string",
"lifetime":64-bit-integer,
"name":"table-name",
"promote":True | False,
"replace":True | False,
},
required parameter table
={
"caslib":"string",
"computedOnDemand":True | False,
"computedVars"
:[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"computedVarsProgram":"string",
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>},
"groupBy"
:[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"groupByMode":"NOSORT" | "REDISTRIBUTE",
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter "name":"table-name",
"orderBy"
:[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"singlePass":True | False,
"vars"
:[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"where":"where-expression",
"whereTable"
:{
"casLib":"string"
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter "name":"table-name"
"vars"
:[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>]
"where":"where-expression"
}
},
technique="CEM" | "EM",
topModels=64-bit-integer
)
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

入力データテーブルを指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 output

required parametercasOut

observationwise クラスターメンバーシップの確率の推定値を含むテーブルを作成します。

 outputTables

names

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

 store

—

モデルを BLOB (バイナリラージオブジェクト) に格納します。

パラメーターの説明

attributes=[{casinvardesc-1} <, {casinvardesc-2}, ...>]

このアクションで使用される変数の属性を変更します。現在、入力および名義パラメーターで指定された属性は無視されます。

attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名attribute
attr

convergenceTest="AITKEN" | "LOGL"

使用する収束判定を指定します。

デフォルトLOGL

covStruct="ALL" | "ALLGMIX" | "ALLPGMIX" | "CCC" | "CCU" | "CUC" | "CUU" | "EEE" | "EEI" | "EEV" | "EII" | "EVI" | "EVV" | "UCC" | "UCU" | "UUC" | "UUU" | "VII" | "VVI" | "VVV" | ["ALL", "ALLGMIX", "ALLPGMIX", "CCC", "CCU", "CUC", "CUU", "EEE", "EEI", "EEV", "EII", "EVI", "EVV", "UCC", "UCU", "UUC", "UUU", "VII", "VVI", "VVV"]

共分散モデルを指定します。

別名covModel
covType

criterion="AIC" | "AICC" | "BIC" | "LOGL" | "NONE"

モデルの選択基準を指定します。

デフォルトBIC

display={displayTables}

クライアントに表示するために送信する結果テーブルのリストを指定します。

display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。

emEpsilon=double

期待値最大化 (EM) アルゴリズムで対数尤度の収束基準を指定します。

別名emEps
convergence
conv
デフォルト1E-05
範囲0–1

factorDetails=True | False

True に設定すると、因子パターンと独自分散がパラメーター推定値テーブルに追加されます。

デフォルトFalse

groupByLimit=64-bit-integer

BY グループの数が指定された値を超えた場合、分析を抑制します。

最小値1

initMethod="KMEANS" | "RANDOM"

初期化変数が指定されていない場合に使用する初期化メソッドを指定します。

デフォルトRANDOM

itHist="DETAILS" | "NONE" | "SUMMARY"

含める反復履歴の詳細レベルを指定します。

デフォルトNONE
DETAILS

詳細な反復履歴が含まれます。

NONE

反復履歴を生成しません。

SUMMARY

要約の反復履歴が含まれます。

maxIter=integer

期待値最大化 (EM) アルゴリズムの最大反復回数を指定します。

デフォルト500
範囲0–MACINT

* model={modelStatement}

分析に使用する変数 (効果) と初期クラスターメンバーシップ確率変数 (従属) を指定します。

modelStatement の値は次のいずれかになります:

"depVars":[{responsevar-1} <, {responsevar-2}, ...>]

モデルの応答変数として使用する 1 つ以上の変数を指定します。すべてのモデルが複数の応答変数をサポートしているわけではありません。

別名depVar
target
"name":"variable-name"

応答変数に名前を指定します。

"effects":[{effect-1} <, {effect-2}, ...>]

モデルを定義する効果のリストを指定します。このリストの各項は、vars パラメーターで指定された変数とその交互作用 (NONE、CROSS、BAR) で構成されます。交互作用が BAR の場合、maxInteract パラメーターによって制限されます。

effect の値は次のいずれかになります:

"interaction":"BAR" | "CROSS" | "NONE"

変数の交互作用の種類を指定します。

別名interact
デフォルトNONE
"maxInteract":integer

BAR の交互作用と組み合わせて使用すると、指定した整数値よりも次数が高い交互作用の効果を排除します。

"nest":["string-1" <, "string-2", ...>]

vars パラメーターによって定義された項内でネストされる変数を指定します。BAR または CROSS 交互作用の項では、ネストは vars パラメーターの最後の変数に対応します。交互作用のない項については、ネストは vars パラメーターにリストされているすべての変数に分散されます。

* "vars":["string-1" <, "string-2", ...>]

効果の項を定義する際に使用する変数を指定します。少なくとも 1 つの変数を指定する必要があります。

nClusters=64-bit-integer | [64-bit-integer-1 <, 64-bit-integer-2, ...>]

ガウシアンクラスター数を指定します。

nFactors=64-bit-integer | [64-bit-integer-1 <, 64-bit-integer-2, ...>]

倹約的なガウシアン混合モデルで使用する因子の数を指定します。

noise="N" | "Y" | ["N", "Y"]

モデルにノイズクラスターを含めるかどうかを指定します。

別名hasNoiseCluster

output={mbcOutput}

observationwise クラスターメンバーシップの確率の推定値を含むテーブルを作成します。

mbcOutput の値は次のいずれかになります:

"allstats":True | False

True に設定すると、すべての統計量が出力テーブルに追加されます。

デフォルトFalse
* "casOut":{casouttable}

出力テーブルの設定を指定します。

casOut パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

"copyVars":"ALL" | "ALL_MODEL" | "ALL_NUMERIC" | ["variable-name-1" <, "variable-name-2", ...>]

入力テーブルから出力テーブルにコピーされる 1 つ以上の変数のリストを指定します。代わりに、すべての変数、モデリングで使用されるすべての変数、またはすべての数値変数を入力テーブルから出力テーブルにコピーする値 ALL、ALL_MODEL、またはALL_NUMERIC を指定することもできます。

"currClus":"string"

最終最大化 (M) ステップで平均および共分散の推定値を生成した期待値 (E) ステップからクラスターメンバーシップの確率推定値の名前付けに接頭部を指定します。

"loglik":"string"

クラスター対数尤度の名前を付ける接頭辞を指定します。

"maxpost":"string"

最大事後確率クラスターの名前を付ける接頭辞を指定します。

"nextClus":"string"

最終最大化 (M) ステップからの平均および共分散推定値を使用する追加の期待値 (E) ステップからのクラスターメンバーシップ確率推定値の名前付けに接頭部を指定します。

デフォルト"NEXT"
"pred":"string"

白色化変数の名前を付ける接頭辞を指定します。

"role":"string"

オブザベーションの役割を含む列の名前を指定します。

outputTables={outputTables}

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。

parameterEpsilon=double

混合重量がゼロとして扱われる、以下のバインドを指定します。

別名parmEps
デフォルト1E-08
範囲1E-15–1

seed=integer

初期クラスターメンバーシップが指定されていない場合に、初期クラスターメンバーシップを生成するために使用するシードを指定します。

最小値1

singularEpsilon=double

共分散行列の特異点の基準を指定します。

別名singEps
デフォルト1E-08
範囲1E-15–1

store={casouttable}

モデルを BLOB (バイナリラージオブジェクト) に格納します。

別名savestate
長い形式store={"name":"table-name"}
短い形式store="table-name"

casouttable の値は次のいずれかになります:

"caslib":"string"

出力テーブルの caslib の名前を指定します。

"label":"string"

テーブルに関連付ける説明ラベルを指定します。

"lifetime":64-bit-integer

最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。

デフォルト0
最小値0
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"

出力テーブルのメモリフォーマットを指定します。

デフォルトINHERIT
DVR

重複値削減メモリフォーマットを使用します。このメモリフォーマットでは、入力データに重複する値が含まれている場合に、メモリの消費量とファイルサイズを削減できます。

INHERIT

サーバーに設定されているデフォルトのメモリフォーマットを使用します。デフォルトでは、サーバーは標準のメモリフォーマットを使用します。管理者が CAS_DEFAULT_MEMORY_FORMAT 環境変数を DVR に設定した場合、DVR メモリフォーマットがサーバーのデフォルトとして設定されます。

STANDARD

標準メモリフォーマットを使用します。

"name":"table-name"

出力テーブルの名前を指定します。

"promote":True | False

True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。

デフォルトFalse
"replace":True | False

True に設定すると、同じ名前の既存のテーブルは上書きされます。

デフォルトFalse
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"

実行中の CAS サーバー上でワーカーポッドの数が増加した場合のテーブル再配布ポリシーを指定します。

DEFER

再配布ポリシーの選択を上位レベルのエンティティに延期します。

NOREDIST

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータを再配布しません。

REBALANCE

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータをリバランスします。

* table={castable}

入力データテーブルを指定します。

table パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。

technique="CEM" | "EM"

使用する期待値最大化 (EM) 手法を指定します。CEM は分類 EM 手法を指します。

デフォルトEM

topModels=64-bit-integer

モデル選択後に要約テーブルに表示する当てはめモデルの数を指定します。

デフォルト10
最小値1

mbcFit アクション

EM アルゴリズムを使用してモデルに基づくクラスタリングを実行します。

results <– cas.mbc.mbcFit(s,
attributes
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
convergenceTest="AITKEN" | "LOGL",
covStruct="ALL" | "ALLGMIX" | "ALLPGMIX" | "CCC" | "CCU" | "CUC" | "CUU" | "EEE" | "EEI" | "EEV" | "EII" | "EVI" | "EVV" | "UCC" | "UCU" | "UUC" | "UUU" | "VII" | "VVI" | "VVV" | list("ALL", "ALLGMIX", "ALLPGMIX", "CCC", "CCU", "CUC", "CUU", "EEE", "EEI", "EEV", "EII", "EVI", "EVV", "UCC", "UCU", "UUC", "UUU", "VII", "VVI", "VVV"),
criterion="AIC" | "AICC" | "BIC" | "LOGL" | "NONE",
display
=list(
caseSensitive=TRUE | FALSE,
exclude=TRUE | FALSE,
excludeAll=TRUE | FALSE,
keyIsPath=TRUE | FALSE,
names=list("string-1" <, "string-2", ...>),
pathType="LABEL" | "NAME",
traceNames=TRUE | FALSE
),
emEpsilon=double,
factorDetails=TRUE | FALSE,
groupByLimit=64-bit-integer,
initMethod="KMEANS" | "RANDOM",
maxIter=integer,
required parameter model
=list(
depVars
=list( list(
name="variable-name"
) <, list(...)>),
effects
=list( list(
interaction="BAR" | "CROSS" | "NONE",
maxInteract=integer,
nest=list("string-1" <, "string-2", ...>),
required parameter vars=list("string-1" <, "string-2", ...>)
) <, list(...)>)
),
nClusters=64-bit-integer | list(64-bit-integer-1 <, 64-bit-integer-2, ...>),
nFactors=64-bit-integer | list(64-bit-integer-1 <, 64-bit-integer-2, ...>),
noise="N" | "Y" | list("N", "Y"),
output
=list(
allstats=TRUE | FALSE,
casOut
=list(
caslib="string"
compress=TRUE | FALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"
threadBlockSize=64-bit-integer
timeStamp="string"
where=list("string-1" <, "string-2", ...>)
),
copyVars="ALL" | "ALL_MODEL" | "ALL_NUMERIC" | list("variable-name-1" <, "variable-name-2", ...>),
currClus="string",
loglik="string",
maxpost="string",
nextClus="string",
pred="string",
role="string"
),
outputTables
=list(
groupByVarsRaw=TRUE | FALSE,
includeAll=TRUE | FALSE,
names=list("string-1" <, "string-2", ...>) | list(key-1=list(casouttable-1) <, key-2=list(casouttable-2), ...>),
repeated=TRUE | FALSE,
replace=TRUE | FALSE
),
seed=integer,
store
=list(
caslib="string",
label="string",
lifetime=64-bit-integer,
name="table-name",
promote=TRUE | FALSE,
replace=TRUE | FALSE,
),
required parameter table
=list(
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
computedVarsProgram="string",
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>),
groupBy
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
groupByMode="NOSORT" | "REDISTRIBUTE",
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters),
required parameter name="table-name",
orderBy
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
singlePass=TRUE | FALSE,
vars
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
where="where-expression",
whereTable
=list(
casLib="string"
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
required parameter name="table-name"
vars
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>)
where="where-expression"
)
),
technique="CEM" | "EM",
topModels=64-bit-integer
)
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

入力データテーブルを指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 output

required parametercasOut

observationwise クラスターメンバーシップの確率の推定値を含むテーブルを作成します。

 outputTables

names

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

 store

—

モデルを BLOB (バイナリラージオブジェクト) に格納します。

パラメーターの説明

attributes=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

このアクションで使用される変数の属性を変更します。現在、入力および名義パラメーターで指定された属性は無視されます。

attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名attribute
attr

convergenceTest="AITKEN" | "LOGL"

使用する収束判定を指定します。

デフォルトLOGL

covStruct="ALL" | "ALLGMIX" | "ALLPGMIX" | "CCC" | "CCU" | "CUC" | "CUU" | "EEE" | "EEI" | "EEV" | "EII" | "EVI" | "EVV" | "UCC" | "UCU" | "UUC" | "UUU" | "VII" | "VVI" | "VVV" | list("ALL", "ALLGMIX", "ALLPGMIX", "CCC", "CCU", "CUC", "CUU", "EEE", "EEI", "EEV", "EII", "EVI", "EVV", "UCC", "UCU", "UUC", "UUU", "VII", "VVI", "VVV")

共分散モデルを指定します。

別名covModel
covType

criterion="AIC" | "AICC" | "BIC" | "LOGL" | "NONE"

モデルの選択基準を指定します。

デフォルトBIC

display=list(displayTables)

クライアントに表示するために送信する結果テーブルのリストを指定します。

display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。

emEpsilon=double

期待値最大化 (EM) アルゴリズムで対数尤度の収束基準を指定します。

別名emEps
convergence
conv
デフォルト1E-05
範囲0–1

factorDetails=TRUE | FALSE

True に設定すると、因子パターンと独自分散がパラメーター推定値テーブルに追加されます。

デフォルトFALSE

groupByLimit=64-bit-integer

BY グループの数が指定された値を超えた場合、分析を抑制します。

最小値1

initMethod="KMEANS" | "RANDOM"

初期化変数が指定されていない場合に使用する初期化メソッドを指定します。

デフォルトRANDOM

itHist="DETAILS" | "NONE" | "SUMMARY"

含める反復履歴の詳細レベルを指定します。

デフォルトNONE
DETAILS

詳細な反復履歴が含まれます。

NONE

反復履歴を生成しません。

SUMMARY

要約の反復履歴が含まれます。

maxIter=integer

期待値最大化 (EM) アルゴリズムの最大反復回数を指定します。

デフォルト500
範囲0–MACINT

* model=list(modelStatement)

分析に使用する変数 (効果) と初期クラスターメンバーシップ確率変数 (従属) を指定します。

modelStatement の値は次のいずれかになります:

depVars=list( list(responsevar-1) <, list(responsevar-2), ...>)

モデルの応答変数として使用する 1 つ以上の変数を指定します。すべてのモデルが複数の応答変数をサポートしているわけではありません。

別名depVar
target
name="variable-name"

応答変数に名前を指定します。

effects=list( list(effect-1) <, list(effect-2), ...>)

モデルを定義する効果のリストを指定します。このリストの各項は、vars パラメーターで指定された変数とその交互作用 (NONE、CROSS、BAR) で構成されます。交互作用が BAR の場合、maxInteract パラメーターによって制限されます。

effect の値は次のいずれかになります:

interaction="BAR" | "CROSS" | "NONE"

変数の交互作用の種類を指定します。

別名interact
デフォルトNONE
maxInteract=integer

BAR の交互作用と組み合わせて使用すると、指定した整数値よりも次数が高い交互作用の効果を排除します。

nest=list("string-1" <, "string-2", ...>)

vars パラメーターによって定義された項内でネストされる変数を指定します。BAR または CROSS 交互作用の項では、ネストは vars パラメーターの最後の変数に対応します。交互作用のない項については、ネストは vars パラメーターにリストされているすべての変数に分散されます。

* vars=list("string-1" <, "string-2", ...>)

効果の項を定義する際に使用する変数を指定します。少なくとも 1 つの変数を指定する必要があります。

nClusters=64-bit-integer | list(64-bit-integer-1 <, 64-bit-integer-2, ...>)

ガウシアンクラスター数を指定します。

nFactors=64-bit-integer | list(64-bit-integer-1 <, 64-bit-integer-2, ...>)

倹約的なガウシアン混合モデルで使用する因子の数を指定します。

noise="N" | "Y" | list("N", "Y")

モデルにノイズクラスターを含めるかどうかを指定します。

別名hasNoiseCluster

output=list(mbcOutput)

observationwise クラスターメンバーシップの確率の推定値を含むテーブルを作成します。

mbcOutput の値は次のいずれかになります:

allstats=TRUE | FALSE

True に設定すると、すべての統計量が出力テーブルに追加されます。

デフォルトFALSE
* casOut=list(casouttable)

出力テーブルの設定を指定します。

casOut パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。

copyVars="ALL" | "ALL_MODEL" | "ALL_NUMERIC" | list("variable-name-1" <, "variable-name-2", ...>)

入力テーブルから出力テーブルにコピーされる 1 つ以上の変数のリストを指定します。代わりに、すべての変数、モデリングで使用されるすべての変数、またはすべての数値変数を入力テーブルから出力テーブルにコピーする値 ALL、ALL_MODEL、またはALL_NUMERIC を指定することもできます。

currClus="string"

最終最大化 (M) ステップで平均および共分散の推定値を生成した期待値 (E) ステップからクラスターメンバーシップの確率推定値の名前付けに接頭部を指定します。

loglik="string"

クラスター対数尤度の名前を付ける接頭辞を指定します。

maxpost="string"

最大事後確率クラスターの名前を付ける接頭辞を指定します。

nextClus="string"

最終最大化 (M) ステップからの平均および共分散推定値を使用する追加の期待値 (E) ステップからのクラスターメンバーシップ確率推定値の名前付けに接頭部を指定します。

デフォルト"NEXT"
pred="string"

白色化変数の名前を付ける接頭辞を指定します。

role="string"

オブザベーションの役割を含む列の名前を指定します。

outputTables=list(outputTables)

CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。

outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。

parameterEpsilon=double

混合重量がゼロとして扱われる、以下のバインドを指定します。

別名parmEps
デフォルト1E-08
範囲1E-15–1

seed=integer

初期クラスターメンバーシップが指定されていない場合に、初期クラスターメンバーシップを生成するために使用するシードを指定します。

最小値1

singularEpsilon=double

共分散行列の特異点の基準を指定します。

別名singEps
デフォルト1E-08
範囲1E-15–1

store=list(casouttable)

モデルを BLOB (バイナリラージオブジェクト) に格納します。

別名savestate
長い形式store=list(name="table-name")
短い形式store="table-name"

casouttable の値は次のいずれかになります:

caslib="string"

出力テーブルの caslib の名前を指定します。

label="string"

テーブルに関連付ける説明ラベルを指定します。

lifetime=64-bit-integer

最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。

デフォルト0
最小値0
memoryFormat="DVR" | "INHERIT" | "STANDARD"

出力テーブルのメモリフォーマットを指定します。

デフォルトINHERIT
DVR

重複値削減メモリフォーマットを使用します。このメモリフォーマットでは、入力データに重複する値が含まれている場合に、メモリの消費量とファイルサイズを削減できます。

INHERIT

サーバーに設定されているデフォルトのメモリフォーマットを使用します。デフォルトでは、サーバーは標準のメモリフォーマットを使用します。管理者が CAS_DEFAULT_MEMORY_FORMAT 環境変数を DVR に設定した場合、DVR メモリフォーマットがサーバーのデフォルトとして設定されます。

STANDARD

標準メモリフォーマットを使用します。

name="table-name"

出力テーブルの名前を指定します。

promote=TRUE | FALSE

True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。

デフォルトFALSE
replace=TRUE | FALSE

True に設定すると、同じ名前の既存のテーブルは上書きされます。

デフォルトFALSE
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"

実行中の CAS サーバー上でワーカーポッドの数が増加した場合のテーブル再配布ポリシーを指定します。

DEFER

再配布ポリシーの選択を上位レベルのエンティティに延期します。

NOREDIST

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータを再配布しません。

REBALANCE

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータをリバランスします。

* table=list(castable)

入力データテーブルを指定します。

table パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。

technique="CEM" | "EM"

使用する期待値最大化 (EM) 手法を指定します。CEM は分類 EM 手法を指します。

デフォルトEM

topModels=64-bit-integer

モデル選択後に要約テーブルに表示する当てはめモデルの数を指定します。

デフォルト10
最小値1
最終更新: 2026年3月26日