ディシジョンツリー アクションセット: 構文

デシジョンツリー、フォレスト、および勾配ブースティングによるモデリングおよびスコアリングのアクションを提供します

forestScore アクション

フォレストモデルを使用してテーブルをスコアリングします。

CASL 構文

decisionTree.forestScore <result=results> <status=rc> /
applyRowOrder=TRUE | FALSE,
assess=TRUE | FALSE,
assessOneRow=TRUE | FALSE,
casOut={
caslib="string",
compress=TRUE | FALSE,
indexVars={"variable-name-1" <, "variable-name-2", ...>},
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
onDemand=TRUE | FALSE,
promote=TRUE | FALSE,
replace=TRUE | FALSE,
replication=integer,
threadBlockSize=64-bit-integer,
timeStamp="string",
where={"string-1" <, "string-2", ...>}
},
copyVars={"variable-name-1" <, "variable-name-2", ...>},
encodeName=TRUE | FALSE,
impute=TRUE | FALSE,
includeMissing=TRUE | FALSE,
isolation=TRUE | FALSE,
modelId="string",
required parameter modelTable={
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
singlePass=TRUE | FALSE,
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
nTree=integer,
rbaImp=TRUE | FALSE,
seed=double,
required parameter table={
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
singlePass=TRUE | FALSE,
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
target="variable-name",
treeError=TRUE | FALSE,
treeVotes=TRUE | FALSE,
varIntImp=integer,
;
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametermodelTable

—

モデルを含むテーブルを指定します。

required parametertable

—

入力テーブルの設定を指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 casOut

—

スコアリングされた結果を格納するテーブルを指定します。指定しない場合、アクションはデータセットをスコアリングし、分類の誤分類率と回帰の平均二乗誤差のみを計算します。

パラメーターの説明

applyRowOrder=TRUE | FALSE

アクションで事前に指定された行順序を使用することを指定します。これには、予備の table.partition アクション呼び出しで orderby パラメータと groupby パラメータを使用する必要があります。

別名reproducibleRowOrder
デフォルトFALSE

assess=TRUE | FALSE

True に設定すると、予測される確率が事象レベルの結果テーブルに追加されます。これらの予測確率を評価アクションで使用することができます。

デフォルトFALSE

assessOneRow=TRUE | FALSE

True に設定すると、予測される確率が事象レベルの結果テーブルに追加されます。すべての事象確率は、別々の列として含まれ、接頭辞 _DT_P_ で名前が付けられます。これらの予測確率は、評価アクションで使用することができます。

デフォルトFALSE

casOut={casouttable}

スコアリングされた結果を格納するテーブルを指定します。指定しない場合、アクションはデータセットをスコアリングし、分類の誤分類率と回帰の平均二乗誤差のみを計算します。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

copyVars={"variable-name-1" <, "variable-name-2", ...>}

入力テーブルから出力テーブルに転送する変数を指定します。

別名copyVar

encodeName=TRUE | FALSE

生成された casout テーブルで、バイナリまたは名義ターゲットの予測確率などの変数名をエンコードするかどうかを指定します。予測確率は _DT_P_ の代わりに接頭辞 P_ で名前が付けられます。

デフォルトFALSE

impute=TRUE | FALSE

ターゲット変数の非欠損値を持つブザベーションの処理方法を指定します。True に設定すると、観測値は誤差なく既知であると仮定され、予測値として使用されます。

デフォルトFALSE

includeMissing=TRUE | FALSE

デフォルトでは、欠損値を持つオブザベーションは含まれます。False に設定すると、スコアリング時にツリーモデルで使用される変数の欠損値を持つオブザベーションは無視されます。

デフォルトTRUE

isolation=TRUE | FALSE

デフォルトFALSE

modelId="string"

スコア済みテーブルを生成するときに使用するモデル ID 変数名を指定します。デフォルトでは、変数名は、分類の場合は _DT_PredName_、ビニングターゲットの場合は _DT_PredLowerbd_ と _DT_PredUpperbd_、回帰の場合は _DT_PredMean_ です。

* modelTable={castable}

モデルを含むテーブルを指定します。

長い形式modelTable={name="table-name"}
短い形式modelTable="table-name"
別名model

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=TRUE | FALSE

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトFALSE
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}

データソースオプションを指定します。

別名options
dataSource
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=TRUE | FALSE

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFALSE
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable={groupbytable}

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルタテーブルの名前を指定します。

vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

nTree=integer

スコアリング中に使用するツリー数を指定します。

別名nTrees
デフォルトMACINT
最小値1

rbaImp=TRUE | FALSE

ランダム分岐割り当て (RBA) 法を使用して、変数の重要度を指定します。

デフォルトFALSE

seed=double

乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータクロックに基づいています。負の値を指定すると、コンピュータクロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。

デフォルト0
範囲0–MACINT

* table={castable}

入力テーブルの設定を指定します。

長い形式table={name="table-name"}
短い形式table="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=TRUE | FALSE

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトFALSE
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}

データソースオプションを指定します。

別名options
dataSource
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=TRUE | FALSE

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFALSE
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable={groupbytable}

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルタテーブルの名前を指定します。

vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

target="variable-name"

データセットのスコアリング時にターゲット変数を指定します。ツリーモデル内のターゲット変数名がスコアリングされたテーブル内で同じである場合、このオプションは必須ではありません。

treeError=TRUE | FALSE

True に設定すると、各ツリーの誤差を計算します。

デフォルトFALSE

treeVotes=TRUE | FALSE

スコアリングフォレストによって生成されるスコアテーブルを、個々のツリーの投票に関する情報で拡張するよう要求します。

デフォルトFALSE

varIntImp=integer

変数の交互作用の重要度を要求し、交互作用の最大次数を指定します。

デフォルト1
範囲0–3

vote="MAJORITY" | "PROB"

分類の投票戦略を指定します。指定された値は、生成された SAS スコアリングコードと、OOB エラーの計算に影響します。

MAJORITY

多数決を使用して予測することを指定します。

PROB

フォレストから予測する平均確率を使用することを指定します。

forestScore アクション

フォレストモデルを使用してテーブルをスコアリングします。

Lua 構文

results, info = s:decisionTree_forestScore{
applyRowOrder=true | false,
assess=true | false,
assessOneRow=true | false,
casOut={
caslib="string",
compress=true | false,
indexVars={"variable-name-1" <, "variable-name-2", ...>},
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
onDemand=true | false,
promote=true | false,
replace=true | false,
replication=integer,
threadBlockSize=64-bit-integer,
timeStamp="string",
where={"string-1" <, "string-2", ...>}
},
copyVars={"variable-name-1" <, "variable-name-2", ...>},
encodeName=true | false,
impute=true | false,
includeMissing=true | false,
isolation=true | false,
modelId="string",
required parameter modelTable={
caslib="string",
computedOnDemand=true | false,
computedVars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
singlePass=true | false,
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
nTree=integer,
rbaImp=true | false,
seed=double,
required parameter table={
caslib="string",
computedOnDemand=true | false,
computedVars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
singlePass=true | false,
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
target="variable-name",
treeError=true | false,
treeVotes=true | false,
varIntImp=integer,
}
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametermodelTable

—

モデルを含むテーブルを指定します。

required parametertable

—

入力テーブルの設定を指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 casOut

—

スコアリングされた結果を格納するテーブルを指定します。指定しない場合、アクションはデータセットをスコアリングし、分類の誤分類率と回帰の平均二乗誤差のみを計算します。

パラメーターの説明

applyRowOrder=true | false

アクションで事前に指定された行順序を使用することを指定します。これには、予備の table.partition アクション呼び出しで orderby パラメータと groupby パラメータを使用する必要があります。

別名reproducibleRowOrder
デフォルトfalse

assess=true | false

True に設定すると、予測される確率が事象レベルの結果テーブルに追加されます。これらの予測確率を評価アクションで使用することができます。

デフォルトfalse

assessOneRow=true | false

True に設定すると、予測される確率が事象レベルの結果テーブルに追加されます。すべての事象確率は、別々の列として含まれ、接頭辞 _DT_P_ で名前が付けられます。これらの予測確率は、評価アクションで使用することができます。

デフォルトfalse

casOut={casouttable}

スコアリングされた結果を格納するテーブルを指定します。指定しない場合、アクションはデータセットをスコアリングし、分類の誤分類率と回帰の平均二乗誤差のみを計算します。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

copyVars={"variable-name-1" <, "variable-name-2", ...>}

入力テーブルから出力テーブルに転送する変数を指定します。

別名copyVar

encodeName=true | false

生成された casout テーブルで、バイナリまたは名義ターゲットの予測確率などの変数名をエンコードするかどうかを指定します。予測確率は _DT_P_ の代わりに接頭辞 P_ で名前が付けられます。

デフォルトfalse

impute=true | false

ターゲット変数の非欠損値を持つブザベーションの処理方法を指定します。True に設定すると、観測値は誤差なく既知であると仮定され、予測値として使用されます。

デフォルトfalse

includeMissing=true | false

デフォルトでは、欠損値を持つオブザベーションは含まれます。False に設定すると、スコアリング時にツリーモデルで使用される変数の欠損値を持つオブザベーションは無視されます。

デフォルトtrue

isolation=true | false

デフォルトfalse

modelId="string"

スコア済みテーブルを生成するときに使用するモデル ID 変数名を指定します。デフォルトでは、変数名は、分類の場合は _DT_PredName_、ビニングターゲットの場合は _DT_PredLowerbd_ と _DT_PredUpperbd_、回帰の場合は _DT_PredMean_ です。

* modelTable={castable}

モデルを含むテーブルを指定します。

長い形式modelTable={name="table-name"}
短い形式modelTable="table-name"
別名model

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=true | false

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトfalse
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}

データソースオプションを指定します。

別名options
dataSource
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=true | false

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトfalse
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable={groupbytable}

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルタテーブルの名前を指定します。

vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

nTree=integer

スコアリング中に使用するツリー数を指定します。

別名nTrees
デフォルトMACINT
最小値1

rbaImp=true | false

ランダム分岐割り当て (RBA) 法を使用して、変数の重要度を指定します。

デフォルトfalse

seed=double

乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータクロックに基づいています。負の値を指定すると、コンピュータクロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。

デフォルト0
範囲0–MACINT

* table={castable}

入力テーブルの設定を指定します。

長い形式table={name="table-name"}
短い形式table="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=true | false

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトfalse
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}

データソースオプションを指定します。

別名options
dataSource
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=true | false

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトfalse
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable={groupbytable}

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルタテーブルの名前を指定します。

vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

target="variable-name"

データセットのスコアリング時にターゲット変数を指定します。ツリーモデル内のターゲット変数名がスコアリングされたテーブル内で同じである場合、このオプションは必須ではありません。

treeError=true | false

True に設定すると、各ツリーの誤差を計算します。

デフォルトfalse

treeVotes=true | false

スコアリングフォレストによって生成されるスコアテーブルを、個々のツリーの投票に関する情報で拡張するよう要求します。

デフォルトfalse

varIntImp=integer

変数の交互作用の重要度を要求し、交互作用の最大次数を指定します。

デフォルト1
範囲0–3

vote="MAJORITY" | "PROB"

分類の投票戦略を指定します。指定された値は、生成された SAS スコアリングコードと、OOB エラーの計算に影響します。

MAJORITY

多数決を使用して予測することを指定します。

PROB

フォレストから予測する平均確率を使用することを指定します。

forestScore アクション

フォレストモデルを使用してテーブルをスコアリングします。

Python 構文

results= s.decisionTree.forestScore(
applyRowOrder=True | False,
assess=True | False,
assessOneRow=True | False,
casOut={
"caslib":"string",
"compress":True | False,
"indexVars":["variable-name-1" <, "variable-name-2", ...>],
"label":"string",
"lifetime":64-bit-integer,
"maxMemSize":64-bit-integer,
"memoryFormat":"DVR" | "INHERIT" | "STANDARD",
"name":"table-name",
"onDemand":True | False,
"promote":True | False,
"replace":True | False,
"replication":integer,
"threadBlockSize":64-bit-integer,
"timeStamp":"string",
"where":["string-1" <, "string-2", ...>]
},
copyVars=["variable-name-1" <, "variable-name-2", ...>],
encodeName=True | False,
impute=True | False,
includeMissing=True | False,
isolation=True | False,
modelId="string",
required parameter modelTable={
"caslib":"string",
"computedOnDemand":True | False,
"computedVars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>},
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter "name":"table-name",
"singlePass":True | False,
"vars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"where":"where-expression",
"whereTable":{
"casLib":"string"
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter "name":"table-name"
"vars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>]
"where":"where-expression"
}
},
nTree=integer,
rbaImp=True | False,
seed=double,
required parameter table={
"caslib":"string",
"computedOnDemand":True | False,
"computedVars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>},
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter "name":"table-name",
"singlePass":True | False,
"vars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"where":"where-expression",
"whereTable":{
"casLib":"string"
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter "name":"table-name"
"vars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>]
"where":"where-expression"
}
},
target="variable-name",
treeError=True | False,
treeVotes=True | False,
varIntImp=integer,
)
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametermodelTable

—

モデルを含むテーブルを指定します。

required parametertable

—

入力テーブルの設定を指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 casOut

—

スコアリングされた結果を格納するテーブルを指定します。指定しない場合、アクションはデータセットをスコアリングし、分類の誤分類率と回帰の平均二乗誤差のみを計算します。

パラメーターの説明

applyRowOrder=True | False

アクションで事前に指定された行順序を使用することを指定します。これには、予備の table.partition アクション呼び出しで orderby パラメータと groupby パラメータを使用する必要があります。

別名reproducibleRowOrder
デフォルトFalse

assess=True | False

True に設定すると、予測される確率が事象レベルの結果テーブルに追加されます。これらの予測確率を評価アクションで使用することができます。

デフォルトFalse

assessOneRow=True | False

True に設定すると、予測される確率が事象レベルの結果テーブルに追加されます。すべての事象確率は、別々の列として含まれ、接頭辞 _DT_P_ で名前が付けられます。これらの予測確率は、評価アクションで使用することができます。

デフォルトFalse

casOut={casouttable}

スコアリングされた結果を格納するテーブルを指定します。指定しない場合、アクションはデータセットをスコアリングし、分類の誤分類率と回帰の平均二乗誤差のみを計算します。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

copyVars=["variable-name-1" <, "variable-name-2", ...>]

入力テーブルから出力テーブルに転送する変数を指定します。

別名copyVar

encodeName=True | False

生成された casout テーブルで、バイナリまたは名義ターゲットの予測確率などの変数名をエンコードするかどうかを指定します。予測確率は _DT_P_ の代わりに接頭辞 P_ で名前が付けられます。

デフォルトFalse

impute=True | False

ターゲット変数の非欠損値を持つブザベーションの処理方法を指定します。True に設定すると、観測値は誤差なく既知であると仮定され、予測値として使用されます。

デフォルトFalse

includeMissing=True | False

デフォルトでは、欠損値を持つオブザベーションは含まれます。False に設定すると、スコアリング時にツリーモデルで使用される変数の欠損値を持つオブザベーションは無視されます。

デフォルトTrue

isolation=True | False

デフォルトFalse

modelId="string"

スコア済みテーブルを生成するときに使用するモデル ID 変数名を指定します。デフォルトでは、変数名は、分類の場合は _DT_PredName_、ビニングターゲットの場合は _DT_PredLowerbd_ と _DT_PredUpperbd_、回帰の場合は _DT_PredMean_ です。

* modelTable={castable}

モデルを含むテーブルを指定します。

長い形式modelTable={"name":"table-name"}
短い形式modelTable="table-name"
別名model

castable の値は次のいずれかになります:

"caslib":"string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

"computedOnDemand":True | False

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトFalse
"computedVars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"computedVarsProgram":"string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>}

データソースオプションを指定します。

別名options
dataSource
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import_

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* "name":"table-name"

入力テーブルの名前を指定します。

"singlePass":True | False

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFalse
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"where":"where-expression"

入力データをサブセット化する式を指定します。

"whereTable":{groupbytable}

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

"casLib":"string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import_

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* "name":"table-name"

フィルタテーブルの名前を指定します。

"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"where":"where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

nTree=integer

スコアリング中に使用するツリー数を指定します。

別名nTrees
デフォルトMACINT
最小値1

rbaImp=True | False

ランダム分岐割り当て (RBA) 法を使用して、変数の重要度を指定します。

デフォルトFalse

seed=double

乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータクロックに基づいています。負の値を指定すると、コンピュータクロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。

デフォルト0
範囲0–MACINT

* table={castable}

入力テーブルの設定を指定します。

長い形式table={"name":"table-name"}
短い形式table="table-name"

castable の値は次のいずれかになります:

"caslib":"string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

"computedOnDemand":True | False

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトFalse
"computedVars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"computedVarsProgram":"string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>}

データソースオプションを指定します。

別名options
dataSource
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import_

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* "name":"table-name"

入力テーブルの名前を指定します。

"singlePass":True | False

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFalse
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"where":"where-expression"

入力データをサブセット化する式を指定します。

"whereTable":{groupbytable}

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

"casLib":"string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import_

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* "name":"table-name"

フィルタテーブルの名前を指定します。

"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"where":"where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

target="variable-name"

データセットのスコアリング時にターゲット変数を指定します。ツリーモデル内のターゲット変数名がスコアリングされたテーブル内で同じである場合、このオプションは必須ではありません。

treeError=True | False

True に設定すると、各ツリーの誤差を計算します。

デフォルトFalse

treeVotes=True | False

スコアリングフォレストによって生成されるスコアテーブルを、個々のツリーの投票に関する情報で拡張するよう要求します。

デフォルトFalse

varIntImp=integer

変数の交互作用の重要度を要求し、交互作用の最大次数を指定します。

デフォルト1
範囲0–3

vote="MAJORITY" | "PROB"

分類の投票戦略を指定します。指定された値は、生成された SAS スコアリングコードと、OOB エラーの計算に影響します。

MAJORITY

多数決を使用して予測することを指定します。

PROB

フォレストから予測する平均確率を使用することを指定します。

forestScore アクション

フォレストモデルを使用してテーブルをスコアリングします。

R 構文

results <– cas.decisionTree.forestScore(s,
applyRowOrder=TRUE | FALSE,
assess=TRUE | FALSE,
assessOneRow=TRUE | FALSE,
casOut=list(
caslib="string",
compress=TRUE | FALSE,
indexVars=list("variable-name-1" <, "variable-name-2", ...>),
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
onDemand=TRUE | FALSE,
promote=TRUE | FALSE,
replace=TRUE | FALSE,
replication=integer,
threadBlockSize=64-bit-integer,
timeStamp="string",
where=list("string-1" <, "string-2", ...>)
),
copyVars=list("variable-name-1" <, "variable-name-2", ...>),
encodeName=TRUE | FALSE,
impute=TRUE | FALSE,
includeMissing=TRUE | FALSE,
isolation=TRUE | FALSE,
modelId="string",
required parameter modelTable=list(
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>),
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters),
required parameter name="table-name",
singlePass=TRUE | FALSE,
vars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
where="where-expression",
whereTable=list(
casLib="string"
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameterslist)
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
required parameter name="table-name"
vars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>)
where="where-expression"
)
),
nTree=integer,
rbaImp=TRUE | FALSE,
seed=double,
required parameter table=list(
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>),
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters),
required parameter name="table-name",
singlePass=TRUE | FALSE,
vars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
where="where-expression",
whereTable=list(
casLib="string"
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameterslist)
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
required parameter name="table-name"
vars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>)
where="where-expression"
)
),
target="variable-name",
treeError=TRUE | FALSE,
treeVotes=TRUE | FALSE,
varIntImp=integer,
)
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametermodelTable

—

モデルを含むテーブルを指定します。

required parametertable

—

入力テーブルの設定を指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 casOut

—

スコアリングされた結果を格納するテーブルを指定します。指定しない場合、アクションはデータセットをスコアリングし、分類の誤分類率と回帰の平均二乗誤差のみを計算します。

パラメーターの説明

applyRowOrder=TRUE | FALSE

アクションで事前に指定された行順序を使用することを指定します。これには、予備の table.partition アクション呼び出しで orderby パラメータと groupby パラメータを使用する必要があります。

別名reproducibleRowOrder
デフォルトFALSE

assess=TRUE | FALSE

True に設定すると、予測される確率が事象レベルの結果テーブルに追加されます。これらの予測確率を評価アクションで使用することができます。

デフォルトFALSE

assessOneRow=TRUE | FALSE

True に設定すると、予測される確率が事象レベルの結果テーブルに追加されます。すべての事象確率は、別々の列として含まれ、接頭辞 _DT_P_ で名前が付けられます。これらの予測確率は、評価アクションで使用することができます。

デフォルトFALSE

casOut=list(casouttable)

スコアリングされた結果を格納するテーブルを指定します。指定しない場合、アクションはデータセットをスコアリングし、分類の誤分類率と回帰の平均二乗誤差のみを計算します。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

copyVars=list("variable-name-1" <, "variable-name-2", ...>)

入力テーブルから出力テーブルに転送する変数を指定します。

別名copyVar

encodeName=TRUE | FALSE

生成された casout テーブルで、バイナリまたは名義ターゲットの予測確率などの変数名をエンコードするかどうかを指定します。予測確率は _DT_P_ の代わりに接頭辞 P_ で名前が付けられます。

デフォルトFALSE

impute=TRUE | FALSE

ターゲット変数の非欠損値を持つブザベーションの処理方法を指定します。True に設定すると、観測値は誤差なく既知であると仮定され、予測値として使用されます。

デフォルトFALSE

includeMissing=TRUE | FALSE

デフォルトでは、欠損値を持つオブザベーションは含まれます。False に設定すると、スコアリング時にツリーモデルで使用される変数の欠損値を持つオブザベーションは無視されます。

デフォルトTRUE

isolation=TRUE | FALSE

デフォルトFALSE

modelId="string"

スコア済みテーブルを生成するときに使用するモデル ID 変数名を指定します。デフォルトでは、変数名は、分類の場合は _DT_PredName_、ビニングターゲットの場合は _DT_PredLowerbd_ と _DT_PredUpperbd_、回帰の場合は _DT_PredMean_ です。

* modelTable=list(castable)

モデルを含むテーブルを指定します。

長い形式modelTable=list(name="table-name")
短い形式modelTable="table-name"
別名model

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=TRUE | FALSE

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトFALSE
computedVars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>)

データソースオプションを指定します。

別名options
dataSource
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=TRUE | FALSE

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFALSE
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable=list(groupbytable)

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルタテーブルの名前を指定します。

vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

nTree=integer

スコアリング中に使用するツリー数を指定します。

別名nTrees
デフォルトMACINT
最小値1

rbaImp=TRUE | FALSE

ランダム分岐割り当て (RBA) 法を使用して、変数の重要度を指定します。

デフォルトFALSE

seed=double

乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータクロックに基づいています。負の値を指定すると、コンピュータクロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。

デフォルト0
範囲0–MACINT

* table=list(castable)

入力テーブルの設定を指定します。

長い形式table=list(name="table-name")
短い形式table="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=TRUE | FALSE

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトFALSE
computedVars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>)

データソースオプションを指定します。

別名options
dataSource
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=TRUE | FALSE

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFALSE
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable=list(groupbytable)

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルタテーブルの名前を指定します。

vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

target="variable-name"

データセットのスコアリング時にターゲット変数を指定します。ツリーモデル内のターゲット変数名がスコアリングされたテーブル内で同じである場合、このオプションは必須ではありません。

treeError=TRUE | FALSE

True に設定すると、各ツリーの誤差を計算します。

デフォルトFALSE

treeVotes=TRUE | FALSE

スコアリングフォレストによって生成されるスコアテーブルを、個々のツリーの投票に関する情報で拡張するよう要求します。

デフォルトFALSE

varIntImp=integer

変数の交互作用の重要度を要求し、交互作用の最大次数を指定します。

デフォルト1
範囲0–3

vote="MAJORITY" | "PROB"

分類の投票戦略を指定します。指定された値は、生成された SAS スコアリングコードと、OOB エラーの計算に影響します。

MAJORITY

多数決を使用して予測することを指定します。

PROB

フォレストから予測する平均確率を使用することを指定します。

最終更新: 2022/10/04