ディシジョンツリー アクションセット: 構文

デシジョンツリー、フォレスト、および勾配ブースティングによるモデリングおよびスコアリングのアクションを提供します

gbtreeTrain アクション

勾配ブースティングツリーを学習します。このアクションには、SAS Visual Data Mining and Machine Learning のライセンスが必要です。

CASL 構文

decisionTree.gbtreeTrain <result=results> <status=rc> /
applyRowOrder=TRUE | FALSE,
attributes={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
auxData="variable-name",
binOrder=TRUE | FALSE,
casOut={
caslib="string",
compress=TRUE | FALSE,
indexVars={"variable-name-1" <, "variable-name-2", ...>},
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
onDemand=TRUE | FALSE,
promote=TRUE | FALSE,
replace=TRUE | FALSE,
replication=integer,
threadBlockSize=64-bit-integer,
timeStamp="string",
where={"string-1" <, "string-2", ...>}
},
code={
casOut={
caslib="string"
compress=TRUE | FALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
onDemand=TRUE | FALSE
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
comment=TRUE | FALSE,
fmtWdth=integer,
indentSize=integer,
labelId=integer,
lineSize=integer,
noTrim=TRUE | FALSE,
tabForm=TRUE | FALSE
},
codeInteractions={
casOut={
caslib="string"
compress=TRUE | FALSE
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
onDemand=TRUE | FALSE
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
comment=TRUE | FALSE,
fmtWdth=integer,
indentSize=integer,
labelId=integer,
lineSize=integer,
noTrim=TRUE | FALSE,
tabForm=TRUE | FALSE
},
distribution="BINARY" | "GAUSSIAN" | "MULTINOMIAL" | "POISSON" | "TWEEDIE" | 64-bit-integer,
earlyStop={
metric="ASE" | "LOGLOSS" | "MCR",
minimum=TRUE | FALSE,
stagnation=64-bit-integer,
threshold=double,
thresholdIter=64-bit-integer,
tolerance=double
},
encodeName=TRUE | FALSE,
fcmpEvalMetric="string",
freq="variable-name",
greedy=TRUE | FALSE,
includeMissing=TRUE | FALSE,
initPred=double,
required parameter inputs={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
lasso=double,
leafSize=integer,
learningRate=double,
logLevel=integer,
m=integer,
maxBranch=integer,
maxLevel=integer,
mergeBin=TRUE | FALSE,
minHessian=double,
modelId="string",
modelTable={
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
computedVarsProgram="string",
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
groupBy={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
groupByMode="NOSORT" | "REDISTRIBUTE",
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
onDemand=TRUE | FALSE,
orderBy={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
singlePass=TRUE | FALSE,
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
monoDec={"string-1" <, "string-2", ...>},
monoInc={"string-1" <, "string-2", ...>},
nBins=integer,
nominalHandling="CLASSIC" | "ENHANCED",
nominals={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
nominalSearch={
handling="CLASSIC" | "ENHANCED",
maxCategories=64-bit-integer,
shrinkage=double,
sort=64-bit-integer,
sortBy="COUNT" | "TARGET"
},
nTree=integer,
offset="variable-name",
phi=double,
power=double,
quantileBin=TRUE | FALSE,
ridge=double,
saveState={
caslib="string",
compress=TRUE | FALSE,
indexVars={"variable-name-1" <, "variable-name-2", ...>},
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
onDemand=TRUE | FALSE,
promote=TRUE | FALSE,
replace=TRUE | FALSE,
replication=integer,
threadBlockSize=64-bit-integer,
timeStamp="string",
where={"string-1" <, "string-2", ...>}
},
seed=double,
singular=double,
required parameter table={
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
singlePass=TRUE | FALSE,
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
required parameter target="variable-name",
validTable={
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
singlePass=TRUE | FALSE,
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
varImp=TRUE | FALSE,
varIntImp=integer,
weight="variable-name"
;
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

 modelTable

—

モデルを含むテーブルを指定します。

required parametertable

—

入力テーブルの設定を指定します。

 validTable

—

入力テーブルの設定を指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 casOut

—

デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。

 code

casOut

アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。

 codeInteractions

casOut

アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。

 saveState

—

生成された aStore モデルを格納するテーブルを指定します。

パラメーターの説明

applyRowOrder=TRUE | FALSE

アクションで事前に指定された行順序を使用することを指定します。これには、予備の table.partition アクション呼び出しで orderby パラメータと groupby パラメータを使用する必要があります。

別名reproducibleRowOrder
デフォルトFALSE

attributes={{casinvardesc-1} <, {casinvardesc-2}, ...>}

入力変数に適用するフォーマットなどの一時的な属性を指定します。

attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名attribute
attrs
attr
varAttrs

auxData="variable-name"

補助ソースからのオブザベーションを示す、転移学習の変数を指定します。値 0 は、従来の学習オブザベーションを示します。その他の値は補助データを示します。

binOrder=TRUE | FALSE

デフォルトでは、数値変数のビンの順序は保持されます。False に設定すると、数値変数のビンの順序は無視されます。

デフォルトTRUE

casOut={casouttable}

デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

code={codegen}

アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。

code パラメーターの指定の詳細については、共通 codegen パラメーターを参照してください。

codeInteractions={viicodegen}

アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。

viicodegen の値は次のいずれかになります:

casOut={casouttable}

出力テーブルの設定を指定します。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

comment=TRUE | FALSE

True に設定すると、DATA ステップコードにコメントが追加されます。

デフォルトFALSE
fmtWdth=integer

DATA ステップコードでのパラメータ推定値などの派生数の書式設定に使用する幅を指定します。

別名fmtWidth
デフォルト20
範囲0–32
indentSize=integer

各レベルの DATA ステップコードをインデントするスペースの数を指定します。

デフォルト3
範囲0–10
labelId=integer

DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。

lineSize=integer

生成されたコードの行サイズを指定します。

デフォルト120
範囲64–254
noTrim=TRUE | FALSE

True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。

デフォルトFALSE
tabForm=TRUE | FALSE

True に設定すると、テーブルの格納に適した方法でコードが生成されます。

別名tableForm
デフォルトFALSE

distribution="BINARY" | "GAUSSIAN" | "MULTINOMIAL" | "POISSON" | "TWEEDIE" | 64-bit-integer

勾配ブースティングツリーの分布を指定します。

デフォルトBINARY
BINARYこの値は二項分類に役立ちます。
GAUSSIANこの値は回帰ツリーに役立ちます。
MULTINOMIALこの値は、2 つ以上のクラスを持つ分類の多項分布に役立ちます。
POISSONこの値はポアソン分布に役立ちます。
TWEEDIEこの値は tweedie の分布に役立ちます。

earlyStop={tkcasdt_earlyStop}

tkcasdt_earlyStop の値は次のいずれかになります:

metric="ASE" | "LOGLOSS" | "MCR"
minimum=TRUE | FALSE
別名smallest
デフォルトFALSE
stagnation=64-bit-integer
デフォルト0
最小値0
threshold=double
デフォルト0
最小値0
thresholdIter=64-bit-integer
デフォルト0
最小値0
tolerance=double
デフォルト0
最小値0

encodeName=TRUE | FALSE

生成された casout テーブルで、バイナリまたは名義ターゲットの予測確率などの変数名をエンコードするかどうかを指定します。予測確率は _DT_P_ の代わりに接頭辞 P_ で名前が付けられます。

デフォルトFALSE

fcmpEvalMetric="string"

勾配ブースティングツリーモデルの FCMP 評価メトリックを指定します

別名fcmpEvalFunc

freq="variable-name"

各オブザベーションの発生頻度を含む数値変数を指定します。

greedy=TRUE | FALSE

デフォルトでは、各ツリーノードの各変数の最適な分割を決定するために、貪欲探索またはしらみつぶし探索が使用されます。False に設定すると、クラスタリングに基づく高速で効率的なアルゴリズムが適用されます。カーディナリティが高い変数には、このパラメータを False に設定することをお勧めします。

デフォルトTRUE

includeMissing=TRUE | FALSE

デフォルトでは、欠損値を持つオブザベーションは含まれます。False に設定すると、スコアリング時にツリーモデルで使用される変数の欠損値を持つオブザベーションは無視されます。

デフォルトTRUE

initPred=double

デフォルト0

* inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}

分析に使用する入力変数を指定します。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名input

lasso=double

予測における L1 ノルム正則化を指定します。値は 0 以上でなければなりません。

デフォルト0
最小値0

leafSize=integer

各ノードのオブザベーションの最小数を指定します。

デフォルト5
最小値1

learningRate=double

各ツリーの学習率を指定します。

デフォルト0.1
範囲(0–1]

logLevel=integer

デフォルト0
最小値0

m=integer

ノード上で分割する際に考慮する入力変数の数を指定します。変数は、各ツリーの入力変数からランダムに選択されます。デフォルトでは、フォレストは使用される入力変数の数の平方根を使用して、最も近い整数に切り上げられます。勾配ブースティングでは、入力変数の数が使用されます。

最小値1

maxBranch=integer

ツリーの各水準で許可される子 (枝) の最大数を指定します。

デフォルト2
最小値1

maxLevel=integer

ツリー水準の最大数を指定します。

デフォルト5
最小値1

mergeBin=TRUE | FALSE

デフォルトでは、1 つのビンの最大値が隣接するビンの最小値と一致すると、値は下のビンにマージされます。False に設定すると、アクションはビンをマージしようとしません。

デフォルトTRUE

minHessian=double

デフォルト0
最小値0

minUseInSearch=integer

欠落したパラメータが USEINSEARCH に設定されている場合、分割検索で欠損値を使用するためのしきい値を指定します。分割変数がノード内に欠損値を持つオブザベーション数が指定された値以上の場合、アクションは USEINSEARCH ポリシーを開始します。それ以外の場合は、欠損値が人気のある分岐に割り当てられます。

デフォルト1

missing="MACSMALL" | "USEINSEARCH"

欠損値を処理するポリシーを指定します。

デフォルトUSEINSEARCH
MACSMALL

数値変数の欠損値を最小のマシン値として扱い、名義変数の欠損値を別の水準として扱うように指定します。

USEINSEARCH

分割ルールの価値の計算に欠損値を組み込み、その結果、欠損値を分割の価値を最大にする分岐に関連付ける分割ルールを作成することを指定します。

modelId="string"

SAS スコアコードを生成するときに使用するモデル ID 変数名を指定します。デフォルトでは、DT_ はターゲット変数名の前に付けられます。

modelTable={castable}

モデルを含むテーブルを指定します。

modelTable パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。

monoDec={"string-1" <, "string-2", ...>}

入力値が増加したときに予測が増加しない間隔入力を指定します。完全なコンプライアンスは保証されていません。

別名monotoneDecrease
monotoneDec
Dec

monoInc={"string-1" <, "string-2", ...>}

入力値が増加したときに予測が減少しない間隔入力を指定します。完全なコンプライアンスは保証されていません。

別名monotoneIncrease
monotoneInc
Inc

nBins=integer

ディシジョンツリーの計算で数値変数に使用するビン数を指定します。

デフォルト50
最小値1

nominalHandling="CLASSIC" | "ENHANCED"

nominals={{casinvardesc-1} <, {casinvardesc-2}, ...>}

分析に使用する名義尺度の入力変数を指定します。

nominals パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名nominal

nominalSearch={tkcasdt_nomSearchOpts}

名義入力で分割を検索する方法を指定します。

別名nomSearch

tkcasdt_nomSearchOpts の値は次のいずれかになります:

handling="CLASSIC" | "ENHANCED"
maxCategories=64-bit-integer

分割ルールに含める水準の最大数を指定します。

別名maxCats
maxLevels
maxValues
cluster
minCardCluster
デフォルト128
最小値0
shrinkage=double

ソート方法でカテゴリ平均に与える重みを指定します。

デフォルト10
最小値0
sort=64-bit-integer

ソート方法を使用するための入力の最小カーディナリティを指定します。

別名minCardSort
デフォルト10
最小値0
sortBy="COUNT" | "TARGET"

nTree=integer

作成するツリー数を指定します。

別名nTrees
デフォルト50
最小値1

offset="variable-name"

分布=POISSON または TWEEDIE で使用するオフセット変数を指定します。

phi=double

この値は tweedie 分布の power パラメータに役立ちます。

別名scale
最小値 (含まない)0

power=double

この値は tweedie 分布の power パラメータに役立ちます。

デフォルト1.5
範囲(1, 2)

quantileBin=TRUE | FALSE

等しい幅のビンではなく、数値入力の分位点でビン境界を指定します。

別名qbin
qtbin
デフォルトTRUE

ridge=double

予測における L2 ノルム正則化を指定します。値は 0 以上でなければなりません。

デフォルト1
最小値0

saveState={casouttable}

生成された aStore モデルを格納するテーブルを指定します。

saveState パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

seed=double

乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータクロックに基づいています。負の値を指定すると、コンピュータクロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。

デフォルト0
範囲0–MACINT

singular=double

除算でゼロを避けるために小さな値を指定します。

デフォルト1E-12
最小値0

subSampleRate=double

各ツリーの構築に使用するデータの割合を指定します。

別名subsample
samplingRate
デフォルト0.5
範囲(0–1]

* table={castable}

入力テーブルの設定を指定します。

長い形式table={name="table-name"}
短い形式table="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=TRUE | FALSE

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトFALSE
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}

データソースオプションを指定します。

別名options
dataSource
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=TRUE | FALSE

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFALSE
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable={groupbytable}

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルタテーブルの名前を指定します。

vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

* target="variable-name"

学習のターゲット変数または応答変数を指定します。変数が数値であるが、nominal= パラメータで指定されておらず、nbinstarget= が指定されていない場合、回帰ツリーが学習されます。

transLearnBurn=integer

転移学習中に、補助オブザベーションのダウンウェイトが開始する前に作成するツリー数を指定します。

デフォルト0
最小値0

transLearnShrink=double

転移学習中に、非生産的な補助データをどれだけダウンウェイトするかを指定します。

デフォルト0.9
範囲0–1

transLearnTrim=double

転移学習中に、補助オブザベーションがダウンウェイトされる学習データ上の勾配の分布の割合を指定します。

デフォルト0.01
範囲(0–0.5]

validTable={castable}

入力テーブルの設定を指定します。

長い形式validTable={name="table-name"}
短い形式validTable="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=TRUE | FALSE

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトFALSE
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}

データソースオプションを指定します。

別名options
dataSource
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=TRUE | FALSE

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFALSE
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable={groupbytable}

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルタテーブルの名前を指定します。

vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

varImp=TRUE | FALSE

変数重要度の情報を生成するかどうかを指定します。重要度の値は、Gini の総削減量によって決まります。

デフォルトFALSE

varIntImp=integer

変数の交互作用の重要度を要求し、交互作用の最大次数を指定します。

デフォルト1
範囲0–3

weight="variable-name"

各オブザベーションの重みを含む数値変数を指定します。

gbtreeTrain アクション

勾配ブースティングツリーを学習します。このアクションには、SAS Visual Data Mining and Machine Learning のライセンスが必要です。

Lua 構文

results, info = s:decisionTree_gbtreeTrain{
applyRowOrder=true | false,
attributes={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
auxData="variable-name",
binOrder=true | false,
casOut={
caslib="string",
compress=true | false,
indexVars={"variable-name-1" <, "variable-name-2", ...>},
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
onDemand=true | false,
promote=true | false,
replace=true | false,
replication=integer,
threadBlockSize=64-bit-integer,
timeStamp="string",
where={"string-1" <, "string-2", ...>}
},
code={
casOut={
caslib="string"
compress=true | false
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
onDemand=true | false
promote=true | false
replace=true | false
replication=integer
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
comment=true | false,
fmtWdth=integer,
indentSize=integer,
labelId=integer,
lineSize=integer,
noTrim=true | false,
tabForm=true | false
},
codeInteractions={
casOut={
caslib="string"
compress=true | false
indexVars={"variable-name-1" <, "variable-name-2", ...>}
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
onDemand=true | false
promote=true | false
replace=true | false
replication=integer
threadBlockSize=64-bit-integer
timeStamp="string"
where={"string-1" <, "string-2", ...>}
},
comment=true | false,
fmtWdth=integer,
indentSize=integer,
labelId=integer,
lineSize=integer,
noTrim=true | false,
tabForm=true | false
},
distribution="BINARY" | "GAUSSIAN" | "MULTINOMIAL" | "POISSON" | "TWEEDIE" | 64-bit-integer,
earlyStop={
metric="ASE" | "LOGLOSS" | "MCR",
minimum=true | false,
stagnation=64-bit-integer,
threshold=double,
thresholdIter=64-bit-integer,
tolerance=double
},
encodeName=true | false,
fcmpEvalMetric="string",
freq="variable-name",
greedy=true | false,
includeMissing=true | false,
initPred=double,
required parameter inputs={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
lasso=double,
leafSize=integer,
learningRate=double,
logLevel=integer,
m=integer,
maxBranch=integer,
maxLevel=integer,
mergeBin=true | false,
minHessian=double,
modelId="string",
modelTable={
caslib="string",
computedOnDemand=true | false,
computedVars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
computedVarsProgram="string",
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
groupBy={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
groupByMode="NOSORT" | "REDISTRIBUTE",
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
onDemand=true | false,
orderBy={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
singlePass=true | false,
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
monoDec={"string-1" <, "string-2", ...>},
monoInc={"string-1" <, "string-2", ...>},
nBins=integer,
nominalHandling="CLASSIC" | "ENHANCED",
nominals={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
nominalSearch={
handling="CLASSIC" | "ENHANCED",
maxCategories=64-bit-integer,
shrinkage=double,
sort=64-bit-integer,
sortBy="COUNT" | "TARGET"
},
nTree=integer,
offset="variable-name",
phi=double,
power=double,
quantileBin=true | false,
ridge=double,
saveState={
caslib="string",
compress=true | false,
indexVars={"variable-name-1" <, "variable-name-2", ...>},
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
onDemand=true | false,
promote=true | false,
replace=true | false,
replication=integer,
threadBlockSize=64-bit-integer,
timeStamp="string",
where={"string-1" <, "string-2", ...>}
},
seed=double,
singular=double,
required parameter table={
caslib="string",
computedOnDemand=true | false,
computedVars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
singlePass=true | false,
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
required parameter target="variable-name",
validTable={
caslib="string",
computedOnDemand=true | false,
computedVars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
singlePass=true | false,
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
varImp=true | false,
varIntImp=integer,
weight="variable-name"
}
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

 modelTable

—

モデルを含むテーブルを指定します。

required parametertable

—

入力テーブルの設定を指定します。

 validTable

—

入力テーブルの設定を指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 casOut

—

デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。

 code

casOut

アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。

 codeInteractions

casOut

アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。

 saveState

—

生成された aStore モデルを格納するテーブルを指定します。

パラメーターの説明

applyRowOrder=true | false

アクションで事前に指定された行順序を使用することを指定します。これには、予備の table.partition アクション呼び出しで orderby パラメータと groupby パラメータを使用する必要があります。

別名reproducibleRowOrder
デフォルトfalse

attributes={{casinvardesc-1} <, {casinvardesc-2}, ...>}

入力変数に適用するフォーマットなどの一時的な属性を指定します。

attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名attribute
attrs
attr
varAttrs

auxData="variable-name"

補助ソースからのオブザベーションを示す、転移学習の変数を指定します。値 0 は、従来の学習オブザベーションを示します。その他の値は補助データを示します。

binOrder=true | false

デフォルトでは、数値変数のビンの順序は保持されます。False に設定すると、数値変数のビンの順序は無視されます。

デフォルトtrue

casOut={casouttable}

デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

code={codegen}

アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。

code パラメーターの指定の詳細については、共通 codegen パラメーターを参照してください。

codeInteractions={viicodegen}

アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。

viicodegen の値は次のいずれかになります:

casOut={casouttable}

出力テーブルの設定を指定します。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

comment=true | false

True に設定すると、DATA ステップコードにコメントが追加されます。

デフォルトfalse
fmtWdth=integer

DATA ステップコードでのパラメータ推定値などの派生数の書式設定に使用する幅を指定します。

別名fmtWidth
デフォルト20
範囲0–32
indentSize=integer

各レベルの DATA ステップコードをインデントするスペースの数を指定します。

デフォルト3
範囲0–10
labelId=integer

DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。

lineSize=integer

生成されたコードの行サイズを指定します。

デフォルト120
範囲64–254
noTrim=true | false

True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。

デフォルトfalse
tabForm=true | false

True に設定すると、テーブルの格納に適した方法でコードが生成されます。

別名tableForm
デフォルトfalse

distribution="BINARY" | "GAUSSIAN" | "MULTINOMIAL" | "POISSON" | "TWEEDIE" | 64-bit-integer

勾配ブースティングツリーの分布を指定します。

デフォルトBINARY
BINARYこの値は二項分類に役立ちます。
GAUSSIANこの値は回帰ツリーに役立ちます。
MULTINOMIALこの値は、2 つ以上のクラスを持つ分類の多項分布に役立ちます。
POISSONこの値はポアソン分布に役立ちます。
TWEEDIEこの値は tweedie の分布に役立ちます。

earlyStop={tkcasdt_earlyStop}

tkcasdt_earlyStop の値は次のいずれかになります:

metric="ASE" | "LOGLOSS" | "MCR"
minimum=true | false
別名smallest
デフォルトfalse
stagnation=64-bit-integer
デフォルト0
最小値0
threshold=double
デフォルト0
最小値0
thresholdIter=64-bit-integer
デフォルト0
最小値0
tolerance=double
デフォルト0
最小値0

encodeName=true | false

生成された casout テーブルで、バイナリまたは名義ターゲットの予測確率などの変数名をエンコードするかどうかを指定します。予測確率は _DT_P_ の代わりに接頭辞 P_ で名前が付けられます。

デフォルトfalse

fcmpEvalMetric="string"

勾配ブースティングツリーモデルの FCMP 評価メトリックを指定します

別名fcmpEvalFunc

freq="variable-name"

各オブザベーションの発生頻度を含む数値変数を指定します。

greedy=true | false

デフォルトでは、各ツリーノードの各変数の最適な分割を決定するために、貪欲探索またはしらみつぶし探索が使用されます。False に設定すると、クラスタリングに基づく高速で効率的なアルゴリズムが適用されます。カーディナリティが高い変数には、このパラメータを False に設定することをお勧めします。

デフォルトtrue

includeMissing=true | false

デフォルトでは、欠損値を持つオブザベーションは含まれます。False に設定すると、スコアリング時にツリーモデルで使用される変数の欠損値を持つオブザベーションは無視されます。

デフォルトtrue

initPred=double

デフォルト0

* inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}

分析に使用する入力変数を指定します。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名input

lasso=double

予測における L1 ノルム正則化を指定します。値は 0 以上でなければなりません。

デフォルト0
最小値0

leafSize=integer

各ノードのオブザベーションの最小数を指定します。

デフォルト5
最小値1

learningRate=double

各ツリーの学習率を指定します。

デフォルト0.1
範囲(0–1]

logLevel=integer

デフォルト0
最小値0

m=integer

ノード上で分割する際に考慮する入力変数の数を指定します。変数は、各ツリーの入力変数からランダムに選択されます。デフォルトでは、フォレストは使用される入力変数の数の平方根を使用して、最も近い整数に切り上げられます。勾配ブースティングでは、入力変数の数が使用されます。

最小値1

maxBranch=integer

ツリーの各水準で許可される子 (枝) の最大数を指定します。

デフォルト2
最小値1

maxLevel=integer

ツリー水準の最大数を指定します。

デフォルト5
最小値1

mergeBin=true | false

デフォルトでは、1 つのビンの最大値が隣接するビンの最小値と一致すると、値は下のビンにマージされます。False に設定すると、アクションはビンをマージしようとしません。

デフォルトtrue

minHessian=double

デフォルト0
最小値0

minUseInSearch=integer

欠落したパラメータが USEINSEARCH に設定されている場合、分割検索で欠損値を使用するためのしきい値を指定します。分割変数がノード内に欠損値を持つオブザベーション数が指定された値以上の場合、アクションは USEINSEARCH ポリシーを開始します。それ以外の場合は、欠損値が人気のある分岐に割り当てられます。

デフォルト1

missing="MACSMALL" | "USEINSEARCH"

欠損値を処理するポリシーを指定します。

デフォルトUSEINSEARCH
MACSMALL

数値変数の欠損値を最小のマシン値として扱い、名義変数の欠損値を別の水準として扱うように指定します。

USEINSEARCH

分割ルールの価値の計算に欠損値を組み込み、その結果、欠損値を分割の価値を最大にする分岐に関連付ける分割ルールを作成することを指定します。

modelId="string"

SAS スコアコードを生成するときに使用するモデル ID 変数名を指定します。デフォルトでは、DT_ はターゲット変数名の前に付けられます。

modelTable={castable}

モデルを含むテーブルを指定します。

modelTable パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。

monoDec={"string-1" <, "string-2", ...>}

入力値が増加したときに予測が増加しない間隔入力を指定します。完全なコンプライアンスは保証されていません。

別名monotoneDecrease
monotoneDec
Dec

monoInc={"string-1" <, "string-2", ...>}

入力値が増加したときに予測が減少しない間隔入力を指定します。完全なコンプライアンスは保証されていません。

別名monotoneIncrease
monotoneInc
Inc

nBins=integer

ディシジョンツリーの計算で数値変数に使用するビン数を指定します。

デフォルト50
最小値1

nominalHandling="CLASSIC" | "ENHANCED"

nominals={{casinvardesc-1} <, {casinvardesc-2}, ...>}

分析に使用する名義尺度の入力変数を指定します。

nominals パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名nominal

nominalSearch={tkcasdt_nomSearchOpts}

名義入力で分割を検索する方法を指定します。

別名nomSearch

tkcasdt_nomSearchOpts の値は次のいずれかになります:

handling="CLASSIC" | "ENHANCED"
maxCategories=64-bit-integer

分割ルールに含める水準の最大数を指定します。

別名maxCats
maxLevels
maxValues
cluster
minCardCluster
デフォルト128
最小値0
shrinkage=double

ソート方法でカテゴリ平均に与える重みを指定します。

デフォルト10
最小値0
sort=64-bit-integer

ソート方法を使用するための入力の最小カーディナリティを指定します。

別名minCardSort
デフォルト10
最小値0
sortBy="COUNT" | "TARGET"

nTree=integer

作成するツリー数を指定します。

別名nTrees
デフォルト50
最小値1

offset="variable-name"

分布=POISSON または TWEEDIE で使用するオフセット変数を指定します。

phi=double

この値は tweedie 分布の power パラメータに役立ちます。

別名scale
最小値 (含まない)0

power=double

この値は tweedie 分布の power パラメータに役立ちます。

デフォルト1.5
範囲(1, 2)

quantileBin=true | false

等しい幅のビンではなく、数値入力の分位点でビン境界を指定します。

別名qbin
qtbin
デフォルトtrue

ridge=double

予測における L2 ノルム正則化を指定します。値は 0 以上でなければなりません。

デフォルト1
最小値0

saveState={casouttable}

生成された aStore モデルを格納するテーブルを指定します。

saveState パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

seed=double

乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータクロックに基づいています。負の値を指定すると、コンピュータクロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。

デフォルト0
範囲0–MACINT

singular=double

除算でゼロを避けるために小さな値を指定します。

デフォルト1E-12
最小値0

subSampleRate=double

各ツリーの構築に使用するデータの割合を指定します。

別名subsample
samplingRate
デフォルト0.5
範囲(0–1]

* table={castable}

入力テーブルの設定を指定します。

長い形式table={name="table-name"}
短い形式table="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=true | false

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトfalse
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}

データソースオプションを指定します。

別名options
dataSource
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=true | false

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトfalse
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable={groupbytable}

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルタテーブルの名前を指定します。

vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

* target="variable-name"

学習のターゲット変数または応答変数を指定します。変数が数値であるが、nominal= パラメータで指定されておらず、nbinstarget= が指定されていない場合、回帰ツリーが学習されます。

transLearnBurn=integer

転移学習中に、補助オブザベーションのダウンウェイトが開始する前に作成するツリー数を指定します。

デフォルト0
最小値0

transLearnShrink=double

転移学習中に、非生産的な補助データをどれだけダウンウェイトするかを指定します。

デフォルト0.9
範囲0–1

transLearnTrim=double

転移学習中に、補助オブザベーションがダウンウェイトされる学習データ上の勾配の分布の割合を指定します。

デフォルト0.01
範囲(0–0.5]

validTable={castable}

入力テーブルの設定を指定します。

長い形式validTable={name="table-name"}
短い形式validTable="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=true | false

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトfalse
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}

データソースオプションを指定します。

別名options
dataSource
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=true | false

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトfalse
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable={groupbytable}

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルタテーブルの名前を指定します。

vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

varImp=true | false

変数重要度の情報を生成するかどうかを指定します。重要度の値は、Gini の総削減量によって決まります。

デフォルトfalse

varIntImp=integer

変数の交互作用の重要度を要求し、交互作用の最大次数を指定します。

デフォルト1
範囲0–3

weight="variable-name"

各オブザベーションの重みを含む数値変数を指定します。

gbtreeTrain アクション

勾配ブースティングツリーを学習します。このアクションには、SAS Visual Data Mining and Machine Learning のライセンスが必要です。

Python 構文

results= s.decisionTree.gbtreeTrain(
applyRowOrder=True | False,
attributes=[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
auxData="variable-name",
binOrder=True | False,
casOut={
"caslib":"string",
"compress":True | False,
"indexVars":["variable-name-1" <, "variable-name-2", ...>],
"label":"string",
"lifetime":64-bit-integer,
"maxMemSize":64-bit-integer,
"memoryFormat":"DVR" | "INHERIT" | "STANDARD",
"name":"table-name",
"onDemand":True | False,
"promote":True | False,
"replace":True | False,
"replication":integer,
"threadBlockSize":64-bit-integer,
"timeStamp":"string",
"where":["string-1" <, "string-2", ...>]
},
code={
"casOut":{
"caslib":"string"
"compress":True | False
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
"label":"string"
"lifetime":64-bit-integer
"maxMemSize":64-bit-integer
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"
"name":"table-name"
"onDemand":True | False
"promote":True | False
"replace":True | False
"replication":integer
"threadBlockSize":64-bit-integer
"timeStamp":"string"
"where":["string-1" <, "string-2", ...>]
},
"comment":True | False,
"fmtWdth":integer,
"indentSize":integer,
"labelId":integer,
"lineSize":integer,
"noTrim":True | False,
"tabForm":True | False
},
codeInteractions={
"casOut":{
"caslib":"string"
"compress":True | False
"indexVars":["variable-name-1" <, "variable-name-2", ...>]
"label":"string"
"lifetime":64-bit-integer
"maxMemSize":64-bit-integer
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"
"name":"table-name"
"onDemand":True | False
"promote":True | False
"replace":True | False
"replication":integer
"threadBlockSize":64-bit-integer
"timeStamp":"string"
"where":["string-1" <, "string-2", ...>]
},
"comment":True | False,
"fmtWdth":integer,
"indentSize":integer,
"labelId":integer,
"lineSize":integer,
"noTrim":True | False,
"tabForm":True | False
},
distribution="BINARY" | "GAUSSIAN" | "MULTINOMIAL" | "POISSON" | "TWEEDIE" | 64-bit-integer,
earlyStop={
"metric":"ASE" | "LOGLOSS" | "MCR",
"minimum":True | False,
"stagnation":64-bit-integer,
"threshold":double,
"thresholdIter":64-bit-integer,
"tolerance":double
},
encodeName=True | False,
fcmpEvalMetric="string",
freq="variable-name",
greedy=True | False,
includeMissing=True | False,
initPred=double,
required parameter inputs=[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
lasso=double,
leafSize=integer,
learningRate=double,
logLevel=integer,
m=integer,
maxBranch=integer,
maxLevel=integer,
mergeBin=True | False,
minHessian=double,
modelId="string",
modelTable={
"caslib":"string",
"computedOnDemand":True | False,
"computedVars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"computedVarsProgram":"string",
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>},
"groupBy":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"groupByMode":"NOSORT" | "REDISTRIBUTE",
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter "name":"table-name",
"onDemand":True | False,
"orderBy":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"singlePass":True | False,
"vars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"where":"where-expression",
"whereTable":{
"casLib":"string"
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter "name":"table-name"
"vars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>]
"where":"where-expression"
}
},
monoDec=["string-1" <, "string-2", ...>],
monoInc=["string-1" <, "string-2", ...>],
nBins=integer,
nominalHandling="CLASSIC" | "ENHANCED",
nominals=[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
nominalSearch={
"handling":"CLASSIC" | "ENHANCED",
"maxCategories":64-bit-integer,
"shrinkage":double,
"sort":64-bit-integer,
"sortBy":"COUNT" | "TARGET"
},
nTree=integer,
offset="variable-name",
phi=double,
power=double,
quantileBin=True | False,
ridge=double,
saveState={
"caslib":"string",
"compress":True | False,
"indexVars":["variable-name-1" <, "variable-name-2", ...>],
"label":"string",
"lifetime":64-bit-integer,
"maxMemSize":64-bit-integer,
"memoryFormat":"DVR" | "INHERIT" | "STANDARD",
"name":"table-name",
"onDemand":True | False,
"promote":True | False,
"replace":True | False,
"replication":integer,
"threadBlockSize":64-bit-integer,
"timeStamp":"string",
"where":["string-1" <, "string-2", ...>]
},
seed=double,
singular=double,
required parameter table={
"caslib":"string",
"computedOnDemand":True | False,
"computedVars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>},
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter "name":"table-name",
"singlePass":True | False,
"vars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"where":"where-expression",
"whereTable":{
"casLib":"string"
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter "name":"table-name"
"vars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>]
"where":"where-expression"
}
},
required parameter target="variable-name",
validTable={
"caslib":"string",
"computedOnDemand":True | False,
"computedVars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>},
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter "name":"table-name",
"singlePass":True | False,
"vars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"where":"where-expression",
"whereTable":{
"casLib":"string"
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter "name":"table-name"
"vars":[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>]
"where":"where-expression"
}
},
varImp=True | False,
varIntImp=integer,
weight="variable-name"
)
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

 modelTable

—

モデルを含むテーブルを指定します。

required parametertable

—

入力テーブルの設定を指定します。

 validTable

—

入力テーブルの設定を指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 casOut

—

デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。

 code

casOut

アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。

 codeInteractions

casOut

アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。

 saveState

—

生成された aStore モデルを格納するテーブルを指定します。

パラメーターの説明

applyRowOrder=True | False

アクションで事前に指定された行順序を使用することを指定します。これには、予備の table.partition アクション呼び出しで orderby パラメータと groupby パラメータを使用する必要があります。

別名reproducibleRowOrder
デフォルトFalse

attributes=[{casinvardesc-1} <, {casinvardesc-2}, ...>]

入力変数に適用するフォーマットなどの一時的な属性を指定します。

attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名attribute
attrs
attr
varAttrs

auxData="variable-name"

補助ソースからのオブザベーションを示す、転移学習の変数を指定します。値 0 は、従来の学習オブザベーションを示します。その他の値は補助データを示します。

binOrder=True | False

デフォルトでは、数値変数のビンの順序は保持されます。False に設定すると、数値変数のビンの順序は無視されます。

デフォルトTrue

casOut={casouttable}

デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

code={codegen}

アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。

code パラメーターの指定の詳細については、共通 codegen パラメーターを参照してください。

codeInteractions={viicodegen}

アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。

viicodegen の値は次のいずれかになります:

"casOut":{casouttable}

出力テーブルの設定を指定します。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

"comment":True | False

True に設定すると、DATA ステップコードにコメントが追加されます。

デフォルトFalse
"fmtWdth":integer

DATA ステップコードでのパラメータ推定値などの派生数の書式設定に使用する幅を指定します。

別名fmtWidth
デフォルト20
範囲0–32
"indentSize":integer

各レベルの DATA ステップコードをインデントするスペースの数を指定します。

デフォルト3
範囲0–10
"labelId":integer

DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。

"lineSize":integer

生成されたコードの行サイズを指定します。

デフォルト120
範囲64–254
"noTrim":True | False

True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。

デフォルトFalse
"tabForm":True | False

True に設定すると、テーブルの格納に適した方法でコードが生成されます。

別名tableForm
デフォルトFalse

distribution="BINARY" | "GAUSSIAN" | "MULTINOMIAL" | "POISSON" | "TWEEDIE" | 64-bit-integer

勾配ブースティングツリーの分布を指定します。

デフォルトBINARY
BINARYこの値は二項分類に役立ちます。
GAUSSIANこの値は回帰ツリーに役立ちます。
MULTINOMIALこの値は、2 つ以上のクラスを持つ分類の多項分布に役立ちます。
POISSONこの値はポアソン分布に役立ちます。
TWEEDIEこの値は tweedie の分布に役立ちます。

earlyStop={tkcasdt_earlyStop}

tkcasdt_earlyStop の値は次のいずれかになります:

"metric":"ASE" | "LOGLOSS" | "MCR"
"minimum":True | False
別名smallest
デフォルトFalse
"stagnation":64-bit-integer
デフォルト0
最小値0
"threshold":double
デフォルト0
最小値0
"thresholdIter":64-bit-integer
デフォルト0
最小値0
"tolerance":double
デフォルト0
最小値0

encodeName=True | False

生成された casout テーブルで、バイナリまたは名義ターゲットの予測確率などの変数名をエンコードするかどうかを指定します。予測確率は _DT_P_ の代わりに接頭辞 P_ で名前が付けられます。

デフォルトFalse

fcmpEvalMetric="string"

勾配ブースティングツリーモデルの FCMP 評価メトリックを指定します

別名fcmpEvalFunc

freq="variable-name"

各オブザベーションの発生頻度を含む数値変数を指定します。

greedy=True | False

デフォルトでは、各ツリーノードの各変数の最適な分割を決定するために、貪欲探索またはしらみつぶし探索が使用されます。False に設定すると、クラスタリングに基づく高速で効率的なアルゴリズムが適用されます。カーディナリティが高い変数には、このパラメータを False に設定することをお勧めします。

デフォルトTrue

includeMissing=True | False

デフォルトでは、欠損値を持つオブザベーションは含まれます。False に設定すると、スコアリング時にツリーモデルで使用される変数の欠損値を持つオブザベーションは無視されます。

デフォルトTrue

initPred=double

デフォルト0

* inputs=[{casinvardesc-1} <, {casinvardesc-2}, ...>]

分析に使用する入力変数を指定します。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名input

lasso=double

予測における L1 ノルム正則化を指定します。値は 0 以上でなければなりません。

デフォルト0
最小値0

leafSize=integer

各ノードのオブザベーションの最小数を指定します。

デフォルト5
最小値1

learningRate=double

各ツリーの学習率を指定します。

デフォルト0.1
範囲(0–1]

logLevel=integer

デフォルト0
最小値0

m=integer

ノード上で分割する際に考慮する入力変数の数を指定します。変数は、各ツリーの入力変数からランダムに選択されます。デフォルトでは、フォレストは使用される入力変数の数の平方根を使用して、最も近い整数に切り上げられます。勾配ブースティングでは、入力変数の数が使用されます。

最小値1

maxBranch=integer

ツリーの各水準で許可される子 (枝) の最大数を指定します。

デフォルト2
最小値1

maxLevel=integer

ツリー水準の最大数を指定します。

デフォルト5
最小値1

mergeBin=True | False

デフォルトでは、1 つのビンの最大値が隣接するビンの最小値と一致すると、値は下のビンにマージされます。False に設定すると、アクションはビンをマージしようとしません。

デフォルトTrue

minHessian=double

デフォルト0
最小値0

minUseInSearch=integer

欠落したパラメータが USEINSEARCH に設定されている場合、分割検索で欠損値を使用するためのしきい値を指定します。分割変数がノード内に欠損値を持つオブザベーション数が指定された値以上の場合、アクションは USEINSEARCH ポリシーを開始します。それ以外の場合は、欠損値が人気のある分岐に割り当てられます。

デフォルト1

missing="MACSMALL" | "USEINSEARCH"

欠損値を処理するポリシーを指定します。

デフォルトUSEINSEARCH
MACSMALL

数値変数の欠損値を最小のマシン値として扱い、名義変数の欠損値を別の水準として扱うように指定します。

USEINSEARCH

分割ルールの価値の計算に欠損値を組み込み、その結果、欠損値を分割の価値を最大にする分岐に関連付ける分割ルールを作成することを指定します。

modelId="string"

SAS スコアコードを生成するときに使用するモデル ID 変数名を指定します。デフォルトでは、DT_ はターゲット変数名の前に付けられます。

modelTable={castable}

モデルを含むテーブルを指定します。

modelTable パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。

monoDec=["string-1" <, "string-2", ...>]

入力値が増加したときに予測が増加しない間隔入力を指定します。完全なコンプライアンスは保証されていません。

別名monotoneDecrease
monotoneDec
Dec

monoInc=["string-1" <, "string-2", ...>]

入力値が増加したときに予測が減少しない間隔入力を指定します。完全なコンプライアンスは保証されていません。

別名monotoneIncrease
monotoneInc
Inc

nBins=integer

ディシジョンツリーの計算で数値変数に使用するビン数を指定します。

デフォルト50
最小値1

nominalHandling="CLASSIC" | "ENHANCED"

nominals=[{casinvardesc-1} <, {casinvardesc-2}, ...>]

分析に使用する名義尺度の入力変数を指定します。

nominals パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名nominal

nominalSearch={tkcasdt_nomSearchOpts}

名義入力で分割を検索する方法を指定します。

別名nomSearch

tkcasdt_nomSearchOpts の値は次のいずれかになります:

"handling":"CLASSIC" | "ENHANCED"
"maxCategories":64-bit-integer

分割ルールに含める水準の最大数を指定します。

別名maxCats
maxLevels
maxValues
cluster
minCardCluster
デフォルト128
最小値0
"shrinkage":double

ソート方法でカテゴリ平均に与える重みを指定します。

デフォルト10
最小値0
"sort":64-bit-integer

ソート方法を使用するための入力の最小カーディナリティを指定します。

別名minCardSort
デフォルト10
最小値0
"sortBy":"COUNT" | "TARGET"

nTree=integer

作成するツリー数を指定します。

別名nTrees
デフォルト50
最小値1

offset="variable-name"

分布=POISSON または TWEEDIE で使用するオフセット変数を指定します。

phi=double

この値は tweedie 分布の power パラメータに役立ちます。

別名scale
最小値 (含まない)0

power=double

この値は tweedie 分布の power パラメータに役立ちます。

デフォルト1.5
範囲(1, 2)

quantileBin=True | False

等しい幅のビンではなく、数値入力の分位点でビン境界を指定します。

別名qbin
qtbin
デフォルトTrue

ridge=double

予測における L2 ノルム正則化を指定します。値は 0 以上でなければなりません。

デフォルト1
最小値0

saveState={casouttable}

生成された aStore モデルを格納するテーブルを指定します。

saveState パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

seed=double

乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータクロックに基づいています。負の値を指定すると、コンピュータクロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。

デフォルト0
範囲0–MACINT

singular=double

除算でゼロを避けるために小さな値を指定します。

デフォルト1E-12
最小値0

subSampleRate=double

各ツリーの構築に使用するデータの割合を指定します。

別名subsample
samplingRate
デフォルト0.5
範囲(0–1]

* table={castable}

入力テーブルの設定を指定します。

長い形式table={"name":"table-name"}
短い形式table="table-name"

castable の値は次のいずれかになります:

"caslib":"string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

"computedOnDemand":True | False

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトFalse
"computedVars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"computedVarsProgram":"string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>}

データソースオプションを指定します。

別名options
dataSource
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import_

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* "name":"table-name"

入力テーブルの名前を指定します。

"singlePass":True | False

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFalse
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"where":"where-expression"

入力データをサブセット化する式を指定します。

"whereTable":{groupbytable}

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

"casLib":"string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import_

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* "name":"table-name"

フィルタテーブルの名前を指定します。

"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"where":"where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

* target="variable-name"

学習のターゲット変数または応答変数を指定します。変数が数値であるが、nominal= パラメータで指定されておらず、nbinstarget= が指定されていない場合、回帰ツリーが学習されます。

transLearnBurn=integer

転移学習中に、補助オブザベーションのダウンウェイトが開始する前に作成するツリー数を指定します。

デフォルト0
最小値0

transLearnShrink=double

転移学習中に、非生産的な補助データをどれだけダウンウェイトするかを指定します。

デフォルト0.9
範囲0–1

transLearnTrim=double

転移学習中に、補助オブザベーションがダウンウェイトされる学習データ上の勾配の分布の割合を指定します。

デフォルト0.01
範囲(0–0.5]

validTable={castable}

入力テーブルの設定を指定します。

長い形式validTable={"name":"table-name"}
短い形式validTable="table-name"

castable の値は次のいずれかになります:

"caslib":"string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

"computedOnDemand":True | False

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトFalse
"computedVars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"computedVarsProgram":"string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>}

データソースオプションを指定します。

別名options
dataSource
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import_

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* "name":"table-name"

入力テーブルの名前を指定します。

"singlePass":True | False

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFalse
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"where":"where-expression"

入力データをサブセット化する式を指定します。

"whereTable":{groupbytable}

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

"casLib":"string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import_

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* "name":"table-name"

フィルタテーブルの名前を指定します。

"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"where":"where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

varImp=True | False

変数重要度の情報を生成するかどうかを指定します。重要度の値は、Gini の総削減量によって決まります。

デフォルトFalse

varIntImp=integer

変数の交互作用の重要度を要求し、交互作用の最大次数を指定します。

デフォルト1
範囲0–3

weight="variable-name"

各オブザベーションの重みを含む数値変数を指定します。

gbtreeTrain アクション

勾配ブースティングツリーを学習します。このアクションには、SAS Visual Data Mining and Machine Learning のライセンスが必要です。

R 構文

results <– cas.decisionTree.gbtreeTrain(s,
applyRowOrder=TRUE | FALSE,
attributes=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
auxData="variable-name",
binOrder=TRUE | FALSE,
casOut=list(
caslib="string",
compress=TRUE | FALSE,
indexVars=list("variable-name-1" <, "variable-name-2", ...>),
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
onDemand=TRUE | FALSE,
promote=TRUE | FALSE,
replace=TRUE | FALSE,
replication=integer,
threadBlockSize=64-bit-integer,
timeStamp="string",
where=list("string-1" <, "string-2", ...>)
),
code=list(
casOut=list(
caslib="string"
compress=TRUE | FALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
onDemand=TRUE | FALSE
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
threadBlockSize=64-bit-integer
timeStamp="string"
where=list("string-1" <, "string-2", ...>)
),
comment=TRUE | FALSE,
fmtWdth=integer,
indentSize=integer,
labelId=integer,
lineSize=integer,
noTrim=TRUE | FALSE,
tabForm=TRUE | FALSE
),
codeInteractions=list(
casOut=list(
caslib="string"
compress=TRUE | FALSE
indexVars=list("variable-name-1" <, "variable-name-2", ...>)
label="string"
lifetime=64-bit-integer
maxMemSize=64-bit-integer
memoryFormat="DVR" | "INHERIT" | "STANDARD"
name="table-name"
onDemand=TRUE | FALSE
promote=TRUE | FALSE
replace=TRUE | FALSE
replication=integer
threadBlockSize=64-bit-integer
timeStamp="string"
where=list("string-1" <, "string-2", ...>)
),
comment=TRUE | FALSE,
fmtWdth=integer,
indentSize=integer,
labelId=integer,
lineSize=integer,
noTrim=TRUE | FALSE,
tabForm=TRUE | FALSE
),
distribution="BINARY" | "GAUSSIAN" | "MULTINOMIAL" | "POISSON" | "TWEEDIE" | 64-bit-integer,
earlyStop=list(
metric="ASE" | "LOGLOSS" | "MCR",
minimum=TRUE | FALSE,
stagnation=64-bit-integer,
threshold=double,
thresholdIter=64-bit-integer,
tolerance=double
),
encodeName=TRUE | FALSE,
fcmpEvalMetric="string",
freq="variable-name",
greedy=TRUE | FALSE,
includeMissing=TRUE | FALSE,
initPred=double,
required parameter inputs=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
lasso=double,
leafSize=integer,
learningRate=double,
logLevel=integer,
m=integer,
maxBranch=integer,
maxLevel=integer,
mergeBin=TRUE | FALSE,
minHessian=double,
modelId="string",
modelTable=list(
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
computedVarsProgram="string",
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>),
groupBy=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
groupByMode="NOSORT" | "REDISTRIBUTE",
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters),
required parameter name="table-name",
onDemand=TRUE | FALSE,
orderBy=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
singlePass=TRUE | FALSE,
vars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
where="where-expression",
whereTable=list(
casLib="string"
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameterslist)
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
required parameter name="table-name"
vars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>)
where="where-expression"
)
),
monoDec=list("string-1" <, "string-2", ...>),
monoInc=list("string-1" <, "string-2", ...>),
nBins=integer,
nominalHandling="CLASSIC" | "ENHANCED",
nominals=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
nominalSearch=list(
handling="CLASSIC" | "ENHANCED",
maxCategories=64-bit-integer,
shrinkage=double,
sort=64-bit-integer,
sortBy="COUNT" | "TARGET"
),
nTree=integer,
offset="variable-name",
phi=double,
power=double,
quantileBin=TRUE | FALSE,
ridge=double,
saveState=list(
caslib="string",
compress=TRUE | FALSE,
indexVars=list("variable-name-1" <, "variable-name-2", ...>),
label="string",
lifetime=64-bit-integer,
maxMemSize=64-bit-integer,
memoryFormat="DVR" | "INHERIT" | "STANDARD",
name="table-name",
onDemand=TRUE | FALSE,
promote=TRUE | FALSE,
replace=TRUE | FALSE,
replication=integer,
threadBlockSize=64-bit-integer,
timeStamp="string",
where=list("string-1" <, "string-2", ...>)
),
seed=double,
singular=double,
required parameter table=list(
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>),
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters),
required parameter name="table-name",
singlePass=TRUE | FALSE,
vars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
where="where-expression",
whereTable=list(
casLib="string"
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameterslist)
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
required parameter name="table-name"
vars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>)
where="where-expression"
)
),
required parameter target="variable-name",
validTable=list(
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>),
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters),
required parameter name="table-name",
singlePass=TRUE | FALSE,
vars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
where="where-expression",
whereTable=list(
casLib="string"
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameterslist)
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
required parameter name="table-name"
vars=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>)
where="where-expression"
)
),
varImp=TRUE | FALSE,
varIntImp=integer,
weight="variable-name"
)
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

 modelTable

—

モデルを含むテーブルを指定します。

required parametertable

—

入力テーブルの設定を指定します。

 validTable

—

入力テーブルの設定を指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

 casOut

—

デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。

 code

casOut

アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。

 codeInteractions

casOut

アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。

 saveState

—

生成された aStore モデルを格納するテーブルを指定します。

パラメーターの説明

applyRowOrder=TRUE | FALSE

アクションで事前に指定された行順序を使用することを指定します。これには、予備の table.partition アクション呼び出しで orderby パラメータと groupby パラメータを使用する必要があります。

別名reproducibleRowOrder
デフォルトFALSE

attributes=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

入力変数に適用するフォーマットなどの一時的な属性を指定します。

attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名attribute
attrs
attr
varAttrs

auxData="variable-name"

補助ソースからのオブザベーションを示す、転移学習の変数を指定します。値 0 は、従来の学習オブザベーションを示します。その他の値は補助データを示します。

binOrder=TRUE | FALSE

デフォルトでは、数値変数のビンの順序は保持されます。False に設定すると、数値変数のビンの順序は無視されます。

デフォルトTRUE

casOut=list(casouttable)

デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

code=list(codegen)

アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。

code パラメーターの指定の詳細については、共通 codegen パラメーターを参照してください。

codeInteractions=list(viicodegen)

アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。

viicodegen の値は次のいずれかになります:

casOut=list(casouttable)

出力テーブルの設定を指定します。

casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

comment=TRUE | FALSE

True に設定すると、DATA ステップコードにコメントが追加されます。

デフォルトFALSE
fmtWdth=integer

DATA ステップコードでのパラメータ推定値などの派生数の書式設定に使用する幅を指定します。

別名fmtWidth
デフォルト20
範囲0–32
indentSize=integer

各レベルの DATA ステップコードをインデントするスペースの数を指定します。

デフォルト3
範囲0–10
labelId=integer

DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。

lineSize=integer

生成されたコードの行サイズを指定します。

デフォルト120
範囲64–254
noTrim=TRUE | FALSE

True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。

デフォルトFALSE
tabForm=TRUE | FALSE

True に設定すると、テーブルの格納に適した方法でコードが生成されます。

別名tableForm
デフォルトFALSE

distribution="BINARY" | "GAUSSIAN" | "MULTINOMIAL" | "POISSON" | "TWEEDIE" | 64-bit-integer

勾配ブースティングツリーの分布を指定します。

デフォルトBINARY
BINARYこの値は二項分類に役立ちます。
GAUSSIANこの値は回帰ツリーに役立ちます。
MULTINOMIALこの値は、2 つ以上のクラスを持つ分類の多項分布に役立ちます。
POISSONこの値はポアソン分布に役立ちます。
TWEEDIEこの値は tweedie の分布に役立ちます。

earlyStop=list(tkcasdt_earlyStop)

tkcasdt_earlyStop の値は次のいずれかになります:

metric="ASE" | "LOGLOSS" | "MCR"
minimum=TRUE | FALSE
別名smallest
デフォルトFALSE
stagnation=64-bit-integer
デフォルト0
最小値0
threshold=double
デフォルト0
最小値0
thresholdIter=64-bit-integer
デフォルト0
最小値0
tolerance=double
デフォルト0
最小値0

encodeName=TRUE | FALSE

生成された casout テーブルで、バイナリまたは名義ターゲットの予測確率などの変数名をエンコードするかどうかを指定します。予測確率は _DT_P_ の代わりに接頭辞 P_ で名前が付けられます。

デフォルトFALSE

fcmpEvalMetric="string"

勾配ブースティングツリーモデルの FCMP 評価メトリックを指定します

別名fcmpEvalFunc

freq="variable-name"

各オブザベーションの発生頻度を含む数値変数を指定します。

greedy=TRUE | FALSE

デフォルトでは、各ツリーノードの各変数の最適な分割を決定するために、貪欲探索またはしらみつぶし探索が使用されます。False に設定すると、クラスタリングに基づく高速で効率的なアルゴリズムが適用されます。カーディナリティが高い変数には、このパラメータを False に設定することをお勧めします。

デフォルトTRUE

includeMissing=TRUE | FALSE

デフォルトでは、欠損値を持つオブザベーションは含まれます。False に設定すると、スコアリング時にツリーモデルで使用される変数の欠損値を持つオブザベーションは無視されます。

デフォルトTRUE

initPred=double

デフォルト0

* inputs=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

分析に使用する入力変数を指定します。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名input

lasso=double

予測における L1 ノルム正則化を指定します。値は 0 以上でなければなりません。

デフォルト0
最小値0

leafSize=integer

各ノードのオブザベーションの最小数を指定します。

デフォルト5
最小値1

learningRate=double

各ツリーの学習率を指定します。

デフォルト0.1
範囲(0–1]

logLevel=integer

デフォルト0
最小値0

m=integer

ノード上で分割する際に考慮する入力変数の数を指定します。変数は、各ツリーの入力変数からランダムに選択されます。デフォルトでは、フォレストは使用される入力変数の数の平方根を使用して、最も近い整数に切り上げられます。勾配ブースティングでは、入力変数の数が使用されます。

最小値1

maxBranch=integer

ツリーの各水準で許可される子 (枝) の最大数を指定します。

デフォルト2
最小値1

maxLevel=integer

ツリー水準の最大数を指定します。

デフォルト5
最小値1

mergeBin=TRUE | FALSE

デフォルトでは、1 つのビンの最大値が隣接するビンの最小値と一致すると、値は下のビンにマージされます。False に設定すると、アクションはビンをマージしようとしません。

デフォルトTRUE

minHessian=double

デフォルト0
最小値0

minUseInSearch=integer

欠落したパラメータが USEINSEARCH に設定されている場合、分割検索で欠損値を使用するためのしきい値を指定します。分割変数がノード内に欠損値を持つオブザベーション数が指定された値以上の場合、アクションは USEINSEARCH ポリシーを開始します。それ以外の場合は、欠損値が人気のある分岐に割り当てられます。

デフォルト1

missing="MACSMALL" | "USEINSEARCH"

欠損値を処理するポリシーを指定します。

デフォルトUSEINSEARCH
MACSMALL

数値変数の欠損値を最小のマシン値として扱い、名義変数の欠損値を別の水準として扱うように指定します。

USEINSEARCH

分割ルールの価値の計算に欠損値を組み込み、その結果、欠損値を分割の価値を最大にする分岐に関連付ける分割ルールを作成することを指定します。

modelId="string"

SAS スコアコードを生成するときに使用するモデル ID 変数名を指定します。デフォルトでは、DT_ はターゲット変数名の前に付けられます。

modelTable=list(castable)

モデルを含むテーブルを指定します。

modelTable パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。

monoDec=list("string-1" <, "string-2", ...>)

入力値が増加したときに予測が増加しない間隔入力を指定します。完全なコンプライアンスは保証されていません。

別名monotoneDecrease
monotoneDec
Dec

monoInc=list("string-1" <, "string-2", ...>)

入力値が増加したときに予測が減少しない間隔入力を指定します。完全なコンプライアンスは保証されていません。

別名monotoneIncrease
monotoneInc
Inc

nBins=integer

ディシジョンツリーの計算で数値変数に使用するビン数を指定します。

デフォルト50
最小値1

nominalHandling="CLASSIC" | "ENHANCED"

nominals=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

分析に使用する名義尺度の入力変数を指定します。

nominals パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名nominal

nominalSearch=list(tkcasdt_nomSearchOpts)

名義入力で分割を検索する方法を指定します。

別名nomSearch

tkcasdt_nomSearchOpts の値は次のいずれかになります:

handling="CLASSIC" | "ENHANCED"
maxCategories=64-bit-integer

分割ルールに含める水準の最大数を指定します。

別名maxCats
maxLevels
maxValues
cluster
minCardCluster
デフォルト128
最小値0
shrinkage=double

ソート方法でカテゴリ平均に与える重みを指定します。

デフォルト10
最小値0
sort=64-bit-integer

ソート方法を使用するための入力の最小カーディナリティを指定します。

別名minCardSort
デフォルト10
最小値0
sortBy="COUNT" | "TARGET"

nTree=integer

作成するツリー数を指定します。

別名nTrees
デフォルト50
最小値1

offset="variable-name"

分布=POISSON または TWEEDIE で使用するオフセット変数を指定します。

phi=double

この値は tweedie 分布の power パラメータに役立ちます。

別名scale
最小値 (含まない)0

power=double

この値は tweedie 分布の power パラメータに役立ちます。

デフォルト1.5
範囲(1, 2)

quantileBin=TRUE | FALSE

等しい幅のビンではなく、数値入力の分位点でビン境界を指定します。

別名qbin
qtbin
デフォルトTRUE

ridge=double

予測における L2 ノルム正則化を指定します。値は 0 以上でなければなりません。

デフォルト1
最小値0

saveState=list(casouttable)

生成された aStore モデルを格納するテーブルを指定します。

saveState パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。

seed=double

乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータクロックに基づいています。負の値を指定すると、コンピュータクロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。

デフォルト0
範囲0–MACINT

singular=double

除算でゼロを避けるために小さな値を指定します。

デフォルト1E-12
最小値0

subSampleRate=double

各ツリーの構築に使用するデータの割合を指定します。

別名subsample
samplingRate
デフォルト0.5
範囲(0–1]

* table=list(castable)

入力テーブルの設定を指定します。

長い形式table=list(name="table-name")
短い形式table="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=TRUE | FALSE

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトFALSE
computedVars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>)

データソースオプションを指定します。

別名options
dataSource
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=TRUE | FALSE

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFALSE
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable=list(groupbytable)

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルタテーブルの名前を指定します。

vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

* target="variable-name"

学習のターゲット変数または応答変数を指定します。変数が数値であるが、nominal= パラメータで指定されておらず、nbinstarget= が指定されていない場合、回帰ツリーが学習されます。

transLearnBurn=integer

転移学習中に、補助オブザベーションのダウンウェイトが開始する前に作成するツリー数を指定します。

デフォルト0
最小値0

transLearnShrink=double

転移学習中に、非生産的な補助データをどれだけダウンウェイトするかを指定します。

デフォルト0.9
範囲0–1

transLearnTrim=double

転移学習中に、補助オブザベーションがダウンウェイトされる学習データ上の勾配の分布の割合を指定します。

デフォルト0.01
範囲(0–0.5]

validTable=list(castable)

入力テーブルの設定を指定します。

長い形式validTable=list(name="table-name")
短い形式validTable="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=TRUE | FALSE

True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。

別名compOnDemand
デフォルトFALSE
computedVars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメータに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>)

データソースオプションを指定します。

別名options
dataSource
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=TRUE | FALSE

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFALSE
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable=list(groupbytable)

WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルタテーブルの名前を指定します。

vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

フィルタテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルタテーブルからデータをサブセット化する式を指定します。

varImp=TRUE | FALSE

変数重要度の情報を生成するかどうかを指定します。重要度の値は、Gini の総削減量によって決まります。

デフォルトFALSE

varIntImp=integer

変数の交互作用の重要度を要求し、交互作用の最大次数を指定します。

デフォルト1
範囲0–3

weight="variable-name"

各オブザベーションの重みを含む数値変数を指定します。

最終更新: 2022/10/04