ディシジョンツリー アクションセット: 構文
デシジョンツリー、フォレスト、および勾配ブースティングによるモデリングおよびスコアリングのアクションを提供します
gbtreeTrain アクション
勾配ブースティングツリーを学習します。このアクションには、SAS Visual Data Mining and Machine Learning のライセンスが必要です。
CASL 構文
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
モデルを含むテーブルを指定します。 | |
|
required parametertable |
— |
入力テーブルの設定を指定します。 |
|
— |
入力テーブルの設定を指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。 | |
|
casOut |
アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。 | |
|
casOut |
アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。 | |
|
— |
生成された aStore モデルを格納するテーブルを指定します。 |
パラメーターの説明
applyRowOrder=TRUE | FALSE
アクションで事前に指定された行順序を使用することを指定します。これには、予備の table.partition アクション呼び出しで orderby パラメータと groupby パラメータを使用する必要があります。
| 別名 | reproducibleRowOrder |
|---|---|
| デフォルト | FALSE |
attributes={{casinvardesc-1} <, {casinvardesc-2}, ...>}
入力変数に適用するフォーマットなどの一時的な属性を指定します。
attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | attribute |
|---|---|
| attrs | |
| attr | |
| varAttrs |
auxData="variable-name"
補助ソースからのオブザベーションを示す、転移学習の変数を指定します。値 0 は、従来の学習オブザベーションを示します。その他の値は補助データを示します。
binOrder=TRUE | FALSE
デフォルトでは、数値変数のビンの順序は保持されます。False に設定すると、数値変数のビンの順序は無視されます。
| デフォルト | TRUE |
|---|
casOut={casouttable}
デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。
casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
code={codegen}
アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。
code パラメーターの指定の詳細については、共通 codegen パラメーターを参照してください。
codeInteractions={viicodegen}
アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。
viicodegen の値は次のいずれかになります:
casOut={casouttable}
出力テーブルの設定を指定します。
casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
comment=TRUE | FALSE
True に設定すると、DATA ステップコードにコメントが追加されます。
| デフォルト | FALSE |
|---|
fmtWdth=integer
DATA ステップコードでのパラメータ推定値などの派生数の書式設定に使用する幅を指定します。
| 別名 | fmtWidth |
|---|---|
| デフォルト | 20 |
| 範囲 | 0–32 |
indentSize=integer
各レベルの DATA ステップコードをインデントするスペースの数を指定します。
| デフォルト | 3 |
|---|---|
| 範囲 | 0–10 |
labelId=integer
DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。
lineSize=integer
生成されたコードの行サイズを指定します。
| デフォルト | 120 |
|---|---|
| 範囲 | 64–254 |
noTrim=TRUE | FALSE
True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。
| デフォルト | FALSE |
|---|
tabForm=TRUE | FALSE
True に設定すると、テーブルの格納に適した方法でコードが生成されます。
| 別名 | tableForm |
|---|---|
| デフォルト | FALSE |
distribution="BINARY" | "GAUSSIAN" | "MULTINOMIAL" | "POISSON" | "TWEEDIE" | 64-bit-integer
勾配ブースティングツリーの分布を指定します。
| デフォルト | BINARY |
|---|---|
| BINARY | この値は二項分類に役立ちます。 |
| GAUSSIAN | この値は回帰ツリーに役立ちます。 |
| MULTINOMIAL | この値は、2 つ以上のクラスを持つ分類の多項分布に役立ちます。 |
| POISSON | この値はポアソン分布に役立ちます。 |
| TWEEDIE | この値は tweedie の分布に役立ちます。 |
earlyStop={tkcasdt_earlyStop}
tkcasdt_earlyStop の値は次のいずれかになります:
metric="ASE" | "LOGLOSS" | "MCR"
minimum=TRUE | FALSE
| 別名 | smallest |
|---|---|
| デフォルト | FALSE |
stagnation=64-bit-integer
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
threshold=double
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
thresholdIter=64-bit-integer
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
tolerance=double
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
encodeName=TRUE | FALSE
生成された casout テーブルで、バイナリまたは名義ターゲットの予測確率などの変数名をエンコードするかどうかを指定します。予測確率は _DT_P_ の代わりに接頭辞 P_ で名前が付けられます。
| デフォルト | FALSE |
|---|
fcmpEvalMetric="string"
勾配ブースティングツリーモデルの FCMP 評価メトリックを指定します
| 別名 | fcmpEvalFunc |
|---|
freq="variable-name"
各オブザベーションの発生頻度を含む数値変数を指定します。
greedy=TRUE | FALSE
デフォルトでは、各ツリーノードの各変数の最適な分割を決定するために、貪欲探索またはしらみつぶし探索が使用されます。False に設定すると、クラスタリングに基づく高速で効率的なアルゴリズムが適用されます。カーディナリティが高い変数には、このパラメータを False に設定することをお勧めします。
| デフォルト | TRUE |
|---|
includeMissing=TRUE | FALSE
デフォルトでは、欠損値を持つオブザベーションは含まれます。False に設定すると、スコアリング時にツリーモデルで使用される変数の欠損値を持つオブザベーションは無視されます。
| デフォルト | TRUE |
|---|
initPred=double
| デフォルト | 0 |
|---|
* inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}
lasso=double
予測における L1 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
leafSize=integer
各ノードのオブザベーションの最小数を指定します。
| デフォルト | 5 |
|---|---|
| 最小値 | 1 |
learningRate=double
各ツリーの学習率を指定します。
| デフォルト | 0.1 |
|---|---|
| 範囲 | (0–1] |
logLevel=integer
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
m=integer
ノード上で分割する際に考慮する入力変数の数を指定します。変数は、各ツリーの入力変数からランダムに選択されます。デフォルトでは、フォレストは使用される入力変数の数の平方根を使用して、最も近い整数に切り上げられます。勾配ブースティングでは、入力変数の数が使用されます。
| 最小値 | 1 |
|---|
maxBranch=integer
ツリーの各水準で許可される子 (枝) の最大数を指定します。
| デフォルト | 2 |
|---|---|
| 最小値 | 1 |
maxLevel=integer
ツリー水準の最大数を指定します。
| デフォルト | 5 |
|---|---|
| 最小値 | 1 |
mergeBin=TRUE | FALSE
デフォルトでは、1 つのビンの最大値が隣接するビンの最小値と一致すると、値は下のビンにマージされます。False に設定すると、アクションはビンをマージしようとしません。
| デフォルト | TRUE |
|---|
minHessian=double
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
minUseInSearch=integer
欠落したパラメータが USEINSEARCH に設定されている場合、分割検索で欠損値を使用するためのしきい値を指定します。分割変数がノード内に欠損値を持つオブザベーション数が指定された値以上の場合、アクションは USEINSEARCH ポリシーを開始します。それ以外の場合は、欠損値が人気のある分岐に割り当てられます。
| デフォルト | 1 |
|---|
missing="MACSMALL" | "USEINSEARCH"
modelId="string"
SAS スコアコードを生成するときに使用するモデル ID 変数名を指定します。デフォルトでは、DT_ はターゲット変数名の前に付けられます。
modelTable={castable}
モデルを含むテーブルを指定します。
modelTable パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。
monoDec={"string-1" <, "string-2", ...>}
入力値が増加したときに予測が増加しない間隔入力を指定します。完全なコンプライアンスは保証されていません。
| 別名 | monotoneDecrease |
|---|---|
| monotoneDec | |
| Dec |
monoInc={"string-1" <, "string-2", ...>}
入力値が増加したときに予測が減少しない間隔入力を指定します。完全なコンプライアンスは保証されていません。
| 別名 | monotoneIncrease |
|---|---|
| monotoneInc | |
| Inc |
nBins=integer
ディシジョンツリーの計算で数値変数に使用するビン数を指定します。
| デフォルト | 50 |
|---|---|
| 最小値 | 1 |
nominalHandling="CLASSIC" | "ENHANCED"
nominals={{casinvardesc-1} <, {casinvardesc-2}, ...>}
nominalSearch={tkcasdt_nomSearchOpts}
名義入力で分割を検索する方法を指定します。
| 別名 | nomSearch |
|---|
tkcasdt_nomSearchOpts の値は次のいずれかになります:
handling="CLASSIC" | "ENHANCED"
maxCategories=64-bit-integer
分割ルールに含める水準の最大数を指定します。
| 別名 | maxCats |
|---|---|
| maxLevels | |
| maxValues | |
| cluster | |
| minCardCluster | |
| デフォルト | 128 |
| 最小値 | 0 |
shrinkage=double
ソート方法でカテゴリ平均に与える重みを指定します。
| デフォルト | 10 |
|---|---|
| 最小値 | 0 |
sort=64-bit-integer
ソート方法を使用するための入力の最小カーディナリティを指定します。
| 別名 | minCardSort |
|---|---|
| デフォルト | 10 |
| 最小値 | 0 |
sortBy="COUNT" | "TARGET"
nTree=integer
作成するツリー数を指定します。
| 別名 | nTrees |
|---|---|
| デフォルト | 50 |
| 最小値 | 1 |
offset="variable-name"
分布=POISSON または TWEEDIE で使用するオフセット変数を指定します。
phi=double
この値は tweedie 分布の power パラメータに役立ちます。
| 別名 | scale |
|---|---|
| 最小値 (含まない) | 0 |
power=double
この値は tweedie 分布の power パラメータに役立ちます。
| デフォルト | 1.5 |
|---|---|
| 範囲 | (1, 2) |
quantileBin=TRUE | FALSE
等しい幅のビンではなく、数値入力の分位点でビン境界を指定します。
| 別名 | qbin |
|---|---|
| qtbin | |
| デフォルト | TRUE |
ridge=double
予測における L2 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 1 |
|---|---|
| 最小値 | 0 |
saveState={casouttable}
生成された aStore モデルを格納するテーブルを指定します。
saveState パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
seed=double
乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータクロックに基づいています。負の値を指定すると、コンピュータクロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。
| デフォルト | 0 |
|---|---|
| 範囲 | 0–MACINT |
singular=double
除算でゼロを避けるために小さな値を指定します。
| デフォルト | 1E-12 |
|---|---|
| 最小値 | 0 |
subSampleRate=double
各ツリーの構築に使用するデータの割合を指定します。
| 別名 | subsample |
|---|---|
| samplingRate | |
| デフォルト | 0.5 |
| 範囲 | (0–1] |
* table={castable}
入力テーブルの設定を指定します。
| 長い形式 | table={name="table-name"} |
|---|---|
| 短い形式 | table="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=TRUE | FALSE
True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | FALSE |
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメータに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
singlePass=TRUE | FALSE
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | FALSE |
|---|
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable={groupbytable}
WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルタテーブルの名前を指定します。
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
フィルタテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルタテーブルからデータをサブセット化する式を指定します。
* target="variable-name"
学習のターゲット変数または応答変数を指定します。変数が数値であるが、nominal= パラメータで指定されておらず、nbinstarget= が指定されていない場合、回帰ツリーが学習されます。
transLearnBurn=integer
転移学習中に、補助オブザベーションのダウンウェイトが開始する前に作成するツリー数を指定します。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
transLearnShrink=double
転移学習中に、非生産的な補助データをどれだけダウンウェイトするかを指定します。
| デフォルト | 0.9 |
|---|---|
| 範囲 | 0–1 |
transLearnTrim=double
転移学習中に、補助オブザベーションがダウンウェイトされる学習データ上の勾配の分布の割合を指定します。
| デフォルト | 0.01 |
|---|---|
| 範囲 | (0–0.5] |
validTable={castable}
入力テーブルの設定を指定します。
| 長い形式 | validTable={name="table-name"} |
|---|---|
| 短い形式 | validTable="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=TRUE | FALSE
True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | FALSE |
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメータに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
singlePass=TRUE | FALSE
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | FALSE |
|---|
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable={groupbytable}
WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルタテーブルの名前を指定します。
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
フィルタテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルタテーブルからデータをサブセット化する式を指定します。
varImp=TRUE | FALSE
変数重要度の情報を生成するかどうかを指定します。重要度の値は、Gini の総削減量によって決まります。
| デフォルト | FALSE |
|---|
varIntImp=integer
変数の交互作用の重要度を要求し、交互作用の最大次数を指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | 0–3 |
weight="variable-name"
各オブザベーションの重みを含む数値変数を指定します。
gbtreeTrain アクション
勾配ブースティングツリーを学習します。このアクションには、SAS Visual Data Mining and Machine Learning のライセンスが必要です。
Lua 構文
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
モデルを含むテーブルを指定します。 | |
|
required parametertable |
— |
入力テーブルの設定を指定します。 |
|
— |
入力テーブルの設定を指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。 | |
|
casOut |
アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。 | |
|
casOut |
アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。 | |
|
— |
生成された aStore モデルを格納するテーブルを指定します。 |
パラメーターの説明
applyRowOrder=true | false
アクションで事前に指定された行順序を使用することを指定します。これには、予備の table.partition アクション呼び出しで orderby パラメータと groupby パラメータを使用する必要があります。
| 別名 | reproducibleRowOrder |
|---|---|
| デフォルト | false |
attributes={{casinvardesc-1} <, {casinvardesc-2}, ...>}
入力変数に適用するフォーマットなどの一時的な属性を指定します。
attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | attribute |
|---|---|
| attrs | |
| attr | |
| varAttrs |
auxData="variable-name"
補助ソースからのオブザベーションを示す、転移学習の変数を指定します。値 0 は、従来の学習オブザベーションを示します。その他の値は補助データを示します。
binOrder=true | false
デフォルトでは、数値変数のビンの順序は保持されます。False に設定すると、数値変数のビンの順序は無視されます。
| デフォルト | true |
|---|
casOut={casouttable}
デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。
casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
code={codegen}
アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。
code パラメーターの指定の詳細については、共通 codegen パラメーターを参照してください。
codeInteractions={viicodegen}
アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。
viicodegen の値は次のいずれかになります:
casOut={casouttable}
出力テーブルの設定を指定します。
casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
comment=true | false
True に設定すると、DATA ステップコードにコメントが追加されます。
| デフォルト | false |
|---|
fmtWdth=integer
DATA ステップコードでのパラメータ推定値などの派生数の書式設定に使用する幅を指定します。
| 別名 | fmtWidth |
|---|---|
| デフォルト | 20 |
| 範囲 | 0–32 |
indentSize=integer
各レベルの DATA ステップコードをインデントするスペースの数を指定します。
| デフォルト | 3 |
|---|---|
| 範囲 | 0–10 |
labelId=integer
DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。
lineSize=integer
生成されたコードの行サイズを指定します。
| デフォルト | 120 |
|---|---|
| 範囲 | 64–254 |
noTrim=true | false
True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。
| デフォルト | false |
|---|
tabForm=true | false
True に設定すると、テーブルの格納に適した方法でコードが生成されます。
| 別名 | tableForm |
|---|---|
| デフォルト | false |
distribution="BINARY" | "GAUSSIAN" | "MULTINOMIAL" | "POISSON" | "TWEEDIE" | 64-bit-integer
勾配ブースティングツリーの分布を指定します。
| デフォルト | BINARY |
|---|---|
| BINARY | この値は二項分類に役立ちます。 |
| GAUSSIAN | この値は回帰ツリーに役立ちます。 |
| MULTINOMIAL | この値は、2 つ以上のクラスを持つ分類の多項分布に役立ちます。 |
| POISSON | この値はポアソン分布に役立ちます。 |
| TWEEDIE | この値は tweedie の分布に役立ちます。 |
earlyStop={tkcasdt_earlyStop}
tkcasdt_earlyStop の値は次のいずれかになります:
metric="ASE" | "LOGLOSS" | "MCR"
minimum=true | false
| 別名 | smallest |
|---|---|
| デフォルト | false |
stagnation=64-bit-integer
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
threshold=double
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
thresholdIter=64-bit-integer
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
tolerance=double
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
encodeName=true | false
生成された casout テーブルで、バイナリまたは名義ターゲットの予測確率などの変数名をエンコードするかどうかを指定します。予測確率は _DT_P_ の代わりに接頭辞 P_ で名前が付けられます。
| デフォルト | false |
|---|
fcmpEvalMetric="string"
勾配ブースティングツリーモデルの FCMP 評価メトリックを指定します
| 別名 | fcmpEvalFunc |
|---|
freq="variable-name"
各オブザベーションの発生頻度を含む数値変数を指定します。
greedy=true | false
デフォルトでは、各ツリーノードの各変数の最適な分割を決定するために、貪欲探索またはしらみつぶし探索が使用されます。False に設定すると、クラスタリングに基づく高速で効率的なアルゴリズムが適用されます。カーディナリティが高い変数には、このパラメータを False に設定することをお勧めします。
| デフォルト | true |
|---|
includeMissing=true | false
デフォルトでは、欠損値を持つオブザベーションは含まれます。False に設定すると、スコアリング時にツリーモデルで使用される変数の欠損値を持つオブザベーションは無視されます。
| デフォルト | true |
|---|
initPred=double
| デフォルト | 0 |
|---|
* inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}
lasso=double
予測における L1 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
leafSize=integer
各ノードのオブザベーションの最小数を指定します。
| デフォルト | 5 |
|---|---|
| 最小値 | 1 |
learningRate=double
各ツリーの学習率を指定します。
| デフォルト | 0.1 |
|---|---|
| 範囲 | (0–1] |
logLevel=integer
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
m=integer
ノード上で分割する際に考慮する入力変数の数を指定します。変数は、各ツリーの入力変数からランダムに選択されます。デフォルトでは、フォレストは使用される入力変数の数の平方根を使用して、最も近い整数に切り上げられます。勾配ブースティングでは、入力変数の数が使用されます。
| 最小値 | 1 |
|---|
maxBranch=integer
ツリーの各水準で許可される子 (枝) の最大数を指定します。
| デフォルト | 2 |
|---|---|
| 最小値 | 1 |
maxLevel=integer
ツリー水準の最大数を指定します。
| デフォルト | 5 |
|---|---|
| 最小値 | 1 |
mergeBin=true | false
デフォルトでは、1 つのビンの最大値が隣接するビンの最小値と一致すると、値は下のビンにマージされます。False に設定すると、アクションはビンをマージしようとしません。
| デフォルト | true |
|---|
minHessian=double
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
minUseInSearch=integer
欠落したパラメータが USEINSEARCH に設定されている場合、分割検索で欠損値を使用するためのしきい値を指定します。分割変数がノード内に欠損値を持つオブザベーション数が指定された値以上の場合、アクションは USEINSEARCH ポリシーを開始します。それ以外の場合は、欠損値が人気のある分岐に割り当てられます。
| デフォルト | 1 |
|---|
missing="MACSMALL" | "USEINSEARCH"
modelId="string"
SAS スコアコードを生成するときに使用するモデル ID 変数名を指定します。デフォルトでは、DT_ はターゲット変数名の前に付けられます。
modelTable={castable}
モデルを含むテーブルを指定します。
modelTable パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。
monoDec={"string-1" <, "string-2", ...>}
入力値が増加したときに予測が増加しない間隔入力を指定します。完全なコンプライアンスは保証されていません。
| 別名 | monotoneDecrease |
|---|---|
| monotoneDec | |
| Dec |
monoInc={"string-1" <, "string-2", ...>}
入力値が増加したときに予測が減少しない間隔入力を指定します。完全なコンプライアンスは保証されていません。
| 別名 | monotoneIncrease |
|---|---|
| monotoneInc | |
| Inc |
nBins=integer
ディシジョンツリーの計算で数値変数に使用するビン数を指定します。
| デフォルト | 50 |
|---|---|
| 最小値 | 1 |
nominalHandling="CLASSIC" | "ENHANCED"
nominals={{casinvardesc-1} <, {casinvardesc-2}, ...>}
nominalSearch={tkcasdt_nomSearchOpts}
名義入力で分割を検索する方法を指定します。
| 別名 | nomSearch |
|---|
tkcasdt_nomSearchOpts の値は次のいずれかになります:
handling="CLASSIC" | "ENHANCED"
maxCategories=64-bit-integer
分割ルールに含める水準の最大数を指定します。
| 別名 | maxCats |
|---|---|
| maxLevels | |
| maxValues | |
| cluster | |
| minCardCluster | |
| デフォルト | 128 |
| 最小値 | 0 |
shrinkage=double
ソート方法でカテゴリ平均に与える重みを指定します。
| デフォルト | 10 |
|---|---|
| 最小値 | 0 |
sort=64-bit-integer
ソート方法を使用するための入力の最小カーディナリティを指定します。
| 別名 | minCardSort |
|---|---|
| デフォルト | 10 |
| 最小値 | 0 |
sortBy="COUNT" | "TARGET"
nTree=integer
作成するツリー数を指定します。
| 別名 | nTrees |
|---|---|
| デフォルト | 50 |
| 最小値 | 1 |
offset="variable-name"
分布=POISSON または TWEEDIE で使用するオフセット変数を指定します。
phi=double
この値は tweedie 分布の power パラメータに役立ちます。
| 別名 | scale |
|---|---|
| 最小値 (含まない) | 0 |
power=double
この値は tweedie 分布の power パラメータに役立ちます。
| デフォルト | 1.5 |
|---|---|
| 範囲 | (1, 2) |
quantileBin=true | false
等しい幅のビンではなく、数値入力の分位点でビン境界を指定します。
| 別名 | qbin |
|---|---|
| qtbin | |
| デフォルト | true |
ridge=double
予測における L2 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 1 |
|---|---|
| 最小値 | 0 |
saveState={casouttable}
生成された aStore モデルを格納するテーブルを指定します。
saveState パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
seed=double
乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータクロックに基づいています。負の値を指定すると、コンピュータクロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。
| デフォルト | 0 |
|---|---|
| 範囲 | 0–MACINT |
singular=double
除算でゼロを避けるために小さな値を指定します。
| デフォルト | 1E-12 |
|---|---|
| 最小値 | 0 |
subSampleRate=double
各ツリーの構築に使用するデータの割合を指定します。
| 別名 | subsample |
|---|---|
| samplingRate | |
| デフォルト | 0.5 |
| 範囲 | (0–1] |
* table={castable}
入力テーブルの設定を指定します。
| 長い形式 | table={name="table-name"} |
|---|---|
| 短い形式 | table="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=true | false
True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | false |
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメータに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
singlePass=true | false
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | false |
|---|
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable={groupbytable}
WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルタテーブルの名前を指定します。
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
フィルタテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルタテーブルからデータをサブセット化する式を指定します。
* target="variable-name"
学習のターゲット変数または応答変数を指定します。変数が数値であるが、nominal= パラメータで指定されておらず、nbinstarget= が指定されていない場合、回帰ツリーが学習されます。
transLearnBurn=integer
転移学習中に、補助オブザベーションのダウンウェイトが開始する前に作成するツリー数を指定します。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
transLearnShrink=double
転移学習中に、非生産的な補助データをどれだけダウンウェイトするかを指定します。
| デフォルト | 0.9 |
|---|---|
| 範囲 | 0–1 |
transLearnTrim=double
転移学習中に、補助オブザベーションがダウンウェイトされる学習データ上の勾配の分布の割合を指定します。
| デフォルト | 0.01 |
|---|---|
| 範囲 | (0–0.5] |
validTable={castable}
入力テーブルの設定を指定します。
| 長い形式 | validTable={name="table-name"} |
|---|---|
| 短い形式 | validTable="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=true | false
True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | false |
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメータに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
singlePass=true | false
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | false |
|---|
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable={groupbytable}
WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルタテーブルの名前を指定します。
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
フィルタテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルタテーブルからデータをサブセット化する式を指定します。
varImp=true | false
変数重要度の情報を生成するかどうかを指定します。重要度の値は、Gini の総削減量によって決まります。
| デフォルト | false |
|---|
varIntImp=integer
変数の交互作用の重要度を要求し、交互作用の最大次数を指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | 0–3 |
weight="variable-name"
各オブザベーションの重みを含む数値変数を指定します。
gbtreeTrain アクション
勾配ブースティングツリーを学習します。このアクションには、SAS Visual Data Mining and Machine Learning のライセンスが必要です。
Python 構文
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
モデルを含むテーブルを指定します。 | |
|
required parametertable |
— |
入力テーブルの設定を指定します。 |
|
— |
入力テーブルの設定を指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。 | |
|
casOut |
アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。 | |
|
casOut |
アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。 | |
|
— |
生成された aStore モデルを格納するテーブルを指定します。 |
パラメーターの説明
applyRowOrder=True | False
アクションで事前に指定された行順序を使用することを指定します。これには、予備の table.partition アクション呼び出しで orderby パラメータと groupby パラメータを使用する必要があります。
| 別名 | reproducibleRowOrder |
|---|---|
| デフォルト | False |
attributes=[{casinvardesc-1} <, {casinvardesc-2}, ...>]
入力変数に適用するフォーマットなどの一時的な属性を指定します。
attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | attribute |
|---|---|
| attrs | |
| attr | |
| varAttrs |
auxData="variable-name"
補助ソースからのオブザベーションを示す、転移学習の変数を指定します。値 0 は、従来の学習オブザベーションを示します。その他の値は補助データを示します。
binOrder=True | False
デフォルトでは、数値変数のビンの順序は保持されます。False に設定すると、数値変数のビンの順序は無視されます。
| デフォルト | True |
|---|
casOut={casouttable}
デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。
casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
code={codegen}
アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。
code パラメーターの指定の詳細については、共通 codegen パラメーターを参照してください。
codeInteractions={viicodegen}
アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。
viicodegen の値は次のいずれかになります:
"casOut":{casouttable}
出力テーブルの設定を指定します。
casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
"comment":True | False
True に設定すると、DATA ステップコードにコメントが追加されます。
| デフォルト | False |
|---|
"fmtWdth":integer
DATA ステップコードでのパラメータ推定値などの派生数の書式設定に使用する幅を指定します。
| 別名 | fmtWidth |
|---|---|
| デフォルト | 20 |
| 範囲 | 0–32 |
"indentSize":integer
各レベルの DATA ステップコードをインデントするスペースの数を指定します。
| デフォルト | 3 |
|---|---|
| 範囲 | 0–10 |
"labelId":integer
DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。
"lineSize":integer
生成されたコードの行サイズを指定します。
| デフォルト | 120 |
|---|---|
| 範囲 | 64–254 |
"noTrim":True | False
True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。
| デフォルト | False |
|---|
"tabForm":True | False
True に設定すると、テーブルの格納に適した方法でコードが生成されます。
| 別名 | tableForm |
|---|---|
| デフォルト | False |
distribution="BINARY" | "GAUSSIAN" | "MULTINOMIAL" | "POISSON" | "TWEEDIE" | 64-bit-integer
勾配ブースティングツリーの分布を指定します。
| デフォルト | BINARY |
|---|---|
| BINARY | この値は二項分類に役立ちます。 |
| GAUSSIAN | この値は回帰ツリーに役立ちます。 |
| MULTINOMIAL | この値は、2 つ以上のクラスを持つ分類の多項分布に役立ちます。 |
| POISSON | この値はポアソン分布に役立ちます。 |
| TWEEDIE | この値は tweedie の分布に役立ちます。 |
earlyStop={tkcasdt_earlyStop}
tkcasdt_earlyStop の値は次のいずれかになります:
"metric":"ASE" | "LOGLOSS" | "MCR"
"minimum":True | False
| 別名 | smallest |
|---|---|
| デフォルト | False |
"stagnation":64-bit-integer
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
"threshold":double
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
"thresholdIter":64-bit-integer
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
"tolerance":double
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
encodeName=True | False
生成された casout テーブルで、バイナリまたは名義ターゲットの予測確率などの変数名をエンコードするかどうかを指定します。予測確率は _DT_P_ の代わりに接頭辞 P_ で名前が付けられます。
| デフォルト | False |
|---|
fcmpEvalMetric="string"
勾配ブースティングツリーモデルの FCMP 評価メトリックを指定します
| 別名 | fcmpEvalFunc |
|---|
freq="variable-name"
各オブザベーションの発生頻度を含む数値変数を指定します。
greedy=True | False
デフォルトでは、各ツリーノードの各変数の最適な分割を決定するために、貪欲探索またはしらみつぶし探索が使用されます。False に設定すると、クラスタリングに基づく高速で効率的なアルゴリズムが適用されます。カーディナリティが高い変数には、このパラメータを False に設定することをお勧めします。
| デフォルト | True |
|---|
includeMissing=True | False
デフォルトでは、欠損値を持つオブザベーションは含まれます。False に設定すると、スコアリング時にツリーモデルで使用される変数の欠損値を持つオブザベーションは無視されます。
| デフォルト | True |
|---|
initPred=double
| デフォルト | 0 |
|---|
* inputs=[{casinvardesc-1} <, {casinvardesc-2}, ...>]
lasso=double
予測における L1 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
leafSize=integer
各ノードのオブザベーションの最小数を指定します。
| デフォルト | 5 |
|---|---|
| 最小値 | 1 |
learningRate=double
各ツリーの学習率を指定します。
| デフォルト | 0.1 |
|---|---|
| 範囲 | (0–1] |
logLevel=integer
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
m=integer
ノード上で分割する際に考慮する入力変数の数を指定します。変数は、各ツリーの入力変数からランダムに選択されます。デフォルトでは、フォレストは使用される入力変数の数の平方根を使用して、最も近い整数に切り上げられます。勾配ブースティングでは、入力変数の数が使用されます。
| 最小値 | 1 |
|---|
maxBranch=integer
ツリーの各水準で許可される子 (枝) の最大数を指定します。
| デフォルト | 2 |
|---|---|
| 最小値 | 1 |
maxLevel=integer
ツリー水準の最大数を指定します。
| デフォルト | 5 |
|---|---|
| 最小値 | 1 |
mergeBin=True | False
デフォルトでは、1 つのビンの最大値が隣接するビンの最小値と一致すると、値は下のビンにマージされます。False に設定すると、アクションはビンをマージしようとしません。
| デフォルト | True |
|---|
minHessian=double
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
minUseInSearch=integer
欠落したパラメータが USEINSEARCH に設定されている場合、分割検索で欠損値を使用するためのしきい値を指定します。分割変数がノード内に欠損値を持つオブザベーション数が指定された値以上の場合、アクションは USEINSEARCH ポリシーを開始します。それ以外の場合は、欠損値が人気のある分岐に割り当てられます。
| デフォルト | 1 |
|---|
missing="MACSMALL" | "USEINSEARCH"
modelId="string"
SAS スコアコードを生成するときに使用するモデル ID 変数名を指定します。デフォルトでは、DT_ はターゲット変数名の前に付けられます。
modelTable={castable}
モデルを含むテーブルを指定します。
modelTable パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。
monoDec=["string-1" <, "string-2", ...>]
入力値が増加したときに予測が増加しない間隔入力を指定します。完全なコンプライアンスは保証されていません。
| 別名 | monotoneDecrease |
|---|---|
| monotoneDec | |
| Dec |
monoInc=["string-1" <, "string-2", ...>]
入力値が増加したときに予測が減少しない間隔入力を指定します。完全なコンプライアンスは保証されていません。
| 別名 | monotoneIncrease |
|---|---|
| monotoneInc | |
| Inc |
nBins=integer
ディシジョンツリーの計算で数値変数に使用するビン数を指定します。
| デフォルト | 50 |
|---|---|
| 最小値 | 1 |
nominalHandling="CLASSIC" | "ENHANCED"
nominals=[{casinvardesc-1} <, {casinvardesc-2}, ...>]
nominalSearch={tkcasdt_nomSearchOpts}
名義入力で分割を検索する方法を指定します。
| 別名 | nomSearch |
|---|
tkcasdt_nomSearchOpts の値は次のいずれかになります:
"handling":"CLASSIC" | "ENHANCED"
"maxCategories":64-bit-integer
分割ルールに含める水準の最大数を指定します。
| 別名 | maxCats |
|---|---|
| maxLevels | |
| maxValues | |
| cluster | |
| minCardCluster | |
| デフォルト | 128 |
| 最小値 | 0 |
"shrinkage":double
ソート方法でカテゴリ平均に与える重みを指定します。
| デフォルト | 10 |
|---|---|
| 最小値 | 0 |
"sort":64-bit-integer
ソート方法を使用するための入力の最小カーディナリティを指定します。
| 別名 | minCardSort |
|---|---|
| デフォルト | 10 |
| 最小値 | 0 |
"sortBy":"COUNT" | "TARGET"
nTree=integer
作成するツリー数を指定します。
| 別名 | nTrees |
|---|---|
| デフォルト | 50 |
| 最小値 | 1 |
offset="variable-name"
分布=POISSON または TWEEDIE で使用するオフセット変数を指定します。
phi=double
この値は tweedie 分布の power パラメータに役立ちます。
| 別名 | scale |
|---|---|
| 最小値 (含まない) | 0 |
power=double
この値は tweedie 分布の power パラメータに役立ちます。
| デフォルト | 1.5 |
|---|---|
| 範囲 | (1, 2) |
quantileBin=True | False
等しい幅のビンではなく、数値入力の分位点でビン境界を指定します。
| 別名 | qbin |
|---|---|
| qtbin | |
| デフォルト | True |
ridge=double
予測における L2 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 1 |
|---|---|
| 最小値 | 0 |
saveState={casouttable}
生成された aStore モデルを格納するテーブルを指定します。
saveState パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
seed=double
乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータクロックに基づいています。負の値を指定すると、コンピュータクロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。
| デフォルト | 0 |
|---|---|
| 範囲 | 0–MACINT |
singular=double
除算でゼロを避けるために小さな値を指定します。
| デフォルト | 1E-12 |
|---|---|
| 最小値 | 0 |
subSampleRate=double
各ツリーの構築に使用するデータの割合を指定します。
| 別名 | subsample |
|---|---|
| samplingRate | |
| デフォルト | 0.5 |
| 範囲 | (0–1] |
* table={castable}
入力テーブルの設定を指定します。
| 長い形式 | table={"name":"table-name"} |
|---|---|
| 短い形式 | table="table-name" |
castable の値は次のいずれかになります:
"caslib":"string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
"computedOnDemand":True | False
True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | False |
"computedVars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"computedVarsProgram":"string"
computedVars パラメータに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import_ |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* "name":"table-name"
入力テーブルの名前を指定します。
"singlePass":True | False
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | False |
|---|
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"where":"where-expression"
入力データをサブセット化する式を指定します。
"whereTable":{groupbytable}
WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
"casLib":"string"
フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import_ |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* "name":"table-name"
フィルタテーブルの名前を指定します。
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
フィルタテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"where":"where-expression"
フィルタテーブルからデータをサブセット化する式を指定します。
* target="variable-name"
学習のターゲット変数または応答変数を指定します。変数が数値であるが、nominal= パラメータで指定されておらず、nbinstarget= が指定されていない場合、回帰ツリーが学習されます。
transLearnBurn=integer
転移学習中に、補助オブザベーションのダウンウェイトが開始する前に作成するツリー数を指定します。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
transLearnShrink=double
転移学習中に、非生産的な補助データをどれだけダウンウェイトするかを指定します。
| デフォルト | 0.9 |
|---|---|
| 範囲 | 0–1 |
transLearnTrim=double
転移学習中に、補助オブザベーションがダウンウェイトされる学習データ上の勾配の分布の割合を指定します。
| デフォルト | 0.01 |
|---|---|
| 範囲 | (0–0.5] |
validTable={castable}
入力テーブルの設定を指定します。
| 長い形式 | validTable={"name":"table-name"} |
|---|---|
| 短い形式 | validTable="table-name" |
castable の値は次のいずれかになります:
"caslib":"string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
"computedOnDemand":True | False
True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | False |
"computedVars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"computedVarsProgram":"string"
computedVars パラメータに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import_ |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* "name":"table-name"
入力テーブルの名前を指定します。
"singlePass":True | False
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | False |
|---|
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"where":"where-expression"
入力データをサブセット化する式を指定します。
"whereTable":{groupbytable}
WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
"casLib":"string"
フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import_ |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* "name":"table-name"
フィルタテーブルの名前を指定します。
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
フィルタテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"where":"where-expression"
フィルタテーブルからデータをサブセット化する式を指定します。
varImp=True | False
変数重要度の情報を生成するかどうかを指定します。重要度の値は、Gini の総削減量によって決まります。
| デフォルト | False |
|---|
varIntImp=integer
変数の交互作用の重要度を要求し、交互作用の最大次数を指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | 0–3 |
weight="variable-name"
各オブザベーションの重みを含む数値変数を指定します。
gbtreeTrain アクション
勾配ブースティングツリーを学習します。このアクションには、SAS Visual Data Mining and Machine Learning のライセンスが必要です。
R 構文
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
モデルを含むテーブルを指定します。 | |
|
required parametertable |
— |
入力テーブルの設定を指定します。 |
|
— |
入力テーブルの設定を指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。 | |
|
casOut |
アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。 | |
|
casOut |
アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。 | |
|
— |
生成された aStore モデルを格納するテーブルを指定します。 |
パラメーターの説明
applyRowOrder=TRUE | FALSE
アクションで事前に指定された行順序を使用することを指定します。これには、予備の table.partition アクション呼び出しで orderby パラメータと groupby パラメータを使用する必要があります。
| 別名 | reproducibleRowOrder |
|---|---|
| デフォルト | FALSE |
attributes=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
入力変数に適用するフォーマットなどの一時的な属性を指定します。
attributes パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | attribute |
|---|---|
| attrs | |
| attr | |
| varAttrs |
auxData="variable-name"
補助ソースからのオブザベーションを示す、転移学習の変数を指定します。値 0 は、従来の学習オブザベーションを示します。その他の値は補助データを示します。
binOrder=TRUE | FALSE
デフォルトでは、数値変数のビンの順序は保持されます。False に設定すると、数値変数のビンの順序は無視されます。
| デフォルト | TRUE |
|---|
casOut=list(casouttable)
デシジョンツリーモデルを格納するテーブルを指定します。指定しない場合、ランダムな名前が生成されます。
casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
code=list(codegen)
アクションが SAS スコアコードを生成することを要求します。追加のパラメータを指定します。
code パラメーターの指定の詳細については、共通 codegen パラメーターを参照してください。
codeInteractions=list(viicodegen)
アクションが SAS スコアコードを生成し、交互作用をエンコードする変数を作成するように要求します。また、少なくとも次数 2 の変数の交互作用を要求する必要があります。
viicodegen の値は次のいずれかになります:
casOut=list(casouttable)
出力テーブルの設定を指定します。
casOut パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
comment=TRUE | FALSE
True に設定すると、DATA ステップコードにコメントが追加されます。
| デフォルト | FALSE |
|---|
fmtWdth=integer
DATA ステップコードでのパラメータ推定値などの派生数の書式設定に使用する幅を指定します。
| 別名 | fmtWidth |
|---|---|
| デフォルト | 20 |
| 範囲 | 0–32 |
indentSize=integer
各レベルの DATA ステップコードをインデントするスペースの数を指定します。
| デフォルト | 3 |
|---|---|
| 範囲 | 0–10 |
labelId=integer
DATA ステップコードの配列名とステートメントラベルで使用するラベル ID を指定します。デフォルトでは、ランダムな正の整数が使用されます。
lineSize=integer
生成されたコードの行サイズを指定します。
| デフォルト | 120 |
|---|---|
| 範囲 | 64–254 |
noTrim=TRUE | FALSE
True に設定すると、フォーマットされた値を持つ変数の比較は、パディング付きの完全なフォーマット幅に基づいて行われます。デフォルトでは、先頭と末尾の空白は、フォーマットされた値から削除されます。
| デフォルト | FALSE |
|---|
tabForm=TRUE | FALSE
True に設定すると、テーブルの格納に適した方法でコードが生成されます。
| 別名 | tableForm |
|---|---|
| デフォルト | FALSE |
distribution="BINARY" | "GAUSSIAN" | "MULTINOMIAL" | "POISSON" | "TWEEDIE" | 64-bit-integer
勾配ブースティングツリーの分布を指定します。
| デフォルト | BINARY |
|---|---|
| BINARY | この値は二項分類に役立ちます。 |
| GAUSSIAN | この値は回帰ツリーに役立ちます。 |
| MULTINOMIAL | この値は、2 つ以上のクラスを持つ分類の多項分布に役立ちます。 |
| POISSON | この値はポアソン分布に役立ちます。 |
| TWEEDIE | この値は tweedie の分布に役立ちます。 |
earlyStop=list(tkcasdt_earlyStop)
tkcasdt_earlyStop の値は次のいずれかになります:
metric="ASE" | "LOGLOSS" | "MCR"
minimum=TRUE | FALSE
| 別名 | smallest |
|---|---|
| デフォルト | FALSE |
stagnation=64-bit-integer
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
threshold=double
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
thresholdIter=64-bit-integer
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
tolerance=double
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
encodeName=TRUE | FALSE
生成された casout テーブルで、バイナリまたは名義ターゲットの予測確率などの変数名をエンコードするかどうかを指定します。予測確率は _DT_P_ の代わりに接頭辞 P_ で名前が付けられます。
| デフォルト | FALSE |
|---|
fcmpEvalMetric="string"
勾配ブースティングツリーモデルの FCMP 評価メトリックを指定します
| 別名 | fcmpEvalFunc |
|---|
freq="variable-name"
各オブザベーションの発生頻度を含む数値変数を指定します。
greedy=TRUE | FALSE
デフォルトでは、各ツリーノードの各変数の最適な分割を決定するために、貪欲探索またはしらみつぶし探索が使用されます。False に設定すると、クラスタリングに基づく高速で効率的なアルゴリズムが適用されます。カーディナリティが高い変数には、このパラメータを False に設定することをお勧めします。
| デフォルト | TRUE |
|---|
includeMissing=TRUE | FALSE
デフォルトでは、欠損値を持つオブザベーションは含まれます。False に設定すると、スコアリング時にツリーモデルで使用される変数の欠損値を持つオブザベーションは無視されます。
| デフォルト | TRUE |
|---|
initPred=double
| デフォルト | 0 |
|---|
* inputs=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
lasso=double
予測における L1 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
leafSize=integer
各ノードのオブザベーションの最小数を指定します。
| デフォルト | 5 |
|---|---|
| 最小値 | 1 |
learningRate=double
各ツリーの学習率を指定します。
| デフォルト | 0.1 |
|---|---|
| 範囲 | (0–1] |
logLevel=integer
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
m=integer
ノード上で分割する際に考慮する入力変数の数を指定します。変数は、各ツリーの入力変数からランダムに選択されます。デフォルトでは、フォレストは使用される入力変数の数の平方根を使用して、最も近い整数に切り上げられます。勾配ブースティングでは、入力変数の数が使用されます。
| 最小値 | 1 |
|---|
maxBranch=integer
ツリーの各水準で許可される子 (枝) の最大数を指定します。
| デフォルト | 2 |
|---|---|
| 最小値 | 1 |
maxLevel=integer
ツリー水準の最大数を指定します。
| デフォルト | 5 |
|---|---|
| 最小値 | 1 |
mergeBin=TRUE | FALSE
デフォルトでは、1 つのビンの最大値が隣接するビンの最小値と一致すると、値は下のビンにマージされます。False に設定すると、アクションはビンをマージしようとしません。
| デフォルト | TRUE |
|---|
minHessian=double
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
minUseInSearch=integer
欠落したパラメータが USEINSEARCH に設定されている場合、分割検索で欠損値を使用するためのしきい値を指定します。分割変数がノード内に欠損値を持つオブザベーション数が指定された値以上の場合、アクションは USEINSEARCH ポリシーを開始します。それ以外の場合は、欠損値が人気のある分岐に割り当てられます。
| デフォルト | 1 |
|---|
missing="MACSMALL" | "USEINSEARCH"
modelId="string"
SAS スコアコードを生成するときに使用するモデル ID 変数名を指定します。デフォルトでは、DT_ はターゲット変数名の前に付けられます。
modelTable=list(castable)
モデルを含むテーブルを指定します。
modelTable パラメーターの指定の詳細については、共通 castable パラメーターを参照してください。
monoDec=list("string-1" <, "string-2", ...>)
入力値が増加したときに予測が増加しない間隔入力を指定します。完全なコンプライアンスは保証されていません。
| 別名 | monotoneDecrease |
|---|---|
| monotoneDec | |
| Dec |
monoInc=list("string-1" <, "string-2", ...>)
入力値が増加したときに予測が減少しない間隔入力を指定します。完全なコンプライアンスは保証されていません。
| 別名 | monotoneIncrease |
|---|---|
| monotoneInc | |
| Inc |
nBins=integer
ディシジョンツリーの計算で数値変数に使用するビン数を指定します。
| デフォルト | 50 |
|---|---|
| 最小値 | 1 |
nominalHandling="CLASSIC" | "ENHANCED"
nominals=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
nominalSearch=list(tkcasdt_nomSearchOpts)
名義入力で分割を検索する方法を指定します。
| 別名 | nomSearch |
|---|
tkcasdt_nomSearchOpts の値は次のいずれかになります:
handling="CLASSIC" | "ENHANCED"
maxCategories=64-bit-integer
分割ルールに含める水準の最大数を指定します。
| 別名 | maxCats |
|---|---|
| maxLevels | |
| maxValues | |
| cluster | |
| minCardCluster | |
| デフォルト | 128 |
| 最小値 | 0 |
shrinkage=double
ソート方法でカテゴリ平均に与える重みを指定します。
| デフォルト | 10 |
|---|---|
| 最小値 | 0 |
sort=64-bit-integer
ソート方法を使用するための入力の最小カーディナリティを指定します。
| 別名 | minCardSort |
|---|---|
| デフォルト | 10 |
| 最小値 | 0 |
sortBy="COUNT" | "TARGET"
nTree=integer
作成するツリー数を指定します。
| 別名 | nTrees |
|---|---|
| デフォルト | 50 |
| 最小値 | 1 |
offset="variable-name"
分布=POISSON または TWEEDIE で使用するオフセット変数を指定します。
phi=double
この値は tweedie 分布の power パラメータに役立ちます。
| 別名 | scale |
|---|---|
| 最小値 (含まない) | 0 |
power=double
この値は tweedie 分布の power パラメータに役立ちます。
| デフォルト | 1.5 |
|---|---|
| 範囲 | (1, 2) |
quantileBin=TRUE | FALSE
等しい幅のビンではなく、数値入力の分位点でビン境界を指定します。
| 別名 | qbin |
|---|---|
| qtbin | |
| デフォルト | TRUE |
ridge=double
予測における L2 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 1 |
|---|---|
| 最小値 | 0 |
saveState=list(casouttable)
生成された aStore モデルを格納するテーブルを指定します。
saveState パラメーターの指定の詳細については、共通 casouttable パラメーターを参照してください。
seed=double
乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータクロックに基づいています。負の値を指定すると、コンピュータクロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。
| デフォルト | 0 |
|---|---|
| 範囲 | 0–MACINT |
singular=double
除算でゼロを避けるために小さな値を指定します。
| デフォルト | 1E-12 |
|---|---|
| 最小値 | 0 |
subSampleRate=double
各ツリーの構築に使用するデータの割合を指定します。
| 別名 | subsample |
|---|---|
| samplingRate | |
| デフォルト | 0.5 |
| 範囲 | (0–1] |
* table=list(castable)
入力テーブルの設定を指定します。
| 長い形式 | table=list(name="table-name") |
|---|---|
| 短い形式 | table="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=TRUE | FALSE
True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | FALSE |
computedVars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメータに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>)
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
singlePass=TRUE | FALSE
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | FALSE |
|---|
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable=list(groupbytable)
WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルタテーブルの名前を指定します。
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
フィルタテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルタテーブルからデータをサブセット化する式を指定します。
* target="variable-name"
学習のターゲット変数または応答変数を指定します。変数が数値であるが、nominal= パラメータで指定されておらず、nbinstarget= が指定されていない場合、回帰ツリーが学習されます。
transLearnBurn=integer
転移学習中に、補助オブザベーションのダウンウェイトが開始する前に作成するツリー数を指定します。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
transLearnShrink=double
転移学習中に、非生産的な補助データをどれだけダウンウェイトするかを指定します。
| デフォルト | 0.9 |
|---|---|
| 範囲 | 0–1 |
transLearnTrim=double
転移学習中に、補助オブザベーションがダウンウェイトされる学習データ上の勾配の分布の割合を指定します。
| デフォルト | 0.01 |
|---|---|
| 範囲 | (0–0.5] |
validTable=list(castable)
入力テーブルの設定を指定します。
| 長い形式 | validTable=list(name="table-name") |
|---|---|
| 短い形式 | validTable="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=TRUE | FALSE
True に設定すると、アクションの開始時ではなく、テーブルがロードされたときに計算される変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | FALSE |
computedVars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
作成する計算変数の名前を指定します。computedVarsProgram パラメータの各変数の式を指定します。このパラメータを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメータに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>)
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
singlePass=TRUE | FALSE
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメータを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | FALSE |
|---|
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable=list(groupbytable)
WHERE フィルタとして使用する行を含む入力テーブルを指定します。vars パラメータが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメータとこのパラメータが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルタテーブルの caslib を指定します。 デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sforce-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルタテーブルの名前を指定します。
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
フィルタテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルタテーブルからデータをサブセット化する式を指定します。
varImp=TRUE | FALSE
変数重要度の情報を生成するかどうかを指定します。重要度の値は、Gini の総削減量によって決まります。
| デフォルト | FALSE |
|---|
varIntImp=integer
変数の交互作用の重要度を要求し、交互作用の最大次数を指定します。
| デフォルト | 1 |
|---|---|
| 範囲 | 0–3 |
weight="variable-name"
各オブザベーションの重みを含む数値変数を指定します。