Light Gradient Boosting アクションセット: 構文
Light Gradient Boosting を実行するアクションを提供します。
lgbmTrain アクション
ハイパフォーマンス勾配ブースティングを実行します。。
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametertable |
— |
学習データの入力テーブルを指定します。 |
|
— |
検証テーブルの入力テーブルリストを指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametercasOut |
予測されたクラススコアのテーブルを作成します。 | |
|
names |
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。 | |
|
— |
将来のスコアリング用のモデルを保存するテーブルを指定します。 |
パラメーターの説明
baggingFraction=double
再標本化せずに、データの一部をランダムに選択します。
| 別名 | subsample |
|---|---|
| デフォルト | 1 |
| 範囲 | (0–1] |
baggingFrequency=integer
バギングの頻度を指定します。
| 別名 | bagging_freq |
|---|---|
| デフォルト | 0 |
| 最小値 | 0 |
boosting="DART" | "GBDT" | "GOSS" | "RF"
display={displayTables}
クライアントに表示するために送信する結果テーブルのリストを指定します。
display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。
* inputs={"variable-name-1" <, "variable-name-2", ...>}
分析用の入力変数リストを指定します。
| 別名 | input |
|---|
lasso=double
予測における L1 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
leafSize=integer
リーフノードの最小データを指定します。
| 別名 | minDataInLeaf |
|---|---|
| デフォルト | 20 |
| 最小値 | 0 |
learningRate=double
ブースティングの学習率を指定します。
| デフォルト | 0.1 |
|---|---|
| 最小値 (含まない) | 0 |
m=double
各反復またはツリーで、特徴量のサブセットをランダムに選択します。
| 別名 | featureFraction |
|---|---|
| デフォルト | 1 |
| 範囲 | (0–1] |
maxCategories=integer
カテゴリ特徴量の最大しきい値点を制限します。
| 別名 | maxCatThreshold |
|---|---|
| デフォルト | 32 |
| 最小値 | 1 |
maxDepth=integer
ツリーモデルの最大深度を制限します。
| デフォルト | -1 |
|---|
maxIters=integer
ブースティングの反復回数を指定します。
| 別名 | numIters |
|---|---|
| デフォルト | 100 |
| 最小値 | 0 |
monotoneConstraints={integer-1 <, integer-2, ...>}
単調な入力特徴量の一連の制約を指定します。1 は増加を表し、-1 は減少を表し、0 はなしを表します。
nBins=integer
ディシジョンツリーの計算で数値変数に使用するビン数を指定します。
| 別名 | maxBin |
|---|---|
| デフォルト | 255 |
| 最小値 | 2 |
nominals={"variable-name-1" <, "variable-name-2", ...>}
名義変数として扱う変数を指定します。
objective="BINARY" | "CROSS_ENTROPY" | "CROSS_ENTROPY_LAMBDA" | "FAIR" | "GAMMA" | "HUBER" | "MAPE" | "MULTICLASS" | "MULTICLASSOVA" | "POISSON" | "QUANTILE" | "REGRESSION" | "REGRESSION_L1" | "TWEEDIE"
使用する目的関数を指定します。デフォルトでは、目的関数は回帰です。
output={lgbmOutputStatement}
予測されたクラススコアのテーブルを作成します。
lgbmOutputStatement の値は次のいずれかになります:
* casOut={casouttable}
出力テーブルの設定を指定します。
casOut パラメーターの指定の詳細については、共通 casouttable (形式 2) パラメーターを参照してください。
copyVars= | {"variable-name-1" <, "variable-name-2", ...>}
入力テーブルから出力テーブルにコピーされる 1 つ以上の変数のリストを指定します。代わりに、すべての変数、モデリングで使用されるすべての変数、またはすべての数値変数を入力テーブルから出力テーブルにコピーする値 ALL、ALL_MODEL、またはALL_NUMERIC を指定することもできます。
outputTables={outputTables}
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。
outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。
ridge=double
予測における L2 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
saveState={casouttable}
将来のスコアリング用のモデルを保存するテーブルを指定します。
saveState パラメーターの指定の詳細については、共通 casouttable (形式 2) パラメーターを参照してください。
seed=double
乱数生成器のシードを指定します。デフォルトでは、シードはコンピュータークロックの時刻に基づきます。
| デフォルト | 0 |
|---|---|
| 範囲 | 0–MACINT |
* table={castable}
学習データの入力テーブルを指定します。
| 長い形式 | table={name="table-name"} |
|---|---|
| 短い形式 | table="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=TRUE | FALSE
True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | FALSE |
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメーターに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
onDemand=TRUE | FALSE
このパラメーターは非推奨です。
| デフォルト | TRUE |
|---|
singlePass=TRUE | FALSE
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | FALSE |
|---|
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable={groupbytable}
WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルターテーブルの名前を指定します。
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
フィルターテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルターテーブルからデータをサブセット化する式を指定します。
* target="variable-name"
学習のターゲットまたは応答変数を指定します。
useMissing=TRUE | FALSE
True に設定すると、欠損値の特別な処理が使用されます。
| デフォルト | TRUE |
|---|
validTable={castable}
検証テーブルの入力テーブルリストを指定します。
| 長い形式 | validTable={name="table-name"} |
|---|---|
| 短い形式 | validTable="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=TRUE | FALSE
True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | FALSE |
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメーターに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
onDemand=TRUE | FALSE
このパラメーターは非推奨です。
| デフォルト | TRUE |
|---|
singlePass=TRUE | FALSE
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | FALSE |
|---|
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable={groupbytable}
WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルターテーブルの名前を指定します。
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
フィルターテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルターテーブルからデータをサブセット化する式を指定します。
lgbmTrain アクション
ハイパフォーマンス勾配ブースティングを実行します。。
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametertable |
— |
学習データの入力テーブルを指定します。 |
|
— |
検証テーブルの入力テーブルリストを指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametercasOut |
予測されたクラススコアのテーブルを作成します。 | |
|
names |
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。 | |
|
— |
将来のスコアリング用のモデルを保存するテーブルを指定します。 |
パラメーターの説明
baggingFraction=double
再標本化せずに、データの一部をランダムに選択します。
| 別名 | subsample |
|---|---|
| デフォルト | 1 |
| 範囲 | (0–1] |
baggingFrequency=integer
バギングの頻度を指定します。
| 別名 | bagging_freq |
|---|---|
| デフォルト | 0 |
| 最小値 | 0 |
boosting="DART" | "GBDT" | "GOSS" | "RF"
display={displayTables}
クライアントに表示するために送信する結果テーブルのリストを指定します。
display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。
* inputs={"variable-name-1" <, "variable-name-2", ...>}
分析用の入力変数リストを指定します。
| 別名 | input |
|---|
lasso=double
予測における L1 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
leafSize=integer
リーフノードの最小データを指定します。
| 別名 | minDataInLeaf |
|---|---|
| デフォルト | 20 |
| 最小値 | 0 |
learningRate=double
ブースティングの学習率を指定します。
| デフォルト | 0.1 |
|---|---|
| 最小値 (含まない) | 0 |
m=double
各反復またはツリーで、特徴量のサブセットをランダムに選択します。
| 別名 | featureFraction |
|---|---|
| デフォルト | 1 |
| 範囲 | (0–1] |
maxCategories=integer
カテゴリ特徴量の最大しきい値点を制限します。
| 別名 | maxCatThreshold |
|---|---|
| デフォルト | 32 |
| 最小値 | 1 |
maxDepth=integer
ツリーモデルの最大深度を制限します。
| デフォルト | -1 |
|---|
maxIters=integer
ブースティングの反復回数を指定します。
| 別名 | numIters |
|---|---|
| デフォルト | 100 |
| 最小値 | 0 |
monotoneConstraints={integer-1 <, integer-2, ...>}
単調な入力特徴量の一連の制約を指定します。1 は増加を表し、-1 は減少を表し、0 はなしを表します。
nBins=integer
ディシジョンツリーの計算で数値変数に使用するビン数を指定します。
| 別名 | maxBin |
|---|---|
| デフォルト | 255 |
| 最小値 | 2 |
nominals={"variable-name-1" <, "variable-name-2", ...>}
名義変数として扱う変数を指定します。
objective="BINARY" | "CROSS_ENTROPY" | "CROSS_ENTROPY_LAMBDA" | "FAIR" | "GAMMA" | "HUBER" | "MAPE" | "MULTICLASS" | "MULTICLASSOVA" | "POISSON" | "QUANTILE" | "REGRESSION" | "REGRESSION_L1" | "TWEEDIE"
使用する目的関数を指定します。デフォルトでは、目的関数は回帰です。
output={lgbmOutputStatement}
予測されたクラススコアのテーブルを作成します。
lgbmOutputStatement の値は次のいずれかになります:
* casOut={casouttable}
出力テーブルの設定を指定します。
casOut パラメーターの指定の詳細については、共通 casouttable (形式 2) パラメーターを参照してください。
copyVars= | {"variable-name-1" <, "variable-name-2", ...>}
入力テーブルから出力テーブルにコピーされる 1 つ以上の変数のリストを指定します。代わりに、すべての変数、モデリングで使用されるすべての変数、またはすべての数値変数を入力テーブルから出力テーブルにコピーする値 ALL、ALL_MODEL、またはALL_NUMERIC を指定することもできます。
outputTables={outputTables}
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。
outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。
ridge=double
予測における L2 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
saveState={casouttable}
将来のスコアリング用のモデルを保存するテーブルを指定します。
saveState パラメーターの指定の詳細については、共通 casouttable (形式 2) パラメーターを参照してください。
seed=double
乱数生成器のシードを指定します。デフォルトでは、シードはコンピュータークロックの時刻に基づきます。
| デフォルト | 0 |
|---|---|
| 範囲 | 0–MACINT |
* table={castable}
学習データの入力テーブルを指定します。
| 長い形式 | table={name="table-name"} |
|---|---|
| 短い形式 | table="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=true | false
True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | false |
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメーターに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
onDemand=true | false
このパラメーターは非推奨です。
| デフォルト | true |
|---|
singlePass=true | false
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | false |
|---|
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable={groupbytable}
WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルターテーブルの名前を指定します。
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
フィルターテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルターテーブルからデータをサブセット化する式を指定します。
* target="variable-name"
学習のターゲットまたは応答変数を指定します。
useMissing=true | false
True に設定すると、欠損値の特別な処理が使用されます。
| デフォルト | true |
|---|
validTable={castable}
検証テーブルの入力テーブルリストを指定します。
| 長い形式 | validTable={name="table-name"} |
|---|---|
| 短い形式 | validTable="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=true | false
True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | false |
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメーターに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
onDemand=true | false
このパラメーターは非推奨です。
| デフォルト | true |
|---|
singlePass=true | false
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | false |
|---|
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable={groupbytable}
WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルターテーブルの名前を指定します。
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}
フィルターテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルターテーブルからデータをサブセット化する式を指定します。
lgbmTrain アクション
ハイパフォーマンス勾配ブースティングを実行します。。
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametertable |
— |
学習データの入力テーブルを指定します。 |
|
— |
検証テーブルの入力テーブルリストを指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametercasOut |
予測されたクラススコアのテーブルを作成します。 | |
|
names |
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。 | |
|
— |
将来のスコアリング用のモデルを保存するテーブルを指定します。 |
パラメーターの説明
baggingFraction=double
再標本化せずに、データの一部をランダムに選択します。
| 別名 | subsample |
|---|---|
| デフォルト | 1 |
| 範囲 | (0–1] |
baggingFrequency=integer
バギングの頻度を指定します。
| 別名 | bagging_freq |
|---|---|
| デフォルト | 0 |
| 最小値 | 0 |
boosting="DART" | "GBDT" | "GOSS" | "RF"
display={displayTables}
クライアントに表示するために送信する結果テーブルのリストを指定します。
display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。
* inputs=["variable-name-1" <, "variable-name-2", ...>]
分析用の入力変数リストを指定します。
| 別名 | input |
|---|
lasso=double
予測における L1 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
leafSize=integer
リーフノードの最小データを指定します。
| 別名 | minDataInLeaf |
|---|---|
| デフォルト | 20 |
| 最小値 | 0 |
learningRate=double
ブースティングの学習率を指定します。
| デフォルト | 0.1 |
|---|---|
| 最小値 (含まない) | 0 |
m=double
各反復またはツリーで、特徴量のサブセットをランダムに選択します。
| 別名 | featureFraction |
|---|---|
| デフォルト | 1 |
| 範囲 | (0–1] |
maxCategories=integer
カテゴリ特徴量の最大しきい値点を制限します。
| 別名 | maxCatThreshold |
|---|---|
| デフォルト | 32 |
| 最小値 | 1 |
maxDepth=integer
ツリーモデルの最大深度を制限します。
| デフォルト | -1 |
|---|
maxIters=integer
ブースティングの反復回数を指定します。
| 別名 | numIters |
|---|---|
| デフォルト | 100 |
| 最小値 | 0 |
monotoneConstraints=[integer-1 <, integer-2, ...>]
単調な入力特徴量の一連の制約を指定します。1 は増加を表し、-1 は減少を表し、0 はなしを表します。
nBins=integer
ディシジョンツリーの計算で数値変数に使用するビン数を指定します。
| 別名 | maxBin |
|---|---|
| デフォルト | 255 |
| 最小値 | 2 |
nominals=["variable-name-1" <, "variable-name-2", ...>]
名義変数として扱う変数を指定します。
objective="BINARY" | "CROSS_ENTROPY" | "CROSS_ENTROPY_LAMBDA" | "FAIR" | "GAMMA" | "HUBER" | "MAPE" | "MULTICLASS" | "MULTICLASSOVA" | "POISSON" | "QUANTILE" | "REGRESSION" | "REGRESSION_L1" | "TWEEDIE"
使用する目的関数を指定します。デフォルトでは、目的関数は回帰です。
output={lgbmOutputStatement}
予測されたクラススコアのテーブルを作成します。
lgbmOutputStatement の値は次のいずれかになります:
* "casOut":{casouttable}
出力テーブルの設定を指定します。
casOut パラメーターの指定の詳細については、共通 casouttable (形式 2) パラメーターを参照してください。
"copyVars": | ["variable-name-1" <, "variable-name-2", ...>]
入力テーブルから出力テーブルにコピーされる 1 つ以上の変数のリストを指定します。代わりに、すべての変数、モデリングで使用されるすべての変数、またはすべての数値変数を入力テーブルから出力テーブルにコピーする値 ALL、ALL_MODEL、またはALL_NUMERIC を指定することもできます。
outputTables={outputTables}
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。
outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。
ridge=double
予測における L2 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
saveState={casouttable}
将来のスコアリング用のモデルを保存するテーブルを指定します。
saveState パラメーターの指定の詳細については、共通 casouttable (形式 2) パラメーターを参照してください。
seed=double
乱数生成器のシードを指定します。デフォルトでは、シードはコンピュータークロックの時刻に基づきます。
| デフォルト | 0 |
|---|---|
| 範囲 | 0–MACINT |
* table={castable}
学習データの入力テーブルを指定します。
| 長い形式 | table={"name":"table-name"} |
|---|---|
| 短い形式 | table="table-name" |
castable の値は次のいずれかになります:
"caslib":"string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
"computedOnDemand":True | False
True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | False |
"computedVars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"computedVarsProgram":"string"
computedVars パラメーターに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import_ |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* "name":"table-name"
入力テーブルの名前を指定します。
"onDemand":True | False
このパラメーターは非推奨です。
| デフォルト | True |
|---|
"singlePass":True | False
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | False |
|---|
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"where":"where-expression"
入力データをサブセット化する式を指定します。
"whereTable":{groupbytable}
WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
"casLib":"string"
フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import_ |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* "name":"table-name"
フィルターテーブルの名前を指定します。
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
フィルターテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"where":"where-expression"
フィルターテーブルからデータをサブセット化する式を指定します。
* target="variable-name"
学習のターゲットまたは応答変数を指定します。
useMissing=True | False
True に設定すると、欠損値の特別な処理が使用されます。
| デフォルト | True |
|---|
validTable={castable}
検証テーブルの入力テーブルリストを指定します。
| 長い形式 | validTable={"name":"table-name"} |
|---|---|
| 短い形式 | validTable="table-name" |
castable の値は次のいずれかになります:
"caslib":"string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
"computedOnDemand":True | False
True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | False |
"computedVars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"computedVarsProgram":"string"
computedVars パラメーターに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import_ |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* "name":"table-name"
入力テーブルの名前を指定します。
"onDemand":True | False
このパラメーターは非推奨です。
| デフォルト | True |
|---|
"singlePass":True | False
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | False |
|---|
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"where":"where-expression"
入力データをサブセット化する式を指定します。
"whereTable":{groupbytable}
WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
"casLib":"string"
フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import_ |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* "name":"table-name"
フィルターテーブルの名前を指定します。
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]
フィルターテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
"format":"string"
変数に適用するフォーマットを指定します。
"formattedLength":integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
"label":"string"
変数の説明ラベルを指定します。
* "name":"variable-name"
変数の名前を指定します。
"nfd":integer
フォーマット精度の長さを指定します。
"nfl":integer
フォーマットフィールドの長さを指定します。
"where":"where-expression"
フィルターテーブルからデータをサブセット化する式を指定します。
lgbmTrain アクション
ハイパフォーマンス勾配ブースティングを実行します。。
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametertable |
— |
学習データの入力テーブルを指定します。 |
|
— |
検証テーブルの入力テーブルリストを指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
required parametercasOut |
予測されたクラススコアのテーブルを作成します。 | |
|
names |
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。 | |
|
— |
将来のスコアリング用のモデルを保存するテーブルを指定します。 |
パラメーターの説明
baggingFraction=double
再標本化せずに、データの一部をランダムに選択します。
| 別名 | subsample |
|---|---|
| デフォルト | 1 |
| 範囲 | (0–1] |
baggingFrequency=integer
バギングの頻度を指定します。
| 別名 | bagging_freq |
|---|---|
| デフォルト | 0 |
| 最小値 | 0 |
boosting="DART" | "GBDT" | "GOSS" | "RF"
display=list(displayTables)
クライアントに表示するために送信する結果テーブルのリストを指定します。
display パラメーターの指定の詳細については、共通 displayTables パラメーターを参照してください。
* inputs=list("variable-name-1" <, "variable-name-2", ...>)
分析用の入力変数リストを指定します。
| 別名 | input |
|---|
lasso=double
予測における L1 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
leafSize=integer
リーフノードの最小データを指定します。
| 別名 | minDataInLeaf |
|---|---|
| デフォルト | 20 |
| 最小値 | 0 |
learningRate=double
ブースティングの学習率を指定します。
| デフォルト | 0.1 |
|---|---|
| 最小値 (含まない) | 0 |
m=double
各反復またはツリーで、特徴量のサブセットをランダムに選択します。
| 別名 | featureFraction |
|---|---|
| デフォルト | 1 |
| 範囲 | (0–1] |
maxCategories=integer
カテゴリ特徴量の最大しきい値点を制限します。
| 別名 | maxCatThreshold |
|---|---|
| デフォルト | 32 |
| 最小値 | 1 |
maxDepth=integer
ツリーモデルの最大深度を制限します。
| デフォルト | -1 |
|---|
maxIters=integer
ブースティングの反復回数を指定します。
| 別名 | numIters |
|---|---|
| デフォルト | 100 |
| 最小値 | 0 |
monotoneConstraints=list(integer-1 <, integer-2, ...>)
単調な入力特徴量の一連の制約を指定します。1 は増加を表し、-1 は減少を表し、0 はなしを表します。
nBins=integer
ディシジョンツリーの計算で数値変数に使用するビン数を指定します。
| 別名 | maxBin |
|---|---|
| デフォルト | 255 |
| 最小値 | 2 |
nominals=list("variable-name-1" <, "variable-name-2", ...>)
名義変数として扱う変数を指定します。
objective="BINARY" | "CROSS_ENTROPY" | "CROSS_ENTROPY_LAMBDA" | "FAIR" | "GAMMA" | "HUBER" | "MAPE" | "MULTICLASS" | "MULTICLASSOVA" | "POISSON" | "QUANTILE" | "REGRESSION" | "REGRESSION_L1" | "TWEEDIE"
使用する目的関数を指定します。デフォルトでは、目的関数は回帰です。
output=list(lgbmOutputStatement)
予測されたクラススコアのテーブルを作成します。
lgbmOutputStatement の値は次のいずれかになります:
* casOut=list(casouttable)
出力テーブルの設定を指定します。
casOut パラメーターの指定の詳細については、共通 casouttable (形式 2) パラメーターを参照してください。
copyVars= | list("variable-name-1" <, "variable-name-2", ...>)
入力テーブルから出力テーブルにコピーされる 1 つ以上の変数のリストを指定します。代わりに、すべての変数、モデリングで使用されるすべての変数、またはすべての数値変数を入力テーブルから出力テーブルにコピーする値 ALL、ALL_MODEL、またはALL_NUMERIC を指定することもできます。
outputTables=list(outputTables)
CAS テーブルとしてサーバーに保存する結果テーブルの名前をリストします。
outputTables パラメーターの指定の詳細については、共通 outputTables パラメーターを参照してください。
ridge=double
予測における L2 ノルム正則化を指定します。値は 0 以上でなければなりません。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
saveState=list(casouttable)
将来のスコアリング用のモデルを保存するテーブルを指定します。
saveState パラメーターの指定の詳細については、共通 casouttable (形式 2) パラメーターを参照してください。
seed=double
乱数生成器のシードを指定します。デフォルトでは、シードはコンピュータークロックの時刻に基づきます。
| デフォルト | 0 |
|---|---|
| 範囲 | 0–MACINT |
* table=list(castable)
学習データの入力テーブルを指定します。
| 長い形式 | table=list(name="table-name") |
|---|---|
| 短い形式 | table="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=TRUE | FALSE
True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | FALSE |
computedVars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメーターに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>)
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
onDemand=TRUE | FALSE
このパラメーターは非推奨です。
| デフォルト | TRUE |
|---|
singlePass=TRUE | FALSE
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | FALSE |
|---|
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable=list(groupbytable)
WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルターテーブルの名前を指定します。
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
フィルターテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルターテーブルからデータをサブセット化する式を指定します。
* target="variable-name"
学習のターゲットまたは応答変数を指定します。
useMissing=TRUE | FALSE
True に設定すると、欠損値の特別な処理が使用されます。
| デフォルト | TRUE |
|---|
validTable=list(castable)
検証テーブルの入力テーブルリストを指定します。
| 長い形式 | validTable=list(name="table-name") |
|---|---|
| 短い形式 | validTable="table-name" |
castable の値は次のいずれかになります:
caslib="string"
アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。
computedOnDemand=TRUE | FALSE
True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。
| 別名 | compOnDemand |
|---|---|
| デフォルト | FALSE |
computedVars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。
| 別名 | compVars |
|---|
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
computedVarsProgram="string"
computedVars パラメーターに含める各計算変数の式を指定します。
| 別名 | compPgm |
|---|
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>)
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
入力テーブルの名前を指定します。
onDemand=TRUE | FALSE
このパラメーターは非推奨です。
| デフォルト | TRUE |
|---|
singlePass=TRUE | FALSE
True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。
| デフォルト | FALSE |
|---|
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
アクションで使用する変数を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
入力データをサブセット化する式を指定します。
whereTable=list(groupbytable)
WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。
groupbytable の値は次のいずれかになります:
casLib="string"
フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)
データソースオプションを指定します。
| 別名 | options |
|---|---|
| dataSource |
dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
データソースからテーブルを読み込むための設定を指定します。
| 別名 | import |
|---|
importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。
* name="table-name"
フィルターテーブルの名前を指定します。
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
フィルターテーブルから使用する変数名を指定します。
casinvardesc の値は次のいずれかになります:
format="string"
変数に適用するフォーマットを指定します。
formattedLength=integer
フォーマットフィールドの長さとフォーマット精度の長さを指定します。
label="string"
変数の説明ラベルを指定します。
* name="variable-name"
変数の名前を指定します。
nfd=integer
フォーマット精度の長さを指定します。
nfl=integer
フォーマットフィールドの長さを指定します。
where="where-expression"
フィルターテーブルからデータをサブセット化する式を指定します。