データサイエンスパイロット アクションセット: 構文

自動機械学習パイプラインの探索、実行、順位付けなど、データサイエンスワークフローを自動化するアクションを提供します。

detectInteractions アクション

変数の交互作用の検出と順位付け。

dataSciencePilot.detectInteractions <result=results> <status=rc> /
required parameter casOut
={
caslib="string",
indexVars={"variable-name-1" <, "variable-name-2", ...>},
lifetime=64-bit-integer,
name="table-name",
promote=TRUE | FALSE,
replace=TRUE | FALSE,
},
event="string",
inputLevels={integer-1 <, integer-2, ...>},
inputs
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
maxDistance=double,
misraGries=TRUE | FALSE,
nominals={"variable-name-1" <, "variable-name-2", ...>},
numPairs=integer,
seed=integer,
sparseInputs=TRUE | FALSE,
required parameter table
={
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
singlePass=TRUE | FALSE,
vars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable
={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
required parameter target="variable-name"
;
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

テーブル名、caslib、他の共通パラメーターを指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

required parametercasOut

—

分析結果を格納する CAS テーブルを指定します。

パラメーターの説明

* casOut={casouttable}

分析結果を格納する CAS テーブルを指定します。

長い形式casOut={name="table-name"}
短い形式casOut="table-name"

casouttable の値は次のいずれかになります:

caslib="string"

出力テーブルの caslib の名前を指定します。

indexVars={"variable-name-1" <, "variable-name-2", ...>}

出力データにインデックスを作成する変数のリストを指定します。

lifetime=64-bit-integer

最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。

デフォルト0
最小値0
memoryFormat="DVR" | "INHERIT" | "STANDARD"

出力テーブルのメモリフォーマットを指定します。

デフォルトINHERIT
DVR

重複値削減メモリフォーマットを使用します。このメモリフォーマットでは、入力データに重複する値が含まれている場合に、メモリの消費量とファイルサイズを削減できます。

INHERIT

サーバーに設定されているデフォルトのメモリフォーマットを使用します。デフォルトでは、サーバーは標準のメモリフォーマットを使用します。管理者が CAS_DEFAULT_MEMORY_FORMAT 環境変数を DVR に設定した場合、DVR メモリフォーマットがサーバーのデフォルトとして設定されます。

STANDARD

標準メモリフォーマットを使用します。

name="table-name"

出力テーブルの名前を指定します。

promote=TRUE | FALSE

True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。

デフォルトFALSE
replace=TRUE | FALSE

True に設定すると、同じ名前の既存のテーブルは上書きされます。

デフォルトFALSE
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"

実行中の CAS サーバー上でワーカーポッドの数が増加した場合のテーブル再配布ポリシーを指定します。

DEFER

再配布ポリシーの選択を上位レベルのエンティティに延期します。

NOREDIST

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータを再配布しません。

REBALANCE

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータをリバランスします。

distinctCountLimit=integer

重複しない値のカウント制限を指定します。この制限を超えて misraGries パラメーターを True に設定すると、Misra-Gries frequency sketch アルゴリズムを使用して頻度分布が推定されます。それ以外の場合、重複しない値のカウント操作は中止されます。

デフォルト10000
最小値256

ecdfTolerance=double

経験累積分布関数のトレランスを指定します。この値は Quantile sketch アルゴリズムによって使用されます。

デフォルト0.001
範囲1E-06–0.1

event="string"

モデル化したいターゲット変数の水準を指定します。複数水準の分類問題は、1対多の二項分類問題にキャストされます。event パラメーターの値はモデル化している水準を示します。

inputLevels={integer-1 <, integer-2, ...>}

sparse パラメーターを True に設定すると、各多項式入力変数のレベル数を示す整数のリストを指定します。

inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}

交互作用分析に使用する CAS テーブルの変数 (または変数名) のサブセットを指定します。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名vars

maxDistance=double

ランダム投影から取得される下位の 1 次元空間における 2 点間の最大距離のしきい値を指定します。

別名maxDist
tau
デフォルト1E-05
範囲0–10

maxNumInteractions=integer

各ランダム投影から考慮する交互作用候補の最大数を指定します。

別名maxInteractions
デフォルト1500
範囲1–10000

minInteractionProbability=double

交互作用候補を報告するアクションの最小交互作用強度のしきい値を指定します。

別名gamma
デフォルト0.015
範囲0–1

misraGries=TRUE | FALSE

True に設定すると、重複しない値のカウント制限を超えた場合に、頻度分布の推定に Misra-Gries アルゴリズムが使用されます。

デフォルトTRUE

nominals={"variable-name-1" <, "variable-name-2", ...>}

名義変数を指定します。

numPairs=integer

指定された入力変数間の平均交互作用強度の計算に使用するアルゴリズムの変数のペア数を指定します。デフォルト値のゼロにより、アクションは必要なペアの数を決定できます。

別名numBackgroundPairs
デフォルト0
範囲0–100000

numProjections=integer

交互作用の可能性がある変数のペアのリストを取得するために使用する XYZ アルゴリズムのランダム投影の最大数を指定します。

別名maxProjections
デフォルト500
範囲1–100000

rankMetric="MAX" | "MEAN" | "MEDIAN"

検出された交互作用の順位付けに使用する集計統計量を指定します。

MAX

集計と順位付けのメトリックとして、交互作用の強さの最大値を使用します。

MEAN

集計と順位付けのメトリックとして、交互作用の強さの平均を使用します。

MEDIAN

集計と順位付けのメトリックとして、交互作用の強さの中央値を使用します。

seed=integer

擬似乱数生成器のシード値を指定します。

デフォルト0

sparseInputs=TRUE | FALSE

True に設定すると、CAS テーブル内の入力データが疎形式であることを指定します。デフォルトでは、値は False で、すべての入力はバイナリ {0,1}、{-1,+1}、または {1,2} であると想定されます。

別名sparse
デフォルトFALSE

* table={castable}

テーブル名、caslib、他の共通パラメーターを指定します。

長い形式table={name="table-name"}
短い形式table="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=TRUE | FALSE

True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。

別名compOnDemand
デフォルトFALSE
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメーターに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}

データソースオプションを指定します。

別名options
dataSource
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=TRUE | FALSE

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFALSE
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable={groupbytable}

WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルターテーブルの名前を指定します。

vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

フィルターテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルターテーブルからデータをサブセット化する式を指定します。

* target="variable-name"

アクションによってターゲット変数として使用される CAS テーブルの変数 (または変数名) を指定します。

別名evalVar

detectInteractions アクション

変数の交互作用の検出と順位付け。

results, info = s:dataSciencePilot_detectInteractions{
required parameter casOut
={
caslib="string",
indexVars={"variable-name-1" <, "variable-name-2", ...>},
lifetime=64-bit-integer,
name="table-name",
promote=true | false,
replace=true | false,
},
event="string",
inputLevels={integer-1 <, integer-2, ...>},
inputs
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
maxDistance=double,
misraGries=true | false,
nominals={"variable-name-1" <, "variable-name-2", ...>},
numPairs=integer,
seed=integer,
sparseInputs=true | false,
required parameter table
={
caslib="string",
computedOnDemand=true | false,
computedVars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>},
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter name="table-name",
singlePass=true | false,
vars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}},
where="where-expression",
whereTable
={
casLib="string"
dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter name="table-name"
vars
={{
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
}, {...}}
where="where-expression"
}
},
required parameter target="variable-name"
}
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

テーブル名、caslib、他の共通パラメーターを指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

required parametercasOut

—

分析結果を格納する CAS テーブルを指定します。

パラメーターの説明

* casOut={casouttable}

分析結果を格納する CAS テーブルを指定します。

長い形式casOut={name="table-name"}
短い形式casOut="table-name"

casouttable の値は次のいずれかになります:

caslib="string"

出力テーブルの caslib の名前を指定します。

indexVars={"variable-name-1" <, "variable-name-2", ...>}

出力データにインデックスを作成する変数のリストを指定します。

lifetime=64-bit-integer

最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。

デフォルト0
最小値0
memoryFormat="DVR" | "INHERIT" | "STANDARD"

出力テーブルのメモリフォーマットを指定します。

デフォルトINHERIT
DVR

重複値削減メモリフォーマットを使用します。このメモリフォーマットでは、入力データに重複する値が含まれている場合に、メモリの消費量とファイルサイズを削減できます。

INHERIT

サーバーに設定されているデフォルトのメモリフォーマットを使用します。デフォルトでは、サーバーは標準のメモリフォーマットを使用します。管理者が CAS_DEFAULT_MEMORY_FORMAT 環境変数を DVR に設定した場合、DVR メモリフォーマットがサーバーのデフォルトとして設定されます。

STANDARD

標準メモリフォーマットを使用します。

name="table-name"

出力テーブルの名前を指定します。

promote=true | false

True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。

デフォルトfalse
replace=true | false

True に設定すると、同じ名前の既存のテーブルは上書きされます。

デフォルトfalse
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"

実行中の CAS サーバー上でワーカーポッドの数が増加した場合のテーブル再配布ポリシーを指定します。

DEFER

再配布ポリシーの選択を上位レベルのエンティティに延期します。

NOREDIST

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータを再配布しません。

REBALANCE

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータをリバランスします。

distinctCountLimit=integer

重複しない値のカウント制限を指定します。この制限を超えて misraGries パラメーターを True に設定すると、Misra-Gries frequency sketch アルゴリズムを使用して頻度分布が推定されます。それ以外の場合、重複しない値のカウント操作は中止されます。

デフォルト10000
最小値256

ecdfTolerance=double

経験累積分布関数のトレランスを指定します。この値は Quantile sketch アルゴリズムによって使用されます。

デフォルト0.001
範囲1E-06–0.1

event="string"

モデル化したいターゲット変数の水準を指定します。複数水準の分類問題は、1対多の二項分類問題にキャストされます。event パラメーターの値はモデル化している水準を示します。

inputLevels={integer-1 <, integer-2, ...>}

sparse パラメーターを True に設定すると、各多項式入力変数のレベル数を示す整数のリストを指定します。

inputs={{casinvardesc-1} <, {casinvardesc-2}, ...>}

交互作用分析に使用する CAS テーブルの変数 (または変数名) のサブセットを指定します。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名vars

maxDistance=double

ランダム投影から取得される下位の 1 次元空間における 2 点間の最大距離のしきい値を指定します。

別名maxDist
tau
デフォルト1E-05
範囲0–10

maxNumInteractions=integer

各ランダム投影から考慮する交互作用候補の最大数を指定します。

別名maxInteractions
デフォルト1500
範囲1–10000

minInteractionProbability=double

交互作用候補を報告するアクションの最小交互作用強度のしきい値を指定します。

別名gamma
デフォルト0.015
範囲0–1

misraGries=true | false

True に設定すると、重複しない値のカウント制限を超えた場合に、頻度分布の推定に Misra-Gries アルゴリズムが使用されます。

デフォルトtrue

nominals={"variable-name-1" <, "variable-name-2", ...>}

名義変数を指定します。

numPairs=integer

指定された入力変数間の平均交互作用強度の計算に使用するアルゴリズムの変数のペア数を指定します。デフォルト値のゼロにより、アクションは必要なペアの数を決定できます。

別名numBackgroundPairs
デフォルト0
範囲0–100000

numProjections=integer

交互作用の可能性がある変数のペアのリストを取得するために使用する XYZ アルゴリズムのランダム投影の最大数を指定します。

別名maxProjections
デフォルト500
範囲1–100000

rankMetric="MAX" | "MEAN" | "MEDIAN"

検出された交互作用の順位付けに使用する集計統計量を指定します。

MAX

集計と順位付けのメトリックとして、交互作用の強さの最大値を使用します。

MEAN

集計と順位付けのメトリックとして、交互作用の強さの平均を使用します。

MEDIAN

集計と順位付けのメトリックとして、交互作用の強さの中央値を使用します。

seed=integer

擬似乱数生成器のシード値を指定します。

デフォルト0

sparseInputs=true | false

True に設定すると、CAS テーブル内の入力データが疎形式であることを指定します。デフォルトでは、値は False で、すべての入力はバイナリ {0,1}、{-1,+1}、または {1,2} であると想定されます。

別名sparse
デフォルトfalse

* table={castable}

テーブル名、caslib、他の共通パラメーターを指定します。

長い形式table={name="table-name"}
短い形式table="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=true | false

True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。

別名compOnDemand
デフォルトfalse
computedVars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメーターに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions={key-1=any-list-or-data-type-1 <, key-2=any-list-or-data-type-2, ...>}

データソースオプションを指定します。

別名options
dataSource
importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=true | false

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトfalse
vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable={groupbytable}

WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions={adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions={fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルターテーブルの名前を指定します。

vars={{casinvardesc-1} <, {casinvardesc-2}, ...>}

フィルターテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルターテーブルからデータをサブセット化する式を指定します。

* target="variable-name"

アクションによってターゲット変数として使用される CAS テーブルの変数 (または変数名) を指定します。

別名evalVar

detectInteractions アクション

変数の交互作用の検出と順位付け。

results=s.dataSciencePilot.detectInteractions(
required parameter casOut
={
"caslib":"string",
"indexVars":["variable-name-1" <, "variable-name-2", ...>],
"lifetime":64-bit-integer,
"name":"table-name",
"promote":True | False,
"replace":True | False,
},
event="string",
inputLevels=[integer-1 <, integer-2, ...>],
inputs
=[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
maxDistance=double,
misraGries=True | False,
nominals=["variable-name-1" <, "variable-name-2", ...>],
numPairs=integer,
seed=integer,
sparseInputs=True | False,
required parameter table
={
"caslib":"string",
"computedOnDemand":True | False,
"computedVars"
:[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>},
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters},
required parameter "name":"table-name",
"singlePass":True | False,
"vars"
:[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>],
"where":"where-expression",
"whereTable"
:{
"casLib":"string"
"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}
required parameter "name":"table-name"
"vars"
:[{
"format":"string",
"formattedLength":integer,
"label":"string",
required parameter "name":"variable-name",
"nfd":integer,
"nfl":integer
}<, {...}>]
"where":"where-expression"
}
},
required parameter target="variable-name"
)
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

テーブル名、caslib、他の共通パラメーターを指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

required parametercasOut

—

分析結果を格納する CAS テーブルを指定します。

パラメーターの説明

* casOut={casouttable}

分析結果を格納する CAS テーブルを指定します。

長い形式casOut={"name":"table-name"}
短い形式casOut="table-name"

casouttable の値は次のいずれかになります:

"caslib":"string"

出力テーブルの caslib の名前を指定します。

"indexVars":["variable-name-1" <, "variable-name-2", ...>]

出力データにインデックスを作成する変数のリストを指定します。

"lifetime":64-bit-integer

最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。

デフォルト0
最小値0
"memoryFormat":"DVR" | "INHERIT" | "STANDARD"

出力テーブルのメモリフォーマットを指定します。

デフォルトINHERIT
DVR

重複値削減メモリフォーマットを使用します。このメモリフォーマットでは、入力データに重複する値が含まれている場合に、メモリの消費量とファイルサイズを削減できます。

INHERIT

サーバーに設定されているデフォルトのメモリフォーマットを使用します。デフォルトでは、サーバーは標準のメモリフォーマットを使用します。管理者が CAS_DEFAULT_MEMORY_FORMAT 環境変数を DVR に設定した場合、DVR メモリフォーマットがサーバーのデフォルトとして設定されます。

STANDARD

標準メモリフォーマットを使用します。

"name":"table-name"

出力テーブルの名前を指定します。

"promote":True | False

True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。

デフォルトFalse
"replace":True | False

True に設定すると、同じ名前の既存のテーブルは上書きされます。

デフォルトFalse
"tableRedistUpPolicy":"DEFER" | "NOREDIST" | "REBALANCE"

実行中の CAS サーバー上でワーカーポッドの数が増加した場合のテーブル再配布ポリシーを指定します。

DEFER

再配布ポリシーの選択を上位レベルのエンティティに延期します。

NOREDIST

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータを再配布しません。

REBALANCE

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータをリバランスします。

distinctCountLimit=integer

重複しない値のカウント制限を指定します。この制限を超えて misraGries パラメーターを True に設定すると、Misra-Gries frequency sketch アルゴリズムを使用して頻度分布が推定されます。それ以外の場合、重複しない値のカウント操作は中止されます。

デフォルト10000
最小値256

ecdfTolerance=double

経験累積分布関数のトレランスを指定します。この値は Quantile sketch アルゴリズムによって使用されます。

デフォルト0.001
範囲1E-06–0.1

event="string"

モデル化したいターゲット変数の水準を指定します。複数水準の分類問題は、1対多の二項分類問題にキャストされます。event パラメーターの値はモデル化している水準を示します。

inputLevels=[integer-1 <, integer-2, ...>]

sparse パラメーターを True に設定すると、各多項式入力変数のレベル数を示す整数のリストを指定します。

inputs=[{casinvardesc-1} <, {casinvardesc-2}, ...>]

交互作用分析に使用する CAS テーブルの変数 (または変数名) のサブセットを指定します。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名vars

maxDistance=double

ランダム投影から取得される下位の 1 次元空間における 2 点間の最大距離のしきい値を指定します。

別名maxDist
tau
デフォルト1E-05
範囲0–10

maxNumInteractions=integer

各ランダム投影から考慮する交互作用候補の最大数を指定します。

別名maxInteractions
デフォルト1500
範囲1–10000

minInteractionProbability=double

交互作用候補を報告するアクションの最小交互作用強度のしきい値を指定します。

別名gamma
デフォルト0.015
範囲0–1

misraGries=True | False

True に設定すると、重複しない値のカウント制限を超えた場合に、頻度分布の推定に Misra-Gries アルゴリズムが使用されます。

デフォルトTrue

nominals=["variable-name-1" <, "variable-name-2", ...>]

名義変数を指定します。

numPairs=integer

指定された入力変数間の平均交互作用強度の計算に使用するアルゴリズムの変数のペア数を指定します。デフォルト値のゼロにより、アクションは必要なペアの数を決定できます。

別名numBackgroundPairs
デフォルト0
範囲0–100000

numProjections=integer

交互作用の可能性がある変数のペアのリストを取得するために使用する XYZ アルゴリズムのランダム投影の最大数を指定します。

別名maxProjections
デフォルト500
範囲1–100000

rankMetric="MAX" | "MEAN" | "MEDIAN"

検出された交互作用の順位付けに使用する集計統計量を指定します。

MAX

集計と順位付けのメトリックとして、交互作用の強さの最大値を使用します。

MEAN

集計と順位付けのメトリックとして、交互作用の強さの平均を使用します。

MEDIAN

集計と順位付けのメトリックとして、交互作用の強さの中央値を使用します。

seed=integer

擬似乱数生成器のシード値を指定します。

デフォルト0

sparseInputs=True | False

True に設定すると、CAS テーブル内の入力データが疎形式であることを指定します。デフォルトでは、値は False で、すべての入力はバイナリ {0,1}、{-1,+1}、または {1,2} であると想定されます。

別名sparse
デフォルトFalse

* table={castable}

テーブル名、caslib、他の共通パラメーターを指定します。

長い形式table={"name":"table-name"}
短い形式table="table-name"

castable の値は次のいずれかになります:

"caslib":"string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

"computedOnDemand":True | False

True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。

別名compOnDemand
デフォルトFalse
"computedVars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"computedVarsProgram":"string"

computedVars パラメーターに含める各計算変数の式を指定します。

別名compPgm
"dataSourceOptions":{"key-1":{any-list-or-data-type-1} <, "key-2":{any-list-or-data-type-2}, ...>}

データソースオプションを指定します。

別名options
dataSource
"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import_

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* "name":"table-name"

入力テーブルの名前を指定します。

"singlePass":True | False

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFalse
"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"where":"where-expression"

入力データをサブセット化する式を指定します。

"whereTable":{groupbytable}

WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

"casLib":"string"

フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。

"dataSourceOptions":{adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters}

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

"importOptions":{"fileType":"ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters}

データソースからテーブルを読み込むための設定を指定します。

別名import_

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* "name":"table-name"

フィルターテーブルの名前を指定します。

"vars":[{casinvardesc-1} <, {casinvardesc-2}, ...>]

フィルターテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

"format":"string"

変数に適用するフォーマットを指定します。

"formattedLength":integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

"label":"string"

変数の説明ラベルを指定します。

* "name":"variable-name"

変数の名前を指定します。

"nfd":integer

フォーマット精度の長さを指定します。

"nfl":integer

フォーマットフィールドの長さを指定します。

"where":"where-expression"

フィルターテーブルからデータをサブセット化する式を指定します。

* target="variable-name"

アクションによってターゲット変数として使用される CAS テーブルの変数 (または変数名) を指定します。

別名evalVar

detectInteractions アクション

変数の交互作用の検出と順位付け。

results <– cas.dataSciencePilot.detectInteractions(s,
required parameter casOut
=list(
caslib="string",
indexVars=list("variable-name-1" <, "variable-name-2", ...>),
lifetime=64-bit-integer,
name="table-name",
promote=TRUE | FALSE,
replace=TRUE | FALSE,
),
event="string",
inputLevels=list(integer-1 <, integer-2, ...>),
inputs
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
maxDistance=double,
misraGries=TRUE | FALSE,
nominals=list("variable-name-1" <, "variable-name-2", ...>),
numPairs=integer,
seed=integer,
sparseInputs=TRUE | FALSE,
required parameter table
=list(
caslib="string",
computedOnDemand=TRUE | FALSE,
computedVars
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>),
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters),
required parameter name="table-name",
singlePass=TRUE | FALSE,
vars
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>),
where="where-expression",
whereTable
=list(
casLib="string"
dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DELIMITED" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SOUND" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)
required parameter name="table-name"
vars
=list( list(
format="string",
formattedLength=integer,
label="string",
required parameter name="variable-name",
nfd=integer,
nfl=integer
) <, list(...)>)
where="where-expression"
)
),
required parameter target="variable-name"
)
必須パラメーター

要約: 入力テーブルと出力テーブル

行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。

入力テーブルの読み込みパラメーター

パラメーター

サブパラメーター

説明

required parametertable

—

テーブル名、caslib、他の共通パラメーターを指定します。

出力テーブルの作成パラメーター

パラメーター

サブパラメーター

説明

required parametercasOut

—

分析結果を格納する CAS テーブルを指定します。

パラメーターの説明

* casOut=list(casouttable)

分析結果を格納する CAS テーブルを指定します。

長い形式casOut=list(name="table-name")
短い形式casOut="table-name"

casouttable の値は次のいずれかになります:

caslib="string"

出力テーブルの caslib の名前を指定します。

indexVars=list("variable-name-1" <, "variable-name-2", ...>)

出力データにインデックスを作成する変数のリストを指定します。

lifetime=64-bit-integer

最後にアクセスした後にテーブルをメモリに保持する秒数を指定します。指定した秒数にアクセスできない場合、テーブルは削除されます。

デフォルト0
最小値0
memoryFormat="DVR" | "INHERIT" | "STANDARD"

出力テーブルのメモリフォーマットを指定します。

デフォルトINHERIT
DVR

重複値削減メモリフォーマットを使用します。このメモリフォーマットでは、入力データに重複する値が含まれている場合に、メモリの消費量とファイルサイズを削減できます。

INHERIT

サーバーに設定されているデフォルトのメモリフォーマットを使用します。デフォルトでは、サーバーは標準のメモリフォーマットを使用します。管理者が CAS_DEFAULT_MEMORY_FORMAT 環境変数を DVR に設定した場合、DVR メモリフォーマットがサーバーのデフォルトとして設定されます。

STANDARD

標準メモリフォーマットを使用します。

name="table-name"

出力テーブルの名前を指定します。

promote=TRUE | FALSE

True に設定すると、出力テーブルはグローバルスコープで追加されます。これにより、アクセスコントロールの対象となる他のセッションがテーブルにアクセスできるようになります。ターゲット caslib には、グローバルスコープも必要です。

デフォルトFALSE
replace=TRUE | FALSE

True に設定すると、同じ名前の既存のテーブルは上書きされます。

デフォルトFALSE
tableRedistUpPolicy="DEFER" | "NOREDIST" | "REBALANCE"

実行中の CAS サーバー上でワーカーポッドの数が増加した場合のテーブル再配布ポリシーを指定します。

DEFER

再配布ポリシーの選択を上位レベルのエンティティに延期します。

NOREDIST

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータを再配布しません。

REBALANCE

実行中の CAS サーバー上でワーカーポッドの数が変更された場合に、テーブルデータをリバランスします。

distinctCountLimit=integer

重複しない値のカウント制限を指定します。この制限を超えて misraGries パラメーターを True に設定すると、Misra-Gries frequency sketch アルゴリズムを使用して頻度分布が推定されます。それ以外の場合、重複しない値のカウント操作は中止されます。

デフォルト10000
最小値256

ecdfTolerance=double

経験累積分布関数のトレランスを指定します。この値は Quantile sketch アルゴリズムによって使用されます。

デフォルト0.001
範囲1E-06–0.1

event="string"

モデル化したいターゲット変数の水準を指定します。複数水準の分類問題は、1対多の二項分類問題にキャストされます。event パラメーターの値はモデル化している水準を示します。

inputLevels=list(integer-1 <, integer-2, ...>)

sparse パラメーターを True に設定すると、各多項式入力変数のレベル数を示す整数のリストを指定します。

inputs=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

交互作用分析に使用する CAS テーブルの変数 (または変数名) のサブセットを指定します。

inputs パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。

別名vars

maxDistance=double

ランダム投影から取得される下位の 1 次元空間における 2 点間の最大距離のしきい値を指定します。

別名maxDist
tau
デフォルト1E-05
範囲0–10

maxNumInteractions=integer

各ランダム投影から考慮する交互作用候補の最大数を指定します。

別名maxInteractions
デフォルト1500
範囲1–10000

minInteractionProbability=double

交互作用候補を報告するアクションの最小交互作用強度のしきい値を指定します。

別名gamma
デフォルト0.015
範囲0–1

misraGries=TRUE | FALSE

True に設定すると、重複しない値のカウント制限を超えた場合に、頻度分布の推定に Misra-Gries アルゴリズムが使用されます。

デフォルトTRUE

nominals=list("variable-name-1" <, "variable-name-2", ...>)

名義変数を指定します。

numPairs=integer

指定された入力変数間の平均交互作用強度の計算に使用するアルゴリズムの変数のペア数を指定します。デフォルト値のゼロにより、アクションは必要なペアの数を決定できます。

別名numBackgroundPairs
デフォルト0
範囲0–100000

numProjections=integer

交互作用の可能性がある変数のペアのリストを取得するために使用する XYZ アルゴリズムのランダム投影の最大数を指定します。

別名maxProjections
デフォルト500
範囲1–100000

rankMetric="MAX" | "MEAN" | "MEDIAN"

検出された交互作用の順位付けに使用する集計統計量を指定します。

MAX

集計と順位付けのメトリックとして、交互作用の強さの最大値を使用します。

MEAN

集計と順位付けのメトリックとして、交互作用の強さの平均を使用します。

MEDIAN

集計と順位付けのメトリックとして、交互作用の強さの中央値を使用します。

seed=integer

擬似乱数生成器のシード値を指定します。

デフォルト0

sparseInputs=TRUE | FALSE

True に設定すると、CAS テーブル内の入力データが疎形式であることを指定します。デフォルトでは、値は False で、すべての入力はバイナリ {0,1}、{-1,+1}、または {1,2} であると想定されます。

別名sparse
デフォルトFALSE

* table=list(castable)

テーブル名、caslib、他の共通パラメーターを指定します。

長い形式table=list(name="table-name")
短い形式table="table-name"

castable の値は次のいずれかになります:

caslib="string"

アクションで使用する入力テーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。別の caslib からテーブルにアクセスする必要がある場合にのみ値を指定します。

computedOnDemand=TRUE | FALSE

True に設定すると、アクションの開始時ではなくテーブルのロード時に計算変数が作成されます。

別名compOnDemand
デフォルトFALSE
computedVars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

作成する計算変数の名前を指定します。computedVarsProgram パラメーターの各変数の式を指定します。このパラメーターを指定しない場合、computeVarsProgram のすべての変数が自動的に含まれます。

別名compVars

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

computedVarsProgram="string"

computedVars パラメーターに含める各計算変数の式を指定します。

別名compPgm
dataSourceOptions=list(key-1=list(any-list-or-data-type-1) <, key-2=list(any-list-or-data-type-2), ...>)

データソースオプションを指定します。

別名options
dataSource
importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

入力テーブルの名前を指定します。

singlePass=TRUE | FALSE

True に設定すると、サーバー上に一時テーブルは作成されません。このパラメーターを True に設定すると効率的ですが、繰り返し実行時にデータの順序が安定しない場合があります。

デフォルトFALSE
vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

アクションで使用する変数を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

入力データをサブセット化する式を指定します。

whereTable=list(groupbytable)

WHERE フィルターとして使用する行を含む入力テーブルを指定します。vars パラメーターが指定されていない場合は、入力テーブルとフィルタリングテーブルに共通するすべての変数名を使用して一致する行を検索します。入力テーブルの where パラメーターとこのパラメーターが指定されている場合、このフィルタリングテーブルが最初に適用されます。

groupbytable の値は次のいずれかになります:

casLib="string"

フィルターテーブルの caslib を指定します。デフォルトでは、アクティブな caslib が使用されます。

dataSourceOptions=list(adls_noreq-parameters | bigquery-parameters | cas_noreq-parameters | clouddex-parameters | db2-parameters | dnfs-parameters | esp-parameters | fedsvr-parameters | gcs_noreq-parameters | hadoop-parameters | hana-parameters | impala-parameters | informix-parameters | jdbc-parameters | mongodb-parameters | mysql-parameters | odbc-parameters | oracle-parameters | path-parameters | postgres-parameters | redshift-parameters | s3-parameters | sapiq-parameters | sforce-parameters | singlestore_standard-parameters | snowflake-parameters | spark-parameters | spde-parameters | sqlserver-parameters | ss_noreq-parameters | teradata-parameters | vertica-parameters | yellowbrick-parameters)

データソースオプションを指定します。

別名options
dataSource

dataSourceOptions パラメーターの指定の詳細については、共通 dataSourceOptions パラメーターを参照してください。

importOptions=list(fileType="ANY" | "AUDIO" | "AUTO" | "BASESAS" | "CSV" | "DOCUMENT" | "DTA" | "ESP" | "EXCEL" | "FMT" | "HDAT" | "IMAGE" | "JMP" | "LASR" | "PARQUET" | "SPSS" | "VIDEO" | "XLS", fileType-specific-parameters)

データソースからテーブルを読み込むための設定を指定します。

別名import

importOptions パラメーターの指定の詳細については、共通 importOptions パラメーターを参照してください。

* name="table-name"

フィルターテーブルの名前を指定します。

vars=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)

フィルターテーブルから使用する変数名を指定します。

casinvardesc の値は次のいずれかになります:

format="string"

変数に適用するフォーマットを指定します。

formattedLength=integer

フォーマットフィールドの長さとフォーマット精度の長さを指定します。

label="string"

変数の説明ラベルを指定します。

* name="variable-name"

変数の名前を指定します。

nfd=integer

フォーマット精度の長さを指定します。

nfl=integer

フォーマットフィールドの長さを指定します。

where="where-expression"

フィルターテーブルからデータをサブセット化する式を指定します。

* target="variable-name"

アクションによってターゲット変数として使用される CAS テーブルの変数 (または変数名) を指定します。

別名evalVar
最終更新: 2026年3月26日