LDA トピックモデリング アクションセット: 構文
LDA モデルを使用して LDA トピックモデルとスコアリング文書を学習するアクションを提供します
ldaTrain アクション
潜在的 Dirichlet 配分法トピックモデルを学習します。
| 参照項目: | 潜在的ディリクレ配分トピックアクションの概要 |
|---|---|
| 例: | 潜在的ディリクレ配分法を使用したドキュメントのトピックモデルの学習 |
| 潜在的ディリクレ配分トピック法を使用したドキュメントの学習とスコアリング |
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
分析のために保持する単語を含む入力 CAS テーブルを指定します。 | |
|
— |
分析から除外する単語を含む入力 CAS テーブルを指定します。 | |
|
required parametertable |
— |
入力テーブルの設定を指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
トピック分布を格納するインメモリテーブルを指定します。 | |
|
— |
文書のトピック比率を格納するインメモリテーブルを指定します。 |
パラメーターの説明
alpha=double
文書のトピック比率の Dirichlet ハイパーパラメーターを指定します。
| デフォルト | 0.1 |
|---|---|
| 最小値 (含まない) | 0 |
beta=double
トピック分布の Dirichlet ハイパーパラメーターを指定します。
| デフォルト | 0.1 |
|---|---|
| 最小値 (含まない) | 0 |
casOut={casouttable}
トピック分布を格納するインメモリテーブルを指定します。
casOut パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
| 別名 | topicDistOut |
|---|---|
| topicDist | |
| ldamodel |
docDistOut={casouttable}
文書のトピック比率を格納するインメモリテーブルを指定します。
docDistOut パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
| 別名 | topicPropOut |
|---|---|
| topicProp | |
| topicProportion | |
| docDist |
* docId="variable-name"
各文書の ID を含む入力テーブルの文字変数または数値変数を指定します。
| 別名 | docIdVar |
|---|
k=64-bit-integer
モデルで考慮するトピック数を指定します。
| 別名 | nTopic |
|---|---|
| numTopics | |
| numTopic | |
| デフォルト | 2 |
| 最小値 | 1 |
keepWords={castable}
分析のために保持する単語を含む入力 CAS テーブルを指定します。
keepWords パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。
| 別名 | startList |
|---|
likelihood=TRUE | FALSE
True に設定すると、尤度と条件付き尤度の両方が計算されます。
| デフォルト | FALSE |
|---|
meanEstimate=TRUE | FALSE
True に設定すると、トピック分布と文書のトピック比率の推定値は、すべての反復から Gibbs サンプルを平均して計算されます。デフォルトでは、推定値は最終反復でのみ Gibbs サンプルから計算されます。
| デフォルト | FALSE |
|---|
nBurnin=integer
Burn-In として考慮する Gibbs サンプリングの反復回数、または破棄する反復回数を指定します。これらの Burn-in 反復回数は、nIters パラメーターで指定された最大反復回数にはカウントされないことに注意してください。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
nIters=integer
最大反復回数を指定します。
| 別名 | nIter |
|---|---|
| maxIters | |
| デフォルト | 10 |
| 最小値 | 1 |
seed=double
乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータークロックに基づいています。負の値を指定すると、コンピュータークロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
stopWords={castable}
分析から除外する単語を含む入力 CAS テーブルを指定します。
stopWords パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。
| 別名 | stopList |
|---|
* table={castable}
入力テーブルの設定を指定します。
table パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。
* text={{casinvardesc-1} <, {casinvardesc-2}, ...>}
モデルの学習に使用する入力テーブルのテキスト変数を指定します。
text パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | texts |
|---|---|
| input | |
| inputs |
tm={castm}
テキスト解析の設定を指定します。
| 長い形式 | tm={entities="NONE" | "STD"} |
|---|---|
| 短い形式 | tm="NONE" | "STD" |
castm の値は次のいずれかになります:
binaryLocation="string"
言語バイナリファイルの場所を指定します。場所は有効でなければなりません。指定されていない場合は、デフォルトのインストール場所が使用されます。
| 別名 | taBinLoc |
|---|
entities="NONE" | "STD"
解析でエンティティを抽出するかどうかを指定します。None に設定すると、エンティティは出力されません。STD に設定すると、標準エンティティが出力されます。
| デフォルト | NONE |
|---|
language="ARABIC" | "CHINESE" | "CROATIAN" | "CZECH" | "DANISH" | "DUTCH" | "ENGLISH" | "FARSI" | "FINNISH" | "FRENCH" | "GERMAN" | "GREEK" | "HEBREW" | "HINDI" | "HUNGARIAN" | "INDONESIAN" | "ITALIAN" | "JAPANESE" | "KAZAKH" | "KOREAN" | "NORWEGIAN" | "POLISH" | "PORTUGUESE" | "ROMANIAN" | "RUSSIAN" | "SLOVAK" | "SLOVENE" | "SPANISH" | "SWEDISH" | "TAGALOG" | "THAI" | "TURKISH" | "VIETNAMESE"
入力文書テーブルのテキスト変数で使用される言語を指定します。
| デフォルト | ENGLISH |
|---|
nounGroups=TRUE | FALSE
True に設定すると、解析中に名詞グループが抽出されます。
| デフォルト | FALSE |
|---|
stemming=TRUE | FALSE
True に設定すると、解析中に語幹抽出が実行されます。
| デフォルト | FALSE |
|---|
ldaTrain アクション
潜在的 Dirichlet 配分法トピックモデルを学習します。
| 参照項目: | 潜在的ディリクレ配分トピックアクションの概要 |
|---|---|
| 例: | 潜在的ディリクレ配分法を使用したドキュメントのトピックモデルの学習 |
| 潜在的ディリクレ配分トピック法を使用したドキュメントの学習とスコアリング |
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
分析のために保持する単語を含む入力 CAS テーブルを指定します。 | |
|
— |
分析から除外する単語を含む入力 CAS テーブルを指定します。 | |
|
required parametertable |
— |
入力テーブルの設定を指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
トピック分布を格納するインメモリテーブルを指定します。 | |
|
— |
文書のトピック比率を格納するインメモリテーブルを指定します。 |
パラメーターの説明
alpha=double
文書のトピック比率の Dirichlet ハイパーパラメーターを指定します。
| デフォルト | 0.1 |
|---|---|
| 最小値 (含まない) | 0 |
beta=double
トピック分布の Dirichlet ハイパーパラメーターを指定します。
| デフォルト | 0.1 |
|---|---|
| 最小値 (含まない) | 0 |
casOut={casouttable}
トピック分布を格納するインメモリテーブルを指定します。
casOut パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
| 別名 | topicDistOut |
|---|---|
| topicDist | |
| ldamodel |
docDistOut={casouttable}
文書のトピック比率を格納するインメモリテーブルを指定します。
docDistOut パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
| 別名 | topicPropOut |
|---|---|
| topicProp | |
| topicProportion | |
| docDist |
* docId="variable-name"
各文書の ID を含む入力テーブルの文字変数または数値変数を指定します。
| 別名 | docIdVar |
|---|
k=64-bit-integer
モデルで考慮するトピック数を指定します。
| 別名 | nTopic |
|---|---|
| numTopics | |
| numTopic | |
| デフォルト | 2 |
| 最小値 | 1 |
keepWords={castable}
分析のために保持する単語を含む入力 CAS テーブルを指定します。
keepWords パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。
| 別名 | startList |
|---|
likelihood=true | false
True に設定すると、尤度と条件付き尤度の両方が計算されます。
| デフォルト | false |
|---|
meanEstimate=true | false
True に設定すると、トピック分布と文書のトピック比率の推定値は、すべての反復から Gibbs サンプルを平均して計算されます。デフォルトでは、推定値は最終反復でのみ Gibbs サンプルから計算されます。
| デフォルト | false |
|---|
nBurnin=integer
Burn-In として考慮する Gibbs サンプリングの反復回数、または破棄する反復回数を指定します。これらの Burn-in 反復回数は、nIters パラメーターで指定された最大反復回数にはカウントされないことに注意してください。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
nIters=integer
最大反復回数を指定します。
| 別名 | nIter |
|---|---|
| maxIters | |
| デフォルト | 10 |
| 最小値 | 1 |
seed=double
乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータークロックに基づいています。負の値を指定すると、コンピュータークロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
stopWords={castable}
分析から除外する単語を含む入力 CAS テーブルを指定します。
stopWords パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。
| 別名 | stopList |
|---|
* table={castable}
入力テーブルの設定を指定します。
table パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。
* text={{casinvardesc-1} <, {casinvardesc-2}, ...>}
モデルの学習に使用する入力テーブルのテキスト変数を指定します。
text パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | texts |
|---|---|
| input | |
| inputs |
tm={castm}
テキスト解析の設定を指定します。
| 長い形式 | tm={entities="NONE" | "STD"} |
|---|---|
| 短い形式 | tm="NONE" | "STD" |
castm の値は次のいずれかになります:
binaryLocation="string"
言語バイナリファイルの場所を指定します。場所は有効でなければなりません。指定されていない場合は、デフォルトのインストール場所が使用されます。
| 別名 | taBinLoc |
|---|
entities="NONE" | "STD"
解析でエンティティを抽出するかどうかを指定します。None に設定すると、エンティティは出力されません。STD に設定すると、標準エンティティが出力されます。
| デフォルト | NONE |
|---|
language="ARABIC" | "CHINESE" | "CROATIAN" | "CZECH" | "DANISH" | "DUTCH" | "ENGLISH" | "FARSI" | "FINNISH" | "FRENCH" | "GERMAN" | "GREEK" | "HEBREW" | "HINDI" | "HUNGARIAN" | "INDONESIAN" | "ITALIAN" | "JAPANESE" | "KAZAKH" | "KOREAN" | "NORWEGIAN" | "POLISH" | "PORTUGUESE" | "ROMANIAN" | "RUSSIAN" | "SLOVAK" | "SLOVENE" | "SPANISH" | "SWEDISH" | "TAGALOG" | "THAI" | "TURKISH" | "VIETNAMESE"
入力文書テーブルのテキスト変数で使用される言語を指定します。
| デフォルト | ENGLISH |
|---|
nounGroups=true | false
True に設定すると、解析中に名詞グループが抽出されます。
| デフォルト | false |
|---|
stemming=true | false
True に設定すると、解析中に語幹抽出が実行されます。
| デフォルト | false |
|---|
ldaTrain アクション
潜在的 Dirichlet 配分法トピックモデルを学習します。
| 参照項目: | 潜在的ディリクレ配分トピックアクションの概要 |
|---|---|
| 例: | 潜在的ディリクレ配分法を使用したドキュメントのトピックモデルの学習 |
| 潜在的ディリクレ配分トピック法を使用したドキュメントの学習とスコアリング |
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
分析のために保持する単語を含む入力 CAS テーブルを指定します。 | |
|
— |
分析から除外する単語を含む入力 CAS テーブルを指定します。 | |
|
required parametertable |
— |
入力テーブルの設定を指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
トピック分布を格納するインメモリテーブルを指定します。 | |
|
— |
文書のトピック比率を格納するインメモリテーブルを指定します。 |
パラメーターの説明
alpha=double
文書のトピック比率の Dirichlet ハイパーパラメーターを指定します。
| デフォルト | 0.1 |
|---|---|
| 最小値 (含まない) | 0 |
beta=double
トピック分布の Dirichlet ハイパーパラメーターを指定します。
| デフォルト | 0.1 |
|---|---|
| 最小値 (含まない) | 0 |
casOut={casouttable}
トピック分布を格納するインメモリテーブルを指定します。
casOut パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
| 別名 | topicDistOut |
|---|---|
| topicDist | |
| ldamodel |
docDistOut={casouttable}
文書のトピック比率を格納するインメモリテーブルを指定します。
docDistOut パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
| 別名 | topicPropOut |
|---|---|
| topicProp | |
| topicProportion | |
| docDist |
* docId="variable-name"
各文書の ID を含む入力テーブルの文字変数または数値変数を指定します。
| 別名 | docIdVar |
|---|
k=64-bit-integer
モデルで考慮するトピック数を指定します。
| 別名 | nTopic |
|---|---|
| numTopics | |
| numTopic | |
| デフォルト | 2 |
| 最小値 | 1 |
keepWords={castable}
分析のために保持する単語を含む入力 CAS テーブルを指定します。
keepWords パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。
| 別名 | startList |
|---|
likelihood=True | False
True に設定すると、尤度と条件付き尤度の両方が計算されます。
| デフォルト | False |
|---|
meanEstimate=True | False
True に設定すると、トピック分布と文書のトピック比率の推定値は、すべての反復から Gibbs サンプルを平均して計算されます。デフォルトでは、推定値は最終反復でのみ Gibbs サンプルから計算されます。
| デフォルト | False |
|---|
nBurnin=integer
Burn-In として考慮する Gibbs サンプリングの反復回数、または破棄する反復回数を指定します。これらの Burn-in 反復回数は、nIters パラメーターで指定された最大反復回数にはカウントされないことに注意してください。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
nIters=integer
最大反復回数を指定します。
| 別名 | nIter |
|---|---|
| maxIters | |
| デフォルト | 10 |
| 最小値 | 1 |
seed=double
乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータークロックに基づいています。負の値を指定すると、コンピュータークロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
stopWords={castable}
分析から除外する単語を含む入力 CAS テーブルを指定します。
stopWords パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。
| 別名 | stopList |
|---|
* table={castable}
入力テーブルの設定を指定します。
table パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。
* text=[{casinvardesc-1} <, {casinvardesc-2}, ...>]
モデルの学習に使用する入力テーブルのテキスト変数を指定します。
text パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | texts |
|---|---|
| input | |
| inputs |
tm={castm}
テキスト解析の設定を指定します。
| 長い形式 | tm={"entities":"NONE" | "STD"} |
|---|---|
| 短い形式 | tm="NONE" | "STD" |
castm の値は次のいずれかになります:
"binaryLocation":"string"
言語バイナリファイルの場所を指定します。場所は有効でなければなりません。指定されていない場合は、デフォルトのインストール場所が使用されます。
| 別名 | taBinLoc |
|---|
"entities":"NONE" | "STD"
解析でエンティティを抽出するかどうかを指定します。None に設定すると、エンティティは出力されません。STD に設定すると、標準エンティティが出力されます。
| デフォルト | NONE |
|---|
"language":"ARABIC" | "CHINESE" | "CROATIAN" | "CZECH" | "DANISH" | "DUTCH" | "ENGLISH" | "FARSI" | "FINNISH" | "FRENCH" | "GERMAN" | "GREEK" | "HEBREW" | "HINDI" | "HUNGARIAN" | "INDONESIAN" | "ITALIAN" | "JAPANESE" | "KAZAKH" | "KOREAN" | "NORWEGIAN" | "POLISH" | "PORTUGUESE" | "ROMANIAN" | "RUSSIAN" | "SLOVAK" | "SLOVENE" | "SPANISH" | "SWEDISH" | "TAGALOG" | "THAI" | "TURKISH" | "VIETNAMESE"
入力文書テーブルのテキスト変数で使用される言語を指定します。
| デフォルト | ENGLISH |
|---|
"nounGroups":True | False
True に設定すると、解析中に名詞グループが抽出されます。
| デフォルト | False |
|---|
"stemming":True | False
True に設定すると、解析中に語幹抽出が実行されます。
| デフォルト | False |
|---|
ldaTrain アクション
潜在的 Dirichlet 配分法トピックモデルを学習します。
| 参照項目: | 潜在的ディリクレ配分トピックアクションの概要 |
|---|---|
| 例: | 潜在的ディリクレ配分法を使用したドキュメントのトピックモデルの学習 |
| 潜在的ディリクレ配分トピック法を使用したドキュメントの学習とスコアリング |
要約: 入力テーブルと出力テーブル
行にサブパラメーターが含まれる場合は、サブパラメーターに名前、caslibなどを指定できます。サブパラメーターが含まれない場合は、パラメーターに名前、caslibなどを指定できます。
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
分析のために保持する単語を含む入力 CAS テーブルを指定します。 | |
|
— |
分析から除外する単語を含む入力 CAS テーブルを指定します。 | |
|
required parametertable |
— |
入力テーブルの設定を指定します。 |
|
パラメーター |
サブパラメーター |
説明 |
|---|---|---|
|
— |
トピック分布を格納するインメモリテーブルを指定します。 | |
|
— |
文書のトピック比率を格納するインメモリテーブルを指定します。 |
パラメーターの説明
alpha=double
文書のトピック比率の Dirichlet ハイパーパラメーターを指定します。
| デフォルト | 0.1 |
|---|---|
| 最小値 (含まない) | 0 |
beta=double
トピック分布の Dirichlet ハイパーパラメーターを指定します。
| デフォルト | 0.1 |
|---|---|
| 最小値 (含まない) | 0 |
casOut=list(casouttable)
トピック分布を格納するインメモリテーブルを指定します。
casOut パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
| 別名 | topicDistOut |
|---|---|
| topicDist | |
| ldamodel |
docDistOut=list(casouttable)
文書のトピック比率を格納するインメモリテーブルを指定します。
docDistOut パラメーターの指定の詳細については、共通 casouttable (形式 1) パラメーターを参照してください。
| 別名 | topicPropOut |
|---|---|
| topicProp | |
| topicProportion | |
| docDist |
* docId="variable-name"
各文書の ID を含む入力テーブルの文字変数または数値変数を指定します。
| 別名 | docIdVar |
|---|
k=64-bit-integer
モデルで考慮するトピック数を指定します。
| 別名 | nTopic |
|---|---|
| numTopics | |
| numTopic | |
| デフォルト | 2 |
| 最小値 | 1 |
keepWords=list(castable)
分析のために保持する単語を含む入力 CAS テーブルを指定します。
keepWords パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。
| 別名 | startList |
|---|
likelihood=TRUE | FALSE
True に設定すると、尤度と条件付き尤度の両方が計算されます。
| デフォルト | FALSE |
|---|
meanEstimate=TRUE | FALSE
True に設定すると、トピック分布と文書のトピック比率の推定値は、すべての反復から Gibbs サンプルを平均して計算されます。デフォルトでは、推定値は最終反復でのみ Gibbs サンプルから計算されます。
| デフォルト | FALSE |
|---|
nBurnin=integer
Burn-In として考慮する Gibbs サンプリングの反復回数、または破棄する反復回数を指定します。これらの Burn-in 反復回数は、nIters パラメーターで指定された最大反復回数にはカウントされないことに注意してください。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
nIters=integer
最大反復回数を指定します。
| 別名 | nIter |
|---|---|
| maxIters | |
| デフォルト | 10 |
| 最小値 | 1 |
seed=double
乱数生成器のシードを指定します。デフォルトでは、乱数ストリームはコンピュータークロックに基づいています。負の値を指定すると、コンピュータークロックに基づいて乱数ストリームが生成されます。実行の間に再現可能な乱数シーケンスが必要な場合は、0 より大きい値を指定してください。
| デフォルト | 0 |
|---|---|
| 最小値 | 0 |
stopWords=list(castable)
分析から除外する単語を含む入力 CAS テーブルを指定します。
stopWords パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。
| 別名 | stopList |
|---|
* table=list(castable)
入力テーブルの設定を指定します。
table パラメーターの指定の詳細については、共通 castable (形式 1) パラメーターを参照してください。
* text=list( list(casinvardesc-1) <, list(casinvardesc-2), ...>)
モデルの学習に使用する入力テーブルのテキスト変数を指定します。
text パラメーターの指定の詳細については、共通 casinvardesc パラメーターを参照してください。
| 別名 | texts |
|---|---|
| input | |
| inputs |
tm=list(castm)
テキスト解析の設定を指定します。
| 長い形式 | tm=list(entities="NONE" | "STD") |
|---|---|
| 短い形式 | tm="NONE" | "STD" |
castm の値は次のいずれかになります:
binaryLocation="string"
言語バイナリファイルの場所を指定します。場所は有効でなければなりません。指定されていない場合は、デフォルトのインストール場所が使用されます。
| 別名 | taBinLoc |
|---|
entities="NONE" | "STD"
解析でエンティティを抽出するかどうかを指定します。None に設定すると、エンティティは出力されません。STD に設定すると、標準エンティティが出力されます。
| デフォルト | NONE |
|---|
language="ARABIC" | "CHINESE" | "CROATIAN" | "CZECH" | "DANISH" | "DUTCH" | "ENGLISH" | "FARSI" | "FINNISH" | "FRENCH" | "GERMAN" | "GREEK" | "HEBREW" | "HINDI" | "HUNGARIAN" | "INDONESIAN" | "ITALIAN" | "JAPANESE" | "KAZAKH" | "KOREAN" | "NORWEGIAN" | "POLISH" | "PORTUGUESE" | "ROMANIAN" | "RUSSIAN" | "SLOVAK" | "SLOVENE" | "SPANISH" | "SWEDISH" | "TAGALOG" | "THAI" | "TURKISH" | "VIETNAMESE"
入力文書テーブルのテキスト変数で使用される言語を指定します。
| デフォルト | ENGLISH |
|---|
nounGroups=TRUE | FALSE
True に設定すると、解析中に名詞グループが抽出されます。
| デフォルト | FALSE |
|---|
stemming=TRUE | FALSE
True に設定すると、解析中に語幹抽出が実行されます。
| デフォルト | FALSE |
|---|