CSVファイルからテキストを前処理することを計画しています。Azure MachineLearningStudioのデフォルトのストップワードリストを読み込みます。
次の要件を満たすように、前処理テキストモジュールを構成する必要があります。
*単一の標準形からの複数の関連する単語を確認してください。
*テキストからパイプ文字を削除します。
*情報検索を最適化するために単語を削除します。
どの3つのオプションを選択する必要がありますか?回答するには、回答エリアで適切なオプションを選択してください。
注:正しい選択はそれぞれ1ポイントの価値があります。

正解:

Explanation:
ボックス1:ストップワードを削除する
単語を削除して、情報検索を最適化します。
ストップワードの削除:事前定義されたストップワードリストをテキスト列に適用する場合は、このオプションを選択します。ストップワードの削除は、他のプロセスの前に実行されます。
ボックス2:レマタイゼーション
単一の標準形からの複数の関連する単語を確認してください。
Lemmatizationは、複数の関連する単語を単一の標準形に変換します。ボックス3:特殊文字を削除する特殊文字を削除する:このオプションを使用して、英数字以外の特殊文字をパイプに置き換えます。キャラクター。
参照:
https://docs.microsoft.com/en-us/azure/machine-learning/studio-module-reference/preprocess-text