Lakehouse1 という名前のレイクハウスを含む Fabric テナントがあります。Lakehouse1 には Nyctaxi_raw という名前のテーブルが含まれています。Nyctaxi_raw には次の列が含まれています。

Fabric ノートブックを作成し、lakehouse1 に添付します。
データを変換するにはPySparkコードを使用する必要があります。ソリューションは以下の要件を満たす必要があります。
* pickupDateTime の日付部分のみを含む pickupDate という名前の列を追加します。
* DataFrame をフィルタリングして、fareAmount が 100 未満の正の数値である行のみを含めます。
コードをどのように完成させるべきでしょうか?回答するには、回答エリアで適切なオプションを選択してください。注意:
正しい選択ごとに 1 ポイントが与えられます。

正解:

Explanation:

* pickupDate 列を追加します: .withColumn("pickupDate", df["pickupDateTime"].cast("date"))
* DataFrame をフィルタリングします: .filter("fareAmount > 0 AND fareAmount < 100")
PySparkでは、.withColumnメソッドを使ってDataFrameに新しい列を追加できます。最初の引数は新しい列名、2番目の引数は新しい列の内容を生成する式です。ここでは、.cast("date")関数を使ってタイムスタンプから日付部分のみを抽出しています。DataFrameをフィルタリングするには、.filterメソッドを使って、fareAmountが0より大きく100より小さい行を選択する条件を指定します。これにより、100未満の正の値のみが含まれるようになります。