
Explanation:

包括的かつ詳細な説明
事例研究より:
Productline2の研究部門データは現在、storage2にCSV形式で保存されています。
要件:「レイクハウス内の研究部門のすべてのデータは、レイクハウスエクスプローラーで管理テーブルとして表示される必要があります。」ファブリックのレイクハウスでは、管理テーブルはTablesフォルダー内にDelta形式で保存されます。
ステップ1:情報源を読む
df = spark.read.format("csv") \
options(header="true", inferSchema="true") \
load("abfss://storage1.dfs.core.windows.net/files/productline2")
これは、ADLS Gen2 から CSV ソースを正しく取り込みます。
ステップ2:管理テーブルとしてLakehouseに書き込む
データがレイクハウス内で照会および管理できるようにするには、データをデルタ形式で書き込む必要があります。
正しいパスは Tables/ の下です。なぜなら、Fabric が Lakehouse で管理するテーブルを自動的に管理するのはこの場所だからです。
対象テーブルの名前はproductline2にする必要があるため、正しいパスは次のとおりです。
df.write.mode("overwrite").format("delta").save("Tables/productline2")
他の選択肢はどうでしょうか?
CSV形式やParquet形式では、管理対象のLakehouseテーブルは作成されず、単にファイルが作成されます。
productline2に直接書き込む場合(Tables/を指定しない場合)、管理対象テーブルではなく、管理対象外ファイルがLakehouse Files領域に保存されます。
Tables/research/productline2 に書き込むと、不要なサブディレクトリが追加され、管理対象テーブルの標準的な構造ではありません。
正しい最終コード
df.write.mode("overwrite").format("delta").save("Tables/productline2")
参考文献
Microsoft Fabric Lakehouse の管理対象テーブル
FabricにおけるDelta Lakeのサポート
SparkはLakehouseに手紙を書く