Skip to content

Latest commit

 

History

History
28 lines (20 loc) · 1.41 KB

File metadata and controls

28 lines (20 loc) · 1.41 KB
description Apache Spark Data Connector Documentation

Spark Data Connector

Apache Spark as a connector for federated SQL query against a Spark Cluster using Spark Connect

datasets:
  - from: spark:spiceai.datasets.my_awesome_table
    name: my_table
    params:
      spark_remote: sc://my-spark-endpoint

{% hint style="info" %} Unquoted identifiers are normalized to lowercase. To reference a table with mixed-case characters, wrap each case-sensitive part in double quotes: spark:my_catalog."MySchema"."MyTable". See Identifier Case Sensitivity. {% endhint %}

Configuration

Limitations

  • Correlated scalar subqueries are only supported in filters, aggregations, projections, and UPDATE/MERGE/DELETE commands. Spark Docs
  • The Spark connector does not yet support streaming query results from Spark.