Spark connector 版本发布
发布说明
使用文档:
源码下载地址:starrocks-connector-for-apache-spark
JAR 包命名规则:starrocks-spark-connector-${spark_version}_${scala_version}-${connector_version}.jar
JAR 包获取方式:
您可以通过以下方式获取 Spark connector 的 JAR 包:
- 从 Maven Central Repository 直接下载编译好的 JAR 包。
- 在 Maven 项目的 pom 文件添加 Spark connector 为依赖项,作为依赖下载。具体方式,参见使用文档。
- 使用源码手动编译成 JAR 包。具体方式,参见使用文档。
版本要求:
| Spark connector | Spark | StarRocks | Java | Scala |
|---|---|---|---|---|
| 1.1.4 | 4.0, 4.1 | 2.5 及以上 | 17 | 2.13 |
| 1.1.4 | 3.3, 3.4, 3.5 | 2.5 及以上 | 8 | 2.12 |
| 1.1.3 | 3.2, 3.3, 3.4, 3.5 | 2.5 及以上 | 8 | 2.12 |
| 1.1.2 | 3.2, 3.3, 3.4, 3.5 | 2.5 及以上 | 8 | 2.12 |
| 1.1.1 | 3.2, 3.3, or 3.4 | 2.5 及以上 | 8 | 2.12 |
| 1.1.0 | 3.2, 3.3, or 3.4 | 2.5 及以上 | 8 | 2.12 |
发布记录
1.1
1.1.4
该版本主要包含一些新特性和改进。
新增特性
- 新增对 StarRocks catalog 的支持。#109
- 新增对
bitmap_hash64的支持。#130 - 支持嵌套字段(Struct、Array 和 Map)。#152
- 支持通过 Spark catalog 进行数据读写。#140
- 支持 Spark 4.0 和 Scala 2.13。#154
功能优化
- 新增安全策略。#139
问题修复
- 修复 DataSource V2 中的过滤器下推错误。#141
1.1.3
该版本主要包含一些新特性和改进。
新增特性
- Sink 支持 LZ4 压缩算法。#110
功能优化
问题修复
- 修复了由于列名使用关键字导致的解析错误。(修复后,BuildScan 中会为列名添加引号。)#103
- 修复了由于
java.lang.String不是 DATE/TIMESTAMP 类型的有效外部类型而引发的异常。#111 - 修复了 JSON 类型写入错误的问题。#115
1.1.2
新增特性
- 支持 Spark 的版本为 3.5。#89
- 通过 Spark SQL 读取 StarRocks 时支持
starrocks.filter.query参数。#92 - 支持读取 StarRocks 中 JSON 类型的列。#100
功能优化
- 优化报错信息。读取 StarRocks 时如果在
starrocks.columns指定 StarRocks 表中不存在的列,则报错信息会明确提示不存在的列名。#97 - Spark connector 通过 HTTP 向 StarRocks 的 FE 请求查询计划时出现异常的时候,FE 会把异常信息通过 HTTP 本身的 status 和 entity 返回给 Spark connector。#98