Apache Calcite - 使用内置函数

news/2024/9/22 18:06:28/

前言

在上一篇文章中学习了如何适配来源数据,并使用sql查询数据。当我们获取数据后,通常还会进行各种计算、变换工作,这时使用内置函数可以极大提高我们的效率。

函数介绍

Apache Calcite 提供了广泛的 SQL 函数支持,包括但不限于标准的 SQL 函数(如聚合函数、数学函数、字符串函数等)以及一些 Calcite 特有的扩展函数。这些函数可以在 SQL 查询中使用,以执行复杂的数据处理和分析任务。详细的介绍可以参考[1]。

下面是对参考手册中函数的分类介绍

  • 聚合函数:如 COUNT, SUM, AVG, MIN, MAX 等。
  • 数学函数:如 ABS, EXP, LOG, POWER, SQRT, SIN, COS 等。
  • 字符串函数:如 CONCAT, LENGTH, UPPER, LOWER, TRIM, SUBSTRING 等。
  • 日期和时间函数:如 CURRENT_DATE, CURRENT_TIME 等。
  • 转换函数:如 CAST, COALESCE, NULLIF, CASE 等。
  • 系统函数:如 USER, CURRENT_USER, SESSION_USER, SYSTEM_USER 等。
  • 窗口函数:如 ROW_NUMBER, RANK, DENSE_RANK, LEAD, LAG 等。

在代码中使用函数

我们可以直接在sql中使用这些函数,首先我们对上一篇文章中的代码进行一点小改动。

Linq4j

在进行改动前首先我们介绍一下Linq4j。Apache Calcite 的 Linq4j(Language-Integrated Query for Java)是一个提供类似于.NET LINQ(Language Integrated Query)的查询功能的库,专为Java语言设计。Linq4j 允许开发者使用Java来编写类似于SQL的查询语句,从而对Java集合、数组等进行查询操作。

Linq4j 是一个查询库,它提供了一组扩展的Java集合接口和迭代器接口,使得开发者可以在Java应用程序中使用声明式的方式来处理数据。它支持多种操作,包括筛选(filter)、映射(map)、聚合(aggregate)等,类似于SQL语言的操作。

我们使用Linq4j类提供的工具方法来将我们的来源数据列表转换为Enumerable对象,这样在查询Sql中可以使用相关的函数。

下面是一个使用案例,我们首先将用户列表转换为Enumerable类型,然后使用where方法来筛选年龄大于30的用户,接着使用orderBy方法按姓名排序,最后将结果转换为列表并打印。

这样的处理方式使得数据操作更加直观和易于理解,类似于我们在SQL中进行查询操作。

import org.apache.calcite.linq4j.Enumerable;
import org.apache.calcite.linq4j.Linq4j;List<User> users = Arrays.asList(new User("Alice", 28),new User("Bob", 35),new User("Charlie", 32)
);Enumerable<User> enumerable = Linq4j.asEnumerable(users);
List<User> filteredSortedUsers = enumerable.where(user -> user.getAge() > 30).orderBy(user -> user.getName()).toList();filteredSortedUsers.forEach(user -> System.out.println(user.getName() + " - " + user.getAge()));

改造代码

我们使用linq4j改造来源集合的创建,重新实现scan方法,这样可以在sql中使用相关的函数。

    public class TableForList extends AbstractTable implements ScannableTable{private PersonList personList;public TableForList(PersonList personList) {this.personList = personList;}@Overridepublic Enumerable<Object[]> scan(DataContext root) {return Linq4j.asEnumerable(personList.getPersonList()).select(emp -> new Object[]{emp.getId(), emp.getName(), emp.getAge()});}@Overridepublic RelDataType getRowType(RelDataTypeFactory typeFactory) {return typeFactory.builder().add("id", typeFactory.createSqlType(SqlTypeName.BIGINT)).add("name",typeFactory.createSqlType(SqlTypeName.VARCHAR)).add("age",typeFactory.createSqlType(SqlTypeName.INTEGER)).build();}}

sql中使用函数

我们对上一篇文章中的Sql做出调整,使用各类函数。

        // 聚合函数ResultSet countResult = statement.executeQuery("select sum(age) from listSchema.MyTable");print(countResult);// 数学函数ResultSet sqrtResult = statement.executeQuery("select sqrt(sum(age)) from listSchema.MyTable");print(sqrtResult);// 字符串函数ResultSet lowerResult = statement.executeQuery("select lower('ABC'),sum(age) from listSchema.MyTable");print(lowerResult);// 日期函数ResultSet timeResult = statement.executeQuery("select current_time,sum(age) from listSchema.MyTable");print(timeResult);// 输出结果
242 
15.556349186104045 
abc 242 
20:14:51 242 

总结

Calcite提供了多种内置函数,使用这些函数可以简化我们的开发工作,提升效率

参考

[1]Calcite内置支持的函数清单,https://calcite.apache.org/docs/reference.html


http://www.ppmy.cn/news/1467388.html

相关文章

C++面试题其三

继续解答常见的C面试题 继续上篇博客的解答&#xff0c;我们将进一步探讨C中的一些关键概念和常见面试问题。 29. typedef和define的区别 typedef&#xff1a;用于为现有类型定义一个新的名字。typedef是编译时的操作&#xff0c;它提供了类型别名&#xff0c;可以提高代码可…

Java基础27,28(多线程,ThreadMethod ,线程安全问题,线程状态,线程池)

目录 一、多线程 1. 概述 2. 进程与线程 2.1 程序 2.2 进程 2.3 线程 2.4 进程与线程的区别 3. 线程基本概念 4.并发与并行 5. 线程的创建方式 方式一&#xff1a;继承Thread类 方式二&#xff1a;实现Runable接口 方式三&#xff1a;实现Callable接口 方式四&…

微信小程序-页面导航-导航传参

1.声明式导航传参 navigator组件的url属性用来指定将要跳转到的页面的路径&#xff0c;同时&#xff0c;路径的后面还可以携带参数&#xff1a; &#xff08;1&#xff09;参数与路径之间使用 ? 分割 &#xff08;2&#xff09;参数键与参数值用 相连 &#xff08;3&…

Spring Security 注册过滤器关键点与最佳实践

在 Spring Security 框架中&#xff0c;注册过滤器是实现身份验证和授权的关键组件。正确配置和使用注册过滤器对于确保应用程序的安全性至关重要。以下是一些关于 Spring Security 注册过滤器的注意事项和最佳实践。 过滤器链顺序&#xff1a; 注册过滤器通常位于过滤器链的末…

【学习笔记】Axios、Promise

TypeScript 1、Axios 1.1、概述 1.2、axios 的基本使用 1.3、axios 的请求方式及对应的 API 1.4、axios 请求的响应结果结构 1.5、axios 常用配置选项 1.6、axios.create() 1.7、拦截器 1.8、取消请求2、Promise 2.1、封装 fs 读…

引领采购数字化变革,商越科技如何帮企业穿越周期?

导读 在企业“降本增效”的路上&#xff0c;采购数字化已经站上C位。采购数字化对企业究竟带来哪些价值&#xff1f; 在中国采购数字化赛道&#xff0c;行业领军者已经出现。 正文 面对经济环境的不确定性&#xff0c;企业都在寻找能够穿越周期的确定性。 “在经济不确定的大…

Kotlin 嵌套类和内部类

文章目录 嵌套类内部类 嵌套类 在类的内部可以定义其他的类&#xff0c;这是类结构上的嵌套&#xff08;Nested&#xff09;。 class Container {val name "Container"class NestedClass {fun getter() {// 此时无法访问外部类的成员// name}} }Note&#xff1a;接…

华为交换机、路由器配置查询、用户界面常见配置及安全加固

华为交换机、路由器配置查询、用户界面常见配置及安全加固。 一、查询命令 1.常用的查询命令 查看当前生效的配置信息&#xff1a; display current-configuration //正在生效的配置&#xff0c;默认参数不显示。查看当前视图下生效的配置信息&#xff1a; display this //常…