在数据呈指数级增长的今天,大数据与 AI 的融合对底层计算性能提出了前所未有的挑战。当企业面临离线批处理耗时长、在线流处理吞吐低的痛点时,如何无需修改业务代码,就能榨干硬件的每一滴潜能?

图 | OmniRuntime Maintainer 尹伟杰

2026 年 8 月 15 日,在重庆举行的 CCF 中国开源大会(CCF ChinaOSC 2026)「AI 时代的开源基础软件技术」分论坛上,OmniRuntime Maintainer 尹伟杰带来了题为《OmniRuntime 基于鲲鹏的大数据开源最佳实践》的精彩分享。自 2025 年 9 月随鲲鹏 BoostKit 首批开源以来,OmniRuntime 正式走向学术与产业开源的核心舞台,交出了一份亮眼的成绩单。

OmniRuntime鲲鹏大数据加速底座

OmniRuntime 是面向鲲鹏 BoostKit 大数据场景的开源向量化加速套件。它采用插件化解耦形式,能够无缝对接 Spark、Flink、Hive 等主流大数据引擎,实现业务 SQL 零改造的高效加速。其中包含:

OmniOperator:C/C++ Native 算子 + OmniVec 列式内存 + 鲲鹏 SVE 向量化。

OmniStream:Flink SQL / DataStream Native 化 + UDF 自动翻译。

OmniStateStore:针对 Flink 状态后端进行深度优化。

性能加速效果:

在标准的鲲鹏 920 + openEuler 22.03 环境下。

离线批处理场景:开启 OmniOperator 后,端到端耗时从 128 分钟骤降至 76 分钟,整体提速 40.6%。在大表 Join、聚合类 SQL 等重负载场景下,提速甚至超过 55%,单特性平均提速在 30% 以上

在线流处理场景:在双流 Join、GroupAgg 等高并发业务中,系统吞吐量平均提升 30%

社区演进:全面进军 AI 与数据科学

站在开源的新起点上,OmniRuntime 的脚步并未停止。未来,项目团队将推出全新特性 OmniInfinity,全面赋能数据科学、大模型数据预处理和特征工程场景:

深度硬件适配:基于灵衢超节点优化 Ray 数据交换。

生态格式支持:实现 Lance-format 解码鲲鹏亲和优化,支持原生编解码。

海量向量检索:Lance 支持百亿级向量索引检索。

算子生态共建:优化 Daft 离线算子,与开源社区携手共建算子广场。

运行时演进:Python JIT 运行时持续迭代优化

Logo

鲲鹏昇腾开发者社区是面向全社会开放的“联接全球计算开发者,聚合华为+生态”的社区,内容涵盖鲲鹏、昇腾资源,帮助开发者快速获取所需的知识、经验、软件、工具、算力,支撑开发者易学、好用、成功,成为核心开发者。

更多推荐