logo 鲲鹏昇腾开发者社区

鲲鹏昇腾开发者社区
鲲鹏社区昇腾社区鲲鹏开发资源昇腾开发资源
去全站搜索看看?

登录社区云

登录社区云,与社区用户共同成长

鲲鹏昇腾开发者社区

邀请您加入社区

欢迎加入社区

欢迎加入社区

数据仓库
  • CMP (类ClouderaCDP7.3(404次编译) )华为鲲鹏Aarch64(ARM)信创环境 查询2100w行 hive 查询策略

    在 Hive 中,对于一个 2100 万行(21M)的聚合表,如果需要对 datetime 类型的非分区键字段进行 >= 和 <= 的范围查询,性能会显著依赖于数据组织方式和查询优化配置。CMP大数据平台(类Cloudera CDP7.3华为鲲鹏CPU)聚合表模型,表体量在 2100w 行,现在有个 datetime 类型的非 key 字段使用了≥和≤查询,使用hive查询策略。"orc.row.

    yumgpkpm
    2025-10-15 08:56:15
     1022 
     25 
    #hive#hadoop#数据仓库 +4
  • 【Big Data】Apache Flink 分布式计算框架的崛起

    在大数据处理领域,实时性与准确性的平衡始终是技术突破的核心方向。Apache Flink 作为当前最受关注的分布式计算框架之一,以 “流批一体” 的设计理念重新定义了大数据处理的范式。本文将从技术本质出发,系统解析 Flink 的诞生背景、架构设计、核心能力及实践方法,帮助技术开发人员全面掌握这一高性能计算框架。

    愚者Turbo
    2025-08-15 17:36:14
     1002 
     18 
    #flink#java#spark +4
没有更多了
回到
顶部
logo 提供社区服务与技术支持
logo 提供社区服务与技术支持
©1999-2023北京创新乐知网络技术有限公司 京ICP备19004658号