登录社区云,与社区用户共同成长
邀请您加入社区
鲲鹏昇腾开发者社区是面向全社会开放的“联接全球计算开发者,聚合华为+生态”的社区,内容涵盖鲲鹏、昇腾资源,帮助开发者快速获取所需的知识、经验、软件、工具、算力,支撑开发者易学、好用、成功,成为核心开发者。
更多推荐
MindSpore Transformers 大语言模型高效预训练与微调实战:分布式并行与显存优化
本文介绍MindSpore Transformers如何解决大语言模型(LLM)训练中的算力与显存瓶颈。通过自动并行、3D并行策略及混合精度、重计算等显存优化技术,实现千亿参数模型高效分布式训练。框架提供统一接口,支持预训练与微调无缝切换,并基于昇腾AI处理器实现单卡训练13B模型、8卡线性加速比达0.97,显著提升训练效率与稳定性。
MindSpore Transformers LLM 预训练模型:高效训练
MindSpore Transformers为昇腾NPU提供原生大模型预训练方案,通过静态图编译、自动并行、混合精度与重计算技术,实现7B~13B模型高效训练。支持单机多卡及多机扩展,显存降低60%以上,训练速度提升2~4倍。结合异步数据流水线与优化配置,显著提升吞吐与稳定性,无需复杂改造即可开箱即用,全面释放昇腾硬件性能。
昇腾平台 RAG SDK 检索前优化技术原理与实战:索引结构优化
昇腾RAG SDK通过智能语义分块、多表征索引、分层架构与NPU原生加速,实现检索精度提升30%、构建速度提升8倍、存储成本降低60%。其四层优化架构深度融合算法与硬件,支持百万级文档毫秒级检索,显著解决大模型幻觉、知识滞后等落地难题,为行业提供高效、低成本的知识增强方案。
扫一扫分享内容
为遵守国家网络实名制规定,未绑定将限制内容发布与互动
所有评论(0)