登录社区云,与社区用户共同成长
邀请您加入社区
国产大模型迎来重大开源进展:华为正式开源盘古大模型系列,包括720亿参数的ProMoE-72B模型、昇腾推理系统和7B嵌入式模型,在昇腾硬件上实现高性能推理(最高1528 tokens/s)。百度同期开源23款ERNIE 4.5系列模型,涵盖0.3B-47B不同规模,包含MoE架构和多模态模型。当前国产大模型生态呈现华为全栈自主(硬件+模型+引擎)与互联网厂商技术开源并行的格局,在英伟达芯片受限背
大语言模型技术迅猛发展的脚步,正引领着信息检索技术进入一个新的纪元。在这一领域中, RAG技术将传统信息检索技术与大语言模型技术相结合,为知识理解、知识获取提供了全新的解决方案。然而,尽管 RAG 在很多任务上表现出色,其在深度应用上仍面临诸多挑战。在日前的 InfoQ 《极客有约》X AICon 直播中,我们邀请到了阿里巴巴总监 & TGO 鲲鹏会学员阿里云高级算法专家、英飞流 CEO、合合信息
华为开源两款大模型:盘古ProMoE72B和盘古Embedded7B。盘古ProMoE72B采用创新的MoGE架构,在昇腾NPU上实现了高效训练和推理,性能超越主流开源模型;盘古Embedded7B具备"快慢思考"双系统,可自动切换响应模式,在复杂任务中表现优异。两款模型均针对昇腾平台优化,提供模型权重和推理代码开源下载,展现华为在大模型领域的技术突破。此举将推动大模型开源生态
本文用到的数据集为 LLaMA-Factory 自带的 identity 和 alpaca_en_demo,对 identity 数据集进行如下全局替换即可实现定制指令:{{name}} 替换为 Ascend-helper{{author}} 替换为 Ascend更多自定义数据集的构建请参考官方数据集构造指引(https://github.com/hiyouga/LLaMA-Factory/blo
大语言模型技术迅猛发展的脚步,正引领着信息检索技术进入一个新的纪元。在这一领域中, RAG 技术将传统信息检索技术与大语言模型技术相结合,为知识理解、知识获取提供了全新的解决方案。然而,尽管 RAG 在很多任务上表现出色,其在深度应用上仍面临诸多挑战。在日前的 InfoQ 《极客有约》X AICon 直播中,我们邀请到了阿里巴巴总监 & TGO 鲲鹏会学员阿里云高级算法专家、英飞流 CEO、合合信
所谓自定义模型就是不适用Ollama官方模型库中的模型,理论可以使用其他各类经过转换处理的模型Ollama库中的模型可以通过提示进行自定义。# 设置温度参数# 设置SYSTEM 消息SYSTEM """作为AI智能助手,你将竭尽所能为员工提供严谨和有帮助的答复。"""Modelfile文档One-API是一个OpenAI接口管理 & 分发系统,支持各类大模型。这里使用Docker快速进行部署。拉取
本文通过费曼学习法分享线性回归这一机器学习基础算法,从数学原理到代码实现全面讲解。内容包括手搓线性回归和使用PyTorch框架两种实现方式,涵盖数据准备、模型定义、损失函数、优化器选择及训练过程。线性回归作为麻雀虽小五脏俱全的模型,包含了深度学习模型训练的全部流程,是理解大模型原理不可或缺的基础知识,适合初学者收藏学习。