登录社区云,与社区用户共同成长
邀请您加入社区
昇思大模型提示学习的多样性,是 OrangePi Alpro 实现边缘轻量化大模型落地的关键技术。通过指令、格式、少样本、推理控制四大类多样化设计,无需模型微调即可适配问答、分类、摘要、故障检测等多场景任务。结合鲲鹏 ARM64 硬件加速与 INT8 量化,在低功耗、轻资源条件下实现稳定高效推理,真正做到一模型多用、低成本部署。
在昇腾环境中,我使用 AISBench 通过 OpenAI-compatible vLLM API,对 Qwen3.6-35B-A3B 模型进行能力评测。在完成 BoolQ 和 GSM8K 后,mentor 希望进一步评价模型在中文金融、经济和法律专业知识方面的表现,因此从 CEval 中选择了六个相关子任务:六科验证集共计 233 道单项选择题,评价指标为 Accuracy。3. CEval 数
基础准备(1-2周):掌握PyTorch和Attention基础原理入门(2-3周):理解FlashAttention原理,复现V1代码实战(3-4周):掌握Ops-Transformer,在昇腾NPU上部署性能调优(2-3周):学会性能分析,速度提升50%社区贡献(持续):提交PR,成为Contributor总时长:10-12周(每天2-3小时)学习资源论文:FlashAttention系列(V
平台发布者支持语言易用性大规模训练能力定位PyTorchFacebookPython/C++★★★★优秀学术研究首选TensorFlowGoogle★★★优秀工业部署广泛KerasGooglePython★★★★★一般入门友好百度Python★★★良好中文生态完善MindSpore华为Python★★★良好昇腾硬件适配目前PyTorch因其动态图机制和易用性,已成为学术界的主流选择,约80%的研究