登录社区云,与社区用户共同成长
邀请您加入社区
本文探讨了端侧图像AI的核心技术与落地实践。首先指出图像AI是移动端最高频的应用场景,因其本地处理、低延时等特点适合端侧部署。关键技术包括:1)构建多模型协同的实时视觉推理管线,实现预处理共享与并行计算;2)设计模块化模型管道,支持检测-分类-OCR等能力灵活组合;3)优化结果渲染机制确保低延迟叠加。实战部分展示了CameraKit取帧、多模型并行推理、拍照翻译全流程等典型场景,并提供了性能优化方
本文梳理 2026 年 7 月上旬全球 AI 领域最新重磅资讯,从国内 AI 智能体合规新政、海内外大模型迭代、雷达视觉多模态融合技术突破、国产算力生态升级四大维度展开深度解读。结合雷达、嵌入式、机载视觉开发者工程落地视角,分析 C 端拟人智能体监管限制、轻量化开源模型替代趋势、CVPR26 最新 4D 雷达检测框架、昇腾国产算力适配方案等核心内容,并针对军工雷达、无人机感知项目给出合规、算力选型
本文主要介绍目前小模型领域的服务化情况和Triton Inference Server方案,这也是目前昇腾在小模型服务化的主打方案,并详细介绍三条路径,Python backend、GE custom backend和ONNX-RUNTIME backend子方案。
YOLO26的边缘部署,本质是在约束条件下寻找最优解。没有万能配置,只有适合当前硬件和业务需求的权衡。建议新手先从NUC或普通PC+iGPU起步,跑通全流程后再迁移到专用AI芯片。每一步都保留中间产物和日志,出问题才能快速回溯。如果你正在适配其他硬件(如昇腾、寒武纪),或在量化过程中遇到精度崩塌,欢迎评论区留言。下期可以聊聊如何用OpenVINO的Model Optimizer自定义层替换,解决Y
在将多模态OCR业务从GPU迁移至昇腾NPU的过程中,由于硬件架构的差异,原有推理链路在性能和资源管理方面出现了新的瓶颈。本文基于一套五层架构的文档解析系统,详细记录了在昇腾NPU环境下的性能调优过程,涵盖推理调用结构重组、并发模型重构以及底层内存分配策略调整。通过一系列优化,最终在单卡单进程场景下实现了显著的性能提升和资源优化。该文档解析系统采用流水线架构,核心功能是对PDF或图片进行版面分析,
本实践完成了基于“HarmonyOS + MindSpore Lite + YOLO”的端侧目标检测初步验证,跑通了模型加载、数据处理到 UI 渲染的完整基础链路。项目源码及转换后的yolo26n.msAiyc-02/YOLO-HarmonyOS-Vision: 基于 ArkTS 与 MindSpore Lite 的鸿蒙端侧 YOLO 目标检测引擎。
SpireCV-Pro 是一个专为智能无人系统、移动机器人和边缘 AI 设备打造的实时感知开发平台。它不是单纯把算法模型封装成 SDK,而是把相机、视频流、激光雷达、目标检测、分割、跟踪、吊舱控制、结果可视化、视频保存、推流、ROS2 转发、评估与数据迭代等能力,拆解成可以多平台(工作站、NX、瑞芯微、昇腾)自由组合的节点,让开发者像搭积木一样构建自己的感知工作流。。
自动驾驶感知中的激光雷达点云高效处理方案 该方案针对自动驾驶系统中激光雷达每秒产生150万个点云数据的实时处理挑战,提出了一种基于NPU加速的二维BEV投影方法: 问题背景:传统CPU逐点处理(O(N log N))无法满足30ms规划周期的实时性要求,单帧处理时间超过200ms。 核心思路: 将三维点云投影到二维BEV俯视图 通过2D卷积网络进行目标检测 计算复杂度从O(N²)降低到O(H×W)
之前做数值计算,一直用NumPy在CPU上跑。数据量一大,CPU就扛不住了。后来发现asnumpy这个库,让NumPy的API直接在昇腾NPU上跑,速度快了10倍不止。这篇文章就来讲讲这个库的使用方法。
本文介绍了在昇腾NPU上使用ops-cv算子库优化YOLOv8目标检测后处理流程的方法。重点分析了NMS、ROIAlign和BboxTransform三个关键算子的作用及实现难点,并提供了完整的YOLOv8后处理代码示例。通过将后处理算子迁移到NPU执行,可显著降低30%的CPU处理延迟至5%以下。文章还介绍了DVPP硬件预处理模块的使用方法,展示了从图像输入到最终检测结果的完整NPU加速流程。
2025年计算机毕业设计项目精选推荐,涵盖人工智能、大数据、物联网等前沿技术方向。项目选题新颖实用,包括基于深度学习的工业缺陷检测、智能农业病虫害识别、金融风控系统等热门领域。提供SpringBoot、Vue、Python等多种技术栈选择,配套开题报告、论文辅导、代码讲解等全方位服务。精选项目如基于XGBoost的电商退货预测系统、OpenVINO工业检测系统等,难度分级明确(⭐⭐⭐⭐⭐)。同时推
本文介绍了2025年计算机专业毕业设计项目资源,涵盖SpringBoot、Vue、Python等主流技术方向。提供500+精品选题案例,包括基于深度学习的智能物流系统、图神经网络的工业优化系统等前沿课题。内容包含开题报告、代码实现、论文辅导等全流程服务,特别推荐人工智能、鸿蒙系统等热门方向选题。适合计算机专业学生获取毕设灵感与技术指导,包含源码数据库等完整资源支持。
YOLO-CT 轻量级框架凭借其独特的设计和优化策略,在肺结节检测领域展现出显著的技术优势。其高效特征提取模块融合 ResNet、FPN 和 DCNv2,能够在复杂的肺部 CT 图像中精准捕捉肺结节的关键特征,为检测任务提供了坚实的基础。通过骨干网改进和头部精简等轻量化优化策略,成功降低了模型的参数规模和计算复杂度,实现了在医疗边缘设备上的高效运行。
本文介绍ATC工具使用,yolo26模型转换,模型移植,以及模型MAP计算方法,最终验证om模型精度与原始模型pt精度误差达到千分之一
测试基于Atlas 300I Duo的单310P3核心,实现了10路1080p视频的YOLOv8n实时检测,核心处理流程包含14个关键步骤,覆盖拉流、解码、推理、可视化到推流全链路。开发时需重点关注昇腾Device/Context管理及DVPP V2接口的使用规范,可参考官方Demo快速落地。
在深度学习科研与工程落地中,MindSpore内置的算子和损失函数虽然丰富,但往往无法满足特定场景下的定制化需求。本文将抛弃高阶封装接口,带你深入MindSpore底层,通过代码实战演示如何编写自定义损失函数,并利用MindSpore独特的函数式自动微分接口(Functional AutoDiff)构建高效的训练单步(TrainStep),以此释放昇腾NPU的极致性能。
昇思MindSpore技术分享大会圆满落幕,2025年将升级推出"干货小卖部"活动。本文详细介绍了基于昇腾800TA2服务器和MindSpore动态图方案的Qwen2.5-7B模型全量微调实践,包括环境配置、数据集转换、分布式训练等关键步骤。通过混合精度训练和4卡并行,实现了486 tokens/sec的高效训练,显存占用仅38GB。最终微调后的模型在Alpaca评估中表现优异
本文详细介绍了在昇腾平台上进行Qwen3-8B大模型预训练的完整实践方案。硬件采用2台昇腾800T A2服务器(8张910B芯片),软件环境配置了CANN8.3、MindSpore和MindSpeed-Core-MS工具链。关键步骤包括:预训练数据转换(将Enwiki数据转换为16个parquet分片)、多机多卡分布式训练配置(TP=4、PP=2的混合并行策略)以及分布式优化器的实现。实践结果显示
本文介绍了基于昇腾910B芯片和MindSpore框架的大语言模型高效推理部署方案。重点阐述了Qwen2.5-7B和Qwen3-8B模型在昇腾800T A2服务器上的推理优化流程,包括硬件配置、软件环境搭建、模型转换与优化、单卡/多卡推理测试以及多场景评估。通过TensorRT加速、算子融合等技术,实现了吞吐量提升35%、延迟降低28%的优化效果,同时保持99.5%的推理一致性。该方案为开发者提供
本文以华为MindSpore框架为核心,详细介绍了在昇腾910 NPU上实现YOLOv5目标检测模型的全流程开发。内容涵盖环境搭建、数据预处理、模型训练与优化、推理部署等关键环节,通过实际案例展示了国产AI框架的性能优势(单帧推理延迟32ms,mAP@0.5达96.1%)。特别强调了MindSpore原生支持昇腾芯片的特性,以及混合精度训练、模型转换等实用技巧,为开发者提供了在国产化AI生态中构建
本文提供计算机专业毕业设计选题与技术方案推荐,涵盖AI、小程序、数据分析等多个领域。内容包括:1)博主介绍与专业服务;2)各类系统案例展示(数据分析、微信小程序、AI系统等);3)最新本科毕设选题推荐,包含20+前沿项目,如AI代码注释生成器、智能城市环境监控系统、在线心理咨询小程序等,详细说明技术栈、创新点和开发难度。适合计算机专业学生获取毕设灵感与技术支持,涉及SpringBoot、Vue、T