登录社区云,与社区用户共同成长
邀请您加入社区
今年写了100多个软件,从Windows到鸿蒙,却没写过一行代码。当不懂编程的人也开始用AI写软件,人类还会写代码吗?直到那个AI搞不定的C++难题出现,我才想明白:AI能替你写代码,但不能替你理解代码。
我们推出 openPangu-2.0,包括两个主要架构版本:拥有 505B 参数、激活参数 18B 的,以及拥有 92B 参数、激活参数 6B 的。此外,我们还推出了一个面向资源受限场景执行的优化端侧模型,总参数量为 30B,激活参数量为 2B。为了最大化智能体能力与系统级效率,我们建立了一套严格的软硬件协同设计方法,将算法创新与昇腾原生基础设施紧密耦合。
本文对比分析了5款主流跨境电商图片本地化工具的技术架构与性能表现。测试集包含100张涵盖多种场景的图片,评估文字检测、翻译准确度、背景修复等核心指标。结果显示,端到端自研架构的工具(如妙言小智)在复杂场景下的综合表现最优,CAR达95.6%;集成型工具开发门槛低但效果有限。针对不同应用场景给出选型建议:跨境电商主图推荐端到端方案,企业级集成可选阿里云API,简单需求可用通用工具。文章强调电商场景需
在FrontierSWE、Terminal-Bench等代码和长程任务权威基准上,GLM-5.2与国际顶尖模型Claude Opus 4.8的差距收窄至1%–4%。值得关注的是,GLM-5.2的线上推理已在Day 0完成与华为昇腾、平头哥、摩尔线程、寒武纪、昆仑芯、沐曦、海光、壁仞等国产算力平台的全适配。近日,智谱正式上线并开源新一代旗舰模型GLM-5.2。资本市场迅速给出回应。6月22日,港股上
华为云 MaaS(ModelArts as a Service)是一站式 AI 开发平台。它提供了从模型训练、量化、到部署的全链路服务。昇腾 NPU 原生适配:DeepSeek 模型经过深度优化,在昇腾 910B 上运行效率接近 A100自动并行:自动将模型切分到多卡/多节点弹性伸缩:根据负载自动扩缩容推理实例本文从 DeepSeek 模型推理的底层原理出发,详细介绍了从量化压缩到高效部署的全链路
硬件门槛超低,1G 显存显卡就能跑大模型,AMD / 苹果硅 / 昇腾都兼容,无显卡也能 CPU 运行。Windows/macOS/Linux 全覆盖,便携包、一键 cli、云端三种部署方式任选。支持 SDXL、Flux、混元视频、3D 混元等海量模型,ControlNet、LoRA、局部重绘、分区提示词、高清放大功能全都内置。工作流存 JSON,图片也能保存完整参数,还能把复杂流程封装成简易界面
最近在做一些鸿蒙应用时,我想到一个问题。从设计稿到鸿蒙页面代码这个过程中,有多少前期工作可以交给AI完成?以前的协作流程其实很固定,中途需求调整,就要重新修改设计稿、重新同步开发、重新适配。尤其是电商类项目,首页、商品详情页、购物车、个人中心、订单列表,各种列表和卡片组件非常多。很多开发时间其实并不是花在业务逻辑上,反而是。。
本文介绍了PyTorch在昇腾NPU上的优化策略,重点解决非连续张量操作带来的性能问题。通过ops-tensor仓实现了三类张量操作的优化:切片/索引、形状变换和广播/拼接。针对gather算子提出索引预排序和批量读取方案,利用UB内存减少HBM访问。同时分析了reshape与view的区别,建议避免不必要的contiguous操作。还介绍了Blaze后端的JIT编译优化,通过预编译和缓存机制处理
它被设计成一个锁定的操作系统,只能运行来自Windows Store的应用,无法安装使用标准Windows安装程序交付的第三方应用或驱动程序。如果我是某中心的产品经理,我会把它叫做Microsoft 365 Pro,并且我会加入大量的Copilot令牌积分,以证明为该套餐贴上每月10美元甚至20美元的价格标签是合理的。显而易见的选择是Windows 12,但某中心有着用“改变游戏规则”的版本颠覆棋
本文将深入CANN仓库的`federated/`、`edge/`模块源码、模型切分器与协同调度器,首次系统性解构其如何通过**跨层级模型表示、动态切分策略引擎、带宽感知任务路由与上下文一致性保障**四大机制,在昇腾AI软件栈中构建“端边云一体”的智能网络,并探讨这一能力对普惠AIGC的战略意义。
摘要:华为CANN架构中的ops-nn算子库为AIGC应用提供高性能算子支持,通过开源共建模式实现深度优化。该库采用分层设计,涵盖神经网络算子开发全流程,支持Tiling策略和流水线并行编程。以FlashAttention算子为例,通过分块计算和在线softmax技术,显著提升大模型推理效率。ops-nn在昇腾AI处理器上实现了算子性能优化、创新灵活性和开发效率的全面提升。
基于 Triton Inference Server 模型实现适配 NPU 生态的后端。Triton 提供了一套标准的接口。这个仓库的作用,就是实现这套接口,并将其映射到昇腾 CANN 的上。为什么是 GE(图引擎)?不同于直接调用算子,GE 会将计算任务转换成一张计算图。自动优化:GE 可以在图层面进行算子融合(Fusion)、内存复用优化,这是单算子调用无法做到的。全流程加速:根据仓库描述,它