登录社区云,与社区用户共同成长
邀请您加入社区
A5服务器即Ascend 950系列,通过npu-smi info与dmidecode确认芯片型号与平台。其典型形态为AI server,支持2CPU+8David架构,分PR(推荐)与DT(训练)两种负载模式。部署需统一版本栈:CANN 9.1.0、TorchNPU 2.10.0、vLLM等,容器部署须挂载关键设备与驱动目录。排查重点包括驱动匹配、版本兼容、算子包安装及设备挂载。昇腾知识图谱可精
对于鸿蒙用户而言,这无疑是一次不容错过的“特权时刻”。无论你是追求高效的专业人士,还是热爱探索的硬核玩家,ToDesk鸿蒙版此次限免的隐私屏、虚拟屏、超清高帧画质、禁用被控键鼠,都像是为你量身定制的“神兵利器”。无需付费弹窗的打扰,没有功能阉割的顾虑,纯粹的强大与便捷,此刻触手可及!
在鲲鹏920与昇腾910B-64GB硬件上,基于银河麒麟系统成功部署DeepSeek-V4-Flash大模型服务。通过vLLM-Ascend容器化方案,实现8卡张量并行、130K上下文长度及32并发,服务地址为http://192.168.99.240:8080。经验证,模型加载正常,支持OpenAI兼容接口,国产化算力栈具备生产可用性。后续可优化并发、启用前缀缓存并监控显存使用。
远程控制的难点,往往不在于建立一次连接,而在连接之后如何处理屏幕、输入和提醒这些细小但高频的动作。电脑接着多块显示器,手机上究竟该看哪一块;需要临时处理工作,又不希望被控端的画面暴露在现场;想在移动端按下Ctrl+CWin+R,却不想在小屏幕里反复找按键。这些问题单看都不大,堆在一次远控会话里,就会把“能操作”与“操作得顺”拉开差距。ToDesk 鸿蒙版4.8.0.0将改动集中在显示、隐私、键盘和
GPU 云服务器选卡先看显存能不能装下模型,再看单位算力成本,最后看供货和合规。2026 年的实用选择可以直接收敛到几条主线:训练优先 H200/H100/B200,7B-13B 微调优先 RTX 4090,推理优先 L40S/H20,FLUX 图像生成优先 RTX 5090 或 48GB 显存卡,国内合规场景重点看 H20 和昇腾 910B/910C。
本文围绕 PaddleOCR-VL-1.6 与 PP-DocLayoutV3 文档解析模型,在 Ascend 910B 与 rtx 5090 两套硬件环境上完成了完整的部署与移植实践。
使用华为昇腾服务器,通过docker搭建部署大模型,应用方面可通过接口调用模型;
应用市场更新功能是华为应用市场服务(AppGallery Kit)面向开发者提供的一项开放能力,主要服务于已在应用市场上架的应用。该功能允许开发者在应用内部集成版本检测与更新提醒逻辑,帮助用户及时将应用升级到最新版本。通过该功能,开发者无需自行搭建版本管理服务器、维护版本信息、处理下载跳转等复杂逻辑,只需调用应用市场更新服务提供的接口,即可完成以下核心操作:该功能有效提升了应用内更新提醒的便捷性和
调优的本质不是"把参数拉满",而是理解每个参数背后的物理约束,在相互冲突的目标间找平衡点:容量 vs 稳定性 → 选 0.85:吞吐 vs 激活显存/延迟 → 选 32768 甜点:长 prompt 吞吐 vs 短请求延迟 → 让短的插队CPU Offload:HBM 容量 vs PCIe 带宽 → 用 200GB 换"不重算"最重要的那条建议:别信任何估算(包括本文的数字),用你自己机器的启动日
报告时间:2026-08-29部署规模:4台 × 8卡 = 32卡昇腾910B4集群目录一、项目概述部署目标二、硬件环境三、软件环境四、集群部署架构五、服务详细配置5.1 vLLM 实例配置5.2 16后端实例分布六、OpenResty 反向代理配置6.1 核心功能6.2 亲和力路由设计6.3 完整 nginx.conf(16后端)七、集群验证结果7.1 16后端健康检查7.2 负载分布验证7.3
NVIDIA Vera Rubin NVL72、华为昇腾950 SuperPoD(含384上一代对照)、燧原云燧 ESL64-O / ESL64-C、中科曙光 ScaleX640(长沙首发"其他"代表) 四个对象逐行展开。表中"数学分析"列给出可落地的方程、矩阵或不等式;"参数表"列给出典型数值与范围;厂商未公开的数字以设计变量 / 典型工程范围标出,不与官方规格混淆。编号类别 / 厂商超节点服
多维信息整体朗读,本质是解决"重复"——重复的焦点、重复的朗读、重复的操作。同一个信息结构,只保留一个朗读入口。扁平信息用聚合嵌套信息父级标注、子级收口,用而非需要独立操作的元素保留独立焦点,不参与聚合下一篇转向另一个维度——焦点已经聚合好了,但焦点位置可能会因为控件消失、页面跳转而"跑丢",这时该怎么主动管理焦点。
申请调试证书需准备CSR文件,每个账号最多3个,实名开发者有效期1年(未实名14天),证书更新需同步更新Profile和公钥指纹,证书吊销不可恢复且关联Profile全部失效。在左侧导航栏选择"证书、APP ID和Profile →。",将生成的证书保存至本地,供后续调试签名使用。等问题,可优先排查是否为调试证书过期导致。,且通过此证书申请的Profile也会。证书申请成功后,在"证书"页面点击"
摘要: 芯动科技IX8012国产PCIe Gen4交换芯片支持端口灵活拆分(如x4拆分为x2+x1+x1),适配多类型外设混合扩展需求,特别适用于工控、边缘服务器等场景。其评估板提供完整验证环境,支持热插拔及国产信创平台(海光、昇腾),对比海外竞品具备供应链可控、端口配置灵活等优势。典型应用包括边缘AI整机、工控机及信创小型服务器,能有效解决PCIe通道资源紧张与设备带宽不匹配问题,是国产化硬件设
AI已深度融入日常生活,未来趋势不可逆转。前vivo产品经理宋紫薇跨界投身AI硬件创业,反映行业热度。AI大模型应用开发工程师成为高薪紧缺岗位,月薪可达60k。该岗位更看重实际应用能力,而非高深理论,适合各背景人士转行学习,是当前绝佳的就业转行机会。打开手机刷短视频,AI自动剪辑的片段越来越丝滑;上班写方案,AI助手分分钟列出框架;就连楼下奶茶店,都用AI系统优化点单流程。现在的AI,早就不是科幻
本文介绍了一个宠物档案管理系统的数据库设计与实现方案。系统主要功能包括宠物基本信息管理、体重和喂食记录、疫苗提醒等。 核心设计要点: 采用主表(pet)挂载两个时间序列从表(weight_record/feed_record)的结构,分别记录体重变化和喂食日志 体重记录使用REAL类型存储带小数的千克值,喂食记录包含食物名称和分量 疫苗提醒通过主表的next_vaccine字段实现,简化到期计算
摘要 本文介绍了药箱管理系统的设计与实现,聚焦"数量+有效期"双维度管理。系统采用主从表结构,主表(medicine)记录药品基本信息及库存量,从表(dose_log)追踪每次数量变动。核心功能包括:数量变更的事务处理、临期药品筛选(基于日期比较)、负库存校验及操作日志记录。设计亮点包括:用0值表示无有效期药品、有符号变动量简化日志、离散量使用整数类型等,为家庭药品管理提供数字化解决方案。
实例:健康数据(Health)|技术:多指标字段、日期维度、HealthDao。
本文深入解析了搜索历史功能的三个核心技术实现:去重插入、超限淘汰和时间排序。通过对比"先查后改"与"INSERT OR REPLACE"两种方案,指出前者更适合需要读取旧值的场景;介绍了三种SQLite删除超限记录的方法,推荐使用子查询方式;解释了如何通过刷新时间戳实现搜索词自动上浮的交互效果。文章还提供了完整的方法矩阵、技术要点对照表和常见问题解答,帮助开发者理解如何构建高效可靠的搜索历史功能,
华为开发者空间,是为全球开发者打造的专属开发者空间,致力于为每位开发者提供一台云主机、一套开发工具和云上存储空间,汇聚昇腾、鸿蒙、鲲鹏、GaussDB、欧拉等华为各项根技术的开发工具资源,并提供配套案例指导开发者从开发编码到应用调测,基于华为根技术生态高效便捷的知识学习、技术体验、应用创新。CodeArts代码智能体是基于智能生成、智能问答两大核心能力构建起一套全方位、多层次的智能开发体系。在智能
华为账号一键登录通过 LoginWithHuaweiIDButton 组件实现,配合隐私协议管理和授权状态控制,提供了安全便捷的登录体验。— 完整登录页面— 账号管理工具。
方法二:进入"设置"→"隐私和安全"→"应用锁",输入锁屏密码/隐私密码验证后,在应用列表中找到小红书并将开关关闭。提示:不同鸿蒙系统版本的菜单位置可能存在细微差别,但基本上都在"设置"里的"隐私和安全"或"安全"分类下。答:应用锁不会影响通知的正常接收,但你可以在设置中单独调整通知内容的显示方式,选择隐藏通知详情来保护隐私。在应用锁设置页面中,选择"密码"而非生物识别方式,就能设置一个单独的应用
摘要: 《龍魂系统优化全流程》提出了一套融合东方数理与现代计算技术的AI系统优化框架。其核心创新包括:1)基于河图洛书的九宫算力矩阵与五行动态调度算法,重构算力资源分配逻辑,目标提升集群利用率至81%;2)双轨隔离部署与鸿蒙首帧渲染优化,保障数据安全与性能;3)引入易经状态机与KFPP知识纯净协议,实现系统决策可解释性及知识防污染;4)分层许可治理(思想层CC协议/工程层Mulan协议)与三维贡献
本文介绍了Qwen3-VL-32B 在昇腾910B上的使用vLLM-Ascend两种性能调优方法,以提高多模态模型在昇腾服务器上的性能
本文介绍了一种面向AI系统的记忆压缩与恢复引擎"龙魂·鸿蒙记忆压缩与恢复引擎v1.0"。该引擎通过分层存储(L0-L3)和智能压缩技术实现AI的长期记忆管理,而非简单存储聊天记录。系统包含记忆引擎、压缩器、恢复器、存储适配等核心模块,采用鸿蒙原生zlib实现数据压缩,支持多级记忆管理(L0瞬时层到L3归档层)和自动压缩调度。关键特性包括基于内容重要性的分层存储策略、智能压缩算法、以及干支时间戳等特
鸿蒙电脑应用数已突破 19000+,生态正加速从“从有到优”向“体验定义者”跨越。欢迎前往鸿蒙应用市场下载 WorkBuddy,在HUAWEI MateBook Fold 非凡大师上开启全新桌面AI办公体验!:屏幕完全展开时,界面自动呈现“左中右三栏”布局——左侧管理任务菜单,中间查看对话与 AI 思考逻辑,右侧实时预览成果。首发适配,鸿蒙全场景产品的每一次升级都有WorkBuddy的同行,共同拓
设备算力充沛,搭载双路高性能处理器,同时具备高安全、高可靠、高能效优势,内置国密加解密引擎、实现双链安全启动,依托内存自愈、故障核隔离技术降低宕机风险,且获CQC VII级节能认证,能效表现行业领先。同时,昆仑技术围绕WATT→FLOPS→TOKENS→AGENTS→VALUES全链路产业价值链,持续夯实面向Token Factory的算力基础设施、软件及解决方案综合能力,打造基于昇腾新一代Atl
本文系统介绍了虚拟列表技术(Virtualized List)在解决长列表渲染性能问题中的应用与实现原理。主要内容包括:1. 问题分析:传统全量渲染方式在数据量大时会导致DOM节点爆炸、加载缓慢、滚动卡顿等问题。2. 核心原理:采用三层DOM结构(视口容器+滚动占位+内容列表),通过动态计算可视区域项和transform位移实现"视觉欺骗"。3. 实现方案: 固定高度场景的确定
第一次接触华为昇腾 NPU 服务器时,接下来该看什么、怎么初步检查,又该执行什么呢?torch_npu不同 Atlas 型号和驱动版本支持的子命令可能略有区别,以本机执行npu-smi -h的结果为准。
本项目基于华为昇腾910B4 NPU服务器集群,部署GLM-5.2-W4A8语言大模型,构建具备256K超长上下文、工具调用、多模态理解能力的AI推理服务平台。集群采用"4台独立服务 + nginx负载均衡"的架构,每台机器独立运行vLLM推理服务,通过nginx实现请求分发。压力测试涵盖单机测试、集群并发测试、长上下文测试和混合负载测试,全面验证集群在高负载下的稳定性和性能表现。集群部署成功:4
在NVIDIA服务器供应商中,。如果你需要,思腾合力是性价比与差异化服务最均衡的选择;浪潮信息和新华三在品牌服务器整机出货量和政企大项目中覆盖更广;华为昇腾在国产化全栈自主可控领域具备独特优势;中科曙光的液冷技术和超算基因深厚。本文从五个维度横向对比,帮助你理性决策。
文章摘要(149字) 《龍魂·韬定律(芯片级)进阶破解之法v2.0》是基于华为鲲鹏/昇腾硬件的算力分层调度方案。核心提出"温度四层模型":热层(昇腾NPU实时任务)、温层(鲲鹏CPU常驻服务)、冷层(低频批处理)和归档层(冻结数据),通过三六九不动点参数化阈值实现硬件受限下的算力最大化。系统遵循四大公理:温度分层、阈值焊死、调度透明和蚁群冗余,构建可追溯的优先级调度矩阵。该方案将存储分层策略延伸至
昇腾NPU算子开发性能优化新利器:msOpProf上板流水图助力算子性能分析 针对昇腾NPU算子开发中性能分析难题,msOpProf工具基于昇腾950硬件特性推出上板流水图功能,通过真实硬件采集的PIPE级流水数据,解决传统性能仿真速度慢、数据不准的痛点。通过quant_matmul算子从昇腾910迁移到950的性能劣化案例,展示了如何利用Pipe流水占比分析和时序分析两大利器: 占比分析:快速定
# HG9680 4U AI服务器:8卡昇腾910架构拆解与选型分析 8颗昇腾910 NPU、2.2 PFLOPS FP16算力、256GB HBM片上内存、8×200GE RoCE网络——这些参数
《龍魂·鸿蒙兼容性白皮书 v1.1》摘要(150字): 本白皮书阐述了龍魂系统与鸿蒙OS的兼容战略,提出"三步走"实施方案:1周实现"龍魂·指尖"基础通信(语音输入/结果展示),1个月完成服务原子化(端侧3种子人格常驻),长期构建分布式共生体。核心原则包括数据主权不变(原始数据永不离开本地)、算力网格化(闲置设备组成家庭计算集群)、民用安全边界(P0-P5分级防护)。技术路径涵盖ArkTS重写关键
《龍魂·鸿蒙兼容性白皮书 v1.0》摘要 本文档由龍芯北辰(UID9622)于2026年7月24日发布,提出龍魂系统与鸿蒙OS深度整合的三阶段战略: 短期(1周):开发轻量应用"龍魂·指尖",通过HTTPS连接现有鲲鹏后端,实现鸿蒙设备基础交互; 中期(1月):将核心功能原子化移植至鸿蒙,包括端侧推理、本地DNA审计及人格碎片化; 长期:利用鸿蒙分布式能力构建"数字共和国",实现跨设备算力调度与数
本文介绍了鸿蒙PC版Markdown编辑器中搜索选项的响应式布局优化方案。当侧栏宽度调整为220vp时,原有的中文搜索选项标签("区分大小写/全词匹配/正则表达式")会被裁切。通过分析业务状态共享机制,提出了以300vp为断点的自适应布局方案:窄侧栏(<300vp)采用两行排列保持标签完整,宽侧栏(≥300vp)恢复单行紧凑布局。文章详细阐述了技术实现细节,包括状态管理、断点选择依据、布局结构设计
三种AI部署方案已经形成明确的能力分层:前端设备仅做辅助采集、Atlas边端承担核心实时算力、国产后端承担平台大数据管控。其中华为昇腾Atlas边端方案凭借全栈自主可控、工业级稳定、实时性优异、适配场景广泛的优势,成为国产化AI落地的核心中坚方案。项目落地中需严格区分场景,禁止使用国外GPU架构、国外推理框架构建信创系统,通过标准端边云国产化架构,实现AI识别系统的安全、合规、高效落地。
2026世界人工智能大会(WAIC)上,华为Atlas950 SuperPoD(昇腾950超节点)首次亮相并获最高SAIL奖。超节点并非芯片,而是针对万亿参数大模型和智能体时代设计的算力底座,通过自研高速互联技术将多颗AI芯片(NPU/GPU)整合为逻辑统一的超级计算机,突破传统集群的通信瓶颈。其核心特征包括全局统一内存编址、超低时延专用互联及无阻塞全互联拓扑。华为Atlas950 SuperPo
在传统App时代,用户与应用的互动是“孤岛式”的:打开App -> 寻找功能 -> 使用 -> 关闭。而在鸿蒙生态中,服务卡片桌面卡片:用户一眼看到物流进度、优惠券。负一屏(智慧助手):聚合高频服务,如“待办事项”、“快递动态”。小艺建议:基于场景预测用户需求,主动推荐服务(如“下班时点外卖”)。智慧搜索:全局搜索时,直接展示服务卡片,而非只是App名称。核心价值零层级触达。用户不需要打开App,
鸿蒙PC Markdown编辑器命令面板设计 本文介绍了鸿蒙PC Markdown编辑器中命令面板的设计思路与实现方案。该面板通过统一入口解决功能增长导致的入口分散问题,支持键盘、触控板和触屏操作。文章重点分析了已实现的命令模型,包括: 设计目标:在不离开当前上下文的情况下定位并执行命令 命令模型:定义最小化接口契约,包含ID、标题、类别等元数据 注册表实现:静态命令对象集合,内置运行时约束检查