登录社区云,与社区用户共同成长
邀请您加入社区
使用华为昇腾服务器,通过docker搭建部署大模型,应用方面可通过接口调用模型;
GPUStack 支持可插拔的推理引擎架构,允许自定义推理后端及其版本,用于引入 GPUStack 未内置的 vLLM / SGLang / MindIE 版本,或接入其他自定义推理引擎镜像。为了部署模型,需要添加 vLLM Ascend 最新发布的v0.13.0rc3版本。vLLM在推理后端菜单,编辑 vLLM,在版本配置中选择添加版本配置值版本0.13.0rc3镜像名称框架CANN覆盖镜像入口
平台实现行业领先的全生态覆盖,深度适配华为鸿蒙、OPPO、vivo 等国产主流生态,全面支持海外谷歌 EMM、苹果 ABM/ASM 注册体系,可统一管理 Android、iOS、Linux、macOS、Windows 及鸿蒙全系统终端,覆盖智能手机、平板、手持终端(PDA)、POS 设备、电子屏及企业自研终端,适配 30 余个行业场景,彻底解决企业设备碎片化管理难题。,设备丢失、违规应用安装、敏感