登录社区云,与社区用户共同成长
邀请您加入社区
在FrontierSWE、Terminal-Bench等代码和长程任务权威基准上,GLM-5.2与国际顶尖模型Claude Opus 4.8的差距收窄至1%–4%。值得关注的是,GLM-5.2的线上推理已在Day 0完成与华为昇腾、平头哥、摩尔线程、寒武纪、昆仑芯、沐曦、海光、壁仞等国产算力平台的全适配。近日,智谱正式上线并开源新一代旗舰模型GLM-5.2。资本市场迅速给出回应。6月22日,港股上
某团队在昇腾NPU上实现了FlashAttention,测试时发现大多数case都正确,但有几个边界case输出了错误结果——Loss只差一点点,但长序列场景下输出差异明显。他们怀疑是数值精度问题,也怀疑是算法实现有bug。问题是:没有系统性地验证FlashAttention的正确性。测试几个case不能证明算法是对的,需要形式化验证和边界条件覆盖。今天把FlashAttention的正确性验证方
第一次在昇腾 910 上跑千卡训练的时候,通信开销直接把算力优势全吃掉了。8 张卡训练 ResNet-50,epoch 时间比单机还慢——这不是卡的问题,是通信没跑通。
本文系统介绍了基于小智AI构建"第二大脑"的开发实践,涵盖三大核心项目:1)智能家居控制系统,实现语音指令解析与设备联动;2)AI对话系统,集成意图识别与上下文管理;3)插件化功能扩展系统,支持模块化开发。通过详细的技术架构、代码实现和Prompt工程示例,展示了如何将小智AI打造为可扩展的智能中枢。文章还提供了Docker部署方案和性能监控方案,为开发者构建个性化AI系统提供