登录社区云,与社区用户共同成长
邀请您加入社区
华为开源盘古大模型系列,包括70亿参数稠密模型和720亿参数MoGE混合专家模型,并发布基于昇腾的推理优化技术。盘古ProMoE采用创新的分组专家架构,实现跨设备负载均衡,在昇腾平台上达到1148 tokens/s推理性能。华为同时公布了超大规模MoE推理部署方案,涵盖FlashComm通信优化、投机推理等核心技术,性能提升6-8倍。盘古Embedded 7B模型通过"快慢思考"