| 0人浏览 | 2026-02-18 00:24 |
2月17日,国产GPU厂商摩尔线程宣布,已在旗舰级AI训推一体全功能GPU MTT S5000上完成对阿里巴巴最新大模型Qwen3.5的全面适配。
Qwen3.5是阿里于2月16日正式发布的新一代开源大模型。据阿里千问介绍,该模型首款版本Qwen3.5-Plus采用创新的混合架构,将线性注意力与稀疏混合专家(MoE)技术相结合,总参数量达3970亿,每次前向传播仅激活170亿参数,性能超过此前万亿参数规模的Qwen3-Max模型,部署显存占用降低60%,最大推理吞吐量可提升至19倍。在定价方面,Qwen3.5-Plus的API价格为每百万Token0.8元。
这并非摩尔线程近期首次快速跟进头部大模型的适配工作。据摩尔线程此前披露,2月14日该公司刚刚在MTT S5000上完成对MiniMax新一代大模型M2.5的Day-0极速适配。此外,2月12日智谱发布旗舰模型GLM-5时也披露,该模型已完成与华为昇腾、摩尔线程、寒武纪、昆仑芯等主流国产芯片平台的深度推理适配与算子级优化。
摩尔线程成立于2020年,总部位于北京,主营业务涵盖GPU芯片设计及相关软件服务。据国家知识产权局信息,该公司目前拥有专利信息1190条。2月初,摩尔线程还推出了业内首个基于国产全功能GPU算力底座的AI Coding Plan智能编程服务,依托MTT S5000的全精度计算能力,联合硅基流动完成高效算子融合与框架优化。
当前正值国产大模型密集发布的窗口期。春节前后,字节跳动发布豆包大模型2.0系列及Seedance2.0视频模型,智谱上线GLM-5,MiniMax开源M2.5,阶跃星辰发布Step3.5Flash,DeepSeek也进行了版本更新。在大模型快速迭代的背景下,国产GPU与大模型之间的适配效率正成为算力生态建设的关键一环。
- 暂时还没有人评论
-
0
-
0
-
TOP
