阿里巴巴开源新一代千问3模型,成本大幅下降
AI导读:
4月29日凌晨,阿里巴巴开源新一代通义千问模型Qwen3(简称千问3),参数量大幅下降,采用混合专家架构,支持多语言,全球开发者可免费下载商用。
4月29日凌晨,阿里巴巴开源了新一代通义千问模型Qwen3(简称千问3),该模型参数量仅为Deepseek-R1的1/3,实现了成本的大幅下降,标志着AI技术在效率与成本上的新突破。
千问3采用了混合专家(MoE)架构,总参数量达到235B,但激活时仅需22B,是国内首个混合推理模型。它将“快思考”与“慢思考”巧妙集成进同一个模型,对于简单需求能够快速响应,实现低算力“秒回”答案;而对于复杂问题,则能进行多步骤的“深度思考”,有效节省了算力消耗。
在性能方面,千问3预训练数据量高达36T,并在后训练阶段进行了多轮强化学习,使得模型在推理、指令遵循、工具调用、多语言能力等方面均有显著提升。同时,千问3的部署成本也大幅下降,仅需4张H20即可部署其满血版,为企业应用提供了更多便利。
为了满足不同场景的需求,千问3提供了丰富的模型版本,包括2款30B、235B的MoE模型,以及0.6B、1.7B、4B、8B、14B、32B等6款密集模型。这些模型均采用了宽松的Apache2.0协议进行开源,首次支持119种语言,全球开发者、研究机构和企业均可免费在魔搭社区、HuggingFace等平台下载模型并进行商用,同时也可以通过阿里云百炼调用千问3的API服务,进一步推动了AI技术的普及和应用。
(文章来源:中国证券报·中证金牛座)
郑重声明:以上内容与本站立场无关。本站发布此内容的目的在于传播更多信息,本站对其观点、判断保持中立,不保证该内容(包括但不限于文字、数据及图表)全部或者部分内容的准确性、真实性、完整性、有效性、及时性、原创性等。相关内容不对各位读者构成任何投资建议,据此操作,风险自担。股市有风险,投资需谨慎。如对该内容存在异议,或发现违法及不良信息,请发送邮件至yxiu_cn@foxmail.com,我们将安排核实处理。

