阿里云发布新一代通义千问模型Qwen3，登顶全球最强开源模型

商业视界 2025-04-29 08:40:15 来源：第一财经作者：网络

AI导读：

4月29日，阿里巴巴推出新一代通义千问模型Qwen3并开源，该模型是国内首个混合推理模型，性能超越全球顶尖模型，登顶全球最强开源模型。阿里云强调其部署成本大幅下降，用户可在多平台下载并商用。

4月29日凌晨，阿里巴巴宣布推出新一代通义千问模型Qwen3（千问3）并进行开源。阿里云方面表示，千问3是国内首个“混合推理模型”，集成了“快思考”与“慢思考”两大功能，参数量仅为Deepseek-R1的1/3，成本大幅下降。在ChatBot Arena等榜单中，千问3性能全面超越R1、OpenAI-o1等全球顶尖模型，成功登顶全球最强开源模型。据知情人士透露，这是今年上半年阿里云最核心的技术产品发布。

通义千问官方发布的技术博客显示，千问3采用混合专家（MoE）架构，总参数量达235B，激活仅需22B。预训练数据量高达36T，并在后训练阶段进行多轮强化学习。同时，千问3将非思考模式无缝整合到思考模型中，对于简单需求可快速响应，低算力下即可“秒回”答案；对于复杂问题则进行多步骤“深度思考”。两种模式的结合，显著增强了模型在实现稳定且高效“思考预算”方面的控制能力。

阿里云方面强调，在性能大幅提升的同时，千问3的部署成本也大幅下降，仅需4张H20显卡即可部署千问3满血版，显存占用仅为DeepSeek-R1的三分之一。这一变化无疑为千问3的广泛应用提供了有力支持。

目前，千问3已开源了2款30B、235B的MoE模型以及6款密集模型，覆盖0.6B至32B的不同参数规模。阿里云透露，千问3的30B参数MoE模型实现了10倍以上的模型性能杠杆提升，仅需激活3B参数即可达到上代Qwen2.5-32B模型的性能水平。所有千问3模型均支持混合推理，API可按需设置“思考预算”，灵活满足AI应用在不同场景下的性能和成本需求。

开源后，用户可在魔搭社区、HuggingFace等平台下载模型并商用，也可通过阿里云百炼平台调用千问3的API服务。个人用户可通过通义APP体验千问3的强大功能，夸克也即将全线接入千问3。

展望未来，千问3将继续优化模型架构和训练方法，以实现数据规模扩展、模型大小增加、上下文长度延长以及模态范围拓宽等关键目标。同时，千问3还将利用环境反馈推进强化学习，以提升长周期推理能力。通义千问团队表示，Qwen3代表了他们在通往通用人工智能（AGI）和超级人工智能（ASI）道路上的一个重要里程碑，预示着正从专注于训练模型的时代过渡到以训练Agent为中心的新时代。

（文章来源：第一财经）

郑重声明：以上内容与本站立场无关。本站发布此内容的目的在于传播更多信息，本站对其观点、判断保持中立，不保证该内容（包括但不限于文字、数据及图表）全部或者部分内容的准确性、真实性、完整性、有效性、及时性、原创性等。相关内容不对各位读者构成任何投资建议，据此操作，风险自担。股市有风险，投资需谨慎。如对该内容存在异议，或发现违法及不良信息，请发送邮件至yxiu_cn@foxmail.com，我们将安排核实处理。