智东西9月6日报道,昨夜,阿里上线Qwen3系列最强模型Qwen3-Max的Preview版本,这也是阿里迄今为止最大的模型,参数量超1万亿。该模型目前已登陆阿里百炼平台,且在通义千问应用及Qwen Chat上免费可用。 据百炼平台介绍,Qwen3-Max-Preview相较2.5系列整体通用能力有大幅度提升,中英文通用文本理解能力、复杂指令遵循能力、主观开放任务能力、多语言能力、工具调用能力均显著增强;模型知识幻觉更少。 在AI模型聚合平台OpenRoute上,Qwen3-Max的介绍提及:其在推理、指令执行、多语言支持和长尾知识覆盖方面均有显著改进;同时在数学、编程、逻辑和科学任务中提供了更高的准确率。该模型支持超过100种语言,具有更强大的翻译和常识推理能力,并针对检索增强生成 (RAG)和工具调用进行了优化,但并未包含专门的“思考”模式。 智东西第一时间在通义千问网页端上对Qwen3-Max-Preview进行了体验,发现模型在文本理解以及数学、编程能力上效果出色,且响应速度很快。 “一个圆里面有两个小球,一个黑色,一个白色,白色的球随即位置自由下落,碰到边界会反弹,同时再生成一个随机位置的白色小球,黑色小球碰到边界会反弹,碰到白色的球会变大一点,请模拟一下。” 当我们把难度提升,让Qwen3-Max-Preview进行一个力量与速度种群模拟,并不断优化这个模拟器,发现Qwen3-Max-Preview能够实现快速而准确的模拟,能在几秒钟之内完成一个成熟程序员可能需要大半天才能完成的工作。 我们输入提示词:“有两个种群,种群a注重力量的发展,种群b注重速度的发展,请模拟一下两个种群之间的相互作用并给出说明。” 在上述模拟中,我发现速度型种群被干掉的太快了,于是进一步希望它们能够具备“逃跑”能力。我输入提示词:“注重速度的种群被干掉的太快了,他们每个个体都应该具备一定的躲避危险的能力。” Qwen3-Max-Preview依然能够很好的实现,输出了“力量与速度种群模拟(协作版)”,模拟出小绿球有了协作能力后能抵御红球的能力,但双方态势依然很僵持。 于是,Qwen3-Max-Preview输出了“力量与速度种群模拟(资源与繁衍版)”,从模拟可以看到,两类球都自行开始裂变,在这种情况下,红球已经干不过绿球了。 尤其是“躲避危险”、“团结”、“协作”、“繁衍”等表述是比较抽象的,且对应的实际含义很复杂,实现起来涉及调节的参数很多,但Qwen3-Max-Preview都在几秒钟之内准确理解语义及背后的逻辑,并完成模拟实验的编程,体现其在复杂推理、指令执行、数学、编程等能力方面的出色能力。 模型层的突破正成为阿里AI转型的第一张王牌。在内部测试和早期用户测评中,Qwen3-Max-Preview表现出更广的知识面,更优秀的对话能力,在Agent任务与指令遵循等方面拥有更强劲的性能。 通义千问大模型开源闭源两手抓,已代表了中国大模型的技术新高度。Qwen3-Max-Preview刷新了阿里大模型参数新纪录,其试图用更加强悍的性能,证明规模化扩展的效果——更大的模型拥有更强的性能。


