阿里最强AI模型Qwen3.8-Max亮相 2.4兆参数、下周开源

21分钟前

社会
3. Aug 2026
9 views
阿里最强AI模型Qwen3.8-Max亮相 2.4兆参数、下周开源

阿里巴巴旗下人工智能应用「通义千问」3日发布最新大模型Qwen3.8-Max,宣称这是Qwen系列迄今能力最强的模型,参数规模达2.4兆,支持100万Token上下文,模型权重预计下周开源。(取材自千问大模型微信公众号)

阿里巴巴旗下人工智能应用「通义千问」3日发布最新大模型Qwen3.8-Max,宣称这是Qwen系列迄今能力最强的模型,参数规模达2.4兆,支持100万Token上下文,模型权重预计下周开源。

据「千问大模型」微信公众号3日发布的消息,Qwen3.8-Max创建在Qwen3.5架构基础上,激活参数为950亿,主要提升编程、办公、科研、长周期任务及多模态智能体能力。除Qwen3.8-Max外,下周也将开源Qwen3.8-27B模型。

消息指,目前全球开发者已可通过千问AI平台使用Qwen3.8的应用程序接口(API)。中国境内每100万Token输入价格为人民币12元、输出36元,隐式缓存命中价格为1.5元;海外输入、输出价格则分别为2美元及6美元。阿里称,相较海外能力相近的前沿模型,Qwen3.8具有较高性价比。

在编程能力方面,阿里公布的测试显示,Qwen3.8-Max可在较少人工介入下,连续首席执行官时间的复杂开发任务。以一项自动编程测试为例,模型自主运行约16天,累计完成265次代码提交、127个合并请求及151个问题单。

阿里也让Qwen3.8-Max尝试重现一篇大型语言模型推理研究论文。公司称,模型连续工作约125小时,前37小时从零创建训练及评测流程,重现论文6项主要结论;其后自行提出并测试18项改进方向,最终在数学基准AIME24上较原方法提高2.7分。

在专业办公测试中,Qwen3.8-Max被用于法律文档审阅、建筑结构建模及体育数据分析。阿里声称,模型可在1小时内从数百份文档中找出1284项相关条款,也能依据图纸创建30层办公大楼的抗震结构模型。

针对长周期任务,阿里另以仿真365天电商经营的E-Commerce Bench测试模型。Qwen3.8-Max须使用人民币10万元启动资金,同时处理选品、供应链议价、库存、定价及退货等工作。官方结果显示,模型最终持有现金约41.6万元,较排名第2的GLM 5.2高出38%。

Qwen3.8-Max也强调多模态能力,可处理超过200页的财报、百小时影片、图片、文档及接口操作,并运行影片剪辑、3D建模、网页还原及应用开发等任务。阿里表示,模型可以在操作过程中持续观察成果,发现接口错位或对象方向错误后自行修正。

另据IT之家报导,在3日公布的第三方模型评测榜单Arena中,阿里Qwen模型仅次于Anthropic旗下Claude系列,整体性能被指位居全球大模型第一梯队。目前Qwen3.8的API已在千问AI平台上线,并接入阿里同日推出的智能体产品「千问办公」。

Comments

No comments has been added on this post

Add new comment

You must be logged in to add new comment. Log in