
国产大模型新一轮竞速已经打响。继Kimi K3开源引爆行业讨论之后,阿里云千问团队推出家族全新旗舰基座Qwen3.8-Max ,官方将其定义为目前千问体系能力最强的大模型。更受开发者关注的消息是,Qwen3.8-Max与Qwen3.8-27B两款模型权重将于下周正式对外开源 。
AITOP100平台获悉,8月3日,千问在著名社交媒体平台“X”的官方账号发布信息,Qwen3.8-Max总参数规模达到2.4万亿 ,采用MoE混合专家架构,定位面向复杂智能体、自主工程、长周期商业与科研任务,重点补齐AI从“简单问答”走向“自主完成完整项目”的能力短板。
一、跳出跑分内卷,核心能力聚焦真实落地
以前大量大模型依靠榜单数据证明实力,但是落地到生产环境经常出现能力缩水。这次Qwen3.8-Max把重心放在端到端自主执行 ,官方放出四项核心能力验证,全部基于真实业务场景测试:
1.自主编程能力
Qwen3.8-Max支持超过10天的持续自我演化开发,可以从空白文件夹起步,自主完成编码、自测、排错、迭代,直至项目生产部署,不需要人工持续介入。对应的完整项目案例oh-my-cli完整运行轨迹已经上传GitHub仓库可供所有人复盘。以往AI代码工具大多只能完成函数补全、脚本编写,很难独立维护长期工程,这项能力意味着Agent型开发工具迎来新的能力分水岭 。
2.真实工作,真实成果
覆盖数百类职业场景生产级交付,覆盖了法律文书审核、产品原型设计、工程仿真、量化策略研究等场景,Qwen3.8-Max能够一次性输出可直接使用的结果,不再局限于概念方案。
3.长时程掌握
在长时程复杂任务层面,Qwen3.8-Max搭载系统级自主规划与闭环自适应学习框架。公开测试案例显示,它可以完成500轮以上芯片设计持续优化 ,也能进行跨度365天的电商经营策略推演。长周期任务最大难点在于模型容易遗忘目标、中途逻辑跑偏,自适应闭环能够持续接收反馈、自主修正方案。
4.原生多模态智能
最后一个大亮点是原生多模态智能闭环 ,和很多“文本基座外挂视觉模块”的模型不同,Qwen3.8-Max视觉能力深度融入任务全流程:图像信息不只是输入素材,全程参与任务规划、执行校验、自我修正,形成完整反馈链路,更适配机器人、工业检测、界面自动化操作等场景。

在LM的表现

在VL上面的表现

二、价格公布,开放渠道全部落地
Qwen3.8-Max同步对外公布国际版API调用定价:
- 输入Token:2.0美元/百万tokens
- 输出Token:6.0美元/百万tokens
- 隐式缓存:0.25美元/百万tokens
普通开发者想要抢先体验,目前有两条官方入口:
- Qwen Studio网页端 :https://chat.qwen.ai/?models=qwen3.8-max
- 标准API接口,支持主流开发框架快速接入
国内开发者可登录阿里云DashScope平台查看国内版本定价与调用权限
最受开源社区期待的权重文件,下周将会上线,除超大杯Qwen3.8-Max之外,轻量化版本Qwen3.8-27B 同步开放权重,兼顾大规模算力部署与中小型本地私有化场景。
三、国产MoE旗舰接连开源意味着什么?
短短几天之内,Kimi K3、Qwen3.8-Max两大万亿参数级别国产模型相继官宣开源,彻底打破过去“高端基座闭源”的惯例
独立AI行业分析师林辰表示:“过去高端大模型厂商倾向锁住权重,依靠API赚取收益。现在头部团队选择开放,本质是争夺开发者生态。对于中小企业,不用从零训练基座,可以直接基于万亿参数模型微调搭建行业Agent;反过来海量开发者的场景实践,也会持续反向推动基座迭代。”
同时竞争格局也出现明显变化,赛道竞争不再只比拼参数大小、榜单分数,自主长程任务、端到端交付、原生多模态Agent能力 ,已经成为新一代旗舰模型的核心评判标准。
小编认为Qwen3.8-Max的发布,把国内万亿参数大模型的竞争推向新阶段。下周权重开源之后,全球开发者能够近距离实测它的长程智能体、自主工程能力。接下来一段时间,开源社区大概率会涌现大量基于该模型打造的编程智能体、行业自动化工作流方案。
后续随着实测数据不断流出,这款模型能否真正缩小和海外顶级模型在复杂自主任务上的差距,还需要我们持续观察。
信息来源:千问X社交媒体平台官方公告
AITOP100-AI资讯频道将持续关注AI行业新闻资讯消息,带来最新AI内容讯息。
想了解AITOP100平台其它版块的内容,请点击下方超链接查看
AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说
AITOP100平台官方交流社群二维码:










