2026年8月3日,阿里巴巴旗下通义千问正式发布Qwen家族迄今最强模型——Qwen3.8-Max。这款参数规模达2.4万亿的大模型,不仅在编程、办公、科研等领域实现全面提升,更宣布将在下周开源模型权重。这是中国大模型赛道进入2026年下半年后的第一记重拳。
Qwen3.8-Max的核心升级
Qwen3.8-Max基于Qwen 3.5架构构建,激活参数95B,支持100万上下文Tokens。与上一代相比,几个关键维度的提升值得关注:
- 编程能力跃升:在复杂代码仓库级问题求解和前端开发领域树立新标杆,端到端完成复杂任务的可靠性大幅提高
- 长程任务处理:支持百万Token上下文,长文档理解、长周期规划和多轮工具调用的表现显著改善
- 多模态增强:复杂文档理解、视频推理、视觉编程及真实场景感知能力更为精准
- 开源承诺:Qwen3.8-Max模型权重下周开源,同时开源27B版本,开发者可自由部署
中国大模型调用量连续十四周全球第一
根据OpenRouter最新数据,7月27日至8月2日这一周,全球AI大模型总调用量为56.8万亿Token。其中,中国大模型周调用量达28.13万亿Token,连续十四周超过美国,稳居全球首位。更值得注意的是,全球调用量排名前五全部是中国产品——DeepSeek领跑,中国大模型在应用层的影响力已经形成压倒性优势。
开源与闭源的路线之争
Qwen3.8-Max选择开源,延续了阿里千问团队一贯的开放策略。这与部分厂商的闭源路线形成鲜明对比。开源意味着:
- 成本优势:企业可在自有基础设施上部署,避免API调用的高频支出
- 数据安全:敏感业务数据无需经过第三方,满足合规要求
- 定制灵活:可针对特定行业场景做微调适配
但闭源模型厂商认为,集中式服务能保证更稳定的质量和更快的迭代节奏。两种路线各有适用场景,短期内不会分出胜负。
对开发者意味着什么
Qwen3.8-Max的发布,对开发者生态有三层影响:
- AI编程进入”氛围编程”时代:模型深度融合逻辑推理、海量记忆与工具执行能力,开发者可以用更自然的对话方式完成复杂开发任务
- 智能体开发门槛继续降低:百万上下文+工具调用+长程规划的组合,让构建能真正端到端完成任务的Agent变得可行
- 开源生态进一步繁荣:2.4万亿参数级别的开源模型,意味着社区微调和垂直应用的空间更大
MiniMax H3同日发布,多模态竞争白热化
同一天,稀宇科技(MiniMax)也发布了全模态生成模型H3。H3支持文本、图像、视频、声音的统一理解,可输出原生双声道音视频,最高支持15秒2K分辨率。MiniMax同样计划开放模型权重。
阿里和MiniMax在同一天发布新一代模型,信号很明确:2026年下半年的大模型竞争,焦点已从单纯的参数规模,转向多模态理解、Agent能力和开源生态的全方位较量。
实操建议
对想尝鲜Qwen3.8-Max的开发者和团队,建议从以下几步入手:
- 先通过千问AI平台的API服务测试核心场景,评估与当前使用模型的差距
- 等开源权重发布后,在自有GPU集群上部署27B版本做初步验证
- 针对业务关键任务做AB测试,量化效率提升和成本节省
- 关注社区微调方案,尤其是编程和办公场景的适配
写在最后
2026年的大模型赛道,竞争维度已经从”谁的参数更大”升级为”谁能让AI真正完成复杂任务”。Qwen3.8-Max的发布,加上开源承诺,让这场竞争多了一个重要变量。对中国AI生态而言,开源大模型的持续迭代,正在构建一条区别于硅谷闭源路线的独立发展路径。
发表回复