跳至内容
1. 重要发布与产品
- 阿里发布Qwen3.8-Max旗舰模型:8月3日发布,总参数2.4万亿,激活参数95B,采用稀疏MoE架构,支持1M Token上下文和原生视觉理解,Arena榜单仅次于Claude系列。(Mr. FIG / 阿里云)
- DeepSeek V4-Flash正式版发布:Agent能力显著提升,输出token和耗时均降至此前一半以下,成本约为三分之一,国内开源组同步新增Vision-Experience视觉实验版本。(掘金 / 知乎)
- MiniMax H3全模态视频模型开源:直接开源全模态视频生成能力,登顶AI视频榜单,同期还发布Music 3.0音乐模型,多模态布局持续扩展。(AI之旅导航 / 知乎)
- GLM-5.3与DeepSeek-V4-Pro接入千问AI平台:8月21日阿里云MaaS扩充模型矩阵,两款前沿模型API同步开放,开发者可在Qoder、Codex等工具中按需切换调用。(Fastdata极数 / 阿里云)
2. 技术进展
- OpenAI披露Astra下一代模型进展:内部版本在高等数学和理论计算机科学领域取得十项突破,包括否证Connes刚性猜想等长期难题,总计算成本约2000美元,定位为下一个主要模型。(Mr. FIG)
- Google Gemini 3.5 Pro延宕73天:曾短暂出现在Chatbot Arena评测平台约30分钟后撤回,Google确认正式发布已推迟,3.5 Pro长期难产引发关注。(无矩AI)
- 首届具身智能与机器人国际会议EIR2026举办:8月4日至7日在新加坡南洋理工大学举办,由清华大学自动化系发起,聚焦AI与机器人深度融合的前沿研究。(清华大学自动化系)
3. 产品与市场
- 2026世界机器人大会在北京启幕:8月19日开幕,主题”人机共生 产需共融”,北京亦庄20余家企业携近百款新品亮相,国内人形机器人整机产品达400余款,占全球半数以上。(光明日报 / 新华网)
- 具身多模态大模型Pelican-Unify 1.0发布:围绕”感知—理解—决策—执行”核心能力,推动大模型与机器人本体、真实场景深度融合,标志具身智能从功能拼凑迈入协同进化阶段。(数字中国建设峰会)
- 国产AI算力芯片集中亮相WAIC:中昊芯英第二代TPU芯片”须臾”算力达896 TFLOPS,性能提升3倍功耗降50%;曦智科技首发光电混合计算边缘盒”天枢·光立方”,光计算走向产业化。(与非网 / 芯师爷)
4. 应用落地
- 千问办公上线前沿模型档位:8月15日首发接入GLM-5.3和DeepSeek V4 Pro,用户可在产品首页直接选用,后因调整于8月17日撤回两款外部模型,可选档位重新变为四档。(新浪财经 / 网易智能)
- 中科曙光发布AI计算开放架构:推出支持百万卡扩展的AI超集群系统scaleX640,单机柜算力密度提升20倍,HBM总容量81.9TB,硬件适配多品牌加速卡,软件兼容主流生态。(IT之家 / 21经济网)
5. 开源与技术
- 中国开源模型全球榜单登顶:2026年8月全球开源模型前六名全部被中国模型占据,包括小米Mi-Mo-V2.5、DeepSeek V4 Flash、腾讯Hy3、MiniMax M3、GLM-5.2、DeepSeek V4 Pro,国产开源大模型全球累计下载量突破100亿次。(无矩AI / 新华网)
- 月之暗面开源Kimi K3模型:2.8T参数,基于KDA混合线性注意力机制和注意力残差技术构建,原生视觉理解,1M上下文,综合表现仅次于当时顶尖模型,被Nature称为”中国的Sputnik时刻”。(知乎 / CSDN)
发表回复