跳至内容
1. 重要发布与产品
- GPT-5.6三变体落地,GPT-6多智能体模型内测:OpenAI发布GPT-5.6并推出Sol、Terra、Luna三个变体,面向不同复杂度和价格带差异化定价,GPT-6多智能体协作模型进入内测阶段。亚马逊完成500亿美元投资,巩固资金储备优势(无矩AI)
- 阿里通义千问Qwen3.8-Max-Preview曝光:参数量达2.4万亿稀疏MoE,激活95B,支持1M上下文,国内定价每百万token输入12元、输出36元,Max级权重计划下周开源(掘金)
- DeepSeek V4 Flash正式开放API:定位高性价比轻量级模型,284B总参/13B激活MoE架构,通过后训练优化把Agent能力拉高约6倍,以极低价格冲击闭源模型定价基准(无矩AI)
- MiniMax H3全模态视频模型开源:138B参数,支持文本、图片、音频、视频统一输入,直出2K分辨率最长15秒带原生立体声音频,视频生成定价0.8元/秒,16家芯片厂商首日适配(掘金)
2. 技术进展
- MoE混合专家架构成主流技术路线:契合智能体多任务处理与长程推理需求,Qwen3.8-Max以2.4T总参/95B激活实现”旗舰能力、可控成本”组合,国产大模型普遍采用稀疏MoE与混合注意力联合优化(新华网/掘金)
- 原生多模态与长上下文成标配:超长上下文、原生多模态、智能体适配成为主流国产大模型重要标配,Qwen3.8-Max支持1M token,混合注意力机制缓解长序列KV Cache显存瓶颈(新华网)
- 具身智能核心技术大量涌现:VLA视觉语言动作模型、世界模型加速落地,全身力控、灵巧抓取、环境自适应、故障自恢复等技术成果推动具身智能走出演示场景,稳步走向工业与服务业实景作业(新华网)
3. 产品与市场
- 国产AI算力芯片密集发布:中昊芯英第二代TPU”须臾”8-bit推理算力达1792 TOPS,较前代性能提升3倍;曦智科技首发全球首款光电混合计算芯片边缘计算盒”天枢·光立方”,光计算技术走向产业化(芯师爷/与非网)
- 国产GPU万卡智算集群点亮:云工场科技沐曦国产GPU万卡智算集群一期正式点亮,采用沐曦曦云C550算力设备已进入实际运营,上海临港将建设沐曦GPU万卡集群(界面新闻)
- 燧原科技科创板IPO申请获受理,昆仑芯P800发布:搭载自研XPU-P架构,FP16算力达345TFLOPS,可适配万卡至三万卡级AI算力集群,国产算力芯片厂商加速资本化(IT之家)
4. 应用落地
- Qwen3.8-Max演示16天自主编程:从空文件夹出发无人干预独立运行约16天,自主写代码、跑测试、看日志,产出oh-my-cli自演化Agent框架在GitHub开源,265次代码提交,量化场景调度约330个子智能体完成约6000次因子回测(掘金)
- 2025中国AI+应用Top50案例揭晓:华为、京东、宁德时代、财跃星辰等50家企业AI应用实践从300余家申报中脱颖而出,覆盖工业、营销、金融等场景,2026″AI+千行万业案例集”活动启动(财联社/科创板日报)
- AI驱动营销收入快速增长:蓝色光标”All in AI”战略下AI已覆盖95%以上作业场景,落地1500个AI驱动营销案例,2024年AI驱动收入达12亿元,占比是上年十倍(腾讯研究院)
5. 开源与技术
- 中国开源模型全球排行榜集体登顶:OpenRouter 7月全球月度排行榜前六名全部为中国开源模型,依次为小米Mi-Mo-V2.5、DeepSeek V4 Flash、腾讯Hy3、MiniMax M3、智谱GLM-5.2、DeepSeek V4 Pro(无矩AI)
- 中国开源大模型全球下载量突破100亿次:据Hugging Face统计,过去一年平台新增开源模型下载流量中中国自研大模型占比达41%,首次超过美国,国家级AI开源社区汇聚用户超1100万、托管模型超7万个(新华网)
- xAI开源Grok Build工具链:上线9天即在GitHub获得超过2万star,Grok 4.6和4.7密集发布,参数规模达2万亿至2.1万亿;月之暗面Kimi K3开源2.8万亿参数模型,完成35亿美元融资筹备港股上市(无矩AI)
发表回复