跳至内容
1. 重要发布与产品
- 阿里发布Qwen3.8基座大模型:总参数量2.4万亿,Arena榜单位居全球第一梯队,编程能力位列CodeArena全球第四,可自主完成长周期项目交付(搜狐科技)
- OpenAI发布GPT-6.1 Sol智能体模型:聚焦智能体编程、计算机使用与专业任务,为GPT-6 Sol的升级版本(知乎专栏)
- 月之暗面开源Kimi K3:2.8万亿参数,采用KDA混合线性注意力机制,支持原生视觉理解与1M上下文,综合表现位居前列(知乎专栏)
2. 技术进展
- 稀疏注意力机制受关注:中国信通院报告指出,DeepSeek的NSA、月之暗面的MoBA等架构成为提升模型推理效率的重要技术路径(新华网)
- 物理人工智能兴起:微软研究院提出物理AI方向,VLA模型可将自然语言指令转化为物理行为,推动机器人走出结构化环境(微软研究院)
- OpenAI发布《An Alien Mind》长文:阐述推理模型可扩展训练起点,指出链式思维监控效果随模型能力提升而减弱,呼吁建立安全门槛(AIHOT日报)
3. 产品与市场
- 华为昇腾950PR配套Atlas 350加速卡亮相:FP4算力1.56 PFLOPS,约为英伟达H20的2.87倍,定价约7万元,性价比突出(知乎专栏)
- 中科曙光发布scaleX640超节点:全球首个单机柜级640卡超节点,单机柜算力密度提升20倍,HBM总容量达81.9TB(知乎专栏)
- 中昊芯英第二代TPU芯片”须臾”展出:混合精度浮点算力896 TFLOPS,较前代性能提升3倍,同等算力功耗降低50%(芯师爷)
4. 应用落地
- 蓝色光标AI营收达12亿元:AI覆盖公司95%以上作业场景,服务约600家客户,落地1500个AI驱动的营销案例(腾讯商学院)
- 工业大模型落地能源优化:蘑菇物联推出”灵知”AI大模型,依托云边端一体化架构采集分析设备数据,精准调控工厂能源使用(新浪财经)
- Google汇总185个生成式AI应用案例:覆盖客户服务、代码开发、数据分析与创意领域,展示全球企业实际应用效果(卓世科技)
5. 开源与技术
- 中国开源模型集体登顶:小米Mi-Mo-V2.5、DeepSeek V4、腾讯Hy3、MiniMax M3、GLM-5.2等占据榜单前六位(无矩AI)
- MiniMax发布H3模型:3300亿参数,7月底上线,与Seedance 2.5等同期发布,开源阵营持续扩充(DataLearnerAI)
- Qwen3.8支持自主编程交付:可从空文件夹出发完成十数天真实项目交付,全程无需人工干预,智能体编程成为竞争焦点(搜狐科技)
发表回复