跳至内容
1. 重要发布与产品
- [阿里发布Qwen3.8基座大模型]:总参数量2.4万亿,Arena榜单仅次于Claude系列,CodeArena编程榜位居全球第四,可自主完成多日真实项目交付。(来源:搜狐科技)
- [月之暗面开源Kimi K3]:2.8T参数,采用KDA混合线性注意力机制与注意力残差技术,原生视觉理解,支持100万token上下文。(来源:知乎)
- [GPT-Image 2.5图像模型上线]:闭源图像模型持续迭代,多模态生成质量与指令遵循能力进一步提升,图像生成竞争加剧。(来源:知乎/DataLearner)
2. 技术进展
- [微软研究院提出物理AI方向]:VLA模型将自然语言指令转化为物理行为,使机器人逐步走出装配线等结构化环境,在开放场景感知与行动。(来源:微软研究院)
- [国产AI芯片从推理走向训练]:先进封装与架构优化弥补工艺差距,国产加速卡在预训练场景的可用性显著提高。(来源:36氪)
- [OpenAI阐述对齐研究路线]:区分目标对齐与价值对齐,指出链式思维监控效果随模型能力提升而减弱,主张建立第三方安全门槛。(来源:AIHOT)
3. 产品与市场
- [华为昇腾960亮相全联接大会]:单卡FP8算力2PFLOPS,搭载288GB HBM,配套全球首个NPO近封装光学超节点,单节点可接入4096张卡。(来源:新浪)
- [曦智科技发布天枢·光立方]:全球首款基于光电混合计算芯片的一体化边缘计算盒,已在民用场景商用,光计算进入产业化阶段。(来源:芯师爷)
- [中科曙光推出AI计算开放架构]:联合20余家产业链伙伴发布国内首个AI计算开放架构,硬件适配多品牌加速卡,支持百万卡扩展超集群。(来源:21经济网)
4. 应用落地
- [灵知AI大模型落地工业能源管理]:蘑菇物联依托云边端一体化架构采集工厂设备数据,精准调控能源使用,已在电子制造等场景部署。(来源:新浪财经)
- [智能客服进入规模化应用阶段]:银行、政务、教育等行业实现规模化落地,非结构化文档向可调用知识资产的转化成为企业常见需求。(来源:知乎专栏)
5. 开源与技术
- [中国开源模型包揽全球榜单前六]:小米Mi-Mo-V2.5、DeepSeek V4 Flash、腾讯Hy3、MiniMax M3、GLM-5.2等占据开源榜前列,开源格局明显变化。(来源:无矩AI)
- [开源模型选型生态趋于成熟]:Qwen3、DeepSeek、GLM等活跃开源系列叠加完善的工具链,成为企业本地化部署的主流选择。(来源:Jimmy Song技术博客)
发表回复