跳至内容
1. 重要发布与产品
- 8月大模型发布潮复盘:20天内11款新模型密集落地,字节跳动Seed 2.1 Turbo支持256K上下文并降低延迟,Meta发布首个全开源全模态模型及面向本地Agent的Muse Glimmer 30B(来源:天聊博客)。
- GPT-6 Astra基准成绩代际跃升:新模型FrontierMath Tier 4得分从83.0%提高至97.6%,ARC-AGI-3从7.8%升至99.9%,ExploitBench达到满分,推理能力提升幅度显著(来源:知乎)。
- 中国开源模型占据全球开源榜前六:Mi-Mo-V2.5、DeepSeek V4 Flash、Hy3、MiniMax M3、GLM-5.2、DeepSeek V4 Pro包揽评测前列,国产开源阵营整体实力领先(来源:无矩AI)。
2. 技术进展
- VLA模型加速机器人智能化:微软研究院指出,面向物理系统的AI模型可将自然语言指令转化为物理行为,使机器人在场景细微变化中迁移经验、自适应调整动作(来源:微软研究院)。
- Kimi K3架构创新受关注:2.8T参数模型基于KDA混合线性注意力与注意力残差技术构建,原生视觉理解并支持1M上下文,被Nature报道称为中国AI的”斯普特尼克时刻”(来源:AI Agent技术社区)。
- 混合线性注意力成为新趋势:新一代模型在保持长上下文能力的同时降低推理成本,参数竞赛进入万亿时代,模型效率与规模并重(来源:阿里云开发者社区)。
3. 产品与市场
- 沐曦曦云C600实现国产供应链闭环:FP8算力达1000 TFLOPS,已完成GLM-5、Qwen3.5等11个模型Day-0适配,验证国产12nm工艺下高端AI芯片的可行性(来源:知乎)。
- 中昊芯英发布第二代TPU”须臾”:混合精度浮点算力达896 TFLOPS,8-bit推理算力1792 TOPS,较前代性能提升3倍,同算力下功耗降低50%(来源:芯师爷)。
- 中科曙光推出640卡超节点:scaleX640采用”一拖二”高密架构,单机柜算力密度提升20倍,HBM总容量81.9TB,构建开放架构的智算新范式(来源:慧博)。
4. 应用落地
- 蓝色光标AI营销规模化产出:AI覆盖公司95%以上作业场景,为约600家客户落地1500个AI驱动营销案例,2024年AI驱动收入达12亿元(来源:腾讯研究院)。
- 蘑菇物联”灵知”大模型优化工业能源:依托云边端一体化架构全方位采集工厂设备数据,通过精准调控能源使用提升生产效率,已服务多家电子制造企业(来源:新浪财经)。
- Google公布185个生成式AI落地案例:案例覆盖客户服务、代码开发、数据分析、安全管理等场景,展示生成式AI在全球各大企业中的广泛应用(来源:卓世科技)。
5. 开源与技术
- 国产开源大模型全球下载破百亿:中国走出不同于硅谷闭源路线的开源创新路径,AI核心产业规模预计突破1.2万亿元,同比增长近30%(来源:新华网)。
- OpenCode开源编码智能体流行:支持在终端、IDE或桌面运行,可连接Claude、GPT、Gemini等任意厂商模型,免费模型内置,降低开发者使用门槛(来源:GitHub)。
- Ollama成为端侧部署主流工具:用Go语言编写,一条命令即可在Windows、macOS、Linux本地安装运行Llama 3、Gemma、Mistral等开源大模型(来源:知乎)。
发表回复