跳至内容
1. 重要发布与产品
- GPT-5.6三变体落地,GPT-6多智能体模型内测:OpenAI于7月9日发布GPT-5.6的Sol、Terra、Luna三个变体,实行差异化定价应对开源冲击;同期内测原生支持多Agent协作的GPT-6。(无矩AI)
- Anthropic发布Claude Sonnet 5并大幅降价:新模型BFCL v3准确率89.7%、SWE-Bench Verified达62.4%,API部分场景降价超40%,公司估值升至9650亿美元。(无矩AI)
- Gemini 3.5 Pro亮相30分钟即撤回:Google旗舰模型上下文窗口达200万token、新增”Deep Think”推理模式,因内部代码基准未达标延宕73天,凸显大模型质量一致性难题。(无矩AI)
- xAI密集发布Grok 4.6与4.7:两款模型参数分别达2万亿和2.1万亿,同期开源Grok Build工具链,上线9天GitHub获超2万star。(无矩AI)
2. 技术进展
- 中国开源模型全球排行榜集体登顶:OpenRouter 7月全球月度榜前六名全部为中国模型——小米Mi-Mo-V2.5、DeepSeek V4 Flash、腾讯Hy3、MiniMax M3、智谱GLM-5.2、DeepSeek V4 Pro。(无矩AI)
- 原生多模态与万亿参数成新主线:阿里通义千问Qwen3.8-Max-Preview曝光2.4万亿参数;月之暗面Kimi K3开源2.8万亿参数模型,采用KDA混合线性注意力机制,原生视觉理解,1M上下文。(无矩AI / 知乎)
- 华为”韬(τ)定律”指引后摩尔路径:以”时间缩微”替代”几何缩微”,通过逻辑折叠压缩信号传播时延,提升晶体管密度,为国产半导体与电子系统演进提供新方向。(澎湃新闻)
3. 产品与市场
- 国产AI算力芯片进入体系化竞争:WAIC 2026上华为展出Atlas 950 SuperPoD真机,搭载1024张昇腾卡,扩展至50万卡集群;东方算芯发布全球首颗软件定义近存计算3D芯片DF1000,14nm工艺实现520 TFLOPS@BF16。(与非网)
- 超节点架构成为算力集群新范式:中科曙光scaleX640单机柜640卡高密互联,算力密度提升20倍;阿里云磐久AL128、浪潮元脑SD200、昆仑芯超节点方案集中亮相,支撑万亿参数机内训练。(澎湃新闻 / 与非网)
- NVIDIA Groq 3 LPU催生新型异构推理架构:2026年形成以GPU+LPU+CPU+DPU为特征的推理架构,专用推理芯片与通用GPU协同,提升Token吞吐量与首Token响应速度。(澎湃新闻)
4. 应用落地
- “2025中国AI+应用Top50″案例揭晓:华为、京东、宁德时代、财跃星辰等50家企业从300余家申报中脱颖而出,覆盖制造、金融、能源等场景。(财联社/科创板日报)
- 工业AI聚焦能源优化与质量管控:蘑菇物联”灵知”AI大模型通过云边端一体化架构采集设备数据、精准调控能源使用;中科视语、中工互联聚焦工业智能化,提升生产效率并削减成本。(新浪财经)
- 营销领域AI驱动收入快速增长:蓝色光标”All in AI”战略覆盖95%以上作业场景,2024年AI驱动收入达12亿元,落地1500个AI营销案例,占总收入2%。(钛媒体/Tisi)
5. 开源与技术
- 中国开源模型全球下载量占比达41%首超美国:国产开源大模型全球累计下载量突破100亿次,在模型训练与推理场景中实现规模化选用,开发者真实采用度超越美国开源生态。(新华网 / 无矩AI)
- OpenCode等开源AI编码代理兴起:OpenCode开源代理支持终端、IDE与桌面多端,可接入Claude、GPT、Gemini等任意模型;Hugging Face、ModelScope、Ollama等平台持续降低本地大模型部署门槛。(OpenCode / Toolify)
- OpenAI宣布将推出开源模型:Sam Altman确认GPT5将迈向完全多模态,OpenAI计划推出开源模型,标志着头部闭源厂商对开源浪潮的战略性回应。(OFweek人工智能网)
发表回复