18万公务员接入AI:日本圈定7款国产大模型,主权AI竞赛从口号进入采购季

2026年3月6日,日本数字厅公布了一份名单,7家企业的国产大模型获准进入政府共用生成AI基盘”源内”(GENAI)。5月起,39个中央政府机关的约18万名职员陆续接入这套系统,实证测试持续到2027年3月,正式采购名单将在2027年度敲定。

政府级AI采购,正在成为大模型厂商的新战场。

“七武士”阵容揭晓

入选的7款模型各有来头:恩梯梯数据的tsuzumi、客户云的CC Gov-LLM、KDDI与ELYZA联合开发的Llama-3.1-ELYZA-JP-70B、软银的Sarashina2 mini、NEC的cotomi v3、富士通的Takane 32B、优选网络的PLaMo 2.0 Prime。

日本媒体把这次评选比作黑泽明的”七武士”。筛选标准摆在明面上:日语能力、机密信息安全、本地化部署。

这份名单透露出一个信号:参数规模让位于可控性。Takane 32B与PLaMo 2.0 Prime的体量,和GPT-6、Gemini 3这类旗舰差距明显,但政府场景的首要诉求是数据不出境、行为可审计。

2026年为何被称作智能体爆发年

《环球》杂志调研的多位业内人士给出一致判断:2026年是AI智能体规模化落地的临界点。

支撑这个判断的条件同时成熟了。

模型能力跨过推理门槛。OpenAI o1、DeepSeek-R1、Gemini 3为代表的新一代模型,在复杂推理、长上下文处理、工具调用准确性上大幅跃升。Claude Opus 4.6能连续执行14小时30分钟的长程任务,50%的准确率离完美尚远,已进入可用区间。

工具生态成型。MCP协议、A2A协议与各类企业API标准化,智能体得以接入真实业务系统,摆脱沙盒环境。

成本曲线出现拐点。大模型推理成本两年内下降超过95%,”每个业务流程配一个Agent”在经济账上成立。支付宝用于支付保险的模型,幻觉率从约3%压到0.6%,稳定性达到了企业敢放手的水平。

落地节奏比宣传慢半拍

智能体的成熟应用集中在2026至2028年。这个时间窗的判断来自一线实践者,可信度高于厂商路线图。

智能手机的历史给出参照:2007年iPhone发布,App经济数年后才真正爆发。智能体遵循同样的节奏,基础设施先行,生态随后。真正的”Agent原生应用生态”还需要3到5年。

眼下最先跑通的,集中在客服、销售、数据分析、软件开发这类高频、标准化、可验证的垂直场景。

主权AI的全球棋局

日本的动作只是拼图的一块。各国都在强调主权AI,从制度、法律层面设立过滤机制,差异只在严格程度。

中国已有1028款大模型完成备案,AI安全治理框架3.0即将发布。欧盟AI法案进入执法阶段,违规厂商最高面临3%全球营收的罚款。美国政府则用订单扶持本土生态。

对厂商而言,政府订单意味着三样东西:稳定收入、海量真实场景数据、政策背书。日本2025财年AI预算达4303亿日元,2027年度的正式采购只是开始。

企业和开发者该盯什么

三条线索值得跟进。

日本政府采购的评价维度——日语适配、机密安全、本地部署——正在变成各国政府选型的通用模板。做政企生意的模型公司,照着这份清单打磨产品方向清晰。

18万人的实证测试会产出全球最大规模的政府AI使用数据,2027年的采购结果将直接改写日本国产模型市场格局。

“七武士”中的Llama-3.1-ELYZA-JP-70B基于Meta开源模型微调,开源路线在政府市场的渗透速度超出多数人预期。开源模型的商业空间,正在从极客社区扩展到国家采购单。

主权AI竞赛已经从口号进入采购季。未来两年,政府机关的AI化程度将成为观察各国数字竞争力的新窗口。


评论

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

苏ICP备2025163703号-2   警徽苏公网安备32010502011527号