发生了什么

美国法律AI公司哈维以月之暗面最新开放权重模型Kimi K3为基础,开发了其首个后训练开放权重模型Tenet。训练依托约1750个专业化法律工作智能体环境,历时约2个月完成专项优化。

美国AI编程平台Cursor所属公司分别于今年3月、5月推出编程模型Composer 2和2.5,均以Kimi K2.5为基础,通过持续预训练和强化学习提升能力。美国“认知”公司、英国Cosine公司也以Kimi模型为基础,强化软件工程能力。

思维机器实验室研发开放权重模型Inkling时,未直接采用中国模型为基础,但其MoE架构主要沿用DeepSeek V3技术路线,并利用Kimi K2.5等开放权重模型生成合成数据用于首轮监督微调。

为什么重要

过去AI企业追求前沿模型常依赖闭源模型,而Kimi、DeepSeek等中国开放权重模型已进入前沿,提供了新选择。随着AI向智能体演进,后训练更重视任务执行能力,中国模型在真实业务场景训练中展现出实用价值。

开放权重模型还具有成本和控制优势,可自主部署、优化和继续训练,降低推理成本、提高灵活性、减少对API的依赖。中国模型正从产品出海延伸至技术输出,成为全球AI研发的重要技术来源。

关键事实

哈维公司发布的Tenet模型以Kimi K3为基础,专项训练历时约2个月,依托约1750个专业法律智能体环境。

Tenet在综合法律实务任务上的完整完成数量接近原始Kimi K3的两倍,合同起草等专项任务完成数增加约20%,并保留通用法律知识。

Cursor的Composer 2和2.5均以Kimi K2.5为基础;思维机器实验室Inkling的MoE架构沿用DeepSeek V3技术路线,并用Kimi K2.5生成合成数据。

接下来看什么

中国开放权重模型是否将持续扩展在海外垂直领域(如法律、编程)的后训练应用,并进一步影响模型架构研发方向。

随着更多海外企业采用中国模型作为技术底座,全球AI供应链中中国模型的技术地位和合作模式将如何演变。

来源