IFM发布K2 Horizon六模型舰队:0.9B到375B全链路开源,Apache 2.0许可

IFM发布K2 Horizon六模型舰队:0.9B到375B全链路开源,Apache 2.0许可

一次放出一个舰队

9月3日,Institute of Foundation Models(IFM)发布K2 Horizon,一次推出六个互联模型:375B-A23B、36B-A4B、32B、7B、3.7B与0.9B。官方基准显示,K2 Horizon在推理、数学、编码、代理任务与通用能力五个维度上均拿下同尺寸梯队的第一梯队成绩,其中0.9B、3.7B与7B三个小模型直接刷新各自规模级别的最高纪录。这是IFM迄今最完整的一次开源发布,也是开源阵营少见的一次性全家桶。

开源的完整程度是这次发布最不寻常的部分。六个模型的训练生命周期从预训练到推理与代理后训练全部打开:中间checkpoint、训练数据或详细的数据构建配方、开放架构、混合比例、训练代码、配置文件、细粒度训练日志、评估结果与最终权重一应俱全。模型与代码采用Apache 2.0许可,数据集按各自适用的许可发布(如ODC-BY),确实无法再分发的数据则完整披露构建与混合方法。

MoVA注意力机制与36B-A4B

舰队中技术含量最高的是36B-A4B模型,它搭载IFM新提出的Mixture-of-Value-Attention(MoVA)机制。MoVA把注意力计算中的值路径也做成混合专家结构,使每活跃参数的能力密度显著提升,官方数据显示其表现超过部分参数量大得多的模型。对推理成本敏感的部署方来说,36B-A4B的意义在于用4B级别的活跃参数拿到接近70B级别的能力,单位算力的性价比被重新定义。

其余五个模型各司其职:375B-A23B面向旗舰级推理与代理任务,32B定位于企业级通用部署,7B、3.7B与0.9B覆盖从消费级GPU到边缘设备的全谱系。官方称六个模型在边缘到企业的所有部署环境里都能提供有竞争力的表现,舰队内部共享训练数据配方与后训练方法,保证跨尺寸的行为一致性。跨模型协作是舰队命名的含义所在——小模型处理前端交互,大模型接管深度推理。

第一个完整开源的代理模型家族

IFM把K2 Horizon定位为第一个完整开源的代理模型家族:从预训练到代理后训练的全过程都被公开,包括checkpoint、数据、代码、配置与日志。这意味着研究者可以逐阶段观察推理、工具调用、规划与代理能力是如何涌现的,复现培育这些能力的方法,再把方法迁移到新工具、新环境与新领域。开源社区过去只能拿到最终权重,中间过程是黑箱,K2 Horizon把黑箱整个拆开了。

发布时机耐人寻味。9月3日当天,Hacker News讨论区的热门评论是模型疲劳——新模型发布速度已是十年前JavaScript框架的十倍,只是采纳门槛比当年低得多。另有评论指出,宣传语写着Radically Open,落地页却先弹出http登录框,开源诚意需要实际下载验证。更认真的讨论聚焦在开源定义本身:完全开源应当包括全部源码、训练数据及其组织与处理方式,否则用户永远不知道闭源模型底下藏着什么。

对开源生态的实际影响

K2 Horizon的直接竞争对手是Qwen、DeepSeek与GLM系列。过去三个月,开源阵营的军备竞赛从单点旗舰转向全家桶策略:一次发布覆盖全尺寸谱系,配合统一的许可与文档。IFM此番把中间checkpoint与训练日志也放出来,走得更远一步——研究者可以拿0.9B的完整训练曲线做scaling law研究,这是只放最终权重的发布做不到的事情。

对下游应用方,六个模型的Apache 2.0许可意味着商用无需谈判。0.9B与3.7B可以直接跑在手机与IoT设备上,7B与32B适合单卡服务器,375B-A23B则以稀疏激活换取可承受的推理成本。模型权重、训练代码与评估结果已在IFM官方页面全部放出。开源舰队模式的成色,将由接下来几个月的第三方评测与微调生态给出最终答案。