【ALENG 自媒体】9月26日晚间自媒体专稿,过去这一阵,AI 圈最热闹的戏码,不是某家巨头又发布了多么吓人的新模型,而是一群”开源派”集体把底牌亮了出来:不仅把模型权重交给你,连喂给模型的训练数据、训练配方和具体方法,也一并摊在桌面上。听起来像是技术宅的过节,其实这件事,跟每一个将来要用 AI 的人都有关系。
先来说说,什么叫”真正的开源”。
9月3日,由穆罕默德·本·扎耶德人工智能大学(MBZUAI)孵化的基金会模型研究所(IFM)一口气发布了六款名为 K2 Horizon 的大模型,参数从最小的 0.9B 到最大的 375B,覆盖手机、手表到企业级部署。官方毫不谦虚地称这是”AI 史上最大规模的全开源模型舰队”。关键就在”全”字:过去几年,行业里流行的”开源”,大多只是把训练好的权重扔出来,你拿去能跑,却永远不知道它吃了什么数据、又是怎么练成的。K2 Horizon 这次把权重、代码、训练数据和方法论一起公开,IFM 创始人、MBZUAI 校长 Eric Xing 说得很直白:
“开源远不止是开放权重。科学之所以成立,是因为别人能看到数据、复现方法、验证结果,并在这个基础上改进。”
这句话戳中的,正是这几年 AI 领域最别扭的地方:嘴上喊着开放,手里却攥着最金贵的那部分。当一家公司告诉你”我们开源了”,你最好先问一句——到底开了哪扇门。
这股开源潮,在刚刚过去的 9 月格外密集。
9月16日,中科院紫东太初开源了 ZDTaichu5.0-9B,一个面向物理世界的空间多模态模型,号称在多项空间基准上拿下同参数规模全球第一;9月23日,小米开源了 MiMo-V2.6 家族,把多模态、推理和 agent 工具链打包放出;同一天,安全公司 Aikido 基于智谱 GLM 发布了专攻漏洞检测的开源安全模型 Altar 1。一个明显的转向是:开源阵营不再只比谁的基准分数高,而是把”模型 + agent + 垂直场景”整套生态一起端出来,让开发者能真正拿去干活,而不是只能在排行榜上远远看看。
事实上,开源与封闭的拉锯,才是 AI 时代真正的暗战。
站在另一边的是 OpenAI、Anthropic、Google 这些掌握最强模型的封闭巨头。它们并非一无是处,恰恰相反,在能力、安全和对齐上的投入令人尊敬;但当最聪明的模型只攥在少数人手里,并以”安全”为由拒绝完整公开时,普通人就永远只能隔着 API 远远张望。今年 8 月 2 日,欧盟 AI 法案对通用 AI 模型的执法权正式生效,要求大模型披露能耗、训练版权摘要等关键信息——监管的尺子,也在逼着”黑箱”开口。而开源阵营用最朴素的方式回应:你不开口,我们就把门拆了。
令人欣慰的是,这场拆除并不只是理想主义者的自娱。K2 Horizon 里最小的 0.9B 模型小到能跑在一块手表上,最大的 375B 则服务企业级推理;从端侧到云端,开源正在把 AI 从神坛一点点搬到每个人的掌心。一个不懂代码的普通人或许永远不必去翻那些训练数据,但正因为有人能翻、能审、能改,AI 才不会悄悄变成某几家公司的私产。这,或许才是”开源”两个字在今天最值得记住的分量。
【配图】开放的人工智能:当模型连数据与方法都摊在阳光下,AI 才真正属于所有人。