
以多语言大语言模型闻名的德国人工智能实验室 Aleph Alpha 刚刚发布了 Kolibri——这是一个拥有 780 亿参数的混合专家模型,在处理每个词元(token)时仅运行其中的一小部分权重。真正让它成为新闻焦点的不是其庞大的体量,而是这些权重以 Apache 2.0 许可证发布,邀请任何人复制、修改和部署该模型,而无需支付许可费用。在由闭源庞然大物主导的格局中,Kolibri 是一个刻意的政治声明:欧洲能够构建并拥有自己的基础模型。
Kolibri 的架构巧妙地兼顾了效率。尽管该模型包含 780 亿个参数,但由于采用了混合专家设计,每个词元大约只有 30 亿个参数被激活。这在降低推理成本的同时,保留了更大密集模型的表达能力。其训练数据中德语占 21%,其余语料库涵盖英语来源,这使 Kolibri 成为服务于国内和全球市场的双语主力工具。
这次训练是一次跨国合作,利用了分布在德国和芬兰数据中心内的 768 个 Nvidia B200 GPU。通过将计算流程保留在欧盟境内,Aleph Alpha 规避了依赖外国云服务商的地缘政治风险——这一担忧多年来一直在欧洲政策界回荡。开源权重的发布也符合欧盟的《人工智能法案》,该法案鼓励透明度并减轻供应商锁定的风险。
从生态系统的角度来看,Kolibri 可能会催生一连串的下游创新。初创公司现在可以微调先进模型,而无需承担从头训练的高昂成本,从而加速在需要德语熟练度的法律科技、医疗保健和金融等垂直领域的应用。此外,开源许可证可能会催生新一代社区驱动的安全工具,因为研究人员可以在没有法律障碍的情况下审查模型行为。
怀疑论者会指出,开源权重模型在微调和部署方面仍然需要大量的计算资源,这可能会将其影响限制在资金雄厚的玩家身上。然而,发布 Kolibri 这一举动本身就迫使业界直面这样一个问题:谁拥有人工智能的未来?如果欧洲能够生产出具有竞争力的、开源许可的基础模型,少数美国公司的垄断地位便开始受到侵蚀,全球人工智能格局也将变得更加多元化。
Kolibri 并非灵丹妙药,但它是一个清晰的转折点。通过将前沿架构与毫不妥协的开放许可模式相结合,Aleph Alpha 正在为一个在技术上具备能力、在政治上实现自主的欧洲人工智能生态系统奠定基础。
图片:valaymtw / Pixabay (https://pixabay.com/photos/web-design-web-developement-website-1080730/)
A recent study reveals Chinese AI models parrot state doctrine, exposing a critical truth: no AI is truly neutral. This forces a reckoning with how national values and political agendas are intrinsically embedded in our most powerful digital agents.

DeepMind proposes a networked AI ecosystem where agents and humans co‑evolve under shared rules, shifting focus from model size to governance.

AI hallucinations are no longer just a digital annoyance. They are spilling over into real-world customer service, breeding dangerous entitlement.

Google replaces its Gems system with open‑standard “Skills,” joining OpenAI and Anthropic in a push toward reusable, agent‑friendly prompts.

评论