Aleph Alpha发布德国主权AI模型Kolibri,开源权重支持德英双语
德国AI公司Aleph Alpha于2026年10月3日发布开源大语言模型Kolibri,采用混合专家架构,总参数781亿,每个token仅激活34.6亿参数。模型以Apache 2.0许可证发布,权重已在Hugging Face上公开,训练基础设施位于德国和芬兰。该模型针对德语优化,在德语文本处理上比GPT-5分词器节省15%的token,适合需要数据主权和合规性的欧洲用户。
Aleph Alpha发布了名为Kolibri的开源大语言模型,专为德语和英语设计。模型采用混合专家架构,总参数达781亿,但每个token只激活34.6亿参数,计算效率极高。Kolibri于2026年10月3日以Apache 2.0许可证发布,权重已公开在Hugging Face上,训练过程使用了德国和芬兰的基础设施,训练数据约24万亿token,其中超过五分之一为德语。
Aleph Alpha强调Kolibri的"主权"特性:模型在德国开发,训练受欧洲和德国法律约束,无外国控制。客户可以完全自由部署,数据不会离开本地服务器,且模型不会被外部修改或关闭。公司还签署了欧盟通用人工智能行为准则。模型卡显示,训练数据中部分英文文本通过Google的Gemma 4改写,德语文本使用Mistral-NeMo,质量过滤标签来自Qwen3-32B,并针对政治偏见进行了过滤。
Kolibri的独特之处在于其分词器,采用名为UniBPE的新算法,专为处理德语长复合词设计。在德国基本法测试中,Kolibri处理德语文本所需的token比GPT-5的分词器少15%,处理英语时也有优势。模型原生支持262,144个token的上下文窗口,测试中可扩展到1,048,576。权重文件约78GB(FP8格式),分为无、低、中、高四个安全等级。模型包含50层,每层有384个专家和一个共享专家,路由器为每个token选择6个专家。
本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。