Aleph Alpha 釋出 78B 開源權重 MoE 模型 Kolibri,旨在捍衛歐洲技術主權
德國人工智慧公司 Aleph Alpha 推出開源權重混合專家模型 Kolibri,具備 780 億參數、100 萬 token 上下文窗口,並全面符合歐盟《人工智慧法案》。

德國人工智慧開發商 Aleph Alpha 正式釋出 Kolibri,這是一款旨在捍衛歐洲技術主權的開源權重雙語語言模型。該模型採用寬鬆的 Apache 2.0 授權條款並於 Hugging Face 上發布,主要鎖定全歐洲的企業與公部門應用場景。
Kolibri 採用混合專家(MoE)架構,總參數量達 780 億,在推論過程中每個 token 僅啟動約 30 億參數。該架構旨在平衡效能與推論成本,Aleph Alpha 指出,無論在德語還是英語環境下,該模型在品質與營運支出方面皆座落於帕雷托最適前緣(Pareto front)。
基準測試表現與架構
Kolibri 展現出極具競爭力的速度與精確度,在德語基準測試中取得 71% 的成績。根據 Aleph Alpha 的說法,與 GPT OSS A5B、Qwen 3.6 A3B 以及 Gemma 4 A4B 等同級輕量活躍參數架構相比,該模型具備更快的解碼速度。
除了 MoE 架構之外,Kolibri 還支援高達 100 萬 token 的超長上下文窗口,能在單次提示詞中處理與檢索龐大文件及企業資料庫。
訓練基礎設施與資料管線
為了打造 Kolibri,Aleph Alpha 在位於德國與芬蘭的資料中心,使用 768 顆 Nvidia B200 GPU 進行模型訓練。
德語內容占預訓練資料集的 21.3%,並由專門為此專案開發的資料管線提供支援。此外,該公司亦利用中文語言模型生成合成訓練資料,以進一步強化模型能力。
聚焦企業與法規遵循
Kolibri 明確針對敏感且高度受監管的領域量身打造,主要鎖定公共行政、航空以及工業應用。
法規遵循是 Aleph Alpha 的核心賣點:Kolibri 是在歐洲法律架構下開發,並在設計之初便全面考量歐盟《人工智慧法案》(EU AI Act)的要求。藉由提供開源權重架構並兼顧嚴格的法規標準,該模型的推出為歐洲各組織提供了一個取代境外託管專有模型的全新選擇。


