Aleph Alpha、欧州の主権確立を目指すオープンウェイトの78B MoEモデル「Kolibri」をリリース
ドイツのAI企業Aleph Alphaは、総パラメータ数780億、100万トークンのコンテキストウィンドウを備え、EU AI Act(欧州AI規制法)に完全準拠したオープンウェイトのMoEモデル「Kolibri」を発表した。

ドイツのAI開発企業Aleph Alphaは、欧州の技術的主権の確立を掲げて設計されたバイリンガル言語モデル「Kolibri」を正式リリースした。同モデルはオープンウェイトとしてHugging Face上で寛容なApache 2.0ライセンスのもと公開され、欧州全域のエンタープライズおよび公共セクターでの利用をターゲットとしている。
Kolibriは総パラメータ数780億(78B)のMixture-of-Experts(MoE)アーキテクチャを採用しており、推論時にトークンあたり約30億パラメータをアクティブ化する。このアーキテクチャは性能と推論コストのバランスを取るよう設計されており、Aleph Alphaによれば、ドイツ語と英語の双方において品質と運用コストのパレートフロントに位置しているという。
ベンチマーク性能とアーキテクチャ
Kolibriは競争力のある速度と精度を実証しており、ドイツ語のベンチマークで71%のスコアを記録している。Aleph Alphaによると、同モデルはGPT OSS A5B、Qwen 3.6 A3B、Gemma 4 A4Bなどの同等の軽量アクティブパラメータアーキテクチャよりも高速なデコード速度を達成しているとのことだ。
MoE構造に加え、Kolibriは最大100万トークンという広大なコンテキストウィンドウをサポートしており、単一のプロンプトで膨大な文書やエンタープライズデータリポジトリの処理・検索が可能となっている。
トレーニングインフラとデータパイプライン
Kolibriの構築にあたり、Aleph Alphaはドイツおよびフィンランドに位置するデータセンターで、768基のNvidia B200 GPUを用いてモデルのトレーニングを実施した。
事前学習データセットのうちドイツ語コンテンツが21.3%を占めており、これは本プロジェクトのために特別に開発された専用データパイプラインによって支えられている。また、同社はモデルの能力を高めるため、中国語モデルを活用して合成学習データを生成した。
エンタープライズと規制対応への注力
Kolibriは、主に行政機関、航空、産業分野を対象とし、機密性が高く厳格に規制されたセクター向けに明確に調整されている。
Aleph Alphaの最大のセールスポイントはコンプライアンスにある。Kolibriは欧州の法体系のもとで開発され、EU AI Actの要件を念頭にゼロから構築された。厳格な規制への適合とオープンウェイトアーキテクチャを兼ね備えることで、今回のリリースは欧州の組織に対し、域外でホストされているプロプライエタリなモデルに代わる選択肢を提供する。


