Aleph Alpha 2026-yil 3-oktyabrda Kolibri nomli yangi katta til modelini chiqardi. Ingliz va nemis tillarida ishlaydigan MoE (Mixture-of-Experts) arxitekturali Transformer modeli jami 78,1 milliard parametrga ega, biroq har bir token uchun shulardan atigi 3,46 milliardi faol ishlaydi. Modelning toʻliq vaznlari Hugging Face platformasida Apache 2.0 litsenziyasi ostida eʻlon qilingan — yaʻni uni yuklab olish, tijoriy maqsadda foydalanish, fine-tuning qilish va on-premise joylashtirish ruxsat etilgan.

Kompaniya relizni Germaniya birlashuvi kuniga (3-oktyabr) toʻgʻrilaganini aytadi:

«On the Day of German Reunification, we are releasing our new model: Kolibri.» — Aleph Alpha rasmiy blogi

Kolibri kompaniyaning «Model Factory» deb atagan avtomatlashtirilgan model oʻrgatish konveyerining mahsuli. Undan oldin xuddi shu konveyer Kolibri Origin prototipida sinovdan oʻtkazilgan: 30,6 milliard parametrli, 65 ming tokenlik kontekst oynali kichik model ommaga chiqarilmagan. Kompaniyaning taʻkidlashicha, ikki reliz orasidagi uch oy ichida parametrlar soni 30 milliarddan 78 milliardga, kontekst uzunligi 65 mingdan 1 million tokengacha, oʻrgatish hajmi esa 7,5 trilliondan 20 trillion tokengacha yetkazilgan. 20 trillion tokenni olish uchun konveyer 200 trilliondan ortiq xom tokenni qayta ishlagan — ular filtrlangan, dublikatlardan tozalangan va saralangan.

Modelning texnik koʻrsatkichlari

Kolibri MoE arxitekturasi tufayli xizmat koʻrsatish narxi bilan sifat oʻrtasidagi muvozanatni maqsad qilgan: kompaniyaning oʻz solishtiruviga koʻra, model ingliz va nemis tillarida sifat-xarajat «Pareto chegarasi»da turadi, yaʻni xuddi shunday narxda undan sifatliroq, xuddi shunday sifatda undan arzonroq model yoʻq. Eng muhim texnik faktlar:

  • jami 78,1 milliard parametr, har bir tokenga 3,46 milliard faol parametr;
  • kontekst uzunligi 1 million tokengacha (eng uzoq oʻrgatilgan uzunlik — 262 144 token);
  • ikki tilli, 128 minglik tokenizer; pre-training tokenlarining 21,3 foizi nemis tilida;
  • bilim chegarasi — 2026-yil 18-iyun;
  • Hugging Face model kartasida reliz sanasi — 2026-yil 3-oktyabr, litsenziya — Apache 2.0.

Arxitektura tafsilotlari ham ochiq: 50 qatlamning barchasi MoE (bitta umumiy ekspert bilan), jami 384 ta ekspert, har bir tokenga 6 tasi faol. Diqqat mexanizmi — 512 oʻlchamli suriluvchi oyna va har beshinchi qatlamda toʻliq diqqat kombinatsiyasi. Pre-training 16 384 tokenlik bazaviy uzunlikda boshlangan.

Kompaniya ikki tillilikka alohida urgʻu beradi: tokenizer nemis va ingliz tillari uchun maxsus ishlab chiqilgan, tarjima qilingan matn kam ishlatilgan (jami 6 foiz), chunki tarjimalar koʻpincha manba tilining madaniy izini olib keladi. Blogda aytilishicha, natija «ingliz tilida oʻrgatilganu, biroz nemischa oʻqigan» model emas, balki dizayni boʻyicha ikki tilli model.

Benchmark natijalari: kompaniyaning oʻz daʻvosi

Kolibri eʻlonida keltirilgan benchmark ballarining barchasi Aleph Alphaʻning oʻz oʻlchovlari; ular mustaqil manbalar tomonidan hali tasdiqlanmagan. Kompaniya jadvalida Kolibri quyidagi natijalarni koʻrsatgan: AIME 2025 — 96,9, AIME 2026 — 96,0, GPQA Diamond — 84,3 (nemischa variantida 81,3). Taqqoslash uchun shu jadvalda Qwen3.6-35B-A3B (AIME 2025 — 84,6), Nemotron 3 Super 120B-A12B (91,7) va Mistral Small 4 119B-A6B (79,8) ham keltirilgan.

Blogning xulosasiga koʻra, Kolibri matematika, kod yozish, grounding va uzoq kontekst vazifalarida faol parametrlari 4 baravar koʻp boʻlgan modellar, jumladan Nemotron 3 Super bilan tenglashadi. Biroq kompaniya ommaviy benchmarklar mijozlarning sohaga xos ehtiyojlarini toʻliq aks ettirmasligini tan oladi — shuning uchun nemis davlat sektori, aviatsiya, ishlab chiqarish va avtomobilsozlik kabi yoʻnalishlar uchun oʻzining ichki baholash toʻplamlari ishlab chiqilgan. Bu ichki testlarda modelning koʻrsatkichlari post-training bosqichlarida barqaror oʻsgani grafiklar bilan koʻrsatilgan, ammo bu maʻlumotlar ham kompaniyaning oʻz hisobotiga asoslanadi va tashqaridan tekshirilmagan.

Oʻrgatish miqyosi haqida blog shunday yozadi: pre-training 20 trillion tokenda, 768 ta NVIDIA B200 GPUʻda 21 kun davom etgan; Kolibri Origin 2026-yil 11-iyunda, Kolibri esa 2026-yil 11-sentyabrda oʻrgatishni yakunlagan. Kompaniyaning aytishicha, shu 21 kun ichida 38 marta rejadan tashqari uzilish boʻlgan — apparat nosozliklari yoki ulanish uzilishlari sababli — va konveyer ularning barchasini inson aralashuvisiz avtomatik bartaraf etgan: klaster oʻrgatishni boshqa tugunlarda qayta ishga tushirgan, jarayon esa eng koʻpi bilan 250 qadam orqadagi checkpointʻdan davom etgan.

«Suveren» model: Yevropa qonunchiligiga moslik

Aleph Alpha Kolibriʻni «suveren» model sifatida joylashtirmoqda: model Germaniyada ishlab chiqilgan, Germaniya va Finlandiyadagi infratuzilmada oʻrgatilgan va Yevropa hamda Germaniya qonunchiligi ostida yaratilgan. Kompaniya model EU AI Act, umumiy maqsadli AI uchun amaliyot kodeksi va GDPR talablarini hisobga olgan holda, mualliflik huquqi masalalariga alohida eʻtibor bilan qurilganini bildiradi.

Maqsadli sohalar — tartibga solinadigan tarmoqlar: davlat boshqaruvi, sanoat va aerokosmik soha. Kompaniyaning bayonoticha, suverenlik ikki oʻlchamni birlashtiradi: model qanday qurilgani va mijozlarga qanday oʻtishi. Modelning kichik va samarali oʻlchami mijozlarga uni ichki maʻlumotlarni uchinchi tomon inference xizmatlariga yubormasdan, on-premise ishga tushirish imkonini beradi. Shuningdek, blogda «Merlin-Arthur» protokoli haqida yoziladi: kontekst javobni qoʻllab-quvvatlamasa, model «bilmayman» deyishga oʻrgatilgan — bu mijozlar soʻragan xususiyat ekani aytiladi. Kompaniya butun taʻminot zanjiri — maʻlumotlarni yigʻish va saralashdan tortib pre-training, post-training va yakuniy baholashgacha — shaffof ekanini taʻkidlaydi.