Kolibri néven nyílt súlyú AI-modellt ad ki az Aleph Alpha
Az európai mesterségesintelligencia-fejlesztésben mérföldkőnek számító bejelentést tett az Aleph Alpha, amely hivatalosan is kiadta a Kolibri elnevezésű nyelvi modelljét. A német és angol nyelvre optimalizált rendszer szakértők keveréke (mixture-of-experts) architektúrára épül: összesen 78 milliárd paraméterrel rendelkezik, amelyekből tokenenként mintegy 3 milliárd aktív. Az Aleph Alpha közlése szerint a Kolibri a minőség és az üzemeltetési költségek tekintetében a Pareto-fronton helyezkedik el mindkét nyelven, felülmúlva a hasonló felépítésű korábbi modelleket.
A modell tanító adatbázisának 21,3 százalékát német nyelvű források teszik ki, amit a vállalat egy kifejezetten erre a célra épített német adatfolyammal biztosított, emellett kínai modellek által generált szintetikus tanítóadatokat is felhasználtak. A Kolibri akár egymillió token méretű kontextusablakot is képes kezelni. A technikai jelentés szerint a betanítást 768 darab B200-as GPU-n végezték Németországban és Finnországban.
A modellt az európai jogszabályok, különösen az EU AI Act előírásainak szem előtt tartásával fejlesztették ki, ami az európai AI-szuverenitást erősíti. Az Aleph Alpha elsősorban a közigazgatás, a repülés és az ipar számára szánja az új eszközt. A modell súlyai Apache 2.0 licenc alatt, nyíltan és szabadon hozzáférhetők a Hugging Face felületén.