Három héten belül megnyithatják a Mistral ezermilliárd paraméteres modelljét
A francia Mistral AI kiadta a Mistral Large 4 nevű, ezermilliárd paraméteres multimodális modelljét, amelyet a vállalat az amerikai és kínai fejlesztésekkel szembeni európai alternatívának szán. A rendszer egyelőre nem nyílt súlyú: csak egy nyilvános, biztonsági korlátokkal ellátott végponton keresztül használható. A Mistral a modell súlyait három héten belül tervezi közzétenni, addig megbízható partnerekkel és kormányokkal vizsgálja, hogyan lehet a technológiát védelmi célokra használni, miközben csökkentik a rosszindulatú alkalmazás kockázatát.
A vállalat szerint a biztonsági ellenőrzésre azért is szükség van, mert a nyílt súlyú modellek könnyebben auditálhatók, ugyanakkor visszaélés esetén nehezebb őket korlátozni. Pierre Stock, a Mistral tudományos alelnöke úgy fogalmazott, hogy a fejlesztés célja a védekezést segítő használat, nem pedig a támadások támogatása.
A Large 4-et teljes egészében a Mistral saját számítási kapacitásán tanították, mintegy 4000 Nvidia GPU felhasználásával. Pierre Stock szerint ez két-háromszor kevesebb, mint amennyit kínai versenytársak használnak, és a zárt modellek fejlesztőinek erőforrásainál is jóval kevesebb. A modell fő célterületei a kiberbiztonság és a pénzügy, de a vállalat a chiptervezést is kiemeli. Ez különösen fontos lehet az ASML és a Samsung számára, amelyek a Mistral fő támogatói közé tartoznak; a Samsung vezette legutóbbi finanszírozási körben a céget 21 milliárd euróra értékelték.